aboutsummaryrefslogtreecommitdiffhomepage
diff options
context:
space:
mode:
-rw-r--r--src/core/SkConvertPixels.cpp16
-rw-r--r--src/core/SkRasterPipelineBlitter.cpp22
-rw-r--r--src/jumper/SkJumper.cpp22
-rw-r--r--src/jumper/SkJumper.h5
-rw-r--r--src/jumper/SkJumper_generated.S12927
-rw-r--r--src/jumper/SkJumper_generated_win.S11154
-rw-r--r--src/jumper/SkJumper_stages.cpp46
7 files changed, 12209 insertions, 11983 deletions
diff --git a/src/core/SkConvertPixels.cpp b/src/core/SkConvertPixels.cpp
index 2ada61f14e..b3a6a06974 100644
--- a/src/core/SkConvertPixels.cpp
+++ b/src/core/SkConvertPixels.cpp
@@ -359,17 +359,16 @@ static void convert_with_pipeline(const SkImageInfo& dstInfo, void* dstRow, size
SkASSERT(premulState == dat || kOpaque_SkAlphaType == srcInfo.alphaType());
// We'll dither if we're decreasing precision below 32-bit.
- int y;
- SkJumper_DitherCtx dither = {&y, 0.0f};
+ float dither_rate = 0.0f;
if (srcInfo.bytesPerPixel() > dstInfo.bytesPerPixel()) {
switch (dstInfo.colorType()) {
- case kRGB_565_SkColorType: dither.rate = 1/63.0f; break;
- case kARGB_4444_SkColorType: dither.rate = 1/15.0f; break;
- default: dither.rate = 0.0f; break;
+ case kRGB_565_SkColorType: dither_rate = 1/63.0f; break;
+ case kARGB_4444_SkColorType: dither_rate = 1/15.0f; break;
+ default: dither_rate = 0.0f; break;
}
}
- if (dither.rate > 0) {
- pipeline.append(SkRasterPipeline::dither, &dither);
+ if (dither_rate > 0) {
+ pipeline.append(SkRasterPipeline::dither, &dither_rate);
}
switch (dstInfo.colorType()) {
@@ -395,8 +394,7 @@ static void convert_with_pipeline(const SkImageInfo& dstInfo, void* dstRow, size
}
auto run = pipeline.compile();
- // This y is declared above when handling dither (which needs to know y).
- for (y = 0; y < srcInfo.height(); ++y) {
+ for (int y = 0; y < srcInfo.height(); ++y) {
run(0,y, srcInfo.width());
// The pipeline has pointers to srcRow and dstRow, so we just need to update them in the
// loop to move between rows of src/dst.
diff --git a/src/core/SkRasterPipelineBlitter.cpp b/src/core/SkRasterPipelineBlitter.cpp
index 2f28eec78c..59fb172170 100644
--- a/src/core/SkRasterPipelineBlitter.cpp
+++ b/src/core/SkRasterPipelineBlitter.cpp
@@ -78,8 +78,7 @@ private:
void* fDstPtr = nullptr;
const void* fMaskPtr = nullptr;
float fCurrentCoverage = 0.0f;
- int fCurrentY = 0;
- SkJumper_DitherCtx fDitherCtx = { &fCurrentY, 0.0f };
+ float fDitherRate = 0.0f;
std::vector<SkPM4f> fShaderBuffer;
@@ -180,7 +179,7 @@ SkBlitter* SkRasterPipelineBlitter::Create(const SkPixmap& dst,
} else {
// If the shader's not constant, it'll need seeding with x,y.
if (!is_constant) {
- colorPipeline->append(SkRasterPipeline::seed_shader, &blitter->fCurrentY);
+ colorPipeline->append(SkRasterPipeline::seed_shader);
}
colorPipeline->extend(shaderPipeline);
}
@@ -197,13 +196,13 @@ SkBlitter* SkRasterPipelineBlitter::Create(const SkPixmap& dst,
if (wants_dither ||
(paint.isDither() && dst.info().colorType() == kRGB_565_SkColorType)) {
switch (dst.info().colorType()) {
- default: blitter->fDitherCtx.rate = 0.0f; break;
- case kRGB_565_SkColorType: blitter->fDitherCtx.rate = 1/63.0f; break;
+ default: blitter->fDitherRate = 0.0f; break;
+ case kRGB_565_SkColorType: blitter->fDitherRate = 1/63.0f; break;
case kRGBA_8888_SkColorType:
- case kBGRA_8888_SkColorType: blitter->fDitherCtx.rate = 1/255.0f; break;
+ case kBGRA_8888_SkColorType: blitter->fDitherRate = 1/255.0f; break;
}
}
- is_constant = is_constant && (blitter->fDitherCtx.rate == 0.0f);
+ is_constant = is_constant && (blitter->fDitherRate == 0.0f);
// We're logically done here. The code between here and return blitter is all optimization.
@@ -263,10 +262,10 @@ void SkRasterPipelineBlitter::append_store(SkRasterPipeline* p) const {
if (fDst.info().gammaCloseToSRGB()) {
p->append(SkRasterPipeline::to_srgb);
}
- if (fDitherCtx.rate > 0.0f) {
+ if (fDitherRate > 0.0f) {
// We dither after any sRGB transfer function to make sure our 1/255.0f is sensible
// over the whole range. If we did it before, 1/255.0f is too big a rate near zero.
- p->append(SkRasterPipeline::dither, &fDitherCtx);
+ p->append(SkRasterPipeline::dither, &fDitherRate);
}
if (fDst.info().colorType() == kBGRA_8888_SkColorType) {
@@ -305,7 +304,6 @@ void SkRasterPipelineBlitter::maybe_shade(int x, int y, int w) {
void SkRasterPipelineBlitter::blitH(int x, int y, int w) {
fDstPtr = fDst.writable_addr(0,y);
- fCurrentY = y;
if (fCanMemsetInBlitH) {
switch (fDst.shiftPerPixel()) {
@@ -323,7 +321,7 @@ void SkRasterPipelineBlitter::blitH(int x, int y, int w) {
if (fBlend == SkBlendMode::kSrcOver
&& fDst.info().colorType() == kRGBA_8888_SkColorType
&& !fDst.colorSpace()
- && fDitherCtx.rate == 0.0f) {
+ && fDitherRate == 0.0f) {
p.append(SkRasterPipeline::srcover_rgba_8888, &fDstPtr);
} else {
if (fBlend != SkBlendMode::kSrc) {
@@ -358,7 +356,6 @@ void SkRasterPipelineBlitter::blitAntiH(int x, int y, const SkAlpha aa[], const
}
fDstPtr = fDst.writable_addr(0,y);
- fCurrentY = y;
for (int16_t run = *runs; run > 0; run = *runs) {
switch (*aa) {
case 0x00: break;
@@ -411,7 +408,6 @@ void SkRasterPipelineBlitter::blitMask(const SkMask& mask, const SkIRect& clip)
int x = clip.left();
for (int y = clip.top(); y < clip.bottom(); y++) {
fDstPtr = fDst.writable_addr(0,y);
- fCurrentY = y;
this->maybe_shade(x,y,clip.width());
switch (mask.fFormat) {
diff --git a/src/jumper/SkJumper.cpp b/src/jumper/SkJumper.cpp
index 6593888d78..b94694680e 100644
--- a/src/jumper/SkJumper.cpp
+++ b/src/jumper/SkJumper.cpp
@@ -43,24 +43,24 @@ extern "C" {
// We'll just run portable code.
#elif defined(__aarch64__)
- void ASM(start_pipeline,aarch64)(size_t, void**, K*, size_t);
+ void ASM(start_pipeline,aarch64)(size_t,size_t,size_t, void**, K*);
StageFn ASM(just_return,aarch64);
#define M(st) StageFn ASM(st,aarch64);
SK_RASTER_PIPELINE_STAGES(M)
#undef M
#elif defined(__arm__)
- void ASM(start_pipeline,vfp4)(size_t, void**, K*, size_t);
+ void ASM(start_pipeline,vfp4)(size_t,size_t,size_t, void**, K*);
StageFn ASM(just_return,vfp4);
#define M(st) StageFn ASM(st,vfp4);
SK_RASTER_PIPELINE_STAGES(M)
#undef M
#elif defined(__x86_64__) || defined(_M_X64)
- void ASM(start_pipeline,hsw )(size_t, void**, K*, size_t);
- void ASM(start_pipeline,avx )(size_t, void**, K*, size_t);
- void ASM(start_pipeline,sse41)(size_t, void**, K*, size_t);
- void ASM(start_pipeline,sse2 )(size_t, void**, K*, size_t);
+ void ASM(start_pipeline,hsw )(size_t,size_t,size_t, void**, K*);
+ void ASM(start_pipeline,avx )(size_t,size_t,size_t, void**, K*);
+ void ASM(start_pipeline,sse41)(size_t,size_t,size_t, void**, K*);
+ void ASM(start_pipeline,sse2 )(size_t,size_t,size_t, void**, K*);
StageFn ASM(just_return,hsw),
ASM(just_return,avx),
@@ -82,7 +82,7 @@ extern "C" {
#endif
// Portable, single-pixel stages.
- void sk_start_pipeline(size_t, void**, K*, size_t);
+ void sk_start_pipeline(size_t,size_t,size_t, void**, K*);
StageFn sk_just_return;
#define M(st) StageFn sk_##st;
SK_RASTER_PIPELINE_STAGES(M)
@@ -96,7 +96,7 @@ static const int kNumStages = SK_RASTER_PIPELINE_STAGES(M);
// Engines comprise everything we need to run SkRasterPipelines.
struct SkJumper_Engine {
StageFn* stages[kNumStages];
- void (*start_pipeline)(size_t, void**, K*, size_t);
+ void (*start_pipeline)(size_t,size_t,size_t, void**, K*);
StageFn* just_return;
};
@@ -192,10 +192,9 @@ void SkRasterPipeline::run(size_t x, size_t y, size_t n) const {
// Best to not use fAlloc here... we can't bound how often run() will be called.
SkAutoSTMalloc<64, void*> program(fSlotsNeeded);
- const size_t limit = x+n;
BuildPipeline(fStages, gEngine, program.get() + fSlotsNeeded);
- gEngine.start_pipeline(x, program.get(), &kConstants, limit);
+ gEngine.start_pipeline(x,y,x+n, program.get(), &kConstants);
}
std::function<void(size_t, size_t, size_t)> SkRasterPipeline::compile() const {
@@ -208,7 +207,6 @@ std::function<void(size_t, size_t, size_t)> SkRasterPipeline::compile() const {
BuildPipeline(fStages, gEngine, program + fSlotsNeeded);
return [=](size_t x, size_t y, size_t n) {
- const size_t limit = x+n;
- gEngine.start_pipeline(x, program, &kConstants, limit);
+ gEngine.start_pipeline(x,y,x+n, program, &kConstants);
};
}
diff --git a/src/jumper/SkJumper.h b/src/jumper/SkJumper.h
index 7d6d0afa31..8e1dd35300 100644
--- a/src/jumper/SkJumper.h
+++ b/src/jumper/SkJumper.h
@@ -95,11 +95,6 @@ struct SkJumper_ParametricTransferFunction {
float G, A,B,C,D,E,F;
};
-struct SkJumper_DitherCtx {
- const int* y;
- float rate;
-};
-
struct SkJumper_GradientCtx {
size_t stopCount;
float* fs[4];
diff --git a/src/jumper/SkJumper_generated.S b/src/jumper/SkJumper_generated.S
index aebbeb4754..8379663481 100644
--- a/src/jumper/SkJumper_generated.S
+++ b/src/jumper/SkJumper_generated.S
@@ -28,21 +28,23 @@ HIDDEN _sk_start_pipeline_aarch64
.globl _sk_start_pipeline_aarch64
FUNCTION(_sk_start_pipeline_aarch64)
_sk_start_pipeline_aarch64:
- .long 0xf81d0ff6 // str x22, [sp, #-48]!
- .long 0xa90153f5 // stp x21, x20, [sp, #16]
- .long 0xa9027bf3 // stp x19, x30, [sp, #32]
- .long 0xaa0103f3 // mov x19, x1
- .long 0xf8408664 // ldr x4, [x19], #8
- .long 0xaa0003f6 // mov x22, x0
- .long 0xaa0303f5 // mov x21, x3
- .long 0x910012c8 // add x8, x22, #0x4
- .long 0xeb15011f // cmp x8, x21
- .long 0xaa0203f4 // mov x20, x2
- .long 0x54000069 // b.ls 34 <sk_start_pipeline_aarch64+0x34> // b.plast
- .long 0xaa1603e0 // mov x0, x22
- .long 0x14000016 // b 88 <sk_start_pipeline_aarch64+0x88>
- .long 0xf90007e4 // str x4, [sp, #8]
- .long 0xf94007e4 // ldr x4, [sp, #8]
+ .long 0xd10103ff // sub sp, sp, #0x40
+ .long 0xa9015bf7 // stp x23, x22, [sp, #16]
+ .long 0xa90253f5 // stp x21, x20, [sp, #32]
+ .long 0xa9037bf3 // stp x19, x30, [sp, #48]
+ .long 0xaa0303f4 // mov x20, x3
+ .long 0xf8408685 // ldr x5, [x20], #8
+ .long 0xaa0003f7 // mov x23, x0
+ .long 0xaa0203f6 // mov x22, x2
+ .long 0x910012e8 // add x8, x23, #0x4
+ .long 0xaa0403f3 // mov x19, x4
+ .long 0xeb16011f // cmp x8, x22
+ .long 0xaa0103f5 // mov x21, x1
+ .long 0x54000069 // b.ls 3c <sk_start_pipeline_aarch64+0x3c> // b.plast
+ .long 0xaa1703e2 // mov x2, x23
+ .long 0x14000017 // b 94 <sk_start_pipeline_aarch64+0x94>
+ .long 0xf90007e5 // str x5, [sp, #8]
+ .long 0xf94007e5 // ldr x5, [sp, #8]
.long 0x6f00e400 // movi v0.2d, #0x0
.long 0x6f00e401 // movi v1.2d, #0x0
.long 0x6f00e402 // movi v2.2d, #0x0
@@ -51,23 +53,26 @@ _sk_start_pipeline_aarch64:
.long 0x6f00e405 // movi v5.2d, #0x0
.long 0x6f00e406 // movi v6.2d, #0x0
.long 0x6f00e407 // movi v7.2d, #0x0
- .long 0xaa1603e0 // mov x0, x22
- .long 0xaa1303e1 // mov x1, x19
- .long 0xaa1403e2 // mov x2, x20
- .long 0xaa1f03e3 // mov x3, xzr
- .long 0xd63f0080 // blr x4
- .long 0xf94007e4 // ldr x4, [sp, #8]
- .long 0x910012c0 // add x0, x22, #0x4
- .long 0x910022c8 // add x8, x22, #0x8
- .long 0xeb15011f // cmp x8, x21
- .long 0xaa0003f6 // mov x22, x0
- .long 0x54fffda9 // b.ls 38 <sk_start_pipeline_aarch64+0x38> // b.plast
- .long 0xcb0002a3 // sub x3, x21, x0
- .long 0xb40001e3 // cbz x3, c8 <sk_start_pipeline_aarch64+0xc8>
- .long 0xaa1303e1 // mov x1, x19
- .long 0xaa1403e2 // mov x2, x20
- .long 0xa9427bf3 // ldp x19, x30, [sp, #32]
- .long 0xa94153f5 // ldp x21, x20, [sp, #16]
+ .long 0xaa1303e0 // mov x0, x19
+ .long 0xaa1403e1 // mov x1, x20
+ .long 0xaa1703e2 // mov x2, x23
+ .long 0xaa1503e3 // mov x3, x21
+ .long 0xaa1f03e4 // mov x4, xzr
+ .long 0xd63f00a0 // blr x5
+ .long 0xf94007e5 // ldr x5, [sp, #8]
+ .long 0x910012e2 // add x2, x23, #0x4
+ .long 0x910022e8 // add x8, x23, #0x8
+ .long 0xeb16011f // cmp x8, x22
+ .long 0xaa0203f7 // mov x23, x2
+ .long 0x54fffd89 // b.ls 40 <sk_start_pipeline_aarch64+0x40> // b.plast
+ .long 0xcb0202c4 // sub x4, x22, x2
+ .long 0xb4000224 // cbz x4, dc <sk_start_pipeline_aarch64+0xdc>
+ .long 0xaa1303e0 // mov x0, x19
+ .long 0xaa1403e1 // mov x1, x20
+ .long 0xaa1503e3 // mov x3, x21
+ .long 0xa9437bf3 // ldp x19, x30, [sp, #48]
+ .long 0xa94253f5 // ldp x21, x20, [sp, #32]
+ .long 0xa9415bf7 // ldp x23, x22, [sp, #16]
.long 0x6f00e400 // movi v0.2d, #0x0
.long 0x6f00e401 // movi v1.2d, #0x0
.long 0x6f00e402 // movi v2.2d, #0x0
@@ -76,11 +81,12 @@ _sk_start_pipeline_aarch64:
.long 0x6f00e405 // movi v5.2d, #0x0
.long 0x6f00e406 // movi v6.2d, #0x0
.long 0x6f00e407 // movi v7.2d, #0x0
- .long 0xf84307f6 // ldr x22, [sp], #48
- .long 0xd61f0080 // br x4
- .long 0xa9427bf3 // ldp x19, x30, [sp, #32]
- .long 0xa94153f5 // ldp x21, x20, [sp, #16]
- .long 0xf84307f6 // ldr x22, [sp], #48
+ .long 0x910103ff // add sp, sp, #0x40
+ .long 0xd61f00a0 // br x5
+ .long 0xa9437bf3 // ldp x19, x30, [sp, #48]
+ .long 0xa94253f5 // ldp x21, x20, [sp, #32]
+ .long 0xa9415bf7 // ldp x23, x22, [sp, #16]
+ .long 0x910103ff // add sp, sp, #0x40
.long 0xd65f03c0 // ret
HIDDEN _sk_just_return_aarch64
@@ -93,80 +99,79 @@ HIDDEN _sk_seed_shader_aarch64
.globl _sk_seed_shader_aarch64
FUNCTION(_sk_seed_shader_aarch64)
_sk_seed_shader_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
- .long 0x3dc00046 // ldr q6, [x2]
- .long 0x4e040c00 // dup v0.4s, w0
- .long 0x4f0167e7 // movi v7.4s, #0x3f, lsl #24
- .long 0x4d40c901 // ld1r {v1.4s}, [x8]
+ .long 0x3dc00007 // ldr q7, [x0]
+ .long 0x4e040c40 // dup v0.4s, w2
+ .long 0xf8408425 // ldr x5, [x1], #8
+ .long 0x4f0167e1 // movi v1.4s, #0x3f, lsl #24
+ .long 0x4e040c66 // dup v6.4s, w3
.long 0x4e21d800 // scvtf v0.4s, v0.4s
- .long 0x4e27d400 // fadd v0.4s, v0.4s, v7.4s
+ .long 0x4e21d8c6 // scvtf v6.4s, v6.4s
+ .long 0x4e21d400 // fadd v0.4s, v0.4s, v1.4s
.long 0x4f03f602 // fmov v2.4s, #1.000000000000000000e+00
- .long 0x4e21d821 // scvtf v1.4s, v1.4s
.long 0x6f00e403 // movi v3.2d, #0x0
.long 0x6f00e404 // movi v4.2d, #0x0
.long 0x6f00e405 // movi v5.2d, #0x0
- .long 0x4e26d400 // fadd v0.4s, v0.4s, v6.4s
+ .long 0x4e21d4c1 // fadd v1.4s, v6.4s, v1.4s
.long 0x6f00e406 // movi v6.2d, #0x0
- .long 0x4e27d421 // fadd v1.4s, v1.4s, v7.4s
+ .long 0x4e27d400 // fadd v0.4s, v0.4s, v7.4s
.long 0x6f00e407 // movi v7.2d, #0x0
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_dither_aarch64
.globl _sk_dither_aarch64
FUNCTION(_sk_dither_aarch64)
_sk_dither_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
- .long 0x3dc00851 // ldr q17, [x2, #32]
- .long 0x4e040c10 // dup v16.4s, w0
- .long 0x4f000432 // movi v18.4s, #0x1
- .long 0xf9400109 // ldr x9, [x8]
- .long 0x4f000454 // movi v20.4s, #0x2
+ .long 0x3dc00811 // ldr q17, [x0, #32]
+ .long 0x4e040c50 // dup v16.4s, w2
+ .long 0x4e040c72 // dup v18.4s, w3
+ .long 0x4f000433 // movi v19.4s, #0x1
+ .long 0x4f000455 // movi v21.4s, #0x2
.long 0x4eb08630 // add v16.4s, v17.4s, v16.4s
- .long 0x4e321e11 // and v17.16b, v16.16b, v18.16b
- .long 0x4d40c935 // ld1r {v21.4s}, [x9]
- .long 0x4e341e16 // and v22.16b, v16.16b, v20.16b
- .long 0x4f000493 // movi v19.4s, #0x4
- .long 0x4f245631 // shl v17.4s, v17.4s, #4
- .long 0x4f2156d6 // shl v22.4s, v22.4s, #1
- .long 0x4eb11ed1 // orr v17.16b, v22.16b, v17.16b
- .long 0x4e331e16 // and v22.16b, v16.16b, v19.16b
- .long 0x6e351e10 // eor v16.16b, v16.16b, v21.16b
- .long 0x6f3e06d6 // ushr v22.4s, v22.4s, #2
- .long 0x4e321e12 // and v18.16b, v16.16b, v18.16b
- .long 0x4eb61e31 // orr v17.16b, v17.16b, v22.16b
- .long 0x4e341e14 // and v20.16b, v16.16b, v20.16b
- .long 0x4f255652 // shl v18.4s, v18.4s, #5
- .long 0x4e331e10 // and v16.16b, v16.16b, v19.16b
- .long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b
- .long 0x4f225694 // shl v20.4s, v20.4s, #2
- .long 0x52a79009 // mov w9, #0x3c800000
- .long 0xbd400912 // ldr s18, [x8, #8]
- .long 0x6f3f0610 // ushr v16.4s, v16.4s, #1
- .long 0x4eb41e31 // orr v17.16b, v17.16b, v20.16b
- .long 0x4e040d36 // dup v22.4s, w9
+ .long 0x4f000494 // movi v20.4s, #0x4
+ .long 0x52a79008 // mov w8, #0x3c800000
+ .long 0x6e301e51 // eor v17.16b, v18.16b, v16.16b
+ .long 0x4e331e12 // and v18.16b, v16.16b, v19.16b
+ .long 0x4e351e17 // and v23.16b, v16.16b, v21.16b
+ .long 0x4e040d16 // dup v22.4s, w8
+ .long 0x4e341e10 // and v16.16b, v16.16b, v20.16b
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
+ .long 0x4f245652 // shl v18.4s, v18.4s, #4
+ .long 0x4f2156f7 // shl v23.4s, v23.4s, #1
+ .long 0x4e331e33 // and v19.16b, v17.16b, v19.16b
+ .long 0x4eb21ef2 // orr v18.16b, v23.16b, v18.16b
+ .long 0x6f3e0610 // ushr v16.4s, v16.4s, #2
+ .long 0x4e351e35 // and v21.16b, v17.16b, v21.16b
+ .long 0x4eb01e50 // orr v16.16b, v18.16b, v16.16b
+ .long 0x4f255673 // shl v19.4s, v19.4s, #5
+ .long 0x4e341e31 // and v17.16b, v17.16b, v20.16b
+ .long 0x4f2256b5 // shl v21.4s, v21.4s, #2
+ .long 0x4eb31e10 // orr v16.16b, v16.16b, v19.16b
+ .long 0xbd400117 // ldr s23, [x8]
+ .long 0x6f3f0631 // ushr v17.4s, v17.4s, #1
+ .long 0x4eb51e10 // orr v16.16b, v16.16b, v21.16b
.long 0x52b7df89 // mov w9, #0xbefc0000
- .long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0x4e040d35 // dup v21.4s, w9
+ .long 0x4eb11e10 // orr v16.16b, v16.16b, v17.16b
+ .long 0x4e040d34 // dup v20.4s, w9
.long 0x4e21da10 // scvtf v16.4s, v16.4s
- .long 0x4e30ced5 // fmla v21.4s, v22.4s, v16.4s
- .long 0x4f9292b0 // fmul v16.4s, v21.4s, v18.s[0]
+ .long 0x4e30ced4 // fmla v20.4s, v22.4s, v16.4s
+ .long 0x4f979290 // fmul v16.4s, v20.4s, v23.s[0]
.long 0x4e20d600 // fadd v0.4s, v16.4s, v0.4s
.long 0x4e21d601 // fadd v1.4s, v16.4s, v1.4s
.long 0x4e22d602 // fadd v2.4s, v16.4s, v2.4s
- .long 0x6f00e413 // movi v19.2d, #0x0
+ .long 0x6f00e412 // movi v18.2d, #0x0
.long 0x4ea3f400 // fmin v0.4s, v0.4s, v3.4s
.long 0x4ea3f421 // fmin v1.4s, v1.4s, v3.4s
.long 0x4ea3f442 // fmin v2.4s, v2.4s, v3.4s
- .long 0x4e20f660 // fmax v0.4s, v19.4s, v0.4s
- .long 0x4e21f661 // fmax v1.4s, v19.4s, v1.4s
- .long 0x4e22f662 // fmax v2.4s, v19.4s, v2.4s
- .long 0xd61f0080 // br x4
+ .long 0x4e20f640 // fmax v0.4s, v18.4s, v0.4s
+ .long 0x4e21f641 // fmax v1.4s, v18.4s, v1.4s
+ .long 0x4e22f642 // fmax v2.4s, v18.4s, v2.4s
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_constant_color_aarch64
.globl _sk_constant_color_aarch64
FUNCTION(_sk_constant_color_aarch64)
_sk_constant_color_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803ea // mov x10, x8
.long 0x4ddfc940 // ld1r {v0.4s}, [x10], #4
.long 0x91002109 // add x9, x8, #0x8
@@ -174,16 +179,16 @@ _sk_constant_color_aarch64:
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0x4d40c903 // ld1r {v3.4s}, [x8]
.long 0x4d40c941 // ld1r {v1.4s}, [x10]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_load_rgba_aarch64
.globl _sk_load_rgba_aarch64
FUNCTION(_sk_load_rgba_aarch64)
_sk_load_rgba_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xad400500 // ldp q0, q1, [x8]
.long 0xad410d02 // ldp q2, q3, [x8, #32]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_store_rgba_aarch64
.globl _sk_store_rgba_aarch64
@@ -192,20 +197,20 @@ _sk_store_rgba_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xad000500 // stp q0, q1, [x8]
.long 0xad010d02 // stp q2, q3, [x8, #32]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_clear_aarch64
.globl _sk_clear_aarch64
FUNCTION(_sk_clear_aarch64)
_sk_clear_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6f00e400 // movi v0.2d, #0x0
.long 0x6f00e401 // movi v1.2d, #0x0
.long 0x6f00e402 // movi v2.2d, #0x0
.long 0x6f00e403 // movi v3.2d, #0x0
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_srcatop_aarch64
.globl _sk_srcatop_aarch64
@@ -216,14 +221,14 @@ _sk_srcatop_aarch64:
.long 0x6e27dc21 // fmul v1.4s, v1.4s, v7.4s
.long 0x6e27dc42 // fmul v2.4s, v2.4s, v7.4s
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e30cc80 // fmla v0.4s, v4.4s, v16.4s
.long 0x4e30cca1 // fmla v1.4s, v5.4s, v16.4s
.long 0x4e30ccc2 // fmla v2.4s, v6.4s, v16.4s
.long 0x6e27de10 // fmul v16.4s, v16.4s, v7.4s
.long 0x4e23ccf0 // fmla v16.4s, v7.4s, v3.4s
.long 0x4eb01e03 // mov v3.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_dstatop_aarch64
.globl _sk_dstatop_aarch64
@@ -231,7 +236,7 @@ FUNCTION(_sk_dstatop_aarch64)
_sk_dstatop_aarch64:
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4ea7d610 // fsub v16.4s, v16.4s, v7.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e20de00 // fmul v0.4s, v16.4s, v0.4s
.long 0x6e21de01 // fmul v1.4s, v16.4s, v1.4s
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
@@ -241,75 +246,75 @@ _sk_dstatop_aarch64:
.long 0x4e23cca1 // fmla v1.4s, v5.4s, v3.4s
.long 0x4e23ccc2 // fmla v2.4s, v6.4s, v3.4s
.long 0x4eb01e03 // mov v3.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_srcin_aarch64
.globl _sk_srcin_aarch64
FUNCTION(_sk_srcin_aarch64)
_sk_srcin_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e27dc00 // fmul v0.4s, v0.4s, v7.4s
.long 0x6e27dc21 // fmul v1.4s, v1.4s, v7.4s
.long 0x6e27dc42 // fmul v2.4s, v2.4s, v7.4s
.long 0x6e27dc63 // fmul v3.4s, v3.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_dstin_aarch64
.globl _sk_dstin_aarch64
FUNCTION(_sk_dstin_aarch64)
_sk_dstin_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e24dc60 // fmul v0.4s, v3.4s, v4.4s
.long 0x6e25dc61 // fmul v1.4s, v3.4s, v5.4s
.long 0x6e26dc62 // fmul v2.4s, v3.4s, v6.4s
.long 0x6e27dc63 // fmul v3.4s, v3.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_srcout_aarch64
.globl _sk_srcout_aarch64
FUNCTION(_sk_srcout_aarch64)
_sk_srcout_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4ea7d610 // fsub v16.4s, v16.4s, v7.4s
.long 0x6e20de00 // fmul v0.4s, v16.4s, v0.4s
.long 0x6e21de01 // fmul v1.4s, v16.4s, v1.4s
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
.long 0x6e23de03 // fmul v3.4s, v16.4s, v3.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_dstout_aarch64
.globl _sk_dstout_aarch64
FUNCTION(_sk_dstout_aarch64)
_sk_dstout_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4f03f600 // fmov v0.4s, #1.000000000000000000e+00
.long 0x4ea3d403 // fsub v3.4s, v0.4s, v3.4s
.long 0x6e24dc60 // fmul v0.4s, v3.4s, v4.4s
.long 0x6e25dc61 // fmul v1.4s, v3.4s, v5.4s
.long 0x6e26dc62 // fmul v2.4s, v3.4s, v6.4s
.long 0x6e27dc63 // fmul v3.4s, v3.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_srcover_aarch64
.globl _sk_srcover_aarch64
FUNCTION(_sk_srcover_aarch64)
_sk_srcover_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x4e24ce00 // fmla v0.4s, v16.4s, v4.4s
.long 0x4e25ce01 // fmla v1.4s, v16.4s, v5.4s
.long 0x4e26ce02 // fmla v2.4s, v16.4s, v6.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_dstover_aarch64
.globl _sk_dstover_aarch64
FUNCTION(_sk_dstover_aarch64)
_sk_dstover_aarch64:
.long 0x4f03f611 // fmov v17.4s, #1.000000000000000000e+00
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea41c90 // mov v16.16b, v4.16b
.long 0x4ea7d634 // fsub v20.4s, v17.4s, v7.4s
.long 0x4ea51cb1 // mov v17.16b, v5.16b
@@ -323,18 +328,18 @@ _sk_dstover_aarch64:
.long 0x4eb11e21 // mov v1.16b, v17.16b
.long 0x4eb21e42 // mov v2.16b, v18.16b
.long 0x4eb31e63 // mov v3.16b, v19.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_modulate_aarch64
.globl _sk_modulate_aarch64
FUNCTION(_sk_modulate_aarch64)
_sk_modulate_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e24dc00 // fmul v0.4s, v0.4s, v4.4s
.long 0x6e25dc21 // fmul v1.4s, v1.4s, v5.4s
.long 0x6e26dc42 // fmul v2.4s, v2.4s, v6.4s
.long 0x6e27dc63 // fmul v3.4s, v3.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_multiply_aarch64
.globl _sk_multiply_aarch64
@@ -347,7 +352,7 @@ _sk_multiply_aarch64:
.long 0x6e21de71 // fmul v17.4s, v19.4s, v1.4s
.long 0x6e22de72 // fmul v18.4s, v19.4s, v2.4s
.long 0x6e23de73 // fmul v19.4s, v19.4s, v3.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e34cc90 // fmla v16.4s, v4.4s, v20.4s
.long 0x4e34ccb1 // fmla v17.4s, v5.4s, v20.4s
.long 0x4e34ccd2 // fmla v18.4s, v6.4s, v20.4s
@@ -360,24 +365,24 @@ _sk_multiply_aarch64:
.long 0x4eb11e21 // mov v1.16b, v17.16b
.long 0x4eb21e42 // mov v2.16b, v18.16b
.long 0x4eb31e63 // mov v3.16b, v19.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_plus__aarch64
.globl _sk_plus__aarch64
FUNCTION(_sk_plus__aarch64)
_sk_plus__aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e24d400 // fadd v0.4s, v0.4s, v4.4s
.long 0x4e25d421 // fadd v1.4s, v1.4s, v5.4s
.long 0x4e26d442 // fadd v2.4s, v2.4s, v6.4s
.long 0x4e27d463 // fadd v3.4s, v3.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_screen_aarch64
.globl _sk_screen_aarch64
FUNCTION(_sk_screen_aarch64)
_sk_screen_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e24d410 // fadd v16.4s, v0.4s, v4.4s
.long 0x4e25d431 // fadd v17.4s, v1.4s, v5.4s
.long 0x4e26d452 // fadd v18.4s, v2.4s, v6.4s
@@ -390,14 +395,14 @@ _sk_screen_aarch64:
.long 0x4eb11e21 // mov v1.16b, v17.16b
.long 0x4eb21e42 // mov v2.16b, v18.16b
.long 0x4eb31e63 // mov v3.16b, v19.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_xor__aarch64
.globl _sk_xor__aarch64
FUNCTION(_sk_xor__aarch64)
_sk_xor__aarch64:
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea7d611 // fsub v17.4s, v16.4s, v7.4s
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x6e20de20 // fmul v0.4s, v17.4s, v0.4s
@@ -408,7 +413,7 @@ _sk_xor__aarch64:
.long 0x4e30cca1 // fmla v1.4s, v5.4s, v16.4s
.long 0x4e30ccc2 // fmla v2.4s, v6.4s, v16.4s
.long 0x4e30cce3 // fmla v3.4s, v7.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_darken_aarch64
.globl _sk_darken_aarch64
@@ -420,7 +425,7 @@ _sk_darken_aarch64:
.long 0x6e25dc73 // fmul v19.4s, v3.4s, v5.4s
.long 0x4e31f610 // fmax v16.4s, v16.4s, v17.4s
.long 0x4e24d400 // fadd v0.4s, v0.4s, v4.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e27dc51 // fmul v17.4s, v2.4s, v7.4s
.long 0x4e33f652 // fmax v18.4s, v18.4s, v19.4s
.long 0x6e26dc73 // fmul v19.4s, v3.4s, v6.4s
@@ -433,7 +438,7 @@ _sk_darken_aarch64:
.long 0x4eb2d421 // fsub v1.4s, v1.4s, v18.4s
.long 0x4eb1d442 // fsub v2.4s, v2.4s, v17.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_lighten_aarch64
.globl _sk_lighten_aarch64
@@ -445,7 +450,7 @@ _sk_lighten_aarch64:
.long 0x6e25dc73 // fmul v19.4s, v3.4s, v5.4s
.long 0x4eb1f610 // fmin v16.4s, v16.4s, v17.4s
.long 0x4e24d400 // fadd v0.4s, v0.4s, v4.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e27dc51 // fmul v17.4s, v2.4s, v7.4s
.long 0x4eb3f652 // fmin v18.4s, v18.4s, v19.4s
.long 0x6e26dc73 // fmul v19.4s, v3.4s, v6.4s
@@ -458,7 +463,7 @@ _sk_lighten_aarch64:
.long 0x4eb2d421 // fsub v1.4s, v1.4s, v18.4s
.long 0x4eb1d442 // fsub v2.4s, v2.4s, v17.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_difference_aarch64
.globl _sk_difference_aarch64
@@ -477,7 +482,7 @@ _sk_difference_aarch64:
.long 0x4eb0d400 // fsub v0.4s, v0.4s, v16.4s
.long 0x4e25d421 // fadd v1.4s, v1.4s, v5.4s
.long 0x4e32d650 // fadd v16.4s, v18.4s, v18.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb3f631 // fmin v17.4s, v17.4s, v19.4s
.long 0x4eb0d421 // fsub v1.4s, v1.4s, v16.4s
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
@@ -486,7 +491,7 @@ _sk_difference_aarch64:
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x4eb1d442 // fsub v2.4s, v2.4s, v17.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_exclusion_aarch64
.globl _sk_exclusion_aarch64
@@ -503,12 +508,12 @@ _sk_exclusion_aarch64:
.long 0x4e26d450 // fadd v16.4s, v2.4s, v6.4s
.long 0x6e26dc42 // fmul v2.4s, v2.4s, v6.4s
.long 0x4e22d442 // fadd v2.4s, v2.4s, v2.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea2d602 // fsub v2.4s, v16.4s, v2.4s
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_colorburn_aarch64
.globl _sk_colorburn_aarch64
@@ -546,7 +551,7 @@ _sk_colorburn_aarch64:
.long 0x4e20cc61 // fmla v1.4s, v3.4s, v0.4s
.long 0x4ea0d840 // fcmeq v0.4s, v2.4s, #0.0
.long 0x4ea3d631 // fsub v17.4s, v17.4s, v3.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e27e490 // fcmeq v16.4s, v4.4s, v7.4s
.long 0x6e611c40 // bsl v0.16b, v2.16b, v1.16b
.long 0x4e31cc92 // fmla v18.4s, v4.4s, v17.4s
@@ -559,7 +564,7 @@ _sk_colorburn_aarch64:
.long 0x6e601e82 // bsl v2.16b, v20.16b, v0.16b
.long 0x4e27ce23 // fmla v3.4s, v17.4s, v7.4s
.long 0x4eb01e00 // mov v0.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_colordodge_aarch64
.globl _sk_colordodge_aarch64
@@ -595,7 +600,7 @@ _sk_colordodge_aarch64:
.long 0x4e23e440 // fcmeq v0.4s, v2.4s, v3.4s
.long 0x6e611c40 // bsl v0.16b, v2.16b, v1.16b
.long 0x4ea3d641 // fsub v1.4s, v18.4s, v3.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea0d890 // fcmeq v16.4s, v4.4s, #0.0
.long 0x4ea0d8b1 // fcmeq v17.4s, v5.4s, #0.0
.long 0x4e21cc93 // fmla v19.4s, v4.4s, v1.4s
@@ -608,7 +613,7 @@ _sk_colordodge_aarch64:
.long 0x4e27cc23 // fmla v3.4s, v1.4s, v7.4s
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x4eb11e21 // mov v1.16b, v17.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_hardlight_aarch64
.globl _sk_hardlight_aarch64
@@ -645,7 +650,7 @@ _sk_hardlight_aarch64:
.long 0x6e21dea1 // fmul v1.4s, v21.4s, v1.4s
.long 0x6e22deb5 // fmul v21.4s, v21.4s, v2.4s
.long 0x6e26dc42 // fmul v2.4s, v2.4s, v6.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e32d652 // fadd v18.4s, v18.4s, v18.4s
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x6e34e474 // fcmge v20.4s, v3.4s, v20.4s
@@ -659,7 +664,7 @@ _sk_hardlight_aarch64:
.long 0x4e36d421 // fadd v1.4s, v1.4s, v22.4s
.long 0x4e34d6a2 // fadd v2.4s, v21.4s, v20.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_overlay_aarch64
.globl _sk_overlay_aarch64
@@ -696,7 +701,7 @@ _sk_overlay_aarch64:
.long 0x6e21dea1 // fmul v1.4s, v21.4s, v1.4s
.long 0x6e22deb5 // fmul v21.4s, v21.4s, v2.4s
.long 0x6e26dc42 // fmul v2.4s, v2.4s, v6.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e32d652 // fadd v18.4s, v18.4s, v18.4s
.long 0x4ea3d610 // fsub v16.4s, v16.4s, v3.4s
.long 0x6e34e4f4 // fcmge v20.4s, v7.4s, v20.4s
@@ -710,7 +715,7 @@ _sk_overlay_aarch64:
.long 0x4e36d421 // fadd v1.4s, v1.4s, v22.4s
.long 0x4e34d6a2 // fadd v2.4s, v21.4s, v20.4s
.long 0x4e27ce03 // fmla v3.4s, v16.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_softlight_aarch64
.globl _sk_softlight_aarch64
@@ -802,7 +807,7 @@ _sk_softlight_aarch64:
.long 0x6e27df7b // fmul v27.4s, v27.4s, v7.4s
.long 0x6e27ded6 // fmul v22.4s, v22.4s, v7.4s
.long 0x6e27df18 // fmul v24.4s, v24.4s, v7.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e37df77 // fmul v23.4s, v27.4s, v23.4s
.long 0x6e3aded6 // fmul v22.4s, v22.4s, v26.4s
.long 0x6e34df14 // fmul v20.4s, v24.4s, v20.4s
@@ -826,7 +831,7 @@ _sk_softlight_aarch64:
.long 0x4e35d421 // fadd v1.4s, v1.4s, v21.4s
.long 0x4e3cd442 // fadd v2.4s, v2.4s, v28.4s
.long 0x4e27ce43 // fmla v3.4s, v18.4s, v7.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_hue_aarch64
.globl _sk_hue_aarch64
@@ -928,7 +933,7 @@ _sk_hue_aarch64:
.long 0x6e35fe31 // fdiv v17.4s, v17.4s, v21.4s
.long 0x6e35fe52 // fdiv v18.4s, v18.4s, v21.4s
.long 0x6e35fe73 // fdiv v19.4s, v19.4s, v21.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb71ee3 // mov v3.16b, v23.16b
.long 0x4eb71efc // mov v28.16b, v23.16b
.long 0x4e31d711 // fadd v17.4s, v24.4s, v17.4s
@@ -945,7 +950,7 @@ _sk_hue_aarch64:
.long 0x4e31d421 // fadd v1.4s, v1.4s, v17.4s
.long 0x4e30d442 // fadd v2.4s, v2.4s, v16.4s
.long 0x4eb4d743 // fsub v3.4s, v26.4s, v20.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_saturation_aarch64
.globl _sk_saturation_aarch64
@@ -1047,7 +1052,7 @@ _sk_saturation_aarch64:
.long 0x6e35fe31 // fdiv v17.4s, v17.4s, v21.4s
.long 0x6e35fe52 // fdiv v18.4s, v18.4s, v21.4s
.long 0x6e35fe73 // fdiv v19.4s, v19.4s, v21.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb71ee3 // mov v3.16b, v23.16b
.long 0x4eb71efc // mov v28.16b, v23.16b
.long 0x4e31d711 // fadd v17.4s, v24.4s, v17.4s
@@ -1064,7 +1069,7 @@ _sk_saturation_aarch64:
.long 0x4e31d421 // fadd v1.4s, v1.4s, v17.4s
.long 0x4e30d442 // fadd v2.4s, v2.4s, v16.4s
.long 0x4eb4d743 // fsub v3.4s, v26.4s, v20.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_color_aarch64
.globl _sk_color_aarch64
@@ -1142,7 +1147,7 @@ _sk_color_aarch64:
.long 0x6e37fe31 // fdiv v17.4s, v17.4s, v23.4s
.long 0x6e37fe73 // fdiv v19.4s, v19.4s, v23.4s
.long 0x6e37fe94 // fdiv v20.4s, v20.4s, v23.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb91f23 // mov v3.16b, v25.16b
.long 0x4eb91f3c // mov v28.16b, v25.16b
.long 0x4e31d6b1 // fadd v17.4s, v21.4s, v17.4s
@@ -1159,7 +1164,7 @@ _sk_color_aarch64:
.long 0x4e31d421 // fadd v1.4s, v1.4s, v17.4s
.long 0x4e32d442 // fadd v2.4s, v2.4s, v18.4s
.long 0x4eb0d703 // fsub v3.4s, v24.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_luminosity_aarch64
.globl _sk_luminosity_aarch64
@@ -1237,7 +1242,7 @@ _sk_luminosity_aarch64:
.long 0x6e33fc00 // fdiv v0.4s, v0.4s, v19.4s
.long 0x6e33fc63 // fdiv v3.4s, v3.4s, v19.4s
.long 0x6e33fe31 // fdiv v17.4s, v17.4s, v19.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb51ea2 // mov v2.16b, v21.16b
.long 0x4eb51ebb // mov v27.16b, v21.16b
.long 0x4e20d680 // fadd v0.4s, v20.4s, v0.4s
@@ -1254,7 +1259,7 @@ _sk_luminosity_aarch64:
.long 0x4e22d421 // fadd v1.4s, v1.4s, v2.4s
.long 0x4e23d742 // fadd v2.4s, v26.4s, v3.4s
.long 0x4eb0d703 // fsub v3.4s, v24.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_srcover_rgba_8888_aarch64
.globl _sk_srcover_rgba_8888_aarch64
@@ -1262,8 +1267,8 @@ FUNCTION(_sk_srcover_rgba_8888_aarch64)
_sk_srcover_rgba_8888_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000908 // add x8, x8, x0, lsl #2
- .long 0xb5000503 // cbnz x3, 1144 <sk_srcover_rgba_8888_aarch64+0xac>
+ .long 0x8b020908 // add x8, x8, x2, lsl #2
+ .long 0xb5000504 // cbnz x4, 1158 <sk_srcover_rgba_8888_aarch64+0xac>
.long 0x3dc00104 // ldr q4, [x8]
.long 0x6f00e625 // movi v5.2d, #0xff000000ff
.long 0x6f380486 // ushr v6.4s, v4.4s, #8
@@ -1298,103 +1303,103 @@ _sk_srcover_rgba_8888_aarch64:
.long 0x6e21a871 // fcvtnu v17.4s, v3.4s
.long 0x4f385631 // shl v17.4s, v17.4s, #24
.long 0x4eb11e10 // orr v16.16b, v16.16b, v17.16b
- .long 0xb5000283 // cbnz x3, 1180 <sk_srcover_rgba_8888_aarch64+0xe8>
+ .long 0xb5000284 // cbnz x4, 1194 <sk_srcover_rgba_8888_aarch64+0xe8>
.long 0x3d800110 // str q16, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x6f00e404 // movi v4.2d, #0x0
- .long 0x54000140 // b.eq 1178 <sk_srcover_rgba_8888_aarch64+0xe0> // b.none
+ .long 0x54000140 // b.eq 118c <sk_srcover_rgba_8888_aarch64+0xe0> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 1170 <sk_srcover_rgba_8888_aarch64+0xd8> // b.none
+ .long 0x540000c0 // b.eq 1184 <sk_srcover_rgba_8888_aarch64+0xd8> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffa61 // b.ne 10ac <sk_srcover_rgba_8888_aarch64+0x14> // b.any
+ .long 0x54fffa61 // b.ne 10c0 <sk_srcover_rgba_8888_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe4 // dup v4.4s, wzr
.long 0x4d408124 // ld1 {v4.s}[2], [x9]
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d409124 // ld1 {v4.s}[1], [x9]
.long 0x0d408104 // ld1 {v4.s}[0], [x8]
- .long 0x17ffffcc // b 10ac <sk_srcover_rgba_8888_aarch64+0x14>
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0x17ffffcc // b 10c0 <sk_srcover_rgba_8888_aarch64+0x14>
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 11ac <sk_srcover_rgba_8888_aarch64+0x114> // b.none
+ .long 0x54000120 // b.eq 11c0 <sk_srcover_rgba_8888_aarch64+0x114> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 11a4 <sk_srcover_rgba_8888_aarch64+0x10c> // b.none
+ .long 0x540000a0 // b.eq 11b8 <sk_srcover_rgba_8888_aarch64+0x10c> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffd01 // b.ne 1138 <sk_srcover_rgba_8888_aarch64+0xa0> // b.any
+ .long 0x54fffd01 // b.ne 114c <sk_srcover_rgba_8888_aarch64+0xa0> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4d008130 // st1 {v16.s}[2], [x9]
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d009130 // st1 {v16.s}[1], [x9]
.long 0x0d008110 // st1 {v16.s}[0], [x8]
- .long 0x17ffffe2 // b 1138 <sk_srcover_rgba_8888_aarch64+0xa0>
+ .long 0x17ffffe2 // b 114c <sk_srcover_rgba_8888_aarch64+0xa0>
HIDDEN _sk_clamp_0_aarch64
.globl _sk_clamp_0_aarch64
FUNCTION(_sk_clamp_0_aarch64)
_sk_clamp_0_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6f00e410 // movi v16.2d, #0x0
.long 0x4e30f400 // fmax v0.4s, v0.4s, v16.4s
.long 0x4e30f421 // fmax v1.4s, v1.4s, v16.4s
.long 0x4e30f442 // fmax v2.4s, v2.4s, v16.4s
.long 0x4e30f463 // fmax v3.4s, v3.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_clamp_1_aarch64
.globl _sk_clamp_1_aarch64
FUNCTION(_sk_clamp_1_aarch64)
_sk_clamp_1_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4eb0f400 // fmin v0.4s, v0.4s, v16.4s
.long 0x4eb0f421 // fmin v1.4s, v1.4s, v16.4s
.long 0x4eb0f442 // fmin v2.4s, v2.4s, v16.4s
.long 0x4eb0f463 // fmin v3.4s, v3.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_clamp_a_aarch64
.globl _sk_clamp_a_aarch64
FUNCTION(_sk_clamp_a_aarch64)
_sk_clamp_a_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4eb0f463 // fmin v3.4s, v3.4s, v16.4s
.long 0x4ea3f400 // fmin v0.4s, v0.4s, v3.4s
.long 0x4ea3f421 // fmin v1.4s, v1.4s, v3.4s
.long 0x4ea3f442 // fmin v2.4s, v2.4s, v3.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_set_rgb_aarch64
.globl _sk_set_rgb_aarch64
FUNCTION(_sk_set_rgb_aarch64)
_sk_set_rgb_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803e9 // mov x9, x8
.long 0x4ddfc920 // ld1r {v0.4s}, [x9], #4
.long 0x91002108 // add x8, x8, #0x8
.long 0x4d40c902 // ld1r {v2.4s}, [x8]
.long 0x4d40c921 // ld1r {v1.4s}, [x9]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_swap_rb_aarch64
.globl _sk_swap_rb_aarch64
FUNCTION(_sk_swap_rb_aarch64)
_sk_swap_rb_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea01c10 // mov v16.16b, v0.16b
.long 0x4ea21c40 // mov v0.16b, v2.16b
.long 0x4eb01e02 // mov v2.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_swap_aarch64
.globl _sk_swap_aarch64
FUNCTION(_sk_swap_aarch64)
_sk_swap_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea31c70 // mov v16.16b, v3.16b
.long 0x4ea21c51 // mov v17.16b, v2.16b
.long 0x4ea11c32 // mov v18.16b, v1.16b
@@ -1407,53 +1412,53 @@ _sk_swap_aarch64:
.long 0x4eb21e45 // mov v5.16b, v18.16b
.long 0x4eb11e26 // mov v6.16b, v17.16b
.long 0x4eb01e07 // mov v7.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_move_src_dst_aarch64
.globl _sk_move_src_dst_aarch64
FUNCTION(_sk_move_src_dst_aarch64)
_sk_move_src_dst_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea01c04 // mov v4.16b, v0.16b
.long 0x4ea11c25 // mov v5.16b, v1.16b
.long 0x4ea21c46 // mov v6.16b, v2.16b
.long 0x4ea31c67 // mov v7.16b, v3.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_move_dst_src_aarch64
.globl _sk_move_dst_src_aarch64
FUNCTION(_sk_move_dst_src_aarch64)
_sk_move_dst_src_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea41c80 // mov v0.16b, v4.16b
.long 0x4ea51ca1 // mov v1.16b, v5.16b
.long 0x4ea61cc2 // mov v2.16b, v6.16b
.long 0x4ea71ce3 // mov v3.16b, v7.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_premul_aarch64
.globl _sk_premul_aarch64
FUNCTION(_sk_premul_aarch64)
_sk_premul_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e23dc00 // fmul v0.4s, v0.4s, v3.4s
.long 0x6e23dc21 // fmul v1.4s, v1.4s, v3.4s
.long 0x6e23dc42 // fmul v2.4s, v2.4s, v3.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_unpremul_aarch64
.globl _sk_unpremul_aarch64
FUNCTION(_sk_unpremul_aarch64)
_sk_unpremul_aarch64:
.long 0x4f03f611 // fmov v17.4s, #1.000000000000000000e+00
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4ea0d870 // fcmeq v16.4s, v3.4s, #0.0
.long 0x6e23fe31 // fdiv v17.4s, v17.4s, v3.4s
.long 0x4e701e30 // bic v16.16b, v17.16b, v16.16b
.long 0x6e20de00 // fmul v0.4s, v16.4s, v0.4s
.long 0x6e21de01 // fmul v1.4s, v16.4s, v1.4s
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_from_srgb_aarch64
.globl _sk_from_srgb_aarch64
@@ -1482,7 +1487,7 @@ _sk_from_srgb_aarch64:
.long 0x6e20dc13 // fmul v19.4s, v0.4s, v0.4s
.long 0x7288f5c8 // movk w8, #0x47ae
.long 0x4e20ce15 // fmla v21.4s, v16.4s, v0.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e21dc34 // fmul v20.4s, v1.4s, v1.4s
.long 0x4e33ceb6 // fmla v22.4s, v21.4s, v19.4s
.long 0x4e040d13 // dup v19.4s, w8
@@ -1497,7 +1502,7 @@ _sk_from_srgb_aarch64:
.long 0x6e761ea0 // bsl v0.16b, v21.16b, v22.16b
.long 0x6e781e01 // bsl v1.16b, v16.16b, v24.16b
.long 0x6e721e22 // bsl v2.16b, v17.16b, v18.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_to_srgb_aarch64
.globl _sk_to_srgb_aarch64
@@ -1559,7 +1564,7 @@ _sk_to_srgb_aarch64:
.long 0x4e35fe94 // frecps v20.4s, v20.4s, v21.4s
.long 0x6e34deb4 // fmul v20.4s, v21.4s, v20.4s
.long 0x4ea1da75 // frecpe v21.4s, v19.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e35fe73 // frecps v19.4s, v19.4s, v21.4s
.long 0x6e33deb3 // fmul v19.4s, v21.4s, v19.4s
.long 0x6e30de50 // fmul v16.4s, v18.4s, v16.4s
@@ -1568,7 +1573,7 @@ _sk_to_srgb_aarch64:
.long 0x6e701f20 // bsl v0.16b, v25.16b, v16.16b
.long 0x6e721f41 // bsl v1.16b, v26.16b, v18.16b
.long 0x6e731e22 // bsl v2.16b, v17.16b, v19.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_rgb_to_hsl_aarch64
.globl _sk_rgb_to_hsl_aarch64
@@ -1601,7 +1606,7 @@ _sk_rgb_to_hsl_aarch64:
.long 0x4e38cc59 // fmla v25.4s, v2.4s, v24.4s
.long 0x6e3ade02 // fmul v2.4s, v16.4s, v26.4s
.long 0x72955568 // movk w8, #0xaaab
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb1d651 // fsub v17.4s, v18.4s, v17.4s
.long 0x6ebae452 // fcmgt v18.4s, v2.4s, v26.4s
.long 0x6e791ee1 // bsl v1.16b, v23.16b, v25.16b
@@ -1612,7 +1617,7 @@ _sk_rgb_to_hsl_aarch64:
.long 0x6e33dc00 // fmul v0.4s, v0.4s, v19.4s
.long 0x4e761c00 // bic v0.16b, v0.16b, v22.16b
.long 0x4e761c21 // bic v1.16b, v1.16b, v22.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_hsl_to_rgb_aarch64
.globl _sk_hsl_to_rgb_aarch64
@@ -1678,7 +1683,7 @@ _sk_hsl_to_rgb_aarch64:
.long 0x6e31e435 // fcmge v21.4s, v1.4s, v17.4s
.long 0x6e31e711 // fcmge v17.4s, v24.4s, v17.4s
.long 0x6e3ee718 // fcmge v24.4s, v24.4s, v30.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e741ef1 // bsl v17.16b, v23.16b, v20.16b
.long 0x6e3ee733 // fcmge v19.4s, v25.4s, v30.4s
.long 0x6e3ee439 // fcmge v25.4s, v1.4s, v30.4s
@@ -1693,19 +1698,19 @@ _sk_hsl_to_rgb_aarch64:
.long 0x6e791c40 // bsl v0.16b, v2.16b, v25.16b
.long 0x6e731c41 // bsl v1.16b, v2.16b, v19.16b
.long 0x4eb01e02 // mov v2.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_scale_1_float_aarch64
.globl _sk_scale_1_float_aarch64
FUNCTION(_sk_scale_1_float_aarch64)
_sk_scale_1_float_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xbd400110 // ldr s16, [x8]
.long 0x4f909000 // fmul v0.4s, v0.4s, v16.s[0]
.long 0x4f909021 // fmul v1.4s, v1.4s, v16.s[0]
.long 0x4f909042 // fmul v2.4s, v2.4s, v16.s[0]
.long 0x4f909063 // fmul v3.4s, v3.4s, v16.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_scale_u8_aarch64
.globl _sk_scale_u8_aarch64
@@ -1713,8 +1718,8 @@ FUNCTION(_sk_scale_u8_aarch64)
_sk_scale_u8_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000108 // add x8, x8, x0
- .long 0xb50002e3 // cbnz x3, 16cc <sk_scale_u8_aarch64+0x68>
+ .long 0x8b020108 // add x8, x8, x2
+ .long 0xb50002e4 // cbnz x4, 16e0 <sk_scale_u8_aarch64+0x68>
.long 0x39400109 // ldrb w9, [x8]
.long 0x3940050a // ldrb w10, [x8, #1]
.long 0x3940090b // ldrb w11, [x8, #2]
@@ -1726,7 +1731,7 @@ _sk_scale_u8_aarch64:
.long 0x2f07b7f0 // bic v16.4h, #0xff, lsl #8
.long 0x52a77008 // mov w8, #0x3b800000
.long 0x72901028 // movk w8, #0x8081
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x2f10a610 // uxtl v16.4s, v16.4h
.long 0x4e040d11 // dup v17.4s, w8
.long 0x6e21da10 // ucvtf v16.4s, v16.4s
@@ -1736,15 +1741,15 @@ _sk_scale_u8_aarch64:
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
.long 0x6e23de03 // fmul v3.4s, v16.4s, v3.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e410 // movi d16, #0x0
- .long 0x54000140 // b.eq 1700 <sk_scale_u8_aarch64+0x9c> // b.none
+ .long 0x54000140 // b.eq 1714 <sk_scale_u8_aarch64+0x9c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 16f8 <sk_scale_u8_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 170c <sk_scale_u8_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffd61 // b.ne 1694 <sk_scale_u8_aarch64+0x30> // b.any
+ .long 0x54fffd61 // b.ne 16a8 <sk_scale_u8_aarch64+0x30> // b.any
.long 0x39400909 // ldrb w9, [x8, #2]
.long 0x0e020ff0 // dup v16.4h, wzr
.long 0x4e0a1d30 // mov v16.h[2], w9
@@ -1752,13 +1757,13 @@ _sk_scale_u8_aarch64:
.long 0x4e061d30 // mov v16.h[1], w9
.long 0x39400108 // ldrb w8, [x8]
.long 0x4e021d10 // mov v16.h[0], w8
- .long 0x17ffffe3 // b 1694 <sk_scale_u8_aarch64+0x30>
+ .long 0x17ffffe3 // b 16a8 <sk_scale_u8_aarch64+0x30>
HIDDEN _sk_lerp_1_float_aarch64
.globl _sk_lerp_1_float_aarch64
FUNCTION(_sk_lerp_1_float_aarch64)
_sk_lerp_1_float_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea4d411 // fsub v17.4s, v0.4s, v4.4s
.long 0x4ea41c80 // mov v0.16b, v4.16b
.long 0x4ea5d432 // fsub v18.4s, v1.4s, v5.4s
@@ -1772,7 +1777,7 @@ _sk_lerp_1_float_aarch64:
.long 0x4ea71ce3 // mov v3.16b, v7.16b
.long 0x4f901222 // fmla v2.4s, v17.4s, v16.s[0]
.long 0x4f901243 // fmla v3.4s, v18.4s, v16.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_lerp_u8_aarch64
.globl _sk_lerp_u8_aarch64
@@ -1780,8 +1785,8 @@ FUNCTION(_sk_lerp_u8_aarch64)
_sk_lerp_u8_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000108 // add x8, x8, x0
- .long 0xb50003e3 // cbnz x3, 17d0 <sk_lerp_u8_aarch64+0x88>
+ .long 0x8b020108 // add x8, x8, x2
+ .long 0xb50003e4 // cbnz x4, 17e4 <sk_lerp_u8_aarch64+0x88>
.long 0x39400109 // ldrb w9, [x8]
.long 0x3940050a // ldrb w10, [x8, #1]
.long 0x3940090b // ldrb w11, [x8, #2]
@@ -1797,7 +1802,7 @@ _sk_lerp_u8_aarch64:
.long 0x2f10a600 // uxtl v0.4s, v16.4h
.long 0x4e040d10 // dup v16.4s, w8
.long 0x6e21d800 // ucvtf v0.4s, v0.4s
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x6e30dc10 // fmul v16.4s, v0.4s, v16.4s
.long 0x4ea41c80 // mov v0.16b, v4.16b
.long 0x4ea5d432 // fsub v18.4s, v1.4s, v5.4s
@@ -1811,15 +1816,15 @@ _sk_lerp_u8_aarch64:
.long 0x4e31ce02 // fmla v2.4s, v16.4s, v17.4s
.long 0x4e32ce03 // fmla v3.4s, v16.4s, v18.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e410 // movi d16, #0x0
- .long 0x54000140 // b.eq 1804 <sk_lerp_u8_aarch64+0xbc> // b.none
+ .long 0x54000140 // b.eq 1818 <sk_lerp_u8_aarch64+0xbc> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 17fc <sk_lerp_u8_aarch64+0xb4> // b.none
+ .long 0x540000c0 // b.eq 1810 <sk_lerp_u8_aarch64+0xb4> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc61 // b.ne 1778 <sk_lerp_u8_aarch64+0x30> // b.any
+ .long 0x54fffc61 // b.ne 178c <sk_lerp_u8_aarch64+0x30> // b.any
.long 0x39400909 // ldrb w9, [x8, #2]
.long 0x0e020ff0 // dup v16.4h, wzr
.long 0x4e0a1d30 // mov v16.h[2], w9
@@ -1827,7 +1832,7 @@ _sk_lerp_u8_aarch64:
.long 0x4e061d30 // mov v16.h[1], w9
.long 0x39400108 // ldrb w8, [x8]
.long 0x4e021d10 // mov v16.h[0], w8
- .long 0x17ffffdb // b 1778 <sk_lerp_u8_aarch64+0x30>
+ .long 0x17ffffdb // b 178c <sk_lerp_u8_aarch64+0x30>
HIDDEN _sk_lerp_565_aarch64
.globl _sk_lerp_565_aarch64
@@ -1835,8 +1840,8 @@ FUNCTION(_sk_lerp_565_aarch64)
_sk_lerp_565_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000508 // add x8, x8, x0, lsl #1
- .long 0xb50005c3 // cbnz x3, 18d4 <sk_lerp_565_aarch64+0xc4>
+ .long 0x8b020508 // add x8, x8, x2, lsl #1
+ .long 0xb50005c4 // cbnz x4, 18e8 <sk_lerp_565_aarch64+0xc4>
.long 0xfd400110 // ldr d16, [x8]
.long 0x321b17e8 // orr w8, wzr, #0x7e0
.long 0x4e040d12 // dup v18.4s, w8
@@ -1874,29 +1879,29 @@ _sk_lerp_565_aarch64:
.long 0x4e21ce42 // fmla v2.4s, v18.4s, v1.4s
.long 0x4e23ce51 // fmla v17.4s, v18.4s, v3.4s
.long 0x4ea71cf2 // mov v18.16b, v7.16b
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4e23ce12 // fmla v18.4s, v16.4s, v3.4s
.long 0x4ea51ca1 // mov v1.16b, v5.16b
.long 0x4e31f643 // fmax v3.4s, v18.4s, v17.4s
.long 0x4e33ce01 // fmla v1.4s, v16.4s, v19.4s
.long 0x4e23f683 // fmax v3.4s, v20.4s, v3.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e410 // movi d16, #0x0
- .long 0x54000140 // b.eq 1908 <sk_lerp_565_aarch64+0xf8> // b.none
+ .long 0x54000140 // b.eq 191c <sk_lerp_565_aarch64+0xf8> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 1900 <sk_lerp_565_aarch64+0xf0> // b.none
+ .long 0x540000c0 // b.eq 1914 <sk_lerp_565_aarch64+0xf0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fff9a1 // b.ne 1824 <sk_lerp_565_aarch64+0x14> // b.any
+ .long 0x54fff9a1 // b.ne 1838 <sk_lerp_565_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020ff0 // dup v16.4h, wzr
.long 0x0d405130 // ld1 {v16.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d404930 // ld1 {v16.h}[1], [x9]
.long 0x0d404110 // ld1 {v16.h}[0], [x8]
- .long 0x17ffffc6 // b 1824 <sk_lerp_565_aarch64+0x14>
+ .long 0x17ffffc6 // b 1838 <sk_lerp_565_aarch64+0x14>
HIDDEN _sk_load_tables_aarch64
.globl _sk_load_tables_aarch64
@@ -1904,8 +1909,8 @@ FUNCTION(_sk_load_tables_aarch64)
_sk_load_tables_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400109 // ldr x9, [x8]
- .long 0x8b000929 // add x9, x9, x0, lsl #2
- .long 0xb50006e3 // cbnz x3, 19f8 <sk_load_tables_aarch64+0xe8>
+ .long 0x8b020929 // add x9, x9, x2, lsl #2
+ .long 0xb50006e4 // cbnz x4, 1a0c <sk_load_tables_aarch64+0xe8>
.long 0x3dc00122 // ldr q2, [x9]
.long 0xa940a909 // ldp x9, x10, [x8, #8]
.long 0x6f00e620 // movi v0.2d, #0xff000000ff
@@ -1953,28 +1958,28 @@ _sk_load_tables_aarch64:
.long 0x6e140641 // mov v1.s[2], v18.s[0]
.long 0xbc715951 // ldr s17, [x10, w17, uxtw #2]
.long 0xbc705912 // ldr s18, [x8, w16, uxtw #2]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x6e140662 // mov v2.s[2], v19.s[0]
.long 0x6e1c0600 // mov v0.s[3], v16.s[0]
.long 0x6e1c0621 // mov v1.s[3], v17.s[0]
.long 0x6e1c0642 // mov v2.s[3], v18.s[0]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x1200046a // and w10, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x1200048a // and w10, w4, #0x3
.long 0x7100055f // cmp w10, #0x1
.long 0x6f00e402 // movi v2.2d, #0x0
- .long 0x54000140 // b.eq 1a2c <sk_load_tables_aarch64+0x11c> // b.none
+ .long 0x54000140 // b.eq 1a40 <sk_load_tables_aarch64+0x11c> // b.none
.long 0x7100095f // cmp w10, #0x2
- .long 0x540000c0 // b.eq 1a24 <sk_load_tables_aarch64+0x114> // b.none
+ .long 0x540000c0 // b.eq 1a38 <sk_load_tables_aarch64+0x114> // b.none
.long 0x71000d5f // cmp w10, #0x3
- .long 0x54fff881 // b.ne 1924 <sk_load_tables_aarch64+0x14> // b.any
+ .long 0x54fff881 // b.ne 1938 <sk_load_tables_aarch64+0x14> // b.any
.long 0x9100212a // add x10, x9, #0x8
.long 0x4e040fe2 // dup v2.4s, wzr
.long 0x4d408142 // ld1 {v2.s}[2], [x10]
.long 0x9100112a // add x10, x9, #0x4
.long 0x0d409142 // ld1 {v2.s}[1], [x10]
.long 0x0d408122 // ld1 {v2.s}[0], [x9]
- .long 0x17ffffbd // b 1924 <sk_load_tables_aarch64+0x14>
+ .long 0x17ffffbd // b 1938 <sk_load_tables_aarch64+0x14>
HIDDEN _sk_load_tables_u16_be_aarch64
.globl _sk_load_tables_u16_be_aarch64
@@ -1982,8 +1987,8 @@ FUNCTION(_sk_load_tables_u16_be_aarch64)
_sk_load_tables_u16_be_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400109 // ldr x9, [x8]
- .long 0x8b000d29 // add x9, x9, x0, lsl #3
- .long 0xb5000743 // cbnz x3, 1b28 <sk_load_tables_u16_be_aarch64+0xf4>
+ .long 0x8b020d29 // add x9, x9, x2, lsl #3
+ .long 0xb5000744 // cbnz x4, 1b3c <sk_load_tables_u16_be_aarch64+0xf4>
.long 0x0c400520 // ld4 {v0.4h-v3.4h}, [x9]
.long 0xa940a909 // ldp x9, x10, [x8, #8]
.long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8
@@ -2032,7 +2037,7 @@ _sk_load_tables_u16_be_aarch64:
.long 0x0d4091e1 // ld1 {v1.s}[1], [x15]
.long 0x0d409122 // ld1 {v2.s}[1], [x9]
.long 0xbc6d5911 // ldr s17, [x8, w13, uxtw #2]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x6e140640 // mov v0.s[2], v18.s[0]
.long 0x6e1406a1 // mov v1.s[2], v21.s[0]
.long 0x6e140602 // mov v2.s[2], v16.s[0]
@@ -2040,17 +2045,17 @@ _sk_load_tables_u16_be_aarch64:
.long 0x6e1c06c1 // mov v1.s[3], v22.s[0]
.long 0x6e1c0622 // mov v2.s[3], v17.s[0]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d606120 // ld4 {v0.h-v3.h}[0], [x9]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54fff8c0 // b.eq 1a48 <sk_load_tables_u16_be_aarch64+0x14> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54fff8c0 // b.eq 1a5c <sk_load_tables_u16_be_aarch64+0x14> // b.none
.long 0x9100212a // add x10, x9, #0x8
.long 0x0d606940 // ld4 {v0.h-v3.h}[1], [x10]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fff843 // b.cc 1a48 <sk_load_tables_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fff843 // b.cc 1a5c <sk_load_tables_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004129 // add x9, x9, #0x10
.long 0x0d607120 // ld4 {v0.h-v3.h}[2], [x9]
- .long 0x17ffffbf // b 1a48 <sk_load_tables_u16_be_aarch64+0x14>
+ .long 0x17ffffbf // b 1a5c <sk_load_tables_u16_be_aarch64+0x14>
HIDDEN _sk_load_tables_rgb_u16_be_aarch64
.globl _sk_load_tables_rgb_u16_be_aarch64
@@ -2059,8 +2064,8 @@ _sk_load_tables_rgb_u16_be_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0x321f07ea // orr w10, wzr, #0x6
.long 0xf9400109 // ldr x9, [x8]
- .long 0x9b0a2409 // madd x9, x0, x10, x9
- .long 0xb5000663 // cbnz x3, 1c2c <sk_load_tables_rgb_u16_be_aarch64+0xdc>
+ .long 0x9b0a2449 // madd x9, x2, x10, x9
+ .long 0xb5000664 // cbnz x4, 1c40 <sk_load_tables_rgb_u16_be_aarch64+0xdc>
.long 0x0c404520 // ld3 {v0.4h-v2.4h}, [x9]
.long 0xa940a909 // ldp x9, x10, [x8, #8]
.long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8
@@ -2102,7 +2107,7 @@ _sk_load_tables_rgb_u16_be_aarch64:
.long 0xbc6d5950 // ldr s16, [x10, w13, uxtw #2]
.long 0x6e140461 // mov v1.s[2], v3.s[0]
.long 0xbc695963 // ldr s3, [x11, w9, uxtw #2]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004028 // add x8, x1, #0x10
.long 0x6e140642 // mov v2.s[2], v18.s[0]
.long 0x6e1c0620 // mov v0.s[3], v17.s[0]
@@ -2110,32 +2115,33 @@ _sk_load_tables_rgb_u16_be_aarch64:
.long 0x6e1c0462 // mov v2.s[3], v3.s[0]
.long 0x4f03f603 // fmov v3.4s, #1.000000000000000000e+00
.long 0xaa0803e1 // mov x1, x8
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d406120 // ld3 {v0.h-v2.h}[0], [x9]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54fff9a0 // b.eq 1b68 <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54fff9a0 // b.eq 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.none
.long 0x9100192a // add x10, x9, #0x6
.long 0x0d406940 // ld3 {v0.h-v2.h}[1], [x10]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fff923 // b.cc 1b68 <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fff923 // b.cc 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
.long 0x91003129 // add x9, x9, #0xc
.long 0x0d407120 // ld3 {v0.h-v2.h}[2], [x9]
- .long 0x17ffffc6 // b 1b68 <sk_load_tables_rgb_u16_be_aarch64+0x18>
+ .long 0x17ffffc6 // b 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18>
HIDDEN _sk_byte_tables_aarch64
.globl _sk_byte_tables_aarch64
FUNCTION(_sk_byte_tables_aarch64)
_sk_byte_tables_aarch64:
- .long 0xf81e0ff5 // str x21, [sp, #-32]!
+ .long 0xd100c3ff // sub sp, sp, #0x30
.long 0xaa0103e8 // mov x8, x1
.long 0x91002109 // add x9, x8, #0x8
- .long 0xa9014ff4 // stp x20, x19, [sp, #16]
+ .long 0xa90157f6 // stp x22, x21, [sp, #16]
+ .long 0xa9024ff4 // stp x20, x19, [sp, #32]
.long 0xf90007e9 // str x9, [sp, #8]
.long 0xf8410429 // ldr x9, [x1], #16
.long 0x52a86fea // mov w10, #0x437f0000
.long 0x4e040d51 // dup v17.4s, w10
.long 0x52a7700b // mov w11, #0x3b800000
- .long 0xa9405527 // ldp x7, x21, [x9]
+ .long 0xa9405933 // ldp x19, x22, [x9]
.long 0x6e31dc00 // fmul v0.4s, v0.4s, v17.4s
.long 0x7290102b // movk w11, #0x8081
.long 0x6e21a800 // fcvtnu v0.4s, v0.4s
@@ -2144,11 +2150,11 @@ _sk_byte_tables_aarch64:
.long 0x0e143c0b // mov w11, v0.s[2]
.long 0x0e1c3c0c // mov w12, v0.s[3]
.long 0x1e26000d // fmov w13, s0
- .long 0x386d48ed // ldrb w13, [x7, w13, uxtw]
- .long 0x386a48ea // ldrb w10, [x7, w10, uxtw]
- .long 0x386b48eb // ldrb w11, [x7, w11, uxtw]
- .long 0x386c48ec // ldrb w12, [x7, w12, uxtw]
- .long 0xa9412527 // ldp x7, x9, [x9, #16]
+ .long 0x386d4a6d // ldrb w13, [x19, w13, uxtw]
+ .long 0x386a4a6a // ldrb w10, [x19, w10, uxtw]
+ .long 0x386b4a6b // ldrb w11, [x19, w11, uxtw]
+ .long 0x386c4a6c // ldrb w12, [x19, w12, uxtw]
+ .long 0xa9412533 // ldp x19, x9, [x9, #16]
.long 0x6e31dc42 // fmul v2.4s, v2.4s, v17.4s
.long 0x6e31dc21 // fmul v1.4s, v1.4s, v17.4s
.long 0x6e31dc63 // fmul v3.4s, v3.4s, v17.4s
@@ -2156,51 +2162,52 @@ _sk_byte_tables_aarch64:
.long 0x6e21a821 // fcvtnu v1.4s, v1.4s
.long 0x6e21a863 // fcvtnu v3.4s, v3.4s
.long 0x0e0c3c52 // mov w18, v2.s[1]
- .long 0x0e143c44 // mov w4, v2.s[2]
- .long 0x0e1c3c45 // mov w5, v2.s[3]
- .long 0x1e260046 // fmov w6, s2
+ .long 0x0e143c45 // mov w5, v2.s[2]
+ .long 0x0e1c3c46 // mov w6, v2.s[3]
+ .long 0x1e260047 // fmov w7, s2
.long 0x1e260031 // fmov w17, s1
- .long 0x386648e6 // ldrb w6, [x7, w6, uxtw]
- .long 0x387248f2 // ldrb w18, [x7, w18, uxtw]
- .long 0x386448e4 // ldrb w4, [x7, w4, uxtw]
- .long 0x386548e5 // ldrb w5, [x7, w5, uxtw]
- .long 0x1e260067 // fmov w7, s3
+ .long 0x38674a67 // ldrb w7, [x19, w7, uxtw]
+ .long 0x38724a72 // ldrb w18, [x19, w18, uxtw]
+ .long 0x38654a65 // ldrb w5, [x19, w5, uxtw]
+ .long 0x38664a66 // ldrb w6, [x19, w6, uxtw]
+ .long 0x1e260073 // fmov w19, s3
.long 0x0e0c3c2e // mov w14, v1.s[1]
- .long 0x0e0c3c73 // mov w19, v3.s[1]
- .long 0x38714ab1 // ldrb w17, [x21, w17, uxtw]
- .long 0x38674927 // ldrb w7, [x9, w7, uxtw]
+ .long 0x0e0c3c74 // mov w20, v3.s[1]
+ .long 0x38714ad1 // ldrb w17, [x22, w17, uxtw]
+ .long 0x38734933 // ldrb w19, [x9, w19, uxtw]
.long 0x0e143c2f // mov w15, v1.s[2]
.long 0x0e1c3c30 // mov w16, v1.s[3]
- .long 0x0e143c74 // mov w20, v3.s[2]
- .long 0x386e4aae // ldrb w14, [x21, w14, uxtw]
- .long 0x38734933 // ldrb w19, [x9, w19, uxtw]
- .long 0x386f4aaf // ldrb w15, [x21, w15, uxtw]
- .long 0x38704ab0 // ldrb w16, [x21, w16, uxtw]
- .long 0x0e1c3c75 // mov w21, v3.s[3]
+ .long 0x0e143c75 // mov w21, v3.s[2]
+ .long 0x386e4ace // ldrb w14, [x22, w14, uxtw]
.long 0x38744934 // ldrb w20, [x9, w20, uxtw]
- .long 0x38754929 // ldrb w9, [x9, w21, uxtw]
+ .long 0x386f4acf // ldrb w15, [x22, w15, uxtw]
+ .long 0x38704ad0 // ldrb w16, [x22, w16, uxtw]
+ .long 0x0e1c3c76 // mov w22, v3.s[3]
+ .long 0x38754935 // ldrb w21, [x9, w21, uxtw]
+ .long 0x38764929 // ldrb w9, [x9, w22, uxtw]
.long 0x4e021da0 // mov v0.h[0], w13
.long 0x4e021e21 // mov v1.h[0], w17
- .long 0x4e021cc2 // mov v2.h[0], w6
- .long 0x4e021ce3 // mov v3.h[0], w7
+ .long 0x4e021ce2 // mov v2.h[0], w7
+ .long 0x4e021e63 // mov v3.h[0], w19
.long 0x4e061d40 // mov v0.h[1], w10
.long 0x4e061dc1 // mov v1.h[1], w14
.long 0x4e061e42 // mov v2.h[1], w18
- .long 0x4e061e63 // mov v3.h[1], w19
+ .long 0x4e061e83 // mov v3.h[1], w20
.long 0x4e0a1d60 // mov v0.h[2], w11
.long 0x4e0a1de1 // mov v1.h[2], w15
- .long 0x4e0a1c82 // mov v2.h[2], w4
- .long 0x4e0a1e83 // mov v3.h[2], w20
+ .long 0x4e0a1ca2 // mov v2.h[2], w5
+ .long 0x4e0a1ea3 // mov v3.h[2], w21
.long 0x4e0e1d80 // mov v0.h[3], w12
.long 0x4e0e1e01 // mov v1.h[3], w16
- .long 0x4e0e1ca2 // mov v2.h[3], w5
+ .long 0x4e0e1cc2 // mov v2.h[3], w6
.long 0x4e0e1d23 // mov v3.h[3], w9
- .long 0xf9400506 // ldr x6, [x8, #8]
+ .long 0xf9400507 // ldr x7, [x8, #8]
.long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8
.long 0x2f07b7e1 // bic v1.4h, #0xff, lsl #8
.long 0x2f07b7e2 // bic v2.4h, #0xff, lsl #8
.long 0x2f07b7e3 // bic v3.4h, #0xff, lsl #8
- .long 0xa9414ff4 // ldp x20, x19, [sp, #16]
+ .long 0xa9424ff4 // ldp x20, x19, [sp, #32]
+ .long 0xa94157f6 // ldp x22, x21, [sp, #16]
.long 0x2f10a400 // uxtl v0.4s, v0.4h
.long 0x2f10a421 // uxtl v1.4s, v1.4h
.long 0x2f10a442 // uxtl v2.4s, v2.4h
@@ -2213,14 +2220,14 @@ _sk_byte_tables_aarch64:
.long 0x6e30dc21 // fmul v1.4s, v1.4s, v16.4s
.long 0x6e30dc42 // fmul v2.4s, v2.4s, v16.4s
.long 0x6e30dc63 // fmul v3.4s, v3.4s, v16.4s
- .long 0xf84207f5 // ldr x21, [sp], #32
- .long 0xd61f00c0 // br x6
+ .long 0x9100c3ff // add sp, sp, #0x30
+ .long 0xd61f00e0 // br x7
HIDDEN _sk_byte_tables_rgb_aarch64
.globl _sk_byte_tables_rgb_aarch64
FUNCTION(_sk_byte_tables_rgb_aarch64)
_sk_byte_tables_rgb_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x52a77009 // mov w9, #0x3b800000
.long 0x72901029 // movk w9, #0x8081
.long 0x4e040d30 // dup v16.4s, w9
@@ -2248,27 +2255,27 @@ _sk_byte_tables_rgb_aarch64:
.long 0x1e260051 // fmov w17, s2
.long 0x0e0c3c09 // mov w9, v0.s[1]
.long 0x386e494e // ldrb w14, [x10, w14, uxtw]
- .long 0x0e0c3c45 // mov w5, v2.s[1]
+ .long 0x0e0c3c46 // mov w6, v2.s[1]
.long 0x38714911 // ldrb w17, [x8, w17, uxtw]
.long 0x0e143c0c // mov w12, v0.s[2]
.long 0x0e1c3c0d // mov w13, v0.s[3]
- .long 0x0e143c46 // mov w6, v2.s[2]
+ .long 0x0e143c47 // mov w7, v2.s[2]
.long 0x38694949 // ldrb w9, [x10, w9, uxtw]
- .long 0x38654905 // ldrb w5, [x8, w5, uxtw]
+ .long 0x38664906 // ldrb w6, [x8, w6, uxtw]
.long 0x386c494c // ldrb w12, [x10, w12, uxtw]
.long 0x386d494a // ldrb w10, [x10, w13, uxtw]
.long 0x0e1c3c4d // mov w13, v2.s[3]
- .long 0x38664906 // ldrb w6, [x8, w6, uxtw]
+ .long 0x38674907 // ldrb w7, [x8, w7, uxtw]
.long 0x386d4908 // ldrb w8, [x8, w13, uxtw]
.long 0x4e021dc0 // mov v0.h[0], w14
.long 0x4e021e41 // mov v1.h[0], w18
.long 0x4e021e22 // mov v2.h[0], w17
.long 0x4e061d20 // mov v0.h[1], w9
.long 0x4e061de1 // mov v1.h[1], w15
- .long 0x4e061ca2 // mov v2.h[1], w5
+ .long 0x4e061cc2 // mov v2.h[1], w6
.long 0x4e0a1d80 // mov v0.h[2], w12
.long 0x4e0a1e01 // mov v1.h[2], w16
- .long 0x4e0a1cc2 // mov v2.h[2], w6
+ .long 0x4e0a1ce2 // mov v2.h[2], w7
.long 0x4e0e1d40 // mov v0.h[3], w10
.long 0x4e0e1d61 // mov v1.h[3], w11
.long 0x4e0e1d02 // mov v2.h[3], w8
@@ -2284,13 +2291,13 @@ _sk_byte_tables_rgb_aarch64:
.long 0x6e30dc00 // fmul v0.4s, v0.4s, v16.4s
.long 0x6e30dc21 // fmul v1.4s, v1.4s, v16.4s
.long 0x6e30dc42 // fmul v2.4s, v2.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_table_r_aarch64
.globl _sk_table_r_aarch64
FUNCTION(_sk_table_r_aarch64)
_sk_table_r_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xb9400909 // ldr w9, [x8, #8]
.long 0xf9400108 // ldr x8, [x8]
.long 0x51000529 // sub w9, w9, #0x1
@@ -2310,13 +2317,13 @@ _sk_table_r_aarch64:
.long 0xbc6b5911 // ldr s17, [x8, w11, uxtw #2]
.long 0x6e140600 // mov v0.s[2], v16.s[0]
.long 0x6e1c0620 // mov v0.s[3], v17.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_table_g_aarch64
.globl _sk_table_g_aarch64
FUNCTION(_sk_table_g_aarch64)
_sk_table_g_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xb9400909 // ldr w9, [x8, #8]
.long 0xf9400108 // ldr x8, [x8]
.long 0x51000529 // sub w9, w9, #0x1
@@ -2336,13 +2343,13 @@ _sk_table_g_aarch64:
.long 0xbc6b5911 // ldr s17, [x8, w11, uxtw #2]
.long 0x6e140601 // mov v1.s[2], v16.s[0]
.long 0x6e1c0621 // mov v1.s[3], v17.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_table_b_aarch64
.globl _sk_table_b_aarch64
FUNCTION(_sk_table_b_aarch64)
_sk_table_b_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xb9400909 // ldr w9, [x8, #8]
.long 0xf9400108 // ldr x8, [x8]
.long 0x51000529 // sub w9, w9, #0x1
@@ -2362,13 +2369,13 @@ _sk_table_b_aarch64:
.long 0xbc6b5911 // ldr s17, [x8, w11, uxtw #2]
.long 0x6e140602 // mov v2.s[2], v16.s[0]
.long 0x6e1c0622 // mov v2.s[3], v17.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_table_a_aarch64
.globl _sk_table_a_aarch64
FUNCTION(_sk_table_a_aarch64)
_sk_table_a_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xb9400909 // ldr w9, [x8, #8]
.long 0xf9400108 // ldr x8, [x8]
.long 0x51000529 // sub w9, w9, #0x1
@@ -2388,7 +2395,7 @@ _sk_table_a_aarch64:
.long 0xbc6b5911 // ldr s17, [x8, w11, uxtw #2]
.long 0x6e140603 // mov v3.s[2], v16.s[0]
.long 0x6e1c0623 // mov v3.s[3], v17.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_parametric_r_aarch64
.globl _sk_parametric_r_aarch64
@@ -2455,7 +2462,7 @@ _sk_parametric_r_aarch64:
.long 0x4f026573 // movi v19.4s, #0x4b, lsl #24
.long 0x6e33de31 // fmul v17.4s, v17.4s, v19.4s
.long 0x6e21aa31 // fcvtnu v17.4s, v17.4s
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4e34d631 // fadd v17.4s, v17.4s, v20.4s
.long 0x6f00e412 // movi v18.2d, #0x0
.long 0x6e711e00 // bsl v0.16b, v16.16b, v17.16b
@@ -2463,7 +2470,7 @@ _sk_parametric_r_aarch64:
.long 0x4e32f400 // fmax v0.4s, v0.4s, v18.4s
.long 0x4eb5f400 // fmin v0.4s, v0.4s, v21.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_parametric_g_aarch64
.globl _sk_parametric_g_aarch64
@@ -2530,7 +2537,7 @@ _sk_parametric_g_aarch64:
.long 0x4f026573 // movi v19.4s, #0x4b, lsl #24
.long 0x6e33de31 // fmul v17.4s, v17.4s, v19.4s
.long 0x6e21aa31 // fcvtnu v17.4s, v17.4s
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4e34d631 // fadd v17.4s, v17.4s, v20.4s
.long 0x6f00e412 // movi v18.2d, #0x0
.long 0x6e711e01 // bsl v1.16b, v16.16b, v17.16b
@@ -2538,7 +2545,7 @@ _sk_parametric_g_aarch64:
.long 0x4e32f421 // fmax v1.4s, v1.4s, v18.4s
.long 0x4eb5f421 // fmin v1.4s, v1.4s, v21.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_parametric_b_aarch64
.globl _sk_parametric_b_aarch64
@@ -2605,7 +2612,7 @@ _sk_parametric_b_aarch64:
.long 0x4f026573 // movi v19.4s, #0x4b, lsl #24
.long 0x6e33de31 // fmul v17.4s, v17.4s, v19.4s
.long 0x6e21aa31 // fcvtnu v17.4s, v17.4s
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4e34d631 // fadd v17.4s, v17.4s, v20.4s
.long 0x6f00e412 // movi v18.2d, #0x0
.long 0x6e711e02 // bsl v2.16b, v16.16b, v17.16b
@@ -2613,7 +2620,7 @@ _sk_parametric_b_aarch64:
.long 0x4e32f442 // fmax v2.4s, v2.4s, v18.4s
.long 0x4eb5f442 // fmin v2.4s, v2.4s, v21.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_parametric_a_aarch64
.globl _sk_parametric_a_aarch64
@@ -2680,7 +2687,7 @@ _sk_parametric_a_aarch64:
.long 0x4f026573 // movi v19.4s, #0x4b, lsl #24
.long 0x6e33de31 // fmul v17.4s, v17.4s, v19.4s
.long 0x6e21aa31 // fcvtnu v17.4s, v17.4s
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4e34d631 // fadd v17.4s, v17.4s, v20.4s
.long 0x6f00e412 // movi v18.2d, #0x0
.long 0x6e711e03 // bsl v3.16b, v16.16b, v17.16b
@@ -2688,7 +2695,7 @@ _sk_parametric_a_aarch64:
.long 0x4e32f463 // fmax v3.4s, v3.4s, v18.4s
.long 0x4eb5f463 // fmin v3.4s, v3.4s, v21.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_lab_to_xyz_aarch64
.globl _sk_lab_to_xyz_aarch64
@@ -2746,7 +2753,7 @@ _sk_lab_to_xyz_aarch64:
.long 0x52a7ea68 // mov w8, #0x3f530000
.long 0x4e30d6b0 // fadd v16.4s, v21.4s, v16.4s
.long 0x6e32deb2 // fmul v18.4s, v21.4s, v18.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x72881ec8 // movk w8, #0x40f6
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
.long 0x6ea0e640 // fcmgt v0.4s, v18.4s, v0.4s
@@ -2754,7 +2761,7 @@ _sk_lab_to_xyz_aarch64:
.long 0x6e621e40 // bsl v0.16b, v18.16b, v2.16b
.long 0x6e31dc00 // fmul v0.4s, v0.4s, v17.4s
.long 0x6e34de62 // fmul v2.4s, v19.4s, v20.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_load_a8_aarch64
.globl _sk_load_a8_aarch64
@@ -2762,8 +2769,8 @@ FUNCTION(_sk_load_a8_aarch64)
_sk_load_a8_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000108 // add x8, x8, x0
- .long 0xb50002e3 // cbnz x3, 25c8 <sk_load_a8_aarch64+0x68>
+ .long 0x8b020108 // add x8, x8, x2
+ .long 0xb50002e4 // cbnz x4, 25e4 <sk_load_a8_aarch64+0x68>
.long 0x39400109 // ldrb w9, [x8]
.long 0x3940050a // ldrb w10, [x8, #1]
.long 0x3940090b // ldrb w11, [x8, #2]
@@ -2774,7 +2781,7 @@ _sk_load_a8_aarch64:
.long 0x4e0e1d02 // mov v2.h[3], w8
.long 0x2f07b7e2 // bic v2.4h, #0xff, lsl #8
.long 0x52a77008 // mov w8, #0x3b800000
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x72901028 // movk w8, #0x8081
.long 0x2f10a442 // uxtl v2.4s, v2.4h
.long 0x4e040d03 // dup v3.4s, w8
@@ -2785,15 +2792,15 @@ _sk_load_a8_aarch64:
.long 0x6e23dc43 // fmul v3.4s, v2.4s, v3.4s
.long 0x6f00e402 // movi v2.2d, #0x0
.long 0xaa0803e1 // mov x1, x8
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e402 // movi d2, #0x0
- .long 0x54000140 // b.eq 25fc <sk_load_a8_aarch64+0x9c> // b.none
+ .long 0x54000140 // b.eq 2618 <sk_load_a8_aarch64+0x9c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 25f4 <sk_load_a8_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 2610 <sk_load_a8_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffd61 // b.ne 2590 <sk_load_a8_aarch64+0x30> // b.any
+ .long 0x54fffd61 // b.ne 25ac <sk_load_a8_aarch64+0x30> // b.any
.long 0x39400909 // ldrb w9, [x8, #2]
.long 0x0e020fe2 // dup v2.4h, wzr
.long 0x4e0a1d22 // mov v2.h[2], w9
@@ -2801,13 +2808,13 @@ _sk_load_a8_aarch64:
.long 0x4e061d22 // mov v2.h[1], w9
.long 0x39400108 // ldrb w8, [x8]
.long 0x4e021d02 // mov v2.h[0], w8
- .long 0x17ffffe3 // b 2590 <sk_load_a8_aarch64+0x30>
+ .long 0x17ffffe3 // b 25ac <sk_load_a8_aarch64+0x30>
HIDDEN _sk_gather_a8_aarch64
.globl _sk_gather_a8_aarch64
FUNCTION(_sk_gather_a8_aarch64)
_sk_gather_a8_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x91004109 // add x9, x8, #0x10
@@ -2836,7 +2843,7 @@ _sk_gather_a8_aarch64:
.long 0x6f00e401 // movi v1.2d, #0x0
.long 0x6e23dc43 // fmul v3.4s, v2.4s, v3.4s
.long 0x6f00e402 // movi v2.2d, #0x0
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_store_a8_aarch64
.globl _sk_store_a8_aarch64
@@ -2849,8 +2856,8 @@ _sk_store_a8_aarch64:
.long 0xf9400108 // ldr x8, [x8]
.long 0x6e21aa10 // fcvtnu v16.4s, v16.4s
.long 0x0e612a10 // xtn v16.4h, v16.4s
- .long 0x8b000108 // add x8, x8, x0
- .long 0xb5000183 // cbnz x3, 26d0 <sk_store_a8_aarch64+0x50>
+ .long 0x8b020108 // add x8, x8, x2
+ .long 0xb5000184 // cbnz x4, 26ec <sk_store_a8_aarch64+0x50>
.long 0x0e0e3e09 // umov w9, v16.h[3]
.long 0x0e0a3e0a // umov w10, v16.h[2]
.long 0x0e063e0b // umov w11, v16.h[1]
@@ -2859,23 +2866,23 @@ _sk_store_a8_aarch64:
.long 0x3900090a // strb w10, [x8, #2]
.long 0x3900050b // strb w11, [x8, #1]
.long 0x3900010c // strb w12, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 26fc <sk_store_a8_aarch64+0x7c> // b.none
+ .long 0x54000120 // b.eq 2718 <sk_store_a8_aarch64+0x7c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 26f4 <sk_store_a8_aarch64+0x74> // b.none
+ .long 0x540000a0 // b.eq 2710 <sk_store_a8_aarch64+0x74> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 26c4 <sk_store_a8_aarch64+0x44> // b.any
+ .long 0x54fffee1 // b.ne 26e0 <sk_store_a8_aarch64+0x44> // b.any
.long 0x0e0a3e09 // umov w9, v16.h[2]
.long 0x39000909 // strb w9, [x8, #2]
.long 0x0e063e09 // umov w9, v16.h[1]
.long 0x39000509 // strb w9, [x8, #1]
.long 0x0e023e09 // umov w9, v16.h[0]
.long 0x39000109 // strb w9, [x8]
- .long 0x17fffff0 // b 26c4 <sk_store_a8_aarch64+0x44>
+ .long 0x17fffff0 // b 26e0 <sk_store_a8_aarch64+0x44>
HIDDEN _sk_load_g8_aarch64
.globl _sk_load_g8_aarch64
@@ -2883,8 +2890,8 @@ FUNCTION(_sk_load_g8_aarch64)
_sk_load_g8_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000108 // add x8, x8, x0
- .long 0xb50002e3 // cbnz x3, 2770 <sk_load_g8_aarch64+0x68>
+ .long 0x8b020108 // add x8, x8, x2
+ .long 0xb50002e4 // cbnz x4, 278c <sk_load_g8_aarch64+0x68>
.long 0x39400109 // ldrb w9, [x8]
.long 0x3940050a // ldrb w10, [x8, #1]
.long 0x3940090b // ldrb w11, [x8, #2]
@@ -2896,7 +2903,7 @@ _sk_load_g8_aarch64:
.long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8
.long 0x52a77008 // mov w8, #0x3b800000
.long 0x72901028 // movk w8, #0x8081
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x2f10a400 // uxtl v0.4s, v0.4h
.long 0x4e040d01 // dup v1.4s, w8
.long 0x6e21d800 // ucvtf v0.4s, v0.4s
@@ -2906,15 +2913,15 @@ _sk_load_g8_aarch64:
.long 0xaa0803e1 // mov x1, x8
.long 0x4ea01c01 // mov v1.16b, v0.16b
.long 0x4ea01c02 // mov v2.16b, v0.16b
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e400 // movi d0, #0x0
- .long 0x54000140 // b.eq 27a4 <sk_load_g8_aarch64+0x9c> // b.none
+ .long 0x54000140 // b.eq 27c0 <sk_load_g8_aarch64+0x9c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 279c <sk_load_g8_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 27b8 <sk_load_g8_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffd61 // b.ne 2738 <sk_load_g8_aarch64+0x30> // b.any
+ .long 0x54fffd61 // b.ne 2754 <sk_load_g8_aarch64+0x30> // b.any
.long 0x39400909 // ldrb w9, [x8, #2]
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x4e0a1d20 // mov v0.h[2], w9
@@ -2922,13 +2929,13 @@ _sk_load_g8_aarch64:
.long 0x4e061d20 // mov v0.h[1], w9
.long 0x39400108 // ldrb w8, [x8]
.long 0x4e021d00 // mov v0.h[0], w8
- .long 0x17ffffe3 // b 2738 <sk_load_g8_aarch64+0x30>
+ .long 0x17ffffe3 // b 2754 <sk_load_g8_aarch64+0x30>
HIDDEN _sk_gather_g8_aarch64
.globl _sk_gather_g8_aarch64
FUNCTION(_sk_gather_g8_aarch64)
_sk_gather_g8_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x91004109 // add x9, x8, #0x10
@@ -2957,7 +2964,7 @@ _sk_gather_g8_aarch64:
.long 0x4f03f603 // fmov v3.4s, #1.000000000000000000e+00
.long 0x4ea01c01 // mov v1.16b, v0.16b
.long 0x4ea01c02 // mov v2.16b, v0.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_gather_i8_aarch64
.globl _sk_gather_i8_aarch64
@@ -2965,9 +2972,9 @@ FUNCTION(_sk_gather_i8_aarch64)
_sk_gather_i8_aarch64:
.long 0xaa0103e8 // mov x8, x1
.long 0xf8408429 // ldr x9, [x1], #8
- .long 0xb4000069 // cbz x9, 283c <sk_gather_i8_aarch64+0x14>
+ .long 0xb4000069 // cbz x9, 2858 <sk_gather_i8_aarch64+0x14>
.long 0xaa0903ea // mov x10, x9
- .long 0x14000003 // b 2844 <sk_gather_i8_aarch64+0x1c>
+ .long 0x14000003 // b 2860 <sk_gather_i8_aarch64+0x1c>
.long 0xf940050a // ldr x10, [x8, #8]
.long 0x91004101 // add x1, x8, #0x10
.long 0xf8410548 // ldr x8, [x10], #16
@@ -3003,7 +3010,7 @@ _sk_gather_i8_aarch64:
.long 0x0d409100 // ld1 {v0.s}[1], [x8]
.long 0xb86b5928 // ldr w8, [x9, w11, uxtw #2]
.long 0x7290102c // movk w12, #0x8081
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e141d40 // mov v0.s[2], w10
.long 0x4e1c1d00 // mov v0.s[3], w8
.long 0x4e231c01 // and v1.16b, v0.16b, v3.16b
@@ -3021,7 +3028,7 @@ _sk_gather_i8_aarch64:
.long 0x6e30dc21 // fmul v1.4s, v1.4s, v16.4s
.long 0x6e30dc42 // fmul v2.4s, v2.4s, v16.4s
.long 0x6e30de23 // fmul v3.4s, v17.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_load_565_aarch64
.globl _sk_load_565_aarch64
@@ -3029,8 +3036,8 @@ FUNCTION(_sk_load_565_aarch64)
_sk_load_565_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000508 // add x8, x8, x0, lsl #1
- .long 0xb50003c3 // cbnz x3, 2998 <sk_load_565_aarch64+0x84>
+ .long 0x8b020508 // add x8, x8, x2, lsl #1
+ .long 0xb50003c4 // cbnz x4, 29b4 <sk_load_565_aarch64+0x84>
.long 0xfd400100 // ldr d0, [x8]
.long 0x321b17e8 // orr w8, wzr, #0x7e0
.long 0x4e040d02 // dup v2.4s, w8
@@ -3049,7 +3056,7 @@ _sk_load_565_aarch64:
.long 0x6e20dc20 // fmul v0.4s, v1.4s, v0.4s
.long 0x4e040d01 // dup v1.4s, w8
.long 0x52a74048 // mov w8, #0x3a020000
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x72810428 // movk w8, #0x821
.long 0x4e21d862 // scvtf v2.4s, v3.4s
.long 0x6e21dc42 // fmul v2.4s, v2.4s, v1.4s
@@ -3059,28 +3066,28 @@ _sk_load_565_aarch64:
.long 0x6e21dc61 // fmul v1.4s, v3.4s, v1.4s
.long 0x4f03f603 // fmov v3.4s, #1.000000000000000000e+00
.long 0xaa0803e1 // mov x1, x8
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e400 // movi d0, #0x0
- .long 0x54000140 // b.eq 29cc <sk_load_565_aarch64+0xb8> // b.none
+ .long 0x54000140 // b.eq 29e8 <sk_load_565_aarch64+0xb8> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 29c4 <sk_load_565_aarch64+0xb0> // b.none
+ .long 0x540000c0 // b.eq 29e0 <sk_load_565_aarch64+0xb0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffba1 // b.ne 2928 <sk_load_565_aarch64+0x14> // b.any
+ .long 0x54fffba1 // b.ne 2944 <sk_load_565_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d405120 // ld1 {v0.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d404920 // ld1 {v0.h}[1], [x9]
.long 0x0d404100 // ld1 {v0.h}[0], [x8]
- .long 0x17ffffd6 // b 2928 <sk_load_565_aarch64+0x14>
+ .long 0x17ffffd6 // b 2944 <sk_load_565_aarch64+0x14>
HIDDEN _sk_gather_565_aarch64
.globl _sk_gather_565_aarch64
FUNCTION(_sk_gather_565_aarch64)
_sk_gather_565_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x91004109 // add x9, x8, #0x10
@@ -3123,7 +3130,7 @@ _sk_gather_565_aarch64:
.long 0x4e21d842 // scvtf v2.4s, v2.4s
.long 0x6e23dc42 // fmul v2.4s, v2.4s, v3.4s
.long 0x4f03f603 // fmov v3.4s, #1.000000000000000000e+00
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_store_565_aarch64
.globl _sk_store_565_aarch64
@@ -3144,26 +3151,26 @@ _sk_store_565_aarch64:
.long 0x6e21aa10 // fcvtnu v16.4s, v16.4s
.long 0x4eb11e51 // orr v17.16b, v18.16b, v17.16b
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0x8b000508 // add x8, x8, x0, lsl #1
+ .long 0x8b020508 // add x8, x8, x2, lsl #1
.long 0x0e612a10 // xtn v16.4h, v16.4s
- .long 0xb50000a3 // cbnz x3, 2adc <sk_store_565_aarch64+0x58>
+ .long 0xb50000a4 // cbnz x4, 2af8 <sk_store_565_aarch64+0x58>
.long 0xfd000110 // str d16, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 2b08 <sk_store_565_aarch64+0x84> // b.none
+ .long 0x54000120 // b.eq 2b24 <sk_store_565_aarch64+0x84> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 2b00 <sk_store_565_aarch64+0x7c> // b.none
+ .long 0x540000a0 // b.eq 2b1c <sk_store_565_aarch64+0x7c> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 2ad0 <sk_store_565_aarch64+0x4c> // b.any
+ .long 0x54fffee1 // b.ne 2aec <sk_store_565_aarch64+0x4c> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d005130 // st1 {v16.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d004930 // st1 {v16.h}[1], [x9]
.long 0x0d004110 // st1 {v16.h}[0], [x8]
- .long 0x17fffff1 // b 2ad0 <sk_store_565_aarch64+0x4c>
+ .long 0x17fffff1 // b 2aec <sk_store_565_aarch64+0x4c>
HIDDEN _sk_load_4444_aarch64
.globl _sk_load_4444_aarch64
@@ -3171,8 +3178,8 @@ FUNCTION(_sk_load_4444_aarch64)
_sk_load_4444_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000508 // add x8, x8, x0, lsl #1
- .long 0xb5000443 // cbnz x3, 2ba4 <sk_load_4444_aarch64+0x94>
+ .long 0x8b020508 // add x8, x8, x2, lsl #1
+ .long 0xb5000444 // cbnz x4, 2bc0 <sk_load_4444_aarch64+0x94>
.long 0xfd400100 // ldr d0, [x8]
.long 0x52a6f108 // mov w8, #0x37880000
.long 0x2f10a400 // uxtl v0.4s, v0.4h
@@ -3197,7 +3204,7 @@ _sk_load_4444_aarch64:
.long 0x6e21dc41 // fmul v1.4s, v2.4s, v1.4s
.long 0x4e040d02 // dup v2.4s, w8
.long 0x52a7b108 // mov w8, #0x3d880000
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x72911128 // movk w8, #0x8889
.long 0x4e21d863 // scvtf v3.4s, v3.4s
.long 0x6e22dc62 // fmul v2.4s, v3.4s, v2.4s
@@ -3205,28 +3212,28 @@ _sk_load_4444_aarch64:
.long 0x4e21da10 // scvtf v16.4s, v16.4s
.long 0x6e23de03 // fmul v3.4s, v16.4s, v3.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x2f00e400 // movi d0, #0x0
- .long 0x54000140 // b.eq 2bd8 <sk_load_4444_aarch64+0xc8> // b.none
+ .long 0x54000140 // b.eq 2bf4 <sk_load_4444_aarch64+0xc8> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 2bd0 <sk_load_4444_aarch64+0xc0> // b.none
+ .long 0x540000c0 // b.eq 2bec <sk_load_4444_aarch64+0xc0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffb21 // b.ne 2b24 <sk_load_4444_aarch64+0x14> // b.any
+ .long 0x54fffb21 // b.ne 2b40 <sk_load_4444_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d405120 // ld1 {v0.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d404920 // ld1 {v0.h}[1], [x9]
.long 0x0d404100 // ld1 {v0.h}[0], [x8]
- .long 0x17ffffd2 // b 2b24 <sk_load_4444_aarch64+0x14>
+ .long 0x17ffffd2 // b 2b40 <sk_load_4444_aarch64+0x14>
HIDDEN _sk_gather_4444_aarch64
.globl _sk_gather_4444_aarch64
FUNCTION(_sk_gather_4444_aarch64)
_sk_gather_4444_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x4f070603 // movi v3.4s, #0xf0
@@ -3274,7 +3281,7 @@ _sk_gather_4444_aarch64:
.long 0x4e040d03 // dup v3.4s, w8
.long 0x4e21da10 // scvtf v16.4s, v16.4s
.long 0x6e23de03 // fmul v3.4s, v16.4s, v3.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_store_4444_aarch64
.globl _sk_store_4444_aarch64
@@ -3297,26 +3304,26 @@ _sk_store_4444_aarch64:
.long 0x6e21aa10 // fcvtnu v16.4s, v16.4s
.long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0x8b000508 // add x8, x8, x0, lsl #1
+ .long 0x8b020508 // add x8, x8, x2, lsl #1
.long 0x0e612a10 // xtn v16.4h, v16.4s
- .long 0xb50000a3 // cbnz x3, 2d04 <sk_store_4444_aarch64+0x60>
+ .long 0xb50000a4 // cbnz x4, 2d20 <sk_store_4444_aarch64+0x60>
.long 0xfd000110 // str d16, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 2d30 <sk_store_4444_aarch64+0x8c> // b.none
+ .long 0x54000120 // b.eq 2d4c <sk_store_4444_aarch64+0x8c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 2d28 <sk_store_4444_aarch64+0x84> // b.none
+ .long 0x540000a0 // b.eq 2d44 <sk_store_4444_aarch64+0x84> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 2cf8 <sk_store_4444_aarch64+0x54> // b.any
+ .long 0x54fffee1 // b.ne 2d14 <sk_store_4444_aarch64+0x54> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d005130 // st1 {v16.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d004930 // st1 {v16.h}[1], [x9]
.long 0x0d004110 // st1 {v16.h}[0], [x8]
- .long 0x17fffff1 // b 2cf8 <sk_store_4444_aarch64+0x54>
+ .long 0x17fffff1 // b 2d14 <sk_store_4444_aarch64+0x54>
HIDDEN _sk_load_8888_aarch64
.globl _sk_load_8888_aarch64
@@ -3324,14 +3331,14 @@ FUNCTION(_sk_load_8888_aarch64)
_sk_load_8888_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000908 // add x8, x8, x0, lsl #2
- .long 0xb50002e3 // cbnz x3, 2da0 <sk_load_8888_aarch64+0x68>
+ .long 0x8b020908 // add x8, x8, x2, lsl #2
+ .long 0xb50002e4 // cbnz x4, 2dbc <sk_load_8888_aarch64+0x68>
.long 0x3dc00100 // ldr q0, [x8]
.long 0x6f00e621 // movi v1.2d, #0xff000000ff
.long 0x52a77008 // mov w8, #0x3b800000
.long 0x6f380402 // ushr v2.4s, v0.4s, #8
.long 0x6f300403 // ushr v3.4s, v0.4s, #16
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x72901028 // movk w8, #0x8081
.long 0x6f280410 // ushr v16.4s, v0.4s, #24
.long 0x4e211c00 // and v0.16b, v0.16b, v1.16b
@@ -3347,28 +3354,28 @@ _sk_load_8888_aarch64:
.long 0x6e31dc41 // fmul v1.4s, v2.4s, v17.4s
.long 0x6e31de02 // fmul v2.4s, v16.4s, v17.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
.long 0x6f00e400 // movi v0.2d, #0x0
- .long 0x54000140 // b.eq 2dd4 <sk_load_8888_aarch64+0x9c> // b.none
+ .long 0x54000140 // b.eq 2df0 <sk_load_8888_aarch64+0x9c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000c0 // b.eq 2dcc <sk_load_8888_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 2de8 <sk_load_8888_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc81 // b.ne 2d4c <sk_load_8888_aarch64+0x14> // b.any
+ .long 0x54fffc81 // b.ne 2d68 <sk_load_8888_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe0 // dup v0.4s, wzr
.long 0x4d408120 // ld1 {v0.s}[2], [x9]
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d409120 // ld1 {v0.s}[1], [x9]
.long 0x0d408100 // ld1 {v0.s}[0], [x8]
- .long 0x17ffffdd // b 2d4c <sk_load_8888_aarch64+0x14>
+ .long 0x17ffffdd // b 2d68 <sk_load_8888_aarch64+0x14>
HIDDEN _sk_gather_8888_aarch64
.globl _sk_gather_8888_aarch64
FUNCTION(_sk_gather_8888_aarch64)
_sk_gather_8888_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x91004109 // add x9, x8, #0x10
@@ -3405,7 +3412,7 @@ _sk_gather_8888_aarch64:
.long 0x6e22de23 // fmul v3.4s, v17.4s, v2.4s
.long 0x6e22de01 // fmul v1.4s, v16.4s, v2.4s
.long 0x6e22de42 // fmul v2.4s, v18.4s, v2.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_store_8888_aarch64
.globl _sk_store_8888_aarch64
@@ -3428,26 +3435,26 @@ _sk_store_8888_aarch64:
.long 0x4f305652 // shl v18.4s, v18.4s, #16
.long 0x4f385610 // shl v16.4s, v16.4s, #24
.long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b
- .long 0x8b000908 // add x8, x8, x0, lsl #2
+ .long 0x8b020908 // add x8, x8, x2, lsl #2
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0xb50000a3 // cbnz x3, 2ed4 <sk_store_8888_aarch64+0x60>
+ .long 0xb50000a4 // cbnz x4, 2ef0 <sk_store_8888_aarch64+0x60>
.long 0x3d800110 // str q16, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0x12000469 // and w9, w3, #0x3
+ .long 0xd61f00a0 // br x5
+ .long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 2f00 <sk_store_8888_aarch64+0x8c> // b.none
+ .long 0x54000120 // b.eq 2f1c <sk_store_8888_aarch64+0x8c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 2ef8 <sk_store_8888_aarch64+0x84> // b.none
+ .long 0x540000a0 // b.eq 2f14 <sk_store_8888_aarch64+0x84> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 2ec8 <sk_store_8888_aarch64+0x54> // b.any
+ .long 0x54fffee1 // b.ne 2ee4 <sk_store_8888_aarch64+0x54> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4d008130 // st1 {v16.s}[2], [x9]
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d009130 // st1 {v16.s}[1], [x9]
.long 0x0d008110 // st1 {v16.s}[0], [x8]
- .long 0x17fffff1 // b 2ec8 <sk_store_8888_aarch64+0x54>
+ .long 0x17fffff1 // b 2ee4 <sk_store_8888_aarch64+0x54>
HIDDEN _sk_load_f16_aarch64
.globl _sk_load_f16_aarch64
@@ -3455,26 +3462,26 @@ FUNCTION(_sk_load_f16_aarch64)
_sk_load_f16_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000d08 // add x8, x8, x0, lsl #3
- .long 0xb5000123 // cbnz x3, 2f38 <sk_load_f16_aarch64+0x30>
+ .long 0x8b020d08 // add x8, x8, x2, lsl #3
+ .long 0xb5000124 // cbnz x4, 2f54 <sk_load_f16_aarch64+0x30>
.long 0x0c400510 // ld4 {v16.4h-v19.4h}, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x0e217a00 // fcvtl v0.4s, v16.4h
.long 0x0e217a21 // fcvtl v1.4s, v17.4h
.long 0x0e217a42 // fcvtl v2.4s, v18.4h
.long 0x0e217a63 // fcvtl v3.4s, v19.4h
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d606110 // ld4 {v16.h-v19.h}[0], [x8]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54fffee0 // b.eq 2f1c <sk_load_f16_aarch64+0x14> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54fffee0 // b.eq 2f38 <sk_load_f16_aarch64+0x14> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0x0d606930 // ld4 {v16.h-v19.h}[1], [x9]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fffe63 // b.cc 2f1c <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fffe63 // b.cc 2f38 <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d607110 // ld4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff0 // b 2f1c <sk_load_f16_aarch64+0x14>
+ .long 0x17fffff0 // b 2f38 <sk_load_f16_aarch64+0x14>
HIDDEN _sk_gather_f16_aarch64
.globl _sk_gather_f16_aarch64
@@ -3527,22 +3534,22 @@ _sk_store_f16_aarch64:
.long 0x0e216852 // fcvtn v18.4h, v2.4s
.long 0xf9400108 // ldr x8, [x8]
.long 0x0e216873 // fcvtn v19.4h, v3.4s
- .long 0x8b000d08 // add x8, x8, x0, lsl #3
- .long 0xb50000a3 // cbnz x3, 3020 <sk_store_f16_aarch64+0x30>
+ .long 0x8b020d08 // add x8, x8, x2, lsl #3
+ .long 0xb50000a4 // cbnz x4, 303c <sk_store_f16_aarch64+0x30>
.long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0xf100047f // cmp x3, #0x1
+ .long 0xd61f00a0 // br x5
+ .long 0xf100049f // cmp x4, #0x1
.long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8]
- .long 0x54ffff60 // b.eq 3014 <sk_store_f16_aarch64+0x24> // b.none
+ .long 0x54ffff60 // b.eq 3030 <sk_store_f16_aarch64+0x24> // b.none
.long 0x91002109 // add x9, x8, #0x8
- .long 0xf1000c7f // cmp x3, #0x3
+ .long 0xf1000c9f // cmp x4, #0x3
.long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9]
- .long 0x54fffee3 // b.cc 3014 <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3030 <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff4 // b 3014 <sk_store_f16_aarch64+0x24>
+ .long 0x17fffff4 // b 3030 <sk_store_f16_aarch64+0x24>
HIDDEN _sk_load_u16_be_aarch64
.globl _sk_load_u16_be_aarch64
@@ -3550,8 +3557,8 @@ FUNCTION(_sk_load_u16_be_aarch64)
_sk_load_u16_be_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b000d08 // add x8, x8, x0, lsl #3
- .long 0xb5000403 // cbnz x3, 30d4 <sk_load_u16_be_aarch64+0x8c>
+ .long 0x8b020d08 // add x8, x8, x2, lsl #3
+ .long 0xb5000404 // cbnz x4, 30f0 <sk_load_u16_be_aarch64+0x8c>
.long 0x0c400500 // ld4 {v0.4h-v3.4h}, [x8]
.long 0x0f185410 // shl v16.4h, v0.4h, #8
.long 0x2f180411 // ushr v17.4h, v0.4h, #8
@@ -3562,7 +3569,7 @@ _sk_load_u16_be_aarch64:
.long 0x0f185476 // shl v22.4h, v3.4h, #8
.long 0x2f180460 // ushr v0.4h, v3.4h, #8
.long 0x52a6f008 // mov w8, #0x37800000
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x0eb11e01 // orr v1.8b, v16.8b, v17.8b
.long 0x0eb31e42 // orr v2.8b, v18.8b, v19.8b
.long 0x0eb51e90 // orr v16.8b, v20.8b, v21.8b
@@ -3582,17 +3589,17 @@ _sk_load_u16_be_aarch64:
.long 0x6e23de02 // fmul v2.4s, v16.4s, v3.4s
.long 0x6e23de23 // fmul v3.4s, v17.4s, v3.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d606100 // ld4 {v0.h-v3.h}[0], [x8]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54fffc00 // b.eq 305c <sk_load_u16_be_aarch64+0x14> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54fffc00 // b.eq 3078 <sk_load_u16_be_aarch64+0x14> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0x0d606920 // ld4 {v0.h-v3.h}[1], [x9]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fffb83 // b.cc 305c <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fffb83 // b.cc 3078 <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d607100 // ld4 {v0.h-v3.h}[2], [x8]
- .long 0x17ffffd9 // b 305c <sk_load_u16_be_aarch64+0x14>
+ .long 0x17ffffd9 // b 3078 <sk_load_u16_be_aarch64+0x14>
HIDDEN _sk_load_rgb_u16_be_aarch64
.globl _sk_load_rgb_u16_be_aarch64
@@ -3601,8 +3608,8 @@ _sk_load_rgb_u16_be_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0x321f07e9 // orr w9, wzr, #0x6
.long 0xf9400108 // ldr x8, [x8]
- .long 0x9b092008 // madd x8, x0, x9, x8
- .long 0xb5000383 // cbnz x3, 317c <sk_load_rgb_u16_be_aarch64+0x80>
+ .long 0x9b092048 // madd x8, x2, x9, x8
+ .long 0xb5000384 // cbnz x4, 3198 <sk_load_rgb_u16_be_aarch64+0x80>
.long 0x0c404500 // ld3 {v0.4h-v2.4h}, [x8]
.long 0x0f185403 // shl v3.4h, v0.4h, #8
.long 0x2f180410 // ushr v16.4h, v0.4h, #8
@@ -3611,7 +3618,7 @@ _sk_load_rgb_u16_be_aarch64:
.long 0x0f185453 // shl v19.4h, v2.4h, #8
.long 0x2f180440 // ushr v0.4h, v2.4h, #8
.long 0x52a6f008 // mov w8, #0x37800000
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x0eb01c61 // orr v1.8b, v3.8b, v16.8b
.long 0x0eb21e23 // orr v3.8b, v17.8b, v18.8b
.long 0x0ea01e60 // orr v0.8b, v19.8b, v0.8b
@@ -3629,17 +3636,17 @@ _sk_load_rgb_u16_be_aarch64:
.long 0x6e22de02 // fmul v2.4s, v16.4s, v2.4s
.long 0x4f03f603 // fmov v3.4s, #1.000000000000000000e+00
.long 0xaa0803e1 // mov x1, x8
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d406100 // ld3 {v0.h-v2.h}[0], [x8]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54fffc80 // b.eq 3114 <sk_load_rgb_u16_be_aarch64+0x18> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54fffc80 // b.eq 3130 <sk_load_rgb_u16_be_aarch64+0x18> // b.none
.long 0x91001909 // add x9, x8, #0x6
.long 0x0d406920 // ld3 {v0.h-v2.h}[1], [x9]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fffc03 // b.cc 3114 <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fffc03 // b.cc 3130 <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
.long 0x91003108 // add x8, x8, #0xc
.long 0x0d407100 // ld3 {v0.h-v2.h}[2], [x8]
- .long 0x17ffffdd // b 3114 <sk_load_rgb_u16_be_aarch64+0x18>
+ .long 0x17ffffdd // b 3130 <sk_load_rgb_u16_be_aarch64+0x18>
HIDDEN _sk_store_u16_be_aarch64
.globl _sk_store_u16_be_aarch64
@@ -3673,23 +3680,23 @@ _sk_store_u16_be_aarch64:
.long 0x0eb51ed2 // orr v18.8b, v22.8b, v21.8b
.long 0x0f185695 // shl v21.4h, v20.4h, #8
.long 0x2f180694 // ushr v20.4h, v20.4h, #8
- .long 0x8b000d08 // add x8, x8, x0, lsl #3
+ .long 0x8b020d08 // add x8, x8, x2, lsl #3
.long 0x0eb41eb3 // orr v19.8b, v21.8b, v20.8b
- .long 0xb50000a3 // cbnz x3, 3230 <sk_store_u16_be_aarch64+0x8c>
+ .long 0xb50000a4 // cbnz x4, 324c <sk_store_u16_be_aarch64+0x8c>
.long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0xf100047f // cmp x3, #0x1
+ .long 0xd61f00a0 // br x5
+ .long 0xf100049f // cmp x4, #0x1
.long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8]
- .long 0x54ffff60 // b.eq 3224 <sk_store_u16_be_aarch64+0x80> // b.none
+ .long 0x54ffff60 // b.eq 3240 <sk_store_u16_be_aarch64+0x80> // b.none
.long 0x91002109 // add x9, x8, #0x8
- .long 0xf1000c7f // cmp x3, #0x3
+ .long 0xf1000c9f // cmp x4, #0x3
.long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9]
- .long 0x54fffee3 // b.cc 3224 <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3240 <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff4 // b 3224 <sk_store_u16_be_aarch64+0x80>
+ .long 0x17fffff4 // b 3240 <sk_store_u16_be_aarch64+0x80>
HIDDEN _sk_load_f32_aarch64
.globl _sk_load_f32_aarch64
@@ -3697,22 +3704,22 @@ FUNCTION(_sk_load_f32_aarch64)
_sk_load_f32_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b001108 // add x8, x8, x0, lsl #4
- .long 0xb50000a3 // cbnz x3, 3278 <sk_load_f32_aarch64+0x20>
+ .long 0x8b021108 // add x8, x8, x2, lsl #4
+ .long 0xb50000a4 // cbnz x4, 3294 <sk_load_f32_aarch64+0x20>
.long 0x4c400900 // ld4 {v0.4s-v3.4s}, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
.long 0x0d60a100 // ld4 {v0.s-v3.s}[0], [x8]
- .long 0xf100047f // cmp x3, #0x1
- .long 0x54ffff60 // b.eq 326c <sk_load_f32_aarch64+0x14> // b.none
+ .long 0xf100049f // cmp x4, #0x1
+ .long 0x54ffff60 // b.eq 3288 <sk_load_f32_aarch64+0x14> // b.none
.long 0x91004109 // add x9, x8, #0x10
.long 0x0d60b120 // ld4 {v0.s-v3.s}[1], [x9]
- .long 0xf1000c7f // cmp x3, #0x3
- .long 0x54fffee3 // b.cc 326c <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0xf1000c9f // cmp x4, #0x3
+ .long 0x54fffee3 // b.cc 3288 <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91008108 // add x8, x8, #0x20
.long 0x4d60a100 // ld4 {v0.s-v3.s}[2], [x8]
- .long 0x17fffff4 // b 326c <sk_load_f32_aarch64+0x14>
+ .long 0x17fffff4 // b 3288 <sk_load_f32_aarch64+0x14>
HIDDEN _sk_store_f32_aarch64
.globl _sk_store_f32_aarch64
@@ -3720,74 +3727,74 @@ FUNCTION(_sk_store_f32_aarch64)
_sk_store_f32_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
- .long 0x8b001108 // add x8, x8, x0, lsl #4
- .long 0xb50000a3 // cbnz x3, 32c0 <sk_store_f32_aarch64+0x20>
+ .long 0x8b021108 // add x8, x8, x2, lsl #4
+ .long 0xb50000a4 // cbnz x4, 32dc <sk_store_f32_aarch64+0x20>
.long 0x4c000900 // st4 {v0.4s-v3.4s}, [x8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
- .long 0xf100047f // cmp x3, #0x1
+ .long 0xd61f00a0 // br x5
+ .long 0xf100049f // cmp x4, #0x1
.long 0x0d20a100 // st4 {v0.s-v3.s}[0], [x8]
- .long 0x54ffff60 // b.eq 32b4 <sk_store_f32_aarch64+0x14> // b.none
+ .long 0x54ffff60 // b.eq 32d0 <sk_store_f32_aarch64+0x14> // b.none
.long 0x91004109 // add x9, x8, #0x10
- .long 0xf1000c7f // cmp x3, #0x3
+ .long 0xf1000c9f // cmp x4, #0x3
.long 0x0d20b120 // st4 {v0.s-v3.s}[1], [x9]
- .long 0x54fffee3 // b.cc 32b4 <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 32d0 <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91008108 // add x8, x8, #0x20
.long 0x4d20a100 // st4 {v0.s-v3.s}[2], [x8]
- .long 0x17fffff4 // b 32b4 <sk_store_f32_aarch64+0x14>
+ .long 0x17fffff4 // b 32d0 <sk_store_f32_aarch64+0x14>
HIDDEN _sk_clamp_x_aarch64
.globl _sk_clamp_x_aarch64
FUNCTION(_sk_clamp_x_aarch64)
_sk_clamp_x_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x6f00e411 // movi v17.2d, #0x0
.long 0x4e20f620 // fmax v0.4s, v17.4s, v0.4s
.long 0x4d40c910 // ld1r {v16.4s}, [x8]
.long 0x4eb0f400 // fmin v0.4s, v0.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_clamp_y_aarch64
.globl _sk_clamp_y_aarch64
FUNCTION(_sk_clamp_y_aarch64)
_sk_clamp_y_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x6f00e411 // movi v17.2d, #0x0
.long 0x4e21f621 // fmax v1.4s, v17.4s, v1.4s
.long 0x4d40c910 // ld1r {v16.4s}, [x8]
.long 0x4eb0f421 // fmin v1.4s, v1.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_repeat_x_aarch64
.globl _sk_repeat_x_aarch64
FUNCTION(_sk_repeat_x_aarch64)
_sk_repeat_x_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xbd400110 // ldr s16, [x8]
.long 0x4e040611 // dup v17.4s, v16.s[0]
.long 0x6e31fc11 // fdiv v17.4s, v0.4s, v17.4s
.long 0x4e219a31 // frintm v17.4s, v17.4s
.long 0x4f905220 // fmls v0.4s, v17.4s, v16.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_repeat_y_aarch64
.globl _sk_repeat_y_aarch64
FUNCTION(_sk_repeat_y_aarch64)
_sk_repeat_y_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xbd400110 // ldr s16, [x8]
.long 0x4e040611 // dup v17.4s, v16.s[0]
.long 0x6e31fc31 // fdiv v17.4s, v1.4s, v17.4s
.long 0x4e219a31 // frintm v17.4s, v17.4s
.long 0x4f905221 // fmls v1.4s, v17.4s, v16.s[0]
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_mirror_x_aarch64
.globl _sk_mirror_x_aarch64
FUNCTION(_sk_mirror_x_aarch64)
_sk_mirror_x_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xbd400110 // ldr s16, [x8]
.long 0x4e040611 // dup v17.4s, v16.s[0]
.long 0x1e302a10 // fadd s16, s16, s16
@@ -3798,13 +3805,13 @@ _sk_mirror_x_aarch64:
.long 0x4f905240 // fmls v0.4s, v18.4s, v16.s[0]
.long 0x4eb1d400 // fsub v0.4s, v0.4s, v17.4s
.long 0x4ea0f800 // fabs v0.4s, v0.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_mirror_y_aarch64
.globl _sk_mirror_y_aarch64
FUNCTION(_sk_mirror_y_aarch64)
_sk_mirror_y_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xbd400110 // ldr s16, [x8]
.long 0x4e040611 // dup v17.4s, v16.s[0]
.long 0x1e302a10 // fadd s16, s16, s16
@@ -3815,27 +3822,27 @@ _sk_mirror_y_aarch64:
.long 0x4f905241 // fmls v1.4s, v18.4s, v16.s[0]
.long 0x4eb1d421 // fsub v1.4s, v1.4s, v17.4s
.long 0x4ea0f821 // fabs v1.4s, v1.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_clamp_x_1_aarch64
.globl _sk_clamp_x_1_aarch64
FUNCTION(_sk_clamp_x_1_aarch64)
_sk_clamp_x_1_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6f00e410 // movi v16.2d, #0x0
.long 0x4e20f600 // fmax v0.4s, v16.4s, v0.4s
.long 0x4f03f610 // fmov v16.4s, #1.000000000000000000e+00
.long 0x4eb0f400 // fmin v0.4s, v0.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_repeat_x_1_aarch64
.globl _sk_repeat_x_1_aarch64
FUNCTION(_sk_repeat_x_1_aarch64)
_sk_repeat_x_1_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e219810 // frintm v16.4s, v0.4s
.long 0x4eb0d400 // fsub v0.4s, v0.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_mirror_x_1_aarch64
.globl _sk_mirror_x_1_aarch64
@@ -3847,11 +3854,11 @@ _sk_mirror_x_1_aarch64:
.long 0x6e31dc11 // fmul v17.4s, v0.4s, v17.4s
.long 0x4e219a31 // frintm v17.4s, v17.4s
.long 0x4e31d631 // fadd v17.4s, v17.4s, v17.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4eb1d400 // fsub v0.4s, v0.4s, v17.4s
.long 0x4e30d400 // fadd v0.4s, v0.4s, v16.4s
.long 0x4ea0f800 // fabs v0.4s, v0.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_luminance_to_alpha_aarch64
.globl _sk_luminance_to_alpha_aarch64
@@ -3865,7 +3872,7 @@ _sk_luminance_to_alpha_aarch64:
.long 0x4ea01c10 // mov v16.16b, v0.16b
.long 0x4e040d00 // dup v0.4s, w8
.long 0x52a7b268 // mov w8, #0x3d930000
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x729bb308 // movk w8, #0xdd98
.long 0x6e20dc23 // fmul v3.4s, v1.4s, v0.4s
.long 0x4e30ce23 // fmla v3.4s, v17.4s, v16.4s
@@ -3874,13 +3881,13 @@ _sk_luminance_to_alpha_aarch64:
.long 0x6f00e401 // movi v1.2d, #0x0
.long 0x4e22ce03 // fmla v3.4s, v16.4s, v2.4s
.long 0x6f00e402 // movi v2.2d, #0x0
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_matrix_2x3_aarch64
.globl _sk_matrix_2x3_aarch64
FUNCTION(_sk_matrix_2x3_aarch64)
_sk_matrix_2x3_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803e9 // mov x9, x8
.long 0x9100410a // add x10, x8, #0x10
.long 0x4ddfc932 // ld1r {v18.4s}, [x9], #4
@@ -3895,13 +3902,13 @@ _sk_matrix_2x3_aarch64:
.long 0x4f931011 // fmla v17.4s, v0.4s, v19.s[0]
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x4eb11e21 // mov v1.16b, v17.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_matrix_3x4_aarch64
.globl _sk_matrix_3x4_aarch64
FUNCTION(_sk_matrix_3x4_aarch64)
_sk_matrix_3x4_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803e9 // mov x9, x8
.long 0x9100910a // add x10, x8, #0x24
.long 0x4ddfc933 // ld1r {v19.4s}, [x9], #4
@@ -3927,7 +3934,7 @@ _sk_matrix_3x4_aarch64:
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x4eb11e21 // mov v1.16b, v17.16b
.long 0x4eb21e42 // mov v2.16b, v18.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_matrix_4x5_aarch64
.globl _sk_matrix_4x5_aarch64
@@ -3945,7 +3952,7 @@ _sk_matrix_4x5_aarch64:
.long 0x2d465533 // ldp s19, s21, [x9, #48]
.long 0x2d475d36 // ldp s22, s23, [x9, #56]
.long 0x9101312a // add x10, x9, #0x4c
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f931070 // fmla v16.4s, v3.4s, v19.s[0]
.long 0x4d40c953 // ld1r {v19.4s}, [x10]
.long 0x4f951071 // fmla v17.4s, v3.4s, v21.s[0]
@@ -3974,7 +3981,7 @@ _sk_matrix_4x5_aarch64:
.long 0x4eb11e21 // mov v1.16b, v17.16b
.long 0x4eb21e42 // mov v2.16b, v18.16b
.long 0x4eb31e63 // mov v3.16b, v19.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_matrix_4x3_aarch64
.globl _sk_matrix_4x3_aarch64
@@ -4000,20 +4007,20 @@ _sk_matrix_4x3_aarch64:
.long 0x4f951022 // fmla v2.4s, v1.4s, v21.s[0]
.long 0x4f961023 // fmla v3.4s, v1.4s, v22.s[0]
.long 0x2d414d01 // ldp s1, s19, [x8, #8]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f921011 // fmla v17.4s, v0.4s, v18.s[0]
.long 0x91004021 // add x1, x1, #0x10
.long 0x4f811002 // fmla v2.4s, v0.4s, v1.s[0]
.long 0x4f931003 // fmla v3.4s, v0.4s, v19.s[0]
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x4eb11e21 // mov v1.16b, v17.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_matrix_perspective_aarch64
.globl _sk_matrix_perspective_aarch64
FUNCTION(_sk_matrix_perspective_aarch64)
_sk_matrix_perspective_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803e9 // mov x9, x8
.long 0x9100510a // add x10, x8, #0x14
.long 0x4ddfc930 // ld1r {v16.4s}, [x9], #4
@@ -4036,7 +4043,7 @@ _sk_matrix_perspective_aarch64:
.long 0x4e20ce14 // fmla v20.4s, v16.4s, v0.4s
.long 0x6e32de21 // fmul v1.4s, v17.4s, v18.4s
.long 0x6e32de80 // fmul v0.4s, v20.4s, v18.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_evenly_spaced_gradient_aarch64
.globl _sk_evenly_spaced_gradient_aarch64
@@ -4059,70 +4066,70 @@ _sk_evenly_spaced_gradient_aarch64:
.long 0x6f20a422 // uxtl2 v2.2d, v1.4s
.long 0x2f20a421 // uxtl v1.2d, v1.2s
.long 0x9e660032 // fmov x18, d1
- .long 0x9e660045 // fmov x5, d2
+ .long 0x9e660046 // fmov x6, d2
.long 0x4e183c2b // mov x11, v1.d[1]
- .long 0x4e183c44 // mov x4, v2.d[1]
- .long 0xbc657921 // ldr s1, [x9, x5, lsl #2]
- .long 0xbc6579a2 // ldr s2, [x13, x5, lsl #2]
- .long 0xbc6579c3 // ldr s3, [x14, x5, lsl #2]
- .long 0xbc657a11 // ldr s17, [x16, x5, lsl #2]
- .long 0xbc6579f2 // ldr s18, [x15, x5, lsl #2]
- .long 0xbc657a33 // ldr s19, [x17, x5, lsl #2]
- .long 0xbc657994 // ldr s20, [x12, x5, lsl #2]
- .long 0xbc657955 // ldr s21, [x10, x5, lsl #2]
- .long 0x8b120925 // add x5, x9, x18, lsl #2
- .long 0x0d4080b6 // ld1 {v22.s}[0], [x5]
- .long 0x8b1209a5 // add x5, x13, x18, lsl #2
- .long 0x0d4080b0 // ld1 {v16.s}[0], [x5]
- .long 0x8b0b0925 // add x5, x9, x11, lsl #2
- .long 0x0d4090b6 // ld1 {v22.s}[1], [x5]
- .long 0x8b1209c5 // add x5, x14, x18, lsl #2
- .long 0x0d4080b7 // ld1 {v23.s}[0], [x5]
- .long 0x8b120a05 // add x5, x16, x18, lsl #2
+ .long 0x4e183c45 // mov x5, v2.d[1]
+ .long 0xbc667921 // ldr s1, [x9, x6, lsl #2]
+ .long 0xbc6679a2 // ldr s2, [x13, x6, lsl #2]
+ .long 0xbc6679c3 // ldr s3, [x14, x6, lsl #2]
+ .long 0xbc667a11 // ldr s17, [x16, x6, lsl #2]
+ .long 0xbc6679f2 // ldr s18, [x15, x6, lsl #2]
+ .long 0xbc667a33 // ldr s19, [x17, x6, lsl #2]
+ .long 0xbc667994 // ldr s20, [x12, x6, lsl #2]
+ .long 0xbc667955 // ldr s21, [x10, x6, lsl #2]
+ .long 0x8b120926 // add x6, x9, x18, lsl #2
+ .long 0x0d4080d6 // ld1 {v22.s}[0], [x6]
+ .long 0x8b1209a6 // add x6, x13, x18, lsl #2
+ .long 0x0d4080d0 // ld1 {v16.s}[0], [x6]
+ .long 0x8b0b0926 // add x6, x9, x11, lsl #2
+ .long 0x0d4090d6 // ld1 {v22.s}[1], [x6]
+ .long 0x8b1209c6 // add x6, x14, x18, lsl #2
+ .long 0x0d4080d7 // ld1 {v23.s}[0], [x6]
+ .long 0x8b120a06 // add x6, x16, x18, lsl #2
.long 0x6e140436 // mov v22.s[2], v1.s[0]
- .long 0x0d4080a1 // ld1 {v1.s}[0], [x5]
- .long 0x8b0b09a5 // add x5, x13, x11, lsl #2
- .long 0x0d4090b0 // ld1 {v16.s}[1], [x5]
- .long 0x8b0b09c5 // add x5, x14, x11, lsl #2
- .long 0x0d4090b7 // ld1 {v23.s}[1], [x5]
- .long 0x8b1209e5 // add x5, x15, x18, lsl #2
- .long 0x0d4080b8 // ld1 {v24.s}[0], [x5]
- .long 0x8b120a25 // add x5, x17, x18, lsl #2
+ .long 0x0d4080c1 // ld1 {v1.s}[0], [x6]
+ .long 0x8b0b09a6 // add x6, x13, x11, lsl #2
+ .long 0x0d4090d0 // ld1 {v16.s}[1], [x6]
+ .long 0x8b0b09c6 // add x6, x14, x11, lsl #2
+ .long 0x0d4090d7 // ld1 {v23.s}[1], [x6]
+ .long 0x8b1209e6 // add x6, x15, x18, lsl #2
+ .long 0x0d4080d8 // ld1 {v24.s}[0], [x6]
+ .long 0x8b120a26 // add x6, x17, x18, lsl #2
.long 0x6e140450 // mov v16.s[2], v2.s[0]
- .long 0x0d4080a2 // ld1 {v2.s}[0], [x5]
- .long 0x8b0b0a05 // add x5, x16, x11, lsl #2
- .long 0x0d4090a1 // ld1 {v1.s}[1], [x5]
- .long 0x8b0b09e5 // add x5, x15, x11, lsl #2
- .long 0x0d4090b8 // ld1 {v24.s}[1], [x5]
- .long 0x8b120985 // add x5, x12, x18, lsl #2
+ .long 0x0d4080c2 // ld1 {v2.s}[0], [x6]
+ .long 0x8b0b0a06 // add x6, x16, x11, lsl #2
+ .long 0x0d4090c1 // ld1 {v1.s}[1], [x6]
+ .long 0x8b0b09e6 // add x6, x15, x11, lsl #2
+ .long 0x0d4090d8 // ld1 {v24.s}[1], [x6]
+ .long 0x8b120986 // add x6, x12, x18, lsl #2
.long 0x8b120952 // add x18, x10, x18, lsl #2
.long 0x6e140477 // mov v23.s[2], v3.s[0]
.long 0x0d408243 // ld1 {v3.s}[0], [x18]
.long 0x8b0b0a32 // add x18, x17, x11, lsl #2
.long 0x6e140621 // mov v1.s[2], v17.s[0]
- .long 0x0d4080b1 // ld1 {v17.s}[0], [x5]
+ .long 0x0d4080d1 // ld1 {v17.s}[0], [x6]
.long 0x0d409242 // ld1 {v2.s}[1], [x18]
.long 0x8b0b0992 // add x18, x12, x11, lsl #2
.long 0x6e140658 // mov v24.s[2], v18.s[0]
.long 0x0d409251 // ld1 {v17.s}[1], [x18]
.long 0x6e140662 // mov v2.s[2], v19.s[0]
- .long 0xbc647932 // ldr s18, [x9, x4, lsl #2]
- .long 0xbc6479b3 // ldr s19, [x13, x4, lsl #2]
+ .long 0xbc657932 // ldr s18, [x9, x5, lsl #2]
+ .long 0xbc6579b3 // ldr s19, [x13, x5, lsl #2]
.long 0x6e140691 // mov v17.s[2], v20.s[0]
- .long 0xbc6479d4 // ldr s20, [x14, x4, lsl #2]
+ .long 0xbc6579d4 // ldr s20, [x14, x5, lsl #2]
.long 0x6e1c0656 // mov v22.s[3], v18.s[0]
- .long 0xbc647a12 // ldr s18, [x16, x4, lsl #2]
+ .long 0xbc657a12 // ldr s18, [x16, x5, lsl #2]
.long 0x6e1c0670 // mov v16.s[3], v19.s[0]
- .long 0xbc6479f3 // ldr s19, [x15, x4, lsl #2]
+ .long 0xbc6579f3 // ldr s19, [x15, x5, lsl #2]
.long 0x8b0b094b // add x11, x10, x11, lsl #2
.long 0x0d409163 // ld1 {v3.s}[1], [x11]
.long 0x6e1c0697 // mov v23.s[3], v20.s[0]
- .long 0xbc647a34 // ldr s20, [x17, x4, lsl #2]
+ .long 0xbc657a34 // ldr s20, [x17, x5, lsl #2]
.long 0x6e1c0641 // mov v1.s[3], v18.s[0]
- .long 0xbc647992 // ldr s18, [x12, x4, lsl #2]
+ .long 0xbc657992 // ldr s18, [x12, x5, lsl #2]
.long 0x6e1c0678 // mov v24.s[3], v19.s[0]
- .long 0xbc647953 // ldr s19, [x10, x4, lsl #2]
- .long 0xf9400504 // ldr x4, [x8, #8]
+ .long 0xbc657953 // ldr s19, [x10, x5, lsl #2]
+ .long 0xf9400505 // ldr x5, [x8, #8]
.long 0x6e1406a3 // mov v3.s[2], v21.s[0]
.long 0x6e1c0682 // mov v2.s[3], v20.s[0]
.long 0x6e1c0651 // mov v17.s[3], v18.s[0]
@@ -4133,7 +4140,7 @@ _sk_evenly_spaced_gradient_aarch64:
.long 0x4e20ce23 // fmla v3.4s, v17.4s, v0.4s
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x910043ff // add sp, sp, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_gauss_a_to_rgba_aarch64
.globl _sk_gauss_a_to_rgba_aarch64
@@ -4154,7 +4161,7 @@ _sk_gauss_a_to_rgba_aarch64:
.long 0x4e23cc01 // fmla v1.4s, v0.4s, v3.4s
.long 0x72830008 // movk w8, #0x1800
.long 0x4e040d30 // dup v16.4s, w9
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x4e23cc22 // fmla v2.4s, v1.4s, v3.4s
.long 0x4e040d00 // dup v0.4s, w8
.long 0x4e23cc50 // fmla v16.4s, v2.4s, v3.4s
@@ -4162,7 +4169,7 @@ _sk_gauss_a_to_rgba_aarch64:
.long 0x4ea01c01 // mov v1.16b, v0.16b
.long 0x4ea01c02 // mov v2.16b, v0.16b
.long 0x4ea01c03 // mov v3.16b, v0.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_gradient_aarch64
.globl _sk_gradient_aarch64
@@ -4176,7 +4183,7 @@ _sk_gradient_aarch64:
.long 0x6f00e411 // movi v17.2d, #0x0
.long 0xf9400109 // ldr x9, [x8]
.long 0xf100093f // cmp x9, #0x2
- .long 0x540001c3 // b.cc 3898 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last
+ .long 0x540001c3 // b.cc 38b4 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last
.long 0xf940250a // ldr x10, [x8, #72]
.long 0xd1000529 // sub x9, x9, #0x1
.long 0x6f00e401 // movi v1.2d, #0x0
@@ -4187,7 +4194,7 @@ _sk_gradient_aarch64:
.long 0x6e23e403 // fcmge v3.4s, v0.4s, v3.4s
.long 0x4e221c63 // and v3.16b, v3.16b, v2.16b
.long 0x4ea18461 // add v1.4s, v3.4s, v1.4s
- .long 0xb5ffff69 // cbnz x9, 3878 <sk_gradient_aarch64+0x38>
+ .long 0xb5ffff69 // cbnz x9, 3894 <sk_gradient_aarch64+0x38>
.long 0x6f20a431 // uxtl2 v17.2d, v1.4s
.long 0x2f20a421 // uxtl v1.2d, v1.2s
.long 0xa940b10a // ldp x10, x12, [x8, #8]
@@ -4260,7 +4267,7 @@ _sk_gradient_aarch64:
.long 0x6e1c06d4 // mov v20.s[3], v22.s[0]
.long 0xbc6b7916 // ldr s22, [x8, x11, lsl #2]
.long 0x4d4081e3 // ld1 {v3.s}[2], [x15]
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e1c06e2 // mov v2.s[3], v23.s[0]
.long 0x6e1c0635 // mov v21.s[3], v17.s[0]
.long 0x6e1c06c3 // mov v3.s[3], v22.s[0]
@@ -4270,13 +4277,13 @@ _sk_gradient_aarch64:
.long 0x4e20cea3 // fmla v3.4s, v21.4s, v0.4s
.long 0x4eb01e00 // mov v0.16b, v16.16b
.long 0x910043ff // add sp, sp, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_evenly_spaced_2_stop_gradient_aarch64
.globl _sk_evenly_spaced_2_stop_gradient_aarch64
FUNCTION(_sk_evenly_spaced_2_stop_gradient_aarch64)
_sk_evenly_spaced_2_stop_gradient_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0xaa0803e9 // mov x9, x8
.long 0x9100410a // add x10, x8, #0x10
.long 0x4ddfc931 // ld1r {v17.4s}, [x9], #4
@@ -4294,7 +4301,7 @@ _sk_evenly_spaced_2_stop_gradient_aarch64:
.long 0x4f931003 // fmla v3.4s, v0.4s, v19.s[0]
.long 0x4f911001 // fmla v1.4s, v0.4s, v17.s[0]
.long 0x4eb01e00 // mov v0.16b, v16.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_xy_to_unit_angle_aarch64
.globl _sk_xy_to_unit_angle_aarch64
@@ -4333,23 +4340,23 @@ _sk_xy_to_unit_angle_aarch64:
.long 0x6e701e40 // bsl v0.16b, v18.16b, v16.16b
.long 0x4ea0e831 // fcmlt v17.4s, v1.4s, #0.0
.long 0x4ea0d690 // fsub v16.4s, v20.4s, v0.4s
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e601e11 // bsl v17.16b, v16.16b, v0.16b
.long 0x6ea0ca20 // fcmge v0.4s, v17.4s, #0.0
.long 0x4ea0ea30 // fcmlt v16.4s, v17.4s, #0.0
.long 0x4ea01e00 // orr v0.16b, v16.16b, v0.16b
.long 0x4e201e20 // and v0.16b, v17.16b, v0.16b
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_xy_to_radius_aarch64
.globl _sk_xy_to_radius_aarch64
FUNCTION(_sk_xy_to_radius_aarch64)
_sk_xy_to_radius_aarch64:
- .long 0xf8408424 // ldr x4, [x1], #8
+ .long 0xf8408425 // ldr x5, [x1], #8
.long 0x6e21dc30 // fmul v16.4s, v1.4s, v1.4s
.long 0x4e20cc10 // fmla v16.4s, v0.4s, v0.4s
.long 0x6ea1fa00 // fsqrt v0.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_save_xy_aarch64
.globl _sk_save_xy_aarch64
@@ -4367,15 +4374,15 @@ _sk_save_xy_aarch64:
.long 0x3d800901 // str q1, [x8, #32]
.long 0x3d801111 // str q17, [x8, #64]
.long 0x3d801910 // str q16, [x8, #96]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_accumulate_aarch64
.globl _sk_accumulate_aarch64
FUNCTION(_sk_accumulate_aarch64)
_sk_accumulate_aarch64:
- .long 0xa8c11028 // ldp x8, x4, [x1], #16
+ .long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x3dc02110 // ldr q16, [x8, #128]
.long 0x3dc02911 // ldr q17, [x8, #160]
.long 0x6e31de10 // fmul v16.4s, v16.4s, v17.4s
@@ -4383,7 +4390,7 @@ _sk_accumulate_aarch64:
.long 0x4e30cc25 // fmla v5.4s, v1.4s, v16.4s
.long 0x4e30cc46 // fmla v6.4s, v2.4s, v16.4s
.long 0x4e30cc67 // fmla v7.4s, v3.4s, v16.4s
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bilinear_nx_aarch64
.globl _sk_bilinear_nx_aarch64
@@ -4395,11 +4402,11 @@ _sk_bilinear_nx_aarch64:
.long 0x3dc00110 // ldr q16, [x8]
.long 0x4ea0d620 // fsub v0.4s, v17.4s, v0.4s
.long 0x3d802100 // str q0, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0567e0 // movi v0.4s, #0xbf, lsl #24
.long 0x4e20d600 // fadd v0.4s, v16.4s, v0.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bilinear_px_aarch64
.globl _sk_bilinear_px_aarch64
@@ -4409,11 +4416,11 @@ _sk_bilinear_px_aarch64:
.long 0x3dc01100 // ldr q0, [x8, #64]
.long 0x3dc00110 // ldr q16, [x8]
.long 0x3d802100 // str q0, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0167e0 // movi v0.4s, #0x3f, lsl #24
.long 0x4e20d600 // fadd v0.4s, v16.4s, v0.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bilinear_ny_aarch64
.globl _sk_bilinear_ny_aarch64
@@ -4425,11 +4432,11 @@ _sk_bilinear_ny_aarch64:
.long 0x3dc00910 // ldr q16, [x8, #32]
.long 0x4ea1d621 // fsub v1.4s, v17.4s, v1.4s
.long 0x3d802901 // str q1, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0567e1 // movi v1.4s, #0xbf, lsl #24
.long 0x4e21d601 // fadd v1.4s, v16.4s, v1.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bilinear_py_aarch64
.globl _sk_bilinear_py_aarch64
@@ -4439,11 +4446,11 @@ _sk_bilinear_py_aarch64:
.long 0x3dc01901 // ldr q1, [x8, #96]
.long 0x3dc00910 // ldr q16, [x8, #32]
.long 0x3d802901 // str q1, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0167e1 // movi v1.4s, #0x3f, lsl #24
.long 0x4e21d601 // fadd v1.4s, v16.4s, v1.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_n3x_aarch64
.globl _sk_bicubic_n3x_aarch64
@@ -4464,11 +4471,11 @@ _sk_bicubic_n3x_aarch64:
.long 0x6e32de20 // fmul v0.4s, v17.4s, v18.4s
.long 0x3dc00113 // ldr q19, [x8]
.long 0x3d802100 // str q0, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f07f700 // fmov v0.4s, #-1.500000000000000000e+00
.long 0x4e20d660 // fadd v0.4s, v19.4s, v0.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_n1x_aarch64
.globl _sk_bicubic_n1x_aarch64
@@ -4491,11 +4498,11 @@ _sk_bicubic_n1x_aarch64:
.long 0x4e20ce51 // fmla v17.4s, v18.4s, v0.4s
.long 0x3dc00110 // ldr q16, [x8]
.long 0x3d802111 // str q17, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0567e0 // movi v0.4s, #0xbf, lsl #24
.long 0x4e20d600 // fadd v0.4s, v16.4s, v0.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_p1x_aarch64
.globl _sk_bicubic_p1x_aarch64
@@ -4517,9 +4524,9 @@ _sk_bicubic_p1x_aarch64:
.long 0x4e040d31 // dup v17.4s, w9
.long 0x4e32ce11 // fmla v17.4s, v16.4s, v18.4s
.long 0x3d802111 // str q17, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_p3x_aarch64
.globl _sk_bicubic_p3x_aarch64
@@ -4538,11 +4545,11 @@ _sk_bicubic_p3x_aarch64:
.long 0x6e31de60 // fmul v0.4s, v19.4s, v17.4s
.long 0x3dc00112 // ldr q18, [x8]
.long 0x3d802100 // str q0, [x8, #128]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f03f700 // fmov v0.4s, #1.500000000000000000e+00
.long 0x4e20d640 // fadd v0.4s, v18.4s, v0.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_n3y_aarch64
.globl _sk_bicubic_n3y_aarch64
@@ -4563,11 +4570,11 @@ _sk_bicubic_n3y_aarch64:
.long 0x6e32de21 // fmul v1.4s, v17.4s, v18.4s
.long 0x3dc00913 // ldr q19, [x8, #32]
.long 0x3d802901 // str q1, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f07f701 // fmov v1.4s, #-1.500000000000000000e+00
.long 0x4e21d661 // fadd v1.4s, v19.4s, v1.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_n1y_aarch64
.globl _sk_bicubic_n1y_aarch64
@@ -4590,11 +4597,11 @@ _sk_bicubic_n1y_aarch64:
.long 0x4e21ce51 // fmla v17.4s, v18.4s, v1.4s
.long 0x3dc00910 // ldr q16, [x8, #32]
.long 0x3d802911 // str q17, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f0567e1 // movi v1.4s, #0xbf, lsl #24
.long 0x4e21d601 // fadd v1.4s, v16.4s, v1.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_p1y_aarch64
.globl _sk_bicubic_p1y_aarch64
@@ -4616,9 +4623,9 @@ _sk_bicubic_p1y_aarch64:
.long 0x4e040d31 // dup v17.4s, w9
.long 0x4e32ce11 // fmla v17.4s, v16.4s, v18.4s
.long 0x3d802911 // str q17, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_bicubic_p3y_aarch64
.globl _sk_bicubic_p3y_aarch64
@@ -4637,49 +4644,53 @@ _sk_bicubic_p3y_aarch64:
.long 0x6e31de61 // fmul v1.4s, v19.4s, v17.4s
.long 0x3dc00912 // ldr q18, [x8, #32]
.long 0x3d802901 // str q1, [x8, #160]
- .long 0xf9400424 // ldr x4, [x1, #8]
+ .long 0xf9400425 // ldr x5, [x1, #8]
.long 0x4f03f701 // fmov v1.4s, #1.500000000000000000e+00
.long 0x4e21d641 // fadd v1.4s, v18.4s, v1.4s
.long 0x91004021 // add x1, x1, #0x10
- .long 0xd61f0080 // br x4
+ .long 0xd61f00a0 // br x5
HIDDEN _sk_callback_aarch64
.globl _sk_callback_aarch64
FUNCTION(_sk_callback_aarch64)
_sk_callback_aarch64:
- .long 0xd101c3ff // sub sp, sp, #0x70
- .long 0xa9045bf7 // stp x23, x22, [sp, #64]
- .long 0xa90553f5 // stp x21, x20, [sp, #80]
- .long 0xa9067bf3 // stp x19, x30, [sp, #96]
+ .long 0xd10203ff // sub sp, sp, #0x80
+ .long 0xf90023f8 // str x24, [sp, #64]
+ .long 0xa9055bf7 // stp x23, x22, [sp, #80]
+ .long 0xa90653f5 // stp x21, x20, [sp, #96]
+ .long 0xa9077bf3 // stp x19, x30, [sp, #112]
.long 0xad011fe6 // stp q6, q7, [sp, #32]
.long 0xad0017e4 // stp q4, q5, [sp]
- .long 0xaa0103f5 // mov x21, x1
- .long 0xf94002b7 // ldr x23, [x21]
- .long 0xaa0303f3 // mov x19, x3
+ .long 0xaa0103f6 // mov x22, x1
+ .long 0xf94002d8 // ldr x24, [x22]
+ .long 0xaa0403f3 // mov x19, x4
.long 0xf100027f // cmp x19, #0x0
.long 0x321e03e9 // orr w9, wzr, #0x4
- .long 0x910022e8 // add x8, x23, #0x8
+ .long 0x91002308 // add x8, x24, #0x8
.long 0x4c000900 // st4 {v0.4s-v3.4s}, [x8]
- .long 0xf94002e8 // ldr x8, [x23]
- .long 0xaa0003f6 // mov x22, x0
+ .long 0xf9400308 // ldr x8, [x24]
+ .long 0xaa0003f7 // mov x23, x0
.long 0x1a891261 // csel w1, w19, w9, ne // ne = any
- .long 0xaa1703e0 // mov x0, x23
- .long 0xaa0203f4 // mov x20, x2
+ .long 0xaa1803e0 // mov x0, x24
+ .long 0xaa0303f4 // mov x20, x3
+ .long 0xaa0203f5 // mov x21, x2
.long 0xd63f0100 // blr x8
- .long 0xf94046e8 // ldr x8, [x23, #136]
- .long 0xf94006a4 // ldr x4, [x21, #8]
- .long 0x910042a1 // add x1, x21, #0x10
- .long 0xaa1603e0 // mov x0, x22
+ .long 0xf9404708 // ldr x8, [x24, #136]
+ .long 0xf94006c5 // ldr x5, [x22, #8]
+ .long 0x910042c1 // add x1, x22, #0x10
+ .long 0xaa1703e0 // mov x0, x23
.long 0x4c400900 // ld4 {v0.4s-v3.4s}, [x8]
- .long 0xaa1403e2 // mov x2, x20
- .long 0xaa1303e3 // mov x3, x19
+ .long 0xaa1503e2 // mov x2, x21
+ .long 0xaa1403e3 // mov x3, x20
+ .long 0xaa1303e4 // mov x4, x19
.long 0xad4017e4 // ldp q4, q5, [sp]
.long 0xad411fe6 // ldp q6, q7, [sp, #32]
- .long 0xa9467bf3 // ldp x19, x30, [sp, #96]
- .long 0xa94553f5 // ldp x21, x20, [sp, #80]
- .long 0xa9445bf7 // ldp x23, x22, [sp, #64]
- .long 0x9101c3ff // add sp, sp, #0x70
- .long 0xd61f0080 // br x4
+ .long 0xa9477bf3 // ldp x19, x30, [sp, #112]
+ .long 0xa94653f5 // ldp x21, x20, [sp, #96]
+ .long 0xa9455bf7 // ldp x23, x22, [sp, #80]
+ .long 0xf94023f8 // ldr x24, [sp, #64]
+ .long 0x910203ff // add sp, sp, #0x80
+ .long 0xd61f00a0 // br x5
#elif defined(__arm__)
BALIGN4
@@ -4687,48 +4698,54 @@ HIDDEN _sk_start_pipeline_vfp4
.globl _sk_start_pipeline_vfp4
FUNCTION(_sk_start_pipeline_vfp4)
_sk_start_pipeline_vfp4:
- .long 0xe92d41f0 // push {r4, r5, r6, r7, r8, lr}
- .long 0xe1a05001 // mov r5, r1
+ .long 0xe92d47f0 // push {r4, r5, r6, r7, r8, r9, sl, lr}
+ .long 0xe24dd008 // sub sp, sp, #8
+ .long 0xe1a04003 // mov r4, r3
+ .long 0xe59d8028 // ldr r8, [sp, #40]
+ .long 0xe4949004 // ldr r9, [r4], #4
.long 0xe1a06000 // mov r6, r0
- .long 0xe1a07003 // mov r7, r3
- .long 0xe1a08002 // mov r8, r2
- .long 0xe495c004 // ldr ip, [r5], #4
.long 0xe2860002 // add r0, r6, #2
- .long 0xea000010 // b 64 <sk_start_pipeline_vfp4+0x64>
+ .long 0xe1a07002 // mov r7, r2
+ .long 0xe1a05001 // mov r5, r1
+ .long 0xe1500007 // cmp r0, r7
+ .long 0x8a000012 // bhi 78 <sk_start_pipeline_vfp4+0x78>
+ .long 0xe3a0a000 // mov sl, #0
.long 0xf2800010 // vmov.i32 d0, #0
- .long 0xe1a00006 // mov r0, r6
+ .long 0xe1a00008 // mov r0, r8
.long 0xf2801010 // vmov.i32 d1, #0
- .long 0xe1a01005 // mov r1, r5
+ .long 0xe1a01004 // mov r1, r4
.long 0xf2802010 // vmov.i32 d2, #0
- .long 0xe1a02008 // mov r2, r8
+ .long 0xe1a02006 // mov r2, r6
.long 0xf2803010 // vmov.i32 d3, #0
- .long 0xe3a03000 // mov r3, #0
+ .long 0xe1a03005 // mov r3, r5
.long 0xf2804010 // vmov.i32 d4, #0
- .long 0xe1a0400c // mov r4, ip
+ .long 0xe58da000 // str sl, [sp]
.long 0xf2805010 // vmov.i32 d5, #0
.long 0xf2806010 // vmov.i32 d6, #0
.long 0xf2807010 // vmov.i32 d7, #0
- .long 0xe12fff34 // blx r4
+ .long 0xe12fff39 // blx r9
.long 0xe2860004 // add r0, r6, #4
.long 0xe2866002 // add r6, r6, #2
- .long 0xe1a0c004 // mov ip, r4
.long 0xe1500007 // cmp r0, r7
- .long 0x9affffec // bls 20 <sk_start_pipeline_vfp4+0x20>
- .long 0xe0573006 // subs r3, r7, r6
- .long 0x08bd81f0 // popeq {r4, r5, r6, r7, r8, pc}
- .long 0xe1a00006 // mov r0, r6
- .long 0xe1a01005 // mov r1, r5
- .long 0xe1a02008 // mov r2, r8
+ .long 0x9affffed // bls 30 <sk_start_pipeline_vfp4+0x30>
+ .long 0xe0570006 // subs r0, r7, r6
+ .long 0x0a00000d // beq b8 <sk_start_pipeline_vfp4+0xb8>
.long 0xf2800010 // vmov.i32 d0, #0
+ .long 0xe58d0000 // str r0, [sp]
.long 0xf2801010 // vmov.i32 d1, #0
+ .long 0xe1a00008 // mov r0, r8
.long 0xf2802010 // vmov.i32 d2, #0
+ .long 0xe1a01004 // mov r1, r4
.long 0xf2803010 // vmov.i32 d3, #0
+ .long 0xe1a02006 // mov r2, r6
.long 0xf2804010 // vmov.i32 d4, #0
+ .long 0xe1a03005 // mov r3, r5
.long 0xf2805010 // vmov.i32 d5, #0
.long 0xf2806010 // vmov.i32 d6, #0
.long 0xf2807010 // vmov.i32 d7, #0
- .long 0xe8bd41f0 // pop {r4, r5, r6, r7, r8, lr}
- .long 0xe12fff1c // bx ip
+ .long 0xe12fff39 // blx r9
+ .long 0xe28dd008 // add sp, sp, #8
+ .long 0xe8bd87f0 // pop {r4, r5, r6, r7, r8, r9, sl, pc}
HIDDEN _sk_just_return_vfp4
.globl _sk_just_return_vfp4
@@ -4740,68 +4757,63 @@ HIDDEN _sk_seed_shader_vfp4
.globl _sk_seed_shader_vfp4
FUNCTION(_sk_seed_shader_vfp4)
_sk_seed_shader_vfp4:
- .long 0xe92d4800 // push {fp, lr}
- .long 0xee800b90 // vdup.32 d16, r0
- .long 0xe591e000 // ldr lr, [r1]
- .long 0xf3fb0620 // vcvt.f32.s32 d16, d16
- .long 0xedd23b00 // vldr d19, [r2]
+ .long 0xee802b90 // vdup.32 d16, r2
.long 0xf2c3161f // vmov.i32 d17, #1056964608
- .long 0xe591c004 // ldr ip, [r1, #4]
- .long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
- .long 0xe2811008 // add r1, r1, #8
+ .long 0xf3fb0620 // vcvt.f32.s32 d16, d16
+ .long 0xee823b90 // vdup.32 d18, r3
.long 0xf3fb2622 // vcvt.f32.s32 d18, d18
- .long 0xf2400da1 // vadd.f32 d16, d16, d17
+ .long 0xedd03b00 // vldr d19, [r0]
+ .long 0xe491c004 // ldr ip, [r1], #4
.long 0xf2872f10 // vmov.f32 d2, #1
.long 0xf2803010 // vmov.i32 d3, #0
+ .long 0xf2400da1 // vadd.f32 d16, d16, d17
.long 0xf2021da1 // vadd.f32 d1, d18, d17
- .long 0xf2000da3 // vadd.f32 d0, d16, d19
.long 0xf2804010 // vmov.i32 d4, #0
.long 0xf2805010 // vmov.i32 d5, #0
+ .long 0xf2000da3 // vadd.f32 d0, d16, d19
.long 0xf2806010 // vmov.i32 d6, #0
.long 0xf2807010 // vmov.i32 d7, #0
- .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
HIDDEN _sk_dither_vfp4
.globl _sk_dither_vfp4
FUNCTION(_sk_dither_vfp4)
_sk_dither_vfp4:
- .long 0xe92d4010 // push {r4, lr}
- .long 0xe591e000 // ldr lr, [r1]
- .long 0xee800b90 // vdup.32 d16, r0
- .long 0xedd21b08 // vldr d17, [r2, #32]
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xee802b90 // vdup.32 d16, r2
.long 0xf2c02011 // vmov.i32 d18, #1
+ .long 0xedd01b08 // vldr d17, [r0, #32]
+ .long 0xf2c03014 // vmov.i32 d19, #4
.long 0xf26108a0 // vadd.i32 d16, d17, d16
- .long 0xe591c004 // ldr ip, [r1, #4]
+ .long 0xee853b90 // vdup.32 d21, r3
.long 0xf2c01012 // vmov.i32 d17, #2
- .long 0xe49e4004 // ldr r4, [lr], #4
+ .long 0xe3a0c5f2 // mov ip, #1015021568
.long 0xf24041b2 // vand d20, d16, d18
- .long 0xe2811008 // add r1, r1, #8
- .long 0xf24051b1 // vand d21, d16, d17
- .long 0xf2c03014 // vmov.i32 d19, #4
- .long 0xf4e47c9f // vld1.32 {d23[]}, [r4 :32]
- .long 0xf2e44534 // vshl.s32 d20, d20, #4
- .long 0xe3a045f2 // mov r4, #1015021568
- .long 0xf24061b3 // vand d22, d16, d19
- .long 0xf34001b7 // veor d16, d16, d23
- .long 0xf2e15535 // vshl.s32 d21, d21, #1
- .long 0xf24021b2 // vand d18, d16, d18
- .long 0xf3fe6036 // vshr.u32 d22, d22, #2
- .long 0xf26541b4 // vorr d20, d21, d20
- .long 0xf24011b1 // vand d17, d16, d17
+ .long 0xe591e000 // ldr lr, [r1]
+ .long 0xf24061b1 // vand d22, d16, d17
+ .long 0xf34551b0 // veor d21, d21, d16
.long 0xf24001b3 // vand d16, d16, d19
- .long 0xf26431b6 // vorr d19, d20, d22
+ .long 0xf2e44534 // vshl.s32 d20, d20, #4
+ .long 0xf2e16536 // vshl.s32 d22, d22, #1
+ .long 0xf24521b2 // vand d18, d21, d18
+ .long 0xf3fe0030 // vshr.u32 d16, d16, #2
+ .long 0xf26641b4 // vorr d20, d22, d20
+ .long 0xf24511b1 // vand d17, d21, d17
.long 0xf2e52532 // vshl.s32 d18, d18, #5
+ .long 0xf26401b0 // vorr d16, d20, d16
+ .long 0xf24531b3 // vand d19, d21, d19
+ .long 0xf26001b2 // vorr d16, d16, d18
.long 0xf2e21531 // vshl.s32 d17, d17, #2
- .long 0xf26321b2 // vorr d18, d19, d18
- .long 0xf3ff0030 // vshr.u32 d16, d16, #1
- .long 0xf26211b1 // vorr d17, d18, d17
+ .long 0xf3ff2033 // vshr.u32 d18, d19, #1
+ .long 0xf26001b1 // vorr d16, d16, d17
+ .long 0xee81cb90 // vdup.32 d17, ip
.long 0xf2c03010 // vmov.i32 d19, #0
- .long 0xf26101b0 // vorr d16, d17, d16
- .long 0xee814b90 // vdup.32 d17, r4
+ .long 0xe591c004 // ldr ip, [r1, #4]
+ .long 0xf26001b2 // vorr d16, d16, d18
+ .long 0xe2811008 // add r1, r1, #8
.long 0xf3fb0620 // vcvt.f32.s32 d16, d16
.long 0xf3400db1 // vmul.f32 d16, d16, d17
- .long 0xeddf1b0d // vldr d17, [pc, #52]
+ .long 0xeddf1b0e // vldr d17, [pc, #56]
.long 0xf2400da1 // vadd.f32 d16, d16, d17
.long 0xf4ee1c9f // vld1.32 {d17[]}, [lr :32]
.long 0xf3410db0 // vmul.f32 d16, d17, d16
@@ -4814,8 +4826,9 @@ _sk_dither_vfp4:
.long 0xf2030fa1 // vmax.f32 d0, d19, d17
.long 0xf2031fa2 // vmax.f32 d1, d19, d18
.long 0xf2032fa0 // vmax.f32 d2, d19, d16
- .long 0xe8bd4010 // pop {r4, lr}
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
+ .long 0xe320f000 // nop {0}
.long 0xbefc0000 // .word 0xbefc0000
.long 0xbefc0000 // .word 0xbefc0000
@@ -6083,16 +6096,18 @@ HIDDEN _sk_srcover_rgba_8888_vfp4
.globl _sk_srcover_rgba_8888_vfp4
FUNCTION(_sk_srcover_rgba_8888_vfp4)
_sk_srcover_rgba_8888_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc100 // add ip, ip, r0, lsl #2
- .long 0x0a00002b // beq 13ec <sk_srcover_rgba_8888_vfp4+0xc4>
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc102 // add ip, ip, r2, lsl #2
+ .long 0x0a00002c // beq 1400 <sk_srcover_rgba_8888_vfp4+0xd0>
.long 0xed9c4b00 // vldr d4, [ip]
.long 0xf2c71f10 // vmov.f32 d17, #1
- .long 0xeddf6b2d // vldr d22, [pc, #180]
+ .long 0xeddf6b2f // vldr d22, [pc, #188]
.long 0xf3c7001f // vmov.i32 d16, #255
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe35e0001 // cmp lr, #1
.long 0xf3f82014 // vshr.u32 d18, d4, #8
.long 0xf3e84014 // vshr.u32 d20, d4, #24
.long 0xf2611d83 // vsub.f32 d17, d17, d3
@@ -6127,16 +6142,18 @@ _sk_srcover_rgba_8888_vfp4:
.long 0xf2f00530 // vshl.s32 d16, d16, #16
.long 0xf26111b2 // vorr d17, d17, d18
.long 0xf26101b0 // vorr d16, d17, d16
- .long 0x0a000006 // beq 13f8 <sk_srcover_rgba_8888_vfp4+0xd0>
+ .long 0x0a000007 // beq 140c <sk_srcover_rgba_8888_vfp4+0xdc>
.long 0xedcc0b00 // vstr d16, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xeddf4a05 // vldr s9, [pc, #20]
+ .long 0xeddf4a06 // vldr s9, [pc, #24]
.long 0xed9c4a00 // vldr s8, [ip]
- .long 0xeaffffd1 // b 1340 <sk_srcover_rgba_8888_vfp4+0x18>
+ .long 0xeaffffd0 // b 1350 <sk_srcover_rgba_8888_vfp4+0x20>
.long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32]
- .long 0xeafffff7 // b 13e0 <sk_srcover_rgba_8888_vfp4+0xb8>
+ .long 0xeafffff6 // b 13f0 <sk_srcover_rgba_8888_vfp4+0xc0>
+ .long 0xe320f000 // nop {0}
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
.long 0x00000000 // .word 0x00000000
@@ -6571,13 +6588,15 @@ HIDDEN _sk_scale_u8_vfp4
.globl _sk_scale_u8_vfp4
FUNCTION(_sk_scale_u8_vfp4)
_sk_scale_u8_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xed2d8b04 // vpush {d8-d9}
.long 0xe24dd008 // sub sp, sp, #8
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de020 // ldr lr, [sp, #32]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc000 // add ip, ip, r0
- .long 0x0a000013 // beq 19f4 <sk_scale_u8_vfp4+0x6c>
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc002 // add ip, ip, r2
+ .long 0x0a000014 // beq 1a18 <sk_scale_u8_vfp4+0x78>
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xe1cdc0b4 // strh ip, [sp, #4]
.long 0xe28dc004 // add ip, sp, #4
@@ -6597,12 +6616,12 @@ _sk_scale_u8_vfp4:
.long 0xf3003d93 // vmul.f32 d3, d16, d3
.long 0xe28dd008 // add sp, sp, #8
.long 0xecbd8b04 // vpop {d8-d9}
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe5dcc000 // ldrb ip, [ip]
- .long 0xeddf8a04 // vldr s17, [pc, #16]
+ .long 0xeddf8a03 // vldr s17, [pc, #12]
.long 0xee08ca10 // vmov s16, ip
- .long 0xeaffffed // b 19bc <sk_scale_u8_vfp4+0x34>
- .long 0xe320f000 // nop {0}
+ .long 0xeaffffec // b 19dc <sk_scale_u8_vfp4+0x3c>
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -6639,10 +6658,11 @@ _sk_lerp_u8_vfp4:
.long 0xed2d8b04 // vpush {d8-d9}
.long 0xe24dd008 // sub sp, sp, #8
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de020 // ldr lr, [sp, #32]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc000 // add ip, ip, r0
- .long 0x0a00001e // beq 1afc <sk_lerp_u8_vfp4+0x9c>
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc002 // add ip, ip, r2
+ .long 0x0a00001e // beq 1b20 <sk_lerp_u8_vfp4+0xa0>
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xe1cdc0b4 // strh ip, [sp, #4]
.long 0xe28dc004 // add ip, sp, #4
@@ -6650,7 +6670,7 @@ _sk_lerp_u8_vfp4:
.long 0xf3c80a30 // vmovl.u8 q8, d16
.long 0xf3908a30 // vmovl.u16 q4, d16
.long 0xf3c7001f // vmov.i32 d16, #255
- .long 0xeddf1b1b // vldr d17, [pc, #108]
+ .long 0xeddf1b1a // vldr d17, [pc, #104]
.long 0xf2602d04 // vsub.f32 d18, d0, d4
.long 0xe591e004 // ldr lr, [r1, #4]
.long 0xf2480130 // vand d16, d8, d16
@@ -6675,10 +6695,9 @@ _sk_lerp_u8_vfp4:
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe5dcc000 // ldrb ip, [ip]
- .long 0xeddf8a04 // vldr s17, [pc, #16]
+ .long 0xeddf8a03 // vldr s17, [pc, #12]
.long 0xee08ca10 // vmov s16, ip
- .long 0xeaffffe2 // b 1a98 <sk_lerp_u8_vfp4+0x38>
- .long 0xe320f000 // nop {0}
+ .long 0xeaffffe2 // b 1abc <sk_lerp_u8_vfp4+0x3c>
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -6692,10 +6711,11 @@ _sk_lerp_565_vfp4:
.long 0xed2d8b04 // vpush {d8-d9}
.long 0xe24dd008 // sub sp, sp, #8
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de020 // ldr lr, [sp, #32]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc080 // add ip, ip, r0, lsl #1
- .long 0x0a00002e // beq 1bfc <sk_lerp_565_vfp4+0xdc>
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc082 // add ip, ip, r2, lsl #1
+ .long 0x0a00002e // beq 1c20 <sk_lerp_565_vfp4+0xe0>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc004 // str ip, [sp, #4]
.long 0xe28dc004 // add ip, sp, #4
@@ -6706,9 +6726,9 @@ _sk_lerp_565_vfp4:
.long 0xee82cb90 // vdup.32 d18, ip
.long 0xf3c71218 // vmov.i32 d17, #63488
.long 0xf2480130 // vand d16, d8, d16
- .long 0xeddf3b28 // vldr d19, [pc, #160]
+ .long 0xeddf3b27 // vldr d19, [pc, #156]
.long 0xf2482132 // vand d18, d8, d18
- .long 0xeddf4b28 // vldr d20, [pc, #160]
+ .long 0xeddf4b27 // vldr d20, [pc, #156]
.long 0xf3fb0620 // vcvt.f32.s32 d16, d16
.long 0xe591e004 // ldr lr, [r1, #4]
.long 0xf3fb2622 // vcvt.f32.s32 d18, d18
@@ -6719,7 +6739,7 @@ _sk_lerp_565_vfp4:
.long 0xf3fb1621 // vcvt.f32.s32 d17, d17
.long 0xe1a0c00e // mov ip, lr
.long 0xf3400db3 // vmul.f32 d16, d16, d19
- .long 0xeddf3b1f // vldr d19, [pc, #124]
+ .long 0xeddf3b1e // vldr d19, [pc, #120]
.long 0xf3422db4 // vmul.f32 d18, d18, d20
.long 0xf2674117 // vorr d20, d7, d7
.long 0xf3411db3 // vmul.f32 d17, d17, d19
@@ -6744,10 +6764,9 @@ _sk_lerp_565_vfp4:
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe1dcc0b0 // ldrh ip, [ip]
- .long 0xeddf8a08 // vldr s17, [pc, #32]
+ .long 0xeddf8a07 // vldr s17, [pc, #28]
.long 0xee08ca10 // vmov s16, ip
- .long 0xeaffffd1 // b 1b54 <sk_lerp_565_vfp4+0x34>
- .long 0xe320f000 // nop {0}
+ .long 0xeaffffd1 // b 1b78 <sk_lerp_565_vfp4+0x38>
.long 0x3d042108 // .word 0x3d042108
.long 0x3d042108 // .word 0x3d042108
.long 0x3a020821 // .word 0x3a020821
@@ -6763,10 +6782,11 @@ FUNCTION(_sk_load_tables_vfp4)
_sk_load_tables_vfp4:
.long 0xe92d47f0 // push {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59d4020 // ldr r4, [sp, #32]
.long 0xe59ce000 // ldr lr, [ip]
- .long 0xe08ee100 // add lr, lr, r0, lsl #2
- .long 0x0a000023 // beq 1cd8 <sk_load_tables_vfp4+0xa8>
+ .long 0xe3540001 // cmp r4, #1
+ .long 0xe08ee102 // add lr, lr, r2, lsl #2
+ .long 0x0a000023 // beq 1cfc <sk_load_tables_vfp4+0xac>
.long 0xed9e0b00 // vldr d0, [lr]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe59c7004 // ldr r7, [ip, #4]
@@ -6777,21 +6797,21 @@ _sk_load_tables_vfp4:
.long 0xf24111b0 // vand d17, d17, d16
.long 0xf24221b0 // vand d18, d18, d16
.long 0xf2400130 // vand d16, d0, d16
- .long 0xee31eb90 // vmov.32 lr, d17[1]
- .long 0xee329b90 // vmov.32 r9, d18[1]
+ .long 0xee319b90 // vmov.32 r9, d17[1]
+ .long 0xee32eb90 // vmov.32 lr, d18[1]
.long 0xee305b90 // vmov.32 r5, d16[1]
.long 0xee108b90 // vmov.32 r8, d16[0]
.long 0xf3e80010 // vshr.u32 d16, d0, #24
.long 0xee12cb90 // vmov.32 ip, d18[0]
.long 0xee11ab90 // vmov.32 sl, d17[0]
.long 0xf3fb0620 // vcvt.f32.s32 d16, d16
- .long 0xeddf1b14 // vldr d17, [pc, #80]
+ .long 0xeddf1b13 // vldr d17, [pc, #76]
.long 0xf3003db1 // vmul.f32 d3, d16, d17
- .long 0xe084e10e // add lr, r4, lr, lsl #2
- .long 0xe0869109 // add r9, r6, r9, lsl #2
+ .long 0xe0849109 // add r9, r4, r9, lsl #2
+ .long 0xe086e10e // add lr, r6, lr, lsl #2
.long 0xe0875105 // add r5, r7, r5, lsl #2
- .long 0xedde2a00 // vldr s5, [lr]
- .long 0xedd91a00 // vldr s3, [r9]
+ .long 0xedd92a00 // vldr s5, [r9]
+ .long 0xedde1a00 // vldr s3, [lr]
.long 0xedd50a00 // vldr s1, [r5]
.long 0xe0875108 // add r5, r7, r8, lsl #2
.long 0xe086710c // add r7, r6, ip, lsl #2
@@ -6803,10 +6823,9 @@ _sk_load_tables_vfp4:
.long 0xed972a00 // vldr s4, [r7]
.long 0xe8bd47f0 // pop {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe12fff1c // bx ip
- .long 0xeddf0a04 // vldr s1, [pc, #16]
+ .long 0xeddf0a03 // vldr s1, [pc, #12]
.long 0xed9e0a00 // vldr s0, [lr]
- .long 0xeaffffd9 // b 1c4c <sk_load_tables_vfp4+0x1c>
- .long 0xe320f000 // nop {0}
+ .long 0xeaffffd9 // b 1c70 <sk_load_tables_vfp4+0x20>
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -6818,24 +6837,25 @@ FUNCTION(_sk_load_tables_u16_be_vfp4)
_sk_load_tables_u16_be_vfp4:
.long 0xe92d47f0 // push {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59d4020 // ldr r4, [sp, #32]
.long 0xe59ce000 // ldr lr, [ip]
- .long 0xe08ee180 // add lr, lr, r0, lsl #3
+ .long 0xe3540000 // cmp r4, #0
+ .long 0xe08ee182 // add lr, lr, r2, lsl #3
.long 0xf4ee070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [lr]
- .long 0x1a000001 // bne 1d1c <sk_load_tables_u16_be_vfp4+0x24>
- .long 0xe28ee008 // add lr, lr, #8
- .long 0xf4ee074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [lr]
- .long 0xee92ebb0 // vmov.u16 lr, d18[0]
+ .long 0x1a000001 // bne 1d40 <sk_load_tables_u16_be_vfp4+0x28>
+ .long 0xe28e4008 // add r4, lr, #8
+ .long 0xf4e4074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [r4]
+ .long 0xee924bb0 // vmov.u16 r4, d18[0]
.long 0xf3c7701f // vmov.i32 d23, #255
.long 0xee905bb0 // vmov.u16 r5, d16[0]
- .long 0xee914bb0 // vmov.u16 r4, d17[0]
+ .long 0xee91ebb0 // vmov.u16 lr, d17[0]
.long 0xee926bf0 // vmov.u16 r6, d18[1]
.long 0xee908bf0 // vmov.u16 r8, d16[1]
.long 0xee917bf0 // vmov.u16 r7, d17[1]
- .long 0xee04eb90 // vmov.32 d20[0], lr
- .long 0xee065b90 // vmov.32 d22[0], r5
- .long 0xee054b90 // vmov.32 d21[0], r4
+ .long 0xee044b90 // vmov.32 d20[0], r4
.long 0xe59c400c // ldr r4, [ip, #12]
+ .long 0xee065b90 // vmov.32 d22[0], r5
+ .long 0xee05eb90 // vmov.32 d21[0], lr
.long 0xee246b90 // vmov.32 d20[1], r6
.long 0xee936bb0 // vmov.u16 r6, d19[0]
.long 0xee268b90 // vmov.32 d22[1], r8
@@ -6865,7 +6885,7 @@ _sk_load_tables_u16_be_vfp4:
.long 0xe0875108 // add r5, r7, r8, lsl #2
.long 0xf26001b1 // vorr d16, d16, d17
.long 0xedd91a00 // vldr s3, [r9]
- .long 0xeddf1b0d // vldr d17, [pc, #52]
+ .long 0xeddf1b0c // vldr d17, [pc, #48]
.long 0xf24001b2 // vand d16, d16, d18
.long 0xedda2a00 // vldr s5, [sl]
.long 0xed950a00 // vldr s0, [r5]
@@ -6879,7 +6899,6 @@ _sk_load_tables_u16_be_vfp4:
.long 0xed972a00 // vldr s4, [r7]
.long 0xe8bd47f0 // pop {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe12fff1c // bx ip
- .long 0xe320f000 // nop {0}
.long 0x37800080 // .word 0x37800080
.long 0x37800080 // .word 0x37800080
@@ -6889,12 +6908,13 @@ FUNCTION(_sk_load_tables_rgb_u16_be_vfp4)
_sk_load_tables_rgb_u16_be_vfp4:
.long 0xe92d47f0 // push {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe0804080 // add r4, r0, r0, lsl #1
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe0824082 // add r4, r2, r2, lsl #1
.long 0xe59ce000 // ldr lr, [ip]
.long 0xe08ee084 // add lr, lr, r4, lsl #1
+ .long 0xe59d4020 // ldr r4, [sp, #32]
.long 0xf4ee060f // vld3.16 {d16[0],d17[0],d18[0]}, [lr]
- .long 0x1a000001 // bne 1e28 <sk_load_tables_rgb_u16_be_vfp4+0x28>
+ .long 0xe3540000 // cmp r4, #0
+ .long 0x1a000001 // bne 1e4c <sk_load_tables_rgb_u16_be_vfp4+0x2c>
.long 0xe28e4006 // add r4, lr, #6
.long 0xf4e4064f // vld3.16 {d16[1],d17[1],d18[1]}, [r4]
.long 0xee924bb0 // vmov.u16 r4, d18[0]
@@ -6937,6 +6957,7 @@ _sk_load_tables_rgb_u16_be_vfp4:
.long 0xed972a00 // vldr s4, [r7]
.long 0xe8bd47f0 // pop {r4, r5, r6, r7, r8, r9, sl, lr}
.long 0xe12fff1c // bx ip
+ .long 0xe320f000 // nop {0}
HIDDEN _sk_byte_tables_vfp4
.globl _sk_byte_tables_vfp4
@@ -7601,34 +7622,38 @@ HIDDEN _sk_load_a8_vfp4
.globl _sk_load_a8_vfp4
FUNCTION(_sk_load_a8_vfp4)
_sk_load_a8_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xe24dd004 // sub sp, sp, #4
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de00c // ldr lr, [sp, #12]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc000 // add ip, ip, r0
- .long 0x0a000012 // beq 2898 <sk_load_a8_vfp4+0x60>
- .long 0xe24dd004 // sub sp, sp, #4
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc002 // add ip, ip, r2
+ .long 0x0a000012 // beq 28cc <sk_load_a8_vfp4+0x6c>
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xe1cdc0b0 // strh ip, [sp]
.long 0xe1a0c00d // mov ip, sp
.long 0xf4ec041f // vld1.16 {d16[0]}, [ip :16]
.long 0xf3c80a30 // vmovl.u8 q8, d16
.long 0xf3900a30 // vmovl.u16 q0, d16
- .long 0xe28dd004 // add sp, sp, #4
.long 0xf3c7001f // vmov.i32 d16, #255
- .long 0xeddf1b0c // vldr d17, [pc, #48]
+ .long 0xeddf1b0f // vldr d17, [pc, #60]
.long 0xe591c004 // ldr ip, [r1, #4]
- .long 0xf2802010 // vmov.i32 d2, #0
- .long 0xf2400130 // vand d16, d0, d16
.long 0xe2811008 // add r1, r1, #8
+ .long 0xf2400130 // vand d16, d0, d16
.long 0xf2800010 // vmov.i32 d0, #0
.long 0xf3fb06a0 // vcvt.f32.u32 d16, d16
.long 0xf2801010 // vmov.i32 d1, #0
+ .long 0xf2802010 // vmov.i32 d2, #0
.long 0xf3003db1 // vmul.f32 d3, d16, d17
+ .long 0xe28dd004 // add sp, sp, #4
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe5dcc000 // ldrb ip, [ip]
- .long 0xeddf0a03 // vldr s1, [pc, #12]
+ .long 0xeddf0a04 // vldr s1, [pc, #16]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeafffff0 // b 286c <sk_load_a8_vfp4+0x34>
+ .long 0xeaffffee // b 2898 <sk_load_a8_vfp4+0x38>
+ .long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -7676,11 +7701,12 @@ _sk_store_a8_vfp4:
.long 0xf2c3161f // vmov.i32 d17, #1056964608
.long 0xf2431c30 // vfma.f32 d17, d3, d16
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc000 // add ip, ip, r0
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc002 // add ip, ip, r2
.long 0xf3fb07a1 // vcvt.u32.f32 d16, d17
- .long 0x0a000007 // beq 2970 <sk_store_a8_vfp4+0x48>
+ .long 0x0a000007 // beq 29ac <sk_store_a8_vfp4+0x4c>
.long 0xee30eb90 // vmov.32 lr, d16[1]
.long 0xee104b90 // vmov.32 r4, d16[0]
.long 0xe5cce001 // strb lr, [ip, #1]
@@ -7691,8 +7717,7 @@ _sk_store_a8_vfp4:
.long 0xe12fff1c // bx ip
.long 0xee10eb90 // vmov.32 lr, d16[0]
.long 0xe5cce000 // strb lr, [ip]
- .long 0xeafffff8 // b 2960 <sk_store_a8_vfp4+0x38>
- .long 0xe320f000 // nop {0}
+ .long 0xeafffff8 // b 299c <sk_store_a8_vfp4+0x3c>
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
@@ -7700,34 +7725,38 @@ HIDDEN _sk_load_g8_vfp4
.globl _sk_load_g8_vfp4
FUNCTION(_sk_load_g8_vfp4)
_sk_load_g8_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xe24dd004 // sub sp, sp, #4
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de00c // ldr lr, [sp, #12]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc000 // add ip, ip, r0
- .long 0x0a000012 // beq 29e8 <sk_load_g8_vfp4+0x60>
- .long 0xe24dd004 // sub sp, sp, #4
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc002 // add ip, ip, r2
+ .long 0x0a000012 // beq 2a2c <sk_load_g8_vfp4+0x6c>
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xe1cdc0b0 // strh ip, [sp]
.long 0xe1a0c00d // mov ip, sp
.long 0xf4ec041f // vld1.16 {d16[0]}, [ip :16]
.long 0xf3c80a30 // vmovl.u8 q8, d16
.long 0xf3900a30 // vmovl.u16 q0, d16
- .long 0xe28dd004 // add sp, sp, #4
.long 0xf3c7001f // vmov.i32 d16, #255
- .long 0xeddf1b0c // vldr d17, [pc, #48]
+ .long 0xeddf1b0f // vldr d17, [pc, #60]
.long 0xe591c004 // ldr ip, [r1, #4]
- .long 0xf2873f10 // vmov.f32 d3, #1
- .long 0xf2400130 // vand d16, d0, d16
.long 0xe2811008 // add r1, r1, #8
+ .long 0xf2400130 // vand d16, d0, d16
+ .long 0xf2873f10 // vmov.f32 d3, #1
.long 0xf3fb06a0 // vcvt.f32.u32 d16, d16
.long 0xf3000db1 // vmul.f32 d0, d16, d17
.long 0xf2201110 // vorr d1, d0, d0
.long 0xf2202110 // vorr d2, d0, d0
+ .long 0xe28dd004 // add sp, sp, #4
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe5dcc000 // ldrb ip, [ip]
- .long 0xeddf0a03 // vldr s1, [pc, #12]
+ .long 0xeddf0a04 // vldr s1, [pc, #16]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeafffff0 // b 29bc <sk_load_g8_vfp4+0x34>
+ .long 0xeaffffee // b 29f8 <sk_load_g8_vfp4+0x38>
+ .long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -7823,28 +7852,29 @@ HIDDEN _sk_load_565_vfp4
.globl _sk_load_565_vfp4
FUNCTION(_sk_load_565_vfp4)
_sk_load_565_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xe24dd004 // sub sp, sp, #4
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de00c // ldr lr, [sp, #12]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc080 // add ip, ip, r0, lsl #1
- .long 0x0a00001a // beq 2bb8 <sk_load_565_vfp4+0x80>
- .long 0xe24dd004 // sub sp, sp, #4
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc082 // add ip, ip, r2, lsl #1
+ .long 0x0a00001a // beq 2c0c <sk_load_565_vfp4+0x8c>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
.long 0xf4ec083f // vld1.32 {d16[0]}, [ip :32]
.long 0xf3900a30 // vmovl.u16 q0, d16
- .long 0xe28dd004 // add sp, sp, #4
.long 0xf3c70218 // vmov.i32 d16, #63488
.long 0xe3a0ce7e // mov ip, #2016
.long 0xf2c1101f // vmov.i32 d17, #31
.long 0xee82cb90 // vdup.32 d18, ip
.long 0xf2400130 // vand d16, d0, d16
- .long 0xeddf3b11 // vldr d19, [pc, #68]
+ .long 0xeddf3b14 // vldr d19, [pc, #80]
.long 0xf2402132 // vand d18, d0, d18
- .long 0xeddf4b11 // vldr d20, [pc, #68]
+ .long 0xeddf4b14 // vldr d20, [pc, #80]
.long 0xf2401131 // vand d17, d0, d17
- .long 0xeddf5b11 // vldr d21, [pc, #68]
+ .long 0xeddf5b14 // vldr d21, [pc, #80]
.long 0xf3fb0620 // vcvt.f32.s32 d16, d16
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xf3fb2622 // vcvt.f32.s32 d18, d18
@@ -7854,11 +7884,14 @@ _sk_load_565_vfp4:
.long 0xf3000db3 // vmul.f32 d0, d16, d19
.long 0xf3021db4 // vmul.f32 d1, d18, d20
.long 0xf3012db5 // vmul.f32 d2, d17, d21
+ .long 0xe28dd004 // add sp, sp, #4
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe1dcc0b0 // ldrh ip, [ip]
- .long 0xeddf0a07 // vldr s1, [pc, #28]
+ .long 0xeddf0a08 // vldr s1, [pc, #32]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeaffffe7 // b 2b68 <sk_load_565_vfp4+0x30>
+ .long 0xeaffffe5 // b 2bb4 <sk_load_565_vfp4+0x34>
+ .long 0xe320f000 // nop {0}
.long 0x37842108 // .word 0x37842108
.long 0x37842108 // .word 0x37842108
.long 0x3a020821 // .word 0x3a020821
@@ -7919,18 +7952,20 @@ HIDDEN _sk_store_565_vfp4
.globl _sk_store_565_vfp4
FUNCTION(_sk_store_565_vfp4)
_sk_store_565_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xf2c30f1f // vmov.f32 d16, #31
- .long 0xeddf1b1b // vldr d17, [pc, #108]
+ .long 0xeddf1b1c // vldr d17, [pc, #112]
.long 0xf2c3361f // vmov.i32 d19, #1056964608
.long 0xe591c000 // ldr ip, [r1]
.long 0xf2413c31 // vfma.f32 d19, d1, d17
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xf2c3161f // vmov.i32 d17, #1056964608
.long 0xf2401c30 // vfma.f32 d17, d0, d16
.long 0xe59cc000 // ldr ip, [ip]
.long 0xf2c3261f // vmov.i32 d18, #1056964608
+ .long 0xe35e0001 // cmp lr, #1
.long 0xf2422c30 // vfma.f32 d18, d2, d16
- .long 0xe08cc080 // add ip, ip, r0, lsl #1
+ .long 0xe08cc082 // add ip, ip, r2, lsl #1
.long 0xf3fb07a3 // vcvt.u32.f32 d16, d19
.long 0xf3fb17a1 // vcvt.u32.f32 d17, d17
.long 0xf3fb27a2 // vcvt.u32.f32 d18, d18
@@ -7938,17 +7973,17 @@ _sk_store_565_vfp4:
.long 0xf2eb1531 // vshl.s32 d17, d17, #11
.long 0xf26001b1 // vorr d16, d16, d17
.long 0xf26001b2 // vorr d16, d16, d18
- .long 0x0a000004 // beq 2cf4 <sk_store_565_vfp4+0x64>
+ .long 0x0a000005 // beq 2d58 <sk_store_565_vfp4+0x70>
.long 0xf3f60121 // vuzp.16 d16, d17
.long 0xf4cc080f // vst1.32 {d16[0]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xe92d4800 // push {fp, lr}
.long 0xee10eb90 // vmov.32 lr, d16[0]
.long 0xe1cce0b0 // strh lr, [ip]
- .long 0xe8bd4800 // pop {fp, lr}
- .long 0xeafffff7 // b 2ce8 <sk_store_565_vfp4+0x58>
+ .long 0xeafffff8 // b 2d48 <sk_store_565_vfp4+0x60>
+ .long 0xe320f000 // nop {0}
.long 0x427c0000 // .word 0x427c0000
.long 0x427c0000 // .word 0x427c0000
@@ -7956,24 +7991,25 @@ HIDDEN _sk_load_4444_vfp4
.globl _sk_load_4444_vfp4
FUNCTION(_sk_load_4444_vfp4)
_sk_load_4444_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xe24dd004 // sub sp, sp, #4
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de00c // ldr lr, [sp, #12]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc080 // add ip, ip, r0, lsl #1
- .long 0x0a00001d // beq 2d9c <sk_load_4444_vfp4+0x8c>
- .long 0xe24dd004 // sub sp, sp, #4
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc082 // add ip, ip, r2, lsl #1
+ .long 0x0a00001d // beq 2e08 <sk_load_4444_vfp4+0x98>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
.long 0xf4ec083f // vld1.32 {d16[0]}, [ip :32]
.long 0xf3900a30 // vmovl.u16 q0, d16
- .long 0xe28dd004 // add sp, sp, #4
.long 0xf3c70210 // vmov.i32 d16, #61440
- .long 0xeddf4b19 // vldr d20, [pc, #100]
+ .long 0xeddf4b1a // vldr d20, [pc, #104]
.long 0xf2c0121f // vmov.i32 d17, #3840
- .long 0xeddf5b19 // vldr d21, [pc, #100]
+ .long 0xeddf5b1a // vldr d21, [pc, #104]
.long 0xf3c72010 // vmov.i32 d18, #240
- .long 0xeddf6b19 // vldr d22, [pc, #100]
+ .long 0xeddf6b1a // vldr d22, [pc, #104]
.long 0xf2400130 // vand d16, d0, d16
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xf2c0301f // vmov.i32 d19, #15
@@ -7986,16 +8022,17 @@ _sk_load_4444_vfp4:
.long 0xf3fb2622 // vcvt.f32.s32 d18, d18
.long 0xf3fb3623 // vcvt.f32.s32 d19, d19
.long 0xf3000db4 // vmul.f32 d0, d16, d20
- .long 0xeddf0b0e // vldr d16, [pc, #56]
+ .long 0xeddf0b0f // vldr d16, [pc, #60]
.long 0xf3011db5 // vmul.f32 d1, d17, d21
.long 0xf3022db6 // vmul.f32 d2, d18, d22
.long 0xf3033db0 // vmul.f32 d3, d19, d16
+ .long 0xe28dd004 // add sp, sp, #4
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xe1dcc0b0 // ldrh ip, [ip]
- .long 0xeddf0a0a // vldr s1, [pc, #40]
+ .long 0xeddf0a09 // vldr s1, [pc, #36]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeaffffe4 // b 2d40 <sk_load_4444_vfp4+0x30>
- .long 0xe320f000 // nop {0}
+ .long 0xeaffffe2 // b 2da4 <sk_load_4444_vfp4+0x34>
.long 0x37888889 // .word 0x37888889
.long 0x37888889 // .word 0x37888889
.long 0x39888889 // .word 0x39888889
@@ -8064,16 +8101,18 @@ HIDDEN _sk_store_4444_vfp4
.globl _sk_store_4444_vfp4
FUNCTION(_sk_store_4444_vfp4)
_sk_store_4444_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xf2c20f1e // vmov.f32 d16, #15
.long 0xe591c000 // ldr ip, [r1]
.long 0xf2c3261f // vmov.i32 d18, #1056964608
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xf2c3361f // vmov.i32 d19, #1056964608
.long 0xf2402c30 // vfma.f32 d18, d0, d16
.long 0xe59cc000 // ldr ip, [ip]
.long 0xf2413c30 // vfma.f32 d19, d1, d16
+ .long 0xe35e0001 // cmp lr, #1
.long 0xf2c3461f // vmov.i32 d20, #1056964608
- .long 0xe08cc080 // add ip, ip, r0, lsl #1
+ .long 0xe08cc082 // add ip, ip, r2, lsl #1
.long 0xf2424c30 // vfma.f32 d20, d2, d16
.long 0xf2c3161f // vmov.i32 d17, #1056964608
.long 0xf2431c30 // vfma.f32 d17, d3, d16
@@ -8087,27 +8126,29 @@ _sk_store_4444_vfp4:
.long 0xf26201b0 // vorr d16, d18, d16
.long 0xf26001b3 // vorr d16, d16, d19
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000004 // beq 2f0c <sk_store_4444_vfp4+0x74>
+ .long 0x0a000005 // beq 2f80 <sk_store_4444_vfp4+0x80>
.long 0xf3f60121 // vuzp.16 d16, d17
.long 0xf4cc080f // vst1.32 {d16[0]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xe92d4800 // push {fp, lr}
.long 0xee10eb90 // vmov.32 lr, d16[0]
.long 0xe1cce0b0 // strh lr, [ip]
- .long 0xe8bd4800 // pop {fp, lr}
- .long 0xeafffff7 // b 2f00 <sk_store_4444_vfp4+0x68>
+ .long 0xeafffff8 // b 2f70 <sk_store_4444_vfp4+0x70>
+ .long 0xe320f000 // nop {0}
HIDDEN _sk_load_8888_vfp4
.globl _sk_load_8888_vfp4
FUNCTION(_sk_load_8888_vfp4)
_sk_load_8888_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc100 // add ip, ip, r0, lsl #2
- .long 0x0a000013 // beq 2f84 <sk_load_8888_vfp4+0x64>
+ .long 0xe35e0001 // cmp lr, #1
+ .long 0xe08cc102 // add ip, ip, r2, lsl #2
+ .long 0x0a000014 // beq 3000 <sk_load_8888_vfp4+0x70>
.long 0xed9c0b00 // vldr d0, [ip]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -8119,7 +8160,7 @@ _sk_load_8888_vfp4:
.long 0xf2404130 // vand d20, d0, d16
.long 0xf24301b0 // vand d16, d19, d16
.long 0xf3fb3624 // vcvt.f32.s32 d19, d20
- .long 0xeddf4b0a // vldr d20, [pc, #40]
+ .long 0xeddf4b0c // vldr d20, [pc, #48]
.long 0xf3fb2622 // vcvt.f32.s32 d18, d18
.long 0xf3fb1621 // vcvt.f32.s32 d17, d17
.long 0xf3fb0620 // vcvt.f32.s32 d16, d16
@@ -8127,10 +8168,12 @@ _sk_load_8888_vfp4:
.long 0xf3023db4 // vmul.f32 d3, d18, d20
.long 0xf3011db4 // vmul.f32 d1, d17, d20
.long 0xf3002db4 // vmul.f32 d2, d16, d20
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xeddf0a03 // vldr s1, [pc, #12]
+ .long 0xeddf0a04 // vldr s1, [pc, #16]
.long 0xed9c0a00 // vldr s0, [ip]
- .long 0xeaffffe9 // b 2f38 <sk_load_8888_vfp4+0x18>
+ .long 0xeaffffe8 // b 2fb0 <sk_load_8888_vfp4+0x20>
+ .long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
.long 0x00000000 // .word 0x00000000
@@ -8181,18 +8224,20 @@ HIDDEN _sk_store_8888_vfp4
.globl _sk_store_8888_vfp4
FUNCTION(_sk_store_8888_vfp4)
_sk_store_8888_vfp4:
- .long 0xeddf0b1c // vldr d16, [pc, #112]
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xeddf0b1f // vldr d16, [pc, #124]
.long 0xf2c3261f // vmov.i32 d18, #1056964608
.long 0xf2412c30 // vfma.f32 d18, d1, d16
.long 0xe591c000 // ldr ip, [r1]
.long 0xf2c3361f // vmov.i32 d19, #1056964608
- .long 0xe3530001 // cmp r3, #1
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xf2c3161f // vmov.i32 d17, #1056964608
.long 0xf2423c30 // vfma.f32 d19, d2, d16
.long 0xe59cc000 // ldr ip, [ip]
.long 0xf2c3461f // vmov.i32 d20, #1056964608
+ .long 0xe35e0001 // cmp lr, #1
.long 0xf2401c30 // vfma.f32 d17, d0, d16
- .long 0xe08cc100 // add ip, ip, r0, lsl #2
+ .long 0xe08cc102 // add ip, ip, r2, lsl #2
.long 0xf2434c30 // vfma.f32 d20, d3, d16
.long 0xf3fb07a2 // vcvt.u32.f32 d16, d18
.long 0xf3fb27a3 // vcvt.u32.f32 d18, d19
@@ -8204,13 +8249,15 @@ _sk_store_8888_vfp4:
.long 0xf2f81533 // vshl.s32 d17, d19, #24
.long 0xf26001b2 // vorr d16, d16, d18
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000003 // beq 30a0 <sk_store_8888_vfp4+0x70>
+ .long 0x0a000004 // beq 312c <sk_store_8888_vfp4+0x7c>
.long 0xedcc0b00 // vstr d16, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32]
- .long 0xeafffffa // b 3094 <sk_store_8888_vfp4+0x64>
+ .long 0xeafffff9 // b 311c <sk_store_8888_vfp4+0x6c>
+ .long 0xe320f000 // nop {0}
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
@@ -8218,12 +8265,14 @@ HIDDEN _sk_load_f16_vfp4
.globl _sk_load_f16_vfp4
FUNCTION(_sk_load_f16_vfp4)
_sk_load_f16_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc180 // add ip, ip, r0, lsl #3
+ .long 0xe35e0000 // cmp lr, #0
+ .long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 30d0 <sk_load_f16_vfp4+0x20>
+ .long 0x1a000001 // bne 3168 <sk_load_f16_vfp4+0x28>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xf3b60720 // vcvt.f32.f16 q0, d16
@@ -8234,6 +8283,7 @@ _sk_load_f16_vfp4:
.long 0xf3f60723 // vcvt.f32.f16 q8, d19
.long 0xf22411b4 // vorr d1, d20, d20
.long 0xf22031b0 // vorr d3, d16, d16
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
HIDDEN _sk_gather_f16_vfp4
@@ -8242,7 +8292,7 @@ FUNCTION(_sk_gather_f16_vfp4)
_sk_gather_f16_vfp4:
.long 0xe92d4c10 // push {r4, sl, fp, lr}
.long 0xe28db008 // add fp, sp, #8
- .long 0xe24dd010 // sub sp, sp, #16
+ .long 0xe24dd020 // sub sp, sp, #32
.long 0xe7c3d01f // bfc sp, #0, #4
.long 0xe591c000 // ldr ip, [r1]
.long 0xf3fb0701 // vcvt.s32.f32 d16, d1
@@ -8255,8 +8305,9 @@ _sk_gather_f16_vfp4:
.long 0xe08e4184 // add r4, lr, r4, lsl #3
.long 0xe08ec18c // add ip, lr, ip, lsl #3
.long 0xedd41b00 // vldr d17, [r4]
- .long 0xe1a0400d // mov r4, sp
+ .long 0xe28d4010 // add r4, sp, #16
.long 0xeddc0b00 // vldr d16, [ip]
+ .long 0xe59bc008 // ldr ip, [fp, #8]
.long 0xf4440aef // vst1.64 {d16-d17}, [r4 :128]
.long 0xf4e4071f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [r4 :64]
.long 0xe3844008 // orr r4, r4, #8
@@ -8265,6 +8316,7 @@ _sk_gather_f16_vfp4:
.long 0xf3b62722 // vcvt.f32.f16 q1, d18
.long 0xe5914004 // ldr r4, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe58dc000 // str ip, [sp]
.long 0xf3f64721 // vcvt.f32.f16 q10, d17
.long 0xf3f60723 // vcvt.f32.f16 q8, d19
.long 0xf22411b4 // vorr d1, d20, d20
@@ -8277,39 +8329,43 @@ HIDDEN _sk_store_f16_vfp4
.globl _sk_store_f16_vfp4
FUNCTION(_sk_store_f16_vfp4)
_sk_store_f16_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xf2630113 // vorr d16, d3, d3
.long 0xe591c000 // ldr ip, [r1]
.long 0xf2612111 // vorr d18, d1, d1
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xf3f67620 // vcvt.f16.f32 d23, q8
.long 0xe59cc000 // ldr ip, [ip]
+ .long 0xe35e0000 // cmp lr, #0
.long 0xf3f66602 // vcvt.f16.f32 d22, q1
- .long 0xe08cc180 // add ip, ip, r0, lsl #3
+ .long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf3f65622 // vcvt.f16.f32 d21, q9
.long 0xf3f64600 // vcvt.f16.f32 d20, q0
.long 0xf4cc470f // vst4.16 {d20[0],d21[0],d22[0],d23[0]}, [ip]
- .long 0x1a000001 // bne 31ac <sk_store_f16_vfp4+0x38>
+ .long 0x1a000001 // bne 3258 <sk_store_f16_vfp4+0x40>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4cc474f // vst4.16 {d20[1],d21[1],d22[1],d23[1]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
+ .long 0xe2811008 // add r1, r1, #8
.long 0xf22211b2 // vorr d1, d18, d18
.long 0xf22031b0 // vorr d3, d16, d16
- .long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
HIDDEN _sk_load_u16_be_vfp4
.globl _sk_load_u16_be_vfp4
FUNCTION(_sk_load_u16_be_vfp4)
_sk_load_u16_be_vfp4:
+ .long 0xe92d4bf0 // push {r4, r5, r6, r7, r8, r9, fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59de020 // ldr lr, [sp, #32]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc180 // add ip, ip, r0, lsl #3
+ .long 0xe35e0000 // cmp lr, #0
+ .long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 31e0 <sk_load_u16_be_vfp4+0x20>
+ .long 0x1a000001 // bne 3298 <sk_load_u16_be_vfp4+0x28>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
- .long 0xe92d4bf0 // push {r4, r5, r6, r7, r8, r9, fp, lr}
.long 0xee90cbb0 // vmov.u16 ip, d16[0]
.long 0xee937bb0 // vmov.u16 r7, d19[0]
.long 0xee92ebb0 // vmov.u16 lr, d18[0]
@@ -8349,7 +8405,7 @@ _sk_load_u16_be_vfp4:
.long 0xf24221b3 // vand d18, d18, d19
.long 0xf24111b3 // vand d17, d17, d19
.long 0xf24431b3 // vand d19, d20, d19
- .long 0xeddf4b0a // vldr d20, [pc, #40]
+ .long 0xeddf4b09 // vldr d20, [pc, #36]
.long 0xf3fb06a0 // vcvt.f32.u32 d16, d16
.long 0xf3fb26a2 // vcvt.f32.u32 d18, d18
.long 0xf3fb16a1 // vcvt.f32.u32 d17, d17
@@ -8360,7 +8416,6 @@ _sk_load_u16_be_vfp4:
.long 0xf3033db4 // vmul.f32 d3, d19, d20
.long 0xe8bd4bf0 // pop {r4, r5, r6, r7, r8, r9, fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xe320f000 // nop {0}
.long 0x37800080 // .word 0x37800080
.long 0x37800080 // .word 0x37800080
@@ -8370,12 +8425,13 @@ FUNCTION(_sk_load_rgb_u16_be_vfp4)
_sk_load_rgb_u16_be_vfp4:
.long 0xe92d48f0 // push {r4, r5, r6, r7, fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe080e080 // add lr, r0, r0, lsl #1
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe082e082 // add lr, r2, r2, lsl #1
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe08cc08e // add ip, ip, lr, lsl #1
+ .long 0xe59de018 // ldr lr, [sp, #24]
.long 0xf4ec060f // vld3.16 {d16[0],d17[0],d18[0]}, [ip]
- .long 0x1a000001 // bne 32e0 <sk_load_rgb_u16_be_vfp4+0x28>
+ .long 0xe35e0000 // cmp lr, #0
+ .long 0x1a000001 // bne 3394 <sk_load_rgb_u16_be_vfp4+0x2c>
.long 0xe28cc006 // add ip, ip, #6
.long 0xf4ec064f // vld3.16 {d16[1],d17[1],d18[1]}, [ip]
.long 0xee90cbb0 // vmov.u16 ip, d16[0]
@@ -8409,7 +8465,7 @@ _sk_load_rgb_u16_be_vfp4:
.long 0xf24001b3 // vand d16, d16, d19
.long 0xf24111b3 // vand d17, d17, d19
.long 0xf24221b3 // vand d18, d18, d19
- .long 0xeddf3b07 // vldr d19, [pc, #28]
+ .long 0xeddf3b08 // vldr d19, [pc, #32]
.long 0xf3fb06a0 // vcvt.f32.u32 d16, d16
.long 0xf3fb16a1 // vcvt.f32.u32 d17, d17
.long 0xf3fb26a2 // vcvt.f32.u32 d18, d18
@@ -8418,6 +8474,7 @@ _sk_load_rgb_u16_be_vfp4:
.long 0xf3022db3 // vmul.f32 d2, d18, d19
.long 0xe8bd48f0 // pop {r4, r5, r6, r7, fp, lr}
.long 0xe12fff1c // bx ip
+ .long 0xe320f000 // nop {0}
.long 0x37800080 // .word 0x37800080
.long 0x37800080 // .word 0x37800080
@@ -8425,12 +8482,12 @@ HIDDEN _sk_store_u16_be_vfp4
.globl _sk_store_u16_be_vfp4
FUNCTION(_sk_store_u16_be_vfp4)
_sk_store_u16_be_vfp4:
- .long 0xeddf0b2c // vldr d16, [pc, #176]
+ .long 0xe92d4800 // push {fp, lr}
+ .long 0xeddf0b2d // vldr d16, [pc, #180]
.long 0xf2c3261f // vmov.i32 d18, #1056964608
.long 0xf2c3361f // vmov.i32 d19, #1056964608
.long 0xe591c000 // ldr ip, [r1]
.long 0xf2432c30 // vfma.f32 d18, d3, d16
- .long 0xe3530000 // cmp r3, #0
.long 0xf2c3161f // vmov.i32 d17, #1056964608
.long 0xf2c3461f // vmov.i32 d20, #1056964608
.long 0xf2423c30 // vfma.f32 d19, d2, d16
@@ -8460,17 +8517,19 @@ _sk_store_u16_be_vfp4:
.long 0xf3f63124 // vuzp.16 d19, d20
.long 0xe59cc000 // ldr ip, [ip]
.long 0xf3f62124 // vuzp.16 d18, d20
- .long 0xe08cc180 // add ip, ip, r0, lsl #3
+ .long 0xe59de008 // ldr lr, [sp, #8]
+ .long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf3f61124 // vuzp.16 d17, d20
+ .long 0xe35e0000 // cmp lr, #0
.long 0xf3f60124 // vuzp.16 d16, d20
.long 0xf4cc070f // vst4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 3430 <sk_store_u16_be_vfp4+0xa8>
+ .long 0x1a000001 // bne 34f0 <sk_store_u16_be_vfp4+0xb0>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4cc074f // vst4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
- .long 0xe320f000 // nop {0}
.long 0x477fff00 // .word 0x477fff00
.long 0x477fff00 // .word 0x477fff00
@@ -8478,33 +8537,39 @@ HIDDEN _sk_load_f32_vfp4
.globl _sk_load_f32_vfp4
FUNCTION(_sk_load_f32_vfp4)
_sk_load_f32_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc200 // add ip, ip, r0, lsl #4
- .long 0x1a000003 // bne 346c <sk_load_f32_vfp4+0x24>
+ .long 0xe35e0000 // cmp lr, #0
+ .long 0xe08cc202 // add ip, ip, r2, lsl #4
+ .long 0x1a000004 // bne 3538 <sk_load_f32_vfp4+0x30>
.long 0xf42c008f // vld4.32 {d0-d3}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4ac0f8f // vld4.32 {d0[]-d3[]}, [ip]
- .long 0xeafffffa // b 3460 <sk_load_f32_vfp4+0x18>
+ .long 0xeafffff9 // b 3528 <sk_load_f32_vfp4+0x20>
HIDDEN _sk_store_f32_vfp4
.globl _sk_store_f32_vfp4
FUNCTION(_sk_store_f32_vfp4)
_sk_store_f32_vfp4:
+ .long 0xe92d4800 // push {fp, lr}
.long 0xe591c000 // ldr ip, [r1]
- .long 0xe3530000 // cmp r3, #0
+ .long 0xe59de008 // ldr lr, [sp, #8]
.long 0xe59cc000 // ldr ip, [ip]
- .long 0xe08cc200 // add ip, ip, r0, lsl #4
- .long 0x1a000003 // bne 3498 <sk_store_f32_vfp4+0x24>
+ .long 0xe35e0000 // cmp lr, #0
+ .long 0xe08cc202 // add ip, ip, r2, lsl #4
+ .long 0x1a000004 // bne 3570 <sk_store_f32_vfp4+0x30>
.long 0xf40c008f // vst4.32 {d0-d3}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
+ .long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf48c0b0f // vst4.32 {d0[0],d1[0],d2[0],d3[0]}, [ip]
- .long 0xeafffffa // b 348c <sk_store_f32_vfp4+0x18>
+ .long 0xeafffff9 // b 3560 <sk_store_f32_vfp4+0x20>
HIDDEN _sk_clamp_x_vfp4
.globl _sk_clamp_x_vfp4
@@ -9064,7 +9129,7 @@ _sk_gradient_vfp4:
.long 0xe591c000 // ldr ip, [r1]
.long 0xe59c4000 // ldr r4, [ip]
.long 0xe3540002 // cmp r4, #2
- .long 0x3a00000b // bcc 3c28 <sk_gradient_vfp4+0x58>
+ .long 0x3a00000b // bcc 3d00 <sk_gradient_vfp4+0x58>
.long 0xe59c5024 // ldr r5, [ip, #36]
.long 0xf2c01010 // vmov.i32 d17, #0
.long 0xf2c02011 // vmov.i32 d18, #1
@@ -9076,7 +9141,7 @@ _sk_gradient_vfp4:
.long 0xf3403e23 // vcge.f32 d19, d0, d19
.long 0xf35231b1 // vbsl d19, d18, d17
.long 0xf26308a0 // vadd.i32 d16, d19, d16
- .long 0x1afffff9 // bne 3c10 <sk_gradient_vfp4+0x40>
+ .long 0x1afffff9 // bne 3ce8 <sk_gradient_vfp4+0x40>
.long 0xee304b90 // vmov.32 r4, d16[1]
.long 0xe59c6010 // ldr r6, [ip, #16]
.long 0xee10eb90 // vmov.32 lr, d16[0]
@@ -9609,26 +9674,26 @@ _sk_callback_vfp4:
.long 0xed2d8b08 // vpush {d8-d11}
.long 0xe1a06001 // mov r6, r1
.long 0xe1a07000 // mov r7, r0
- .long 0xe5965000 // ldr r5, [r6]
- .long 0xe1a04003 // mov r4, r3
- .long 0xe1a08002 // mov r8, r2
- .long 0xe3540000 // cmp r4, #0
- .long 0xe2850004 // add r0, r5, #4
- .long 0xe1a01004 // mov r1, r4
- .long 0x03a01002 // moveq r1, #2
+ .long 0xe5964000 // ldr r4, [r6]
+ .long 0xe1a05002 // mov r5, r2
+ .long 0xe59d1038 // ldr r1, [sp, #56]
.long 0xeeb08b47 // vmov.f64 d8, d7
+ .long 0xe2840004 // add r0, r4, #4
+ .long 0xe1a08003 // mov r8, r3
+ .long 0xe3510000 // cmp r1, #0
+ .long 0x03a01002 // moveq r1, #2
.long 0xf400008f // vst4.32 {d0-d3}, [r0]
- .long 0xe1a00005 // mov r0, r5
- .long 0xe5952000 // ldr r2, [r5]
+ .long 0xe1a00004 // mov r0, r4
+ .long 0xe5942000 // ldr r2, [r4]
.long 0xeeb09b46 // vmov.f64 d9, d6
.long 0xeeb0ab45 // vmov.f64 d10, d5
.long 0xeeb0bb44 // vmov.f64 d11, d4
.long 0xe12fff32 // blx r2
- .long 0xe5950084 // ldr r0, [r5, #132]
+ .long 0xe5940084 // ldr r0, [r4, #132]
.long 0xe2861008 // add r1, r6, #8
.long 0xe596c004 // ldr ip, [r6, #4]
- .long 0xe1a02008 // mov r2, r8
- .long 0xe1a03004 // mov r3, r4
+ .long 0xe1a02005 // mov r2, r5
+ .long 0xe1a03008 // mov r3, r8
.long 0xeeb04b4b // vmov.f64 d4, d11
.long 0xf420008f // vld4.32 {d0-d3}, [r0]
.long 0xe1a00007 // mov r0, r7
@@ -9645,22 +9710,26 @@ HIDDEN _sk_start_pipeline_hsw
.globl _sk_start_pipeline_hsw
FUNCTION(_sk_start_pipeline_hsw)
_sk_start_pipeline_hsw:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 73,137,204 // mov %rcx,%r12
- .byte 73,137,214 // mov %rdx,%r14
+ .byte 80 // push %rax
+ .byte 77,137,198 // mov %r8,%r14
+ .byte 73,137,213 // mov %rdx,%r13
+ .byte 73,137,247 // mov %rsi,%r15
.byte 72,137,251 // mov %rdi,%rbx
+ .byte 72,137,206 // mov %rcx,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,247 // mov %rsi,%r15
+ .byte 73,137,244 // mov %rsi,%r12
.byte 72,141,75,8 // lea 0x8(%rbx),%rcx
- .byte 76,57,225 // cmp %r12,%rcx
- .byte 118,5 // jbe 25 <_sk_start_pipeline_hsw+0x25>
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 235,71 // jmp 6c <_sk_start_pipeline_hsw+0x6c>
- .byte 185,0,0,0,0 // mov $0x0,%ecx
+ .byte 76,57,233 // cmp %r13,%rcx
+ .byte 118,5 // jbe 2d <_sk_start_pipeline_hsw+0x2d>
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 235,74 // jmp 77 <_sk_start_pipeline_hsw+0x77>
+ .byte 65,184,0,0,0,0 // mov $0x0,%r8d
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -9669,19 +9738,20 @@ _sk_start_pipeline_hsw:
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
.byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6
.byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 73,137,197 // mov %rax,%r13
- .byte 65,255,213 // callq *%r13
- .byte 76,137,232 // mov %r13,%rax
- .byte 72,141,123,8 // lea 0x8(%rbx),%rdi
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 255,213 // callq *%rbp
+ .byte 72,137,232 // mov %rbp,%rax
+ .byte 72,141,83,8 // lea 0x8(%rbx),%rdx
.byte 72,131,195,16 // add $0x10,%rbx
- .byte 76,57,227 // cmp %r12,%rbx
- .byte 72,137,251 // mov %rdi,%rbx
- .byte 118,185 // jbe 25 <_sk_start_pipeline_hsw+0x25>
- .byte 73,41,252 // sub %rdi,%r12
- .byte 116,52 // je a5 <_sk_start_pipeline_hsw+0xa5>
+ .byte 76,57,235 // cmp %r13,%rbx
+ .byte 72,137,211 // mov %rdx,%rbx
+ .byte 118,182 // jbe 2d <_sk_start_pipeline_hsw+0x2d>
+ .byte 73,41,213 // sub %rdx,%r13
+ .byte 116,60 // je b8 <_sk_start_pipeline_hsw+0xb8>
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -9690,20 +9760,25 @@ _sk_start_pipeline_hsw:
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
.byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6
.byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,225 // mov %r12,%rcx
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 77,137,232 // mov %r13,%r8
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 197,248,119 // vzeroupper
.byte 195 // retq
@@ -9717,18 +9792,18 @@ HIDDEN _sk_seed_shader_hsw
.globl _sk_seed_shader_hsw
FUNCTION(_sk_seed_shader_hsw)
_sk_seed_shader_hsw:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 197,249,110,199 // vmovd %edi,%xmm0
+ .byte 197,249,110,194 // vmovd %edx,%xmm0
.byte 196,226,125,88,192 // vpbroadcastd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,29,73,0,0 // vbroadcastss 0x491d(%rip),%ymm1 # 49e8 <_sk_callback_hsw+0x126>
+ .byte 196,226,125,24,13,11,73,0,0 // vbroadcastss 0x490b(%rip),%ymm1 # 49ec <_sk_callback_hsw+0x130>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
- .byte 197,252,88,2 // vaddps (%rdx),%ymm0,%ymm0
- .byte 196,226,125,24,16 // vbroadcastss (%rax),%ymm2
+ .byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0
+ .byte 197,249,110,209 // vmovd %ecx,%xmm2
+ .byte 196,226,125,88,210 // vpbroadcastd %xmm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,21,1,73,0,0 // vbroadcastss 0x4901(%rip),%ymm2 # 49ec <_sk_callback_hsw+0x12a>
+ .byte 196,226,125,24,21,235,72,0,0 // vbroadcastss 0x48eb(%rip),%ymm2 # 49f0 <_sk_callback_hsw+0x134>
.byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
@@ -9741,19 +9816,19 @@ HIDDEN _sk_dither_hsw
FUNCTION(_sk_dither_hsw)
_sk_dither_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 197,121,110,199 // vmovd %edi,%xmm8
+ .byte 197,121,110,194 // vmovd %edx,%xmm8
.byte 196,66,125,88,192 // vpbroadcastd %xmm8,%ymm8
- .byte 197,61,254,66,32 // vpaddd 0x20(%rdx),%ymm8,%ymm8
- .byte 76,139,0 // mov (%rax),%r8
- .byte 196,66,125,88,8 // vpbroadcastd (%r8),%ymm9
- .byte 196,65,61,239,201 // vpxor %ymm9,%ymm8,%ymm9
- .byte 196,98,125,88,21,201,72,0,0 // vpbroadcastd 0x48c9(%rip),%ymm10 # 49f0 <_sk_callback_hsw+0x12e>
+ .byte 197,61,254,71,32 // vpaddd 0x20(%rdi),%ymm8,%ymm8
+ .byte 197,121,110,201 // vmovd %ecx,%xmm9
+ .byte 196,66,125,88,201 // vpbroadcastd %xmm9,%ymm9
+ .byte 196,65,53,239,200 // vpxor %ymm8,%ymm9,%ymm9
+ .byte 196,98,125,88,21,178,72,0,0 // vpbroadcastd 0x48b2(%rip),%ymm10 # 49f4 <_sk_callback_hsw+0x138>
.byte 196,65,53,219,218 // vpand %ymm10,%ymm9,%ymm11
.byte 196,193,37,114,243,5 // vpslld $0x5,%ymm11,%ymm11
.byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10
.byte 196,193,45,114,242,4 // vpslld $0x4,%ymm10,%ymm10
- .byte 196,98,125,88,37,174,72,0,0 // vpbroadcastd 0x48ae(%rip),%ymm12 # 49f4 <_sk_callback_hsw+0x132>
- .byte 196,98,125,88,45,169,72,0,0 // vpbroadcastd 0x48a9(%rip),%ymm13 # 49f8 <_sk_callback_hsw+0x136>
+ .byte 196,98,125,88,37,151,72,0,0 // vpbroadcastd 0x4897(%rip),%ymm12 # 49f8 <_sk_callback_hsw+0x13c>
+ .byte 196,98,125,88,45,146,72,0,0 // vpbroadcastd 0x4892(%rip),%ymm13 # 49fc <_sk_callback_hsw+0x140>
.byte 196,65,53,219,245 // vpand %ymm13,%ymm9,%ymm14
.byte 196,193,13,114,246,2 // vpslld $0x2,%ymm14,%ymm14
.byte 196,65,61,219,237 // vpand %ymm13,%ymm8,%ymm13
@@ -9764,14 +9839,14 @@ _sk_dither_hsw:
.byte 196,193,61,114,208,2 // vpsrld $0x2,%ymm8,%ymm8
.byte 196,65,21,235,210 // vpor %ymm10,%ymm13,%ymm10
.byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8
- .byte 196,65,61,235,195 // vpor %ymm11,%ymm8,%ymm8
- .byte 196,65,13,235,201 // vpor %ymm9,%ymm14,%ymm9
+ .byte 196,65,37,235,214 // vpor %ymm14,%ymm11,%ymm10
+ .byte 196,65,61,235,194 // vpor %ymm10,%ymm8,%ymm8
.byte 196,65,61,235,193 // vpor %ymm9,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,91,72,0,0 // vbroadcastss 0x485b(%rip),%ymm9 # 49fc <_sk_callback_hsw+0x13a>
- .byte 196,98,125,24,21,86,72,0,0 // vbroadcastss 0x4856(%rip),%ymm10 # 4a00 <_sk_callback_hsw+0x13e>
+ .byte 196,98,125,24,13,68,72,0,0 // vbroadcastss 0x4844(%rip),%ymm9 # 4a00 <_sk_callback_hsw+0x144>
+ .byte 196,98,125,24,21,63,72,0,0 // vbroadcastss 0x483f(%rip),%ymm10 # 4a04 <_sk_callback_hsw+0x148>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,64,8 // vbroadcastss 0x8(%rax),%ymm8
+ .byte 196,98,125,24,0 // vbroadcastss (%rax),%ymm8
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
.byte 197,188,88,192 // vaddps %ymm0,%ymm8,%ymm0
.byte 197,188,88,201 // vaddps %ymm1,%ymm8,%ymm1
@@ -9838,7 +9913,7 @@ HIDDEN _sk_srcatop_hsw
FUNCTION(_sk_srcatop_hsw)
_sk_srcatop_hsw:
.byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0
- .byte 196,98,125,24,5,173,71,0,0 // vbroadcastss 0x47ad(%rip),%ymm8 # 4a04 <_sk_callback_hsw+0x142>
+ .byte 196,98,125,24,5,151,71,0,0 // vbroadcastss 0x4797(%rip),%ymm8 # 4a08 <_sk_callback_hsw+0x14c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,226,61,184,196 // vfmadd231ps %ymm4,%ymm8,%ymm0
.byte 197,244,89,207 // vmulps %ymm7,%ymm1,%ymm1
@@ -9854,7 +9929,7 @@ HIDDEN _sk_dstatop_hsw
.globl _sk_dstatop_hsw
FUNCTION(_sk_dstatop_hsw)
_sk_dstatop_hsw:
- .byte 196,98,125,24,5,128,71,0,0 // vbroadcastss 0x4780(%rip),%ymm8 # 4a08 <_sk_callback_hsw+0x146>
+ .byte 196,98,125,24,5,106,71,0,0 // vbroadcastss 0x476a(%rip),%ymm8 # 4a0c <_sk_callback_hsw+0x150>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,226,101,184,196 // vfmadd231ps %ymm4,%ymm3,%ymm0
@@ -9893,7 +9968,7 @@ HIDDEN _sk_srcout_hsw
.globl _sk_srcout_hsw
FUNCTION(_sk_srcout_hsw)
_sk_srcout_hsw:
- .byte 196,98,125,24,5,39,71,0,0 // vbroadcastss 0x4727(%rip),%ymm8 # 4a0c <_sk_callback_hsw+0x14a>
+ .byte 196,98,125,24,5,17,71,0,0 // vbroadcastss 0x4711(%rip),%ymm8 # 4a10 <_sk_callback_hsw+0x154>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -9906,7 +9981,7 @@ HIDDEN _sk_dstout_hsw
.globl _sk_dstout_hsw
FUNCTION(_sk_dstout_hsw)
_sk_dstout_hsw:
- .byte 196,226,125,24,5,10,71,0,0 // vbroadcastss 0x470a(%rip),%ymm0 # 4a10 <_sk_callback_hsw+0x14e>
+ .byte 196,226,125,24,5,244,70,0,0 // vbroadcastss 0x46f4(%rip),%ymm0 # 4a14 <_sk_callback_hsw+0x158>
.byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3
.byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0
.byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1
@@ -9919,7 +9994,7 @@ HIDDEN _sk_srcover_hsw
.globl _sk_srcover_hsw
FUNCTION(_sk_srcover_hsw)
_sk_srcover_hsw:
- .byte 196,98,125,24,5,237,70,0,0 // vbroadcastss 0x46ed(%rip),%ymm8 # 4a14 <_sk_callback_hsw+0x152>
+ .byte 196,98,125,24,5,215,70,0,0 // vbroadcastss 0x46d7(%rip),%ymm8 # 4a18 <_sk_callback_hsw+0x15c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0
.byte 196,194,85,184,200 // vfmadd231ps %ymm8,%ymm5,%ymm1
@@ -9932,7 +10007,7 @@ HIDDEN _sk_dstover_hsw
.globl _sk_dstover_hsw
FUNCTION(_sk_dstover_hsw)
_sk_dstover_hsw:
- .byte 196,98,125,24,5,204,70,0,0 // vbroadcastss 0x46cc(%rip),%ymm8 # 4a18 <_sk_callback_hsw+0x156>
+ .byte 196,98,125,24,5,182,70,0,0 // vbroadcastss 0x46b6(%rip),%ymm8 # 4a1c <_sk_callback_hsw+0x160>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0
.byte 196,226,61,168,205 // vfmadd213ps %ymm5,%ymm8,%ymm1
@@ -9956,7 +10031,7 @@ HIDDEN _sk_multiply_hsw
.globl _sk_multiply_hsw
FUNCTION(_sk_multiply_hsw)
_sk_multiply_hsw:
- .byte 196,98,125,24,5,151,70,0,0 // vbroadcastss 0x4697(%rip),%ymm8 # 4a1c <_sk_callback_hsw+0x15a>
+ .byte 196,98,125,24,5,129,70,0,0 // vbroadcastss 0x4681(%rip),%ymm8 # 4a20 <_sk_callback_hsw+0x164>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -10004,7 +10079,7 @@ HIDDEN _sk_xor__hsw
.globl _sk_xor__hsw
FUNCTION(_sk_xor__hsw)
_sk_xor__hsw:
- .byte 196,98,125,24,5,18,70,0,0 // vbroadcastss 0x4612(%rip),%ymm8 # 4a20 <_sk_callback_hsw+0x15e>
+ .byte 196,98,125,24,5,252,69,0,0 // vbroadcastss 0x45fc(%rip),%ymm8 # 4a24 <_sk_callback_hsw+0x168>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -10038,7 +10113,7 @@ _sk_darken_hsw:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,154,69,0,0 // vbroadcastss 0x459a(%rip),%ymm8 # 4a24 <_sk_callback_hsw+0x162>
+ .byte 196,98,125,24,5,132,69,0,0 // vbroadcastss 0x4584(%rip),%ymm8 # 4a28 <_sk_callback_hsw+0x16c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -10063,7 +10138,7 @@ _sk_lighten_hsw:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,73,69,0,0 // vbroadcastss 0x4549(%rip),%ymm8 # 4a28 <_sk_callback_hsw+0x166>
+ .byte 196,98,125,24,5,51,69,0,0 // vbroadcastss 0x4533(%rip),%ymm8 # 4a2c <_sk_callback_hsw+0x170>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -10091,7 +10166,7 @@ _sk_difference_hsw:
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,236,68,0,0 // vbroadcastss 0x44ec(%rip),%ymm8 # 4a2c <_sk_callback_hsw+0x16a>
+ .byte 196,98,125,24,5,214,68,0,0 // vbroadcastss 0x44d6(%rip),%ymm8 # 4a30 <_sk_callback_hsw+0x174>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -10113,7 +10188,7 @@ _sk_exclusion_hsw:
.byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,170,68,0,0 // vbroadcastss 0x44aa(%rip),%ymm8 # 4a30 <_sk_callback_hsw+0x16e>
+ .byte 196,98,125,24,5,148,68,0,0 // vbroadcastss 0x4494(%rip),%ymm8 # 4a34 <_sk_callback_hsw+0x178>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -10123,7 +10198,7 @@ HIDDEN _sk_colorburn_hsw
.globl _sk_colorburn_hsw
FUNCTION(_sk_colorburn_hsw)
_sk_colorburn_hsw:
- .byte 196,98,125,24,5,152,68,0,0 // vbroadcastss 0x4498(%rip),%ymm8 # 4a34 <_sk_callback_hsw+0x172>
+ .byte 196,98,125,24,5,130,68,0,0 // vbroadcastss 0x4482(%rip),%ymm8 # 4a38 <_sk_callback_hsw+0x17c>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11
.byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10
@@ -10181,7 +10256,7 @@ HIDDEN _sk_colordodge_hsw
FUNCTION(_sk_colordodge_hsw)
_sk_colordodge_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,13,163,67,0,0 // vbroadcastss 0x43a3(%rip),%ymm9 # 4a38 <_sk_callback_hsw+0x176>
+ .byte 196,98,125,24,13,141,67,0,0 // vbroadcastss 0x438d(%rip),%ymm9 # 4a3c <_sk_callback_hsw+0x180>
.byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9
@@ -10234,7 +10309,7 @@ HIDDEN _sk_hardlight_hsw
.globl _sk_hardlight_hsw
FUNCTION(_sk_hardlight_hsw)
_sk_hardlight_hsw:
- .byte 196,98,125,24,5,196,66,0,0 // vbroadcastss 0x42c4(%rip),%ymm8 # 4a3c <_sk_callback_hsw+0x17a>
+ .byte 196,98,125,24,5,174,66,0,0 // vbroadcastss 0x42ae(%rip),%ymm8 # 4a40 <_sk_callback_hsw+0x184>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -10285,7 +10360,7 @@ HIDDEN _sk_overlay_hsw
.globl _sk_overlay_hsw
FUNCTION(_sk_overlay_hsw)
_sk_overlay_hsw:
- .byte 196,98,125,24,5,252,65,0,0 // vbroadcastss 0x41fc(%rip),%ymm8 # 4a40 <_sk_callback_hsw+0x17e>
+ .byte 196,98,125,24,5,230,65,0,0 // vbroadcastss 0x41e6(%rip),%ymm8 # 4a44 <_sk_callback_hsw+0x188>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -10346,10 +10421,10 @@ _sk_softlight_hsw:
.byte 196,65,20,88,197 // vaddps %ymm13,%ymm13,%ymm8
.byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8
.byte 196,66,61,168,192 // vfmadd213ps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,29,7,65,0,0 // vbroadcastss 0x4107(%rip),%ymm11 # 4a48 <_sk_callback_hsw+0x186>
+ .byte 196,98,125,24,29,241,64,0,0 // vbroadcastss 0x40f1(%rip),%ymm11 # 4a4c <_sk_callback_hsw+0x190>
.byte 196,65,20,88,227 // vaddps %ymm11,%ymm13,%ymm12
.byte 196,65,28,89,192 // vmulps %ymm8,%ymm12,%ymm8
- .byte 196,98,125,24,37,248,64,0,0 // vbroadcastss 0x40f8(%rip),%ymm12 # 4a4c <_sk_callback_hsw+0x18a>
+ .byte 196,98,125,24,37,226,64,0,0 // vbroadcastss 0x40e2(%rip),%ymm12 # 4a50 <_sk_callback_hsw+0x194>
.byte 196,66,21,184,196 // vfmadd231ps %ymm12,%ymm13,%ymm8
.byte 196,65,124,82,245 // vrsqrtps %ymm13,%ymm14
.byte 196,65,124,83,246 // vrcpps %ymm14,%ymm14
@@ -10359,7 +10434,7 @@ _sk_softlight_hsw:
.byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15
.byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14
.byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15
- .byte 196,98,125,24,5,187,64,0,0 // vbroadcastss 0x40bb(%rip),%ymm8 # 4a44 <_sk_callback_hsw+0x182>
+ .byte 196,98,125,24,5,165,64,0,0 // vbroadcastss 0x40a5(%rip),%ymm8 # 4a48 <_sk_callback_hsw+0x18c>
.byte 196,65,60,92,237 // vsubps %ymm13,%ymm8,%ymm13
.byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0
.byte 196,98,125,168,235 // vfmadd213ps %ymm3,%ymm0,%ymm13
@@ -10472,11 +10547,11 @@ _sk_hue_hsw:
.byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10
.byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10
.byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- .byte 196,98,125,24,53,191,62,0,0 // vbroadcastss 0x3ebf(%rip),%ymm14 # 4a50 <_sk_callback_hsw+0x18e>
- .byte 196,98,125,24,61,186,62,0,0 // vbroadcastss 0x3eba(%rip),%ymm15 # 4a54 <_sk_callback_hsw+0x192>
+ .byte 196,98,125,24,53,169,62,0,0 // vbroadcastss 0x3ea9(%rip),%ymm14 # 4a54 <_sk_callback_hsw+0x198>
+ .byte 196,98,125,24,61,164,62,0,0 // vbroadcastss 0x3ea4(%rip),%ymm15 # 4a58 <_sk_callback_hsw+0x19c>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13
- .byte 196,226,125,24,5,171,62,0,0 // vbroadcastss 0x3eab(%rip),%ymm0 # 4a58 <_sk_callback_hsw+0x196>
+ .byte 196,226,125,24,5,149,62,0,0 // vbroadcastss 0x3e95(%rip),%ymm0 # 4a5c <_sk_callback_hsw+0x1a0>
.byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13
.byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10
.byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -10531,7 +10606,7 @@ _sk_hue_hsw:
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
.byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9
.byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8
- .byte 196,226,125,24,13,152,61,0,0 // vbroadcastss 0x3d98(%rip),%ymm1 # 4a5c <_sk_callback_hsw+0x19a>
+ .byte 196,226,125,24,13,130,61,0,0 // vbroadcastss 0x3d82(%rip),%ymm1 # 4a60 <_sk_callback_hsw+0x1a4>
.byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11
@@ -10585,11 +10660,11 @@ _sk_saturation_hsw:
.byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10
.byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10
.byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- .byte 196,98,125,24,53,175,60,0,0 // vbroadcastss 0x3caf(%rip),%ymm14 # 4a60 <_sk_callback_hsw+0x19e>
- .byte 196,98,125,24,61,170,60,0,0 // vbroadcastss 0x3caa(%rip),%ymm15 # 4a64 <_sk_callback_hsw+0x1a2>
+ .byte 196,98,125,24,53,153,60,0,0 // vbroadcastss 0x3c99(%rip),%ymm14 # 4a64 <_sk_callback_hsw+0x1a8>
+ .byte 196,98,125,24,61,148,60,0,0 // vbroadcastss 0x3c94(%rip),%ymm15 # 4a68 <_sk_callback_hsw+0x1ac>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13
- .byte 196,226,125,24,5,155,60,0,0 // vbroadcastss 0x3c9b(%rip),%ymm0 # 4a68 <_sk_callback_hsw+0x1a6>
+ .byte 196,226,125,24,5,133,60,0,0 // vbroadcastss 0x3c85(%rip),%ymm0 # 4a6c <_sk_callback_hsw+0x1b0>
.byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13
.byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10
.byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -10644,7 +10719,7 @@ _sk_saturation_hsw:
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
.byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9
.byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8
- .byte 196,226,125,24,13,136,59,0,0 // vbroadcastss 0x3b88(%rip),%ymm1 # 4a6c <_sk_callback_hsw+0x1aa>
+ .byte 196,226,125,24,13,114,59,0,0 // vbroadcastss 0x3b72(%rip),%ymm1 # 4a70 <_sk_callback_hsw+0x1b4>
.byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11
@@ -10672,11 +10747,11 @@ _sk_color_hsw:
.byte 197,108,89,199 // vmulps %ymm7,%ymm2,%ymm8
.byte 197,116,89,215 // vmulps %ymm7,%ymm1,%ymm10
.byte 197,52,89,223 // vmulps %ymm7,%ymm9,%ymm11
- .byte 196,98,125,24,45,33,59,0,0 // vbroadcastss 0x3b21(%rip),%ymm13 # 4a70 <_sk_callback_hsw+0x1ae>
- .byte 196,98,125,24,53,28,59,0,0 // vbroadcastss 0x3b1c(%rip),%ymm14 # 4a74 <_sk_callback_hsw+0x1b2>
+ .byte 196,98,125,24,45,11,59,0,0 // vbroadcastss 0x3b0b(%rip),%ymm13 # 4a74 <_sk_callback_hsw+0x1b8>
+ .byte 196,98,125,24,53,6,59,0,0 // vbroadcastss 0x3b06(%rip),%ymm14 # 4a78 <_sk_callback_hsw+0x1bc>
.byte 196,65,84,89,230 // vmulps %ymm14,%ymm5,%ymm12
.byte 196,66,93,184,229 // vfmadd231ps %ymm13,%ymm4,%ymm12
- .byte 196,98,125,24,61,13,59,0,0 // vbroadcastss 0x3b0d(%rip),%ymm15 # 4a78 <_sk_callback_hsw+0x1b6>
+ .byte 196,98,125,24,61,247,58,0,0 // vbroadcastss 0x3af7(%rip),%ymm15 # 4a7c <_sk_callback_hsw+0x1c0>
.byte 196,66,77,184,231 // vfmadd231ps %ymm15,%ymm6,%ymm12
.byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9
.byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -10732,7 +10807,7 @@ _sk_color_hsw:
.byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1
.byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8
.byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9
- .byte 196,226,125,24,5,239,57,0,0 // vbroadcastss 0x39ef(%rip),%ymm0 # 4a7c <_sk_callback_hsw+0x1ba>
+ .byte 196,226,125,24,5,217,57,0,0 // vbroadcastss 0x39d9(%rip),%ymm0 # 4a80 <_sk_callback_hsw+0x1c4>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -10760,11 +10835,11 @@ _sk_luminosity_hsw:
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
.byte 197,100,89,213 // vmulps %ymm5,%ymm3,%ymm10
.byte 197,100,89,222 // vmulps %ymm6,%ymm3,%ymm11
- .byte 196,98,125,24,45,136,57,0,0 // vbroadcastss 0x3988(%rip),%ymm13 # 4a80 <_sk_callback_hsw+0x1be>
- .byte 196,98,125,24,53,131,57,0,0 // vbroadcastss 0x3983(%rip),%ymm14 # 4a84 <_sk_callback_hsw+0x1c2>
+ .byte 196,98,125,24,45,114,57,0,0 // vbroadcastss 0x3972(%rip),%ymm13 # 4a84 <_sk_callback_hsw+0x1c8>
+ .byte 196,98,125,24,53,109,57,0,0 // vbroadcastss 0x396d(%rip),%ymm14 # 4a88 <_sk_callback_hsw+0x1cc>
.byte 196,65,116,89,230 // vmulps %ymm14,%ymm1,%ymm12
.byte 196,66,109,184,229 // vfmadd231ps %ymm13,%ymm2,%ymm12
- .byte 196,98,125,24,61,116,57,0,0 // vbroadcastss 0x3974(%rip),%ymm15 # 4a88 <_sk_callback_hsw+0x1c6>
+ .byte 196,98,125,24,61,94,57,0,0 // vbroadcastss 0x395e(%rip),%ymm15 # 4a8c <_sk_callback_hsw+0x1d0>
.byte 196,66,53,184,231 // vfmadd231ps %ymm15,%ymm9,%ymm12
.byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9
.byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -10820,7 +10895,7 @@ _sk_luminosity_hsw:
.byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1
.byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8
.byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9
- .byte 196,226,125,24,5,86,56,0,0 // vbroadcastss 0x3856(%rip),%ymm0 # 4a8c <_sk_callback_hsw+0x1ca>
+ .byte 196,226,125,24,5,64,56,0,0 // vbroadcastss 0x3840(%rip),%ymm0 # 4a90 <_sk_callback_hsw+0x1d4>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -10841,24 +10916,24 @@ HIDDEN _sk_srcover_rgba_8888_hsw
.globl _sk_srcover_rgba_8888_hsw
FUNCTION(_sk_srcover_rgba_8888_hsw)
_sk_srcover_rgba_8888_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,180,0,0,0 // jne 1345 <_sk_srcover_rgba_8888_hsw+0xcd>
- .byte 196,193,124,16,57 // vmovups (%r9),%ymm7
- .byte 197,196,84,37,98,59,0,0 // vandps 0x3b62(%rip),%ymm7,%ymm4 # 4e00 <_sk_callback_hsw+0x53e>
+ .byte 15,133,180,0,0,0 // jne 135f <_sk_srcover_rgba_8888_hsw+0xcd>
+ .byte 196,193,124,16,58 // vmovups (%r10),%ymm7
+ .byte 197,196,84,37,72,59,0,0 // vandps 0x3b48(%rip),%ymm7,%ymm4 # 4e00 <_sk_callback_hsw+0x544>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,69,0,45,117,59,0,0 // vpshufb 0x3b75(%rip),%ymm7,%ymm5 # 4e20 <_sk_callback_hsw+0x55e>
+ .byte 196,226,69,0,45,91,59,0,0 // vpshufb 0x3b5b(%rip),%ymm7,%ymm5 # 4e20 <_sk_callback_hsw+0x564>
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,69,0,53,136,59,0,0 // vpshufb 0x3b88(%rip),%ymm7,%ymm6 # 4e40 <_sk_callback_hsw+0x57e>
+ .byte 196,226,69,0,53,110,59,0,0 // vpshufb 0x3b6e(%rip),%ymm7,%ymm6 # 4e40 <_sk_callback_hsw+0x584>
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
.byte 197,197,114,215,24 // vpsrld $0x18,%ymm7,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,194,55,0,0 // vbroadcastss 0x37c2(%rip),%ymm8 # 4a90 <_sk_callback_hsw+0x1ce>
+ .byte 196,98,125,24,5,172,55,0,0 // vbroadcastss 0x37ac(%rip),%ymm8 # 4a94 <_sk_callback_hsw+0x1d8>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
- .byte 196,98,125,24,13,185,55,0,0 // vbroadcastss 0x37b9(%rip),%ymm9 # 4a94 <_sk_callback_hsw+0x1d2>
+ .byte 196,98,125,24,13,163,55,0,0 // vbroadcastss 0x37a3(%rip),%ymm9 # 4a98 <_sk_callback_hsw+0x1dc>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0
.byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
@@ -10878,10 +10953,10 @@ _sk_srcover_rgba_8888_hsw:
.byte 196,65,53,235,202 // vpor %ymm10,%ymm9,%ymm9
.byte 196,65,61,235,193 // vpor %ymm9,%ymm8,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,53 // jne 136e <_sk_srcover_rgba_8888_hsw+0xf6>
- .byte 196,65,124,17,1 // vmovups %ymm8,(%r9)
+ .byte 117,53 // jne 1388 <_sk_srcover_rgba_8888_hsw+0xf6>
+ .byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -10890,8 +10965,8 @@ _sk_srcover_rgba_8888_hsw:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,125,33,228 // vpmovsxbd %xmm4,%ymm4
- .byte 196,194,93,44,57 // vmaskmovps (%r9),%ymm4,%ymm7
- .byte 233,40,255,255,255 // jmpq 1296 <_sk_srcover_rgba_8888_hsw+0x1e>
+ .byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
+ .byte 233,40,255,255,255 // jmpq 12b0 <_sk_srcover_rgba_8888_hsw+0x1e>
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
.byte 192,225,3 // shl $0x3,%cl
@@ -10899,8 +10974,8 @@ _sk_srcover_rgba_8888_hsw:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9
- .byte 196,66,53,46,1 // vmaskmovps %ymm8,%ymm9,(%r9)
- .byte 235,170 // jmp 133e <_sk_srcover_rgba_8888_hsw+0xc6>
+ .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
+ .byte 235,170 // jmp 1358 <_sk_srcover_rgba_8888_hsw+0xc6>
HIDDEN _sk_clamp_0_hsw
.globl _sk_clamp_0_hsw
@@ -10918,7 +10993,7 @@ HIDDEN _sk_clamp_1_hsw
.globl _sk_clamp_1_hsw
FUNCTION(_sk_clamp_1_hsw)
_sk_clamp_1_hsw:
- .byte 196,98,125,24,5,222,54,0,0 // vbroadcastss 0x36de(%rip),%ymm8 # 4a98 <_sk_callback_hsw+0x1d6>
+ .byte 196,98,125,24,5,200,54,0,0 // vbroadcastss 0x36c8(%rip),%ymm8 # 4a9c <_sk_callback_hsw+0x1e0>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
@@ -10930,7 +11005,7 @@ HIDDEN _sk_clamp_a_hsw
.globl _sk_clamp_a_hsw
FUNCTION(_sk_clamp_a_hsw)
_sk_clamp_a_hsw:
- .byte 196,98,125,24,5,193,54,0,0 // vbroadcastss 0x36c1(%rip),%ymm8 # 4a9c <_sk_callback_hsw+0x1da>
+ .byte 196,98,125,24,5,171,54,0,0 // vbroadcastss 0x36ab(%rip),%ymm8 # 4aa0 <_sk_callback_hsw+0x1e4>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0
.byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1
@@ -11016,7 +11091,7 @@ FUNCTION(_sk_unpremul_hsw)
_sk_unpremul_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9
- .byte 196,98,125,24,21,9,54,0,0 // vbroadcastss 0x3609(%rip),%ymm10 # 4aa0 <_sk_callback_hsw+0x1de>
+ .byte 196,98,125,24,21,243,53,0,0 // vbroadcastss 0x35f3(%rip),%ymm10 # 4aa4 <_sk_callback_hsw+0x1e8>
.byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10
.byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
@@ -11029,16 +11104,16 @@ HIDDEN _sk_from_srgb_hsw
.globl _sk_from_srgb_hsw
FUNCTION(_sk_from_srgb_hsw)
_sk_from_srgb_hsw:
- .byte 196,98,125,24,5,234,53,0,0 // vbroadcastss 0x35ea(%rip),%ymm8 # 4aa4 <_sk_callback_hsw+0x1e2>
+ .byte 196,98,125,24,5,212,53,0,0 // vbroadcastss 0x35d4(%rip),%ymm8 # 4aa8 <_sk_callback_hsw+0x1ec>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10
- .byte 196,98,125,24,29,220,53,0,0 // vbroadcastss 0x35dc(%rip),%ymm11 # 4aa8 <_sk_callback_hsw+0x1e6>
- .byte 196,98,125,24,37,215,53,0,0 // vbroadcastss 0x35d7(%rip),%ymm12 # 4aac <_sk_callback_hsw+0x1ea>
+ .byte 196,98,125,24,29,198,53,0,0 // vbroadcastss 0x35c6(%rip),%ymm11 # 4aac <_sk_callback_hsw+0x1f0>
+ .byte 196,98,125,24,37,193,53,0,0 // vbroadcastss 0x35c1(%rip),%ymm12 # 4ab0 <_sk_callback_hsw+0x1f4>
.byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13
.byte 196,66,125,168,235 // vfmadd213ps %ymm11,%ymm0,%ymm13
- .byte 196,98,125,24,53,200,53,0,0 // vbroadcastss 0x35c8(%rip),%ymm14 # 4ab0 <_sk_callback_hsw+0x1ee>
+ .byte 196,98,125,24,53,178,53,0,0 // vbroadcastss 0x35b2(%rip),%ymm14 # 4ab4 <_sk_callback_hsw+0x1f8>
.byte 196,66,45,168,238 // vfmadd213ps %ymm14,%ymm10,%ymm13
- .byte 196,98,125,24,21,190,53,0,0 // vbroadcastss 0x35be(%rip),%ymm10 # 4ab4 <_sk_callback_hsw+0x1f2>
+ .byte 196,98,125,24,21,168,53,0,0 // vbroadcastss 0x35a8(%rip),%ymm10 # 4ab8 <_sk_callback_hsw+0x1fc>
.byte 196,193,124,194,194,1 // vcmpltps %ymm10,%ymm0,%ymm0
.byte 196,195,21,74,193,0 // vblendvps %ymm0,%ymm9,%ymm13,%ymm0
.byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9
@@ -11062,19 +11137,19 @@ HIDDEN _sk_to_srgb_hsw
FUNCTION(_sk_to_srgb_hsw)
_sk_to_srgb_hsw:
.byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9
- .byte 196,98,125,24,5,98,53,0,0 // vbroadcastss 0x3562(%rip),%ymm8 # 4ab8 <_sk_callback_hsw+0x1f6>
+ .byte 196,98,125,24,5,76,53,0,0 // vbroadcastss 0x354c(%rip),%ymm8 # 4abc <_sk_callback_hsw+0x200>
.byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10
- .byte 196,98,125,24,29,88,53,0,0 // vbroadcastss 0x3558(%rip),%ymm11 # 4abc <_sk_callback_hsw+0x1fa>
- .byte 196,98,125,24,37,83,53,0,0 // vbroadcastss 0x3553(%rip),%ymm12 # 4ac0 <_sk_callback_hsw+0x1fe>
+ .byte 196,98,125,24,29,66,53,0,0 // vbroadcastss 0x3542(%rip),%ymm11 # 4ac0 <_sk_callback_hsw+0x204>
+ .byte 196,98,125,24,37,61,53,0,0 // vbroadcastss 0x353d(%rip),%ymm12 # 4ac4 <_sk_callback_hsw+0x208>
.byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13
.byte 196,66,53,168,235 // vfmadd213ps %ymm11,%ymm9,%ymm13
- .byte 196,98,125,24,53,68,53,0,0 // vbroadcastss 0x3544(%rip),%ymm14 # 4ac4 <_sk_callback_hsw+0x202>
+ .byte 196,98,125,24,53,46,53,0,0 // vbroadcastss 0x352e(%rip),%ymm14 # 4ac8 <_sk_callback_hsw+0x20c>
.byte 196,66,53,168,238 // vfmadd213ps %ymm14,%ymm9,%ymm13
- .byte 196,98,125,24,61,58,53,0,0 // vbroadcastss 0x353a(%rip),%ymm15 # 4ac8 <_sk_callback_hsw+0x206>
+ .byte 196,98,125,24,61,36,53,0,0 // vbroadcastss 0x3524(%rip),%ymm15 # 4acc <_sk_callback_hsw+0x210>
.byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9
.byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9
.byte 196,65,20,89,201 // vmulps %ymm9,%ymm13,%ymm9
- .byte 196,98,125,24,45,38,53,0,0 // vbroadcastss 0x3526(%rip),%ymm13 # 4acc <_sk_callback_hsw+0x20a>
+ .byte 196,98,125,24,45,16,53,0,0 // vbroadcastss 0x3510(%rip),%ymm13 # 4ad0 <_sk_callback_hsw+0x214>
.byte 196,193,124,194,197,1 // vcmpltps %ymm13,%ymm0,%ymm0
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9
@@ -11108,26 +11183,26 @@ _sk_rgb_to_hsl_hsw:
.byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9
.byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9
.byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,29,155,52,0,0 // vbroadcastss 0x349b(%rip),%ymm11 # 4ad0 <_sk_callback_hsw+0x20e>
+ .byte 196,98,125,24,29,133,52,0,0 // vbroadcastss 0x3485(%rip),%ymm11 # 4ad4 <_sk_callback_hsw+0x218>
.byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11
.byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12
.byte 197,116,194,234,1 // vcmpltps %ymm2,%ymm1,%ymm13
- .byte 196,98,125,24,53,136,52,0,0 // vbroadcastss 0x3488(%rip),%ymm14 # 4ad4 <_sk_callback_hsw+0x212>
+ .byte 196,98,125,24,53,114,52,0,0 // vbroadcastss 0x3472(%rip),%ymm14 # 4ad8 <_sk_callback_hsw+0x21c>
.byte 196,65,4,87,255 // vxorps %ymm15,%ymm15,%ymm15
.byte 196,67,5,74,238,208 // vblendvps %ymm13,%ymm14,%ymm15,%ymm13
.byte 196,66,37,168,229 // vfmadd213ps %ymm13,%ymm11,%ymm12
.byte 197,236,92,208 // vsubps %ymm0,%ymm2,%ymm2
.byte 197,124,92,233 // vsubps %ymm1,%ymm0,%ymm13
- .byte 196,98,125,24,53,111,52,0,0 // vbroadcastss 0x346f(%rip),%ymm14 # 4adc <_sk_callback_hsw+0x21a>
+ .byte 196,98,125,24,53,89,52,0,0 // vbroadcastss 0x3459(%rip),%ymm14 # 4ae0 <_sk_callback_hsw+0x224>
.byte 196,66,37,168,238 // vfmadd213ps %ymm14,%ymm11,%ymm13
- .byte 196,98,125,24,53,93,52,0,0 // vbroadcastss 0x345d(%rip),%ymm14 # 4ad8 <_sk_callback_hsw+0x216>
+ .byte 196,98,125,24,53,71,52,0,0 // vbroadcastss 0x3447(%rip),%ymm14 # 4adc <_sk_callback_hsw+0x220>
.byte 196,194,37,168,214 // vfmadd213ps %ymm14,%ymm11,%ymm2
.byte 197,188,194,201,0 // vcmpeqps %ymm1,%ymm8,%ymm1
.byte 196,227,21,74,202,16 // vblendvps %ymm1,%ymm2,%ymm13,%ymm1
.byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0
.byte 196,195,117,74,196,0 // vblendvps %ymm0,%ymm12,%ymm1,%ymm0
.byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1
- .byte 196,98,125,24,29,64,52,0,0 // vbroadcastss 0x3440(%rip),%ymm11 # 4ae4 <_sk_callback_hsw+0x222>
+ .byte 196,98,125,24,29,42,52,0,0 // vbroadcastss 0x342a(%rip),%ymm11 # 4ae8 <_sk_callback_hsw+0x22c>
.byte 196,193,116,89,211 // vmulps %ymm11,%ymm1,%ymm2
.byte 197,36,194,218,1 // vcmpltps %ymm2,%ymm11,%ymm11
.byte 196,65,12,92,224 // vsubps %ymm8,%ymm14,%ymm12
@@ -11137,7 +11212,7 @@ _sk_rgb_to_hsl_hsw:
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 196,195,125,74,199,128 // vblendvps %ymm8,%ymm15,%ymm0,%ymm0
.byte 196,195,117,74,207,128 // vblendvps %ymm8,%ymm15,%ymm1,%ymm1
- .byte 196,98,125,24,5,3,52,0,0 // vbroadcastss 0x3403(%rip),%ymm8 # 4ae0 <_sk_callback_hsw+0x21e>
+ .byte 196,98,125,24,5,237,51,0,0 // vbroadcastss 0x33ed(%rip),%ymm8 # 4ae4 <_sk_callback_hsw+0x228>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -11154,30 +11229,30 @@ _sk_hsl_to_rgb_hsw:
.byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp)
.byte 197,252,40,233 // vmovaps %ymm1,%ymm5
.byte 197,252,40,224 // vmovaps %ymm0,%ymm4
- .byte 196,98,125,24,5,208,51,0,0 // vbroadcastss 0x33d0(%rip),%ymm8 # 4ae8 <_sk_callback_hsw+0x226>
+ .byte 196,98,125,24,5,186,51,0,0 // vbroadcastss 0x33ba(%rip),%ymm8 # 4aec <_sk_callback_hsw+0x230>
.byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9
.byte 197,84,89,210 // vmulps %ymm2,%ymm5,%ymm10
.byte 196,65,84,92,218 // vsubps %ymm10,%ymm5,%ymm11
.byte 196,67,45,74,203,144 // vblendvps %ymm9,%ymm11,%ymm10,%ymm9
.byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10
- .byte 196,98,125,24,13,179,51,0,0 // vbroadcastss 0x33b3(%rip),%ymm9 # 4aec <_sk_callback_hsw+0x22a>
+ .byte 196,98,125,24,13,157,51,0,0 // vbroadcastss 0x339d(%rip),%ymm9 # 4af0 <_sk_callback_hsw+0x234>
.byte 196,66,109,170,202 // vfmsub213ps %ymm10,%ymm2,%ymm9
- .byte 196,98,125,24,29,169,51,0,0 // vbroadcastss 0x33a9(%rip),%ymm11 # 4af0 <_sk_callback_hsw+0x22e>
+ .byte 196,98,125,24,29,147,51,0,0 // vbroadcastss 0x3393(%rip),%ymm11 # 4af4 <_sk_callback_hsw+0x238>
.byte 196,65,92,88,219 // vaddps %ymm11,%ymm4,%ymm11
.byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12
.byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15
.byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11
- .byte 196,98,125,24,45,147,51,0,0 // vbroadcastss 0x3393(%rip),%ymm13 # 4af8 <_sk_callback_hsw+0x236>
+ .byte 196,98,125,24,45,125,51,0,0 // vbroadcastss 0x337d(%rip),%ymm13 # 4afc <_sk_callback_hsw+0x240>
.byte 196,193,4,89,197 // vmulps %ymm13,%ymm15,%ymm0
- .byte 196,98,125,24,53,137,51,0,0 // vbroadcastss 0x3389(%rip),%ymm14 # 4afc <_sk_callback_hsw+0x23a>
+ .byte 196,98,125,24,53,115,51,0,0 // vbroadcastss 0x3373(%rip),%ymm14 # 4b00 <_sk_callback_hsw+0x244>
.byte 197,12,92,224 // vsubps %ymm0,%ymm14,%ymm12
.byte 196,66,37,168,225 // vfmadd213ps %ymm9,%ymm11,%ymm12
- .byte 196,226,125,24,29,111,51,0,0 // vbroadcastss 0x336f(%rip),%ymm3 # 4af4 <_sk_callback_hsw+0x232>
+ .byte 196,226,125,24,29,89,51,0,0 // vbroadcastss 0x3359(%rip),%ymm3 # 4af8 <_sk_callback_hsw+0x23c>
.byte 196,193,100,194,255,2 // vcmpleps %ymm15,%ymm3,%ymm7
.byte 196,195,29,74,249,112 // vblendvps %ymm7,%ymm9,%ymm12,%ymm7
.byte 196,65,60,194,231,2 // vcmpleps %ymm15,%ymm8,%ymm12
.byte 196,227,45,74,255,192 // vblendvps %ymm12,%ymm7,%ymm10,%ymm7
- .byte 196,98,125,24,37,90,51,0,0 // vbroadcastss 0x335a(%rip),%ymm12 # 4b00 <_sk_callback_hsw+0x23e>
+ .byte 196,98,125,24,37,68,51,0,0 // vbroadcastss 0x3344(%rip),%ymm12 # 4b04 <_sk_callback_hsw+0x248>
.byte 196,65,28,194,255,2 // vcmpleps %ymm15,%ymm12,%ymm15
.byte 196,194,37,168,193 // vfmadd213ps %ymm9,%ymm11,%ymm0
.byte 196,99,125,74,255,240 // vblendvps %ymm15,%ymm7,%ymm0,%ymm15
@@ -11193,7 +11268,7 @@ _sk_hsl_to_rgb_hsw:
.byte 197,156,194,192,2 // vcmpleps %ymm0,%ymm12,%ymm0
.byte 196,194,37,168,249 // vfmadd213ps %ymm9,%ymm11,%ymm7
.byte 196,227,69,74,201,0 // vblendvps %ymm0,%ymm1,%ymm7,%ymm1
- .byte 196,226,125,24,5,6,51,0,0 // vbroadcastss 0x3306(%rip),%ymm0 # 4b04 <_sk_callback_hsw+0x242>
+ .byte 196,226,125,24,5,240,50,0,0 // vbroadcastss 0x32f0(%rip),%ymm0 # 4b08 <_sk_callback_hsw+0x24c>
.byte 197,220,88,192 // vaddps %ymm0,%ymm4,%ymm0
.byte 196,227,125,8,224,1 // vroundps $0x1,%ymm0,%ymm4
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
@@ -11238,36 +11313,38 @@ HIDDEN _sk_scale_u8_hsw
.globl _sk_scale_u8_hsw
FUNCTION(_sk_scale_u8_hsw)
_sk_scale_u8_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,51 // jne 18de <_sk_scale_u8_hsw+0x43>
+ .byte 117,51 // jne 18f8 <_sk_scale_u8_hsw+0x43>
.byte 197,122,126,0 // vmovq (%rax),%xmm8
.byte 196,66,125,49,192 // vpmovzxbd %xmm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,70,50,0,0 // vbroadcastss 0x3246(%rip),%ymm9 # 4b08 <_sk_callback_hsw+0x246>
+ .byte 196,98,125,24,13,48,50,0,0 // vbroadcastss 0x3230(%rip),%ymm9 # 4b0c <_sk_callback_hsw+0x250>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
.byte 197,188,89,219 // vmulps %ymm3,%ymm8,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 18e6 <_sk_scale_u8_hsw+0x4b>
- .byte 196,65,249,110,193 // vmovq %r9,%xmm8
- .byte 235,172 // jmp 18af <_sk_scale_u8_hsw+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 1901 <_sk_scale_u8_hsw+0x4c>
+ .byte 196,65,249,110,194 // vmovq %r10,%xmm8
+ .byte 91 // pop %rbx
+ .byte 235,171 // jmp 18c9 <_sk_scale_u8_hsw+0x14>
HIDDEN _sk_lerp_1_float_hsw
.globl _sk_lerp_1_float_hsw
@@ -11290,16 +11367,16 @@ HIDDEN _sk_lerp_u8_hsw
.globl _sk_lerp_u8_hsw
FUNCTION(_sk_lerp_u8_hsw)
_sk_lerp_u8_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,71 // jne 1989 <_sk_lerp_u8_hsw+0x57>
+ .byte 117,71 // jne 19a4 <_sk_lerp_u8_hsw+0x57>
.byte 197,122,126,0 // vmovq (%rax),%xmm8
.byte 196,66,125,49,192 // vpmovzxbd %xmm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,179,49,0,0 // vbroadcastss 0x31b3(%rip),%ymm9 # 4b0c <_sk_callback_hsw+0x24a>
+ .byte 196,98,125,24,13,156,49,0,0 // vbroadcastss 0x319c(%rip),%ymm9 # 4b10 <_sk_callback_hsw+0x254>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0
@@ -11310,45 +11387,47 @@ _sk_lerp_u8_hsw:
.byte 197,228,92,223 // vsubps %ymm7,%ymm3,%ymm3
.byte 196,226,61,168,223 // vfmadd213ps %ymm7,%ymm8,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 1991 <_sk_lerp_u8_hsw+0x5f>
- .byte 196,65,249,110,193 // vmovq %r9,%xmm8
- .byte 235,152 // jmp 1946 <_sk_lerp_u8_hsw+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 19ad <_sk_lerp_u8_hsw+0x60>
+ .byte 196,65,249,110,194 // vmovq %r10,%xmm8
+ .byte 91 // pop %rbx
+ .byte 235,151 // jmp 1961 <_sk_lerp_u8_hsw+0x14>
HIDDEN _sk_lerp_565_hsw
.globl _sk_lerp_565_hsw
FUNCTION(_sk_lerp_565_hsw)
_sk_lerp_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,169,0,0,0 // jne 1a65 <_sk_lerp_565_hsw+0xb7>
- .byte 196,65,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm8
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,169,0,0,0 // jne 1a81 <_sk_lerp_565_hsw+0xb7>
+ .byte 196,65,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm8
.byte 196,66,125,51,192 // vpmovzxwd %xmm8,%ymm8
- .byte 196,98,125,88,13,64,49,0,0 // vpbroadcastd 0x3140(%rip),%ymm9 # 4b10 <_sk_callback_hsw+0x24e>
+ .byte 196,98,125,88,13,40,49,0,0 // vpbroadcastd 0x3128(%rip),%ymm9 # 4b14 <_sk_callback_hsw+0x258>
.byte 196,65,61,219,201 // vpand %ymm9,%ymm8,%ymm9
.byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9
- .byte 196,98,125,24,21,49,49,0,0 // vbroadcastss 0x3131(%rip),%ymm10 # 4b14 <_sk_callback_hsw+0x252>
+ .byte 196,98,125,24,21,25,49,0,0 // vbroadcastss 0x3119(%rip),%ymm10 # 4b18 <_sk_callback_hsw+0x25c>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,88,21,39,49,0,0 // vpbroadcastd 0x3127(%rip),%ymm10 # 4b18 <_sk_callback_hsw+0x256>
+ .byte 196,98,125,88,21,15,49,0,0 // vpbroadcastd 0x310f(%rip),%ymm10 # 4b1c <_sk_callback_hsw+0x260>
.byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10
.byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10
- .byte 196,98,125,24,29,24,49,0,0 // vbroadcastss 0x3118(%rip),%ymm11 # 4b1c <_sk_callback_hsw+0x25a>
+ .byte 196,98,125,24,29,0,49,0,0 // vbroadcastss 0x3100(%rip),%ymm11 # 4b20 <_sk_callback_hsw+0x264>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,88,29,14,49,0,0 // vpbroadcastd 0x310e(%rip),%ymm11 # 4b20 <_sk_callback_hsw+0x25e>
+ .byte 196,98,125,88,29,246,48,0,0 // vpbroadcastd 0x30f6(%rip),%ymm11 # 4b24 <_sk_callback_hsw+0x268>
.byte 196,65,61,219,195 // vpand %ymm11,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,29,255,48,0,0 // vbroadcastss 0x30ff(%rip),%ymm11 # 4b24 <_sk_callback_hsw+0x262>
+ .byte 196,98,125,24,29,231,48,0,0 // vbroadcastss 0x30e7(%rip),%ymm11 # 4b28 <_sk_callback_hsw+0x26c>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,226,53,168,196 // vfmadd213ps %ymm4,%ymm9,%ymm0
@@ -11364,31 +11443,31 @@ _sk_lerp_565_hsw:
.byte 197,180,95,219 // vmaxps %ymm3,%ymm9,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 15,135,68,255,255,255 // ja 19c2 <_sk_lerp_565_hsw+0x14>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,75,0,0,0 // lea 0x4b(%rip),%r9 # 1ad4 <_sk_lerp_565_hsw+0x126>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 15,135,68,255,255,255 // ja 19de <_sk_lerp_565_hsw+0x14>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,75,0,0,0 // lea 0x4b(%rip),%r10 # 1af0 <_sk_lerp_565_hsw+0x126>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8
- .byte 196,65,57,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm8,%xmm8
- .byte 233,239,254,255,255 // jmpq 19c2 <_sk_lerp_565_hsw+0x14>
+ .byte 196,65,57,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 233,239,254,255,255 // jmpq 19de <_sk_lerp_565_hsw+0x14>
.byte 144 // nop
.byte 243,255 // repz (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 235,255 // jmp 1ad9 <_sk_lerp_565_hsw+0x12b>
+ .byte 235,255 // jmp 1af5 <_sk_lerp_565_hsw+0x12b>
.byte 255 // (bad)
.byte 255,227 // jmpq *%rbx
.byte 255 // (bad)
@@ -11412,55 +11491,55 @@ HIDDEN _sk_load_tables_hsw
.globl _sk_load_tables_hsw
FUNCTION(_sk_load_tables_hsw)
_sk_load_tables_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,105 // jne 1b6e <_sk_load_tables_hsw+0x7e>
- .byte 196,193,124,16,25 // vmovups (%r9),%ymm3
- .byte 197,228,84,13,78,51,0,0 // vandps 0x334e(%rip),%ymm3,%ymm1 # 4e60 <_sk_callback_hsw+0x59e>
+ .byte 117,105 // jne 1b8a <_sk_load_tables_hsw+0x7e>
+ .byte 196,193,124,16,26 // vmovups (%r10),%ymm3
+ .byte 197,228,84,13,50,51,0,0 // vandps 0x3332(%rip),%ymm3,%ymm1 # 4e60 <_sk_callback_hsw+0x5a4>
.byte 196,65,61,118,192 // vpcmpeqd %ymm8,%ymm8,%ymm8
.byte 72,139,72,8 // mov 0x8(%rax),%rcx
- .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
.byte 196,226,109,146,4,137 // vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0
- .byte 196,226,101,0,21,78,51,0,0 // vpshufb 0x334e(%rip),%ymm3,%ymm2 # 4e80 <_sk_callback_hsw+0x5be>
+ .byte 196,226,101,0,21,50,51,0,0 // vpshufb 0x3332(%rip),%ymm3,%ymm2 # 4e80 <_sk_callback_hsw+0x5c4>
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
- .byte 196,194,53,146,12,145 // vgatherdps %ymm9,(%r9,%ymm2,4),%ymm1
+ .byte 196,194,53,146,12,146 // vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1
.byte 72,139,64,24 // mov 0x18(%rax),%rax
- .byte 196,98,101,0,13,86,51,0,0 // vpshufb 0x3356(%rip),%ymm3,%ymm9 # 4ea0 <_sk_callback_hsw+0x5de>
+ .byte 196,98,101,0,13,58,51,0,0 // vpshufb 0x333a(%rip),%ymm3,%ymm9 # 4ea0 <_sk_callback_hsw+0x5e4>
.byte 196,162,61,146,20,136 // vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,198,47,0,0 // vbroadcastss 0x2fc6(%rip),%ymm8 # 4b28 <_sk_callback_hsw+0x266>
+ .byte 196,98,125,24,5,174,47,0,0 // vbroadcastss 0x2fae(%rip),%ymm8 # 4b2c <_sk_callback_hsw+0x270>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
.byte 192,225,3 // shl $0x3,%cl
- .byte 73,199,194,255,255,255,255 // mov $0xffffffffffffffff,%r10
- .byte 73,211,234 // shr %cl,%r10
- .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 73,199,195,255,255,255,255 // mov $0xffffffffffffffff,%r11
+ .byte 73,211,235 // shr %cl,%r11
+ .byte 196,193,249,110,195 // vmovq %r11,%xmm0
.byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0
- .byte 196,194,125,44,25 // vmaskmovps (%r9),%ymm0,%ymm3
- .byte 233,115,255,255,255 // jmpq 1b0a <_sk_load_tables_hsw+0x1a>
+ .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
+ .byte 233,115,255,255,255 // jmpq 1b26 <_sk_load_tables_hsw+0x1a>
HIDDEN _sk_load_tables_u16_be_hsw
.globl _sk_load_tables_u16_be_hsw
FUNCTION(_sk_load_tables_u16_be_hsw)
_sk_load_tables_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,201,0,0,0 // jne 1c76 <_sk_load_tables_u16_be_hsw+0xdf>
- .byte 196,1,121,16,4,72 // vmovupd (%r8,%r9,2),%xmm8
- .byte 196,129,121,16,84,72,16 // vmovupd 0x10(%r8,%r9,2),%xmm2
- .byte 196,129,121,16,92,72,32 // vmovupd 0x20(%r8,%r9,2),%xmm3
- .byte 196,1,122,111,76,72,48 // vmovdqu 0x30(%r8,%r9,2),%xmm9
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,201,0,0,0 // jne 1c92 <_sk_load_tables_u16_be_hsw+0xdf>
+ .byte 196,1,121,16,4,81 // vmovupd (%r9,%r10,2),%xmm8
+ .byte 196,129,121,16,84,81,16 // vmovupd 0x10(%r9,%r10,2),%xmm2
+ .byte 196,129,121,16,92,81,32 // vmovupd 0x20(%r9,%r10,2),%xmm3
+ .byte 196,1,122,111,76,81,48 // vmovdqu 0x30(%r9,%r10,2),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,97,97,201 // vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -11472,18 +11551,18 @@ _sk_load_tables_u16_be_hsw:
.byte 197,185,108,200 // vpunpcklqdq %xmm0,%xmm8,%xmm1
.byte 197,185,109,208 // vpunpckhqdq %xmm0,%xmm8,%xmm2
.byte 197,49,108,195 // vpunpcklqdq %xmm3,%xmm9,%xmm8
- .byte 197,121,111,21,226,51,0,0 // vmovdqa 0x33e2(%rip),%xmm10 # 4fe0 <_sk_callback_hsw+0x71e>
+ .byte 197,121,111,21,198,51,0,0 // vmovdqa 0x33c6(%rip),%xmm10 # 4fe0 <_sk_callback_hsw+0x724>
.byte 196,193,113,219,194 // vpand %xmm10,%xmm1,%xmm0
.byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1
.byte 196,65,37,118,219 // vpcmpeqd %ymm11,%ymm11,%ymm11
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 196,65,29,118,228 // vpcmpeqd %ymm12,%ymm12,%ymm12
- .byte 196,194,29,146,4,136 // vgatherdps %ymm12,(%r8,%ymm1,4),%ymm0
+ .byte 196,194,29,146,4,137 // vgatherdps %ymm12,(%r9,%ymm1,4),%ymm0
.byte 196,193,105,219,202 // vpand %xmm10,%xmm2,%xmm1
.byte 196,226,125,51,209 // vpmovzxwd %xmm1,%ymm2
.byte 196,65,29,118,228 // vpcmpeqd %ymm12,%ymm12,%ymm12
- .byte 196,194,29,146,12,145 // vgatherdps %ymm12,(%r9,%ymm2,4),%ymm1
+ .byte 196,194,29,146,12,146 // vgatherdps %ymm12,(%r10,%ymm2,4),%ymm1
.byte 72,139,64,24 // mov 0x18(%rax),%rax
.byte 196,193,57,219,210 // vpand %xmm10,%xmm8,%xmm2
.byte 196,98,125,51,194 // vpmovzxwd %xmm2,%ymm8
@@ -11494,50 +11573,50 @@ _sk_load_tables_u16_be_hsw:
.byte 197,185,235,219 // vpor %xmm3,%xmm8,%xmm3
.byte 196,226,125,51,219 // vpmovzxwd %xmm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,191,46,0,0 // vbroadcastss 0x2ebf(%rip),%ymm8 # 4b2c <_sk_callback_hsw+0x26a>
+ .byte 196,98,125,24,5,167,46,0,0 // vbroadcastss 0x2ea7(%rip),%ymm8 # 4b30 <_sk_callback_hsw+0x274>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 196,1,123,16,4,72 // vmovsd (%r8,%r9,2),%xmm8
+ .byte 196,1,123,16,4,81 // vmovsd (%r9,%r10,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,85 // je 1cdc <_sk_load_tables_u16_be_hsw+0x145>
- .byte 196,1,57,22,68,72,8 // vmovhpd 0x8(%r8,%r9,2),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,72 // jb 1cdc <_sk_load_tables_u16_be_hsw+0x145>
- .byte 196,129,123,16,84,72,16 // vmovsd 0x10(%r8,%r9,2),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,72 // je 1ce9 <_sk_load_tables_u16_be_hsw+0x152>
- .byte 196,129,105,22,84,72,24 // vmovhpd 0x18(%r8,%r9,2),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,59 // jb 1ce9 <_sk_load_tables_u16_be_hsw+0x152>
- .byte 196,129,123,16,92,72,32 // vmovsd 0x20(%r8,%r9,2),%xmm3
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,9,255,255,255 // je 1bc8 <_sk_load_tables_u16_be_hsw+0x31>
- .byte 196,129,97,22,92,72,40 // vmovhpd 0x28(%r8,%r9,2),%xmm3,%xmm3
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,248,254,255,255 // jb 1bc8 <_sk_load_tables_u16_be_hsw+0x31>
- .byte 196,1,122,126,76,72,48 // vmovq 0x30(%r8,%r9,2),%xmm9
- .byte 233,236,254,255,255 // jmpq 1bc8 <_sk_load_tables_u16_be_hsw+0x31>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,85 // je 1cf8 <_sk_load_tables_u16_be_hsw+0x145>
+ .byte 196,1,57,22,68,81,8 // vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,72 // jb 1cf8 <_sk_load_tables_u16_be_hsw+0x145>
+ .byte 196,129,123,16,84,81,16 // vmovsd 0x10(%r9,%r10,2),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,72 // je 1d05 <_sk_load_tables_u16_be_hsw+0x152>
+ .byte 196,129,105,22,84,81,24 // vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,59 // jb 1d05 <_sk_load_tables_u16_be_hsw+0x152>
+ .byte 196,129,123,16,92,81,32 // vmovsd 0x20(%r9,%r10,2),%xmm3
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,9,255,255,255 // je 1be4 <_sk_load_tables_u16_be_hsw+0x31>
+ .byte 196,129,97,22,92,81,40 // vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,248,254,255,255 // jb 1be4 <_sk_load_tables_u16_be_hsw+0x31>
+ .byte 196,1,122,126,76,81,48 // vmovq 0x30(%r9,%r10,2),%xmm9
+ .byte 233,236,254,255,255 // jmpq 1be4 <_sk_load_tables_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,223,254,255,255 // jmpq 1bc8 <_sk_load_tables_u16_be_hsw+0x31>
+ .byte 233,223,254,255,255 // jmpq 1be4 <_sk_load_tables_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,214,254,255,255 // jmpq 1bc8 <_sk_load_tables_u16_be_hsw+0x31>
+ .byte 233,214,254,255,255 // jmpq 1be4 <_sk_load_tables_u16_be_hsw+0x31>
HIDDEN _sk_load_tables_rgb_u16_be_hsw
.globl _sk_load_tables_rgb_u16_be_hsw
FUNCTION(_sk_load_tables_rgb_u16_be_hsw)
_sk_load_tables_rgb_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,127 // lea (%rdi,%rdi,2),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,193,0,0,0 // jne 1dc5 <_sk_load_tables_rgb_u16_be_hsw+0xd3>
- .byte 196,129,122,111,4,72 // vmovdqu (%r8,%r9,2),%xmm0
- .byte 196,129,122,111,84,72,12 // vmovdqu 0xc(%r8,%r9,2),%xmm2
- .byte 196,129,122,111,76,72,24 // vmovdqu 0x18(%r8,%r9,2),%xmm1
- .byte 196,129,122,111,92,72,32 // vmovdqu 0x20(%r8,%r9,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,193,0,0,0 // jne 1de1 <_sk_load_tables_rgb_u16_be_hsw+0xd3>
+ .byte 196,129,122,111,4,81 // vmovdqu (%r9,%r10,2),%xmm0
+ .byte 196,129,122,111,84,81,12 // vmovdqu 0xc(%r9,%r10,2),%xmm2
+ .byte 196,129,122,111,76,81,24 // vmovdqu 0x18(%r9,%r10,2),%xmm1
+ .byte 196,129,122,111,92,81,32 // vmovdqu 0x20(%r9,%r10,2),%xmm3
.byte 197,225,115,219,4 // vpsrldq $0x4,%xmm3,%xmm3
.byte 197,185,115,216,6 // vpsrldq $0x6,%xmm0,%xmm8
.byte 197,177,115,218,6 // vpsrldq $0x6,%xmm2,%xmm9
@@ -11554,342 +11633,312 @@ _sk_load_tables_rgb_u16_be_hsw:
.byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3
.byte 197,185,109,210 // vpunpckhqdq %xmm2,%xmm8,%xmm2
.byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8
- .byte 197,121,111,13,130,50,0,0 // vmovdqa 0x3282(%rip),%xmm9 # 4ff0 <_sk_callback_hsw+0x72e>
+ .byte 197,121,111,13,102,50,0,0 // vmovdqa 0x3266(%rip),%xmm9 # 4ff0 <_sk_callback_hsw+0x734>
.byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0
.byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 196,65,45,118,210 // vpcmpeqd %ymm10,%ymm10,%ymm10
- .byte 196,194,45,146,4,136 // vgatherdps %ymm10,(%r8,%ymm1,4),%ymm0
+ .byte 196,194,45,146,4,137 // vgatherdps %ymm10,(%r9,%ymm1,4),%ymm0
.byte 196,193,105,219,201 // vpand %xmm9,%xmm2,%xmm1
.byte 196,226,125,51,209 // vpmovzxwd %xmm1,%ymm2
.byte 196,65,45,118,210 // vpcmpeqd %ymm10,%ymm10,%ymm10
- .byte 196,194,45,146,12,145 // vgatherdps %ymm10,(%r9,%ymm2,4),%ymm1
+ .byte 196,194,45,146,12,146 // vgatherdps %ymm10,(%r10,%ymm2,4),%ymm1
.byte 72,139,64,24 // mov 0x18(%rax),%rax
.byte 196,193,57,219,209 // vpand %xmm9,%xmm8,%xmm2
.byte 196,98,125,51,194 // vpmovzxwd %xmm2,%ymm8
.byte 196,162,101,146,20,128 // vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,109,45,0,0 // vbroadcastss 0x2d6d(%rip),%ymm3 # 4b30 <_sk_callback_hsw+0x26e>
- .byte 255,224 // jmpq *%rax
- .byte 196,129,121,110,4,72 // vmovd (%r8,%r9,2),%xmm0
- .byte 196,129,121,196,68,72,4,2 // vpinsrw $0x2,0x4(%r8,%r9,2),%xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,5 // jne 1dde <_sk_load_tables_rgb_u16_be_hsw+0xec>
- .byte 233,90,255,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 196,129,121,110,76,72,6 // vmovd 0x6(%r8,%r9,2),%xmm1
- .byte 196,1,113,196,68,72,10,2 // vpinsrw $0x2,0xa(%r8,%r9,2),%xmm1,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,26 // jb 1e0d <_sk_load_tables_rgb_u16_be_hsw+0x11b>
- .byte 196,129,121,110,76,72,12 // vmovd 0xc(%r8,%r9,2),%xmm1
- .byte 196,129,113,196,84,72,16,2 // vpinsrw $0x2,0x10(%r8,%r9,2),%xmm1,%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 117,10 // jne 1e12 <_sk_load_tables_rgb_u16_be_hsw+0x120>
- .byte 233,43,255,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 233,38,255,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 196,129,121,110,76,72,18 // vmovd 0x12(%r8,%r9,2),%xmm1
- .byte 196,1,113,196,76,72,22,2 // vpinsrw $0x2,0x16(%r8,%r9,2),%xmm1,%xmm9
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,26 // jb 1e41 <_sk_load_tables_rgb_u16_be_hsw+0x14f>
- .byte 196,129,121,110,76,72,24 // vmovd 0x18(%r8,%r9,2),%xmm1
- .byte 196,129,113,196,76,72,28,2 // vpinsrw $0x2,0x1c(%r8,%r9,2),%xmm1,%xmm1
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 117,10 // jne 1e46 <_sk_load_tables_rgb_u16_be_hsw+0x154>
- .byte 233,247,254,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 233,242,254,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 196,129,121,110,92,72,30 // vmovd 0x1e(%r8,%r9,2),%xmm3
- .byte 196,1,97,196,92,72,34,2 // vpinsrw $0x2,0x22(%r8,%r9,2),%xmm3,%xmm11
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,20 // jb 1e6f <_sk_load_tables_rgb_u16_be_hsw+0x17d>
- .byte 196,129,121,110,92,72,36 // vmovd 0x24(%r8,%r9,2),%xmm3
- .byte 196,129,97,196,92,72,40,2 // vpinsrw $0x2,0x28(%r8,%r9,2),%xmm3,%xmm3
- .byte 233,201,254,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- .byte 233,196,254,255,255 // jmpq 1d38 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 196,226,125,24,29,85,45,0,0 // vbroadcastss 0x2d55(%rip),%ymm3 # 4b34 <_sk_callback_hsw+0x278>
+ .byte 255,224 // jmpq *%rax
+ .byte 196,129,121,110,4,81 // vmovd (%r9,%r10,2),%xmm0
+ .byte 196,129,121,196,68,81,4,2 // vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,5 // jne 1dfa <_sk_load_tables_rgb_u16_be_hsw+0xec>
+ .byte 233,90,255,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 196,129,121,110,76,81,6 // vmovd 0x6(%r9,%r10,2),%xmm1
+ .byte 196,1,113,196,68,81,10,2 // vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,26 // jb 1e29 <_sk_load_tables_rgb_u16_be_hsw+0x11b>
+ .byte 196,129,121,110,76,81,12 // vmovd 0xc(%r9,%r10,2),%xmm1
+ .byte 196,129,113,196,84,81,16,2 // vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 117,10 // jne 1e2e <_sk_load_tables_rgb_u16_be_hsw+0x120>
+ .byte 233,43,255,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 233,38,255,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 196,129,121,110,76,81,18 // vmovd 0x12(%r9,%r10,2),%xmm1
+ .byte 196,1,113,196,76,81,22,2 // vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,26 // jb 1e5d <_sk_load_tables_rgb_u16_be_hsw+0x14f>
+ .byte 196,129,121,110,76,81,24 // vmovd 0x18(%r9,%r10,2),%xmm1
+ .byte 196,129,113,196,76,81,28,2 // vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 117,10 // jne 1e62 <_sk_load_tables_rgb_u16_be_hsw+0x154>
+ .byte 233,247,254,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 233,242,254,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 196,129,121,110,92,81,30 // vmovd 0x1e(%r9,%r10,2),%xmm3
+ .byte 196,1,97,196,92,81,34,2 // vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,20 // jb 1e8b <_sk_load_tables_rgb_u16_be_hsw+0x17d>
+ .byte 196,129,121,110,92,81,36 // vmovd 0x24(%r9,%r10,2),%xmm3
+ .byte 196,129,97,196,92,81,40,2 // vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3
+ .byte 233,201,254,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ .byte 233,196,254,255,255 // jmpq 1d54 <_sk_load_tables_rgb_u16_be_hsw+0x46>
HIDDEN _sk_byte_tables_hsw
.globl _sk_byte_tables_hsw
FUNCTION(_sk_byte_tables_hsw)
_sk_byte_tables_hsw:
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,171,44,0,0 // vbroadcastss 0x2cab(%rip),%ymm8 # 4b34 <_sk_callback_hsw+0x272>
+ .byte 196,98,125,24,5,157,44,0,0 // vbroadcastss 0x2c9d(%rip),%ymm8 # 4b38 <_sk_callback_hsw+0x27c>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 68,137,197 // mov %r8d,%ebp
- .byte 77,137,194 // mov %r8,%r10
+ .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
+ .byte 196,65,249,126,201 // vmovq %xmm9,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,131,121,32,4,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ .byte 196,67,249,22,202,1 // vpextrq $0x1,%xmm9,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,121,32,20,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ .byte 69,137,209 // mov %r10d,%r9d
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,192 // vmovq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,199 // mov %r8,%r15
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 69,137,198 // mov %r8d,%r14d
- .byte 77,137,196 // mov %r8,%r12
- .byte 73,193,236,32 // shr $0x20,%r12
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,221 // mov %ebx,%r13d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,57,1 // vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,41 // movzbl (%r9,%r13,1),%ebp
- .byte 196,227,121,32,197,4 // vpinsrb $0x4,%ebp,%xmm0,%xmm0
- .byte 65,15,182,44,25 // movzbl (%r9,%rbx,1),%ebp
- .byte 196,227,121,32,197,5 // vpinsrb $0x5,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,49 // movzbl (%r9,%r14,1),%ebp
- .byte 196,227,121,32,197,6 // vpinsrb $0x6,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,33 // movzbl (%r9,%r12,1),%ebp
- .byte 196,227,121,32,197,7 // vpinsrb $0x7,%ebp,%xmm0,%xmm0
- .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,252,43,0,0 // vbroadcastss 0x2bfc(%rip),%ymm9 # 4b38 <_sk_callback_hsw+0x276>
- .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
+ .byte 196,99,125,57,200,1 // vextracti128 $0x1,%ymm9,%xmm0
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,67,41,32,201,2 // vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,3 // vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,4 // vpinsrb $0x4,%r10d,%xmm9,%xmm9
+ .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,49,32,193,5 // vpinsrb $0x5,%r9d,%xmm9,%xmm0
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,121,32,193,6 // vpinsrb $0x6,%r9d,%xmm0,%xmm0
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,121,32,202,7 // vpinsrb $0x7,%r10d,%xmm0,%xmm9
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
- .byte 196,227,249,22,205,1 // vpextrq $0x1,%xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,121,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,201,1 // vextracti128 $0x1,%ymm1,%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,121,32,195,3 // vpinsrb $0x3,%r11d,%xmm0,%xmm0
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,121,32,195,4 // vpinsrb $0x4,%r11d,%xmm0,%xmm0
.byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,5 // vpinsrb $0x5,%r10d,%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,207 // vmovq %xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,12,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- .byte 196,195,113,32,12,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,32 // movzbl (%r8,%r12,1),%ebp
- .byte 196,227,113,32,205,4 // vpinsrb $0x4,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,56 // movzbl (%r8,%r15,1),%ebp
- .byte 196,227,113,32,205,5 // vpinsrb $0x5,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,113,32,205,6 // vpinsrb $0x6,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,113,32,205,7 // vpinsrb $0x7,%ebp,%xmm1,%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,6 // vpinsrb $0x6,%r10d,%xmm0,%xmm0
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,195,121,32,201,7 // vpinsrb $0x7,%r9d,%xmm0,%xmm1
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 196,193,108,89,192 // vmulps %ymm8,%ymm2,%ymm0
+ .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,20,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,105,32,20,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm2
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,105,32,210,2 // vpinsrb $0x2,%r10d,%xmm2,%xmm2
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,105,32,211,3 // vpinsrb $0x3,%r11d,%xmm2,%xmm2
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,105,32,211,4 // vpinsrb $0x4,%r11d,%xmm2,%xmm2
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,105,32,194,5 // vpinsrb $0x5,%r10d,%xmm2,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,6 // vpinsrb $0x6,%r10d,%xmm0,%xmm0
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,195,121,32,209,7 // vpinsrb $0x7,%r9d,%xmm0,%xmm2
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
+ .byte 196,193,100,89,192 // vmulps %ymm8,%ymm3,%ymm0
+ .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,28,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
+ .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,97,32,28,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm3,%xmm3
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
+ .byte 71,15,182,12,10 // movzbl (%r10,%r9,1),%r9d
+ .byte 196,195,97,32,217,2 // vpinsrb $0x2,%r9d,%xmm3,%xmm3
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,97,32,216,3 // vpinsrb $0x3,%eax,%xmm3,%xmm3
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,97,32,216,4 // vpinsrb $0x4,%eax,%xmm3,%xmm3
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 67,15,182,4,10 // movzbl (%r10,%r9,1),%eax
+ .byte 196,227,97,32,192,5 // vpinsrb $0x5,%eax,%xmm3,%xmm0
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,121,32,216,6 // vpinsrb $0x6,%eax,%xmm0,%xmm3
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
+ .byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0
+ .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
+ .byte 196,98,125,24,5,66,42,0,0 // vbroadcastss 0x2a42(%rip),%ymm8 # 4b3c <_sk_callback_hsw+0x280>
+ .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,57,210,1 // vextracti128 $0x1,%ymm2,%xmm2
- .byte 196,195,249,22,211,1 // vpextrq $0x1,%xmm2,%r11
- .byte 69,137,222 // mov %r11d,%r14d
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,215 // vmovq %xmm2,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,20,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm2
- .byte 196,195,105,32,20,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm2,%xmm2
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,105,32,211,2 // vpinsrb $0x2,%ebx,%xmm2,%xmm2
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,105,32,213,3 // vpinsrb $0x3,%ebp,%xmm2,%xmm2
- .byte 67,15,182,44,32 // movzbl (%r8,%r12,1),%ebp
- .byte 196,227,105,32,213,4 // vpinsrb $0x4,%ebp,%xmm2,%xmm2
- .byte 67,15,182,44,56 // movzbl (%r8,%r15,1),%ebp
- .byte 196,227,105,32,213,5 // vpinsrb $0x5,%ebp,%xmm2,%xmm2
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,105,32,213,6 // vpinsrb $0x6,%ebp,%xmm2,%xmm2
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,105,32,213,7 // vpinsrb $0x7,%ebp,%xmm2,%xmm2
+ .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 196,226,125,49,210 // vpmovzxbd %xmm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,193,108,89,209 // vmulps %ymm9,%ymm2,%ymm2
- .byte 72,139,64,24 // mov 0x18(%rax),%rax
- .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
- .byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
- .byte 196,227,249,22,221,1 // vpextrq $0x1,%xmm3,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,219 // vmovq %xmm3,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,57,219,1 // vextracti128 $0x1,%ymm3,%xmm3
- .byte 196,195,249,22,218,1 // vpextrq $0x1,%xmm3,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,222 // vmovq %xmm3,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 196,163,121,32,28,8,0 // vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm3
- .byte 196,227,97,32,28,24,1 // vpinsrb $0x1,(%rax,%rbx,1),%xmm3,%xmm3
- .byte 66,15,182,28,0 // movzbl (%rax,%r8,1),%ebx
- .byte 196,227,97,32,219,2 // vpinsrb $0x2,%ebx,%xmm3,%xmm3
- .byte 15,182,44,40 // movzbl (%rax,%rbp,1),%ebp
- .byte 196,227,97,32,221,3 // vpinsrb $0x3,%ebp,%xmm3,%xmm3
- .byte 66,15,182,44,56 // movzbl (%rax,%r15,1),%ebp
- .byte 196,227,97,32,221,4 // vpinsrb $0x4,%ebp,%xmm3,%xmm3
- .byte 66,15,182,44,48 // movzbl (%rax,%r14,1),%ebp
- .byte 196,227,97,32,221,5 // vpinsrb $0x5,%ebp,%xmm3,%xmm3
- .byte 66,15,182,44,24 // movzbl (%rax,%r11,1),%ebp
- .byte 196,227,97,32,221,6 // vpinsrb $0x6,%ebp,%xmm3,%xmm3
- .byte 66,15,182,4,16 // movzbl (%rax,%r10,1),%eax
+ .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 196,227,97,32,216,7 // vpinsrb $0x7,%eax,%xmm3,%xmm3
.byte 196,226,125,49,219 // vpmovzxbd %xmm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,193,100,89,217 // vmulps %ymm9,%ymm3,%ymm3
+ .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_byte_tables_rgb_hsw
.globl _sk_byte_tables_rgb_hsw
FUNCTION(_sk_byte_tables_rgb_hsw)
_sk_byte_tables_rgb_hsw:
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,139,64,24 // mov 0x18(%rax),%r8d
- .byte 65,255,200 // dec %r8d
- .byte 196,65,121,110,192 // vmovd %r8d,%xmm8
+ .byte 68,139,72,24 // mov 0x18(%rax),%r9d
+ .byte 65,255,201 // dec %r9d
+ .byte 196,65,121,110,193 // vmovd %r9d,%xmm8
.byte 196,66,125,88,192 // vpbroadcastd %xmm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 68,137,197 // mov %r8d,%ebp
- .byte 77,137,194 // mov %r8,%r10
+ .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
+ .byte 196,65,249,126,201 // vmovq %xmm9,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,131,121,32,4,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ .byte 196,67,249,22,202,1 // vpextrq $0x1,%xmm9,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,121,32,20,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ .byte 69,137,209 // mov %r10d,%r9d
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,192 // vmovq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,199 // mov %r8,%r15
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 69,137,198 // mov %r8d,%r14d
- .byte 77,137,196 // mov %r8,%r12
- .byte 73,193,236,32 // shr $0x20,%r12
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,221 // mov %ebx,%r13d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,57,1 // vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,41 // movzbl (%r9,%r13,1),%ebp
- .byte 196,227,121,32,197,4 // vpinsrb $0x4,%ebp,%xmm0,%xmm0
- .byte 65,15,182,44,25 // movzbl (%r9,%rbx,1),%ebp
- .byte 196,227,121,32,197,5 // vpinsrb $0x5,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,49 // movzbl (%r9,%r14,1),%ebp
- .byte 196,227,121,32,197,6 // vpinsrb $0x6,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,33 // movzbl (%r9,%r12,1),%ebp
- .byte 196,227,121,32,197,7 // vpinsrb $0x7,%ebp,%xmm0,%xmm0
- .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,53,41,0,0 // vbroadcastss 0x2935(%rip),%ymm9 # 4b3c <_sk_callback_hsw+0x27a>
- .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
+ .byte 196,99,125,57,200,1 // vextracti128 $0x1,%ymm9,%xmm0
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,67,41,32,201,2 // vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,3 // vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,4 // vpinsrb $0x4,%r10d,%xmm9,%xmm9
+ .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,49,32,193,5 // vpinsrb $0x5,%r9d,%xmm9,%xmm0
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,121,32,193,6 // vpinsrb $0x6,%r9d,%xmm0,%xmm0
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,121,32,202,7 // vpinsrb $0x7,%r10d,%xmm0,%xmm9
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
- .byte 196,227,249,22,205,1 // vpextrq $0x1,%xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,121,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,201,1 // vextracti128 $0x1,%ymm1,%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,121,32,195,3 // vpinsrb $0x3,%r11d,%xmm0,%xmm0
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,195,121,32,195,4 // vpinsrb $0x4,%r11d,%xmm0,%xmm0
.byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,5 // vpinsrb $0x5,%r10d,%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,6 // vpinsrb $0x6,%r10d,%xmm0,%xmm0
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,207 // vmovq %xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,12,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- .byte 196,195,113,32,12,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,32 // movzbl (%r8,%r12,1),%ebp
- .byte 196,227,113,32,205,4 // vpinsrb $0x4,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,56 // movzbl (%r8,%r15,1),%ebp
- .byte 196,227,113,32,205,5 // vpinsrb $0x5,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,113,32,205,6 // vpinsrb $0x6,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,113,32,205,7 // vpinsrb $0x7,%ebp,%xmm1,%xmm1
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,195,121,32,201,7 // vpinsrb $0x7,%r9d,%xmm0,%xmm1
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
+ .byte 197,188,89,194 // vmulps %ymm2,%ymm8,%ymm0
+ .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,20,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
+ .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,105,32,20,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm2,%xmm2
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
+ .byte 71,15,182,12,10 // movzbl (%r10,%r9,1),%r9d
+ .byte 196,195,105,32,209,2 // vpinsrb $0x2,%r9d,%xmm2,%xmm2
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,105,32,208,3 // vpinsrb $0x3,%eax,%xmm2,%xmm2
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,105,32,208,4 // vpinsrb $0x4,%eax,%xmm2,%xmm2
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 67,15,182,4,10 // movzbl (%r10,%r9,1),%eax
+ .byte 196,227,105,32,192,5 // vpinsrb $0x5,%eax,%xmm2,%xmm0
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,227,121,32,208,6 // vpinsrb $0x6,%eax,%xmm0,%xmm2
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
+ .byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0
+ .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
+ .byte 196,98,125,24,5,46,40,0,0 // vbroadcastss 0x282e(%rip),%ymm8 # 4b40 <_sk_callback_hsw+0x284>
+ .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
- .byte 72,139,64,16 // mov 0x10(%rax),%rax
- .byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
- .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,57,210,1 // vextracti128 $0x1,%ymm2,%xmm2
- .byte 196,195,249,22,210,1 // vpextrq $0x1,%xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,214 // vmovq %xmm2,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 196,163,121,32,20,8,0 // vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm2
- .byte 196,227,105,32,20,24,1 // vpinsrb $0x1,(%rax,%rbx,1),%xmm2,%xmm2
- .byte 66,15,182,28,0 // movzbl (%rax,%r8,1),%ebx
- .byte 196,227,105,32,211,2 // vpinsrb $0x2,%ebx,%xmm2,%xmm2
- .byte 15,182,44,40 // movzbl (%rax,%rbp,1),%ebp
- .byte 196,227,105,32,213,3 // vpinsrb $0x3,%ebp,%xmm2,%xmm2
- .byte 66,15,182,44,56 // movzbl (%rax,%r15,1),%ebp
- .byte 196,227,105,32,213,4 // vpinsrb $0x4,%ebp,%xmm2,%xmm2
- .byte 66,15,182,44,48 // movzbl (%rax,%r14,1),%ebp
- .byte 196,227,105,32,213,5 // vpinsrb $0x5,%ebp,%xmm2,%xmm2
- .byte 66,15,182,44,24 // movzbl (%rax,%r11,1),%ebp
- .byte 196,227,105,32,213,6 // vpinsrb $0x6,%ebp,%xmm2,%xmm2
- .byte 66,15,182,4,16 // movzbl (%rax,%r10,1),%eax
+ .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 196,227,105,32,208,7 // vpinsrb $0x7,%eax,%xmm2,%xmm2
.byte 196,226,125,49,210 // vpmovzxbd %xmm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,193,108,89,209 // vmulps %ymm9,%ymm2,%ymm2
+ .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_r_hsw
@@ -11897,7 +11946,7 @@ HIDDEN _sk_table_r_hsw
FUNCTION(_sk_table_r_hsw)
_sk_table_r_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -11906,7 +11955,7 @@ _sk_table_r_hsw:
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,125,91,192 // vcvtps2dq %ymm0,%ymm8
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
- .byte 196,130,53,146,4,128 // vgatherdps %ymm9,(%r8,%ymm8,4),%ymm0
+ .byte 196,130,53,146,4,129 // vgatherdps %ymm9,(%r9,%ymm8,4),%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -11915,7 +11964,7 @@ HIDDEN _sk_table_g_hsw
FUNCTION(_sk_table_g_hsw)
_sk_table_g_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -11924,7 +11973,7 @@ _sk_table_g_hsw:
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,125,91,193 // vcvtps2dq %ymm1,%ymm8
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
- .byte 196,130,53,146,12,128 // vgatherdps %ymm9,(%r8,%ymm8,4),%ymm1
+ .byte 196,130,53,146,12,129 // vgatherdps %ymm9,(%r9,%ymm8,4),%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -11933,7 +11982,7 @@ HIDDEN _sk_table_b_hsw
FUNCTION(_sk_table_b_hsw)
_sk_table_b_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -11942,7 +11991,7 @@ _sk_table_b_hsw:
.byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
.byte 197,125,91,194 // vcvtps2dq %ymm2,%ymm8
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
- .byte 196,130,53,146,20,128 // vgatherdps %ymm9,(%r8,%ymm8,4),%ymm2
+ .byte 196,130,53,146,20,129 // vgatherdps %ymm9,(%r9,%ymm8,4),%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -11951,7 +12000,7 @@ HIDDEN _sk_table_a_hsw
FUNCTION(_sk_table_a_hsw)
_sk_table_a_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -11960,7 +12009,7 @@ _sk_table_a_hsw:
.byte 197,188,89,219 // vmulps %ymm3,%ymm8,%ymm3
.byte 197,125,91,195 // vcvtps2dq %ymm3,%ymm8
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
- .byte 196,130,53,146,28,128 // vgatherdps %ymm9,(%r8,%ymm8,4),%ymm3
+ .byte 196,130,53,146,28,129 // vgatherdps %ymm9,(%r9,%ymm8,4),%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -11979,33 +12028,33 @@ _sk_parametric_r_hsw:
.byte 196,66,125,168,211 // vfmadd213ps %ymm11,%ymm0,%ymm10
.byte 196,226,125,24,0 // vbroadcastss (%rax),%ymm0
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,232,38,0,0 // vbroadcastss 0x26e8(%rip),%ymm12 # 4b40 <_sk_callback_hsw+0x27e>
- .byte 196,98,125,24,45,227,38,0,0 // vbroadcastss 0x26e3(%rip),%ymm13 # 4b44 <_sk_callback_hsw+0x282>
+ .byte 196,98,125,24,37,8,39,0,0 // vbroadcastss 0x2708(%rip),%ymm12 # 4b44 <_sk_callback_hsw+0x288>
+ .byte 196,98,125,24,45,3,39,0,0 // vbroadcastss 0x2703(%rip),%ymm13 # 4b48 <_sk_callback_hsw+0x28c>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,217,38,0,0 // vbroadcastss 0x26d9(%rip),%ymm13 # 4b48 <_sk_callback_hsw+0x286>
+ .byte 196,98,125,24,45,249,38,0,0 // vbroadcastss 0x26f9(%rip),%ymm13 # 4b4c <_sk_callback_hsw+0x290>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,207,38,0,0 // vbroadcastss 0x26cf(%rip),%ymm13 # 4b4c <_sk_callback_hsw+0x28a>
+ .byte 196,98,125,24,45,239,38,0,0 // vbroadcastss 0x26ef(%rip),%ymm13 # 4b50 <_sk_callback_hsw+0x294>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,197,38,0,0 // vbroadcastss 0x26c5(%rip),%ymm11 # 4b50 <_sk_callback_hsw+0x28e>
+ .byte 196,98,125,24,29,229,38,0,0 // vbroadcastss 0x26e5(%rip),%ymm11 # 4b54 <_sk_callback_hsw+0x298>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,187,38,0,0 // vbroadcastss 0x26bb(%rip),%ymm12 # 4b54 <_sk_callback_hsw+0x292>
+ .byte 196,98,125,24,37,219,38,0,0 // vbroadcastss 0x26db(%rip),%ymm12 # 4b58 <_sk_callback_hsw+0x29c>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,177,38,0,0 // vbroadcastss 0x26b1(%rip),%ymm12 # 4b58 <_sk_callback_hsw+0x296>
+ .byte 196,98,125,24,37,209,38,0,0 // vbroadcastss 0x26d1(%rip),%ymm12 # 4b5c <_sk_callback_hsw+0x2a0>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,146,38,0,0 // vbroadcastss 0x2692(%rip),%ymm11 # 4b5c <_sk_callback_hsw+0x29a>
+ .byte 196,98,125,24,29,178,38,0,0 // vbroadcastss 0x26b2(%rip),%ymm11 # 4b60 <_sk_callback_hsw+0x2a4>
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,136,38,0,0 // vbroadcastss 0x2688(%rip),%ymm11 # 4b60 <_sk_callback_hsw+0x29e>
+ .byte 196,98,125,24,29,168,38,0,0 // vbroadcastss 0x26a8(%rip),%ymm11 # 4b64 <_sk_callback_hsw+0x2a8>
.byte 196,98,45,172,216 // vfnmadd213ps %ymm0,%ymm10,%ymm11
- .byte 196,226,125,24,5,126,38,0,0 // vbroadcastss 0x267e(%rip),%ymm0 # 4b64 <_sk_callback_hsw+0x2a2>
+ .byte 196,226,125,24,5,158,38,0,0 // vbroadcastss 0x269e(%rip),%ymm0 # 4b68 <_sk_callback_hsw+0x2ac>
.byte 196,193,124,92,194 // vsubps %ymm10,%ymm0,%ymm0
- .byte 196,98,125,24,21,116,38,0,0 // vbroadcastss 0x2674(%rip),%ymm10 # 4b68 <_sk_callback_hsw+0x2a6>
+ .byte 196,98,125,24,21,148,38,0,0 // vbroadcastss 0x2694(%rip),%ymm10 # 4b6c <_sk_callback_hsw+0x2b0>
.byte 197,172,94,192 // vdivps %ymm0,%ymm10,%ymm0
.byte 197,164,88,192 // vaddps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,21,103,38,0,0 // vbroadcastss 0x2667(%rip),%ymm10 # 4b6c <_sk_callback_hsw+0x2aa>
+ .byte 196,98,125,24,21,135,38,0,0 // vbroadcastss 0x2687(%rip),%ymm10 # 4b70 <_sk_callback_hsw+0x2b4>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -12013,7 +12062,7 @@ _sk_parametric_r_hsw:
.byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,62,38,0,0 // vbroadcastss 0x263e(%rip),%ymm8 # 4b70 <_sk_callback_hsw+0x2ae>
+ .byte 196,98,125,24,5,94,38,0,0 // vbroadcastss 0x265e(%rip),%ymm8 # 4b74 <_sk_callback_hsw+0x2b8>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -12033,33 +12082,33 @@ _sk_parametric_g_hsw:
.byte 196,66,117,168,211 // vfmadd213ps %ymm11,%ymm1,%ymm10
.byte 196,226,125,24,8 // vbroadcastss (%rax),%ymm1
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,246,37,0,0 // vbroadcastss 0x25f6(%rip),%ymm12 # 4b74 <_sk_callback_hsw+0x2b2>
- .byte 196,98,125,24,45,241,37,0,0 // vbroadcastss 0x25f1(%rip),%ymm13 # 4b78 <_sk_callback_hsw+0x2b6>
+ .byte 196,98,125,24,37,22,38,0,0 // vbroadcastss 0x2616(%rip),%ymm12 # 4b78 <_sk_callback_hsw+0x2bc>
+ .byte 196,98,125,24,45,17,38,0,0 // vbroadcastss 0x2611(%rip),%ymm13 # 4b7c <_sk_callback_hsw+0x2c0>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,231,37,0,0 // vbroadcastss 0x25e7(%rip),%ymm13 # 4b7c <_sk_callback_hsw+0x2ba>
+ .byte 196,98,125,24,45,7,38,0,0 // vbroadcastss 0x2607(%rip),%ymm13 # 4b80 <_sk_callback_hsw+0x2c4>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,221,37,0,0 // vbroadcastss 0x25dd(%rip),%ymm13 # 4b80 <_sk_callback_hsw+0x2be>
+ .byte 196,98,125,24,45,253,37,0,0 // vbroadcastss 0x25fd(%rip),%ymm13 # 4b84 <_sk_callback_hsw+0x2c8>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,211,37,0,0 // vbroadcastss 0x25d3(%rip),%ymm11 # 4b84 <_sk_callback_hsw+0x2c2>
+ .byte 196,98,125,24,29,243,37,0,0 // vbroadcastss 0x25f3(%rip),%ymm11 # 4b88 <_sk_callback_hsw+0x2cc>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,201,37,0,0 // vbroadcastss 0x25c9(%rip),%ymm12 # 4b88 <_sk_callback_hsw+0x2c6>
+ .byte 196,98,125,24,37,233,37,0,0 // vbroadcastss 0x25e9(%rip),%ymm12 # 4b8c <_sk_callback_hsw+0x2d0>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,191,37,0,0 // vbroadcastss 0x25bf(%rip),%ymm12 # 4b8c <_sk_callback_hsw+0x2ca>
+ .byte 196,98,125,24,37,223,37,0,0 // vbroadcastss 0x25df(%rip),%ymm12 # 4b90 <_sk_callback_hsw+0x2d4>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10
.byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10
- .byte 196,98,125,24,29,160,37,0,0 // vbroadcastss 0x25a0(%rip),%ymm11 # 4b90 <_sk_callback_hsw+0x2ce>
+ .byte 196,98,125,24,29,192,37,0,0 // vbroadcastss 0x25c0(%rip),%ymm11 # 4b94 <_sk_callback_hsw+0x2d8>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,150,37,0,0 // vbroadcastss 0x2596(%rip),%ymm11 # 4b94 <_sk_callback_hsw+0x2d2>
+ .byte 196,98,125,24,29,182,37,0,0 // vbroadcastss 0x25b6(%rip),%ymm11 # 4b98 <_sk_callback_hsw+0x2dc>
.byte 196,98,45,172,217 // vfnmadd213ps %ymm1,%ymm10,%ymm11
- .byte 196,226,125,24,13,140,37,0,0 // vbroadcastss 0x258c(%rip),%ymm1 # 4b98 <_sk_callback_hsw+0x2d6>
+ .byte 196,226,125,24,13,172,37,0,0 // vbroadcastss 0x25ac(%rip),%ymm1 # 4b9c <_sk_callback_hsw+0x2e0>
.byte 196,193,116,92,202 // vsubps %ymm10,%ymm1,%ymm1
- .byte 196,98,125,24,21,130,37,0,0 // vbroadcastss 0x2582(%rip),%ymm10 # 4b9c <_sk_callback_hsw+0x2da>
+ .byte 196,98,125,24,21,162,37,0,0 // vbroadcastss 0x25a2(%rip),%ymm10 # 4ba0 <_sk_callback_hsw+0x2e4>
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 197,164,88,201 // vaddps %ymm1,%ymm11,%ymm1
- .byte 196,98,125,24,21,117,37,0,0 // vbroadcastss 0x2575(%rip),%ymm10 # 4ba0 <_sk_callback_hsw+0x2de>
+ .byte 196,98,125,24,21,149,37,0,0 // vbroadcastss 0x2595(%rip),%ymm10 # 4ba4 <_sk_callback_hsw+0x2e8>
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -12067,7 +12116,7 @@ _sk_parametric_g_hsw:
.byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,5,76,37,0,0 // vbroadcastss 0x254c(%rip),%ymm8 # 4ba4 <_sk_callback_hsw+0x2e2>
+ .byte 196,98,125,24,5,108,37,0,0 // vbroadcastss 0x256c(%rip),%ymm8 # 4ba8 <_sk_callback_hsw+0x2ec>
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -12087,33 +12136,33 @@ _sk_parametric_b_hsw:
.byte 196,66,109,168,211 // vfmadd213ps %ymm11,%ymm2,%ymm10
.byte 196,226,125,24,16 // vbroadcastss (%rax),%ymm2
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,4,37,0,0 // vbroadcastss 0x2504(%rip),%ymm12 # 4ba8 <_sk_callback_hsw+0x2e6>
- .byte 196,98,125,24,45,255,36,0,0 // vbroadcastss 0x24ff(%rip),%ymm13 # 4bac <_sk_callback_hsw+0x2ea>
+ .byte 196,98,125,24,37,36,37,0,0 // vbroadcastss 0x2524(%rip),%ymm12 # 4bac <_sk_callback_hsw+0x2f0>
+ .byte 196,98,125,24,45,31,37,0,0 // vbroadcastss 0x251f(%rip),%ymm13 # 4bb0 <_sk_callback_hsw+0x2f4>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,245,36,0,0 // vbroadcastss 0x24f5(%rip),%ymm13 # 4bb0 <_sk_callback_hsw+0x2ee>
+ .byte 196,98,125,24,45,21,37,0,0 // vbroadcastss 0x2515(%rip),%ymm13 # 4bb4 <_sk_callback_hsw+0x2f8>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,235,36,0,0 // vbroadcastss 0x24eb(%rip),%ymm13 # 4bb4 <_sk_callback_hsw+0x2f2>
+ .byte 196,98,125,24,45,11,37,0,0 // vbroadcastss 0x250b(%rip),%ymm13 # 4bb8 <_sk_callback_hsw+0x2fc>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,225,36,0,0 // vbroadcastss 0x24e1(%rip),%ymm11 # 4bb8 <_sk_callback_hsw+0x2f6>
+ .byte 196,98,125,24,29,1,37,0,0 // vbroadcastss 0x2501(%rip),%ymm11 # 4bbc <_sk_callback_hsw+0x300>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,215,36,0,0 // vbroadcastss 0x24d7(%rip),%ymm12 # 4bbc <_sk_callback_hsw+0x2fa>
+ .byte 196,98,125,24,37,247,36,0,0 // vbroadcastss 0x24f7(%rip),%ymm12 # 4bc0 <_sk_callback_hsw+0x304>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,205,36,0,0 // vbroadcastss 0x24cd(%rip),%ymm12 # 4bc0 <_sk_callback_hsw+0x2fe>
+ .byte 196,98,125,24,37,237,36,0,0 // vbroadcastss 0x24ed(%rip),%ymm12 # 4bc4 <_sk_callback_hsw+0x308>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10
.byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10
- .byte 196,98,125,24,29,174,36,0,0 // vbroadcastss 0x24ae(%rip),%ymm11 # 4bc4 <_sk_callback_hsw+0x302>
+ .byte 196,98,125,24,29,206,36,0,0 // vbroadcastss 0x24ce(%rip),%ymm11 # 4bc8 <_sk_callback_hsw+0x30c>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,164,36,0,0 // vbroadcastss 0x24a4(%rip),%ymm11 # 4bc8 <_sk_callback_hsw+0x306>
+ .byte 196,98,125,24,29,196,36,0,0 // vbroadcastss 0x24c4(%rip),%ymm11 # 4bcc <_sk_callback_hsw+0x310>
.byte 196,98,45,172,218 // vfnmadd213ps %ymm2,%ymm10,%ymm11
- .byte 196,226,125,24,21,154,36,0,0 // vbroadcastss 0x249a(%rip),%ymm2 # 4bcc <_sk_callback_hsw+0x30a>
+ .byte 196,226,125,24,21,186,36,0,0 // vbroadcastss 0x24ba(%rip),%ymm2 # 4bd0 <_sk_callback_hsw+0x314>
.byte 196,193,108,92,210 // vsubps %ymm10,%ymm2,%ymm2
- .byte 196,98,125,24,21,144,36,0,0 // vbroadcastss 0x2490(%rip),%ymm10 # 4bd0 <_sk_callback_hsw+0x30e>
+ .byte 196,98,125,24,21,176,36,0,0 // vbroadcastss 0x24b0(%rip),%ymm10 # 4bd4 <_sk_callback_hsw+0x318>
.byte 197,172,94,210 // vdivps %ymm2,%ymm10,%ymm2
.byte 197,164,88,210 // vaddps %ymm2,%ymm11,%ymm2
- .byte 196,98,125,24,21,131,36,0,0 // vbroadcastss 0x2483(%rip),%ymm10 # 4bd4 <_sk_callback_hsw+0x312>
+ .byte 196,98,125,24,21,163,36,0,0 // vbroadcastss 0x24a3(%rip),%ymm10 # 4bd8 <_sk_callback_hsw+0x31c>
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -12121,7 +12170,7 @@ _sk_parametric_b_hsw:
.byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,90,36,0,0 // vbroadcastss 0x245a(%rip),%ymm8 # 4bd8 <_sk_callback_hsw+0x316>
+ .byte 196,98,125,24,5,122,36,0,0 // vbroadcastss 0x247a(%rip),%ymm8 # 4bdc <_sk_callback_hsw+0x320>
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -12141,33 +12190,33 @@ _sk_parametric_a_hsw:
.byte 196,66,101,168,211 // vfmadd213ps %ymm11,%ymm3,%ymm10
.byte 196,226,125,24,24 // vbroadcastss (%rax),%ymm3
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,18,36,0,0 // vbroadcastss 0x2412(%rip),%ymm12 # 4bdc <_sk_callback_hsw+0x31a>
- .byte 196,98,125,24,45,13,36,0,0 // vbroadcastss 0x240d(%rip),%ymm13 # 4be0 <_sk_callback_hsw+0x31e>
+ .byte 196,98,125,24,37,50,36,0,0 // vbroadcastss 0x2432(%rip),%ymm12 # 4be0 <_sk_callback_hsw+0x324>
+ .byte 196,98,125,24,45,45,36,0,0 // vbroadcastss 0x242d(%rip),%ymm13 # 4be4 <_sk_callback_hsw+0x328>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,3,36,0,0 // vbroadcastss 0x2403(%rip),%ymm13 # 4be4 <_sk_callback_hsw+0x322>
+ .byte 196,98,125,24,45,35,36,0,0 // vbroadcastss 0x2423(%rip),%ymm13 # 4be8 <_sk_callback_hsw+0x32c>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,249,35,0,0 // vbroadcastss 0x23f9(%rip),%ymm13 # 4be8 <_sk_callback_hsw+0x326>
+ .byte 196,98,125,24,45,25,36,0,0 // vbroadcastss 0x2419(%rip),%ymm13 # 4bec <_sk_callback_hsw+0x330>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,239,35,0,0 // vbroadcastss 0x23ef(%rip),%ymm11 # 4bec <_sk_callback_hsw+0x32a>
+ .byte 196,98,125,24,29,15,36,0,0 // vbroadcastss 0x240f(%rip),%ymm11 # 4bf0 <_sk_callback_hsw+0x334>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,229,35,0,0 // vbroadcastss 0x23e5(%rip),%ymm12 # 4bf0 <_sk_callback_hsw+0x32e>
+ .byte 196,98,125,24,37,5,36,0,0 // vbroadcastss 0x2405(%rip),%ymm12 # 4bf4 <_sk_callback_hsw+0x338>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,219,35,0,0 // vbroadcastss 0x23db(%rip),%ymm12 # 4bf4 <_sk_callback_hsw+0x332>
+ .byte 196,98,125,24,37,251,35,0,0 // vbroadcastss 0x23fb(%rip),%ymm12 # 4bf8 <_sk_callback_hsw+0x33c>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10
.byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10
- .byte 196,98,125,24,29,188,35,0,0 // vbroadcastss 0x23bc(%rip),%ymm11 # 4bf8 <_sk_callback_hsw+0x336>
+ .byte 196,98,125,24,29,220,35,0,0 // vbroadcastss 0x23dc(%rip),%ymm11 # 4bfc <_sk_callback_hsw+0x340>
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,178,35,0,0 // vbroadcastss 0x23b2(%rip),%ymm11 # 4bfc <_sk_callback_hsw+0x33a>
+ .byte 196,98,125,24,29,210,35,0,0 // vbroadcastss 0x23d2(%rip),%ymm11 # 4c00 <_sk_callback_hsw+0x344>
.byte 196,98,45,172,219 // vfnmadd213ps %ymm3,%ymm10,%ymm11
- .byte 196,226,125,24,29,168,35,0,0 // vbroadcastss 0x23a8(%rip),%ymm3 # 4c00 <_sk_callback_hsw+0x33e>
+ .byte 196,226,125,24,29,200,35,0,0 // vbroadcastss 0x23c8(%rip),%ymm3 # 4c04 <_sk_callback_hsw+0x348>
.byte 196,193,100,92,218 // vsubps %ymm10,%ymm3,%ymm3
- .byte 196,98,125,24,21,158,35,0,0 // vbroadcastss 0x239e(%rip),%ymm10 # 4c04 <_sk_callback_hsw+0x342>
+ .byte 196,98,125,24,21,190,35,0,0 // vbroadcastss 0x23be(%rip),%ymm10 # 4c08 <_sk_callback_hsw+0x34c>
.byte 197,172,94,219 // vdivps %ymm3,%ymm10,%ymm3
.byte 197,164,88,219 // vaddps %ymm3,%ymm11,%ymm3
- .byte 196,98,125,24,21,145,35,0,0 // vbroadcastss 0x2391(%rip),%ymm10 # 4c08 <_sk_callback_hsw+0x346>
+ .byte 196,98,125,24,21,177,35,0,0 // vbroadcastss 0x23b1(%rip),%ymm10 # 4c0c <_sk_callback_hsw+0x350>
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -12175,7 +12224,7 @@ _sk_parametric_a_hsw:
.byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3
- .byte 196,98,125,24,5,104,35,0,0 // vbroadcastss 0x2368(%rip),%ymm8 # 4c0c <_sk_callback_hsw+0x34a>
+ .byte 196,98,125,24,5,136,35,0,0 // vbroadcastss 0x2388(%rip),%ymm8 # 4c10 <_sk_callback_hsw+0x354>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -12184,26 +12233,26 @@ HIDDEN _sk_lab_to_xyz_hsw
.globl _sk_lab_to_xyz_hsw
FUNCTION(_sk_lab_to_xyz_hsw)
_sk_lab_to_xyz_hsw:
- .byte 196,98,125,24,5,90,35,0,0 // vbroadcastss 0x235a(%rip),%ymm8 # 4c10 <_sk_callback_hsw+0x34e>
- .byte 196,98,125,24,13,85,35,0,0 // vbroadcastss 0x2355(%rip),%ymm9 # 4c14 <_sk_callback_hsw+0x352>
- .byte 196,98,125,24,21,80,35,0,0 // vbroadcastss 0x2350(%rip),%ymm10 # 4c18 <_sk_callback_hsw+0x356>
+ .byte 196,98,125,24,5,122,35,0,0 // vbroadcastss 0x237a(%rip),%ymm8 # 4c14 <_sk_callback_hsw+0x358>
+ .byte 196,98,125,24,13,117,35,0,0 // vbroadcastss 0x2375(%rip),%ymm9 # 4c18 <_sk_callback_hsw+0x35c>
+ .byte 196,98,125,24,21,112,35,0,0 // vbroadcastss 0x2370(%rip),%ymm10 # 4c1c <_sk_callback_hsw+0x360>
.byte 196,194,53,168,202 // vfmadd213ps %ymm10,%ymm9,%ymm1
.byte 196,194,53,168,210 // vfmadd213ps %ymm10,%ymm9,%ymm2
- .byte 196,98,125,24,13,65,35,0,0 // vbroadcastss 0x2341(%rip),%ymm9 # 4c1c <_sk_callback_hsw+0x35a>
+ .byte 196,98,125,24,13,97,35,0,0 // vbroadcastss 0x2361(%rip),%ymm9 # 4c20 <_sk_callback_hsw+0x364>
.byte 196,66,125,184,200 // vfmadd231ps %ymm8,%ymm0,%ymm9
- .byte 196,226,125,24,5,55,35,0,0 // vbroadcastss 0x2337(%rip),%ymm0 # 4c20 <_sk_callback_hsw+0x35e>
+ .byte 196,226,125,24,5,87,35,0,0 // vbroadcastss 0x2357(%rip),%ymm0 # 4c24 <_sk_callback_hsw+0x368>
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
- .byte 196,98,125,24,5,46,35,0,0 // vbroadcastss 0x232e(%rip),%ymm8 # 4c24 <_sk_callback_hsw+0x362>
+ .byte 196,98,125,24,5,78,35,0,0 // vbroadcastss 0x234e(%rip),%ymm8 # 4c28 <_sk_callback_hsw+0x36c>
.byte 196,98,117,168,192 // vfmadd213ps %ymm0,%ymm1,%ymm8
- .byte 196,98,125,24,13,36,35,0,0 // vbroadcastss 0x2324(%rip),%ymm9 # 4c28 <_sk_callback_hsw+0x366>
+ .byte 196,98,125,24,13,68,35,0,0 // vbroadcastss 0x2344(%rip),%ymm9 # 4c2c <_sk_callback_hsw+0x370>
.byte 196,98,109,172,200 // vfnmadd213ps %ymm0,%ymm2,%ymm9
.byte 196,193,60,89,200 // vmulps %ymm8,%ymm8,%ymm1
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
- .byte 196,226,125,24,21,17,35,0,0 // vbroadcastss 0x2311(%rip),%ymm2 # 4c2c <_sk_callback_hsw+0x36a>
+ .byte 196,226,125,24,21,49,35,0,0 // vbroadcastss 0x2331(%rip),%ymm2 # 4c30 <_sk_callback_hsw+0x374>
.byte 197,108,194,209,1 // vcmpltps %ymm1,%ymm2,%ymm10
- .byte 196,98,125,24,29,7,35,0,0 // vbroadcastss 0x2307(%rip),%ymm11 # 4c30 <_sk_callback_hsw+0x36e>
+ .byte 196,98,125,24,29,39,35,0,0 // vbroadcastss 0x2327(%rip),%ymm11 # 4c34 <_sk_callback_hsw+0x378>
.byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8
- .byte 196,98,125,24,37,253,34,0,0 // vbroadcastss 0x22fd(%rip),%ymm12 # 4c34 <_sk_callback_hsw+0x372>
+ .byte 196,98,125,24,37,29,35,0,0 // vbroadcastss 0x231d(%rip),%ymm12 # 4c38 <_sk_callback_hsw+0x37c>
.byte 196,65,60,89,196 // vmulps %ymm12,%ymm8,%ymm8
.byte 196,99,61,74,193,160 // vblendvps %ymm10,%ymm1,%ymm8,%ymm8
.byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1
@@ -12218,9 +12267,9 @@ _sk_lab_to_xyz_hsw:
.byte 196,65,52,88,203 // vaddps %ymm11,%ymm9,%ymm9
.byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9
.byte 196,227,53,74,208,32 // vblendvps %ymm2,%ymm0,%ymm9,%ymm2
- .byte 196,226,125,24,5,178,34,0,0 // vbroadcastss 0x22b2(%rip),%ymm0 # 4c38 <_sk_callback_hsw+0x376>
+ .byte 196,226,125,24,5,210,34,0,0 // vbroadcastss 0x22d2(%rip),%ymm0 # 4c3c <_sk_callback_hsw+0x380>
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,169,34,0,0 // vbroadcastss 0x22a9(%rip),%ymm8 # 4c3c <_sk_callback_hsw+0x37a>
+ .byte 196,98,125,24,5,201,34,0,0 // vbroadcastss 0x22c9(%rip),%ymm8 # 4c40 <_sk_callback_hsw+0x384>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -12229,35 +12278,37 @@ HIDDEN _sk_load_a8_hsw
.globl _sk_load_a8_hsw
FUNCTION(_sk_load_a8_hsw)
_sk_load_a8_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,45 // jne 29d9 <_sk_load_a8_hsw+0x3d>
+ .byte 117,45 // jne 29bd <_sk_load_a8_hsw+0x3d>
.byte 197,250,126,0 // vmovq (%rax),%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,126,34,0,0 // vbroadcastss 0x227e(%rip),%ymm1 # 4c40 <_sk_callback_hsw+0x37e>
+ .byte 196,226,125,24,13,158,34,0,0 // vbroadcastss 0x229e(%rip),%ymm1 # 4c44 <_sk_callback_hsw+0x388>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 29e1 <_sk_load_a8_hsw+0x45>
- .byte 196,193,249,110,193 // vmovq %r9,%xmm0
- .byte 235,178 // jmp 29b0 <_sk_load_a8_hsw+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 29c6 <_sk_load_a8_hsw+0x46>
+ .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 91 // pop %rbx
+ .byte 235,177 // jmp 2994 <_sk_load_a8_hsw+0x14>
HIDDEN _sk_gather_a8_hsw
.globl _sk_gather_a8_hsw
@@ -12265,45 +12316,46 @@ FUNCTION(_sk_gather_a8_hsw)
_sk_gather_a8_hsw:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
.byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,199 // vmovq %xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,4,24,0 // vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,16,1 // vpinsrb $0x1,(%r8,%r10,1),%xmm0,%xmm0
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 196,195,121,32,193,2 // vpinsrb $0x2,%r9d,%xmm0,%xmm0
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 196,193,249,126,196 // vmovq %xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,32 // movzbl (%r8,%r12,1),%eax
+ .byte 67,15,182,4,41 // movzbl (%r9,%r13,1),%eax
.byte 196,227,121,32,192,4 // vpinsrb $0x4,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,56 // movzbl (%r8,%r15,1),%eax
+ .byte 67,15,182,4,33 // movzbl (%r9,%r12,1),%eax
.byte 196,227,121,32,192,5 // vpinsrb $0x5,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,48 // movzbl (%r8,%r14,1),%eax
+ .byte 67,15,182,4,57 // movzbl (%r9,%r15,1),%eax
.byte 196,227,121,32,192,6 // vpinsrb $0x6,%eax,%xmm0,%xmm0
- .byte 65,15,182,4,24 // movzbl (%r8,%rbx,1),%eax
+ .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax
.byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,137,33,0,0 // vbroadcastss 0x2189(%rip),%ymm1 # 4c44 <_sk_callback_hsw+0x382>
+ .byte 196,226,125,24,13,166,33,0,0 // vbroadcastss 0x21a6(%rip),%ymm1 # 4c48 <_sk_callback_hsw+0x38c>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -12311,6 +12363,7 @@ _sk_gather_a8_hsw:
.byte 197,237,239,210 // vpxor %ymm2,%ymm2,%ymm2
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -12320,57 +12373,56 @@ HIDDEN _sk_store_a8_hsw
FUNCTION(_sk_store_a8_hsw)
_sk_store_a8_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,100,33,0,0 // vbroadcastss 0x2164(%rip),%ymm8 # 4c48 <_sk_callback_hsw+0x386>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,127,33,0,0 // vbroadcastss 0x217f(%rip),%ymm8 # 4c4c <_sk_callback_hsw+0x390>
.byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8
.byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 196,65,57,103,192 // vpackuswb %xmm8,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 2b0d <_sk_store_a8_hsw+0x37>
- .byte 196,65,123,17,4,58 // vmovsd %xmm8,(%r10,%rdi,1)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 2af6 <_sk_store_a8_hsw+0x37>
+ .byte 196,65,123,17,4,19 // vmovsd %xmm8,(%r11,%rdx,1)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 2b09 <_sk_store_a8_hsw+0x33>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 2af2 <_sk_store_a8_hsw+0x33>
.byte 196,66,121,48,192 // vpmovzxbw %xmm8,%xmm8
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,67,0,0,0 // lea 0x43(%rip),%r9 # 2b70 <_sk_store_a8_hsw+0x9a>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,20,68,58,6,12 // vpextrb $0xc,%xmm8,0x6(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,5,10 // vpextrb $0xa,%xmm8,0x5(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,4,8 // vpextrb $0x8,%xmm8,0x4(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,3,6 // vpextrb $0x6,%xmm8,0x3(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,2,4 // vpextrb $0x4,%xmm8,0x2(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,1,2 // vpextrb $0x2,%xmm8,0x1(%r10,%rdi,1)
- .byte 196,67,121,20,4,58,0 // vpextrb $0x0,%xmm8,(%r10,%rdi,1)
- .byte 235,154 // jmp 2b09 <_sk_store_a8_hsw+0x33>
- .byte 144 // nop
- .byte 246,255 // idiv %bh
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 2b58 <_sk_store_a8_hsw+0x99>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,20,68,19,6,12 // vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,5,10 // vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,4,8 // vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,3,6 // vpextrb $0x6,%xmm8,0x3(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,1,2 // vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1)
+ .byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1)
+ .byte 235,154 // jmp 2af2 <_sk_store_a8_hsw+0x33>
+ .byte 247,255 // idiv %edi
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 238 // out %al,(%dx)
+ .byte 239 // out %eax,(%dx)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,230 // jmpq *%rsi
+ .byte 255,231 // jmpq *%rdi
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 222,255 // fdivrp %st,%st(7)
+ .byte 223,255 // (bad)
.byte 255 // (bad)
- .byte 255,214 // callq *%rsi
+ .byte 255,215 // callq *%rdi
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,206 // dec %esi
+ .byte 255,207 // dec %edi
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,198 // inc %esi
+ .byte 255,199 // inc %edi
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -12379,35 +12431,37 @@ HIDDEN _sk_load_g8_hsw
.globl _sk_load_g8_hsw
FUNCTION(_sk_load_g8_hsw)
_sk_load_g8_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,50 // jne 2bce <_sk_load_g8_hsw+0x42>
+ .byte 117,50 // jne 2bb6 <_sk_load_g8_hsw+0x42>
.byte 197,250,126,0 // vmovq (%rax),%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,154,32,0,0 // vbroadcastss 0x209a(%rip),%ymm1 # 4c4c <_sk_callback_hsw+0x38a>
+ .byte 196,226,125,24,13,182,32,0,0 // vbroadcastss 0x20b6(%rip),%ymm1 # 4c50 <_sk_callback_hsw+0x394>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,143,32,0,0 // vbroadcastss 0x208f(%rip),%ymm3 # 4c50 <_sk_callback_hsw+0x38e>
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 196,226,125,24,29,171,32,0,0 // vbroadcastss 0x20ab(%rip),%ymm3 # 4c54 <_sk_callback_hsw+0x398>
+ .byte 76,137,201 // mov %r9,%rcx
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 2bd6 <_sk_load_g8_hsw+0x4a>
- .byte 196,193,249,110,193 // vmovq %r9,%xmm0
- .byte 235,173 // jmp 2ba0 <_sk_load_g8_hsw+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 2bbf <_sk_load_g8_hsw+0x4b>
+ .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 91 // pop %rbx
+ .byte 235,172 // jmp 2b88 <_sk_load_g8_hsw+0x14>
HIDDEN _sk_gather_g8_hsw
.globl _sk_gather_g8_hsw
@@ -12415,52 +12469,54 @@ FUNCTION(_sk_gather_g8_hsw)
_sk_gather_g8_hsw:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
.byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,199 // vmovq %xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,4,24,0 // vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,16,1 // vpinsrb $0x1,(%r8,%r10,1),%xmm0,%xmm0
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 196,195,121,32,193,2 // vpinsrb $0x2,%r9d,%xmm0,%xmm0
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 196,193,249,126,196 // vmovq %xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,32 // movzbl (%r8,%r12,1),%eax
+ .byte 67,15,182,4,41 // movzbl (%r9,%r13,1),%eax
.byte 196,227,121,32,192,4 // vpinsrb $0x4,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,56 // movzbl (%r8,%r15,1),%eax
+ .byte 67,15,182,4,33 // movzbl (%r9,%r12,1),%eax
.byte 196,227,121,32,192,5 // vpinsrb $0x5,%eax,%xmm0,%xmm0
- .byte 67,15,182,4,48 // movzbl (%r8,%r14,1),%eax
+ .byte 67,15,182,4,57 // movzbl (%r9,%r15,1),%eax
.byte 196,227,121,32,192,6 // vpinsrb $0x6,%eax,%xmm0,%xmm0
- .byte 65,15,182,4,24 // movzbl (%r8,%rbx,1),%eax
+ .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax
.byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,164,31,0,0 // vbroadcastss 0x1fa4(%rip),%ymm1 # 4c54 <_sk_callback_hsw+0x392>
+ .byte 196,226,125,24,13,189,31,0,0 // vbroadcastss 0x1fbd(%rip),%ymm1 # 4c58 <_sk_callback_hsw+0x39c>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,153,31,0,0 // vbroadcastss 0x1f99(%rip),%ymm3 # 4c58 <_sk_callback_hsw+0x396>
+ .byte 196,226,125,24,29,178,31,0,0 // vbroadcastss 0x1fb2(%rip),%ymm3 # 4c5c <_sk_callback_hsw+0x3a0>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -12470,56 +12526,57 @@ HIDDEN _sk_gather_i8_hsw
FUNCTION(_sk_gather_i8_hsw)
_sk_gather_i8_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,192 // mov %rax,%r8
- .byte 77,133,192 // test %r8,%r8
- .byte 116,5 // je 2cdf <_sk_gather_i8_hsw+0xf>
- .byte 76,137,192 // mov %r8,%rax
- .byte 235,2 // jmp 2ce1 <_sk_gather_i8_hsw+0x11>
+ .byte 73,137,193 // mov %rax,%r9
+ .byte 77,133,201 // test %r9,%r9
+ .byte 116,5 // je 2ccc <_sk_gather_i8_hsw+0xf>
+ .byte 76,137,200 // mov %r9,%rax
+ .byte 235,2 // jmp 2cce <_sk_gather_i8_hsw+0x11>
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,139,16 // mov (%rax),%r10
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,195 // vmovq %xmm0,%r11
- .byte 69,137,222 // mov %r11d,%r14d
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
- .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
+ .byte 65,137,222 // mov %ebx,%r14d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,196 // vmovq %xmm0,%r12
- .byte 69,137,229 // mov %r12d,%r13d
- .byte 73,193,236,32 // shr $0x20,%r12
- .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,17,2 // vpinsrb $0x2,(%r9,%r10,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,1,3 // vpinsrb $0x3,(%r9,%rax,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,41,4 // vpinsrb $0x4,(%r9,%r13,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,33,5 // vpinsrb $0x5,(%r9,%r12,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,57,6 // vpinsrb $0x6,(%r9,%r15,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,25,7 // vpinsrb $0x7,(%r9,%rbx,1),%xmm0,%xmm0
+ .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
+ .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
+ .byte 69,137,252 // mov %r15d,%r12d
+ .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 196,193,249,126,197 // vmovq %xmm0,%r13
+ .byte 68,137,237 // mov %r13d,%ebp
+ .byte 73,193,237,32 // shr $0x20,%r13
+ .byte 196,131,121,32,4,50,0 // vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,26,1 // vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,42,4 // vpinsrb $0x4,(%r10,%rbp,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,42,5 // vpinsrb $0x5,(%r10,%r13,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,34,6 // vpinsrb $0x6,(%r10,%r12,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,58,7 // vpinsrb $0x7,(%r10,%r15,1),%xmm0,%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
- .byte 73,139,64,8 // mov 0x8(%r8),%rax
+ .byte 73,139,65,8 // mov 0x8(%r9),%rax
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 196,226,117,144,28,128 // vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3
- .byte 197,229,219,5,49,33,0,0 // vpand 0x2131(%rip),%ymm3,%ymm0 # 4ec0 <_sk_callback_hsw+0x5fe>
+ .byte 197,229,219,5,67,33,0,0 // vpand 0x2143(%rip),%ymm3,%ymm0 # 4ec0 <_sk_callback_hsw+0x604>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,192,30,0,0 // vbroadcastss 0x1ec0(%rip),%ymm8 # 4c5c <_sk_callback_hsw+0x39a>
+ .byte 196,98,125,24,5,214,30,0,0 // vbroadcastss 0x1ed6(%rip),%ymm8 # 4c60 <_sk_callback_hsw+0x3a4>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,54,33,0,0 // vpshufb 0x2136(%rip),%ymm3,%ymm1 # 4ee0 <_sk_callback_hsw+0x61e>
+ .byte 196,226,101,0,13,72,33,0,0 // vpshufb 0x2148(%rip),%ymm3,%ymm1 # 4ee0 <_sk_callback_hsw+0x624>
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,68,33,0,0 // vpshufb 0x2144(%rip),%ymm3,%ymm2 # 4f00 <_sk_callback_hsw+0x63e>
+ .byte 196,226,101,0,21,86,33,0,0 // vpshufb 0x2156(%rip),%ymm3,%ymm2 # 4f00 <_sk_callback_hsw+0x644>
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -12531,6 +12588,7 @@ _sk_gather_i8_hsw:
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_load_565_hsw
@@ -12538,69 +12596,69 @@ HIDDEN _sk_load_565_hsw
FUNCTION(_sk_load_565_hsw)
_sk_load_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,114 // jne 2e5c <_sk_load_565_hsw+0x7c>
- .byte 196,193,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm0
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,114 // jne 2e4b <_sk_load_565_hsw+0x7c>
+ .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2
- .byte 196,226,125,88,5,98,30,0,0 // vpbroadcastd 0x1e62(%rip),%ymm0 # 4c60 <_sk_callback_hsw+0x39e>
+ .byte 196,226,125,88,5,119,30,0,0 // vpbroadcastd 0x1e77(%rip),%ymm0 # 4c64 <_sk_callback_hsw+0x3a8>
.byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,85,30,0,0 // vbroadcastss 0x1e55(%rip),%ymm1 # 4c64 <_sk_callback_hsw+0x3a2>
+ .byte 196,226,125,24,13,106,30,0,0 // vbroadcastss 0x1e6a(%rip),%ymm1 # 4c68 <_sk_callback_hsw+0x3ac>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,76,30,0,0 // vpbroadcastd 0x1e4c(%rip),%ymm1 # 4c68 <_sk_callback_hsw+0x3a6>
+ .byte 196,226,125,88,13,97,30,0,0 // vpbroadcastd 0x1e61(%rip),%ymm1 # 4c6c <_sk_callback_hsw+0x3b0>
.byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,63,30,0,0 // vbroadcastss 0x1e3f(%rip),%ymm3 # 4c6c <_sk_callback_hsw+0x3aa>
+ .byte 196,226,125,24,29,84,30,0,0 // vbroadcastss 0x1e54(%rip),%ymm3 # 4c70 <_sk_callback_hsw+0x3b4>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,88,29,54,30,0,0 // vpbroadcastd 0x1e36(%rip),%ymm3 # 4c70 <_sk_callback_hsw+0x3ae>
+ .byte 196,226,125,88,29,75,30,0,0 // vpbroadcastd 0x1e4b(%rip),%ymm3 # 4c74 <_sk_callback_hsw+0x3b8>
.byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,41,30,0,0 // vbroadcastss 0x1e29(%rip),%ymm3 # 4c74 <_sk_callback_hsw+0x3b2>
+ .byte 196,226,125,24,29,62,30,0,0 // vbroadcastss 0x1e3e(%rip),%ymm3 # 4c78 <_sk_callback_hsw+0x3bc>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,30,30,0,0 // vbroadcastss 0x1e1e(%rip),%ymm3 # 4c78 <_sk_callback_hsw+0x3b6>
+ .byte 196,226,125,24,29,51,30,0,0 // vbroadcastss 0x1e33(%rip),%ymm3 # 4c7c <_sk_callback_hsw+0x3c0>
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,128 // ja 2df0 <_sk_load_565_hsw+0x10>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,73,0,0,0 // lea 0x49(%rip),%r9 # 2ec4 <_sk_load_565_hsw+0xe4>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,128 // ja 2ddf <_sk_load_565_hsw+0x10>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 2eb4 <_sk_load_565_hsw+0xe5>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 196,193,121,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- .byte 233,44,255,255,255 // jmpq 2df0 <_sk_load_565_hsw+0x10>
- .byte 244 // hlt
+ .byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 233,44,255,255,255 // jmpq 2ddf <_sk_load_565_hsw+0x10>
+ .byte 144 // nop
+ .byte 243,255 // repz (bad)
.byte 255 // (bad)
.byte 255 // (bad)
+ .byte 235,255 // jmp 2eb9 <_sk_load_565_hsw+0xea>
.byte 255 // (bad)
- .byte 236 // in (%dx),%al
+ .byte 255,227 // jmpq *%rbx
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,228 // jmpq *%rsp
- .byte 255 // (bad)
.byte 255 // (bad)
+ .byte 219,255 // (bad)
.byte 255 // (bad)
- .byte 220,255 // fdivr %st,%st(7)
+ .byte 255,211 // callq *%rbx
.byte 255 // (bad)
- .byte 255,212 // callq *%rsp
.byte 255 // (bad)
+ .byte 255,203 // dec %ebx
.byte 255 // (bad)
- .byte 255,204 // dec %esp
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,192 // inc %eax
+ .byte 191 // .byte 0xbf
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -12609,68 +12667,72 @@ HIDDEN _sk_gather_565_hsw
.globl _sk_gather_565_hsw
FUNCTION(_sk_gather_565_hsw)
_sk_gather_565_hsw:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
.byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,199 // vmovq %xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 71,15,183,20,80 // movzwl (%r8,%r10,2),%r10d
- .byte 71,15,183,28,88 // movzwl (%r8,%r11,2),%r11d
- .byte 196,193,121,110,195 // vmovd %r11d,%xmm0
- .byte 196,193,121,196,194,1 // vpinsrw $0x1,%r10d,%xmm0,%xmm0
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 196,193,121,196,193,2 // vpinsrw $0x2,%r9d,%xmm0,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 196,193,249,126,196 // vmovq %xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 71,15,183,28,89 // movzwl (%r9,%r11,2),%r11d
+ .byte 67,15,183,44,113 // movzwl (%r9,%r14,2),%ebp
+ .byte 197,249,110,197 // vmovd %ebp,%xmm0
+ .byte 196,193,121,196,195,1 // vpinsrw $0x1,%r11d,%xmm0,%xmm0
+ .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp
+ .byte 197,249,196,197,2 // vpinsrw $0x2,%ebp,%xmm0,%xmm0
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 197,249,196,192,3 // vpinsrw $0x3,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,96 // movzwl (%r8,%r12,2),%eax
+ .byte 67,15,183,4,105 // movzwl (%r9,%r13,2),%eax
.byte 197,249,196,192,4 // vpinsrw $0x4,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,120 // movzwl (%r8,%r15,2),%eax
+ .byte 67,15,183,4,97 // movzwl (%r9,%r12,2),%eax
.byte 197,249,196,192,5 // vpinsrw $0x5,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,112 // movzwl (%r8,%r14,2),%eax
+ .byte 67,15,183,4,121 // movzwl (%r9,%r15,2),%eax
.byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0
- .byte 65,15,183,4,88 // movzwl (%r8,%rbx,2),%eax
+ .byte 65,15,183,4,89 // movzwl (%r9,%rbx,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2
- .byte 196,226,125,88,5,225,28,0,0 // vpbroadcastd 0x1ce1(%rip),%ymm0 # 4c7c <_sk_callback_hsw+0x3ba>
+ .byte 196,226,125,88,5,244,28,0,0 // vpbroadcastd 0x1cf4(%rip),%ymm0 # 4c80 <_sk_callback_hsw+0x3c4>
.byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,212,28,0,0 // vbroadcastss 0x1cd4(%rip),%ymm1 # 4c80 <_sk_callback_hsw+0x3be>
+ .byte 196,226,125,24,13,231,28,0,0 // vbroadcastss 0x1ce7(%rip),%ymm1 # 4c84 <_sk_callback_hsw+0x3c8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,203,28,0,0 // vpbroadcastd 0x1ccb(%rip),%ymm1 # 4c84 <_sk_callback_hsw+0x3c2>
+ .byte 196,226,125,88,13,222,28,0,0 // vpbroadcastd 0x1cde(%rip),%ymm1 # 4c88 <_sk_callback_hsw+0x3cc>
.byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,190,28,0,0 // vbroadcastss 0x1cbe(%rip),%ymm3 # 4c88 <_sk_callback_hsw+0x3c6>
+ .byte 196,226,125,24,29,209,28,0,0 // vbroadcastss 0x1cd1(%rip),%ymm3 # 4c8c <_sk_callback_hsw+0x3d0>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,88,29,181,28,0,0 // vpbroadcastd 0x1cb5(%rip),%ymm3 # 4c8c <_sk_callback_hsw+0x3ca>
+ .byte 196,226,125,88,29,200,28,0,0 // vpbroadcastd 0x1cc8(%rip),%ymm3 # 4c90 <_sk_callback_hsw+0x3d4>
.byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,168,28,0,0 // vbroadcastss 0x1ca8(%rip),%ymm3 # 4c90 <_sk_callback_hsw+0x3ce>
+ .byte 196,226,125,24,29,187,28,0,0 // vbroadcastss 0x1cbb(%rip),%ymm3 # 4c94 <_sk_callback_hsw+0x3d8>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,157,28,0,0 // vbroadcastss 0x1c9d(%rip),%ymm3 # 4c94 <_sk_callback_hsw+0x3d2>
+ .byte 196,226,125,24,29,176,28,0,0 // vbroadcastss 0x1cb0(%rip),%ymm3 # 4c98 <_sk_callback_hsw+0x3dc>
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_565_hsw
@@ -12678,12 +12740,12 @@ HIDDEN _sk_store_565_hsw
FUNCTION(_sk_store_565_hsw)
_sk_store_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,138,28,0,0 // vbroadcastss 0x1c8a(%rip),%ymm8 # 4c98 <_sk_callback_hsw+0x3d6>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,154,28,0,0 // vbroadcastss 0x1c9a(%rip),%ymm8 # 4c9c <_sk_callback_hsw+0x3e0>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,53,114,241,11 // vpslld $0xb,%ymm9,%ymm9
- .byte 196,98,125,24,21,117,28,0,0 // vbroadcastss 0x1c75(%rip),%ymm10 # 4c9c <_sk_callback_hsw+0x3da>
+ .byte 196,98,125,24,21,133,28,0,0 // vbroadcastss 0x1c85(%rip),%ymm10 # 4ca0 <_sk_callback_hsw+0x3e4>
.byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10
.byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10
.byte 196,193,45,114,242,5 // vpslld $0x5,%ymm10,%ymm10
@@ -12693,29 +12755,29 @@ _sk_store_565_hsw:
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3065 <_sk_store_565_hsw+0x65>
- .byte 196,65,122,127,4,122 // vmovdqu %xmm8,(%r10,%rdi,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 3061 <_sk_store_565_hsw+0x61>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,68,0,0,0 // lea 0x44(%rip),%r9 # 30c4 <_sk_store_565_hsw+0xc4>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,21,68,122,12,6 // vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,10,5 // vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,8,4 // vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,6,3 // vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,4,2 // vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,2,1 // vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- .byte 196,67,121,21,4,122,0 // vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- .byte 235,159 // jmp 3061 <_sk_store_565_hsw+0x61>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3059 <_sk_store_565_hsw+0x65>
+ .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 3055 <_sk_store_565_hsw+0x61>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 30b8 <_sk_store_565_hsw+0xc4>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,6,3 // vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ .byte 235,159 // jmp 3055 <_sk_store_565_hsw+0x61>
.byte 102,144 // xchg %ax,%ax
.byte 245 // cmc
.byte 255 // (bad)
@@ -12746,53 +12808,53 @@ HIDDEN _sk_load_4444_hsw
FUNCTION(_sk_load_4444_hsw)
_sk_load_4444_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,138,0,0,0 // jne 3178 <_sk_load_4444_hsw+0x98>
- .byte 196,193,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm0
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,138,0,0,0 // jne 316c <_sk_load_4444_hsw+0x98>
+ .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3
- .byte 196,226,125,88,5,158,27,0,0 // vpbroadcastd 0x1b9e(%rip),%ymm0 # 4ca0 <_sk_callback_hsw+0x3de>
+ .byte 196,226,125,88,5,174,27,0,0 // vpbroadcastd 0x1bae(%rip),%ymm0 # 4ca4 <_sk_callback_hsw+0x3e8>
.byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,145,27,0,0 // vbroadcastss 0x1b91(%rip),%ymm1 # 4ca4 <_sk_callback_hsw+0x3e2>
+ .byte 196,226,125,24,13,161,27,0,0 // vbroadcastss 0x1ba1(%rip),%ymm1 # 4ca8 <_sk_callback_hsw+0x3ec>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,136,27,0,0 // vpbroadcastd 0x1b88(%rip),%ymm1 # 4ca8 <_sk_callback_hsw+0x3e6>
+ .byte 196,226,125,88,13,152,27,0,0 // vpbroadcastd 0x1b98(%rip),%ymm1 # 4cac <_sk_callback_hsw+0x3f0>
.byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,123,27,0,0 // vbroadcastss 0x1b7b(%rip),%ymm2 # 4cac <_sk_callback_hsw+0x3ea>
+ .byte 196,226,125,24,21,139,27,0,0 // vbroadcastss 0x1b8b(%rip),%ymm2 # 4cb0 <_sk_callback_hsw+0x3f4>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,88,21,114,27,0,0 // vpbroadcastd 0x1b72(%rip),%ymm2 # 4cb0 <_sk_callback_hsw+0x3ee>
+ .byte 196,226,125,88,21,130,27,0,0 // vpbroadcastd 0x1b82(%rip),%ymm2 # 4cb4 <_sk_callback_hsw+0x3f8>
.byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,101,27,0,0 // vbroadcastss 0x1b65(%rip),%ymm8 # 4cb4 <_sk_callback_hsw+0x3f2>
+ .byte 196,98,125,24,5,117,27,0,0 // vbroadcastss 0x1b75(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x3fc>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,88,5,91,27,0,0 // vpbroadcastd 0x1b5b(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x3f6>
+ .byte 196,98,125,88,5,107,27,0,0 // vpbroadcastd 0x1b6b(%rip),%ymm8 # 4cbc <_sk_callback_hsw+0x400>
.byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,77,27,0,0 // vbroadcastss 0x1b4d(%rip),%ymm8 # 4cbc <_sk_callback_hsw+0x3fa>
+ .byte 196,98,125,24,5,93,27,0,0 // vbroadcastss 0x1b5d(%rip),%ymm8 # 4cc0 <_sk_callback_hsw+0x404>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 15,135,100,255,255,255 // ja 30f4 <_sk_load_4444_hsw+0x14>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,73,0,0,0 // lea 0x49(%rip),%r9 # 31e4 <_sk_load_4444_hsw+0x104>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 15,135,100,255,255,255 // ja 30e8 <_sk_load_4444_hsw+0x14>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,73,0,0,0 // lea 0x49(%rip),%r10 # 31d8 <_sk_load_4444_hsw+0x104>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 196,193,121,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- .byte 233,16,255,255,255 // jmpq 30f4 <_sk_load_4444_hsw+0x14>
+ .byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 233,16,255,255,255 // jmpq 30e8 <_sk_load_4444_hsw+0x14>
.byte 244 // hlt
.byte 255 // (bad)
.byte 255 // (bad)
@@ -12821,72 +12883,76 @@ HIDDEN _sk_gather_4444_hsw
.globl _sk_gather_4444_hsw
FUNCTION(_sk_gather_4444_hsw)
_sk_gather_4444_hsw:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
.byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,199 // vmovq %xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 71,15,183,20,80 // movzwl (%r8,%r10,2),%r10d
- .byte 71,15,183,28,88 // movzwl (%r8,%r11,2),%r11d
- .byte 196,193,121,110,195 // vmovd %r11d,%xmm0
- .byte 196,193,121,196,194,1 // vpinsrw $0x1,%r10d,%xmm0,%xmm0
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 196,193,121,196,193,2 // vpinsrw $0x2,%r9d,%xmm0,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 196,193,249,126,196 // vmovq %xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 71,15,183,28,89 // movzwl (%r9,%r11,2),%r11d
+ .byte 67,15,183,44,113 // movzwl (%r9,%r14,2),%ebp
+ .byte 197,249,110,197 // vmovd %ebp,%xmm0
+ .byte 196,193,121,196,195,1 // vpinsrw $0x1,%r11d,%xmm0,%xmm0
+ .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp
+ .byte 197,249,196,197,2 // vpinsrw $0x2,%ebp,%xmm0,%xmm0
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 197,249,196,192,3 // vpinsrw $0x3,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,96 // movzwl (%r8,%r12,2),%eax
+ .byte 67,15,183,4,105 // movzwl (%r9,%r13,2),%eax
.byte 197,249,196,192,4 // vpinsrw $0x4,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,120 // movzwl (%r8,%r15,2),%eax
+ .byte 67,15,183,4,97 // movzwl (%r9,%r12,2),%eax
.byte 197,249,196,192,5 // vpinsrw $0x5,%eax,%xmm0,%xmm0
- .byte 67,15,183,4,112 // movzwl (%r8,%r14,2),%eax
+ .byte 67,15,183,4,121 // movzwl (%r9,%r15,2),%eax
.byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0
- .byte 65,15,183,4,88 // movzwl (%r8,%rbx,2),%eax
+ .byte 65,15,183,4,89 // movzwl (%r9,%rbx,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3
- .byte 196,226,125,88,5,5,26,0,0 // vpbroadcastd 0x1a05(%rip),%ymm0 # 4cc0 <_sk_callback_hsw+0x3fe>
+ .byte 196,226,125,88,5,20,26,0,0 // vpbroadcastd 0x1a14(%rip),%ymm0 # 4cc4 <_sk_callback_hsw+0x408>
.byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,248,25,0,0 // vbroadcastss 0x19f8(%rip),%ymm1 # 4cc4 <_sk_callback_hsw+0x402>
+ .byte 196,226,125,24,13,7,26,0,0 // vbroadcastss 0x1a07(%rip),%ymm1 # 4cc8 <_sk_callback_hsw+0x40c>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,239,25,0,0 // vpbroadcastd 0x19ef(%rip),%ymm1 # 4cc8 <_sk_callback_hsw+0x406>
+ .byte 196,226,125,88,13,254,25,0,0 // vpbroadcastd 0x19fe(%rip),%ymm1 # 4ccc <_sk_callback_hsw+0x410>
.byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,226,25,0,0 // vbroadcastss 0x19e2(%rip),%ymm2 # 4ccc <_sk_callback_hsw+0x40a>
+ .byte 196,226,125,24,21,241,25,0,0 // vbroadcastss 0x19f1(%rip),%ymm2 # 4cd0 <_sk_callback_hsw+0x414>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,88,21,217,25,0,0 // vpbroadcastd 0x19d9(%rip),%ymm2 # 4cd0 <_sk_callback_hsw+0x40e>
+ .byte 196,226,125,88,21,232,25,0,0 // vpbroadcastd 0x19e8(%rip),%ymm2 # 4cd4 <_sk_callback_hsw+0x418>
.byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,204,25,0,0 // vbroadcastss 0x19cc(%rip),%ymm8 # 4cd4 <_sk_callback_hsw+0x412>
+ .byte 196,98,125,24,5,219,25,0,0 // vbroadcastss 0x19db(%rip),%ymm8 # 4cd8 <_sk_callback_hsw+0x41c>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,88,5,194,25,0,0 // vpbroadcastd 0x19c2(%rip),%ymm8 # 4cd8 <_sk_callback_hsw+0x416>
+ .byte 196,98,125,88,5,209,25,0,0 // vpbroadcastd 0x19d1(%rip),%ymm8 # 4cdc <_sk_callback_hsw+0x420>
.byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,180,25,0,0 // vbroadcastss 0x19b4(%rip),%ymm8 # 4cdc <_sk_callback_hsw+0x41a>
+ .byte 196,98,125,24,5,195,25,0,0 // vbroadcastss 0x19c3(%rip),%ymm8 # 4ce0 <_sk_callback_hsw+0x424>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_4444_hsw
@@ -12894,8 +12960,8 @@ HIDDEN _sk_store_4444_hsw
FUNCTION(_sk_store_4444_hsw)
_sk_store_4444_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,154,25,0,0 // vbroadcastss 0x199a(%rip),%ymm8 # 4ce0 <_sk_callback_hsw+0x41e>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,166,25,0,0 // vbroadcastss 0x19a6(%rip),%ymm8 # 4ce4 <_sk_callback_hsw+0x428>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,53,114,241,12 // vpslld $0xc,%ymm9,%ymm9
@@ -12912,29 +12978,29 @@ _sk_store_4444_hsw:
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 33a9 <_sk_store_4444_hsw+0x71>
- .byte 196,65,122,127,4,122 // vmovdqu %xmm8,(%r10,%rdi,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 33a5 <_sk_store_4444_hsw+0x6d>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,68,0,0,0 // lea 0x44(%rip),%r9 # 3408 <_sk_store_4444_hsw+0xd0>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,21,68,122,12,6 // vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,10,5 // vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,8,4 // vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,6,3 // vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,4,2 // vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,2,1 // vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- .byte 196,67,121,21,4,122,0 // vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- .byte 235,159 // jmp 33a5 <_sk_store_4444_hsw+0x6d>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 33a1 <_sk_store_4444_hsw+0x71>
+ .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 339d <_sk_store_4444_hsw+0x6d>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 3400 <_sk_store_4444_hsw+0xd0>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,6,3 // vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ .byte 235,159 // jmp 339d <_sk_store_4444_hsw+0x6d>
.byte 102,144 // xchg %ax,%ax
.byte 245 // cmc
.byte 255 // (bad)
@@ -12964,28 +13030,28 @@ HIDDEN _sk_load_8888_hsw
.globl _sk_load_8888_hsw
FUNCTION(_sk_load_8888_hsw)
_sk_load_8888_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3491 <_sk_load_8888_hsw+0x6d>
- .byte 196,193,124,16,25 // vmovups (%r9),%ymm3
- .byte 197,228,84,5,218,26,0,0 // vandps 0x1ada(%rip),%ymm3,%ymm0 # 4f20 <_sk_callback_hsw+0x65e>
+ .byte 117,88 // jne 3489 <_sk_load_8888_hsw+0x6d>
+ .byte 196,193,124,16,26 // vmovups (%r10),%ymm3
+ .byte 197,228,84,5,226,26,0,0 // vandps 0x1ae2(%rip),%ymm3,%ymm0 # 4f20 <_sk_callback_hsw+0x664>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,145,24,0,0 // vbroadcastss 0x1891(%rip),%ymm8 # 4ce4 <_sk_callback_hsw+0x422>
+ .byte 196,98,125,24,5,157,24,0,0 // vbroadcastss 0x189d(%rip),%ymm8 # 4ce8 <_sk_callback_hsw+0x42c>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,223,26,0,0 // vpshufb 0x1adf(%rip),%ymm3,%ymm1 # 4f40 <_sk_callback_hsw+0x67e>
+ .byte 196,226,101,0,13,231,26,0,0 // vpshufb 0x1ae7(%rip),%ymm3,%ymm1 # 4f40 <_sk_callback_hsw+0x684>
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,237,26,0,0 // vpshufb 0x1aed(%rip),%ymm3,%ymm2 # 4f60 <_sk_callback_hsw+0x69e>
+ .byte 196,226,101,0,21,245,26,0,0 // vpshufb 0x1af5(%rip),%ymm3,%ymm2 # 4f60 <_sk_callback_hsw+0x6a4>
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -12994,30 +13060,30 @@ _sk_load_8888_hsw:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0
- .byte 196,194,125,44,25 // vmaskmovps (%r9),%ymm0,%ymm3
- .byte 235,135 // jmp 343e <_sk_load_8888_hsw+0x1a>
+ .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
+ .byte 235,135 // jmp 3436 <_sk_load_8888_hsw+0x1a>
HIDDEN _sk_gather_8888_hsw
.globl _sk_gather_8888_hsw
FUNCTION(_sk_gather_8888_hsw)
_sk_gather_8888_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,194,117,144,28,128 // vpgatherdd %ymm1,(%r8,%ymm0,4),%ymm3
- .byte 197,229,219,5,155,26,0,0 // vpand 0x1a9b(%rip),%ymm3,%ymm0 # 4f80 <_sk_callback_hsw+0x6be>
+ .byte 196,194,117,144,28,129 // vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
+ .byte 197,229,219,5,163,26,0,0 // vpand 0x1aa3(%rip),%ymm3,%ymm0 # 4f80 <_sk_callback_hsw+0x6c4>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,246,23,0,0 // vbroadcastss 0x17f6(%rip),%ymm8 # 4ce8 <_sk_callback_hsw+0x426>
+ .byte 196,98,125,24,5,2,24,0,0 // vbroadcastss 0x1802(%rip),%ymm8 # 4cec <_sk_callback_hsw+0x430>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,160,26,0,0 // vpshufb 0x1aa0(%rip),%ymm3,%ymm1 # 4fa0 <_sk_callback_hsw+0x6de>
+ .byte 196,226,101,0,13,168,26,0,0 // vpshufb 0x1aa8(%rip),%ymm3,%ymm1 # 4fa0 <_sk_callback_hsw+0x6e4>
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,174,26,0,0 // vpshufb 0x1aae(%rip),%ymm3,%ymm2 # 4fc0 <_sk_callback_hsw+0x6fe>
+ .byte 196,226,101,0,21,182,26,0,0 // vpshufb 0x1ab6(%rip),%ymm3,%ymm2 # 4fc0 <_sk_callback_hsw+0x704>
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -13030,11 +13096,11 @@ HIDDEN _sk_store_8888_hsw
.globl _sk_store_8888_hsw
FUNCTION(_sk_store_8888_hsw)
_sk_store_8888_hsw:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
- .byte 196,98,125,24,5,166,23,0,0 // vbroadcastss 0x17a6(%rip),%ymm8 # 4cec <_sk_callback_hsw+0x42a>
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
+ .byte 196,98,125,24,5,178,23,0,0 // vbroadcastss 0x17b2(%rip),%ymm8 # 4cf0 <_sk_callback_hsw+0x434>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -13050,10 +13116,10 @@ _sk_store_8888_hsw:
.byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 35a0 <_sk_store_8888_hsw+0x73>
- .byte 196,65,124,17,1 // vmovups %ymm8,(%r9)
+ .byte 117,12 // jne 3598 <_sk_store_8888_hsw+0x73>
+ .byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -13062,8 +13128,8 @@ _sk_store_8888_hsw:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9
- .byte 196,66,53,46,1 // vmaskmovps %ymm8,%ymm9,(%r9)
- .byte 235,211 // jmp 3599 <_sk_store_8888_hsw+0x6c>
+ .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
+ .byte 235,211 // jmp 3591 <_sk_store_8888_hsw+0x6c>
HIDDEN _sk_load_f16_hsw
.globl _sk_load_f16_hsw
@@ -13071,12 +13137,12 @@ FUNCTION(_sk_load_f16_hsw)
_sk_load_f16_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,97 // jne 3631 <_sk_load_f16_hsw+0x6b>
- .byte 197,121,16,4,248 // vmovupd (%rax,%rdi,8),%xmm8
- .byte 197,249,16,84,248,16 // vmovupd 0x10(%rax,%rdi,8),%xmm2
- .byte 197,249,16,92,248,32 // vmovupd 0x20(%rax,%rdi,8),%xmm3
- .byte 197,122,111,76,248,48 // vmovdqu 0x30(%rax,%rdi,8),%xmm9
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,97 // jne 3629 <_sk_load_f16_hsw+0x6b>
+ .byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
+ .byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2
+ .byte 197,249,16,92,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm3
+ .byte 197,122,111,76,208,48 // vmovdqu 0x30(%rax,%rdx,8),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,97,97,201 // vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -13095,39 +13161,39 @@ _sk_load_f16_hsw:
.byte 196,226,125,19,219 // vcvtph2ps %xmm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 197,123,16,4,248 // vmovsd (%rax,%rdi,8),%xmm8
+ .byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,79 // je 3690 <_sk_load_f16_hsw+0xca>
- .byte 197,57,22,68,248,8 // vmovhpd 0x8(%rax,%rdi,8),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,67 // jb 3690 <_sk_load_f16_hsw+0xca>
- .byte 197,251,16,84,248,16 // vmovsd 0x10(%rax,%rdi,8),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,68 // je 369d <_sk_load_f16_hsw+0xd7>
- .byte 197,233,22,84,248,24 // vmovhpd 0x18(%rax,%rdi,8),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,56 // jb 369d <_sk_load_f16_hsw+0xd7>
- .byte 197,251,16,92,248,32 // vmovsd 0x20(%rax,%rdi,8),%xmm3
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,114,255,255,255 // je 35e7 <_sk_load_f16_hsw+0x21>
- .byte 197,225,22,92,248,40 // vmovhpd 0x28(%rax,%rdi,8),%xmm3,%xmm3
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,98,255,255,255 // jb 35e7 <_sk_load_f16_hsw+0x21>
- .byte 197,122,126,76,248,48 // vmovq 0x30(%rax,%rdi,8),%xmm9
- .byte 233,87,255,255,255 // jmpq 35e7 <_sk_load_f16_hsw+0x21>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,79 // je 3688 <_sk_load_f16_hsw+0xca>
+ .byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,67 // jb 3688 <_sk_load_f16_hsw+0xca>
+ .byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,68 // je 3695 <_sk_load_f16_hsw+0xd7>
+ .byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,56 // jb 3695 <_sk_load_f16_hsw+0xd7>
+ .byte 197,251,16,92,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm3
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,114,255,255,255 // je 35df <_sk_load_f16_hsw+0x21>
+ .byte 197,225,22,92,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,98,255,255,255 // jb 35df <_sk_load_f16_hsw+0x21>
+ .byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
+ .byte 233,87,255,255,255 // jmpq 35df <_sk_load_f16_hsw+0x21>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,74,255,255,255 // jmpq 35e7 <_sk_load_f16_hsw+0x21>
+ .byte 233,74,255,255,255 // jmpq 35df <_sk_load_f16_hsw+0x21>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,65,255,255,255 // jmpq 35e7 <_sk_load_f16_hsw+0x21>
+ .byte 233,65,255,255,255 // jmpq 35df <_sk_load_f16_hsw+0x21>
HIDDEN _sk_gather_f16_hsw
.globl _sk_gather_f16_hsw
FUNCTION(_sk_gather_f16_hsw)
_sk_gather_f16_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
@@ -13135,9 +13201,9 @@ _sk_gather_f16_hsw:
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
- .byte 196,194,237,144,28,192 // vpgatherdq %ymm2,(%r8,%xmm0,8),%ymm3
+ .byte 196,194,237,144,28,193 // vpgatherdq %ymm2,(%r9,%xmm0,8),%ymm3
.byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
- .byte 196,194,245,144,20,192 // vpgatherdq %ymm1,(%r8,%xmm0,8),%ymm2
+ .byte 196,194,245,144,20,193 // vpgatherdq %ymm1,(%r9,%xmm0,8),%ymm2
.byte 196,227,125,57,216,1 // vextracti128 $0x1,%ymm3,%xmm0
.byte 196,227,125,57,209,1 // vextracti128 $0x1,%ymm2,%xmm1
.byte 197,97,97,192 // vpunpcklwd %xmm0,%xmm3,%xmm8
@@ -13177,46 +13243,46 @@ _sk_store_f16_hsw:
.byte 196,65,25,106,209 // vpunpckhdq %xmm9,%xmm12,%xmm10
.byte 196,65,57,98,205 // vpunpckldq %xmm13,%xmm8,%xmm9
.byte 196,65,57,106,197 // vpunpckhdq %xmm13,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,27 // jne 3795 <_sk_store_f16_hsw+0x65>
- .byte 197,120,17,28,248 // vmovups %xmm11,(%rax,%rdi,8)
- .byte 197,120,17,84,248,16 // vmovups %xmm10,0x10(%rax,%rdi,8)
- .byte 197,120,17,76,248,32 // vmovups %xmm9,0x20(%rax,%rdi,8)
- .byte 197,122,127,68,248,48 // vmovdqu %xmm8,0x30(%rax,%rdi,8)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 197,121,214,28,248 // vmovq %xmm11,(%rax,%rdi,8)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,241 // je 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,23,92,248,8 // vmovhpd %xmm11,0x8(%rax,%rdi,8)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,229 // jb 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,214,84,248,16 // vmovq %xmm10,0x10(%rax,%rdi,8)
- .byte 116,221 // je 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,23,84,248,24 // vmovhpd %xmm10,0x18(%rax,%rdi,8)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,209 // jb 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,214,76,248,32 // vmovq %xmm9,0x20(%rax,%rdi,8)
- .byte 116,201 // je 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,23,76,248,40 // vmovhpd %xmm9,0x28(%rax,%rdi,8)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,189 // jb 3791 <_sk_store_f16_hsw+0x61>
- .byte 197,121,214,68,248,48 // vmovq %xmm8,0x30(%rax,%rdi,8)
- .byte 235,181 // jmp 3791 <_sk_store_f16_hsw+0x61>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,27 // jne 378d <_sk_store_f16_hsw+0x65>
+ .byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8)
+ .byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8)
+ .byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8)
+ .byte 197,122,127,68,208,48 // vmovdqu %xmm8,0x30(%rax,%rdx,8)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,241 // je 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,229 // jb 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8)
+ .byte 116,221 // je 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,209 // jb 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8)
+ .byte 116,201 // je 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,189 // jb 3789 <_sk_store_f16_hsw+0x61>
+ .byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8)
+ .byte 235,181 // jmp 3789 <_sk_store_f16_hsw+0x61>
HIDDEN _sk_load_u16_be_hsw
.globl _sk_load_u16_be_hsw
FUNCTION(_sk_load_u16_be_hsw)
_sk_load_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,204,0,0,0 // jne 38be <_sk_load_u16_be_hsw+0xe2>
- .byte 196,65,121,16,4,64 // vmovupd (%r8,%rax,2),%xmm8
- .byte 196,193,121,16,84,64,16 // vmovupd 0x10(%r8,%rax,2),%xmm2
- .byte 196,193,121,16,92,64,32 // vmovupd 0x20(%r8,%rax,2),%xmm3
- .byte 196,65,122,111,76,64,48 // vmovdqu 0x30(%r8,%rax,2),%xmm9
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,204,0,0,0 // jne 38b6 <_sk_load_u16_be_hsw+0xe2>
+ .byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8
+ .byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2
+ .byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3
+ .byte 196,65,122,111,76,65,48 // vmovdqu 0x30(%r9,%rax,2),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,97,97,201 // vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -13231,7 +13297,7 @@ _sk_load_u16_be_hsw:
.byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,21,157,20,0,0 // vbroadcastss 0x149d(%rip),%ymm10 # 4cf0 <_sk_callback_hsw+0x42e>
+ .byte 196,98,125,24,21,169,20,0,0 // vbroadcastss 0x14a9(%rip),%ymm10 # 4cf4 <_sk_callback_hsw+0x438>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -13256,46 +13322,46 @@ _sk_load_u16_be_hsw:
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 196,65,123,16,4,64 // vmovsd (%r8,%rax,2),%xmm8
+ .byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,85 // je 3924 <_sk_load_u16_be_hsw+0x148>
- .byte 196,65,57,22,68,64,8 // vmovhpd 0x8(%r8,%rax,2),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,72 // jb 3924 <_sk_load_u16_be_hsw+0x148>
- .byte 196,193,123,16,84,64,16 // vmovsd 0x10(%r8,%rax,2),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,72 // je 3931 <_sk_load_u16_be_hsw+0x155>
- .byte 196,193,105,22,84,64,24 // vmovhpd 0x18(%r8,%rax,2),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,59 // jb 3931 <_sk_load_u16_be_hsw+0x155>
- .byte 196,193,123,16,92,64,32 // vmovsd 0x20(%r8,%rax,2),%xmm3
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,6,255,255,255 // je 380d <_sk_load_u16_be_hsw+0x31>
- .byte 196,193,97,22,92,64,40 // vmovhpd 0x28(%r8,%rax,2),%xmm3,%xmm3
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,245,254,255,255 // jb 380d <_sk_load_u16_be_hsw+0x31>
- .byte 196,65,122,126,76,64,48 // vmovq 0x30(%r8,%rax,2),%xmm9
- .byte 233,233,254,255,255 // jmpq 380d <_sk_load_u16_be_hsw+0x31>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,85 // je 391c <_sk_load_u16_be_hsw+0x148>
+ .byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,72 // jb 391c <_sk_load_u16_be_hsw+0x148>
+ .byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,72 // je 3929 <_sk_load_u16_be_hsw+0x155>
+ .byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,59 // jb 3929 <_sk_load_u16_be_hsw+0x155>
+ .byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,6,255,255,255 // je 3805 <_sk_load_u16_be_hsw+0x31>
+ .byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,245,254,255,255 // jb 3805 <_sk_load_u16_be_hsw+0x31>
+ .byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9
+ .byte 233,233,254,255,255 // jmpq 3805 <_sk_load_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,220,254,255,255 // jmpq 380d <_sk_load_u16_be_hsw+0x31>
+ .byte 233,220,254,255,255 // jmpq 3805 <_sk_load_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,211,254,255,255 // jmpq 380d <_sk_load_u16_be_hsw+0x31>
+ .byte 233,211,254,255,255 // jmpq 3805 <_sk_load_u16_be_hsw+0x31>
HIDDEN _sk_load_rgb_u16_be_hsw
.globl _sk_load_rgb_u16_be_hsw
FUNCTION(_sk_load_rgb_u16_be_hsw)
_sk_load_rgb_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,127 // lea (%rdi,%rdi,2),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,204,0,0,0 // jne 3a18 <_sk_load_rgb_u16_be_hsw+0xde>
- .byte 196,193,122,111,4,64 // vmovdqu (%r8,%rax,2),%xmm0
- .byte 196,193,122,111,84,64,12 // vmovdqu 0xc(%r8,%rax,2),%xmm2
- .byte 196,193,122,111,76,64,24 // vmovdqu 0x18(%r8,%rax,2),%xmm1
- .byte 196,193,122,111,92,64,32 // vmovdqu 0x20(%r8,%rax,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,204,0,0,0 // jne 3a10 <_sk_load_rgb_u16_be_hsw+0xde>
+ .byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0
+ .byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2
+ .byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1
+ .byte 196,193,122,111,92,65,32 // vmovdqu 0x20(%r9,%rax,2),%xmm3
.byte 197,225,115,219,4 // vpsrldq $0x4,%xmm3,%xmm3
.byte 197,185,115,216,6 // vpsrldq $0x6,%xmm0,%xmm8
.byte 197,177,115,218,6 // vpsrldq $0x6,%xmm2,%xmm9
@@ -13315,7 +13381,7 @@ _sk_load_rgb_u16_be_hsw:
.byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,21,46,19,0,0 // vbroadcastss 0x132e(%rip),%ymm10 # 4cf4 <_sk_callback_hsw+0x432>
+ .byte 196,98,125,24,21,58,19,0,0 // vbroadcastss 0x133a(%rip),%ymm10 # 4cf8 <_sk_callback_hsw+0x43c>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -13332,50 +13398,50 @@ _sk_load_rgb_u16_be_hsw:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,226,18,0,0 // vbroadcastss 0x12e2(%rip),%ymm3 # 4cf8 <_sk_callback_hsw+0x436>
- .byte 255,224 // jmpq *%rax
- .byte 196,193,121,110,4,64 // vmovd (%r8,%rax,2),%xmm0
- .byte 196,193,121,196,68,64,4,2 // vpinsrw $0x2,0x4(%r8,%rax,2),%xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,5 // jne 3a31 <_sk_load_rgb_u16_be_hsw+0xf7>
- .byte 233,79,255,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 196,193,121,110,76,64,6 // vmovd 0x6(%r8,%rax,2),%xmm1
- .byte 196,65,113,196,68,64,10,2 // vpinsrw $0x2,0xa(%r8,%rax,2),%xmm1,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,26 // jb 3a60 <_sk_load_rgb_u16_be_hsw+0x126>
- .byte 196,193,121,110,76,64,12 // vmovd 0xc(%r8,%rax,2),%xmm1
- .byte 196,193,113,196,84,64,16,2 // vpinsrw $0x2,0x10(%r8,%rax,2),%xmm1,%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 117,10 // jne 3a65 <_sk_load_rgb_u16_be_hsw+0x12b>
- .byte 233,32,255,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,27,255,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 196,193,121,110,76,64,18 // vmovd 0x12(%r8,%rax,2),%xmm1
- .byte 196,65,113,196,76,64,22,2 // vpinsrw $0x2,0x16(%r8,%rax,2),%xmm1,%xmm9
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,26 // jb 3a94 <_sk_load_rgb_u16_be_hsw+0x15a>
- .byte 196,193,121,110,76,64,24 // vmovd 0x18(%r8,%rax,2),%xmm1
- .byte 196,193,113,196,76,64,28,2 // vpinsrw $0x2,0x1c(%r8,%rax,2),%xmm1,%xmm1
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 117,10 // jne 3a99 <_sk_load_rgb_u16_be_hsw+0x15f>
- .byte 233,236,254,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,231,254,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 196,193,121,110,92,64,30 // vmovd 0x1e(%r8,%rax,2),%xmm3
- .byte 196,65,97,196,92,64,34,2 // vpinsrw $0x2,0x22(%r8,%rax,2),%xmm3,%xmm11
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,20 // jb 3ac2 <_sk_load_rgb_u16_be_hsw+0x188>
- .byte 196,193,121,110,92,64,36 // vmovd 0x24(%r8,%rax,2),%xmm3
- .byte 196,193,97,196,92,64,40,2 // vpinsrw $0x2,0x28(%r8,%rax,2),%xmm3,%xmm3
- .byte 233,190,254,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,185,254,255,255 // jmpq 3980 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 196,226,125,24,29,238,18,0,0 // vbroadcastss 0x12ee(%rip),%ymm3 # 4cfc <_sk_callback_hsw+0x440>
+ .byte 255,224 // jmpq *%rax
+ .byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0
+ .byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,5 // jne 3a29 <_sk_load_rgb_u16_be_hsw+0xf7>
+ .byte 233,79,255,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1
+ .byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,26 // jb 3a58 <_sk_load_rgb_u16_be_hsw+0x126>
+ .byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1
+ .byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 117,10 // jne 3a5d <_sk_load_rgb_u16_be_hsw+0x12b>
+ .byte 233,32,255,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,27,255,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1
+ .byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,26 // jb 3a8c <_sk_load_rgb_u16_be_hsw+0x15a>
+ .byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1
+ .byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 117,10 // jne 3a91 <_sk_load_rgb_u16_be_hsw+0x15f>
+ .byte 233,236,254,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,231,254,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3
+ .byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,20 // jb 3aba <_sk_load_rgb_u16_be_hsw+0x188>
+ .byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3
+ .byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
+ .byte 233,190,254,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,185,254,255,255 // jmpq 3978 <_sk_load_rgb_u16_be_hsw+0x46>
HIDDEN _sk_store_u16_be_hsw
.globl _sk_store_u16_be_hsw
FUNCTION(_sk_store_u16_be_hsw)
_sk_store_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 196,98,125,24,5,31,18,0,0 // vbroadcastss 0x121f(%rip),%ymm8 # 4cfc <_sk_callback_hsw+0x43a>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 196,98,125,24,5,43,18,0,0 // vbroadcastss 0x122b(%rip),%ymm8 # 4d00 <_sk_callback_hsw+0x444>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10
@@ -13412,57 +13478,57 @@ _sk_store_u16_be_hsw:
.byte 196,65,25,106,209 // vpunpckhdq %xmm9,%xmm12,%xmm10
.byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9
.byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,31 // jne 3bc1 <_sk_store_u16_be_hsw+0xfa>
- .byte 196,65,120,17,28,64 // vmovups %xmm11,(%r8,%rax,2)
- .byte 196,65,120,17,84,64,16 // vmovups %xmm10,0x10(%r8,%rax,2)
- .byte 196,65,120,17,76,64,32 // vmovups %xmm9,0x20(%r8,%rax,2)
- .byte 196,65,122,127,68,64,48 // vmovdqu %xmm8,0x30(%r8,%rax,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,65,121,214,28,64 // vmovq %xmm11,(%r8,%rax,2)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,23,92,64,8 // vmovhpd %xmm11,0x8(%r8,%rax,2)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,214,84,64,16 // vmovq %xmm10,0x10(%r8,%rax,2)
- .byte 116,218 // je 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,23,84,64,24 // vmovhpd %xmm10,0x18(%r8,%rax,2)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,205 // jb 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,214,76,64,32 // vmovq %xmm9,0x20(%r8,%rax,2)
- .byte 116,196 // je 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,23,76,64,40 // vmovhpd %xmm9,0x28(%r8,%rax,2)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,183 // jb 3bbd <_sk_store_u16_be_hsw+0xf6>
- .byte 196,65,121,214,68,64,48 // vmovq %xmm8,0x30(%r8,%rax,2)
- .byte 235,174 // jmp 3bbd <_sk_store_u16_be_hsw+0xf6>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,31 // jne 3bb9 <_sk_store_u16_be_hsw+0xfa>
+ .byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2)
+ .byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2)
+ .byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2)
+ .byte 196,65,122,127,68,65,48 // vmovdqu %xmm8,0x30(%r9,%rax,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2)
+ .byte 116,218 // je 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,205 // jb 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2)
+ .byte 116,196 // je 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,183 // jb 3bb5 <_sk_store_u16_be_hsw+0xf6>
+ .byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2)
+ .byte 235,174 // jmp 3bb5 <_sk_store_u16_be_hsw+0xf6>
HIDDEN _sk_load_f32_hsw
.globl _sk_load_f32_hsw
FUNCTION(_sk_load_f32_hsw)
_sk_load_f32_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 119,110 // ja 3c85 <_sk_load_f32_hsw+0x76>
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,141,21,135,0,0,0 // lea 0x87(%rip),%r10 # 3cb0 <_sk_load_f32_hsw+0xa1>
- .byte 73,99,4,138 // movslq (%r10,%rcx,4),%rax
- .byte 76,1,208 // add %r10,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,3,125,24,68,136,112,1 // vinsertf128 $0x1,0x70(%r8,%r9,4),%ymm0,%ymm8
- .byte 196,131,125,24,92,136,96,1 // vinsertf128 $0x1,0x60(%r8,%r9,4),%ymm0,%ymm3
- .byte 196,131,125,24,76,136,80,1 // vinsertf128 $0x1,0x50(%r8,%r9,4),%ymm0,%ymm1
- .byte 196,131,125,24,84,136,64,1 // vinsertf128 $0x1,0x40(%r8,%r9,4),%ymm0,%ymm2
- .byte 196,129,121,16,68,136,48 // vmovupd 0x30(%r8,%r9,4),%xmm0
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 119,110 // ja 3c7d <_sk_load_f32_hsw+0x76>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,141,29,135,0,0,0 // lea 0x87(%rip),%r11 # 3ca8 <_sk_load_f32_hsw+0xa1>
+ .byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
+ .byte 76,1,216 // add %r11,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,3,125,24,68,145,112,1 // vinsertf128 $0x1,0x70(%r9,%r10,4),%ymm0,%ymm8
+ .byte 196,131,125,24,92,145,96,1 // vinsertf128 $0x1,0x60(%r9,%r10,4),%ymm0,%ymm3
+ .byte 196,131,125,24,76,145,80,1 // vinsertf128 $0x1,0x50(%r9,%r10,4),%ymm0,%ymm1
+ .byte 196,131,125,24,84,145,64,1 // vinsertf128 $0x1,0x40(%r9,%r10,4),%ymm0,%ymm2
+ .byte 196,129,121,16,68,145,48 // vmovupd 0x30(%r9,%r10,4),%xmm0
.byte 196,195,125,13,192,12 // vblendpd $0xc,%ymm8,%ymm0,%ymm0
- .byte 196,1,121,16,68,136,32 // vmovupd 0x20(%r8,%r9,4),%xmm8
+ .byte 196,1,121,16,68,145,32 // vmovupd 0x20(%r9,%r10,4),%xmm8
.byte 196,99,61,13,203,12 // vblendpd $0xc,%ymm3,%ymm8,%ymm9
- .byte 196,129,121,16,92,136,16 // vmovupd 0x10(%r8,%r9,4),%xmm3
+ .byte 196,129,121,16,92,145,16 // vmovupd 0x10(%r9,%r10,4),%xmm3
.byte 196,99,101,13,209,12 // vblendpd $0xc,%ymm1,%ymm3,%ymm10
- .byte 196,129,121,16,12,136 // vmovupd (%r8,%r9,4),%xmm1
+ .byte 196,129,121,16,12,145 // vmovupd (%r9,%r10,4),%xmm1
.byte 196,227,117,13,202,12 // vblendpd $0xc,%ymm2,%ymm1,%ymm1
.byte 196,193,116,20,210 // vunpcklps %ymm10,%ymm1,%ymm2
.byte 196,193,116,21,218 // vunpckhps %ymm10,%ymm1,%ymm3
@@ -13498,8 +13564,8 @@ HIDDEN _sk_store_f32_hsw
FUNCTION(_sk_store_f32_hsw)
_sk_store_f32_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 197,124,20,193 // vunpcklps %ymm1,%ymm0,%ymm8
.byte 197,124,21,217 // vunpckhps %ymm1,%ymm0,%ymm11
.byte 197,108,20,203 // vunpcklps %ymm3,%ymm2,%ymm9
@@ -13508,36 +13574,36 @@ _sk_store_f32_hsw:
.byte 196,65,61,21,201 // vunpckhpd %ymm9,%ymm8,%ymm9
.byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8
.byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,55 // jne 3d3d <_sk_store_f32_hsw+0x6d>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,55 // jne 3d35 <_sk_store_f32_hsw+0x6d>
.byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
.byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
.byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
.byte 196,67,61,6,195,49 // vperm2f128 $0x31,%ymm11,%ymm8,%ymm8
- .byte 196,65,125,17,36,128 // vmovupd %ymm12,(%r8,%rax,4)
- .byte 196,65,125,17,108,128,32 // vmovupd %ymm13,0x20(%r8,%rax,4)
- .byte 196,65,125,17,76,128,64 // vmovupd %ymm9,0x40(%r8,%rax,4)
- .byte 196,65,125,17,68,128,96 // vmovupd %ymm8,0x60(%r8,%rax,4)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,65,121,17,20,128 // vmovupd %xmm10,(%r8,%rax,4)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,65,121,17,76,128,16 // vmovupd %xmm9,0x10(%r8,%rax,4)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,65,121,17,68,128,32 // vmovupd %xmm8,0x20(%r8,%rax,4)
- .byte 116,218 // je 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,65,121,17,92,128,48 // vmovupd %xmm11,0x30(%r8,%rax,4)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,205 // jb 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,67,125,25,84,128,64,1 // vextractf128 $0x1,%ymm10,0x40(%r8,%rax,4)
- .byte 116,195 // je 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,67,125,25,76,128,80,1 // vextractf128 $0x1,%ymm9,0x50(%r8,%rax,4)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,181 // jb 3d39 <_sk_store_f32_hsw+0x69>
- .byte 196,67,125,25,68,128,96,1 // vextractf128 $0x1,%ymm8,0x60(%r8,%rax,4)
- .byte 235,171 // jmp 3d39 <_sk_store_f32_hsw+0x69>
+ .byte 196,65,125,17,36,129 // vmovupd %ymm12,(%r9,%rax,4)
+ .byte 196,65,125,17,108,129,32 // vmovupd %ymm13,0x20(%r9,%rax,4)
+ .byte 196,65,125,17,76,129,64 // vmovupd %ymm9,0x40(%r9,%rax,4)
+ .byte 196,65,125,17,68,129,96 // vmovupd %ymm8,0x60(%r9,%rax,4)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4)
+ .byte 116,218 // je 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,205 // jb 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
+ .byte 116,195 // je 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,181 // jb 3d31 <_sk_store_f32_hsw+0x69>
+ .byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
+ .byte 235,171 // jmp 3d31 <_sk_store_f32_hsw+0x69>
HIDDEN _sk_clamp_x_hsw
.globl _sk_clamp_x_hsw
@@ -13635,7 +13701,7 @@ FUNCTION(_sk_clamp_x_1_hsw)
_sk_clamp_x_1_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,114,14,0,0 // vbroadcastss 0xe72(%rip),%ymm8 # 4d00 <_sk_callback_hsw+0x43e>
+ .byte 196,98,125,24,5,126,14,0,0 // vbroadcastss 0xe7e(%rip),%ymm8 # 4d04 <_sk_callback_hsw+0x448>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -13653,9 +13719,9 @@ HIDDEN _sk_mirror_x_1_hsw
.globl _sk_mirror_x_1_hsw
FUNCTION(_sk_mirror_x_1_hsw)
_sk_mirror_x_1_hsw:
- .byte 196,98,125,24,5,85,14,0,0 // vbroadcastss 0xe55(%rip),%ymm8 # 4d04 <_sk_callback_hsw+0x442>
+ .byte 196,98,125,24,5,97,14,0,0 // vbroadcastss 0xe61(%rip),%ymm8 # 4d08 <_sk_callback_hsw+0x44c>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,13,75,14,0,0 // vbroadcastss 0xe4b(%rip),%ymm9 # 4d08 <_sk_callback_hsw+0x446>
+ .byte 196,98,125,24,13,87,14,0,0 // vbroadcastss 0xe57(%rip),%ymm9 # 4d0c <_sk_callback_hsw+0x450>
.byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9
.byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9
.byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9
@@ -13671,11 +13737,11 @@ HIDDEN _sk_luminance_to_alpha_hsw
.globl _sk_luminance_to_alpha_hsw
FUNCTION(_sk_luminance_to_alpha_hsw)
_sk_luminance_to_alpha_hsw:
- .byte 196,226,125,24,29,27,14,0,0 // vbroadcastss 0xe1b(%rip),%ymm3 # 4d0c <_sk_callback_hsw+0x44a>
- .byte 196,98,125,24,5,22,14,0,0 // vbroadcastss 0xe16(%rip),%ymm8 # 4d10 <_sk_callback_hsw+0x44e>
+ .byte 196,226,125,24,29,39,14,0,0 // vbroadcastss 0xe27(%rip),%ymm3 # 4d10 <_sk_callback_hsw+0x454>
+ .byte 196,98,125,24,5,34,14,0,0 // vbroadcastss 0xe22(%rip),%ymm8 # 4d14 <_sk_callback_hsw+0x458>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 196,226,125,184,203 // vfmadd231ps %ymm3,%ymm0,%ymm1
- .byte 196,226,125,24,29,7,14,0,0 // vbroadcastss 0xe07(%rip),%ymm3 # 4d14 <_sk_callback_hsw+0x452>
+ .byte 196,226,125,24,29,19,14,0,0 // vbroadcastss 0xe13(%rip),%ymm3 # 4d18 <_sk_callback_hsw+0x45c>
.byte 196,226,109,168,217 // vfmadd213ps %ymm1,%ymm2,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -13843,62 +13909,63 @@ HIDDEN _sk_evenly_spaced_gradient_hsw
.globl _sk_evenly_spaced_gradient_hsw
FUNCTION(_sk_evenly_spaced_gradient_hsw)
_sk_evenly_spaced_gradient_hsw:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 77,137,202 // mov %r9,%r10
- .byte 73,255,202 // dec %r10
- .byte 120,7 // js 41c5 <_sk_evenly_spaced_gradient_hsw+0x18>
- .byte 196,193,242,42,202 // vcvtsi2ss %r10,%xmm1,%xmm1
- .byte 235,22 // jmp 41db <_sk_evenly_spaced_gradient_hsw+0x2e>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
.byte 77,137,211 // mov %r10,%r11
- .byte 73,209,235 // shr %r11
- .byte 65,131,226,1 // and $0x1,%r10d
- .byte 77,9,218 // or %r11,%r10
- .byte 196,193,242,42,202 // vcvtsi2ss %r10,%xmm1,%xmm1
+ .byte 73,255,203 // dec %r11
+ .byte 120,7 // js 41be <_sk_evenly_spaced_gradient_hsw+0x19>
+ .byte 196,193,242,42,203 // vcvtsi2ss %r11,%xmm1,%xmm1
+ .byte 235,22 // jmp 41d4 <_sk_evenly_spaced_gradient_hsw+0x2f>
+ .byte 76,137,219 // mov %r11,%rbx
+ .byte 72,209,235 // shr %rbx
+ .byte 65,131,227,1 // and $0x1,%r11d
+ .byte 73,9,219 // or %rbx,%r11
+ .byte 196,193,242,42,203 // vcvtsi2ss %r11,%xmm1,%xmm1
.byte 197,242,88,201 // vaddss %xmm1,%xmm1,%xmm1
.byte 196,226,125,24,201 // vbroadcastss %xmm1,%ymm1
.byte 197,244,89,200 // vmulps %ymm0,%ymm1,%ymm1
.byte 197,126,91,217 // vcvttps2dq %ymm1,%ymm11
- .byte 73,131,249,8 // cmp $0x8,%r9
- .byte 119,70 // ja 4234 <_sk_evenly_spaced_gradient_hsw+0x87>
- .byte 196,66,37,22,0 // vpermps (%r8),%ymm11,%ymm8
- .byte 76,139,64,40 // mov 0x28(%rax),%r8
- .byte 196,66,37,22,8 // vpermps (%r8),%ymm11,%ymm9
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
+ .byte 73,131,250,8 // cmp $0x8,%r10
+ .byte 119,70 // ja 422d <_sk_evenly_spaced_gradient_hsw+0x88>
+ .byte 196,66,37,22,1 // vpermps (%r9),%ymm11,%ymm8
+ .byte 72,139,88,40 // mov 0x28(%rax),%rbx
+ .byte 196,98,37,22,11 // vpermps (%rbx),%ymm11,%ymm9
+ .byte 72,139,88,16 // mov 0x10(%rax),%rbx
.byte 76,139,72,24 // mov 0x18(%rax),%r9
- .byte 196,194,37,22,8 // vpermps (%r8),%ymm11,%ymm1
- .byte 76,139,64,48 // mov 0x30(%rax),%r8
- .byte 196,66,37,22,16 // vpermps (%r8),%ymm11,%ymm10
+ .byte 196,226,37,22,11 // vpermps (%rbx),%ymm11,%ymm1
+ .byte 72,139,88,48 // mov 0x30(%rax),%rbx
+ .byte 196,98,37,22,19 // vpermps (%rbx),%ymm11,%ymm10
.byte 196,194,37,22,17 // vpermps (%r9),%ymm11,%ymm2
- .byte 76,139,64,56 // mov 0x38(%rax),%r8
- .byte 196,66,37,22,32 // vpermps (%r8),%ymm11,%ymm12
- .byte 76,139,64,32 // mov 0x20(%rax),%r8
- .byte 196,194,37,22,24 // vpermps (%r8),%ymm11,%ymm3
+ .byte 72,139,88,56 // mov 0x38(%rax),%rbx
+ .byte 196,98,37,22,35 // vpermps (%rbx),%ymm11,%ymm12
+ .byte 72,139,88,32 // mov 0x20(%rax),%rbx
+ .byte 196,226,37,22,27 // vpermps (%rbx),%ymm11,%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,98,37,22,40 // vpermps (%rax),%ymm11,%ymm13
- .byte 235,110 // jmp 42a2 <_sk_evenly_spaced_gradient_hsw+0xf5>
+ .byte 235,110 // jmp 429b <_sk_evenly_spaced_gradient_hsw+0xf6>
.byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,2,117,146,4,152 // vgatherdps %ymm1,(%r8,%ymm11,4),%ymm8
- .byte 76,139,64,40 // mov 0x28(%rax),%r8
+ .byte 196,2,117,146,4,153 // vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8
+ .byte 72,139,88,40 // mov 0x28(%rax),%rbx
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,2,117,146,12,152 // vgatherdps %ymm1,(%r8,%ymm11,4),%ymm9
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
+ .byte 196,34,117,146,12,155 // vgatherdps %ymm1,(%rbx,%ymm11,4),%ymm9
+ .byte 72,139,88,16 // mov 0x10(%rax),%rbx
.byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
- .byte 196,130,109,146,12,152 // vgatherdps %ymm2,(%r8,%ymm11,4),%ymm1
- .byte 76,139,64,48 // mov 0x30(%rax),%r8
+ .byte 196,162,109,146,12,155 // vgatherdps %ymm2,(%rbx,%ymm11,4),%ymm1
+ .byte 72,139,88,48 // mov 0x30(%rax),%rbx
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
- .byte 196,2,109,146,20,152 // vgatherdps %ymm2,(%r8,%ymm11,4),%ymm10
+ .byte 196,34,109,146,20,155 // vgatherdps %ymm2,(%rbx,%ymm11,4),%ymm10
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
.byte 196,130,101,146,20,153 // vgatherdps %ymm3,(%r9,%ymm11,4),%ymm2
- .byte 76,139,64,56 // mov 0x38(%rax),%r8
+ .byte 72,139,88,56 // mov 0x38(%rax),%rbx
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
- .byte 196,2,101,146,36,152 // vgatherdps %ymm3,(%r8,%ymm11,4),%ymm12
- .byte 76,139,64,32 // mov 0x20(%rax),%r8
+ .byte 196,34,101,146,36,155 // vgatherdps %ymm3,(%rbx,%ymm11,4),%ymm12
+ .byte 72,139,88,32 // mov 0x20(%rax),%rbx
.byte 196,65,21,118,237 // vpcmpeqd %ymm13,%ymm13,%ymm13
- .byte 196,130,21,146,28,152 // vgatherdps %ymm13,(%r8,%ymm11,4),%ymm3
+ .byte 196,162,21,146,28,155 // vgatherdps %ymm13,(%rbx,%ymm11,4),%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,34,13,146,44,152 // vgatherdps %ymm14,(%rax,%ymm11,4),%ymm13
.byte 196,66,125,168,193 // vfmadd213ps %ymm9,%ymm0,%ymm8
@@ -13907,20 +13974,21 @@ _sk_evenly_spaced_gradient_hsw:
.byte 196,194,125,168,221 // vfmadd213ps %ymm13,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,124,41,192 // vmovaps %ymm8,%ymm0
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_gauss_a_to_rgba_hsw
.globl _sk_gauss_a_to_rgba_hsw
FUNCTION(_sk_gauss_a_to_rgba_hsw)
_sk_gauss_a_to_rgba_hsw:
- .byte 196,226,125,24,5,81,10,0,0 // vbroadcastss 0xa51(%rip),%ymm0 # 4d18 <_sk_callback_hsw+0x456>
- .byte 196,226,125,24,13,76,10,0,0 // vbroadcastss 0xa4c(%rip),%ymm1 # 4d1c <_sk_callback_hsw+0x45a>
+ .byte 196,226,125,24,5,91,10,0,0 // vbroadcastss 0xa5b(%rip),%ymm0 # 4d1c <_sk_callback_hsw+0x460>
+ .byte 196,226,125,24,13,86,10,0,0 // vbroadcastss 0xa56(%rip),%ymm1 # 4d20 <_sk_callback_hsw+0x464>
.byte 196,226,101,168,200 // vfmadd213ps %ymm0,%ymm3,%ymm1
- .byte 196,226,125,24,5,66,10,0,0 // vbroadcastss 0xa42(%rip),%ymm0 # 4d20 <_sk_callback_hsw+0x45e>
+ .byte 196,226,125,24,5,76,10,0,0 // vbroadcastss 0xa4c(%rip),%ymm0 # 4d24 <_sk_callback_hsw+0x468>
.byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0
- .byte 196,226,125,24,13,56,10,0,0 // vbroadcastss 0xa38(%rip),%ymm1 # 4d24 <_sk_callback_hsw+0x462>
+ .byte 196,226,125,24,13,66,10,0,0 // vbroadcastss 0xa42(%rip),%ymm1 # 4d28 <_sk_callback_hsw+0x46c>
.byte 196,226,101,184,200 // vfmadd231ps %ymm0,%ymm3,%ymm1
- .byte 196,226,125,24,5,46,10,0,0 // vbroadcastss 0xa2e(%rip),%ymm0 # 4d28 <_sk_callback_hsw+0x466>
+ .byte 196,226,125,24,5,56,10,0,0 // vbroadcastss 0xa38(%rip),%ymm0 # 4d2c <_sk_callback_hsw+0x470>
.byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
@@ -13933,63 +14001,63 @@ HIDDEN _sk_gradient_hsw
FUNCTION(_sk_gradient_hsw)
_sk_gradient_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 73,131,248,1 // cmp $0x1,%r8
- .byte 15,134,180,0,0,0 // jbe 43d2 <_sk_gradient_hsw+0xc3>
- .byte 76,139,72,72 // mov 0x48(%rax),%r9
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 73,131,249,1 // cmp $0x1,%r9
+ .byte 15,134,180,0,0,0 // jbe 43cc <_sk_gradient_hsw+0xc3>
+ .byte 76,139,80,72 // mov 0x48(%rax),%r10
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
- .byte 65,186,1,0,0,0 // mov $0x1,%r10d
- .byte 196,226,125,24,21,247,9,0,0 // vbroadcastss 0x9f7(%rip),%ymm2 # 4d2c <_sk_callback_hsw+0x46a>
+ .byte 65,187,1,0,0,0 // mov $0x1,%r11d
+ .byte 196,226,125,24,21,1,10,0,0 // vbroadcastss 0xa01(%rip),%ymm2 # 4d30 <_sk_callback_hsw+0x474>
.byte 196,65,53,239,201 // vpxor %ymm9,%ymm9,%ymm9
- .byte 196,130,125,24,28,145 // vbroadcastss (%r9,%r10,4),%ymm3
+ .byte 196,130,125,24,28,154 // vbroadcastss (%r10,%r11,4),%ymm3
.byte 197,228,194,216,2 // vcmpleps %ymm0,%ymm3,%ymm3
.byte 196,227,117,74,218,48 // vblendvps %ymm3,%ymm2,%ymm1,%ymm3
.byte 196,65,101,254,201 // vpaddd %ymm9,%ymm3,%ymm9
- .byte 73,255,194 // inc %r10
- .byte 77,57,208 // cmp %r10,%r8
- .byte 117,226 // jne 433a <_sk_gradient_hsw+0x2b>
- .byte 76,139,72,8 // mov 0x8(%rax),%r9
- .byte 73,131,248,8 // cmp $0x8,%r8
- .byte 118,121 // jbe 43db <_sk_gradient_hsw+0xcc>
+ .byte 73,255,195 // inc %r11
+ .byte 77,57,217 // cmp %r11,%r9
+ .byte 117,226 // jne 4334 <_sk_gradient_hsw+0x2b>
+ .byte 76,139,80,8 // mov 0x8(%rax),%r10
+ .byte 73,131,249,8 // cmp $0x8,%r9
+ .byte 118,121 // jbe 43d5 <_sk_gradient_hsw+0xcc>
.byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,2,117,146,4,137 // vgatherdps %ymm1,(%r9,%ymm9,4),%ymm8
- .byte 76,139,64,40 // mov 0x28(%rax),%r8
+ .byte 196,2,117,146,4,138 // vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8
+ .byte 76,139,72,40 // mov 0x28(%rax),%r9
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,2,117,146,20,136 // vgatherdps %ymm1,(%r8,%ymm9,4),%ymm10
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 76,139,72,24 // mov 0x18(%rax),%r9
+ .byte 196,2,117,146,20,137 // vgatherdps %ymm1,(%r9,%ymm9,4),%ymm10
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
- .byte 196,130,109,146,12,136 // vgatherdps %ymm2,(%r8,%ymm9,4),%ymm1
- .byte 76,139,64,48 // mov 0x30(%rax),%r8
+ .byte 196,130,109,146,12,137 // vgatherdps %ymm2,(%r9,%ymm9,4),%ymm1
+ .byte 76,139,72,48 // mov 0x30(%rax),%r9
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
- .byte 196,2,109,146,28,136 // vgatherdps %ymm2,(%r8,%ymm9,4),%ymm11
+ .byte 196,2,109,146,28,137 // vgatherdps %ymm2,(%r9,%ymm9,4),%ymm11
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
- .byte 196,130,101,146,20,137 // vgatherdps %ymm3,(%r9,%ymm9,4),%ymm2
- .byte 76,139,64,56 // mov 0x38(%rax),%r8
+ .byte 196,130,101,146,20,138 // vgatherdps %ymm3,(%r10,%ymm9,4),%ymm2
+ .byte 76,139,72,56 // mov 0x38(%rax),%r9
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
- .byte 196,2,101,146,36,136 // vgatherdps %ymm3,(%r8,%ymm9,4),%ymm12
- .byte 76,139,64,32 // mov 0x20(%rax),%r8
+ .byte 196,2,101,146,36,137 // vgatherdps %ymm3,(%r9,%ymm9,4),%ymm12
+ .byte 76,139,72,32 // mov 0x20(%rax),%r9
.byte 196,65,21,118,237 // vpcmpeqd %ymm13,%ymm13,%ymm13
- .byte 196,130,21,146,28,136 // vgatherdps %ymm13,(%r8,%ymm9,4),%ymm3
+ .byte 196,130,21,146,28,137 // vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,34,13,146,44,136 // vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13
- .byte 235,77 // jmp 441f <_sk_gradient_hsw+0x110>
- .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 235,77 // jmp 4419 <_sk_gradient_hsw+0x110>
+ .byte 76,139,80,8 // mov 0x8(%rax),%r10
.byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9
- .byte 196,66,53,22,1 // vpermps (%r9),%ymm9,%ymm8
- .byte 76,139,64,40 // mov 0x28(%rax),%r8
- .byte 196,66,53,22,16 // vpermps (%r8),%ymm9,%ymm10
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 76,139,72,24 // mov 0x18(%rax),%r9
- .byte 196,194,53,22,8 // vpermps (%r8),%ymm9,%ymm1
- .byte 76,139,64,48 // mov 0x30(%rax),%r8
- .byte 196,66,53,22,24 // vpermps (%r8),%ymm9,%ymm11
- .byte 196,194,53,22,17 // vpermps (%r9),%ymm9,%ymm2
- .byte 76,139,64,56 // mov 0x38(%rax),%r8
- .byte 196,66,53,22,32 // vpermps (%r8),%ymm9,%ymm12
- .byte 76,139,64,32 // mov 0x20(%rax),%r8
- .byte 196,194,53,22,24 // vpermps (%r8),%ymm9,%ymm3
+ .byte 196,66,53,22,2 // vpermps (%r10),%ymm9,%ymm8
+ .byte 76,139,72,40 // mov 0x28(%rax),%r9
+ .byte 196,66,53,22,17 // vpermps (%r9),%ymm9,%ymm10
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
+ .byte 196,194,53,22,9 // vpermps (%r9),%ymm9,%ymm1
+ .byte 76,139,72,48 // mov 0x30(%rax),%r9
+ .byte 196,66,53,22,25 // vpermps (%r9),%ymm9,%ymm11
+ .byte 196,194,53,22,18 // vpermps (%r10),%ymm9,%ymm2
+ .byte 76,139,72,56 // mov 0x38(%rax),%r9
+ .byte 196,66,53,22,33 // vpermps (%r9),%ymm9,%ymm12
+ .byte 76,139,72,32 // mov 0x20(%rax),%r9
+ .byte 196,194,53,22,25 // vpermps (%r9),%ymm9,%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,98,53,22,40 // vpermps (%rax),%ymm9,%ymm13
.byte 196,66,125,168,194 // vfmadd213ps %ymm10,%ymm0,%ymm8
@@ -14034,24 +14102,24 @@ _sk_xy_to_unit_angle_hsw:
.byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12
.byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11
.byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12
- .byte 196,98,125,24,45,118,8,0,0 // vbroadcastss 0x876(%rip),%ymm13 # 4d30 <_sk_callback_hsw+0x46e>
- .byte 196,98,125,24,53,113,8,0,0 // vbroadcastss 0x871(%rip),%ymm14 # 4d34 <_sk_callback_hsw+0x472>
+ .byte 196,98,125,24,45,128,8,0,0 // vbroadcastss 0x880(%rip),%ymm13 # 4d34 <_sk_callback_hsw+0x478>
+ .byte 196,98,125,24,53,123,8,0,0 // vbroadcastss 0x87b(%rip),%ymm14 # 4d38 <_sk_callback_hsw+0x47c>
.byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14
- .byte 196,98,125,24,45,103,8,0,0 // vbroadcastss 0x867(%rip),%ymm13 # 4d38 <_sk_callback_hsw+0x476>
+ .byte 196,98,125,24,45,113,8,0,0 // vbroadcastss 0x871(%rip),%ymm13 # 4d3c <_sk_callback_hsw+0x480>
.byte 196,66,29,184,238 // vfmadd231ps %ymm14,%ymm12,%ymm13
- .byte 196,98,125,24,53,93,8,0,0 // vbroadcastss 0x85d(%rip),%ymm14 # 4d3c <_sk_callback_hsw+0x47a>
+ .byte 196,98,125,24,53,103,8,0,0 // vbroadcastss 0x867(%rip),%ymm14 # 4d40 <_sk_callback_hsw+0x484>
.byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14
.byte 196,65,36,89,222 // vmulps %ymm14,%ymm11,%ymm11
.byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,72,8,0,0 // vbroadcastss 0x848(%rip),%ymm10 # 4d40 <_sk_callback_hsw+0x47e>
+ .byte 196,98,125,24,21,82,8,0,0 // vbroadcastss 0x852(%rip),%ymm10 # 4d44 <_sk_callback_hsw+0x488>
.byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10
.byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9
.byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,21,50,8,0,0 // vbroadcastss 0x832(%rip),%ymm10 # 4d44 <_sk_callback_hsw+0x482>
+ .byte 196,98,125,24,21,60,8,0,0 // vbroadcastss 0x83c(%rip),%ymm10 # 4d48 <_sk_callback_hsw+0x48c>
.byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9
- .byte 196,98,125,24,21,28,8,0,0 // vbroadcastss 0x81c(%rip),%ymm10 # 4d48 <_sk_callback_hsw+0x486>
+ .byte 196,98,125,24,21,38,8,0,0 // vbroadcastss 0x826(%rip),%ymm10 # 4d4c <_sk_callback_hsw+0x490>
.byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10
.byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0
.byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9
@@ -14074,7 +14142,7 @@ HIDDEN _sk_save_xy_hsw
FUNCTION(_sk_save_xy_hsw)
_sk_save_xy_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,233,7,0,0 // vbroadcastss 0x7e9(%rip),%ymm8 # 4d4c <_sk_callback_hsw+0x48a>
+ .byte 196,98,125,24,5,243,7,0,0 // vbroadcastss 0x7f3(%rip),%ymm8 # 4d50 <_sk_callback_hsw+0x494>
.byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9
.byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
@@ -14108,9 +14176,9 @@ HIDDEN _sk_bilinear_nx_hsw
FUNCTION(_sk_bilinear_nx_hsw)
_sk_bilinear_nx_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,125,7,0,0 // vbroadcastss 0x77d(%rip),%ymm0 # 4d50 <_sk_callback_hsw+0x48e>
+ .byte 196,226,125,24,5,135,7,0,0 // vbroadcastss 0x787(%rip),%ymm0 # 4d54 <_sk_callback_hsw+0x498>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,116,7,0,0 // vbroadcastss 0x774(%rip),%ymm8 # 4d54 <_sk_callback_hsw+0x492>
+ .byte 196,98,125,24,5,126,7,0,0 // vbroadcastss 0x77e(%rip),%ymm8 # 4d58 <_sk_callback_hsw+0x49c>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14121,7 +14189,7 @@ HIDDEN _sk_bilinear_px_hsw
FUNCTION(_sk_bilinear_px_hsw)
_sk_bilinear_px_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,92,7,0,0 // vbroadcastss 0x75c(%rip),%ymm0 # 4d58 <_sk_callback_hsw+0x496>
+ .byte 196,226,125,24,5,102,7,0,0 // vbroadcastss 0x766(%rip),%ymm0 # 4d5c <_sk_callback_hsw+0x4a0>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -14133,9 +14201,9 @@ HIDDEN _sk_bilinear_ny_hsw
FUNCTION(_sk_bilinear_ny_hsw)
_sk_bilinear_ny_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,64,7,0,0 // vbroadcastss 0x740(%rip),%ymm1 # 4d5c <_sk_callback_hsw+0x49a>
+ .byte 196,226,125,24,13,74,7,0,0 // vbroadcastss 0x74a(%rip),%ymm1 # 4d60 <_sk_callback_hsw+0x4a4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,54,7,0,0 // vbroadcastss 0x736(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x49e>
+ .byte 196,98,125,24,5,64,7,0,0 // vbroadcastss 0x740(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x4a8>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14146,7 +14214,7 @@ HIDDEN _sk_bilinear_py_hsw
FUNCTION(_sk_bilinear_py_hsw)
_sk_bilinear_py_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,30,7,0,0 // vbroadcastss 0x71e(%rip),%ymm1 # 4d64 <_sk_callback_hsw+0x4a2>
+ .byte 196,226,125,24,13,40,7,0,0 // vbroadcastss 0x728(%rip),%ymm1 # 4d68 <_sk_callback_hsw+0x4ac>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -14158,13 +14226,13 @@ HIDDEN _sk_bicubic_n3x_hsw
FUNCTION(_sk_bicubic_n3x_hsw)
_sk_bicubic_n3x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,1,7,0,0 // vbroadcastss 0x701(%rip),%ymm0 # 4d68 <_sk_callback_hsw+0x4a6>
+ .byte 196,226,125,24,5,11,7,0,0 // vbroadcastss 0x70b(%rip),%ymm0 # 4d6c <_sk_callback_hsw+0x4b0>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,248,6,0,0 // vbroadcastss 0x6f8(%rip),%ymm8 # 4d6c <_sk_callback_hsw+0x4aa>
+ .byte 196,98,125,24,5,2,7,0,0 // vbroadcastss 0x702(%rip),%ymm8 # 4d70 <_sk_callback_hsw+0x4b4>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,233,6,0,0 // vbroadcastss 0x6e9(%rip),%ymm10 # 4d70 <_sk_callback_hsw+0x4ae>
- .byte 196,98,125,24,29,228,6,0,0 // vbroadcastss 0x6e4(%rip),%ymm11 # 4d74 <_sk_callback_hsw+0x4b2>
+ .byte 196,98,125,24,21,243,6,0,0 // vbroadcastss 0x6f3(%rip),%ymm10 # 4d74 <_sk_callback_hsw+0x4b8>
+ .byte 196,98,125,24,29,238,6,0,0 // vbroadcastss 0x6ee(%rip),%ymm11 # 4d78 <_sk_callback_hsw+0x4bc>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -14176,16 +14244,16 @@ HIDDEN _sk_bicubic_n1x_hsw
FUNCTION(_sk_bicubic_n1x_hsw)
_sk_bicubic_n1x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,199,6,0,0 // vbroadcastss 0x6c7(%rip),%ymm0 # 4d78 <_sk_callback_hsw+0x4b6>
+ .byte 196,226,125,24,5,209,6,0,0 // vbroadcastss 0x6d1(%rip),%ymm0 # 4d7c <_sk_callback_hsw+0x4c0>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,190,6,0,0 // vbroadcastss 0x6be(%rip),%ymm8 # 4d7c <_sk_callback_hsw+0x4ba>
+ .byte 196,98,125,24,5,200,6,0,0 // vbroadcastss 0x6c8(%rip),%ymm8 # 4d80 <_sk_callback_hsw+0x4c4>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,180,6,0,0 // vbroadcastss 0x6b4(%rip),%ymm9 # 4d80 <_sk_callback_hsw+0x4be>
- .byte 196,98,125,24,21,175,6,0,0 // vbroadcastss 0x6af(%rip),%ymm10 # 4d84 <_sk_callback_hsw+0x4c2>
+ .byte 196,98,125,24,13,190,6,0,0 // vbroadcastss 0x6be(%rip),%ymm9 # 4d84 <_sk_callback_hsw+0x4c8>
+ .byte 196,98,125,24,21,185,6,0,0 // vbroadcastss 0x6b9(%rip),%ymm10 # 4d88 <_sk_callback_hsw+0x4cc>
.byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,13,165,6,0,0 // vbroadcastss 0x6a5(%rip),%ymm9 # 4d88 <_sk_callback_hsw+0x4c6>
+ .byte 196,98,125,24,13,175,6,0,0 // vbroadcastss 0x6af(%rip),%ymm9 # 4d8c <_sk_callback_hsw+0x4d0>
.byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9
- .byte 196,98,125,24,21,155,6,0,0 // vbroadcastss 0x69b(%rip),%ymm10 # 4d8c <_sk_callback_hsw+0x4ca>
+ .byte 196,98,125,24,21,165,6,0,0 // vbroadcastss 0x6a5(%rip),%ymm10 # 4d90 <_sk_callback_hsw+0x4d4>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
.byte 197,124,17,144,128,0,0,0 // vmovups %ymm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14196,14 +14264,14 @@ HIDDEN _sk_bicubic_p1x_hsw
FUNCTION(_sk_bicubic_p1x_hsw)
_sk_bicubic_p1x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,131,6,0,0 // vbroadcastss 0x683(%rip),%ymm8 # 4d90 <_sk_callback_hsw+0x4ce>
+ .byte 196,98,125,24,5,141,6,0,0 // vbroadcastss 0x68d(%rip),%ymm8 # 4d94 <_sk_callback_hsw+0x4d8>
.byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0
.byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9
- .byte 196,98,125,24,21,117,6,0,0 // vbroadcastss 0x675(%rip),%ymm10 # 4d94 <_sk_callback_hsw+0x4d2>
- .byte 196,98,125,24,29,112,6,0,0 // vbroadcastss 0x670(%rip),%ymm11 # 4d98 <_sk_callback_hsw+0x4d6>
+ .byte 196,98,125,24,21,127,6,0,0 // vbroadcastss 0x67f(%rip),%ymm10 # 4d98 <_sk_callback_hsw+0x4dc>
+ .byte 196,98,125,24,29,122,6,0,0 // vbroadcastss 0x67a(%rip),%ymm11 # 4d9c <_sk_callback_hsw+0x4e0>
.byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11
.byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11
- .byte 196,98,125,24,5,97,6,0,0 // vbroadcastss 0x661(%rip),%ymm8 # 4d9c <_sk_callback_hsw+0x4da>
+ .byte 196,98,125,24,5,107,6,0,0 // vbroadcastss 0x66b(%rip),%ymm8 # 4da0 <_sk_callback_hsw+0x4e4>
.byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14214,12 +14282,12 @@ HIDDEN _sk_bicubic_p3x_hsw
FUNCTION(_sk_bicubic_p3x_hsw)
_sk_bicubic_p3x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,73,6,0,0 // vbroadcastss 0x649(%rip),%ymm0 # 4da0 <_sk_callback_hsw+0x4de>
+ .byte 196,226,125,24,5,83,6,0,0 // vbroadcastss 0x653(%rip),%ymm0 # 4da4 <_sk_callback_hsw+0x4e8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,54,6,0,0 // vbroadcastss 0x636(%rip),%ymm10 # 4da4 <_sk_callback_hsw+0x4e2>
- .byte 196,98,125,24,29,49,6,0,0 // vbroadcastss 0x631(%rip),%ymm11 # 4da8 <_sk_callback_hsw+0x4e6>
+ .byte 196,98,125,24,21,64,6,0,0 // vbroadcastss 0x640(%rip),%ymm10 # 4da8 <_sk_callback_hsw+0x4ec>
+ .byte 196,98,125,24,29,59,6,0,0 // vbroadcastss 0x63b(%rip),%ymm11 # 4dac <_sk_callback_hsw+0x4f0>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -14231,13 +14299,13 @@ HIDDEN _sk_bicubic_n3y_hsw
FUNCTION(_sk_bicubic_n3y_hsw)
_sk_bicubic_n3y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,20,6,0,0 // vbroadcastss 0x614(%rip),%ymm1 # 4dac <_sk_callback_hsw+0x4ea>
+ .byte 196,226,125,24,13,30,6,0,0 // vbroadcastss 0x61e(%rip),%ymm1 # 4db0 <_sk_callback_hsw+0x4f4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,10,6,0,0 // vbroadcastss 0x60a(%rip),%ymm8 # 4db0 <_sk_callback_hsw+0x4ee>
+ .byte 196,98,125,24,5,20,6,0,0 // vbroadcastss 0x614(%rip),%ymm8 # 4db4 <_sk_callback_hsw+0x4f8>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,251,5,0,0 // vbroadcastss 0x5fb(%rip),%ymm10 # 4db4 <_sk_callback_hsw+0x4f2>
- .byte 196,98,125,24,29,246,5,0,0 // vbroadcastss 0x5f6(%rip),%ymm11 # 4db8 <_sk_callback_hsw+0x4f6>
+ .byte 196,98,125,24,21,5,6,0,0 // vbroadcastss 0x605(%rip),%ymm10 # 4db8 <_sk_callback_hsw+0x4fc>
+ .byte 196,98,125,24,29,0,6,0,0 // vbroadcastss 0x600(%rip),%ymm11 # 4dbc <_sk_callback_hsw+0x500>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -14249,16 +14317,16 @@ HIDDEN _sk_bicubic_n1y_hsw
FUNCTION(_sk_bicubic_n1y_hsw)
_sk_bicubic_n1y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,217,5,0,0 // vbroadcastss 0x5d9(%rip),%ymm1 # 4dbc <_sk_callback_hsw+0x4fa>
+ .byte 196,226,125,24,13,227,5,0,0 // vbroadcastss 0x5e3(%rip),%ymm1 # 4dc0 <_sk_callback_hsw+0x504>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,207,5,0,0 // vbroadcastss 0x5cf(%rip),%ymm8 # 4dc0 <_sk_callback_hsw+0x4fe>
+ .byte 196,98,125,24,5,217,5,0,0 // vbroadcastss 0x5d9(%rip),%ymm8 # 4dc4 <_sk_callback_hsw+0x508>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,197,5,0,0 // vbroadcastss 0x5c5(%rip),%ymm9 # 4dc4 <_sk_callback_hsw+0x502>
- .byte 196,98,125,24,21,192,5,0,0 // vbroadcastss 0x5c0(%rip),%ymm10 # 4dc8 <_sk_callback_hsw+0x506>
+ .byte 196,98,125,24,13,207,5,0,0 // vbroadcastss 0x5cf(%rip),%ymm9 # 4dc8 <_sk_callback_hsw+0x50c>
+ .byte 196,98,125,24,21,202,5,0,0 // vbroadcastss 0x5ca(%rip),%ymm10 # 4dcc <_sk_callback_hsw+0x510>
.byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,13,182,5,0,0 // vbroadcastss 0x5b6(%rip),%ymm9 # 4dcc <_sk_callback_hsw+0x50a>
+ .byte 196,98,125,24,13,192,5,0,0 // vbroadcastss 0x5c0(%rip),%ymm9 # 4dd0 <_sk_callback_hsw+0x514>
.byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9
- .byte 196,98,125,24,21,172,5,0,0 // vbroadcastss 0x5ac(%rip),%ymm10 # 4dd0 <_sk_callback_hsw+0x50e>
+ .byte 196,98,125,24,21,182,5,0,0 // vbroadcastss 0x5b6(%rip),%ymm10 # 4dd4 <_sk_callback_hsw+0x518>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
.byte 197,124,17,144,160,0,0,0 // vmovups %ymm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14269,14 +14337,14 @@ HIDDEN _sk_bicubic_p1y_hsw
FUNCTION(_sk_bicubic_p1y_hsw)
_sk_bicubic_p1y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,148,5,0,0 // vbroadcastss 0x594(%rip),%ymm8 # 4dd4 <_sk_callback_hsw+0x512>
+ .byte 196,98,125,24,5,158,5,0,0 // vbroadcastss 0x59e(%rip),%ymm8 # 4dd8 <_sk_callback_hsw+0x51c>
.byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1
.byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9
- .byte 196,98,125,24,21,133,5,0,0 // vbroadcastss 0x585(%rip),%ymm10 # 4dd8 <_sk_callback_hsw+0x516>
- .byte 196,98,125,24,29,128,5,0,0 // vbroadcastss 0x580(%rip),%ymm11 # 4ddc <_sk_callback_hsw+0x51a>
+ .byte 196,98,125,24,21,143,5,0,0 // vbroadcastss 0x58f(%rip),%ymm10 # 4ddc <_sk_callback_hsw+0x520>
+ .byte 196,98,125,24,29,138,5,0,0 // vbroadcastss 0x58a(%rip),%ymm11 # 4de0 <_sk_callback_hsw+0x524>
.byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11
.byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11
- .byte 196,98,125,24,5,113,5,0,0 // vbroadcastss 0x571(%rip),%ymm8 # 4de0 <_sk_callback_hsw+0x51e>
+ .byte 196,98,125,24,5,123,5,0,0 // vbroadcastss 0x57b(%rip),%ymm8 # 4de4 <_sk_callback_hsw+0x528>
.byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -14287,12 +14355,12 @@ HIDDEN _sk_bicubic_p3y_hsw
FUNCTION(_sk_bicubic_p3y_hsw)
_sk_bicubic_p3y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,89,5,0,0 // vbroadcastss 0x559(%rip),%ymm1 # 4de4 <_sk_callback_hsw+0x522>
+ .byte 196,226,125,24,13,99,5,0,0 // vbroadcastss 0x563(%rip),%ymm1 # 4de8 <_sk_callback_hsw+0x52c>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,69,5,0,0 // vbroadcastss 0x545(%rip),%ymm10 # 4de8 <_sk_callback_hsw+0x526>
- .byte 196,98,125,24,29,64,5,0,0 // vbroadcastss 0x540(%rip),%ymm11 # 4dec <_sk_callback_hsw+0x52a>
+ .byte 196,98,125,24,21,79,5,0,0 // vbroadcastss 0x54f(%rip),%ymm10 # 4dec <_sk_callback_hsw+0x530>
+ .byte 196,98,125,24,29,74,5,0,0 // vbroadcastss 0x54a(%rip),%ymm11 # 4df0 <_sk_callback_hsw+0x534>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -14303,22 +14371,24 @@ HIDDEN _sk_callback_hsw
.globl _sk_callback_hsw
FUNCTION(_sk_callback_hsw)
_sk_callback_hsw:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 72,129,236,144,0,0,0 // sub $0x90,%rsp
+ .byte 72,129,236,136,0,0,0 // sub $0x88,%rsp
.byte 197,252,17,124,36,96 // vmovups %ymm7,0x60(%rsp)
.byte 197,252,17,116,36,64 // vmovups %ymm6,0x40(%rsp)
.byte 197,252,17,108,36,32 // vmovups %ymm5,0x20(%rsp)
.byte 197,252,17,36,36 // vmovups %ymm4,(%rsp)
- .byte 73,137,205 // mov %rcx,%r13
- .byte 73,137,214 // mov %rdx,%r14
- .byte 73,137,255 // mov %rdi,%r15
+ .byte 76,137,195 // mov %r8,%rbx
+ .byte 73,137,206 // mov %rcx,%r14
+ .byte 73,137,215 // mov %rdx,%r15
+ .byte 73,137,252 // mov %rdi,%r12
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,137,195 // mov %rax,%rbx
- .byte 73,137,244 // mov %rsi,%r12
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 73,137,245 // mov %rsi,%r13
.byte 197,252,20,225 // vunpcklps %ymm1,%ymm0,%ymm4
.byte 197,252,21,193 // vunpckhps %ymm1,%ymm0,%ymm0
.byte 197,236,20,203 // vunpcklps %ymm3,%ymm2,%ymm1
@@ -14331,17 +14401,17 @@ _sk_callback_hsw:
.byte 196,227,93,24,232,1 // vinsertf128 $0x1,%xmm0,%ymm4,%ymm5
.byte 196,227,101,6,201,49 // vperm2f128 $0x31,%ymm1,%ymm3,%ymm1
.byte 196,227,93,6,192,49 // vperm2f128 $0x31,%ymm0,%ymm4,%ymm0
- .byte 197,253,17,83,8 // vmovupd %ymm2,0x8(%rbx)
- .byte 197,253,17,107,40 // vmovupd %ymm5,0x28(%rbx)
- .byte 197,253,17,75,72 // vmovupd %ymm1,0x48(%rbx)
- .byte 197,253,17,67,104 // vmovupd %ymm0,0x68(%rbx)
- .byte 77,133,237 // test %r13,%r13
+ .byte 197,253,17,85,8 // vmovupd %ymm2,0x8(%rbp)
+ .byte 197,253,17,109,40 // vmovupd %ymm5,0x28(%rbp)
+ .byte 197,253,17,77,72 // vmovupd %ymm1,0x48(%rbp)
+ .byte 197,253,17,69,104 // vmovupd %ymm0,0x68(%rbp)
+ .byte 72,133,219 // test %rbx,%rbx
.byte 190,8,0,0,0 // mov $0x8,%esi
- .byte 65,15,69,245 // cmovne %r13d,%esi
- .byte 72,137,223 // mov %rbx,%rdi
+ .byte 15,69,243 // cmovne %ebx,%esi
+ .byte 72,137,239 // mov %rbp,%rdi
.byte 197,248,119 // vzeroupper
- .byte 255,19 // callq *(%rbx)
- .byte 72,139,131,136,0,0,0 // mov 0x88(%rbx),%rax
+ .byte 255,85,0 // callq *0x0(%rbp)
+ .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax
.byte 197,248,16,0 // vmovups (%rax),%xmm0
.byte 197,248,16,72,16 // vmovups 0x10(%rax),%xmm1
.byte 197,248,16,80,32 // vmovups 0x20(%rax),%xmm2
@@ -14358,21 +14428,23 @@ _sk_callback_hsw:
.byte 197,221,21,201 // vunpckhpd %ymm1,%ymm4,%ymm1
.byte 197,213,20,211 // vunpcklpd %ymm3,%ymm5,%ymm2
.byte 197,213,21,219 // vunpckhpd %ymm3,%ymm5,%ymm3
- .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,238 // mov %r13,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,255 // mov %r15,%rdi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,233 // mov %r13,%rcx
+ .byte 76,137,231 // mov %r12,%rdi
+ .byte 76,137,250 // mov %r15,%rdx
+ .byte 76,137,241 // mov %r14,%rcx
+ .byte 73,137,216 // mov %rbx,%r8
.byte 197,252,16,36,36 // vmovups (%rsp),%ymm4
.byte 197,252,16,108,36,32 // vmovups 0x20(%rsp),%ymm5
.byte 197,252,16,116,36,64 // vmovups 0x40(%rsp),%ymm6
.byte 197,252,16,124,36,96 // vmovups 0x60(%rsp),%ymm7
- .byte 72,129,196,144,0,0,0 // add $0x90,%rsp
+ .byte 72,129,196,136,0,0,0 // add $0x88,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
BALIGN4
@@ -14416,25 +14488,25 @@ BALIGN4
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 4a99 <.literal4+0xb1>
+ .byte 71,225,61 // rex.RXB loope 4a9d <.literal4+0xb1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 4aa9 <.literal4+0xc1>
+ .byte 71,225,61 // rex.RXB loope 4aad <.literal4+0xc1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 4ab9 <.literal4+0xd1>
+ .byte 71,225,61 // rex.RXB loope 4abd <.literal4+0xd1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 4ac9 <.literal4+0xe1>
+ .byte 71,225,61 // rex.RXB loope 4acd <.literal4+0xe1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
@@ -14484,7 +14556,7 @@ BALIGN4
.byte 190,129,128,128,59 // mov $0x3b808081,%esi
.byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 4b21 <.literal4+0x139>
+ .byte 224,7 // loopne 4b25 <.literal4+0x139>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -14500,10 +14572,10 @@ BALIGN4
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
.byte 0,52,255 // add %dh,(%rdi,%rdi,8)
.byte 255 // (bad)
- .byte 127,0 // jg 4b48 <.literal4+0x160>
+ .byte 127,0 // jg 4b4c <.literal4+0x160>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 4bc1 <.literal4+0x1d9>
+ .byte 119,115 // ja 4bc5 <.literal4+0x1d9>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -14517,10 +14589,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 4b7c <.literal4+0x194>
+ .byte 127,0 // jg 4b80 <.literal4+0x194>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 4bf5 <.literal4+0x20d>
+ .byte 119,115 // ja 4bf9 <.literal4+0x20d>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -14534,10 +14606,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 4bb0 <.literal4+0x1c8>
+ .byte 127,0 // jg 4bb4 <.literal4+0x1c8>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 4c29 <.literal4+0x241>
+ .byte 119,115 // ja 4c2d <.literal4+0x241>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -14551,10 +14623,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 4be4 <.literal4+0x1fc>
+ .byte 127,0 // jg 4be8 <.literal4+0x1fc>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 4c5d <.literal4+0x275>
+ .byte 119,115 // ja 4c61 <.literal4+0x275>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -14567,7 +14639,7 @@ BALIGN4
.byte 0,75,0 // add %cl,0x0(%rbx)
.byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax)
.byte 66,0,0 // rex.X add %al,(%rax)
- .byte 127,67 // jg 4c5b <.literal4+0x273>
+ .byte 127,67 // jg 4c5f <.literal4+0x273>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -14579,10 +14651,10 @@ BALIGN4
.byte 190,80,128,3,62 // mov $0x3e038050,%esi
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 4c7b <.literal4+0x293>
+ .byte 118,63 // jbe 4c7f <.literal4+0x293>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
- .byte 127,67 // jg 4c8f <.literal4+0x2a7>
+ .byte 127,67 // jg 4c93 <.literal4+0x2a7>
.byte 129,128,128,59,0,0,128,63,129,128 // addl $0x80813f80,0x3b80(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
@@ -14591,7 +14663,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 4c71 <.literal4+0x289>
+ .byte 224,7 // loopne 4c75 <.literal4+0x289>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -14603,7 +14675,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 4c8d <.literal4+0x2a5>
+ .byte 224,7 // loopne 4c91 <.literal4+0x2a5>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -14614,7 +14686,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 4ce2 <.literal4+0x2fa>
+ .byte 124,66 // jl 4ce6 <.literal4+0x2fa>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax)
@@ -14632,9 +14704,9 @@ BALIGN4
.byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax)
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax)
- .byte 112,65 // jo 4d25 <.literal4+0x33d>
+ .byte 112,65 // jo 4d29 <.literal4+0x33d>
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
- .byte 127,67 // jg 4d33 <.literal4+0x34b>
+ .byte 127,67 // jg 4d37 <.literal4+0x34b>
.byte 128,0,128 // addb $0x80,(%rax)
.byte 55 // (bad)
.byte 128,0,128 // addb $0x80,(%rax)
@@ -14642,7 +14714,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 4d47 <.literal4+0x35f>
+ .byte 127,71 // jg 4d4b <.literal4+0x35f>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,191,0,0,0 // add %al,0xbf(%rax)
@@ -14750,16 +14822,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e28 <_sk_callback_hsw+0xa000566>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e28 <_sk_callback_hsw+0xa00056c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e30 <_sk_callback_hsw+0x1200056e>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e30 <_sk_callback_hsw+0x12000574>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e38 <_sk_callback_hsw+0x1a000576>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e38 <_sk_callback_hsw+0x1a00057c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004e40 <_sk_callback_hsw+0x300057e>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004e40 <_sk_callback_hsw+0x3000584>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -14802,16 +14874,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e88 <_sk_callback_hsw+0xa0005c6>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e88 <_sk_callback_hsw+0xa0005cc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e90 <_sk_callback_hsw+0x120005ce>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e90 <_sk_callback_hsw+0x120005d4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e98 <_sk_callback_hsw+0x1a0005d6>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e98 <_sk_callback_hsw+0x1a0005dc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004ea0 <_sk_callback_hsw+0x30005de>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004ea0 <_sk_callback_hsw+0x30005e4>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -14854,16 +14926,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004ee8 <_sk_callback_hsw+0xa000626>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004ee8 <_sk_callback_hsw+0xa00062c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004ef0 <_sk_callback_hsw+0x1200062e>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004ef0 <_sk_callback_hsw+0x12000634>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004ef8 <_sk_callback_hsw+0x1a000636>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004ef8 <_sk_callback_hsw+0x1a00063c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f00 <_sk_callback_hsw+0x300063e>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f00 <_sk_callback_hsw+0x3000644>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -14906,16 +14978,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004f48 <_sk_callback_hsw+0xa000686>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004f48 <_sk_callback_hsw+0xa00068c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004f50 <_sk_callback_hsw+0x1200068e>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004f50 <_sk_callback_hsw+0x12000694>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004f58 <_sk_callback_hsw+0x1a000696>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004f58 <_sk_callback_hsw+0x1a00069c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f60 <_sk_callback_hsw+0x300069e>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f60 <_sk_callback_hsw+0x30006a4>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -14958,16 +15030,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004fa8 <_sk_callback_hsw+0xa0006e6>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004fa8 <_sk_callback_hsw+0xa0006ec>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004fb0 <_sk_callback_hsw+0x120006ee>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004fb0 <_sk_callback_hsw+0x120006f4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004fb8 <_sk_callback_hsw+0x1a0006f6>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004fb8 <_sk_callback_hsw+0x1a0006fc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004fc0 <_sk_callback_hsw+0x30006fe>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004fc0 <_sk_callback_hsw+0x3000704>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -15016,22 +15088,26 @@ HIDDEN _sk_start_pipeline_avx
.globl _sk_start_pipeline_avx
FUNCTION(_sk_start_pipeline_avx)
_sk_start_pipeline_avx:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 73,137,204 // mov %rcx,%r12
- .byte 73,137,214 // mov %rdx,%r14
+ .byte 80 // push %rax
+ .byte 77,137,198 // mov %r8,%r14
+ .byte 73,137,213 // mov %rdx,%r13
+ .byte 73,137,247 // mov %rsi,%r15
.byte 72,137,251 // mov %rdi,%rbx
+ .byte 72,137,206 // mov %rcx,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,247 // mov %rsi,%r15
+ .byte 73,137,244 // mov %rsi,%r12
.byte 72,141,75,8 // lea 0x8(%rbx),%rcx
- .byte 76,57,225 // cmp %r12,%rcx
- .byte 118,5 // jbe 25 <_sk_start_pipeline_avx+0x25>
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 235,71 // jmp 6c <_sk_start_pipeline_avx+0x6c>
- .byte 185,0,0,0,0 // mov $0x0,%ecx
+ .byte 76,57,233 // cmp %r13,%rcx
+ .byte 118,5 // jbe 2d <_sk_start_pipeline_avx+0x2d>
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 235,74 // jmp 77 <_sk_start_pipeline_avx+0x77>
+ .byte 65,184,0,0,0,0 // mov $0x0,%r8d
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -15040,19 +15116,20 @@ _sk_start_pipeline_avx:
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
.byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6
.byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 73,137,197 // mov %rax,%r13
- .byte 65,255,213 // callq *%r13
- .byte 76,137,232 // mov %r13,%rax
- .byte 72,141,123,8 // lea 0x8(%rbx),%rdi
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 255,213 // callq *%rbp
+ .byte 72,137,232 // mov %rbp,%rax
+ .byte 72,141,83,8 // lea 0x8(%rbx),%rdx
.byte 72,131,195,16 // add $0x10,%rbx
- .byte 76,57,227 // cmp %r12,%rbx
- .byte 72,137,251 // mov %rdi,%rbx
- .byte 118,185 // jbe 25 <_sk_start_pipeline_avx+0x25>
- .byte 73,41,252 // sub %rdi,%r12
- .byte 116,52 // je a5 <_sk_start_pipeline_avx+0xa5>
+ .byte 76,57,235 // cmp %r13,%rbx
+ .byte 72,137,211 // mov %rdx,%rbx
+ .byte 118,182 // jbe 2d <_sk_start_pipeline_avx+0x2d>
+ .byte 73,41,213 // sub %rdx,%r13
+ .byte 116,60 // je b8 <_sk_start_pipeline_avx+0xb8>
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -15061,20 +15138,25 @@ _sk_start_pipeline_avx:
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
.byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6
.byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,225 // mov %r12,%rcx
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 77,137,232 // mov %r13,%r8
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 197,248,119 // vzeroupper
.byte 195 // retq
@@ -15088,19 +15170,20 @@ HIDDEN _sk_seed_shader_avx
.globl _sk_seed_shader_avx
FUNCTION(_sk_seed_shader_avx)
_sk_seed_shader_avx:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 197,249,110,199 // vmovd %edi,%xmm0
+ .byte 197,249,110,194 // vmovd %edx,%xmm0
.byte 197,249,112,192,0 // vpshufd $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,211,100,0,0 // vbroadcastss 0x64d3(%rip),%ymm1 # 65a4 <_sk_callback_avx+0x128>
+ .byte 196,226,125,24,13,17,101,0,0 // vbroadcastss 0x6511(%rip),%ymm1 # 65f8 <_sk_callback_avx+0x130>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
- .byte 197,252,88,2 // vaddps (%rdx),%ymm0,%ymm0
- .byte 196,226,125,24,16 // vbroadcastss (%rax),%ymm2
+ .byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0
+ .byte 197,249,110,209 // vmovd %ecx,%xmm2
+ .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
+ .byte 196,227,109,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,21,183,100,0,0 // vbroadcastss 0x64b7(%rip),%ymm2 # 65a8 <_sk_callback_avx+0x12c>
+ .byte 196,226,125,24,21,235,100,0,0 // vbroadcastss 0x64eb(%rip),%ymm2 # 65fc <_sk_callback_avx+0x134>
.byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
@@ -15113,17 +15196,18 @@ HIDDEN _sk_dither_avx
FUNCTION(_sk_dither_avx)
_sk_dither_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 197,124,16,66,32 // vmovups 0x20(%rdx),%ymm8
+ .byte 197,124,16,71,32 // vmovups 0x20(%rdi),%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
- .byte 197,121,110,215 // vmovd %edi,%xmm10
+ .byte 197,121,110,210 // vmovd %edx,%xmm10
.byte 196,65,121,112,210,0 // vpshufd $0x0,%xmm10,%xmm10
.byte 196,65,49,254,202 // vpaddd %xmm10,%xmm9,%xmm9
.byte 196,65,57,254,194 // vpaddd %xmm10,%xmm8,%xmm8
.byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- .byte 76,139,0 // mov (%rax),%r8
- .byte 196,66,125,24,8 // vbroadcastss (%r8),%ymm9
- .byte 196,65,60,87,209 // vxorps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,29,104,100,0,0 // vbroadcastss 0x6468(%rip),%ymm11 # 65ac <_sk_callback_avx+0x130>
+ .byte 197,121,110,201 // vmovd %ecx,%xmm9
+ .byte 196,65,121,112,201,0 // vpshufd $0x0,%xmm9,%xmm9
+ .byte 196,67,53,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
+ .byte 196,65,52,87,208 // vxorps %ymm8,%ymm9,%ymm10
+ .byte 196,98,125,24,29,148,100,0,0 // vbroadcastss 0x6494(%rip),%ymm11 # 6600 <_sk_callback_avx+0x138>
.byte 196,65,44,84,203 // vandps %ymm11,%ymm10,%ymm9
.byte 196,193,25,114,241,5 // vpslld $0x5,%xmm9,%xmm12
.byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9
@@ -15134,8 +15218,8 @@ _sk_dither_avx:
.byte 196,67,125,25,219,1 // vextractf128 $0x1,%ymm11,%xmm11
.byte 196,193,33,114,243,4 // vpslld $0x4,%xmm11,%xmm11
.byte 196,67,29,24,219,1 // vinsertf128 $0x1,%xmm11,%ymm12,%ymm11
- .byte 196,98,125,24,37,41,100,0,0 // vbroadcastss 0x6429(%rip),%ymm12 # 65b0 <_sk_callback_avx+0x134>
- .byte 196,98,125,24,45,36,100,0,0 // vbroadcastss 0x6424(%rip),%ymm13 # 65b4 <_sk_callback_avx+0x138>
+ .byte 196,98,125,24,37,85,100,0,0 // vbroadcastss 0x6455(%rip),%ymm12 # 6604 <_sk_callback_avx+0x13c>
+ .byte 196,98,125,24,45,80,100,0,0 // vbroadcastss 0x6450(%rip),%ymm13 # 6608 <_sk_callback_avx+0x140>
.byte 196,65,44,84,245 // vandps %ymm13,%ymm10,%ymm14
.byte 196,193,1,114,246,2 // vpslld $0x2,%xmm14,%xmm15
.byte 196,67,125,25,246,1 // vextractf128 $0x1,%ymm14,%xmm14
@@ -15158,15 +15242,15 @@ _sk_dither_avx:
.byte 196,67,29,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm12,%ymm8
.byte 196,65,20,86,219 // vorps %ymm11,%ymm13,%ymm11
.byte 196,65,36,86,192 // vorps %ymm8,%ymm11,%ymm8
+ .byte 196,65,52,86,206 // vorps %ymm14,%ymm9,%ymm9
.byte 196,65,60,86,193 // vorps %ymm9,%ymm8,%ymm8
- .byte 196,65,12,86,202 // vorps %ymm10,%ymm14,%ymm9
- .byte 196,65,60,86,193 // vorps %ymm9,%ymm8,%ymm8
+ .byte 196,65,60,86,194 // vorps %ymm10,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,143,99,0,0 // vbroadcastss 0x638f(%rip),%ymm9 # 65b8 <_sk_callback_avx+0x13c>
+ .byte 196,98,125,24,13,187,99,0,0 // vbroadcastss 0x63bb(%rip),%ymm9 # 660c <_sk_callback_avx+0x144>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,133,99,0,0 // vbroadcastss 0x6385(%rip),%ymm9 # 65bc <_sk_callback_avx+0x140>
+ .byte 196,98,125,24,13,177,99,0,0 // vbroadcastss 0x63b1(%rip),%ymm9 # 6610 <_sk_callback_avx+0x148>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,72,8 // vbroadcastss 0x8(%rax),%ymm9
+ .byte 196,98,125,24,8 // vbroadcastss (%rax),%ymm9
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,188,88,192 // vaddps %ymm0,%ymm8,%ymm0
.byte 197,188,88,201 // vaddps %ymm1,%ymm8,%ymm1
@@ -15233,7 +15317,7 @@ HIDDEN _sk_srcatop_avx
FUNCTION(_sk_srcatop_avx)
_sk_srcatop_avx:
.byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0
- .byte 196,98,125,24,5,220,98,0,0 // vbroadcastss 0x62dc(%rip),%ymm8 # 65c0 <_sk_callback_avx+0x144>
+ .byte 196,98,125,24,5,9,99,0,0 // vbroadcastss 0x6309(%rip),%ymm8 # 6614 <_sk_callback_avx+0x14c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -15254,7 +15338,7 @@ HIDDEN _sk_dstatop_avx
FUNCTION(_sk_dstatop_avx)
_sk_dstatop_avx:
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
- .byte 196,98,125,24,13,158,98,0,0 // vbroadcastss 0x629e(%rip),%ymm9 # 65c4 <_sk_callback_avx+0x148>
+ .byte 196,98,125,24,13,203,98,0,0 // vbroadcastss 0x62cb(%rip),%ymm9 # 6618 <_sk_callback_avx+0x150>
.byte 197,52,92,207 // vsubps %ymm7,%ymm9,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,188,88,192 // vaddps %ymm0,%ymm8,%ymm0
@@ -15296,7 +15380,7 @@ HIDDEN _sk_srcout_avx
.globl _sk_srcout_avx
FUNCTION(_sk_srcout_avx)
_sk_srcout_avx:
- .byte 196,98,125,24,5,61,98,0,0 // vbroadcastss 0x623d(%rip),%ymm8 # 65c8 <_sk_callback_avx+0x14c>
+ .byte 196,98,125,24,5,106,98,0,0 // vbroadcastss 0x626a(%rip),%ymm8 # 661c <_sk_callback_avx+0x154>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -15309,7 +15393,7 @@ HIDDEN _sk_dstout_avx
.globl _sk_dstout_avx
FUNCTION(_sk_dstout_avx)
_sk_dstout_avx:
- .byte 196,226,125,24,5,32,98,0,0 // vbroadcastss 0x6220(%rip),%ymm0 # 65cc <_sk_callback_avx+0x150>
+ .byte 196,226,125,24,5,77,98,0,0 // vbroadcastss 0x624d(%rip),%ymm0 # 6620 <_sk_callback_avx+0x158>
.byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3
.byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0
.byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1
@@ -15322,7 +15406,7 @@ HIDDEN _sk_srcover_avx
.globl _sk_srcover_avx
FUNCTION(_sk_srcover_avx)
_sk_srcover_avx:
- .byte 196,98,125,24,5,3,98,0,0 // vbroadcastss 0x6203(%rip),%ymm8 # 65d0 <_sk_callback_avx+0x154>
+ .byte 196,98,125,24,5,48,98,0,0 // vbroadcastss 0x6230(%rip),%ymm8 # 6624 <_sk_callback_avx+0x15c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -15339,7 +15423,7 @@ HIDDEN _sk_dstover_avx
.globl _sk_dstover_avx
FUNCTION(_sk_dstover_avx)
_sk_dstover_avx:
- .byte 196,98,125,24,5,214,97,0,0 // vbroadcastss 0x61d6(%rip),%ymm8 # 65d4 <_sk_callback_avx+0x158>
+ .byte 196,98,125,24,5,3,98,0,0 // vbroadcastss 0x6203(%rip),%ymm8 # 6628 <_sk_callback_avx+0x160>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,252,88,196 // vaddps %ymm4,%ymm0,%ymm0
@@ -15367,7 +15451,7 @@ HIDDEN _sk_multiply_avx
.globl _sk_multiply_avx
FUNCTION(_sk_multiply_avx)
_sk_multiply_avx:
- .byte 196,98,125,24,5,149,97,0,0 // vbroadcastss 0x6195(%rip),%ymm8 # 65d8 <_sk_callback_avx+0x15c>
+ .byte 196,98,125,24,5,194,97,0,0 // vbroadcastss 0x61c2(%rip),%ymm8 # 662c <_sk_callback_avx+0x164>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -15427,7 +15511,7 @@ HIDDEN _sk_xor__avx
.globl _sk_xor__avx
FUNCTION(_sk_xor__avx)
_sk_xor__avx:
- .byte 196,98,125,24,5,228,96,0,0 // vbroadcastss 0x60e4(%rip),%ymm8 # 65dc <_sk_callback_avx+0x160>
+ .byte 196,98,125,24,5,17,97,0,0 // vbroadcastss 0x6111(%rip),%ymm8 # 6630 <_sk_callback_avx+0x168>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -15464,7 +15548,7 @@ _sk_darken_avx:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,100,96,0,0 // vbroadcastss 0x6064(%rip),%ymm8 # 65e0 <_sk_callback_avx+0x164>
+ .byte 196,98,125,24,5,145,96,0,0 // vbroadcastss 0x6091(%rip),%ymm8 # 6634 <_sk_callback_avx+0x16c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -15490,7 +15574,7 @@ _sk_lighten_avx:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,16,96,0,0 // vbroadcastss 0x6010(%rip),%ymm8 # 65e4 <_sk_callback_avx+0x168>
+ .byte 196,98,125,24,5,61,96,0,0 // vbroadcastss 0x603d(%rip),%ymm8 # 6638 <_sk_callback_avx+0x170>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -15519,7 +15603,7 @@ _sk_difference_avx:
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,176,95,0,0 // vbroadcastss 0x5fb0(%rip),%ymm8 # 65e8 <_sk_callback_avx+0x16c>
+ .byte 196,98,125,24,5,221,95,0,0 // vbroadcastss 0x5fdd(%rip),%ymm8 # 663c <_sk_callback_avx+0x174>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -15542,7 +15626,7 @@ _sk_exclusion_avx:
.byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,107,95,0,0 // vbroadcastss 0x5f6b(%rip),%ymm8 # 65ec <_sk_callback_avx+0x170>
+ .byte 196,98,125,24,5,152,95,0,0 // vbroadcastss 0x5f98(%rip),%ymm8 # 6640 <_sk_callback_avx+0x178>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -15553,7 +15637,7 @@ HIDDEN _sk_colorburn_avx
.globl _sk_colorburn_avx
FUNCTION(_sk_colorburn_avx)
_sk_colorburn_avx:
- .byte 196,98,125,24,5,86,95,0,0 // vbroadcastss 0x5f56(%rip),%ymm8 # 65f0 <_sk_callback_avx+0x174>
+ .byte 196,98,125,24,5,131,95,0,0 // vbroadcastss 0x5f83(%rip),%ymm8 # 6644 <_sk_callback_avx+0x17c>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11
.byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10
@@ -15615,7 +15699,7 @@ HIDDEN _sk_colordodge_avx
FUNCTION(_sk_colordodge_avx)
_sk_colordodge_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,13,82,94,0,0 // vbroadcastss 0x5e52(%rip),%ymm9 # 65f4 <_sk_callback_avx+0x178>
+ .byte 196,98,125,24,13,127,94,0,0 // vbroadcastss 0x5e7f(%rip),%ymm9 # 6648 <_sk_callback_avx+0x180>
.byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9
@@ -15672,7 +15756,7 @@ HIDDEN _sk_hardlight_avx
.globl _sk_hardlight_avx
FUNCTION(_sk_hardlight_avx)
_sk_hardlight_avx:
- .byte 196,98,125,24,5,100,93,0,0 // vbroadcastss 0x5d64(%rip),%ymm8 # 65f8 <_sk_callback_avx+0x17c>
+ .byte 196,98,125,24,5,145,93,0,0 // vbroadcastss 0x5d91(%rip),%ymm8 # 664c <_sk_callback_avx+0x184>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -15727,7 +15811,7 @@ HIDDEN _sk_overlay_avx
.globl _sk_overlay_avx
FUNCTION(_sk_overlay_avx)
_sk_overlay_avx:
- .byte 196,98,125,24,5,141,92,0,0 // vbroadcastss 0x5c8d(%rip),%ymm8 # 65fc <_sk_callback_avx+0x180>
+ .byte 196,98,125,24,5,186,92,0,0 // vbroadcastss 0x5cba(%rip),%ymm8 # 6650 <_sk_callback_avx+0x188>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -15793,10 +15877,10 @@ _sk_softlight_avx:
.byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8
.byte 196,65,60,89,216 // vmulps %ymm8,%ymm8,%ymm11
.byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8
- .byte 196,98,125,24,29,132,91,0,0 // vbroadcastss 0x5b84(%rip),%ymm11 # 6604 <_sk_callback_avx+0x188>
+ .byte 196,98,125,24,29,177,91,0,0 // vbroadcastss 0x5bb1(%rip),%ymm11 # 6658 <_sk_callback_avx+0x190>
.byte 196,65,28,88,235 // vaddps %ymm11,%ymm12,%ymm13
.byte 196,65,20,89,192 // vmulps %ymm8,%ymm13,%ymm8
- .byte 196,98,125,24,45,117,91,0,0 // vbroadcastss 0x5b75(%rip),%ymm13 # 6608 <_sk_callback_avx+0x18c>
+ .byte 196,98,125,24,45,162,91,0,0 // vbroadcastss 0x5ba2(%rip),%ymm13 # 665c <_sk_callback_avx+0x194>
.byte 196,65,28,89,245 // vmulps %ymm13,%ymm12,%ymm14
.byte 196,65,12,88,192 // vaddps %ymm8,%ymm14,%ymm8
.byte 196,65,124,82,244 // vrsqrtps %ymm12,%ymm14
@@ -15807,7 +15891,7 @@ _sk_softlight_avx:
.byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15
.byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14
.byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15
- .byte 196,98,125,24,5,51,91,0,0 // vbroadcastss 0x5b33(%rip),%ymm8 # 6600 <_sk_callback_avx+0x184>
+ .byte 196,98,125,24,5,96,91,0,0 // vbroadcastss 0x5b60(%rip),%ymm8 # 6654 <_sk_callback_avx+0x18c>
.byte 196,65,60,92,228 // vsubps %ymm12,%ymm8,%ymm12
.byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0
.byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12
@@ -15934,12 +16018,12 @@ _sk_hue_avx:
.byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11
.byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11
.byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- .byte 196,98,125,24,53,2,89,0,0 // vbroadcastss 0x5902(%rip),%ymm14 # 660c <_sk_callback_avx+0x190>
+ .byte 196,98,125,24,53,47,89,0,0 // vbroadcastss 0x592f(%rip),%ymm14 # 6660 <_sk_callback_avx+0x198>
.byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11
- .byte 196,98,125,24,61,248,88,0,0 // vbroadcastss 0x58f8(%rip),%ymm15 # 6610 <_sk_callback_avx+0x194>
+ .byte 196,98,125,24,61,37,89,0,0 // vbroadcastss 0x5925(%rip),%ymm15 # 6664 <_sk_callback_avx+0x19c>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
- .byte 196,226,125,24,5,233,88,0,0 // vbroadcastss 0x58e9(%rip),%ymm0 # 6614 <_sk_callback_avx+0x198>
+ .byte 196,226,125,24,5,22,89,0,0 // vbroadcastss 0x5916(%rip),%ymm0 # 6668 <_sk_callback_avx+0x1a0>
.byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
.byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13
@@ -16000,7 +16084,7 @@ _sk_hue_avx:
.byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10
.byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,194,87,0,0 // vbroadcastss 0x57c2(%rip),%ymm8 # 6618 <_sk_callback_avx+0x19c>
+ .byte 196,98,125,24,5,239,87,0,0 // vbroadcastss 0x57ef(%rip),%ymm8 # 666c <_sk_callback_avx+0x1a4>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -16057,12 +16141,12 @@ _sk_saturation_avx:
.byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11
.byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11
.byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- .byte 196,98,125,24,53,208,86,0,0 // vbroadcastss 0x56d0(%rip),%ymm14 # 661c <_sk_callback_avx+0x1a0>
+ .byte 196,98,125,24,53,253,86,0,0 // vbroadcastss 0x56fd(%rip),%ymm14 # 6670 <_sk_callback_avx+0x1a8>
.byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11
- .byte 196,98,125,24,61,198,86,0,0 // vbroadcastss 0x56c6(%rip),%ymm15 # 6620 <_sk_callback_avx+0x1a4>
+ .byte 196,98,125,24,61,243,86,0,0 // vbroadcastss 0x56f3(%rip),%ymm15 # 6674 <_sk_callback_avx+0x1ac>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
- .byte 196,226,125,24,5,183,86,0,0 // vbroadcastss 0x56b7(%rip),%ymm0 # 6624 <_sk_callback_avx+0x1a8>
+ .byte 196,226,125,24,5,228,86,0,0 // vbroadcastss 0x56e4(%rip),%ymm0 # 6678 <_sk_callback_avx+0x1b0>
.byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
.byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13
@@ -16123,7 +16207,7 @@ _sk_saturation_avx:
.byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10
.byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,144,85,0,0 // vbroadcastss 0x5590(%rip),%ymm8 # 6628 <_sk_callback_avx+0x1ac>
+ .byte 196,98,125,24,5,189,85,0,0 // vbroadcastss 0x55bd(%rip),%ymm8 # 667c <_sk_callback_avx+0x1b4>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -16152,12 +16236,12 @@ _sk_color_avx:
.byte 197,252,17,68,36,168 // vmovups %ymm0,-0x58(%rsp)
.byte 197,124,89,199 // vmulps %ymm7,%ymm0,%ymm8
.byte 197,116,89,207 // vmulps %ymm7,%ymm1,%ymm9
- .byte 196,98,125,24,45,38,85,0,0 // vbroadcastss 0x5526(%rip),%ymm13 # 662c <_sk_callback_avx+0x1b0>
+ .byte 196,98,125,24,45,83,85,0,0 // vbroadcastss 0x5553(%rip),%ymm13 # 6680 <_sk_callback_avx+0x1b8>
.byte 196,65,92,89,213 // vmulps %ymm13,%ymm4,%ymm10
- .byte 196,98,125,24,53,28,85,0,0 // vbroadcastss 0x551c(%rip),%ymm14 # 6630 <_sk_callback_avx+0x1b4>
+ .byte 196,98,125,24,53,73,85,0,0 // vbroadcastss 0x5549(%rip),%ymm14 # 6684 <_sk_callback_avx+0x1bc>
.byte 196,65,84,89,222 // vmulps %ymm14,%ymm5,%ymm11
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,61,13,85,0,0 // vbroadcastss 0x550d(%rip),%ymm15 # 6634 <_sk_callback_avx+0x1b8>
+ .byte 196,98,125,24,61,58,85,0,0 // vbroadcastss 0x553a(%rip),%ymm15 # 6688 <_sk_callback_avx+0x1c0>
.byte 196,65,76,89,223 // vmulps %ymm15,%ymm6,%ymm11
.byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0
.byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11
@@ -16220,7 +16304,7 @@ _sk_color_avx:
.byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9
.byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0
.byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8
- .byte 196,226,125,24,5,212,83,0,0 // vbroadcastss 0x53d4(%rip),%ymm0 # 6638 <_sk_callback_avx+0x1bc>
+ .byte 196,226,125,24,5,1,84,0,0 // vbroadcastss 0x5401(%rip),%ymm0 # 668c <_sk_callback_avx+0x1c4>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,84,36,168 // vmulps -0x58(%rsp),%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -16250,12 +16334,12 @@ _sk_luminosity_avx:
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
.byte 197,100,89,205 // vmulps %ymm5,%ymm3,%ymm9
- .byte 196,98,125,24,45,102,83,0,0 // vbroadcastss 0x5366(%rip),%ymm13 # 663c <_sk_callback_avx+0x1c0>
+ .byte 196,98,125,24,45,147,83,0,0 // vbroadcastss 0x5393(%rip),%ymm13 # 6690 <_sk_callback_avx+0x1c8>
.byte 196,65,108,89,213 // vmulps %ymm13,%ymm2,%ymm10
- .byte 196,98,125,24,53,92,83,0,0 // vbroadcastss 0x535c(%rip),%ymm14 # 6640 <_sk_callback_avx+0x1c4>
+ .byte 196,98,125,24,53,137,83,0,0 // vbroadcastss 0x5389(%rip),%ymm14 # 6694 <_sk_callback_avx+0x1cc>
.byte 196,65,116,89,222 // vmulps %ymm14,%ymm1,%ymm11
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,61,77,83,0,0 // vbroadcastss 0x534d(%rip),%ymm15 # 6644 <_sk_callback_avx+0x1c8>
+ .byte 196,98,125,24,61,122,83,0,0 // vbroadcastss 0x537a(%rip),%ymm15 # 6698 <_sk_callback_avx+0x1d0>
.byte 196,65,28,89,223 // vmulps %ymm15,%ymm12,%ymm11
.byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0
.byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11
@@ -16318,7 +16402,7 @@ _sk_luminosity_avx:
.byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9
.byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0
.byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8
- .byte 196,226,125,24,5,20,82,0,0 // vbroadcastss 0x5214(%rip),%ymm0 # 6648 <_sk_callback_avx+0x1cc>
+ .byte 196,226,125,24,5,65,82,0,0 // vbroadcastss 0x5241(%rip),%ymm0 # 669c <_sk_callback_avx+0x1d4>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -16342,14 +16426,14 @@ HIDDEN _sk_srcover_rgba_8888_avx
.globl _sk_srcover_rgba_8888_avx
FUNCTION(_sk_srcover_rgba_8888_avx)
_sk_srcover_rgba_8888_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,43,1,0,0 // jne 15c3 <_sk_srcover_rgba_8888_avx+0x144>
- .byte 196,193,124,16,57 // vmovups (%r9),%ymm7
- .byte 197,124,40,13,219,85,0,0 // vmovaps 0x55db(%rip),%ymm9 # 6a80 <_sk_callback_avx+0x604>
+ .byte 15,133,43,1,0,0 // jne 15ea <_sk_srcover_rgba_8888_avx+0x144>
+ .byte 196,193,124,16,58 // vmovups (%r10),%ymm7
+ .byte 197,124,40,13,20,86,0,0 // vmovaps 0x5614(%rip),%ymm9 # 6ae0 <_sk_callback_avx+0x618>
.byte 196,193,68,84,225 // vandps %ymm9,%ymm7,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
.byte 197,209,114,215,8 // vpsrld $0x8,%xmm7,%xmm5
@@ -16367,9 +16451,9 @@ _sk_srcover_rgba_8888_avx:
.byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7
.byte 196,227,53,24,255,1 // vinsertf128 $0x1,%xmm7,%ymm9,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,70,81,0,0 // vbroadcastss 0x5146(%rip),%ymm8 # 664c <_sk_callback_avx+0x1d0>
+ .byte 196,98,125,24,5,115,81,0,0 // vbroadcastss 0x5173(%rip),%ymm8 # 66a0 <_sk_callback_avx+0x1d8>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
- .byte 196,98,125,24,13,61,81,0,0 // vbroadcastss 0x513d(%rip),%ymm9 # 6650 <_sk_callback_avx+0x1d4>
+ .byte 196,98,125,24,13,106,81,0,0 // vbroadcastss 0x516a(%rip),%ymm9 # 66a4 <_sk_callback_avx+0x1dc>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 197,60,89,212 // vmulps %ymm4,%ymm8,%ymm10
.byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0
@@ -16402,10 +16486,10 @@ _sk_srcover_rgba_8888_avx:
.byte 196,65,53,86,202 // vorpd %ymm10,%ymm9,%ymm9
.byte 196,65,61,86,193 // vorpd %ymm9,%ymm8,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,87 // jne 160e <_sk_srcover_rgba_8888_avx+0x18f>
- .byte 196,65,124,17,1 // vmovups %ymm8,(%r9)
+ .byte 117,87 // jne 1635 <_sk_srcover_rgba_8888_avx+0x18f>
+ .byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -16414,13 +16498,13 @@ _sk_srcover_rgba_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,121,48,228 // vpmovzxbw %xmm4,%xmm4
- .byte 196,226,89,0,45,245,83,0,0 // vpshufb 0x53f5(%rip),%xmm4,%xmm5 # 69e0 <_sk_callback_avx+0x564>
+ .byte 196,226,89,0,45,30,84,0,0 // vpshufb 0x541e(%rip),%xmm4,%xmm5 # 6a30 <_sk_callback_avx+0x568>
.byte 196,226,121,33,237 // vpmovsxbd %xmm5,%xmm5
- .byte 196,226,89,0,37,247,83,0,0 // vpshufb 0x53f7(%rip),%xmm4,%xmm4 # 69f0 <_sk_callback_avx+0x574>
+ .byte 196,226,89,0,37,32,84,0,0 // vpshufb 0x5420(%rip),%xmm4,%xmm4 # 6a40 <_sk_callback_avx+0x578>
.byte 196,226,121,33,228 // vpmovsxbd %xmm4,%xmm4
.byte 196,227,85,24,228,1 // vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
- .byte 196,194,93,44,57 // vmaskmovps (%r9),%ymm4,%ymm7
- .byte 233,143,254,255,255 // jmpq 149d <_sk_srcover_rgba_8888_avx+0x1e>
+ .byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
+ .byte 233,143,254,255,255 // jmpq 14c4 <_sk_srcover_rgba_8888_avx+0x1e>
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
.byte 192,225,3 // shl $0x3,%cl
@@ -16428,13 +16512,13 @@ _sk_srcover_rgba_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,170,83,0,0 // vpshufb 0x53aa(%rip),%xmm9,%xmm10 # 69e0 <_sk_callback_avx+0x564>
+ .byte 196,98,49,0,21,211,83,0,0 // vpshufb 0x53d3(%rip),%xmm9,%xmm10 # 6a30 <_sk_callback_avx+0x568>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,172,83,0,0 // vpshufb 0x53ac(%rip),%xmm9,%xmm9 # 69f0 <_sk_callback_avx+0x574>
+ .byte 196,98,49,0,13,213,83,0,0 // vpshufb 0x53d5(%rip),%xmm9,%xmm9 # 6a40 <_sk_callback_avx+0x578>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- .byte 196,66,53,46,1 // vmaskmovps %ymm8,%ymm9,(%r9)
- .byte 233,99,255,255,255 // jmpq 15bc <_sk_srcover_rgba_8888_avx+0x13d>
+ .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
+ .byte 233,99,255,255,255 // jmpq 15e3 <_sk_srcover_rgba_8888_avx+0x13d>
HIDDEN _sk_clamp_0_avx
.globl _sk_clamp_0_avx
@@ -16452,7 +16536,7 @@ HIDDEN _sk_clamp_1_avx
.globl _sk_clamp_1_avx
FUNCTION(_sk_clamp_1_avx)
_sk_clamp_1_avx:
- .byte 196,98,125,24,5,213,79,0,0 // vbroadcastss 0x4fd5(%rip),%ymm8 # 6654 <_sk_callback_avx+0x1d8>
+ .byte 196,98,125,24,5,2,80,0,0 // vbroadcastss 0x5002(%rip),%ymm8 # 66a8 <_sk_callback_avx+0x1e0>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
@@ -16464,7 +16548,7 @@ HIDDEN _sk_clamp_a_avx
.globl _sk_clamp_a_avx
FUNCTION(_sk_clamp_a_avx)
_sk_clamp_a_avx:
- .byte 196,98,125,24,5,184,79,0,0 // vbroadcastss 0x4fb8(%rip),%ymm8 # 6658 <_sk_callback_avx+0x1dc>
+ .byte 196,98,125,24,5,229,79,0,0 // vbroadcastss 0x4fe5(%rip),%ymm8 # 66ac <_sk_callback_avx+0x1e4>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0
.byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1
@@ -16550,7 +16634,7 @@ FUNCTION(_sk_unpremul_avx)
_sk_unpremul_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9
- .byte 196,98,125,24,21,0,79,0,0 // vbroadcastss 0x4f00(%rip),%ymm10 # 665c <_sk_callback_avx+0x1e0>
+ .byte 196,98,125,24,21,45,79,0,0 // vbroadcastss 0x4f2d(%rip),%ymm10 # 66b0 <_sk_callback_avx+0x1e8>
.byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10
.byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
@@ -16563,17 +16647,17 @@ HIDDEN _sk_from_srgb_avx
.globl _sk_from_srgb_avx
FUNCTION(_sk_from_srgb_avx)
_sk_from_srgb_avx:
- .byte 196,98,125,24,5,225,78,0,0 // vbroadcastss 0x4ee1(%rip),%ymm8 # 6660 <_sk_callback_avx+0x1e4>
+ .byte 196,98,125,24,5,14,79,0,0 // vbroadcastss 0x4f0e(%rip),%ymm8 # 66b4 <_sk_callback_avx+0x1ec>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10
- .byte 196,98,125,24,29,211,78,0,0 // vbroadcastss 0x4ed3(%rip),%ymm11 # 6664 <_sk_callback_avx+0x1e8>
+ .byte 196,98,125,24,29,0,79,0,0 // vbroadcastss 0x4f00(%rip),%ymm11 # 66b8 <_sk_callback_avx+0x1f0>
.byte 196,65,124,89,227 // vmulps %ymm11,%ymm0,%ymm12
- .byte 196,98,125,24,45,201,78,0,0 // vbroadcastss 0x4ec9(%rip),%ymm13 # 6668 <_sk_callback_avx+0x1ec>
+ .byte 196,98,125,24,45,246,78,0,0 // vbroadcastss 0x4ef6(%rip),%ymm13 # 66bc <_sk_callback_avx+0x1f4>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,44,89,212 // vmulps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,186,78,0,0 // vbroadcastss 0x4eba(%rip),%ymm12 # 666c <_sk_callback_avx+0x1f0>
+ .byte 196,98,125,24,37,231,78,0,0 // vbroadcastss 0x4ee7(%rip),%ymm12 # 66c0 <_sk_callback_avx+0x1f8>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,53,176,78,0,0 // vbroadcastss 0x4eb0(%rip),%ymm14 # 6670 <_sk_callback_avx+0x1f4>
+ .byte 196,98,125,24,53,221,78,0,0 // vbroadcastss 0x4edd(%rip),%ymm14 # 66c4 <_sk_callback_avx+0x1fc>
.byte 196,193,124,194,198,1 // vcmpltps %ymm14,%ymm0,%ymm0
.byte 196,195,45,74,193,0 // vblendvps %ymm0,%ymm9,%ymm10,%ymm0
.byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9
@@ -16600,20 +16684,20 @@ HIDDEN _sk_to_srgb_avx
FUNCTION(_sk_to_srgb_avx)
_sk_to_srgb_avx:
.byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9
- .byte 196,98,125,24,5,69,78,0,0 // vbroadcastss 0x4e45(%rip),%ymm8 # 6674 <_sk_callback_avx+0x1f8>
+ .byte 196,98,125,24,5,114,78,0,0 // vbroadcastss 0x4e72(%rip),%ymm8 # 66c8 <_sk_callback_avx+0x200>
.byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10
- .byte 196,98,125,24,29,59,78,0,0 // vbroadcastss 0x4e3b(%rip),%ymm11 # 6678 <_sk_callback_avx+0x1fc>
+ .byte 196,98,125,24,29,104,78,0,0 // vbroadcastss 0x4e68(%rip),%ymm11 # 66cc <_sk_callback_avx+0x204>
.byte 196,65,52,89,227 // vmulps %ymm11,%ymm9,%ymm12
- .byte 196,98,125,24,45,49,78,0,0 // vbroadcastss 0x4e31(%rip),%ymm13 # 667c <_sk_callback_avx+0x200>
+ .byte 196,98,125,24,45,94,78,0,0 // vbroadcastss 0x4e5e(%rip),%ymm13 # 66d0 <_sk_callback_avx+0x208>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,52,89,228 // vmulps %ymm12,%ymm9,%ymm12
- .byte 196,98,125,24,53,34,78,0,0 // vbroadcastss 0x4e22(%rip),%ymm14 # 6680 <_sk_callback_avx+0x204>
+ .byte 196,98,125,24,53,79,78,0,0 // vbroadcastss 0x4e4f(%rip),%ymm14 # 66d4 <_sk_callback_avx+0x20c>
.byte 196,65,28,88,230 // vaddps %ymm14,%ymm12,%ymm12
- .byte 196,98,125,24,61,24,78,0,0 // vbroadcastss 0x4e18(%rip),%ymm15 # 6684 <_sk_callback_avx+0x208>
+ .byte 196,98,125,24,61,69,78,0,0 // vbroadcastss 0x4e45(%rip),%ymm15 # 66d8 <_sk_callback_avx+0x210>
.byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9
.byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9
.byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9
- .byte 196,98,125,24,37,4,78,0,0 // vbroadcastss 0x4e04(%rip),%ymm12 # 6688 <_sk_callback_avx+0x20c>
+ .byte 196,98,125,24,37,49,78,0,0 // vbroadcastss 0x4e31(%rip),%ymm12 # 66dc <_sk_callback_avx+0x214>
.byte 196,193,124,194,196,1 // vcmpltps %ymm12,%ymm0,%ymm0
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9
@@ -16650,7 +16734,7 @@ _sk_rgb_to_hsl_avx:
.byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9
.byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9
.byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,29,106,77,0,0 // vbroadcastss 0x4d6a(%rip),%ymm11 # 668c <_sk_callback_avx+0x210>
+ .byte 196,98,125,24,29,151,77,0,0 // vbroadcastss 0x4d97(%rip),%ymm11 # 66e0 <_sk_callback_avx+0x218>
.byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11
.byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12
.byte 196,65,28,89,227 // vmulps %ymm11,%ymm12,%ymm12
@@ -16660,19 +16744,19 @@ _sk_rgb_to_hsl_avx:
.byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2
.byte 197,252,92,201 // vsubps %ymm1,%ymm0,%ymm1
.byte 196,193,116,89,203 // vmulps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,67,77,0,0 // vbroadcastss 0x4d43(%rip),%ymm11 # 6698 <_sk_callback_avx+0x21c>
+ .byte 196,98,125,24,29,112,77,0,0 // vbroadcastss 0x4d70(%rip),%ymm11 # 66ec <_sk_callback_avx+0x224>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,49,77,0,0 // vbroadcastss 0x4d31(%rip),%ymm11 # 6694 <_sk_callback_avx+0x218>
+ .byte 196,98,125,24,29,94,77,0,0 // vbroadcastss 0x4d5e(%rip),%ymm11 # 66e8 <_sk_callback_avx+0x220>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,227,117,74,202,224 // vblendvps %ymm14,%ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,25,77,0,0 // vbroadcastss 0x4d19(%rip),%ymm2 # 6690 <_sk_callback_avx+0x214>
+ .byte 196,226,125,24,21,70,77,0,0 // vbroadcastss 0x4d46(%rip),%ymm2 # 66e4 <_sk_callback_avx+0x21c>
.byte 196,65,12,87,246 // vxorps %ymm14,%ymm14,%ymm14
.byte 196,227,13,74,210,208 // vblendvps %ymm13,%ymm2,%ymm14,%ymm2
.byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0
.byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2
.byte 196,227,117,74,194,0 // vblendvps %ymm0,%ymm2,%ymm1,%ymm0
.byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1
- .byte 196,98,125,24,37,0,77,0,0 // vbroadcastss 0x4d00(%rip),%ymm12 # 66a0 <_sk_callback_avx+0x224>
+ .byte 196,98,125,24,37,45,77,0,0 // vbroadcastss 0x4d2d(%rip),%ymm12 # 66f4 <_sk_callback_avx+0x22c>
.byte 196,193,116,89,212 // vmulps %ymm12,%ymm1,%ymm2
.byte 197,28,194,226,1 // vcmpltps %ymm2,%ymm12,%ymm12
.byte 196,65,36,92,216 // vsubps %ymm8,%ymm11,%ymm11
@@ -16682,7 +16766,7 @@ _sk_rgb_to_hsl_avx:
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 196,195,125,74,198,128 // vblendvps %ymm8,%ymm14,%ymm0,%ymm0
.byte 196,195,117,74,206,128 // vblendvps %ymm8,%ymm14,%ymm1,%ymm1
- .byte 196,98,125,24,5,195,76,0,0 // vbroadcastss 0x4cc3(%rip),%ymm8 # 669c <_sk_callback_avx+0x220>
+ .byte 196,98,125,24,5,240,76,0,0 // vbroadcastss 0x4cf0(%rip),%ymm8 # 66f0 <_sk_callback_avx+0x228>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -16699,7 +16783,7 @@ _sk_hsl_to_rgb_avx:
.byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp)
.byte 197,252,40,225 // vmovaps %ymm1,%ymm4
.byte 197,252,40,216 // vmovaps %ymm0,%ymm3
- .byte 196,98,125,24,5,144,76,0,0 // vbroadcastss 0x4c90(%rip),%ymm8 # 66a4 <_sk_callback_avx+0x228>
+ .byte 196,98,125,24,5,189,76,0,0 // vbroadcastss 0x4cbd(%rip),%ymm8 # 66f8 <_sk_callback_avx+0x230>
.byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9
.byte 197,92,89,210 // vmulps %ymm2,%ymm4,%ymm10
.byte 196,65,92,92,218 // vsubps %ymm10,%ymm4,%ymm11
@@ -16707,23 +16791,23 @@ _sk_hsl_to_rgb_avx:
.byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10
.byte 197,108,88,202 // vaddps %ymm2,%ymm2,%ymm9
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,29,106,76,0,0 // vbroadcastss 0x4c6a(%rip),%ymm11 # 66a8 <_sk_callback_avx+0x22c>
+ .byte 196,98,125,24,29,151,76,0,0 // vbroadcastss 0x4c97(%rip),%ymm11 # 66fc <_sk_callback_avx+0x234>
.byte 196,65,100,88,219 // vaddps %ymm11,%ymm3,%ymm11
.byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12
.byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15
.byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11
- .byte 196,98,125,24,37,84,76,0,0 // vbroadcastss 0x4c54(%rip),%ymm12 # 66b0 <_sk_callback_avx+0x234>
+ .byte 196,98,125,24,37,129,76,0,0 // vbroadcastss 0x4c81(%rip),%ymm12 # 6704 <_sk_callback_avx+0x23c>
.byte 196,193,4,89,196 // vmulps %ymm12,%ymm15,%ymm0
- .byte 196,98,125,24,45,74,76,0,0 // vbroadcastss 0x4c4a(%rip),%ymm13 # 66b4 <_sk_callback_avx+0x238>
+ .byte 196,98,125,24,45,119,76,0,0 // vbroadcastss 0x4c77(%rip),%ymm13 # 6708 <_sk_callback_avx+0x240>
.byte 197,20,92,240 // vsubps %ymm0,%ymm13,%ymm14
.byte 196,65,36,89,246 // vmulps %ymm14,%ymm11,%ymm14
.byte 196,65,52,88,246 // vaddps %ymm14,%ymm9,%ymm14
- .byte 196,226,125,24,13,43,76,0,0 // vbroadcastss 0x4c2b(%rip),%ymm1 # 66ac <_sk_callback_avx+0x230>
+ .byte 196,226,125,24,13,88,76,0,0 // vbroadcastss 0x4c58(%rip),%ymm1 # 6700 <_sk_callback_avx+0x238>
.byte 196,193,116,194,255,2 // vcmpleps %ymm15,%ymm1,%ymm7
.byte 196,195,13,74,249,112 // vblendvps %ymm7,%ymm9,%ymm14,%ymm7
.byte 196,65,60,194,247,2 // vcmpleps %ymm15,%ymm8,%ymm14
.byte 196,227,45,74,255,224 // vblendvps %ymm14,%ymm7,%ymm10,%ymm7
- .byte 196,98,125,24,53,22,76,0,0 // vbroadcastss 0x4c16(%rip),%ymm14 # 66b8 <_sk_callback_avx+0x23c>
+ .byte 196,98,125,24,53,67,76,0,0 // vbroadcastss 0x4c43(%rip),%ymm14 # 670c <_sk_callback_avx+0x244>
.byte 196,65,12,194,255,2 // vcmpleps %ymm15,%ymm14,%ymm15
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -16742,7 +16826,7 @@ _sk_hsl_to_rgb_avx:
.byte 197,164,89,247 // vmulps %ymm7,%ymm11,%ymm6
.byte 197,180,88,246 // vaddps %ymm6,%ymm9,%ymm6
.byte 196,227,77,74,237,0 // vblendvps %ymm0,%ymm5,%ymm6,%ymm5
- .byte 196,226,125,24,5,184,75,0,0 // vbroadcastss 0x4bb8(%rip),%ymm0 # 66bc <_sk_callback_avx+0x240>
+ .byte 196,226,125,24,5,229,75,0,0 // vbroadcastss 0x4be5(%rip),%ymm0 # 6710 <_sk_callback_avx+0x248>
.byte 197,228,88,192 // vaddps %ymm0,%ymm3,%ymm0
.byte 196,227,125,8,216,1 // vroundps $0x1,%ymm0,%ymm3
.byte 197,252,92,195 // vsubps %ymm3,%ymm0,%ymm0
@@ -16789,39 +16873,41 @@ HIDDEN _sk_scale_u8_avx
.globl _sk_scale_u8_avx
FUNCTION(_sk_scale_u8_avx)
_sk_scale_u8_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,68 // jne 1bfb <_sk_scale_u8_avx+0x54>
+ .byte 117,68 // jne 1c22 <_sk_scale_u8_avx+0x54>
.byte 197,122,126,0 // vmovq (%rax),%xmm8
.byte 196,66,121,49,200 // vpmovzxbd %xmm8,%xmm9
.byte 196,67,121,4,192,229 // vpermilps $0xe5,%xmm8,%xmm8
.byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8
.byte 196,67,53,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm9,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,225,74,0,0 // vbroadcastss 0x4ae1(%rip),%ymm9 # 66c0 <_sk_callback_avx+0x244>
+ .byte 196,98,125,24,13,14,75,0,0 // vbroadcastss 0x4b0e(%rip),%ymm9 # 6714 <_sk_callback_avx+0x24c>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
.byte 197,188,89,219 // vmulps %ymm3,%ymm8,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 1c03 <_sk_scale_u8_avx+0x5c>
- .byte 196,65,249,110,193 // vmovq %r9,%xmm8
- .byte 235,155 // jmp 1bbb <_sk_scale_u8_avx+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 1c2b <_sk_scale_u8_avx+0x5d>
+ .byte 196,65,249,110,194 // vmovq %r10,%xmm8
+ .byte 91 // pop %rbx
+ .byte 235,154 // jmp 1be2 <_sk_scale_u8_avx+0x14>
HIDDEN _sk_lerp_1_float_avx
.globl _sk_lerp_1_float_avx
@@ -16848,19 +16934,19 @@ HIDDEN _sk_lerp_u8_avx
.globl _sk_lerp_u8_avx
FUNCTION(_sk_lerp_u8_avx)
_sk_lerp_u8_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,104 // jne 1cd7 <_sk_lerp_u8_avx+0x78>
+ .byte 117,104 // jne 1cff <_sk_lerp_u8_avx+0x78>
.byte 197,122,126,0 // vmovq (%rax),%xmm8
.byte 196,66,121,49,200 // vpmovzxbd %xmm8,%xmm9
.byte 196,67,121,4,192,229 // vpermilps $0xe5,%xmm8,%xmm8
.byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8
.byte 196,67,53,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm9,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,45,74,0,0 // vbroadcastss 0x4a2d(%rip),%ymm9 # 66c4 <_sk_callback_avx+0x248>
+ .byte 196,98,125,24,13,89,74,0,0 // vbroadcastss 0x4a59(%rip),%ymm9 # 6718 <_sk_callback_avx+0x250>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
@@ -16875,48 +16961,50 @@ _sk_lerp_u8_avx:
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 197,228,88,223 // vaddps %ymm7,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 1cdf <_sk_lerp_u8_avx+0x80>
- .byte 196,65,249,110,193 // vmovq %r9,%xmm8
- .byte 233,116,255,255,255 // jmpq 1c73 <_sk_lerp_u8_avx+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 1d08 <_sk_lerp_u8_avx+0x81>
+ .byte 196,65,249,110,194 // vmovq %r10,%xmm8
+ .byte 91 // pop %rbx
+ .byte 233,115,255,255,255 // jmpq 1c9b <_sk_lerp_u8_avx+0x14>
HIDDEN _sk_lerp_565_avx
.globl _sk_lerp_565_avx
FUNCTION(_sk_lerp_565_avx)
_sk_lerp_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,208,0,0,0 // jne 1ddd <_sk_lerp_565_avx+0xde>
- .byte 196,65,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm8
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,208,0,0,0 // jne 1e06 <_sk_lerp_565_avx+0xde>
+ .byte 196,65,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 196,65,57,105,201 // vpunpckhwd %xmm9,%xmm8,%xmm9
.byte 196,66,121,51,192 // vpmovzxwd %xmm8,%xmm8
.byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,151,73,0,0 // vbroadcastss 0x4997(%rip),%ymm9 # 66c8 <_sk_callback_avx+0x24c>
+ .byte 196,98,125,24,13,194,73,0,0 // vbroadcastss 0x49c2(%rip),%ymm9 # 671c <_sk_callback_avx+0x254>
.byte 196,65,60,84,201 // vandps %ymm9,%ymm8,%ymm9
.byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9
- .byte 196,98,125,24,21,136,73,0,0 // vbroadcastss 0x4988(%rip),%ymm10 # 66cc <_sk_callback_avx+0x250>
+ .byte 196,98,125,24,21,179,73,0,0 // vbroadcastss 0x49b3(%rip),%ymm10 # 6720 <_sk_callback_avx+0x258>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,126,73,0,0 // vbroadcastss 0x497e(%rip),%ymm10 # 66d0 <_sk_callback_avx+0x254>
+ .byte 196,98,125,24,21,169,73,0,0 // vbroadcastss 0x49a9(%rip),%ymm10 # 6724 <_sk_callback_avx+0x25c>
.byte 196,65,60,84,210 // vandps %ymm10,%ymm8,%ymm10
.byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10
- .byte 196,98,125,24,29,111,73,0,0 // vbroadcastss 0x496f(%rip),%ymm11 # 66d4 <_sk_callback_avx+0x258>
+ .byte 196,98,125,24,29,154,73,0,0 // vbroadcastss 0x499a(%rip),%ymm11 # 6728 <_sk_callback_avx+0x260>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,29,101,73,0,0 // vbroadcastss 0x4965(%rip),%ymm11 # 66d8 <_sk_callback_avx+0x25c>
+ .byte 196,98,125,24,29,144,73,0,0 // vbroadcastss 0x4990(%rip),%ymm11 # 672c <_sk_callback_avx+0x264>
.byte 196,65,60,84,195 // vandps %ymm11,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,29,86,73,0,0 // vbroadcastss 0x4956(%rip),%ymm11 # 66dc <_sk_callback_avx+0x260>
+ .byte 196,98,125,24,29,129,73,0,0 // vbroadcastss 0x4981(%rip),%ymm11 # 6730 <_sk_callback_avx+0x268>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
@@ -16938,46 +17026,47 @@ _sk_lerp_565_avx:
.byte 197,180,95,219 // vmaxps %ymm3,%ymm9,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 15,135,29,255,255,255 // ja 1d13 <_sk_lerp_565_avx+0x14>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,75,0,0,0 // lea 0x4b(%rip),%r9 # 1e4c <_sk_lerp_565_avx+0x14d>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 15,135,29,255,255,255 // ja 1d3c <_sk_lerp_565_avx+0x14>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 1e74 <_sk_lerp_565_avx+0x14c>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8
- .byte 196,65,57,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm8,%xmm8
- .byte 196,65,57,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm8,%xmm8
- .byte 233,200,254,255,255 // jmpq 1d13 <_sk_lerp_565_avx+0x14>
- .byte 144 // nop
- .byte 243,255 // repz (bad)
+ .byte 196,65,57,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 196,65,57,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8
+ .byte 233,200,254,255,255 // jmpq 1d3c <_sk_lerp_565_avx+0x14>
+ .byte 244 // hlt
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 235,255 // jmp 1e51 <_sk_lerp_565_avx+0x152>
.byte 255 // (bad)
- .byte 255,227 // jmpq *%rbx
+ .byte 236 // in (%dx),%al
.byte 255 // (bad)
.byte 255 // (bad)
+ .byte 255,228 // jmpq *%rsp
.byte 255 // (bad)
- .byte 219,255 // (bad)
.byte 255 // (bad)
- .byte 255,211 // callq *%rbx
.byte 255 // (bad)
+ .byte 220,255 // fdivr %st,%st(7)
.byte 255 // (bad)
- .byte 255,203 // dec %ebx
+ .byte 255,212 // callq *%rsp
.byte 255 // (bad)
.byte 255 // (bad)
+ .byte 255,204 // dec %esp
.byte 255 // (bad)
- .byte 190 // .byte 0xbe
+ .byte 255 // (bad)
+ .byte 255 // (bad)
+ .byte 191 // .byte 0xbf
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -16986,156 +17075,143 @@ HIDDEN _sk_load_tables_avx
.globl _sk_load_tables_avx
FUNCTION(_sk_load_tables_avx)
_sk_load_tables_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 83 // push %rbx
+ .byte 197,252,17,124,36,208 // vmovups %ymm7,-0x30(%rsp)
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,26,2,0,0 // jne 209b <_sk_load_tables_avx+0x233>
- .byte 196,65,124,16,17 // vmovups (%r9),%ymm10
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
- .byte 197,124,40,13,8,76,0,0 // vmovaps 0x4c08(%rip),%ymm9 # 6aa0 <_sk_callback_avx+0x624>
- .byte 196,193,44,84,193 // vandps %ymm9,%ymm10,%ymm0
- .byte 196,193,249,126,193 // vmovq %xmm0,%r9
- .byte 69,137,203 // mov %r9d,%r11d
+ .byte 15,133,248,1,0,0 // jne 20a8 <_sk_load_tables_avx+0x218>
+ .byte 196,65,124,16,18 // vmovups (%r10),%ymm10
+ .byte 197,124,40,13,67,76,0,0 // vmovaps 0x4c43(%rip),%ymm9 # 6b00 <_sk_callback_avx+0x638>
+ .byte 196,193,44,84,201 // vandps %ymm9,%ymm10,%ymm1
+ .byte 196,227,125,25,200,1 // vextractf128 $0x1,%ymm1,%xmm0
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 72,139,88,8 // mov 0x8(%rax),%rbx
+ .byte 196,161,122,16,20,147 // vmovss (%rbx,%r10,4),%xmm2
.byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
- .byte 69,137,214 // mov %r10d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 196,163,105,33,4,155,16 // vinsertps $0x10,(%rbx,%r11,4),%xmm2,%xmm0
+ .byte 68,137,209 // mov %r10d,%ecx
+ .byte 196,227,121,33,4,139,32 // vinsertps $0x20,(%rbx,%rcx,4),%xmm0,%xmm0
+ .byte 196,193,249,126,203 // vmovq %xmm1,%r11
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 73,193,233,32 // shr $0x20,%r9
- .byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
- .byte 196,227,249,22,193,1 // vpextrq $0x1,%xmm0,%rcx
- .byte 65,137,205 // mov %ecx,%r13d
+ .byte 196,35,121,33,44,147,48 // vinsertps $0x30,(%rbx,%r10,4),%xmm0,%xmm13
+ .byte 68,137,217 // mov %r11d,%ecx
+ .byte 197,250,16,20,139 // vmovss (%rbx,%rcx,4),%xmm2
+ .byte 196,227,249,22,201,1 // vpextrq $0x1,%xmm1,%rcx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 196,163,105,33,12,155,16 // vinsertps $0x10,(%rbx,%r11,4),%xmm2,%xmm1
+ .byte 65,137,202 // mov %ecx,%r10d
.byte 72,193,233,32 // shr $0x20,%rcx
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 72,139,104,8 // mov 0x8(%rax),%rbp
- .byte 76,139,96,16 // mov 0x10(%rax),%r12
- .byte 196,161,122,16,68,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm0
- .byte 196,227,121,33,68,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm0,%xmm0
- .byte 196,163,121,33,68,173,0,32 // vinsertps $0x20,0x0(%rbp,%r13,4),%xmm0,%xmm0
- .byte 196,227,121,33,68,141,0,48 // vinsertps $0x30,0x0(%rbp,%rcx,4),%xmm0,%xmm0
- .byte 196,161,122,16,76,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm1
- .byte 196,163,113,33,76,141,0,16 // vinsertps $0x10,0x0(%rbp,%r9,4),%xmm1,%xmm1
- .byte 196,163,113,33,76,181,0,32 // vinsertps $0x20,0x0(%rbp,%r14,4),%xmm1,%xmm1
- .byte 196,163,113,33,76,149,0,48 // vinsertps $0x30,0x0(%rbp,%r10,4),%xmm1,%xmm1
- .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- .byte 196,193,113,114,210,8 // vpsrld $0x8,%xmm10,%xmm1
+ .byte 196,163,113,33,12,147,32 // vinsertps $0x20,(%rbx,%r10,4),%xmm1,%xmm1
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
+ .byte 196,99,113,33,36,139,48 // vinsertps $0x30,(%rbx,%rcx,4),%xmm1,%xmm12
+ .byte 196,193,105,114,210,8 // vpsrld $0x8,%xmm10,%xmm2
.byte 196,67,125,25,208,1 // vextractf128 $0x1,%ymm10,%xmm8
- .byte 196,193,105,114,208,8 // vpsrld $0x8,%xmm8,%xmm2
- .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- .byte 196,193,116,84,201 // vandps %ymm9,%ymm1,%ymm1
- .byte 196,193,249,126,201 // vmovq %xmm1,%r9
- .byte 69,137,203 // mov %r9d,%r11d
- .byte 196,195,249,22,202,1 // vpextrq $0x1,%xmm1,%r10
- .byte 69,137,214 // mov %r10d,%r14d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 73,193,233,32 // shr $0x20,%r9
- .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
- .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
- .byte 196,227,249,22,205,1 // vpextrq $0x1,%xmm1,%rbp
- .byte 137,233 // mov %ebp,%ecx
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,129,122,16,12,188 // vmovss (%r12,%r15,4),%xmm1
- .byte 196,195,113,33,12,156,16 // vinsertps $0x10,(%r12,%rbx,4),%xmm1,%xmm1
- .byte 196,193,122,16,20,140 // vmovss (%r12,%rcx,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,193,122,16,20,172 // vmovss (%r12,%rbp,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,129,122,16,20,156 // vmovss (%r12,%r11,4),%xmm2
- .byte 196,131,105,33,20,140,16 // vinsertps $0x10,(%r12,%r9,4),%xmm2,%xmm2
- .byte 196,129,122,16,28,180 // vmovss (%r12,%r14,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,129,122,16,28,148 // vmovss (%r12,%r10,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,227,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
- .byte 72,139,64,24 // mov 0x18(%rax),%rax
- .byte 196,193,105,114,210,16 // vpsrld $0x10,%xmm10,%xmm2
- .byte 196,193,97,114,208,16 // vpsrld $0x10,%xmm8,%xmm3
- .byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
- .byte 196,193,108,84,209 // vandps %ymm9,%ymm2,%ymm2
- .byte 196,193,249,126,209 // vmovq %xmm2,%r9
- .byte 69,137,202 // mov %r9d,%r10d
- .byte 196,227,249,22,209,1 // vpextrq $0x1,%xmm2,%rcx
- .byte 65,137,203 // mov %ecx,%r11d
+ .byte 196,193,121,114,208,8 // vpsrld $0x8,%xmm8,%xmm0
+ .byte 196,227,109,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm2,%ymm0
+ .byte 196,193,124,84,209 // vandps %ymm9,%ymm0,%ymm2
+ .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0
+ .byte 196,225,249,126,193 // vmovq %xmm0,%rcx
+ .byte 137,203 // mov %ecx,%ebx
+ .byte 196,193,122,16,12,154 // vmovss (%r10,%rbx,4),%xmm1
+ .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
.byte 72,193,233,32 // shr $0x20,%rcx
- .byte 73,193,233,32 // shr $0x20,%r9
- .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2
- .byte 196,225,249,126,213 // vmovq %xmm2,%rbp
- .byte 65,137,238 // mov %ebp,%r14d
+ .byte 196,67,113,33,52,138,16 // vinsertps $0x10,(%r10,%rcx,4),%xmm1,%xmm14
+ .byte 137,217 // mov %ebx,%ecx
+ .byte 196,193,122,16,28,138 // vmovss (%r10,%rcx,4),%xmm3
+ .byte 196,225,249,126,209 // vmovq %xmm2,%rcx
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,122,16,12,154 // vmovss (%r10,%rbx,4),%xmm1
+ .byte 137,203 // mov %ecx,%ebx
+ .byte 196,193,122,16,4,154 // vmovss (%r10,%rbx,4),%xmm0
.byte 196,227,249,22,211,1 // vpextrq $0x1,%xmm2,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
+ .byte 72,193,233,32 // shr $0x20,%rcx
+ .byte 196,67,121,33,28,138,16 // vinsertps $0x10,(%r10,%rcx,4),%xmm0,%xmm11
+ .byte 137,217 // mov %ebx,%ecx
+ .byte 196,65,122,16,60,138 // vmovss (%r10,%rcx,4),%xmm15
+ .byte 196,195,29,24,197,1 // vinsertf128 $0x1,%xmm13,%ymm12,%ymm0
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,161,122,16,20,176 // vmovss (%rax,%r14,4),%xmm2
- .byte 196,227,105,33,20,168,16 // vinsertps $0x10,(%rax,%rbp,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,184 // vmovss (%rax,%r15,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
+ .byte 196,227,9,33,219,32 // vinsertps $0x20,%xmm3,%xmm14,%xmm3
+ .byte 196,227,97,33,249,48 // vinsertps $0x30,%xmm1,%xmm3,%xmm7
+ .byte 196,65,122,16,52,154 // vmovss (%r10,%rbx,4),%xmm14
+ .byte 72,139,64,24 // mov 0x18(%rax),%rax
+ .byte 196,193,97,114,210,16 // vpsrld $0x10,%xmm10,%xmm3
+ .byte 196,193,105,114,208,16 // vpsrld $0x10,%xmm8,%xmm2
+ .byte 196,227,101,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm3,%ymm2
+ .byte 196,65,108,84,201 // vandps %ymm9,%ymm2,%ymm9
+ .byte 196,99,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm2
+ .byte 196,225,249,126,209 // vmovq %xmm2,%rcx
+ .byte 137,203 // mov %ecx,%ebx
.byte 197,250,16,28,152 // vmovss (%rax,%rbx,4),%xmm3
- .byte 196,99,105,33,203,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm9
- .byte 196,161,122,16,28,144 // vmovss (%rax,%r10,4),%xmm3
- .byte 196,163,97,33,28,136,16 // vinsertps $0x10,(%rax,%r9,4),%xmm3,%xmm3
- .byte 196,161,122,16,20,152 // vmovss (%rax,%r11,4),%xmm2
- .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
+ .byte 196,227,249,22,211,1 // vpextrq $0x1,%xmm2,%rbx
+ .byte 72,193,233,32 // shr $0x20,%rcx
+ .byte 196,99,97,33,36,136,16 // vinsertps $0x10,(%rax,%rcx,4),%xmm3,%xmm12
+ .byte 137,217 // mov %ebx,%ecx
.byte 197,250,16,28,136 // vmovss (%rax,%rcx,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,195,109,24,209,1 // vinsertf128 $0x1,%xmm9,%ymm2,%ymm2
- .byte 196,193,49,114,210,24 // vpsrld $0x18,%xmm10,%xmm9
- .byte 196,193,97,114,208,24 // vpsrld $0x18,%xmm8,%xmm3
- .byte 196,227,53,24,219,1 // vinsertf128 $0x1,%xmm3,%ymm9,%ymm3
+ .byte 196,97,249,126,201 // vmovq %xmm9,%rcx
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 197,250,16,20,152 // vmovss (%rax,%rbx,4),%xmm2
+ .byte 137,203 // mov %ecx,%ebx
+ .byte 197,250,16,12,152 // vmovss (%rax,%rbx,4),%xmm1
+ .byte 196,99,249,22,203,1 // vpextrq $0x1,%xmm9,%rbx
+ .byte 72,193,233,32 // shr $0x20,%rcx
+ .byte 196,99,113,33,12,136,16 // vinsertps $0x10,(%rax,%rcx,4),%xmm1,%xmm9
+ .byte 137,217 // mov %ebx,%ecx
+ .byte 197,122,16,44,136 // vmovss (%rax,%rcx,4),%xmm13
+ .byte 196,195,33,33,207,32 // vinsertps $0x20,%xmm15,%xmm11,%xmm1
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 197,122,16,28,152 // vmovss (%rax,%rbx,4),%xmm11
+ .byte 196,195,113,33,206,48 // vinsertps $0x30,%xmm14,%xmm1,%xmm1
+ .byte 196,227,117,24,207,1 // vinsertf128 $0x1,%xmm7,%ymm1,%ymm1
+ .byte 196,227,25,33,219,32 // vinsertps $0x20,%xmm3,%xmm12,%xmm3
+ .byte 196,227,97,33,210,48 // vinsertps $0x30,%xmm2,%xmm3,%xmm2
+ .byte 196,195,49,33,221,32 // vinsertps $0x20,%xmm13,%xmm9,%xmm3
+ .byte 196,195,97,33,219,48 // vinsertps $0x30,%xmm11,%xmm3,%xmm3
+ .byte 196,227,101,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm3,%ymm2
+ .byte 196,193,97,114,210,24 // vpsrld $0x18,%xmm10,%xmm3
+ .byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7
+ .byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,91,70,0,0 // vbroadcastss 0x465b(%rip),%ymm8 # 66e0 <_sk_callback_avx+0x264>
- .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
+ .byte 196,226,125,24,61,158,70,0,0 // vbroadcastss 0x469e(%rip),%ymm7 # 6734 <_sk_callback_avx+0x26c>
+ .byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
+ .byte 197,252,16,124,36,208 // vmovups -0x30(%rsp),%ymm7
.byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
.byte 192,225,3 // shl $0x3,%cl
- .byte 73,199,194,255,255,255,255 // mov $0xffffffffffffffff,%r10
- .byte 73,211,234 // shr %cl,%r10
- .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 73,199,195,255,255,255,255 // mov $0xffffffffffffffff,%r11
+ .byte 73,211,235 // shr %cl,%r11
+ .byte 196,193,249,110,195 // vmovq %r11,%xmm0
.byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0
- .byte 196,226,121,0,13,61,73,0,0 // vpshufb 0x493d(%rip),%xmm0,%xmm1 # 6a00 <_sk_callback_avx+0x584>
+ .byte 196,226,121,0,13,128,73,0,0 // vpshufb 0x4980(%rip),%xmm0,%xmm1 # 6a50 <_sk_callback_avx+0x588>
.byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1
- .byte 196,226,121,0,5,63,73,0,0 // vpshufb 0x493f(%rip),%xmm0,%xmm0 # 6a10 <_sk_callback_avx+0x594>
+ .byte 196,226,121,0,5,130,73,0,0 // vpshufb 0x4982(%rip),%xmm0,%xmm0 # 6a60 <_sk_callback_avx+0x598>
.byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- .byte 196,66,125,44,17 // vmaskmovps (%r9),%ymm0,%ymm10
- .byte 233,160,253,255,255 // jmpq 1e86 <_sk_load_tables_avx+0x1e>
+ .byte 196,66,125,44,18 // vmaskmovps (%r10),%ymm0,%ymm10
+ .byte 233,194,253,255,255 // jmpq 1eb5 <_sk_load_tables_avx+0x25>
HIDDEN _sk_load_tables_u16_be_avx
.globl _sk_load_tables_u16_be_avx
FUNCTION(_sk_load_tables_u16_be_avx)
_sk_load_tables_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,113,2,0,0 // jne 236d <_sk_load_tables_u16_be_avx+0x287>
- .byte 196,1,121,16,4,72 // vmovupd (%r8,%r9,2),%xmm8
- .byte 196,129,121,16,84,72,16 // vmovupd 0x10(%r8,%r9,2),%xmm2
- .byte 196,129,121,16,92,72,32 // vmovupd 0x20(%r8,%r9,2),%xmm3
- .byte 196,1,122,111,76,72,48 // vmovdqu 0x30(%r8,%r9,2),%xmm9
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 197,252,17,124,36,200 // vmovups %ymm7,-0x38(%rsp)
+ .byte 15,133,84,2,0,0 // jne 2363 <_sk_load_tables_u16_be_avx+0x270>
+ .byte 196,1,121,16,4,81 // vmovupd (%r9,%r10,2),%xmm8
+ .byte 196,129,121,16,84,81,16 // vmovupd 0x10(%r9,%r10,2),%xmm2
+ .byte 196,129,121,16,92,81,32 // vmovupd 0x20(%r9,%r10,2),%xmm3
+ .byte 196,1,122,111,76,81,48 // vmovdqu 0x30(%r9,%r10,2),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,97,97,201 // vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -17143,170 +17219,159 @@ _sk_load_tables_u16_be_avx:
.byte 197,121,97,202 // vpunpcklwd %xmm2,%xmm0,%xmm9
.byte 197,121,105,194 // vpunpckhwd %xmm2,%xmm0,%xmm8
.byte 197,241,97,195 // vpunpcklwd %xmm3,%xmm1,%xmm0
- .byte 197,113,105,227 // vpunpckhwd %xmm3,%xmm1,%xmm12
- .byte 197,177,108,208 // vpunpcklqdq %xmm0,%xmm9,%xmm2
- .byte 197,177,109,200 // vpunpckhqdq %xmm0,%xmm9,%xmm1
- .byte 196,65,57,108,212 // vpunpcklqdq %xmm12,%xmm8,%xmm10
- .byte 197,121,111,29,200,72,0,0 // vmovdqa 0x48c8(%rip),%xmm11 # 6a20 <_sk_callback_avx+0x5a4>
- .byte 196,193,105,219,195 // vpand %xmm11,%xmm2,%xmm0
+ .byte 197,113,105,219 // vpunpckhwd %xmm3,%xmm1,%xmm11
+ .byte 197,177,108,200 // vpunpcklqdq %xmm0,%xmm9,%xmm1
+ .byte 197,49,109,224 // vpunpckhqdq %xmm0,%xmm9,%xmm12
+ .byte 197,121,111,21,20,73,0,0 // vmovdqa 0x4914(%rip),%xmm10 # 6a70 <_sk_callback_avx+0x5a8>
+ .byte 196,193,113,219,202 // vpand %xmm10,%xmm1,%xmm1
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 196,193,121,105,209 // vpunpckhwd %xmm9,%xmm0,%xmm2
- .byte 196,195,249,22,208,1 // vpextrq $0x1,%xmm2,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 77,137,194 // mov %r8,%r10
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,208 // vmovq %xmm2,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,198 // mov %r8,%r14
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
- .byte 69,137,229 // mov %r12d,%r13d
- .byte 73,193,236,30 // shr $0x1e,%r12
- .byte 72,139,104,8 // mov 0x8(%rax),%rbp
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 196,161,122,16,68,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm0
- .byte 196,163,121,33,68,181,0,16 // vinsertps $0x10,0x0(%rbp,%r14,4),%xmm0,%xmm0
- .byte 196,161,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm2
- .byte 196,227,121,33,194,32 // vinsertps $0x20,%xmm2,%xmm0,%xmm0
- .byte 196,161,122,16,84,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm2
- .byte 196,227,121,33,194,48 // vinsertps $0x30,%xmm2,%xmm0,%xmm0
- .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
- .byte 196,227,105,33,84,29,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,1),%xmm2,%xmm2
- .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,92,37,0 // vmovss 0x0(%rbp,%r12,1),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,227,109,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm2,%ymm0
- .byte 196,193,113,219,203 // vpand %xmm11,%xmm1,%xmm1
.byte 196,193,113,105,209 // vpunpckhwd %xmm9,%xmm1,%xmm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,249,126,209 // vmovq %xmm2,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,88,8 // mov 0x8(%rax),%r11
+ .byte 196,129,122,16,28,147 // vmovss (%r11,%r10,4),%xmm3
+ .byte 196,195,249,22,210,1 // vpextrq $0x1,%xmm2,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,97,33,44,139,16 // vinsertps $0x10,(%r11,%r9,4),%xmm3,%xmm13
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
.byte 196,226,121,51,201 // vpmovzxwd %xmm1,%xmm1
- .byte 196,193,249,126,203 // vmovq %xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 196,129,122,16,28,139 // vmovss (%r11,%r9,4),%xmm3
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 196,129,122,16,4,147 // vmovss (%r11,%r10,4),%xmm0
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 196,129,122,16,20,147 // vmovss (%r11,%r10,4),%xmm2
+ .byte 196,195,249,22,202,1 // vpextrq $0x1,%xmm1,%r10
+ .byte 196,131,105,33,12,11,16 // vinsertps $0x10,(%r11,%r9,1),%xmm2,%xmm1
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 196,129,122,16,20,139 // vmovss (%r11,%r9,4),%xmm2
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 196,227,17,33,219,32 // vinsertps $0x20,%xmm3,%xmm13,%xmm3
+ .byte 196,99,97,33,232,48 // vinsertps $0x30,%xmm0,%xmm3,%xmm13
+ .byte 196,99,113,33,242,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm14
+ .byte 196,1,122,16,60,19 // vmovss (%r11,%r10,1),%xmm15
+ .byte 196,193,25,219,210 // vpand %xmm10,%xmm12,%xmm2
+ .byte 196,193,105,105,193 // vpunpckhwd %xmm9,%xmm2,%xmm0
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,129,122,16,12,153 // vmovss (%r9,%r11,4),%xmm1
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,3,113,33,36,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm1,%xmm12
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 196,226,121,51,194 // vpmovzxwd %xmm2,%xmm0
+ .byte 196,129,122,16,20,145 // vmovss (%r9,%r10,4),%xmm2
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 196,129,122,16,28,153 // vmovss (%r9,%r11,4),%xmm3
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 196,129,122,16,12,153 // vmovss (%r9,%r11,4),%xmm1
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 196,131,113,33,12,17,16 // vinsertps $0x10,(%r9,%r10,1),%xmm1,%xmm1
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 196,129,122,16,60,145 // vmovss (%r9,%r10,4),%xmm7
+ .byte 196,195,9,33,199,48 // vinsertps $0x30,%xmm15,%xmm14,%xmm0
+ .byte 196,65,57,108,243 // vpunpcklqdq %xmm11,%xmm8,%xmm14
+ .byte 196,195,125,24,197,1 // vinsertf128 $0x1,%xmm13,%ymm0,%ymm0
.byte 73,193,235,30 // shr $0x1e,%r11
- .byte 196,195,249,22,207,1 // vpextrq $0x1,%xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,30 // shr $0x1e,%r15
- .byte 196,129,122,16,12,144 // vmovss (%r8,%r10,4),%xmm1
- .byte 196,195,113,33,12,152,16 // vinsertps $0x10,(%r8,%rbx,4),%xmm1,%xmm1
- .byte 196,129,122,16,20,136 // vmovss (%r8,%r9,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,193,122,16,20,168 // vmovss (%r8,%rbp,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,129,122,16,20,176 // vmovss (%r8,%r14,4),%xmm2
- .byte 196,131,105,33,20,24,16 // vinsertps $0x10,(%r8,%r11,1),%xmm2,%xmm2
- .byte 196,129,122,16,28,160 // vmovss (%r8,%r12,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,129,122,16,28,56 // vmovss (%r8,%r15,1),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,227,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
+ .byte 196,227,25,33,210,32 // vinsertps $0x20,%xmm2,%xmm12,%xmm2
+ .byte 196,227,105,33,219,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm3
+ .byte 196,99,113,33,239,32 // vinsertps $0x20,%xmm7,%xmm1,%xmm13
+ .byte 196,1,122,16,60,25 // vmovss (%r9,%r11,1),%xmm15
.byte 76,139,80,24 // mov 0x18(%rax),%r10
- .byte 196,193,41,219,211 // vpand %xmm11,%xmm10,%xmm2
- .byte 196,193,105,105,217 // vpunpckhwd %xmm9,%xmm2,%xmm3
- .byte 196,227,249,22,221,1 // vpextrq $0x1,%xmm3,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,219 // vmovq %xmm3,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,226,121,51,210 // vpmovzxwd %xmm2,%xmm2
- .byte 196,225,249,126,208 // vmovq %xmm2,%rax
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,30 // shr $0x1e,%rax
- .byte 196,195,249,22,214,1 // vpextrq $0x1,%xmm2,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,30 // shr $0x1e,%r14
- .byte 196,129,122,16,20,138 // vmovss (%r10,%r9,4),%xmm2
- .byte 196,195,105,33,20,154,16 // vinsertps $0x10,(%r10,%rbx,4),%xmm2,%xmm2
- .byte 196,129,122,16,28,130 // vmovss (%r10,%r8,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,193,122,16,28,170 // vmovss (%r10,%rbp,4),%xmm3
- .byte 196,99,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm10
- .byte 196,129,122,16,28,154 // vmovss (%r10,%r11,4),%xmm3
- .byte 196,195,97,33,28,2,16 // vinsertps $0x10,(%r10,%rax,1),%xmm3,%xmm3
- .byte 196,129,122,16,20,186 // vmovss (%r10,%r15,4),%xmm2
- .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
- .byte 196,129,122,16,28,50 // vmovss (%r10,%r14,1),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,195,109,24,210,1 // vinsertf128 $0x1,%xmm10,%ymm2,%ymm2
- .byte 196,193,57,109,220 // vpunpckhqdq %xmm12,%xmm8,%xmm3
- .byte 197,185,113,243,8 // vpsllw $0x8,%xmm3,%xmm8
+ .byte 196,193,9,219,250 // vpand %xmm10,%xmm14,%xmm7
+ .byte 196,193,65,105,209 // vpunpckhwd %xmm9,%xmm7,%xmm2
+ .byte 196,193,249,126,209 // vmovq %xmm2,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,193,122,16,12,130 // vmovss (%r10,%rax,4),%xmm1
+ .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,113,33,20,138,16 // vinsertps $0x10,(%r10,%r9,4),%xmm1,%xmm10
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,226,121,51,207 // vpmovzxwd %xmm7,%xmm1
+ .byte 196,1,122,16,52,138 // vmovss (%r10,%r9,4),%xmm14
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 196,65,122,16,36,130 // vmovss (%r10,%rax,4),%xmm12
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 196,193,122,16,20,130 // vmovss (%r10,%rax,4),%xmm2
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 196,131,105,33,20,10,16 // vinsertps $0x10,(%r10,%r9,1),%xmm2,%xmm2
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 196,193,122,16,60,130 // vmovss (%r10,%rax,4),%xmm7
+ .byte 196,195,17,33,207,48 // vinsertps $0x30,%xmm15,%xmm13,%xmm1
+ .byte 73,193,235,30 // shr $0x1e,%r11
+ .byte 196,1,122,16,44,26 // vmovss (%r10,%r11,1),%xmm13
+ .byte 196,227,117,24,203,1 // vinsertf128 $0x1,%xmm3,%ymm1,%ymm1
+ .byte 196,195,41,33,222,32 // vinsertps $0x20,%xmm14,%xmm10,%xmm3
+ .byte 196,195,97,33,220,48 // vinsertps $0x30,%xmm12,%xmm3,%xmm3
+ .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ .byte 196,195,105,33,213,48 // vinsertps $0x30,%xmm13,%xmm2,%xmm2
+ .byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
+ .byte 196,193,57,109,219 // vpunpckhqdq %xmm11,%xmm8,%xmm3
+ .byte 197,193,113,243,8 // vpsllw $0x8,%xmm3,%xmm7
.byte 197,225,113,211,8 // vpsrlw $0x8,%xmm3,%xmm3
- .byte 197,185,235,219 // vpor %xmm3,%xmm8,%xmm3
- .byte 196,65,97,105,193 // vpunpckhwd %xmm9,%xmm3,%xmm8
+ .byte 197,193,235,219 // vpor %xmm3,%xmm7,%xmm3
+ .byte 196,193,97,105,249 // vpunpckhwd %xmm9,%xmm3,%xmm7
.byte 196,226,121,51,219 // vpmovzxwd %xmm3,%xmm3
- .byte 196,195,101,24,216,1 // vinsertf128 $0x1,%xmm8,%ymm3,%ymm3
+ .byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,138,67,0,0 // vbroadcastss 0x438a(%rip),%ymm8 # 66e4 <_sk_callback_avx+0x268>
- .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
+ .byte 196,226,125,24,61,227,67,0,0 // vbroadcastss 0x43e3(%rip),%ymm7 # 6738 <_sk_callback_avx+0x270>
+ .byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
+ .byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7
.byte 255,224 // jmpq *%rax
- .byte 196,1,123,16,4,72 // vmovsd (%r8,%r9,2),%xmm8
+ .byte 196,1,123,16,4,81 // vmovsd (%r9,%r10,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,85 // je 23d3 <_sk_load_tables_u16_be_avx+0x2ed>
- .byte 196,1,57,22,68,72,8 // vmovhpd 0x8(%r8,%r9,2),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,72 // jb 23d3 <_sk_load_tables_u16_be_avx+0x2ed>
- .byte 196,129,123,16,84,72,16 // vmovsd 0x10(%r8,%r9,2),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,72 // je 23e0 <_sk_load_tables_u16_be_avx+0x2fa>
- .byte 196,129,105,22,84,72,24 // vmovhpd 0x18(%r8,%r9,2),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,59 // jb 23e0 <_sk_load_tables_u16_be_avx+0x2fa>
- .byte 196,129,123,16,92,72,32 // vmovsd 0x20(%r8,%r9,2),%xmm3
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,97,253,255,255 // je 2117 <_sk_load_tables_u16_be_avx+0x31>
- .byte 196,129,97,22,92,72,40 // vmovhpd 0x28(%r8,%r9,2),%xmm3,%xmm3
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,80,253,255,255 // jb 2117 <_sk_load_tables_u16_be_avx+0x31>
- .byte 196,1,122,126,76,72,48 // vmovq 0x30(%r8,%r9,2),%xmm9
- .byte 233,68,253,255,255 // jmpq 2117 <_sk_load_tables_u16_be_avx+0x31>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,85 // je 23c9 <_sk_load_tables_u16_be_avx+0x2d6>
+ .byte 196,1,57,22,68,81,8 // vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,72 // jb 23c9 <_sk_load_tables_u16_be_avx+0x2d6>
+ .byte 196,129,123,16,84,81,16 // vmovsd 0x10(%r9,%r10,2),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,72 // je 23d6 <_sk_load_tables_u16_be_avx+0x2e3>
+ .byte 196,129,105,22,84,81,24 // vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,59 // jb 23d6 <_sk_load_tables_u16_be_avx+0x2e3>
+ .byte 196,129,123,16,92,81,32 // vmovsd 0x20(%r9,%r10,2),%xmm3
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,126,253,255,255 // je 212a <_sk_load_tables_u16_be_avx+0x37>
+ .byte 196,129,97,22,92,81,40 // vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,109,253,255,255 // jb 212a <_sk_load_tables_u16_be_avx+0x37>
+ .byte 196,1,122,126,76,81,48 // vmovq 0x30(%r9,%r10,2),%xmm9
+ .byte 233,97,253,255,255 // jmpq 212a <_sk_load_tables_u16_be_avx+0x37>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,55,253,255,255 // jmpq 2117 <_sk_load_tables_u16_be_avx+0x31>
+ .byte 233,84,253,255,255 // jmpq 212a <_sk_load_tables_u16_be_avx+0x37>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,46,253,255,255 // jmpq 2117 <_sk_load_tables_u16_be_avx+0x31>
+ .byte 233,75,253,255,255 // jmpq 212a <_sk_load_tables_u16_be_avx+0x37>
HIDDEN _sk_load_tables_rgb_u16_be_avx
.globl _sk_load_tables_rgb_u16_be_avx
FUNCTION(_sk_load_tables_rgb_u16_be_avx)
_sk_load_tables_rgb_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,127 // lea (%rdi,%rdi,2),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,93,2,0,0 // jne 2658 <_sk_load_tables_rgb_u16_be_avx+0x26f>
- .byte 196,129,122,111,4,72 // vmovdqu (%r8,%r9,2),%xmm0
- .byte 196,129,122,111,84,72,12 // vmovdqu 0xc(%r8,%r9,2),%xmm2
- .byte 196,129,122,111,76,72,24 // vmovdqu 0x18(%r8,%r9,2),%xmm1
- .byte 196,129,122,111,92,72,32 // vmovdqu 0x20(%r8,%r9,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 197,252,17,124,36,200 // vmovups %ymm7,-0x38(%rsp)
+ .byte 197,252,17,116,36,168 // vmovups %ymm6,-0x58(%rsp)
+ .byte 15,133,71,2,0,0 // jne 2644 <_sk_load_tables_rgb_u16_be_avx+0x265>
+ .byte 196,129,122,111,4,81 // vmovdqu (%r9,%r10,2),%xmm0
+ .byte 196,129,122,111,84,81,12 // vmovdqu 0xc(%r9,%r10,2),%xmm2
+ .byte 196,129,122,111,76,81,24 // vmovdqu 0x18(%r9,%r10,2),%xmm1
+ .byte 196,129,122,111,92,81,32 // vmovdqu 0x20(%r9,%r10,2),%xmm3
.byte 197,225,115,219,4 // vpsrldq $0x4,%xmm3,%xmm3
.byte 197,185,115,216,6 // vpsrldq $0x6,%xmm0,%xmm8
.byte 197,177,115,218,6 // vpsrldq $0x6,%xmm2,%xmm9
.byte 197,161,115,217,6 // vpsrldq $0x6,%xmm1,%xmm11
.byte 197,169,115,219,6 // vpsrldq $0x6,%xmm3,%xmm10
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
.byte 197,249,97,194 // vpunpcklwd %xmm2,%xmm0,%xmm0
.byte 196,193,57,97,209 // vpunpcklwd %xmm9,%xmm8,%xmm2
.byte 197,241,97,203 // vpunpcklwd %xmm3,%xmm1,%xmm1
@@ -17314,428 +17379,392 @@ _sk_load_tables_rgb_u16_be_avx:
.byte 197,121,97,194 // vpunpcklwd %xmm2,%xmm0,%xmm8
.byte 197,249,105,194 // vpunpckhwd %xmm2,%xmm0,%xmm0
.byte 197,241,97,211 // vpunpcklwd %xmm3,%xmm1,%xmm2
- .byte 197,241,105,219 // vpunpckhwd %xmm3,%xmm1,%xmm3
- .byte 197,185,108,202 // vpunpcklqdq %xmm2,%xmm8,%xmm1
- .byte 197,185,109,210 // vpunpckhqdq %xmm2,%xmm8,%xmm2
- .byte 197,121,108,195 // vpunpcklqdq %xmm3,%xmm0,%xmm8
- .byte 197,121,111,13,193,69,0,0 // vmovdqa 0x45c1(%rip),%xmm9 # 6a30 <_sk_callback_avx+0x5b4>
- .byte 196,193,113,219,193 // vpand %xmm9,%xmm1,%xmm0
+ .byte 197,241,105,203 // vpunpckhwd %xmm3,%xmm1,%xmm1
+ .byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3
+ .byte 197,57,109,218 // vpunpckhqdq %xmm2,%xmm8,%xmm11
+ .byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8
+ .byte 197,121,111,13,25,70,0,0 // vmovdqa 0x4619(%rip),%xmm9 # 6a80 <_sk_callback_avx+0x5b8>
+ .byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0
.byte 196,65,41,239,210 // vpxor %xmm10,%xmm10,%xmm10
.byte 196,193,121,105,202 // vpunpckhwd %xmm10,%xmm0,%xmm1
- .byte 196,195,249,22,200,1 // vpextrq $0x1,%xmm1,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 77,137,194 // mov %r8,%r10
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,88,8 // mov 0x8(%rax),%r11
+ .byte 196,129,122,16,20,147 // vmovss (%r11,%r10,4),%xmm2
+ .byte 196,195,249,22,202,1 // vpextrq $0x1,%xmm1,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,105,33,36,139,16 // vinsertps $0x10,(%r11,%r9,4),%xmm2,%xmm12
+ .byte 69,137,209 // mov %r10d,%r9d
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,200 // vmovq %xmm1,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,198 // mov %r8,%r14
- .byte 73,193,238,32 // shr $0x20,%r14
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
- .byte 69,137,229 // mov %r12d,%r13d
- .byte 73,193,236,30 // shr $0x1e,%r12
- .byte 72,139,104,8 // mov 0x8(%rax),%rbp
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 196,161,122,16,68,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm0
- .byte 196,163,121,33,68,181,0,16 // vinsertps $0x10,0x0(%rbp,%r14,4),%xmm0,%xmm0
- .byte 196,161,122,16,76,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm1
- .byte 196,227,121,33,193,32 // vinsertps $0x20,%xmm1,%xmm0,%xmm0
- .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1
- .byte 196,227,121,33,193,48 // vinsertps $0x30,%xmm1,%xmm0,%xmm0
- .byte 196,161,122,16,76,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm1
- .byte 196,227,113,33,76,29,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,1),%xmm1,%xmm1
- .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3
- .byte 196,227,113,33,203,32 // vinsertps $0x20,%xmm3,%xmm1,%xmm1
- .byte 196,161,122,16,92,37,0 // vmovss 0x0(%rbp,%r12,1),%xmm3
- .byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1
- .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- .byte 196,193,105,219,201 // vpand %xmm9,%xmm2,%xmm1
- .byte 196,193,113,105,210 // vpunpckhwd %xmm10,%xmm1,%xmm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,226,121,51,201 // vpmovzxwd %xmm1,%xmm1
- .byte 196,193,249,126,203 // vmovq %xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 196,129,122,16,20,139 // vmovss (%r11,%r9,4),%xmm2
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 196,129,122,16,12,147 // vmovss (%r11,%r10,4),%xmm1
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 196,129,122,16,28,147 // vmovss (%r11,%r10,4),%xmm3
+ .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
+ .byte 196,131,97,33,28,11,16 // vinsertps $0x10,(%r11,%r9,1),%xmm3,%xmm3
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 196,129,122,16,4,139 // vmovss (%r11,%r9,4),%xmm0
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 196,227,25,33,210,32 // vinsertps $0x20,%xmm2,%xmm12,%xmm2
+ .byte 196,227,105,33,201,48 // vinsertps $0x30,%xmm1,%xmm2,%xmm1
+ .byte 196,129,122,16,20,19 // vmovss (%r11,%r10,1),%xmm2
+ .byte 196,65,33,219,225 // vpand %xmm9,%xmm11,%xmm12
+ .byte 196,65,25,105,218 // vpunpckhwd %xmm10,%xmm12,%xmm11
+ .byte 196,65,249,126,218 // vmovq %xmm11,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,1,122,16,44,153 // vmovss (%r9,%r11,4),%xmm13
+ .byte 196,67,249,22,219,1 // vpextrq $0x1,%xmm11,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,3,17,33,28,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm13,%xmm11
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 196,66,121,51,244 // vpmovzxwd %xmm12,%xmm14
+ .byte 196,1,122,16,44,145 // vmovss (%r9,%r10,4),%xmm13
+ .byte 196,65,249,126,242 // vmovq %xmm14,%r10
+ .byte 196,1,122,16,36,153 // vmovss (%r9,%r11,4),%xmm12
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 196,1,122,16,60,153 // vmovss (%r9,%r11,4),%xmm15
+ .byte 196,67,249,22,243,1 // vpextrq $0x1,%xmm14,%r11
+ .byte 196,3,1,33,52,17,16 // vinsertps $0x10,(%r9,%r10,1),%xmm15,%xmm14
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 196,1,122,16,60,145 // vmovss (%r9,%r10,4),%xmm15
+ .byte 196,227,97,33,192,32 // vinsertps $0x20,%xmm0,%xmm3,%xmm0
+ .byte 196,227,121,33,194,48 // vinsertps $0x30,%xmm2,%xmm0,%xmm0
+ .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 73,193,235,30 // shr $0x1e,%r11
- .byte 196,195,249,22,207,1 // vpextrq $0x1,%xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,30 // shr $0x1e,%r15
- .byte 196,129,122,16,12,144 // vmovss (%r8,%r10,4),%xmm1
- .byte 196,195,113,33,12,152,16 // vinsertps $0x10,(%r8,%rbx,4),%xmm1,%xmm1
- .byte 196,129,122,16,20,136 // vmovss (%r8,%r9,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,193,122,16,20,168 // vmovss (%r8,%rbp,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,129,122,16,20,176 // vmovss (%r8,%r14,4),%xmm2
- .byte 196,131,105,33,20,24,16 // vinsertps $0x10,(%r8,%r11,1),%xmm2,%xmm2
- .byte 196,129,122,16,28,160 // vmovss (%r8,%r12,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,129,122,16,28,56 // vmovss (%r8,%r15,1),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,227,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
+ .byte 196,129,122,16,52,25 // vmovss (%r9,%r11,1),%xmm6
.byte 76,139,80,24 // mov 0x18(%rax),%r10
- .byte 196,193,57,219,209 // vpand %xmm9,%xmm8,%xmm2
- .byte 196,193,105,105,218 // vpunpckhwd %xmm10,%xmm2,%xmm3
- .byte 196,227,249,22,221,1 // vpextrq $0x1,%xmm3,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,219 // vmovq %xmm3,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,226,121,51,210 // vpmovzxwd %xmm2,%xmm2
- .byte 196,225,249,126,208 // vmovq %xmm2,%rax
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,30 // shr $0x1e,%rax
- .byte 196,195,249,22,214,1 // vpextrq $0x1,%xmm2,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,30 // shr $0x1e,%r14
- .byte 196,129,122,16,20,138 // vmovss (%r10,%r9,4),%xmm2
- .byte 196,195,105,33,20,154,16 // vinsertps $0x10,(%r10,%rbx,4),%xmm2,%xmm2
- .byte 196,129,122,16,28,130 // vmovss (%r10,%r8,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,193,122,16,28,170 // vmovss (%r10,%rbp,4),%xmm3
- .byte 196,99,105,33,195,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm8
- .byte 196,129,122,16,28,154 // vmovss (%r10,%r11,4),%xmm3
- .byte 196,195,97,33,28,2,16 // vinsertps $0x10,(%r10,%rax,1),%xmm3,%xmm3
- .byte 196,129,122,16,20,186 // vmovss (%r10,%r15,4),%xmm2
- .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
- .byte 196,129,122,16,28,50 // vmovss (%r10,%r14,1),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,195,109,24,208,1 // vinsertf128 $0x1,%xmm8,%ymm2,%ymm2
+ .byte 196,65,57,219,193 // vpand %xmm9,%xmm8,%xmm8
+ .byte 196,193,57,105,210 // vpunpckhwd %xmm10,%xmm8,%xmm2
+ .byte 196,193,249,126,209 // vmovq %xmm2,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,193,122,16,12,130 // vmovss (%r10,%rax,4),%xmm1
+ .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,113,33,12,138,16 // vinsertps $0x10,(%r10,%r9,4),%xmm1,%xmm9
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,194,121,51,200 // vpmovzxwd %xmm8,%xmm1
+ .byte 196,1,122,16,4,138 // vmovss (%r10,%r9,4),%xmm8
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 196,65,122,16,20,130 // vmovss (%r10,%rax,4),%xmm10
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 196,193,122,16,20,130 // vmovss (%r10,%rax,4),%xmm2
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 196,131,105,33,20,10,16 // vinsertps $0x10,(%r10,%r9,1),%xmm2,%xmm2
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 196,193,122,16,60,130 // vmovss (%r10,%rax,4),%xmm7
+ .byte 196,195,33,33,205,32 // vinsertps $0x20,%xmm13,%xmm11,%xmm1
+ .byte 73,193,235,30 // shr $0x1e,%r11
+ .byte 196,1,122,16,28,26 // vmovss (%r10,%r11,1),%xmm11
+ .byte 196,195,113,33,204,48 // vinsertps $0x30,%xmm12,%xmm1,%xmm1
+ .byte 196,195,9,33,223,32 // vinsertps $0x20,%xmm15,%xmm14,%xmm3
+ .byte 196,227,97,33,222,48 // vinsertps $0x30,%xmm6,%xmm3,%xmm3
+ .byte 196,227,101,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm3,%ymm1
+ .byte 196,195,49,33,216,32 // vinsertps $0x20,%xmm8,%xmm9,%xmm3
+ .byte 196,195,97,33,218,48 // vinsertps $0x30,%xmm10,%xmm3,%xmm3
+ .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ .byte 196,195,105,33,211,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm2
+ .byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,156,64,0,0 // vbroadcastss 0x409c(%rip),%ymm3 # 66e8 <_sk_callback_avx+0x26c>
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
+ .byte 196,226,125,24,29,6,65,0,0 // vbroadcastss 0x4106(%rip),%ymm3 # 673c <_sk_callback_avx+0x274>
+ .byte 197,252,16,116,36,168 // vmovups -0x58(%rsp),%ymm6
+ .byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7
.byte 255,224 // jmpq *%rax
- .byte 196,129,121,110,4,72 // vmovd (%r8,%r9,2),%xmm0
- .byte 196,129,121,196,68,72,4,2 // vpinsrw $0x2,0x4(%r8,%r9,2),%xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,5 // jne 2671 <_sk_load_tables_rgb_u16_be_avx+0x288>
- .byte 233,190,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 196,129,121,110,76,72,6 // vmovd 0x6(%r8,%r9,2),%xmm1
- .byte 196,1,113,196,68,72,10,2 // vpinsrw $0x2,0xa(%r8,%r9,2),%xmm1,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,26 // jb 26a0 <_sk_load_tables_rgb_u16_be_avx+0x2b7>
- .byte 196,129,121,110,76,72,12 // vmovd 0xc(%r8,%r9,2),%xmm1
- .byte 196,129,113,196,84,72,16,2 // vpinsrw $0x2,0x10(%r8,%r9,2),%xmm1,%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 117,10 // jne 26a5 <_sk_load_tables_rgb_u16_be_avx+0x2bc>
- .byte 233,143,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 233,138,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 196,129,121,110,76,72,18 // vmovd 0x12(%r8,%r9,2),%xmm1
- .byte 196,1,113,196,76,72,22,2 // vpinsrw $0x2,0x16(%r8,%r9,2),%xmm1,%xmm9
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,26 // jb 26d4 <_sk_load_tables_rgb_u16_be_avx+0x2eb>
- .byte 196,129,121,110,76,72,24 // vmovd 0x18(%r8,%r9,2),%xmm1
- .byte 196,129,113,196,76,72,28,2 // vpinsrw $0x2,0x1c(%r8,%r9,2),%xmm1,%xmm1
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 117,10 // jne 26d9 <_sk_load_tables_rgb_u16_be_avx+0x2f0>
- .byte 233,91,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 233,86,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 196,129,121,110,92,72,30 // vmovd 0x1e(%r8,%r9,2),%xmm3
- .byte 196,1,97,196,92,72,34,2 // vpinsrw $0x2,0x22(%r8,%r9,2),%xmm3,%xmm11
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,20 // jb 2702 <_sk_load_tables_rgb_u16_be_avx+0x319>
- .byte 196,129,121,110,92,72,36 // vmovd 0x24(%r8,%r9,2),%xmm3
- .byte 196,129,97,196,92,72,40,2 // vpinsrw $0x2,0x28(%r8,%r9,2),%xmm3,%xmm3
- .byte 233,45,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
- .byte 233,40,253,255,255 // jmpq 242f <_sk_load_tables_rgb_u16_be_avx+0x46>
+ .byte 196,129,121,110,4,81 // vmovd (%r9,%r10,2),%xmm0
+ .byte 196,129,121,196,68,81,4,2 // vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,5 // jne 265d <_sk_load_tables_rgb_u16_be_avx+0x27e>
+ .byte 233,212,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 196,129,121,110,76,81,6 // vmovd 0x6(%r9,%r10,2),%xmm1
+ .byte 196,1,113,196,68,81,10,2 // vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,26 // jb 268c <_sk_load_tables_rgb_u16_be_avx+0x2ad>
+ .byte 196,129,121,110,76,81,12 // vmovd 0xc(%r9,%r10,2),%xmm1
+ .byte 196,129,113,196,84,81,16,2 // vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 117,10 // jne 2691 <_sk_load_tables_rgb_u16_be_avx+0x2b2>
+ .byte 233,165,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 233,160,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 196,129,121,110,76,81,18 // vmovd 0x12(%r9,%r10,2),%xmm1
+ .byte 196,1,113,196,76,81,22,2 // vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,26 // jb 26c0 <_sk_load_tables_rgb_u16_be_avx+0x2e1>
+ .byte 196,129,121,110,76,81,24 // vmovd 0x18(%r9,%r10,2),%xmm1
+ .byte 196,129,113,196,76,81,28,2 // vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 117,10 // jne 26c5 <_sk_load_tables_rgb_u16_be_avx+0x2e6>
+ .byte 233,113,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 233,108,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 196,129,121,110,92,81,30 // vmovd 0x1e(%r9,%r10,2),%xmm3
+ .byte 196,1,97,196,92,81,34,2 // vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,20 // jb 26ee <_sk_load_tables_rgb_u16_be_avx+0x30f>
+ .byte 196,129,121,110,92,81,36 // vmovd 0x24(%r9,%r10,2),%xmm3
+ .byte 196,129,97,196,92,81,40,2 // vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3
+ .byte 233,67,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
+ .byte 233,62,253,255,255 // jmpq 2431 <_sk_load_tables_rgb_u16_be_avx+0x52>
HIDDEN _sk_byte_tables_avx
.globl _sk_byte_tables_avx
FUNCTION(_sk_byte_tables_avx)
_sk_byte_tables_avx:
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,208,63,0,0 // vbroadcastss 0x3fd0(%rip),%ymm8 # 66ec <_sk_callback_avx+0x270>
+ .byte 196,98,125,24,5,66,64,0,0 // vbroadcastss 0x4042(%rip),%ymm8 # 6740 <_sk_callback_avx+0x278>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
+ .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
+ .byte 196,65,249,126,201 // vmovq %xmm9,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,131,121,32,4,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ .byte 196,67,249,22,202,1 // vpextrq $0x1,%xmm9,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,121,32,20,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,99,125,25,200,1 // vextractf128 $0x1,%ymm9,%xmm0
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,67,41,32,201,2 // vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,3 // vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 196,3,121,32,20,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm10
+ .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,41,32,4,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm10,%xmm0
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,121,32,193,2 // vpinsrb $0x2,%r9d,%xmm0,%xmm0
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,121,32,210,3 // vpinsrb $0x3,%r10d,%xmm0,%xmm10
+ .byte 196,193,116,89,192 // vmulps %ymm8,%ymm1,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 68,137,197 // mov %r8d,%ebp
- .byte 77,137,194 // mov %r8,%r10
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,12,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm1
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,192 // vmovq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,199 // mov %r8,%r15
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 196,131,113,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 69,137,198 // mov %r8d,%r14d
- .byte 77,137,196 // mov %r8,%r12
- .byte 73,193,236,32 // shr $0x20,%r12
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,221 // mov %ebx,%r13d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,57,1 // vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 196,98,121,49,200 // vpmovzxbd %xmm0,%xmm9
- .byte 196,131,121,32,4,41,0 // vpinsrb $0x0,(%r9,%r13,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- .byte 67,15,182,44,49 // movzbl (%r9,%r14,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,33 // movzbl (%r9,%r12,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 196,227,53,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm9,%ymm0
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,30,63,0,0 // vbroadcastss 0x3f1e(%rip),%ymm9 # 66f0 <_sk_callback_avx+0x274>
- .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
- .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,113,32,202,2 // vpinsrb $0x2,%r10d,%xmm1,%xmm1
+ .byte 196,193,249,126,194 // vmovq %xmm0,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,67,113,32,227,3 // vpinsrb $0x3,%r11d,%xmm1,%xmm12
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,12,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm1
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,113,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,67,121,32,233,3 // vpinsrb $0x3,%r9d,%xmm0,%xmm13
+ .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 196,193,108,89,200 // vmulps %ymm8,%ymm2,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
- .byte 196,227,249,22,205,1 // vpextrq $0x1,%xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,20,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,105,32,20,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm2
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,105,32,210,2 // vpinsrb $0x2,%r10d,%xmm2,%xmm2
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,67,105,32,219,3 // vpinsrb $0x3,%r11d,%xmm2,%xmm11
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,20,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
.byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,105,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,113,32,202,2 // vpinsrb $0x2,%r10d,%xmm1,%xmm1
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,207 // vmovq %xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,12,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- .byte 196,195,113,32,12,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 196,98,121,49,209 // vpmovzxbd %xmm1,%xmm10
- .byte 196,131,121,32,12,32,0 // vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm1
- .byte 196,131,113,32,12,56,1 // vpinsrb $0x1,(%r8,%r15,1),%xmm1,%xmm1
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,113,32,205,2 // vpinsrb $0x2,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1
- .byte 196,227,45,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm10,%ymm1
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,67,113,32,241,3 // vpinsrb $0x3,%r9d,%xmm1,%xmm14
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
+ .byte 196,193,100,89,200 // vmulps %ymm8,%ymm3,%ymm1
+ .byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,28,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
+ .byte 196,227,249,22,200,1 // vpextrq $0x1,%xmm1,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,97,32,28,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm3,%xmm3
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
+ .byte 71,15,182,12,10 // movzbl (%r10,%r9,1),%r9d
+ .byte 196,195,97,32,217,2 // vpinsrb $0x2,%r9d,%xmm3,%xmm3
+ .byte 196,193,249,126,201 // vmovq %xmm1,%r9
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,99,97,32,192,3 // vpinsrb $0x3,%eax,%xmm3,%xmm8
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,4,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm0
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,121,32,4,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm0,%xmm0
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,99,121,32,248,2 // vpinsrb $0x2,%eax,%xmm0,%xmm15
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
+ .byte 196,194,121,49,193 // vpmovzxbd %xmm9,%xmm0
+ .byte 196,194,121,49,202 // vpmovzxbd %xmm10,%xmm1
+ .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
+ .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
+ .byte 196,194,121,49,204 // vpmovzxbd %xmm12,%xmm1
+ .byte 196,194,121,49,213 // vpmovzxbd %xmm13,%xmm2
+ .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
+ .byte 196,98,125,24,13,236,61,0,0 // vbroadcastss 0x3dec(%rip),%ymm9 # 6744 <_sk_callback_avx+0x27c>
+ .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
- .byte 76,139,64,16 // mov 0x10(%rax),%r8
- .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2
- .byte 196,195,249,22,211,1 // vpextrq $0x1,%xmm2,%r11
- .byte 69,137,222 // mov %r11d,%r14d
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,215 // vmovq %xmm2,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,20,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm2
- .byte 196,195,105,32,20,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm2,%xmm2
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,105,32,211,2 // vpinsrb $0x2,%ebx,%xmm2,%xmm2
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,105,32,213,3 // vpinsrb $0x3,%ebp,%xmm2,%xmm2
- .byte 196,98,121,49,210 // vpmovzxbd %xmm2,%xmm10
- .byte 196,131,121,32,20,32,0 // vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm2
- .byte 196,131,105,32,20,56,1 // vpinsrb $0x1,(%r8,%r15,1),%xmm2,%xmm2
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,105,32,213,2 // vpinsrb $0x2,%ebp,%xmm2,%xmm2
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,105,32,213,3 // vpinsrb $0x3,%ebp,%xmm2,%xmm2
- .byte 196,226,121,49,210 // vpmovzxbd %xmm2,%xmm2
- .byte 196,227,45,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm10,%ymm2
+ .byte 196,194,121,49,211 // vpmovzxbd %xmm11,%xmm2
+ .byte 196,194,121,49,222 // vpmovzxbd %xmm14,%xmm3
+ .byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,209 // vmulps %ymm9,%ymm2,%ymm2
- .byte 72,139,64,24 // mov 0x18(%rax),%rax
- .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
- .byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
- .byte 196,227,249,22,221,1 // vpextrq $0x1,%xmm3,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,219 // vmovq %xmm3,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,25,219,1 // vextractf128 $0x1,%ymm3,%xmm3
- .byte 196,195,249,22,218,1 // vpextrq $0x1,%xmm3,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,222 // vmovq %xmm3,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 196,163,121,32,28,8,0 // vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm3
- .byte 196,227,97,32,28,24,1 // vpinsrb $0x1,(%rax,%rbx,1),%xmm3,%xmm3
- .byte 66,15,182,28,0 // movzbl (%rax,%r8,1),%ebx
- .byte 196,227,97,32,219,2 // vpinsrb $0x2,%ebx,%xmm3,%xmm3
- .byte 15,182,44,40 // movzbl (%rax,%rbp,1),%ebp
- .byte 196,227,97,32,221,3 // vpinsrb $0x3,%ebp,%xmm3,%xmm3
- .byte 196,98,121,49,195 // vpmovzxbd %xmm3,%xmm8
- .byte 196,163,121,32,28,56,0 // vpinsrb $0x0,(%rax,%r15,1),%xmm0,%xmm3
- .byte 196,163,97,32,28,48,1 // vpinsrb $0x1,(%rax,%r14,1),%xmm3,%xmm3
- .byte 66,15,182,44,24 // movzbl (%rax,%r11,1),%ebp
- .byte 196,227,97,32,221,2 // vpinsrb $0x2,%ebp,%xmm3,%xmm3
- .byte 66,15,182,4,16 // movzbl (%rax,%r10,1),%eax
- .byte 196,227,97,32,216,3 // vpinsrb $0x3,%eax,%xmm3,%xmm3
+ .byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8
+ .byte 196,227,1,32,216,3 // vpinsrb $0x3,%eax,%xmm15,%xmm3
.byte 196,226,121,49,219 // vpmovzxbd %xmm3,%xmm3
.byte 196,227,61,24,219,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
.byte 196,193,100,89,217 // vmulps %ymm9,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_byte_tables_rgb_avx
.globl _sk_byte_tables_rgb_avx
FUNCTION(_sk_byte_tables_rgb_avx)
_sk_byte_tables_rgb_avx:
- .byte 85 // push %rbp
- .byte 65,87 // push %r15
- .byte 65,86 // push %r14
- .byte 65,85 // push %r13
- .byte 65,84 // push %r12
- .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,139,64,24 // mov 0x18(%rax),%r8d
- .byte 65,255,200 // dec %r8d
- .byte 196,65,121,110,192 // vmovd %r8d,%xmm8
+ .byte 68,139,72,24 // mov 0x18(%rax),%r9d
+ .byte 65,255,201 // dec %r9d
+ .byte 196,65,121,110,193 // vmovd %r9d,%xmm8
.byte 196,65,121,112,192,0 // vpshufd $0x0,%xmm8,%xmm8
.byte 196,67,61,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 68,137,197 // mov %r8d,%ebp
- .byte 77,137,194 // mov %r8,%r10
+ .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
+ .byte 196,65,249,126,201 // vmovq %xmm9,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,131,121,32,4,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ .byte 196,67,249,22,202,1 // vpextrq $0x1,%xmm9,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,3,121,32,20,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ .byte 69,137,209 // mov %r10d,%r9d
.byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,192 // vmovq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,199 // mov %r8,%r15
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0
- .byte 196,195,249,22,192,1 // vpextrq $0x1,%xmm0,%r8
- .byte 69,137,198 // mov %r8d,%r14d
- .byte 77,137,196 // mov %r8,%r12
- .byte 73,193,236,32 // shr $0x20,%r12
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,221 // mov %ebx,%r13d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,57,1 // vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 196,98,121,49,200 // vpmovzxbd %xmm0,%xmm9
- .byte 196,131,121,32,4,41,0 // vpinsrb $0x0,(%r9,%r13,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- .byte 67,15,182,44,49 // movzbl (%r9,%r14,1),%ebp
- .byte 196,227,121,32,197,2 // vpinsrb $0x2,%ebp,%xmm0,%xmm0
- .byte 67,15,182,44,33 // movzbl (%r9,%r12,1),%ebp
- .byte 196,227,121,32,197,3 // vpinsrb $0x3,%ebp,%xmm0,%xmm0
- .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 196,227,53,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm9,%ymm0
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,68,60,0,0 // vbroadcastss 0x3c44(%rip),%ymm9 # 66f4 <_sk_callback_avx+0x278>
- .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
+ .byte 196,99,125,25,200,1 // vextractf128 $0x1,%ymm9,%xmm0
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,67,41,32,201,2 // vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,49,32,202,3 // vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 196,3,121,32,20,19,0 // vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm10
+ .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,41,32,4,11,1 // vpinsrb $0x1,(%r11,%r9,1),%xmm10,%xmm0
+ .byte 69,137,209 // mov %r10d,%r9d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 71,15,182,12,11 // movzbl (%r11,%r9,1),%r9d
+ .byte 196,195,121,32,193,2 // vpinsrb $0x2,%r9d,%xmm0,%xmm0
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 71,15,182,20,19 // movzbl (%r11,%r10,1),%r10d
+ .byte 196,67,121,32,218,3 // vpinsrb $0x3,%r10d,%xmm0,%xmm11
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
- .byte 196,227,249,22,205,1 // vpextrq $0x1,%xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
- .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,121,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ .byte 196,193,249,126,202 // vmovq %xmm1,%r10
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 196,67,121,32,211,3 // vpinsrb $0x3,%r11d,%xmm0,%xmm10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 196,131,121,32,4,25,0 // vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
.byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
- .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,131,121,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ .byte 69,137,218 // mov %r11d,%r10d
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,193,249,126,207 // vmovq %xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,131,121,32,12,16,0 // vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- .byte 196,195,113,32,12,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
- .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 196,98,121,49,209 // vpmovzxbd %xmm1,%xmm10
- .byte 196,131,121,32,12,32,0 // vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm1
- .byte 196,131,113,32,12,56,1 // vpinsrb $0x1,(%r8,%r15,1),%xmm1,%xmm1
- .byte 67,15,182,44,48 // movzbl (%r8,%r14,1),%ebp
- .byte 196,227,113,32,205,2 // vpinsrb $0x2,%ebp,%xmm1,%xmm1
- .byte 67,15,182,44,24 // movzbl (%r8,%r11,1),%ebp
- .byte 196,227,113,32,205,3 // vpinsrb $0x3,%ebp,%xmm1,%xmm1
- .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1
- .byte 196,227,45,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm10,%ymm1
+ .byte 71,15,182,12,25 // movzbl (%r9,%r11,1),%r9d
+ .byte 196,67,121,32,225,3 // vpinsrb $0x3,%r9d,%xmm0,%xmm12
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
+ .byte 197,188,89,194 // vmulps %ymm2,%ymm8,%ymm0
+ .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,20,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
+ .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,105,32,20,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm2,%xmm2
+ .byte 65,137,193 // mov %eax,%r9d
+ .byte 72,193,232,32 // shr $0x20,%rax
+ .byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0
+ .byte 71,15,182,12,10 // movzbl (%r10,%r9,1),%r9d
+ .byte 196,195,105,32,209,2 // vpinsrb $0x2,%r9d,%xmm2,%xmm2
+ .byte 196,193,249,126,193 // vmovq %xmm0,%r9
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,99,105,32,192,3 // vpinsrb $0x3,%eax,%xmm2,%xmm8
+ .byte 68,137,200 // mov %r9d,%eax
+ .byte 196,195,121,32,12,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,131,113,32,4,10,1 // vpinsrb $0x1,(%r10,%r9,1),%xmm1,%xmm0
+ .byte 68,137,216 // mov %r11d,%eax
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
+ .byte 196,99,121,32,232,2 // vpinsrb $0x2,%eax,%xmm0,%xmm13
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
+ .byte 196,194,121,49,193 // vpmovzxbd %xmm9,%xmm0
+ .byte 196,194,121,49,203 // vpmovzxbd %xmm11,%xmm1
+ .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
+ .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
+ .byte 196,98,125,24,13,205,59,0,0 // vbroadcastss 0x3bcd(%rip),%ymm9 # 6748 <_sk_callback_avx+0x280>
+ .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
+ .byte 196,194,121,49,202 // vpmovzxbd %xmm10,%xmm1
+ .byte 196,194,121,49,212 // vpmovzxbd %xmm12,%xmm2
+ .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
- .byte 72,139,64,16 // mov 0x10(%rax),%rax
- .byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
- .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
- .byte 196,227,249,22,213,1 // vpextrq $0x1,%xmm2,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
- .byte 72,193,237,32 // shr $0x20,%rbp
- .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2
- .byte 196,195,249,22,210,1 // vpextrq $0x1,%xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 196,193,249,126,214 // vmovq %xmm2,%r14
- .byte 69,137,247 // mov %r14d,%r15d
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 196,163,121,32,20,8,0 // vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm2
- .byte 196,227,105,32,20,24,1 // vpinsrb $0x1,(%rax,%rbx,1),%xmm2,%xmm2
- .byte 66,15,182,28,0 // movzbl (%rax,%r8,1),%ebx
- .byte 196,227,105,32,211,2 // vpinsrb $0x2,%ebx,%xmm2,%xmm2
- .byte 15,182,44,40 // movzbl (%rax,%rbp,1),%ebp
- .byte 196,227,105,32,213,3 // vpinsrb $0x3,%ebp,%xmm2,%xmm2
- .byte 196,98,121,49,194 // vpmovzxbd %xmm2,%xmm8
- .byte 196,163,121,32,20,56,0 // vpinsrb $0x0,(%rax,%r15,1),%xmm0,%xmm2
- .byte 196,163,105,32,20,48,1 // vpinsrb $0x1,(%rax,%r14,1),%xmm2,%xmm2
- .byte 66,15,182,44,24 // movzbl (%rax,%r11,1),%ebp
- .byte 196,227,105,32,213,2 // vpinsrb $0x2,%ebp,%xmm2,%xmm2
- .byte 66,15,182,4,16 // movzbl (%rax,%r10,1),%eax
- .byte 196,227,105,32,208,3 // vpinsrb $0x3,%eax,%xmm2,%xmm2
+ .byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8
+ .byte 196,227,17,32,208,3 // vpinsrb $0x3,%eax,%xmm13,%xmm2
.byte 196,226,121,49,210 // vpmovzxbd %xmm2,%xmm2
.byte 196,227,61,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm8,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,209 // vmulps %ymm9,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,92 // pop %r12
- .byte 65,93 // pop %r13
- .byte 65,94 // pop %r14
- .byte 65,95 // pop %r15
- .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_r_avx
@@ -17744,10 +17773,11 @@ FUNCTION(_sk_table_r_avx)
_sk_table_r_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -17757,34 +17787,35 @@ _sk_table_r_avx:
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,195 // vmovq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0
.byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,199 // vmovq %xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,129,122,16,4,160 // vmovss (%r8,%r12,4),%xmm0
- .byte 196,3,121,33,4,184,16 // vinsertps $0x10,(%r8,%r15,4),%xmm0,%xmm8
- .byte 196,129,122,16,4,176 // vmovss (%r8,%r14,4),%xmm0
+ .byte 196,193,249,126,196 // vmovq %xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,129,122,16,4,169 // vmovss (%r9,%r13,4),%xmm0
+ .byte 196,3,121,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm0,%xmm8
+ .byte 196,129,122,16,4,185 // vmovss (%r9,%r15,4),%xmm0
.byte 196,99,57,33,192,32 // vinsertps $0x20,%xmm0,%xmm8,%xmm8
- .byte 196,193,122,16,4,152 // vmovss (%r8,%rbx,4),%xmm0
+ .byte 196,193,122,16,4,153 // vmovss (%r9,%rbx,4),%xmm0
.byte 196,99,57,33,192,48 // vinsertps $0x30,%xmm0,%xmm8,%xmm8
- .byte 196,129,122,16,4,152 // vmovss (%r8,%r11,4),%xmm0
- .byte 196,3,121,33,12,144,16 // vinsertps $0x10,(%r8,%r10,4),%xmm0,%xmm9
- .byte 196,129,122,16,4,136 // vmovss (%r8,%r9,4),%xmm0
+ .byte 196,129,122,16,4,177 // vmovss (%r9,%r14,4),%xmm0
+ .byte 196,3,121,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm0,%xmm9
+ .byte 196,129,122,16,4,145 // vmovss (%r9,%r10,4),%xmm0
.byte 196,99,49,33,200,32 // vinsertps $0x20,%xmm0,%xmm9,%xmm9
- .byte 196,193,122,16,4,128 // vmovss (%r8,%rax,4),%xmm0
+ .byte 196,193,122,16,4,129 // vmovss (%r9,%rax,4),%xmm0
.byte 196,227,49,33,192,48 // vinsertps $0x30,%xmm0,%xmm9,%xmm0
.byte 196,195,125,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -17795,10 +17826,11 @@ FUNCTION(_sk_table_g_avx)
_sk_table_g_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -17808,34 +17840,35 @@ _sk_table_g_avx:
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
.byte 196,227,249,22,200,1 // vpextrq $0x1,%xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,202 // vmovq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,203 // vmovq %xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
.byte 196,227,249,22,203,1 // vpextrq $0x1,%xmm1,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,207 // vmovq %xmm1,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,129,122,16,12,160 // vmovss (%r8,%r12,4),%xmm1
- .byte 196,3,113,33,4,184,16 // vinsertps $0x10,(%r8,%r15,4),%xmm1,%xmm8
- .byte 196,129,122,16,12,176 // vmovss (%r8,%r14,4),%xmm1
+ .byte 196,193,249,126,204 // vmovq %xmm1,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,129,122,16,12,169 // vmovss (%r9,%r13,4),%xmm1
+ .byte 196,3,113,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm1,%xmm8
+ .byte 196,129,122,16,12,185 // vmovss (%r9,%r15,4),%xmm1
.byte 196,99,57,33,193,32 // vinsertps $0x20,%xmm1,%xmm8,%xmm8
- .byte 196,193,122,16,12,152 // vmovss (%r8,%rbx,4),%xmm1
+ .byte 196,193,122,16,12,153 // vmovss (%r9,%rbx,4),%xmm1
.byte 196,99,57,33,193,48 // vinsertps $0x30,%xmm1,%xmm8,%xmm8
- .byte 196,129,122,16,12,152 // vmovss (%r8,%r11,4),%xmm1
- .byte 196,3,113,33,12,144,16 // vinsertps $0x10,(%r8,%r10,4),%xmm1,%xmm9
- .byte 196,129,122,16,12,136 // vmovss (%r8,%r9,4),%xmm1
+ .byte 196,129,122,16,12,177 // vmovss (%r9,%r14,4),%xmm1
+ .byte 196,3,113,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm1,%xmm9
+ .byte 196,129,122,16,12,145 // vmovss (%r9,%r10,4),%xmm1
.byte 196,99,49,33,201,32 // vinsertps $0x20,%xmm1,%xmm9,%xmm9
- .byte 196,193,122,16,12,128 // vmovss (%r8,%rax,4),%xmm1
+ .byte 196,193,122,16,12,129 // vmovss (%r9,%rax,4),%xmm1
.byte 196,227,49,33,201,48 // vinsertps $0x30,%xmm1,%xmm9,%xmm1
.byte 196,195,117,24,200,1 // vinsertf128 $0x1,%xmm8,%ymm1,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -17846,10 +17879,11 @@ FUNCTION(_sk_table_b_avx)
_sk_table_b_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -17859,34 +17893,35 @@ _sk_table_b_avx:
.byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2
.byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2
.byte 196,227,249,22,211,1 // vpextrq $0x1,%xmm2,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,215 // vmovq %xmm2,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,129,122,16,20,160 // vmovss (%r8,%r12,4),%xmm2
- .byte 196,3,105,33,4,184,16 // vinsertps $0x10,(%r8,%r15,4),%xmm2,%xmm8
- .byte 196,129,122,16,20,176 // vmovss (%r8,%r14,4),%xmm2
+ .byte 196,193,249,126,212 // vmovq %xmm2,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,129,122,16,20,169 // vmovss (%r9,%r13,4),%xmm2
+ .byte 196,3,105,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm2,%xmm8
+ .byte 196,129,122,16,20,185 // vmovss (%r9,%r15,4),%xmm2
.byte 196,99,57,33,194,32 // vinsertps $0x20,%xmm2,%xmm8,%xmm8
- .byte 196,193,122,16,20,152 // vmovss (%r8,%rbx,4),%xmm2
+ .byte 196,193,122,16,20,153 // vmovss (%r9,%rbx,4),%xmm2
.byte 196,99,57,33,194,48 // vinsertps $0x30,%xmm2,%xmm8,%xmm8
- .byte 196,129,122,16,20,152 // vmovss (%r8,%r11,4),%xmm2
- .byte 196,3,105,33,12,144,16 // vinsertps $0x10,(%r8,%r10,4),%xmm2,%xmm9
- .byte 196,129,122,16,20,136 // vmovss (%r8,%r9,4),%xmm2
+ .byte 196,129,122,16,20,177 // vmovss (%r9,%r14,4),%xmm2
+ .byte 196,3,105,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm2,%xmm9
+ .byte 196,129,122,16,20,145 // vmovss (%r9,%r10,4),%xmm2
.byte 196,99,49,33,202,32 // vinsertps $0x20,%xmm2,%xmm9,%xmm9
- .byte 196,193,122,16,20,128 // vmovss (%r8,%rax,4),%xmm2
+ .byte 196,193,122,16,20,129 // vmovss (%r9,%rax,4),%xmm2
.byte 196,227,49,33,210,48 // vinsertps $0x30,%xmm2,%xmm9,%xmm2
.byte 196,195,109,24,208,1 // vinsertf128 $0x1,%xmm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -17897,10 +17932,11 @@ FUNCTION(_sk_table_a_avx)
_sk_table_a_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 197,121,110,192 // vmovd %eax,%xmm8
@@ -17910,34 +17946,35 @@ _sk_table_a_avx:
.byte 197,188,89,219 // vmulps %ymm3,%ymm8,%ymm3
.byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
.byte 196,227,249,22,216,1 // vpextrq $0x1,%xmm3,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,218 // vmovq %xmm3,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,219 // vmovq %xmm3,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,219,1 // vextractf128 $0x1,%ymm3,%xmm3
.byte 196,227,249,22,219,1 // vpextrq $0x1,%xmm3,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
+ .byte 65,137,223 // mov %ebx,%r15d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,249,126,223 // vmovq %xmm3,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,129,122,16,28,160 // vmovss (%r8,%r12,4),%xmm3
- .byte 196,3,97,33,4,184,16 // vinsertps $0x10,(%r8,%r15,4),%xmm3,%xmm8
- .byte 196,129,122,16,28,176 // vmovss (%r8,%r14,4),%xmm3
+ .byte 196,193,249,126,220 // vmovq %xmm3,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,129,122,16,28,169 // vmovss (%r9,%r13,4),%xmm3
+ .byte 196,3,97,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm3,%xmm8
+ .byte 196,129,122,16,28,185 // vmovss (%r9,%r15,4),%xmm3
.byte 196,99,57,33,195,32 // vinsertps $0x20,%xmm3,%xmm8,%xmm8
- .byte 196,193,122,16,28,152 // vmovss (%r8,%rbx,4),%xmm3
+ .byte 196,193,122,16,28,153 // vmovss (%r9,%rbx,4),%xmm3
.byte 196,99,57,33,195,48 // vinsertps $0x30,%xmm3,%xmm8,%xmm8
- .byte 196,129,122,16,28,152 // vmovss (%r8,%r11,4),%xmm3
- .byte 196,3,97,33,12,144,16 // vinsertps $0x10,(%r8,%r10,4),%xmm3,%xmm9
- .byte 196,129,122,16,28,136 // vmovss (%r8,%r9,4),%xmm3
+ .byte 196,129,122,16,28,177 // vmovss (%r9,%r14,4),%xmm3
+ .byte 196,3,97,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm3,%xmm9
+ .byte 196,129,122,16,28,145 // vmovss (%r9,%r10,4),%xmm3
.byte 196,99,49,33,203,32 // vinsertps $0x20,%xmm3,%xmm9,%xmm9
- .byte 196,193,122,16,28,128 // vmovss (%r8,%rax,4),%xmm3
+ .byte 196,193,122,16,28,129 // vmovss (%r9,%rax,4),%xmm3
.byte 196,227,49,33,219,48 // vinsertps $0x30,%xmm3,%xmm9,%xmm3
.byte 196,195,101,24,216,1 // vinsertf128 $0x1,%xmm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -17959,36 +17996,36 @@ _sk_parametric_r_avx:
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,216 // vcvtdq2ps %ymm0,%ymm11
- .byte 196,98,125,24,37,162,55,0,0 // vbroadcastss 0x37a2(%rip),%ymm12 # 66f8 <_sk_callback_avx+0x27c>
+ .byte 196,98,125,24,37,50,56,0,0 // vbroadcastss 0x3832(%rip),%ymm12 # 674c <_sk_callback_avx+0x284>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,152,55,0,0 // vbroadcastss 0x3798(%rip),%ymm12 # 66fc <_sk_callback_avx+0x280>
+ .byte 196,98,125,24,37,40,56,0,0 // vbroadcastss 0x3828(%rip),%ymm12 # 6750 <_sk_callback_avx+0x288>
.byte 196,193,124,84,196 // vandps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,142,55,0,0 // vbroadcastss 0x378e(%rip),%ymm12 # 6700 <_sk_callback_avx+0x284>
+ .byte 196,98,125,24,37,30,56,0,0 // vbroadcastss 0x381e(%rip),%ymm12 # 6754 <_sk_callback_avx+0x28c>
.byte 196,193,124,86,196 // vorps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,132,55,0,0 // vbroadcastss 0x3784(%rip),%ymm12 # 6704 <_sk_callback_avx+0x288>
+ .byte 196,98,125,24,37,20,56,0,0 // vbroadcastss 0x3814(%rip),%ymm12 # 6758 <_sk_callback_avx+0x290>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,122,55,0,0 // vbroadcastss 0x377a(%rip),%ymm12 # 6708 <_sk_callback_avx+0x28c>
+ .byte 196,98,125,24,37,10,56,0,0 // vbroadcastss 0x380a(%rip),%ymm12 # 675c <_sk_callback_avx+0x294>
.byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,107,55,0,0 // vbroadcastss 0x376b(%rip),%ymm12 # 670c <_sk_callback_avx+0x290>
+ .byte 196,98,125,24,37,251,55,0,0 // vbroadcastss 0x37fb(%rip),%ymm12 # 6760 <_sk_callback_avx+0x298>
.byte 196,193,124,88,196 // vaddps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,97,55,0,0 // vbroadcastss 0x3761(%rip),%ymm12 # 6710 <_sk_callback_avx+0x294>
+ .byte 196,98,125,24,37,241,55,0,0 // vbroadcastss 0x37f1(%rip),%ymm12 # 6764 <_sk_callback_avx+0x29c>
.byte 197,156,94,192 // vdivps %ymm0,%ymm12,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
.byte 197,172,89,192 // vmulps %ymm0,%ymm10,%ymm0
.byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,69,55,0,0 // vbroadcastss 0x3745(%rip),%ymm11 # 6714 <_sk_callback_avx+0x298>
+ .byte 196,98,125,24,29,213,55,0,0 // vbroadcastss 0x37d5(%rip),%ymm11 # 6768 <_sk_callback_avx+0x2a0>
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,59,55,0,0 // vbroadcastss 0x373b(%rip),%ymm11 # 6718 <_sk_callback_avx+0x29c>
+ .byte 196,98,125,24,29,203,55,0,0 // vbroadcastss 0x37cb(%rip),%ymm11 # 676c <_sk_callback_avx+0x2a4>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,124,92,195 // vsubps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,44,55,0,0 // vbroadcastss 0x372c(%rip),%ymm11 # 671c <_sk_callback_avx+0x2a0>
+ .byte 196,98,125,24,29,188,55,0,0 // vbroadcastss 0x37bc(%rip),%ymm11 # 6770 <_sk_callback_avx+0x2a8>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,34,55,0,0 // vbroadcastss 0x3722(%rip),%ymm11 # 6720 <_sk_callback_avx+0x2a4>
+ .byte 196,98,125,24,29,178,55,0,0 // vbroadcastss 0x37b2(%rip),%ymm11 # 6774 <_sk_callback_avx+0x2ac>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0
- .byte 196,98,125,24,21,19,55,0,0 // vbroadcastss 0x3713(%rip),%ymm10 # 6724 <_sk_callback_avx+0x2a8>
+ .byte 196,98,125,24,21,163,55,0,0 // vbroadcastss 0x37a3(%rip),%ymm10 # 6778 <_sk_callback_avx+0x2b0>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -17996,7 +18033,7 @@ _sk_parametric_r_avx:
.byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,234,54,0,0 // vbroadcastss 0x36ea(%rip),%ymm8 # 6728 <_sk_callback_avx+0x2ac>
+ .byte 196,98,125,24,5,122,55,0,0 // vbroadcastss 0x377a(%rip),%ymm8 # 677c <_sk_callback_avx+0x2b4>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -18018,36 +18055,36 @@ _sk_parametric_g_avx:
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,217 // vcvtdq2ps %ymm1,%ymm11
- .byte 196,98,125,24,37,155,54,0,0 // vbroadcastss 0x369b(%rip),%ymm12 # 672c <_sk_callback_avx+0x2b0>
+ .byte 196,98,125,24,37,43,55,0,0 // vbroadcastss 0x372b(%rip),%ymm12 # 6780 <_sk_callback_avx+0x2b8>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,145,54,0,0 // vbroadcastss 0x3691(%rip),%ymm12 # 6730 <_sk_callback_avx+0x2b4>
+ .byte 196,98,125,24,37,33,55,0,0 // vbroadcastss 0x3721(%rip),%ymm12 # 6784 <_sk_callback_avx+0x2bc>
.byte 196,193,116,84,204 // vandps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,135,54,0,0 // vbroadcastss 0x3687(%rip),%ymm12 # 6734 <_sk_callback_avx+0x2b8>
+ .byte 196,98,125,24,37,23,55,0,0 // vbroadcastss 0x3717(%rip),%ymm12 # 6788 <_sk_callback_avx+0x2c0>
.byte 196,193,116,86,204 // vorps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,125,54,0,0 // vbroadcastss 0x367d(%rip),%ymm12 # 6738 <_sk_callback_avx+0x2bc>
+ .byte 196,98,125,24,37,13,55,0,0 // vbroadcastss 0x370d(%rip),%ymm12 # 678c <_sk_callback_avx+0x2c4>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,115,54,0,0 // vbroadcastss 0x3673(%rip),%ymm12 # 673c <_sk_callback_avx+0x2c0>
+ .byte 196,98,125,24,37,3,55,0,0 // vbroadcastss 0x3703(%rip),%ymm12 # 6790 <_sk_callback_avx+0x2c8>
.byte 196,65,116,89,228 // vmulps %ymm12,%ymm1,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,100,54,0,0 // vbroadcastss 0x3664(%rip),%ymm12 # 6740 <_sk_callback_avx+0x2c4>
+ .byte 196,98,125,24,37,244,54,0,0 // vbroadcastss 0x36f4(%rip),%ymm12 # 6794 <_sk_callback_avx+0x2cc>
.byte 196,193,116,88,204 // vaddps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,90,54,0,0 // vbroadcastss 0x365a(%rip),%ymm12 # 6744 <_sk_callback_avx+0x2c8>
+ .byte 196,98,125,24,37,234,54,0,0 // vbroadcastss 0x36ea(%rip),%ymm12 # 6798 <_sk_callback_avx+0x2d0>
.byte 197,156,94,201 // vdivps %ymm1,%ymm12,%ymm1
.byte 197,164,92,201 // vsubps %ymm1,%ymm11,%ymm1
.byte 197,172,89,201 // vmulps %ymm1,%ymm10,%ymm1
.byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10
.byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10
- .byte 196,98,125,24,29,62,54,0,0 // vbroadcastss 0x363e(%rip),%ymm11 # 6748 <_sk_callback_avx+0x2cc>
+ .byte 196,98,125,24,29,206,54,0,0 // vbroadcastss 0x36ce(%rip),%ymm11 # 679c <_sk_callback_avx+0x2d4>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,52,54,0,0 // vbroadcastss 0x3634(%rip),%ymm11 # 674c <_sk_callback_avx+0x2d0>
+ .byte 196,98,125,24,29,196,54,0,0 // vbroadcastss 0x36c4(%rip),%ymm11 # 67a0 <_sk_callback_avx+0x2d8>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,116,92,203 // vsubps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,37,54,0,0 // vbroadcastss 0x3625(%rip),%ymm11 # 6750 <_sk_callback_avx+0x2d4>
+ .byte 196,98,125,24,29,181,54,0,0 // vbroadcastss 0x36b5(%rip),%ymm11 # 67a4 <_sk_callback_avx+0x2dc>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,27,54,0,0 // vbroadcastss 0x361b(%rip),%ymm11 # 6754 <_sk_callback_avx+0x2d8>
+ .byte 196,98,125,24,29,171,54,0,0 // vbroadcastss 0x36ab(%rip),%ymm11 # 67a8 <_sk_callback_avx+0x2e0>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,116,88,202 // vaddps %ymm10,%ymm1,%ymm1
- .byte 196,98,125,24,21,12,54,0,0 // vbroadcastss 0x360c(%rip),%ymm10 # 6758 <_sk_callback_avx+0x2dc>
+ .byte 196,98,125,24,21,156,54,0,0 // vbroadcastss 0x369c(%rip),%ymm10 # 67ac <_sk_callback_avx+0x2e4>
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -18055,7 +18092,7 @@ _sk_parametric_g_avx:
.byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,5,227,53,0,0 // vbroadcastss 0x35e3(%rip),%ymm8 # 675c <_sk_callback_avx+0x2e0>
+ .byte 196,98,125,24,5,115,54,0,0 // vbroadcastss 0x3673(%rip),%ymm8 # 67b0 <_sk_callback_avx+0x2e8>
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -18077,36 +18114,36 @@ _sk_parametric_b_avx:
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,218 // vcvtdq2ps %ymm2,%ymm11
- .byte 196,98,125,24,37,148,53,0,0 // vbroadcastss 0x3594(%rip),%ymm12 # 6760 <_sk_callback_avx+0x2e4>
+ .byte 196,98,125,24,37,36,54,0,0 // vbroadcastss 0x3624(%rip),%ymm12 # 67b4 <_sk_callback_avx+0x2ec>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,138,53,0,0 // vbroadcastss 0x358a(%rip),%ymm12 # 6764 <_sk_callback_avx+0x2e8>
+ .byte 196,98,125,24,37,26,54,0,0 // vbroadcastss 0x361a(%rip),%ymm12 # 67b8 <_sk_callback_avx+0x2f0>
.byte 196,193,108,84,212 // vandps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,128,53,0,0 // vbroadcastss 0x3580(%rip),%ymm12 # 6768 <_sk_callback_avx+0x2ec>
+ .byte 196,98,125,24,37,16,54,0,0 // vbroadcastss 0x3610(%rip),%ymm12 # 67bc <_sk_callback_avx+0x2f4>
.byte 196,193,108,86,212 // vorps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,118,53,0,0 // vbroadcastss 0x3576(%rip),%ymm12 # 676c <_sk_callback_avx+0x2f0>
+ .byte 196,98,125,24,37,6,54,0,0 // vbroadcastss 0x3606(%rip),%ymm12 # 67c0 <_sk_callback_avx+0x2f8>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,108,53,0,0 // vbroadcastss 0x356c(%rip),%ymm12 # 6770 <_sk_callback_avx+0x2f4>
+ .byte 196,98,125,24,37,252,53,0,0 // vbroadcastss 0x35fc(%rip),%ymm12 # 67c4 <_sk_callback_avx+0x2fc>
.byte 196,65,108,89,228 // vmulps %ymm12,%ymm2,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,93,53,0,0 // vbroadcastss 0x355d(%rip),%ymm12 # 6774 <_sk_callback_avx+0x2f8>
+ .byte 196,98,125,24,37,237,53,0,0 // vbroadcastss 0x35ed(%rip),%ymm12 # 67c8 <_sk_callback_avx+0x300>
.byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,83,53,0,0 // vbroadcastss 0x3553(%rip),%ymm12 # 6778 <_sk_callback_avx+0x2fc>
+ .byte 196,98,125,24,37,227,53,0,0 // vbroadcastss 0x35e3(%rip),%ymm12 # 67cc <_sk_callback_avx+0x304>
.byte 197,156,94,210 // vdivps %ymm2,%ymm12,%ymm2
.byte 197,164,92,210 // vsubps %ymm2,%ymm11,%ymm2
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10
.byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10
- .byte 196,98,125,24,29,55,53,0,0 // vbroadcastss 0x3537(%rip),%ymm11 # 677c <_sk_callback_avx+0x300>
+ .byte 196,98,125,24,29,199,53,0,0 // vbroadcastss 0x35c7(%rip),%ymm11 # 67d0 <_sk_callback_avx+0x308>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,45,53,0,0 // vbroadcastss 0x352d(%rip),%ymm11 # 6780 <_sk_callback_avx+0x304>
+ .byte 196,98,125,24,29,189,53,0,0 // vbroadcastss 0x35bd(%rip),%ymm11 # 67d4 <_sk_callback_avx+0x30c>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,108,92,211 // vsubps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,30,53,0,0 // vbroadcastss 0x351e(%rip),%ymm11 # 6784 <_sk_callback_avx+0x308>
+ .byte 196,98,125,24,29,174,53,0,0 // vbroadcastss 0x35ae(%rip),%ymm11 # 67d8 <_sk_callback_avx+0x310>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,20,53,0,0 // vbroadcastss 0x3514(%rip),%ymm11 # 6788 <_sk_callback_avx+0x30c>
+ .byte 196,98,125,24,29,164,53,0,0 // vbroadcastss 0x35a4(%rip),%ymm11 # 67dc <_sk_callback_avx+0x314>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,108,88,210 // vaddps %ymm10,%ymm2,%ymm2
- .byte 196,98,125,24,21,5,53,0,0 // vbroadcastss 0x3505(%rip),%ymm10 # 678c <_sk_callback_avx+0x310>
+ .byte 196,98,125,24,21,149,53,0,0 // vbroadcastss 0x3595(%rip),%ymm10 # 67e0 <_sk_callback_avx+0x318>
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -18114,7 +18151,7 @@ _sk_parametric_b_avx:
.byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,220,52,0,0 // vbroadcastss 0x34dc(%rip),%ymm8 # 6790 <_sk_callback_avx+0x314>
+ .byte 196,98,125,24,5,108,53,0,0 // vbroadcastss 0x356c(%rip),%ymm8 # 67e4 <_sk_callback_avx+0x31c>
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -18136,36 +18173,36 @@ _sk_parametric_a_avx:
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,219 // vcvtdq2ps %ymm3,%ymm11
- .byte 196,98,125,24,37,141,52,0,0 // vbroadcastss 0x348d(%rip),%ymm12 # 6794 <_sk_callback_avx+0x318>
+ .byte 196,98,125,24,37,29,53,0,0 // vbroadcastss 0x351d(%rip),%ymm12 # 67e8 <_sk_callback_avx+0x320>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,131,52,0,0 // vbroadcastss 0x3483(%rip),%ymm12 # 6798 <_sk_callback_avx+0x31c>
+ .byte 196,98,125,24,37,19,53,0,0 // vbroadcastss 0x3513(%rip),%ymm12 # 67ec <_sk_callback_avx+0x324>
.byte 196,193,100,84,220 // vandps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,121,52,0,0 // vbroadcastss 0x3479(%rip),%ymm12 # 679c <_sk_callback_avx+0x320>
+ .byte 196,98,125,24,37,9,53,0,0 // vbroadcastss 0x3509(%rip),%ymm12 # 67f0 <_sk_callback_avx+0x328>
.byte 196,193,100,86,220 // vorps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,111,52,0,0 // vbroadcastss 0x346f(%rip),%ymm12 # 67a0 <_sk_callback_avx+0x324>
+ .byte 196,98,125,24,37,255,52,0,0 // vbroadcastss 0x34ff(%rip),%ymm12 # 67f4 <_sk_callback_avx+0x32c>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,101,52,0,0 // vbroadcastss 0x3465(%rip),%ymm12 # 67a4 <_sk_callback_avx+0x328>
+ .byte 196,98,125,24,37,245,52,0,0 // vbroadcastss 0x34f5(%rip),%ymm12 # 67f8 <_sk_callback_avx+0x330>
.byte 196,65,100,89,228 // vmulps %ymm12,%ymm3,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,86,52,0,0 // vbroadcastss 0x3456(%rip),%ymm12 # 67a8 <_sk_callback_avx+0x32c>
+ .byte 196,98,125,24,37,230,52,0,0 // vbroadcastss 0x34e6(%rip),%ymm12 # 67fc <_sk_callback_avx+0x334>
.byte 196,193,100,88,220 // vaddps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,76,52,0,0 // vbroadcastss 0x344c(%rip),%ymm12 # 67ac <_sk_callback_avx+0x330>
+ .byte 196,98,125,24,37,220,52,0,0 // vbroadcastss 0x34dc(%rip),%ymm12 # 6800 <_sk_callback_avx+0x338>
.byte 197,156,94,219 // vdivps %ymm3,%ymm12,%ymm3
.byte 197,164,92,219 // vsubps %ymm3,%ymm11,%ymm3
.byte 197,172,89,219 // vmulps %ymm3,%ymm10,%ymm3
.byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10
.byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10
- .byte 196,98,125,24,29,48,52,0,0 // vbroadcastss 0x3430(%rip),%ymm11 # 67b0 <_sk_callback_avx+0x334>
+ .byte 196,98,125,24,29,192,52,0,0 // vbroadcastss 0x34c0(%rip),%ymm11 # 6804 <_sk_callback_avx+0x33c>
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,38,52,0,0 // vbroadcastss 0x3426(%rip),%ymm11 # 67b4 <_sk_callback_avx+0x338>
+ .byte 196,98,125,24,29,182,52,0,0 // vbroadcastss 0x34b6(%rip),%ymm11 # 6808 <_sk_callback_avx+0x340>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,100,92,219 // vsubps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,23,52,0,0 // vbroadcastss 0x3417(%rip),%ymm11 # 67b8 <_sk_callback_avx+0x33c>
+ .byte 196,98,125,24,29,167,52,0,0 // vbroadcastss 0x34a7(%rip),%ymm11 # 680c <_sk_callback_avx+0x344>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,13,52,0,0 // vbroadcastss 0x340d(%rip),%ymm11 # 67bc <_sk_callback_avx+0x340>
+ .byte 196,98,125,24,29,157,52,0,0 // vbroadcastss 0x349d(%rip),%ymm11 # 6810 <_sk_callback_avx+0x348>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,100,88,218 // vaddps %ymm10,%ymm3,%ymm3
- .byte 196,98,125,24,21,254,51,0,0 // vbroadcastss 0x33fe(%rip),%ymm10 # 67c0 <_sk_callback_avx+0x344>
+ .byte 196,98,125,24,21,142,52,0,0 // vbroadcastss 0x348e(%rip),%ymm10 # 6814 <_sk_callback_avx+0x34c>
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -18173,7 +18210,7 @@ _sk_parametric_a_avx:
.byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3
- .byte 196,98,125,24,5,213,51,0,0 // vbroadcastss 0x33d5(%rip),%ymm8 # 67c4 <_sk_callback_avx+0x348>
+ .byte 196,98,125,24,5,101,52,0,0 // vbroadcastss 0x3465(%rip),%ymm8 # 6818 <_sk_callback_avx+0x350>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -18182,31 +18219,31 @@ HIDDEN _sk_lab_to_xyz_avx
.globl _sk_lab_to_xyz_avx
FUNCTION(_sk_lab_to_xyz_avx)
_sk_lab_to_xyz_avx:
- .byte 196,98,125,24,5,199,51,0,0 // vbroadcastss 0x33c7(%rip),%ymm8 # 67c8 <_sk_callback_avx+0x34c>
+ .byte 196,98,125,24,5,87,52,0,0 // vbroadcastss 0x3457(%rip),%ymm8 # 681c <_sk_callback_avx+0x354>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,189,51,0,0 // vbroadcastss 0x33bd(%rip),%ymm8 # 67cc <_sk_callback_avx+0x350>
+ .byte 196,98,125,24,5,77,52,0,0 // vbroadcastss 0x344d(%rip),%ymm8 # 6820 <_sk_callback_avx+0x358>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,13,179,51,0,0 // vbroadcastss 0x33b3(%rip),%ymm9 # 67d0 <_sk_callback_avx+0x354>
+ .byte 196,98,125,24,13,67,52,0,0 // vbroadcastss 0x3443(%rip),%ymm9 # 6824 <_sk_callback_avx+0x35c>
.byte 196,193,116,88,201 // vaddps %ymm9,%ymm1,%ymm1
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 196,193,108,88,209 // vaddps %ymm9,%ymm2,%ymm2
- .byte 196,98,125,24,5,159,51,0,0 // vbroadcastss 0x339f(%rip),%ymm8 # 67d4 <_sk_callback_avx+0x358>
+ .byte 196,98,125,24,5,47,52,0,0 // vbroadcastss 0x342f(%rip),%ymm8 # 6828 <_sk_callback_avx+0x360>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,149,51,0,0 // vbroadcastss 0x3395(%rip),%ymm8 # 67d8 <_sk_callback_avx+0x35c>
+ .byte 196,98,125,24,5,37,52,0,0 // vbroadcastss 0x3425(%rip),%ymm8 # 682c <_sk_callback_avx+0x364>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,139,51,0,0 // vbroadcastss 0x338b(%rip),%ymm8 # 67dc <_sk_callback_avx+0x360>
+ .byte 196,98,125,24,5,27,52,0,0 // vbroadcastss 0x341b(%rip),%ymm8 # 6830 <_sk_callback_avx+0x368>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 197,252,88,201 // vaddps %ymm1,%ymm0,%ymm1
- .byte 196,98,125,24,5,125,51,0,0 // vbroadcastss 0x337d(%rip),%ymm8 # 67e0 <_sk_callback_avx+0x364>
+ .byte 196,98,125,24,5,13,52,0,0 // vbroadcastss 0x340d(%rip),%ymm8 # 6834 <_sk_callback_avx+0x36c>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,252,92,210 // vsubps %ymm2,%ymm0,%ymm2
.byte 197,116,89,193 // vmulps %ymm1,%ymm1,%ymm8
.byte 196,65,116,89,192 // vmulps %ymm8,%ymm1,%ymm8
- .byte 196,98,125,24,13,102,51,0,0 // vbroadcastss 0x3366(%rip),%ymm9 # 67e4 <_sk_callback_avx+0x368>
+ .byte 196,98,125,24,13,246,51,0,0 // vbroadcastss 0x33f6(%rip),%ymm9 # 6838 <_sk_callback_avx+0x370>
.byte 196,65,52,194,208,1 // vcmpltps %ymm8,%ymm9,%ymm10
- .byte 196,98,125,24,29,91,51,0,0 // vbroadcastss 0x335b(%rip),%ymm11 # 67e8 <_sk_callback_avx+0x36c>
+ .byte 196,98,125,24,29,235,51,0,0 // vbroadcastss 0x33eb(%rip),%ymm11 # 683c <_sk_callback_avx+0x374>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,37,81,51,0,0 // vbroadcastss 0x3351(%rip),%ymm12 # 67ec <_sk_callback_avx+0x370>
+ .byte 196,98,125,24,37,225,51,0,0 // vbroadcastss 0x33e1(%rip),%ymm12 # 6840 <_sk_callback_avx+0x378>
.byte 196,193,116,89,204 // vmulps %ymm12,%ymm1,%ymm1
.byte 196,67,117,74,192,160 // vblendvps %ymm10,%ymm8,%ymm1,%ymm8
.byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1
@@ -18221,9 +18258,9 @@ _sk_lab_to_xyz_avx:
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,193,108,89,212 // vmulps %ymm12,%ymm2,%ymm2
.byte 196,227,109,74,208,144 // vblendvps %ymm9,%ymm0,%ymm2,%ymm2
- .byte 196,226,125,24,5,7,51,0,0 // vbroadcastss 0x3307(%rip),%ymm0 # 67f0 <_sk_callback_avx+0x374>
+ .byte 196,226,125,24,5,151,51,0,0 // vbroadcastss 0x3397(%rip),%ymm0 # 6844 <_sk_callback_avx+0x37c>
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,254,50,0,0 // vbroadcastss 0x32fe(%rip),%ymm8 # 67f4 <_sk_callback_avx+0x378>
+ .byte 196,98,125,24,5,142,51,0,0 // vbroadcastss 0x338e(%rip),%ymm8 # 6848 <_sk_callback_avx+0x380>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -18232,38 +18269,40 @@ HIDDEN _sk_load_a8_avx
.globl _sk_load_a8_avx
FUNCTION(_sk_load_a8_avx)
_sk_load_a8_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,62 // jne 354d <_sk_load_a8_avx+0x4e>
+ .byte 117,62 // jne 3511 <_sk_load_a8_avx+0x4e>
.byte 197,250,126,0 // vmovq (%rax),%xmm0
.byte 196,226,121,49,200 // vpmovzxbd %xmm0,%xmm1
.byte 196,227,121,4,192,229 // vpermilps $0xe5,%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,194,50,0,0 // vbroadcastss 0x32c2(%rip),%ymm1 # 67f8 <_sk_callback_avx+0x37c>
+ .byte 196,226,125,24,13,82,51,0,0 // vbroadcastss 0x3352(%rip),%ymm1 # 684c <_sk_callback_avx+0x384>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 3555 <_sk_load_a8_avx+0x56>
- .byte 196,193,249,110,193 // vmovq %r9,%xmm0
- .byte 235,161 // jmp 3513 <_sk_load_a8_avx+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 351a <_sk_load_a8_avx+0x57>
+ .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 91 // pop %rbx
+ .byte 235,160 // jmp 34d7 <_sk_load_a8_avx+0x14>
HIDDEN _sk_gather_a8_avx
.globl _sk_gather_a8_avx
@@ -18271,10 +18310,11 @@ FUNCTION(_sk_gather_a8_avx)
_sk_gather_a8_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -18285,35 +18325,35 @@ _sk_gather_a8_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,131,121,32,4,48,0 // vpinsrb $0x0,(%r8,%r14,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm0,%xmm0
- .byte 67,15,182,28,32 // movzbl (%r8,%r12,1),%ebx
+ .byte 196,131,121,32,4,57,0 // vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
+ .byte 67,15,182,28,41 // movzbl (%r9,%r13,1),%ebx
.byte 196,227,121,32,195,2 // vpinsrb $0x2,%ebx,%xmm0,%xmm0
- .byte 67,15,182,28,56 // movzbl (%r8,%r15,1),%ebx
+ .byte 67,15,182,28,33 // movzbl (%r9,%r12,1),%ebx
.byte 196,227,121,32,195,3 // vpinsrb $0x3,%ebx,%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 196,131,121,32,12,24,0 // vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm1
- .byte 196,131,113,32,12,16,1 // vpinsrb $0x1,(%r8,%r10,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
+ .byte 196,131,121,32,12,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1
+ .byte 196,131,113,32,12,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1
+ .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx
.byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1
.byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,183,49,0,0 // vbroadcastss 0x31b7(%rip),%ymm1 # 67fc <_sk_callback_avx+0x380>
+ .byte 196,226,125,24,13,68,50,0,0 // vbroadcastss 0x3244(%rip),%ymm1 # 6850 <_sk_callback_avx+0x388>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -18321,6 +18361,7 @@ _sk_gather_a8_avx:
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -18330,58 +18371,58 @@ HIDDEN _sk_store_a8_avx
FUNCTION(_sk_store_a8_avx)
_sk_store_a8_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,146,49,0,0 // vbroadcastss 0x3192(%rip),%ymm8 # 6800 <_sk_callback_avx+0x384>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,29,50,0,0 // vbroadcastss 0x321d(%rip),%ymm8 # 6854 <_sk_callback_avx+0x38c>
.byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8
.byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 196,65,57,103,192 // vpackuswb %xmm8,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3697 <_sk_store_a8_avx+0x37>
- .byte 196,65,123,17,4,58 // vmovsd %xmm8,(%r10,%rdi,1)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3660 <_sk_store_a8_avx+0x37>
+ .byte 196,65,123,17,4,19 // vmovsd %xmm8,(%r11,%rdx,1)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 3693 <_sk_store_a8_avx+0x33>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 365c <_sk_store_a8_avx+0x33>
.byte 196,66,121,48,192 // vpmovzxbw %xmm8,%xmm8
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,69,0,0,0 // lea 0x45(%rip),%r9 # 36fc <_sk_store_a8_avx+0x9c>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,20,68,58,6,12 // vpextrb $0xc,%xmm8,0x6(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,5,10 // vpextrb $0xa,%xmm8,0x5(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,4,8 // vpextrb $0x8,%xmm8,0x4(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,3,6 // vpextrb $0x6,%xmm8,0x3(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,2,4 // vpextrb $0x4,%xmm8,0x2(%r10,%rdi,1)
- .byte 196,67,121,20,68,58,1,2 // vpextrb $0x2,%xmm8,0x1(%r10,%rdi,1)
- .byte 196,67,121,20,4,58,0 // vpextrb $0x0,%xmm8,(%r10,%rdi,1)
- .byte 235,154 // jmp 3693 <_sk_store_a8_avx+0x33>
- .byte 15,31,0 // nopl (%rax)
- .byte 244 // hlt
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 36c4 <_sk_store_a8_avx+0x9b>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,20,68,19,6,12 // vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,5,10 // vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,4,8 // vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,3,6 // vpextrb $0x6,%xmm8,0x3(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
+ .byte 196,67,121,20,68,19,1,2 // vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1)
+ .byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1)
+ .byte 235,154 // jmp 365c <_sk_store_a8_avx+0x33>
+ .byte 102,144 // xchg %ax,%ax
+ .byte 245 // cmc
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 236 // in (%dx),%al
+ .byte 237 // in (%dx),%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,228 // jmpq *%rsp
+ .byte 255,229 // jmpq *%rbp
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 220,255 // fdivr %st,%st(7)
+ .byte 221,255 // (bad)
.byte 255 // (bad)
- .byte 255,212 // callq *%rsp
+ .byte 255,213 // callq *%rbp
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,204 // dec %esp
+ .byte 255,205 // dec %ebp
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,196 // inc %esp
+ .byte 255,197 // inc %ebp
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -18390,38 +18431,40 @@ HIDDEN _sk_load_g8_avx
.globl _sk_load_g8_avx
FUNCTION(_sk_load_g8_avx)
_sk_load_g8_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,1,248 // add %rdi,%rax
+ .byte 72,1,208 // add %rdx,%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,67 // jne 376b <_sk_load_g8_avx+0x53>
+ .byte 117,67 // jne 3733 <_sk_load_g8_avx+0x53>
.byte 197,250,126,0 // vmovq (%rax),%xmm0
.byte 196,226,121,49,200 // vpmovzxbd %xmm0,%xmm1
.byte 196,227,121,4,192,229 // vpermilps $0xe5,%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,181,48,0,0 // vbroadcastss 0x30b5(%rip),%ymm1 # 6804 <_sk_callback_avx+0x388>
+ .byte 196,226,125,24,13,65,49,0,0 // vbroadcastss 0x3141(%rip),%ymm1 # 6858 <_sk_callback_avx+0x390>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,170,48,0,0 // vbroadcastss 0x30aa(%rip),%ymm3 # 6808 <_sk_callback_avx+0x38c>
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 196,226,125,24,29,54,49,0,0 // vbroadcastss 0x3136(%rip),%ymm3 # 685c <_sk_callback_avx+0x394>
+ .byte 76,137,201 // mov %r9,%rcx
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
+ .byte 83 // push %rbx
.byte 49,201 // xor %ecx,%ecx
- .byte 77,137,194 // mov %r8,%r10
- .byte 69,49,201 // xor %r9d,%r9d
- .byte 68,15,182,24 // movzbl (%rax),%r11d
+ .byte 77,137,195 // mov %r8,%r11
+ .byte 69,49,210 // xor %r10d,%r10d
+ .byte 15,182,24 // movzbl (%rax),%ebx
.byte 72,255,192 // inc %rax
- .byte 73,211,227 // shl %cl,%r11
- .byte 77,9,217 // or %r11,%r9
+ .byte 72,211,227 // shl %cl,%rbx
+ .byte 73,9,218 // or %rbx,%r10
.byte 72,131,193,8 // add $0x8,%rcx
- .byte 73,255,202 // dec %r10
- .byte 117,234 // jne 3773 <_sk_load_g8_avx+0x5b>
- .byte 196,193,249,110,193 // vmovq %r9,%xmm0
- .byte 235,156 // jmp 372c <_sk_load_g8_avx+0x14>
+ .byte 73,255,203 // dec %r11
+ .byte 117,235 // jne 373c <_sk_load_g8_avx+0x5c>
+ .byte 196,193,249,110,194 // vmovq %r10,%xmm0
+ .byte 91 // pop %rbx
+ .byte 235,155 // jmp 36f4 <_sk_load_g8_avx+0x14>
HIDDEN _sk_gather_g8_avx
.globl _sk_gather_g8_avx
@@ -18429,10 +18472,11 @@ FUNCTION(_sk_gather_g8_avx)
_sk_gather_g8_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -18443,42 +18487,43 @@ _sk_gather_g8_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,131,121,32,4,48,0 // vpinsrb $0x0,(%r8,%r14,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,24,1 // vpinsrb $0x1,(%r8,%rbx,1),%xmm0,%xmm0
- .byte 67,15,182,28,32 // movzbl (%r8,%r12,1),%ebx
+ .byte 196,131,121,32,4,57,0 // vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
+ .byte 67,15,182,28,41 // movzbl (%r9,%r13,1),%ebx
.byte 196,227,121,32,195,2 // vpinsrb $0x2,%ebx,%xmm0,%xmm0
- .byte 67,15,182,28,56 // movzbl (%r8,%r15,1),%ebx
+ .byte 67,15,182,28,33 // movzbl (%r9,%r12,1),%ebx
.byte 196,227,121,32,195,3 // vpinsrb $0x3,%ebx,%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 196,131,121,32,12,24,0 // vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm1
- .byte 196,131,113,32,12,16,1 // vpinsrb $0x1,(%r8,%r10,1),%xmm1,%xmm1
- .byte 67,15,182,28,8 // movzbl (%r8,%r9,1),%ebx
+ .byte 196,131,121,32,12,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1
+ .byte 196,131,113,32,12,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1
+ .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx
.byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1
.byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,169,47,0,0 // vbroadcastss 0x2fa9(%rip),%ymm1 # 680c <_sk_callback_avx+0x390>
+ .byte 196,226,125,24,13,50,48,0,0 // vbroadcastss 0x3032(%rip),%ymm1 # 6860 <_sk_callback_avx+0x398>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,158,47,0,0 // vbroadcastss 0x2f9e(%rip),%ymm3 # 6810 <_sk_callback_avx+0x394>
+ .byte 196,226,125,24,29,39,48,0,0 // vbroadcastss 0x3027(%rip),%ymm3 # 6864 <_sk_callback_avx+0x39c>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -18488,18 +18533,19 @@ HIDDEN _sk_gather_i8_avx
FUNCTION(_sk_gather_i8_avx)
_sk_gather_i8_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,192 // mov %rax,%r8
- .byte 77,133,192 // test %r8,%r8
- .byte 116,5 // je 3892 <_sk_gather_i8_avx+0xf>
- .byte 76,137,192 // mov %r8,%rax
- .byte 235,2 // jmp 3894 <_sk_gather_i8_avx+0x11>
+ .byte 73,137,193 // mov %rax,%r9
+ .byte 77,133,201 // test %r9,%r9
+ .byte 116,5 // je 385f <_sk_gather_i8_avx+0xf>
+ .byte 76,137,200 // mov %r9,%rax
+ .byte 235,2 // jmp 3861 <_sk_gather_i8_avx+0x11>
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,139,16 // mov (%rax),%r10
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -18510,54 +18556,54 @@ _sk_gather_i8_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,211 // vmovq %xmm2,%r11
- .byte 69,137,222 // mov %r11d,%r14d
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
- .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,223 // mov %ebx,%r15d
- .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
- .byte 69,137,229 // mov %r12d,%r13d
- .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,225,249,126,211 // vmovq %xmm2,%rbx
+ .byte 65,137,222 // mov %ebx,%r14d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,17,2 // vpinsrb $0x2,(%r9,%r10,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,1,3 // vpinsrb $0x3,(%r9,%rax,1),%xmm0,%xmm0
+ .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
+ .byte 196,193,249,126,199 // vmovq %xmm0,%r15
+ .byte 69,137,252 // mov %r15d,%r12d
+ .byte 196,195,249,22,197,1 // vpextrq $0x1,%xmm0,%r13
+ .byte 68,137,237 // mov %r13d,%ebp
+ .byte 73,193,237,32 // shr $0x20,%r13
+ .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 196,131,121,32,4,50,0 // vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,26,1 // vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10
- .byte 196,193,249,126,195 // vmovq %xmm0,%r11
- .byte 196,131,121,32,4,57,0 // vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
- .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,41,2 // vpinsrb $0x2,(%r9,%r13,1),%xmm0,%xmm0
- .byte 196,131,121,32,4,33,3 // vpinsrb $0x3,(%r9,%r12,1),%xmm0,%xmm0
+ .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11
+ .byte 196,193,249,126,198 // vmovq %xmm0,%r14
+ .byte 196,131,121,32,4,34,0 // vpinsrb $0x0,(%r10,%r12,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,58,1 // vpinsrb $0x1,(%r10,%r15,1),%xmm0,%xmm0
+ .byte 196,195,121,32,4,42,2 // vpinsrb $0x2,(%r10,%rbp,1),%xmm0,%xmm0
+ .byte 196,131,121,32,4,42,3 // vpinsrb $0x3,(%r10,%r13,1),%xmm0,%xmm0
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 73,139,88,8 // mov 0x8(%r8),%rbx
- .byte 196,193,249,126,193 // vmovq %xmm0,%r9
- .byte 69,137,200 // mov %r9d,%r8d
- .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 73,139,105,8 // mov 0x8(%r9),%rbp
+ .byte 196,225,249,126,195 // vmovq %xmm0,%rbx
+ .byte 65,137,217 // mov %ebx,%r9d
+ .byte 72,193,235,30 // shr $0x1e,%rbx
.byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 65,137,198 // mov %eax,%r14d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 69,137,223 // mov %r11d,%r15d
+ .byte 69,137,247 // mov %r14d,%r15d
+ .byte 73,193,238,30 // shr $0x1e,%r14
+ .byte 69,137,220 // mov %r11d,%r12d
.byte 73,193,235,30 // shr $0x1e,%r11
- .byte 69,137,212 // mov %r10d,%r12d
- .byte 73,193,234,30 // shr $0x1e,%r10
- .byte 196,161,121,110,4,131 // vmovd (%rbx,%r8,4),%xmm0
- .byte 196,163,121,34,4,11,1 // vpinsrd $0x1,(%rbx,%r9,1),%xmm0,%xmm0
- .byte 196,163,121,34,4,179,2 // vpinsrd $0x2,(%rbx,%r14,4),%xmm0,%xmm0
- .byte 196,99,121,34,4,3,3 // vpinsrd $0x3,(%rbx,%rax,1),%xmm0,%xmm8
- .byte 196,161,121,110,4,187 // vmovd (%rbx,%r15,4),%xmm0
- .byte 196,163,121,34,4,27,1 // vpinsrd $0x1,(%rbx,%r11,1),%xmm0,%xmm0
- .byte 196,163,121,34,4,163,2 // vpinsrd $0x2,(%rbx,%r12,4),%xmm0,%xmm0
- .byte 196,163,121,34,28,19,3 // vpinsrd $0x3,(%rbx,%r10,1),%xmm0,%xmm3
+ .byte 196,161,121,110,68,141,0 // vmovd 0x0(%rbp,%r9,4),%xmm0
+ .byte 196,227,121,34,68,29,0,1 // vpinsrd $0x1,0x0(%rbp,%rbx,1),%xmm0,%xmm0
+ .byte 196,163,121,34,68,149,0,2 // vpinsrd $0x2,0x0(%rbp,%r10,4),%xmm0,%xmm0
+ .byte 196,99,121,34,68,5,0,3 // vpinsrd $0x3,0x0(%rbp,%rax,1),%xmm0,%xmm8
+ .byte 196,161,121,110,68,189,0 // vmovd 0x0(%rbp,%r15,4),%xmm0
+ .byte 196,163,121,34,68,53,0,1 // vpinsrd $0x1,0x0(%rbp,%r14,1),%xmm0,%xmm0
+ .byte 196,163,121,34,68,165,0,2 // vpinsrd $0x2,0x0(%rbp,%r12,4),%xmm0,%xmm0
+ .byte 196,163,121,34,92,29,0,3 // vpinsrd $0x3,0x0(%rbp,%r11,1),%xmm0,%xmm3
.byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- .byte 197,124,40,21,2,49,0,0 // vmovaps 0x3102(%rip),%ymm10 # 6ac0 <_sk_callback_avx+0x644>
+ .byte 197,124,40,21,140,49,0,0 // vmovaps 0x318c(%rip),%ymm10 # 6b20 <_sk_callback_avx+0x658>
.byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,68,46,0,0 // vbroadcastss 0x2e44(%rip),%ymm9 # 6814 <_sk_callback_avx+0x398>
+ .byte 196,98,125,24,13,194,46,0,0 // vbroadcastss 0x2ec2(%rip),%ymm9 # 6868 <_sk_callback_avx+0x3a0>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1
.byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2
@@ -18582,6 +18628,7 @@ _sk_gather_i8_avx:
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_load_565_avx
@@ -18589,72 +18636,72 @@ HIDDEN _sk_load_565_avx
FUNCTION(_sk_load_565_avx)
_sk_load_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,128,0,0,0 // jne 3ac8 <_sk_load_565_avx+0x8e>
- .byte 196,193,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm0
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,128,0,0,0 // jne 3a9f <_sk_load_565_avx+0x8e>
+ .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- .byte 196,226,125,24,5,174,45,0,0 // vbroadcastss 0x2dae(%rip),%ymm0 # 6818 <_sk_callback_avx+0x39c>
+ .byte 196,226,125,24,5,43,46,0,0 // vbroadcastss 0x2e2b(%rip),%ymm0 # 686c <_sk_callback_avx+0x3a4>
.byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,161,45,0,0 // vbroadcastss 0x2da1(%rip),%ymm1 # 681c <_sk_callback_avx+0x3a0>
+ .byte 196,226,125,24,13,30,46,0,0 // vbroadcastss 0x2e1e(%rip),%ymm1 # 6870 <_sk_callback_avx+0x3a8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,152,45,0,0 // vbroadcastss 0x2d98(%rip),%ymm1 # 6820 <_sk_callback_avx+0x3a4>
+ .byte 196,226,125,24,13,21,46,0,0 // vbroadcastss 0x2e15(%rip),%ymm1 # 6874 <_sk_callback_avx+0x3ac>
.byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,139,45,0,0 // vbroadcastss 0x2d8b(%rip),%ymm3 # 6824 <_sk_callback_avx+0x3a8>
+ .byte 196,226,125,24,29,8,46,0,0 // vbroadcastss 0x2e08(%rip),%ymm3 # 6878 <_sk_callback_avx+0x3b0>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,24,29,130,45,0,0 // vbroadcastss 0x2d82(%rip),%ymm3 # 6828 <_sk_callback_avx+0x3ac>
+ .byte 196,226,125,24,29,255,45,0,0 // vbroadcastss 0x2dff(%rip),%ymm3 # 687c <_sk_callback_avx+0x3b4>
.byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,117,45,0,0 // vbroadcastss 0x2d75(%rip),%ymm3 # 682c <_sk_callback_avx+0x3b0>
+ .byte 196,226,125,24,29,242,45,0,0 // vbroadcastss 0x2df2(%rip),%ymm3 # 6880 <_sk_callback_avx+0x3b8>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,106,45,0,0 // vbroadcastss 0x2d6a(%rip),%ymm3 # 6830 <_sk_callback_avx+0x3b4>
+ .byte 196,226,125,24,29,231,45,0,0 // vbroadcastss 0x2de7(%rip),%ymm3 # 6884 <_sk_callback_avx+0x3bc>
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 15,135,110,255,255,255 // ja 3a4e <_sk_load_565_avx+0x14>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,73,0,0,0 // lea 0x49(%rip),%r9 # 3b34 <_sk_load_565_avx+0xfa>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 15,135,110,255,255,255 // ja 3a25 <_sk_load_565_avx+0x14>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 3b0c <_sk_load_565_avx+0xfb>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 196,193,121,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- .byte 233,26,255,255,255 // jmpq 3a4e <_sk_load_565_avx+0x14>
- .byte 244 // hlt
+ .byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 233,26,255,255,255 // jmpq 3a25 <_sk_load_565_avx+0x14>
+ .byte 144 // nop
+ .byte 243,255 // repz (bad)
.byte 255 // (bad)
.byte 255 // (bad)
+ .byte 235,255 // jmp 3b11 <_sk_load_565_avx+0x100>
.byte 255 // (bad)
- .byte 236 // in (%dx),%al
+ .byte 255,227 // jmpq *%rbx
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,228 // jmpq *%rsp
.byte 255 // (bad)
+ .byte 219,255 // (bad)
.byte 255 // (bad)
+ .byte 255,211 // callq *%rbx
.byte 255 // (bad)
- .byte 220,255 // fdivr %st,%st(7)
.byte 255 // (bad)
- .byte 255,212 // callq *%rsp
+ .byte 255,203 // dec %ebx
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,204 // dec %esp
.byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,192 // inc %eax
+ .byte 191 // .byte 0xbf
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -18666,10 +18713,11 @@ _sk_gather_565_avx:
.byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -18680,57 +18728,58 @@ _sk_gather_565_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 65,15,183,28,88 // movzwl (%r8,%rbx,2),%ebx
- .byte 67,15,183,44,112 // movzwl (%r8,%r14,2),%ebp
+ .byte 65,15,183,28,89 // movzwl (%r9,%rbx,2),%ebx
+ .byte 67,15,183,44,121 // movzwl (%r9,%r15,2),%ebp
.byte 197,249,110,197 // vmovd %ebp,%xmm0
.byte 197,249,196,195,1 // vpinsrw $0x1,%ebx,%xmm0,%xmm0
- .byte 67,15,183,28,96 // movzwl (%r8,%r12,2),%ebx
+ .byte 67,15,183,28,105 // movzwl (%r9,%r13,2),%ebx
.byte 197,249,196,195,2 // vpinsrw $0x2,%ebx,%xmm0,%xmm0
- .byte 67,15,183,28,120 // movzwl (%r8,%r15,2),%ebx
+ .byte 67,15,183,28,97 // movzwl (%r9,%r12,2),%ebx
.byte 197,249,196,195,3 // vpinsrw $0x3,%ebx,%xmm0,%xmm0
- .byte 67,15,183,44,88 // movzwl (%r8,%r11,2),%ebp
- .byte 197,249,196,197,4 // vpinsrw $0x4,%ebp,%xmm0,%xmm0
- .byte 67,15,183,44,80 // movzwl (%r8,%r10,2),%ebp
+ .byte 67,15,183,28,113 // movzwl (%r9,%r14,2),%ebx
+ .byte 197,249,196,195,4 // vpinsrw $0x4,%ebx,%xmm0,%xmm0
+ .byte 67,15,183,44,89 // movzwl (%r9,%r11,2),%ebp
.byte 197,249,196,197,5 // vpinsrw $0x5,%ebp,%xmm0,%xmm0
- .byte 67,15,183,44,72 // movzwl (%r8,%r9,2),%ebp
+ .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp
.byte 197,249,196,197,6 // vpinsrw $0x6,%ebp,%xmm0,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- .byte 196,226,125,24,5,10,44,0,0 // vbroadcastss 0x2c0a(%rip),%ymm0 # 6834 <_sk_callback_avx+0x3b8>
+ .byte 196,226,125,24,5,132,44,0,0 // vbroadcastss 0x2c84(%rip),%ymm0 # 6888 <_sk_callback_avx+0x3c0>
.byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,253,43,0,0 // vbroadcastss 0x2bfd(%rip),%ymm1 # 6838 <_sk_callback_avx+0x3bc>
+ .byte 196,226,125,24,13,119,44,0,0 // vbroadcastss 0x2c77(%rip),%ymm1 # 688c <_sk_callback_avx+0x3c4>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,244,43,0,0 // vbroadcastss 0x2bf4(%rip),%ymm1 # 683c <_sk_callback_avx+0x3c0>
+ .byte 196,226,125,24,13,110,44,0,0 // vbroadcastss 0x2c6e(%rip),%ymm1 # 6890 <_sk_callback_avx+0x3c8>
.byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,231,43,0,0 // vbroadcastss 0x2be7(%rip),%ymm3 # 6840 <_sk_callback_avx+0x3c4>
+ .byte 196,226,125,24,29,97,44,0,0 // vbroadcastss 0x2c61(%rip),%ymm3 # 6894 <_sk_callback_avx+0x3cc>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,24,29,222,43,0,0 // vbroadcastss 0x2bde(%rip),%ymm3 # 6844 <_sk_callback_avx+0x3c8>
+ .byte 196,226,125,24,29,88,44,0,0 // vbroadcastss 0x2c58(%rip),%ymm3 # 6898 <_sk_callback_avx+0x3d0>
.byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,209,43,0,0 // vbroadcastss 0x2bd1(%rip),%ymm3 # 6848 <_sk_callback_avx+0x3cc>
+ .byte 196,226,125,24,29,75,44,0,0 // vbroadcastss 0x2c4b(%rip),%ymm3 # 689c <_sk_callback_avx+0x3d4>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,198,43,0,0 // vbroadcastss 0x2bc6(%rip),%ymm3 # 684c <_sk_callback_avx+0x3d0>
+ .byte 196,226,125,24,29,64,44,0,0 // vbroadcastss 0x2c40(%rip),%ymm3 # 68a0 <_sk_callback_avx+0x3d8>
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 93 // pop %rbp
@@ -18741,15 +18790,15 @@ HIDDEN _sk_store_565_avx
FUNCTION(_sk_store_565_avx)
_sk_store_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,178,43,0,0 // vbroadcastss 0x2bb2(%rip),%ymm8 # 6850 <_sk_callback_avx+0x3d4>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,42,44,0,0 // vbroadcastss 0x2c2a(%rip),%ymm8 # 68a4 <_sk_callback_avx+0x3dc>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,41,114,241,11 // vpslld $0xb,%xmm9,%xmm10
.byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9
.byte 196,193,49,114,241,11 // vpslld $0xb,%xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- .byte 196,98,125,24,21,139,43,0,0 // vbroadcastss 0x2b8b(%rip),%ymm10 # 6854 <_sk_callback_avx+0x3d8>
+ .byte 196,98,125,24,21,3,44,0,0 // vbroadcastss 0x2c03(%rip),%ymm10 # 68a8 <_sk_callback_avx+0x3e0>
.byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10
.byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10
.byte 196,193,33,114,242,5 // vpslld $0x5,%xmm10,%xmm11
@@ -18762,29 +18811,29 @@ _sk_store_565_avx:
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3d19 <_sk_store_565_avx+0x89>
- .byte 196,65,122,127,4,122 // vmovdqu %xmm8,(%r10,%rdi,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 3d15 <_sk_store_565_avx+0x85>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,68,0,0,0 // lea 0x44(%rip),%r9 # 3d78 <_sk_store_565_avx+0xe8>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,21,68,122,12,6 // vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,10,5 // vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,8,4 // vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,6,3 // vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,4,2 // vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,2,1 // vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- .byte 196,67,121,21,4,122,0 // vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- .byte 235,159 // jmp 3d15 <_sk_store_565_avx+0x85>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3cf5 <_sk_store_565_avx+0x89>
+ .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 3cf1 <_sk_store_565_avx+0x85>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 3d54 <_sk_store_565_avx+0xe8>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,6,3 // vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ .byte 235,159 // jmp 3cf1 <_sk_store_565_avx+0x85>
.byte 102,144 // xchg %ax,%ax
.byte 245 // cmc
.byte 255 // (bad)
@@ -18815,56 +18864,56 @@ HIDDEN _sk_load_4444_avx
FUNCTION(_sk_load_4444_avx)
_sk_load_4444_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,152,0,0,0 // jne 3e3a <_sk_load_4444_avx+0xa6>
- .byte 196,193,122,111,4,122 // vmovdqu (%r10,%rdi,2),%xmm0
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,152,0,0,0 // jne 3e16 <_sk_load_4444_avx+0xa6>
+ .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- .byte 196,226,125,24,5,148,42,0,0 // vbroadcastss 0x2a94(%rip),%ymm0 # 6858 <_sk_callback_avx+0x3dc>
+ .byte 196,226,125,24,5,12,43,0,0 // vbroadcastss 0x2b0c(%rip),%ymm0 # 68ac <_sk_callback_avx+0x3e4>
.byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,135,42,0,0 // vbroadcastss 0x2a87(%rip),%ymm1 # 685c <_sk_callback_avx+0x3e0>
+ .byte 196,226,125,24,13,255,42,0,0 // vbroadcastss 0x2aff(%rip),%ymm1 # 68b0 <_sk_callback_avx+0x3e8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,126,42,0,0 // vbroadcastss 0x2a7e(%rip),%ymm1 # 6860 <_sk_callback_avx+0x3e4>
+ .byte 196,226,125,24,13,246,42,0,0 // vbroadcastss 0x2af6(%rip),%ymm1 # 68b4 <_sk_callback_avx+0x3ec>
.byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,113,42,0,0 // vbroadcastss 0x2a71(%rip),%ymm2 # 6864 <_sk_callback_avx+0x3e8>
+ .byte 196,226,125,24,21,233,42,0,0 // vbroadcastss 0x2ae9(%rip),%ymm2 # 68b8 <_sk_callback_avx+0x3f0>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,104,42,0,0 // vbroadcastss 0x2a68(%rip),%ymm2 # 6868 <_sk_callback_avx+0x3ec>
+ .byte 196,226,125,24,21,224,42,0,0 // vbroadcastss 0x2ae0(%rip),%ymm2 # 68bc <_sk_callback_avx+0x3f4>
.byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,91,42,0,0 // vbroadcastss 0x2a5b(%rip),%ymm8 # 686c <_sk_callback_avx+0x3f0>
+ .byte 196,98,125,24,5,211,42,0,0 // vbroadcastss 0x2ad3(%rip),%ymm8 # 68c0 <_sk_callback_avx+0x3f8>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,81,42,0,0 // vbroadcastss 0x2a51(%rip),%ymm8 # 6870 <_sk_callback_avx+0x3f4>
+ .byte 196,98,125,24,5,201,42,0,0 // vbroadcastss 0x2ac9(%rip),%ymm8 # 68c4 <_sk_callback_avx+0x3fc>
.byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,67,42,0,0 // vbroadcastss 0x2a43(%rip),%ymm8 # 6874 <_sk_callback_avx+0x3f8>
+ .byte 196,98,125,24,5,187,42,0,0 // vbroadcastss 0x2abb(%rip),%ymm8 # 68c8 <_sk_callback_avx+0x400>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 15,135,86,255,255,255 // ja 3da8 <_sk_load_4444_avx+0x14>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,75,0,0,0 // lea 0x4b(%rip),%r9 # 3ea8 <_sk_load_4444_avx+0x114>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 15,135,86,255,255,255 // ja 3d84 <_sk_load_4444_avx+0x14>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,75,0,0,0 // lea 0x4b(%rip),%r10 # 3e84 <_sk_load_4444_avx+0x114>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
- .byte 196,193,121,196,68,122,12,6 // vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,10,5 // vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,8,4 // vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,6,3 // vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,4,2 // vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,68,122,2,1 // vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- .byte 196,193,121,196,4,122,0 // vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- .byte 233,2,255,255,255 // jmpq 3da8 <_sk_load_4444_avx+0x14>
+ .byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,6,3 // vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ .byte 233,2,255,255,255 // jmpq 3d84 <_sk_load_4444_avx+0x14>
.byte 102,144 // xchg %ax,%ax
.byte 242,255 // repnz (bad)
.byte 255 // (bad)
@@ -18897,10 +18946,11 @@ _sk_gather_4444_avx:
.byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -18911,61 +18961,62 @@ _sk_gather_4444_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 65,15,183,28,88 // movzwl (%r8,%rbx,2),%ebx
- .byte 67,15,183,44,112 // movzwl (%r8,%r14,2),%ebp
+ .byte 65,15,183,28,89 // movzwl (%r9,%rbx,2),%ebx
+ .byte 67,15,183,44,121 // movzwl (%r9,%r15,2),%ebp
.byte 197,249,110,197 // vmovd %ebp,%xmm0
.byte 197,249,196,195,1 // vpinsrw $0x1,%ebx,%xmm0,%xmm0
- .byte 67,15,183,28,96 // movzwl (%r8,%r12,2),%ebx
+ .byte 67,15,183,28,105 // movzwl (%r9,%r13,2),%ebx
.byte 197,249,196,195,2 // vpinsrw $0x2,%ebx,%xmm0,%xmm0
- .byte 67,15,183,28,120 // movzwl (%r8,%r15,2),%ebx
+ .byte 67,15,183,28,97 // movzwl (%r9,%r12,2),%ebx
.byte 197,249,196,195,3 // vpinsrw $0x3,%ebx,%xmm0,%xmm0
- .byte 67,15,183,44,88 // movzwl (%r8,%r11,2),%ebp
- .byte 197,249,196,197,4 // vpinsrw $0x4,%ebp,%xmm0,%xmm0
- .byte 67,15,183,44,80 // movzwl (%r8,%r10,2),%ebp
+ .byte 67,15,183,28,113 // movzwl (%r9,%r14,2),%ebx
+ .byte 197,249,196,195,4 // vpinsrw $0x4,%ebx,%xmm0,%xmm0
+ .byte 67,15,183,44,89 // movzwl (%r9,%r11,2),%ebp
.byte 197,249,196,197,5 // vpinsrw $0x5,%ebp,%xmm0,%xmm0
- .byte 67,15,183,44,72 // movzwl (%r8,%r9,2),%ebp
+ .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp
.byte 197,249,196,197,6 // vpinsrw $0x6,%ebp,%xmm0,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- .byte 196,226,125,24,5,218,40,0,0 // vbroadcastss 0x28da(%rip),%ymm0 # 6878 <_sk_callback_avx+0x3fc>
+ .byte 196,226,125,24,5,80,41,0,0 // vbroadcastss 0x2950(%rip),%ymm0 # 68cc <_sk_callback_avx+0x404>
.byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,205,40,0,0 // vbroadcastss 0x28cd(%rip),%ymm1 # 687c <_sk_callback_avx+0x400>
+ .byte 196,226,125,24,13,67,41,0,0 // vbroadcastss 0x2943(%rip),%ymm1 # 68d0 <_sk_callback_avx+0x408>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,196,40,0,0 // vbroadcastss 0x28c4(%rip),%ymm1 # 6880 <_sk_callback_avx+0x404>
+ .byte 196,226,125,24,13,58,41,0,0 // vbroadcastss 0x293a(%rip),%ymm1 # 68d4 <_sk_callback_avx+0x40c>
.byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,183,40,0,0 // vbroadcastss 0x28b7(%rip),%ymm2 # 6884 <_sk_callback_avx+0x408>
+ .byte 196,226,125,24,21,45,41,0,0 // vbroadcastss 0x292d(%rip),%ymm2 # 68d8 <_sk_callback_avx+0x410>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,174,40,0,0 // vbroadcastss 0x28ae(%rip),%ymm2 # 6888 <_sk_callback_avx+0x40c>
+ .byte 196,226,125,24,21,36,41,0,0 // vbroadcastss 0x2924(%rip),%ymm2 # 68dc <_sk_callback_avx+0x414>
.byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,161,40,0,0 // vbroadcastss 0x28a1(%rip),%ymm8 # 688c <_sk_callback_avx+0x410>
+ .byte 196,98,125,24,5,23,41,0,0 // vbroadcastss 0x2917(%rip),%ymm8 # 68e0 <_sk_callback_avx+0x418>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,151,40,0,0 // vbroadcastss 0x2897(%rip),%ymm8 # 6890 <_sk_callback_avx+0x414>
+ .byte 196,98,125,24,5,13,41,0,0 // vbroadcastss 0x290d(%rip),%ymm8 # 68e4 <_sk_callback_avx+0x41c>
.byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,137,40,0,0 // vbroadcastss 0x2889(%rip),%ymm8 # 6894 <_sk_callback_avx+0x418>
+ .byte 196,98,125,24,5,255,40,0,0 // vbroadcastss 0x28ff(%rip),%ymm8 # 68e8 <_sk_callback_avx+0x420>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 93 // pop %rbp
@@ -18976,8 +19027,8 @@ HIDDEN _sk_store_4444_avx
FUNCTION(_sk_store_4444_avx)
_sk_store_4444_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,16 // mov (%rax),%r10
- .byte 196,98,125,24,5,110,40,0,0 // vbroadcastss 0x286e(%rip),%ymm8 # 6898 <_sk_callback_avx+0x41c>
+ .byte 76,139,24 // mov (%rax),%r11
+ .byte 196,98,125,24,5,226,40,0,0 // vbroadcastss 0x28e2(%rip),%ymm8 # 68ec <_sk_callback_avx+0x424>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,41,114,241,12 // vpslld $0xc,%xmm9,%xmm10
@@ -19003,29 +19054,29 @@ _sk_store_4444_avx:
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 40c3 <_sk_store_4444_avx+0xa7>
- .byte 196,65,122,127,4,122 // vmovdqu %xmm8,(%r10,%rdi,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,7 // and $0x7,%r8b
- .byte 65,254,200 // dec %r8b
- .byte 65,128,248,6 // cmp $0x6,%r8b
- .byte 119,236 // ja 40bf <_sk_store_4444_avx+0xa3>
- .byte 69,15,182,192 // movzbl %r8b,%r8d
- .byte 76,141,13,66,0,0,0 // lea 0x42(%rip),%r9 # 4120 <_sk_store_4444_avx+0x104>
- .byte 75,99,4,129 // movslq (%r9,%r8,4),%rax
- .byte 76,1,200 // add %r9,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,67,121,21,68,122,12,6 // vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,10,5 // vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,8,4 // vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,6,3 // vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,4,2 // vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- .byte 196,67,121,21,68,122,2,1 // vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- .byte 196,67,121,21,4,122,0 // vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- .byte 235,159 // jmp 40bf <_sk_store_4444_avx+0xa3>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 40a3 <_sk_store_4444_avx+0xa7>
+ .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,7 // and $0x7,%r9b
+ .byte 65,254,201 // dec %r9b
+ .byte 65,128,249,6 // cmp $0x6,%r9b
+ .byte 119,236 // ja 409f <_sk_store_4444_avx+0xa3>
+ .byte 69,15,182,201 // movzbl %r9b,%r9d
+ .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 4100 <_sk_store_4444_avx+0x104>
+ .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
+ .byte 76,1,208 // add %r10,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,6,3 // vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ .byte 235,159 // jmp 409f <_sk_store_4444_avx+0xa3>
.byte 247,255 // idiv %edi
.byte 255 // (bad)
.byte 255 // (bad)
@@ -19053,17 +19104,17 @@ HIDDEN _sk_load_8888_avx
.globl _sk_load_8888_avx
FUNCTION(_sk_load_8888_avx)
_sk_load_8888_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,137,0,0,0 // jne 41de <_sk_load_8888_avx+0xa2>
- .byte 196,193,124,16,25 // vmovups (%r9),%ymm3
- .byte 197,124,40,21,126,41,0,0 // vmovaps 0x297e(%rip),%ymm10 # 6ae0 <_sk_callback_avx+0x664>
+ .byte 15,133,137,0,0,0 // jne 41be <_sk_load_8888_avx+0xa2>
+ .byte 196,193,124,16,26 // vmovups (%r10),%ymm3
+ .byte 197,124,40,21,254,41,0,0 // vmovaps 0x29fe(%rip),%ymm10 # 6b40 <_sk_callback_avx+0x678>
.byte 196,193,100,84,194 // vandps %ymm10,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,40,39,0,0 // vbroadcastss 0x2728(%rip),%ymm8 # 689c <_sk_callback_avx+0x420>
+ .byte 196,98,125,24,5,156,39,0,0 // vbroadcastss 0x279c(%rip),%ymm8 # 68f0 <_sk_callback_avx+0x428>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,241,114,211,8 // vpsrld $0x8,%xmm3,%xmm1
.byte 196,195,125,25,217,1 // vextractf128 $0x1,%ymm3,%xmm9
@@ -19084,7 +19135,7 @@ _sk_load_8888_avx:
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -19093,13 +19144,13 @@ _sk_load_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0
- .byte 196,226,121,0,13,58,40,0,0 // vpshufb 0x283a(%rip),%xmm0,%xmm1 # 6a40 <_sk_callback_avx+0x5c4>
+ .byte 196,226,121,0,13,170,40,0,0 // vpshufb 0x28aa(%rip),%xmm0,%xmm1 # 6a90 <_sk_callback_avx+0x5c8>
.byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1
- .byte 196,226,121,0,5,60,40,0,0 // vpshufb 0x283c(%rip),%xmm0,%xmm0 # 6a50 <_sk_callback_avx+0x5d4>
+ .byte 196,226,121,0,5,172,40,0,0 // vpshufb 0x28ac(%rip),%xmm0,%xmm0 # 6aa0 <_sk_callback_avx+0x5d8>
.byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- .byte 196,194,125,44,25 // vmaskmovps (%r9),%ymm0,%ymm3
- .byte 233,49,255,255,255 // jmpq 415a <_sk_load_8888_avx+0x1e>
+ .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
+ .byte 233,49,255,255,255 // jmpq 413a <_sk_load_8888_avx+0x1e>
HIDDEN _sk_gather_8888_avx
.globl _sk_gather_8888_avx
@@ -19107,10 +19158,11 @@ FUNCTION(_sk_gather_8888_avx)
_sk_gather_8888_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
.byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
@@ -19121,31 +19173,31 @@ _sk_gather_8888_avx:
.byte 196,227,125,25,194,1 // vextractf128 $0x1,%ymm0,%xmm2
.byte 197,241,254,202 // vpaddd %xmm2,%xmm1,%xmm1
.byte 196,225,249,126,200 // vmovq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,195,249,22,202,1 // vpextrq $0x1,%xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,225,254,192 // vpaddd %xmm0,%xmm3,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,129,121,110,4,176 // vmovd (%r8,%r14,4),%xmm0
- .byte 196,195,121,34,4,152,1 // vpinsrd $0x1,(%r8,%rbx,4),%xmm0,%xmm0
- .byte 196,131,121,34,4,160,2 // vpinsrd $0x2,(%r8,%r12,4),%xmm0,%xmm0
- .byte 196,3,121,34,4,184,3 // vpinsrd $0x3,(%r8,%r15,4),%xmm0,%xmm8
- .byte 196,129,121,110,4,136 // vmovd (%r8,%r9,4),%xmm0
- .byte 196,195,121,34,4,128,1 // vpinsrd $0x1,(%r8,%rax,4),%xmm0,%xmm0
- .byte 196,131,121,34,4,152,2 // vpinsrd $0x2,(%r8,%r11,4),%xmm0,%xmm0
- .byte 196,131,121,34,28,144,3 // vpinsrd $0x3,(%r8,%r10,4),%xmm0,%xmm3
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,129,121,110,4,185 // vmovd (%r9,%r15,4),%xmm0
+ .byte 196,195,121,34,4,153,1 // vpinsrd $0x1,(%r9,%rbx,4),%xmm0,%xmm0
+ .byte 196,131,121,34,4,169,2 // vpinsrd $0x2,(%r9,%r13,4),%xmm0,%xmm0
+ .byte 196,3,121,34,4,161,3 // vpinsrd $0x3,(%r9,%r12,4),%xmm0,%xmm8
+ .byte 196,129,121,110,4,145 // vmovd (%r9,%r10,4),%xmm0
+ .byte 196,195,121,34,4,129,1 // vpinsrd $0x1,(%r9,%rax,4),%xmm0,%xmm0
+ .byte 196,131,121,34,4,177,2 // vpinsrd $0x2,(%r9,%r14,4),%xmm0,%xmm0
+ .byte 196,131,121,34,28,153,3 // vpinsrd $0x3,(%r9,%r11,4),%xmm0,%xmm3
.byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- .byte 197,124,40,21,37,40,0,0 // vmovaps 0x2825(%rip),%ymm10 # 6b00 <_sk_callback_avx+0x684>
+ .byte 197,124,40,21,163,40,0,0 // vmovaps 0x28a3(%rip),%ymm10 # 6b60 <_sk_callback_avx+0x698>
.byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,179,37,0,0 // vbroadcastss 0x25b3(%rip),%ymm9 # 68a0 <_sk_callback_avx+0x424>
+ .byte 196,98,125,24,13,37,38,0,0 // vbroadcastss 0x2625(%rip),%ymm9 # 68f4 <_sk_callback_avx+0x42c>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1
.byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2
@@ -19167,6 +19219,7 @@ _sk_gather_8888_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -19175,11 +19228,11 @@ HIDDEN _sk_store_8888_avx
.globl _sk_store_8888_avx
FUNCTION(_sk_store_8888_avx)
_sk_store_8888_avx:
- .byte 73,137,200 // mov %rcx,%r8
+ .byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,3,8 // add (%rax),%r9
- .byte 196,98,125,24,5,54,37,0,0 // vbroadcastss 0x2536(%rip),%ymm8 # 68a4 <_sk_callback_avx+0x428>
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,3,16 // add (%rax),%r10
+ .byte 196,98,125,24,5,166,37,0,0 // vbroadcastss 0x25a6(%rip),%ymm8 # 68f8 <_sk_callback_avx+0x430>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -19204,10 +19257,10 @@ _sk_store_8888_avx:
.byte 196,65,45,86,192 // vorpd %ymm8,%ymm10,%ymm8
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 43fe <_sk_store_8888_avx+0xa9>
- .byte 196,65,124,17,1 // vmovups %ymm8,(%r9)
+ .byte 117,12 // jne 43e2 <_sk_store_8888_avx+0xa9>
+ .byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,193 // mov %r8,%rcx
+ .byte 76,137,201 // mov %r9,%rcx
.byte 255,224 // jmpq *%rax
.byte 185,8,0,0,0 // mov $0x8,%ecx
.byte 68,41,193 // sub %r8d,%ecx
@@ -19216,13 +19269,13 @@ _sk_store_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,58,38,0,0 // vpshufb 0x263a(%rip),%xmm9,%xmm10 # 6a60 <_sk_callback_avx+0x5e4>
+ .byte 196,98,49,0,21,166,38,0,0 // vpshufb 0x26a6(%rip),%xmm9,%xmm10 # 6ab0 <_sk_callback_avx+0x5e8>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,60,38,0,0 // vpshufb 0x263c(%rip),%xmm9,%xmm9 # 6a70 <_sk_callback_avx+0x5f4>
+ .byte 196,98,49,0,13,168,38,0,0 // vpshufb 0x26a8(%rip),%xmm9,%xmm9 # 6ac0 <_sk_callback_avx+0x5f8>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- .byte 196,66,53,46,1 // vmaskmovps %ymm8,%ymm9,(%r9)
- .byte 235,177 // jmp 43f7 <_sk_store_8888_avx+0xa2>
+ .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
+ .byte 235,177 // jmp 43db <_sk_store_8888_avx+0xa2>
HIDDEN _sk_load_f16_avx
.globl _sk_load_f16_avx
@@ -19231,16 +19284,16 @@ _sk_load_f16_avx:
.byte 72,131,236,24 // sub $0x18,%rsp
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
+ .byte 77,133,192 // test %r8,%r8
.byte 197,252,17,124,36,224 // vmovups %ymm7,-0x20(%rsp)
.byte 197,252,17,116,36,192 // vmovups %ymm6,-0x40(%rsp)
.byte 197,252,17,108,36,160 // vmovups %ymm5,-0x60(%rsp)
.byte 197,254,127,100,36,128 // vmovdqu %ymm4,-0x80(%rsp)
- .byte 15,133,141,2,0,0 // jne 46fd <_sk_load_f16_avx+0x2b7>
- .byte 197,121,16,4,248 // vmovupd (%rax,%rdi,8),%xmm8
- .byte 197,249,16,84,248,16 // vmovupd 0x10(%rax,%rdi,8),%xmm2
- .byte 197,249,16,76,248,32 // vmovupd 0x20(%rax,%rdi,8),%xmm1
- .byte 197,122,111,76,248,48 // vmovdqu 0x30(%rax,%rdi,8),%xmm9
+ .byte 15,133,141,2,0,0 // jne 46e1 <_sk_load_f16_avx+0x2b7>
+ .byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
+ .byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2
+ .byte 197,249,16,76,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm1
+ .byte 197,122,111,76,208,48 // vmovdqu 0x30(%rax,%rdx,8),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,113,97,217 // vpunpcklwd %xmm9,%xmm1,%xmm3
@@ -19254,13 +19307,13 @@ _sk_load_f16_avx:
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- .byte 196,98,125,24,37,223,35,0,0 // vbroadcastss 0x23df(%rip),%ymm12 # 68a8 <_sk_callback_avx+0x42c>
+ .byte 196,98,125,24,37,79,36,0,0 // vbroadcastss 0x244f(%rip),%ymm12 # 68fc <_sk_callback_avx+0x434>
.byte 196,193,124,84,204 // vandps %ymm12,%ymm0,%ymm1
.byte 197,252,87,193 // vxorps %ymm1,%ymm0,%ymm0
.byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14
- .byte 196,98,121,24,29,203,35,0,0 // vbroadcastss 0x23cb(%rip),%xmm11 # 68ac <_sk_callback_avx+0x430>
+ .byte 196,98,121,24,29,59,36,0,0 // vbroadcastss 0x243b(%rip),%xmm11 # 6900 <_sk_callback_avx+0x438>
.byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3
- .byte 196,98,121,24,45,193,35,0,0 // vbroadcastss 0x23c1(%rip),%xmm13 # 68b0 <_sk_callback_avx+0x434>
+ .byte 196,98,121,24,45,49,36,0,0 // vbroadcastss 0x2431(%rip),%xmm13 # 6904 <_sk_callback_avx+0x43c>
.byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3
.byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10
.byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -19274,7 +19327,7 @@ _sk_load_f16_avx:
.byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
.byte 197,252,86,193 // vorps %ymm1,%ymm0,%ymm0
.byte 196,227,125,25,193,1 // vextractf128 $0x1,%ymm0,%xmm1
- .byte 196,226,121,24,29,119,35,0,0 // vbroadcastss 0x2377(%rip),%xmm3 # 68b4 <_sk_callback_avx+0x438>
+ .byte 196,226,121,24,29,231,35,0,0 // vbroadcastss 0x23e7(%rip),%xmm3 # 6908 <_sk_callback_avx+0x440>
.byte 197,241,254,203 // vpaddd %xmm3,%xmm1,%xmm1
.byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -19364,32 +19417,32 @@ _sk_load_f16_avx:
.byte 197,252,16,124,36,224 // vmovups -0x20(%rsp),%ymm7
.byte 72,131,196,24 // add $0x18,%rsp
.byte 255,224 // jmpq *%rax
- .byte 197,123,16,4,248 // vmovsd (%rax,%rdi,8),%xmm8
+ .byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,79 // je 475c <_sk_load_f16_avx+0x316>
- .byte 197,57,22,68,248,8 // vmovhpd 0x8(%rax,%rdi,8),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,67 // jb 475c <_sk_load_f16_avx+0x316>
- .byte 197,251,16,84,248,16 // vmovsd 0x10(%rax,%rdi,8),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,68 // je 4769 <_sk_load_f16_avx+0x323>
- .byte 197,233,22,84,248,24 // vmovhpd 0x18(%rax,%rdi,8),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,56 // jb 4769 <_sk_load_f16_avx+0x323>
- .byte 197,251,16,76,248,32 // vmovsd 0x20(%rax,%rdi,8),%xmm1
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,70,253,255,255 // je 4487 <_sk_load_f16_avx+0x41>
- .byte 197,241,22,76,248,40 // vmovhpd 0x28(%rax,%rdi,8),%xmm1,%xmm1
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,54,253,255,255 // jb 4487 <_sk_load_f16_avx+0x41>
- .byte 197,122,126,76,248,48 // vmovq 0x30(%rax,%rdi,8),%xmm9
- .byte 233,43,253,255,255 // jmpq 4487 <_sk_load_f16_avx+0x41>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,79 // je 4740 <_sk_load_f16_avx+0x316>
+ .byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,67 // jb 4740 <_sk_load_f16_avx+0x316>
+ .byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,68 // je 474d <_sk_load_f16_avx+0x323>
+ .byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,56 // jb 474d <_sk_load_f16_avx+0x323>
+ .byte 197,251,16,76,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm1
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,70,253,255,255 // je 446b <_sk_load_f16_avx+0x41>
+ .byte 197,241,22,76,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,54,253,255,255 // jb 446b <_sk_load_f16_avx+0x41>
+ .byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
+ .byte 233,43,253,255,255 // jmpq 446b <_sk_load_f16_avx+0x41>
.byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,30,253,255,255 // jmpq 4487 <_sk_load_f16_avx+0x41>
+ .byte 233,30,253,255,255 // jmpq 446b <_sk_load_f16_avx+0x41>
.byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1
- .byte 233,21,253,255,255 // jmpq 4487 <_sk_load_f16_avx+0x41>
+ .byte 233,21,253,255,255 // jmpq 446b <_sk_load_f16_avx+0x41>
HIDDEN _sk_gather_f16_avx
.globl _sk_gather_f16_avx
@@ -19397,15 +19450,16 @@ FUNCTION(_sk_gather_f16_avx)
_sk_gather_f16_avx:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 72,131,236,24 // sub $0x18,%rsp
+ .byte 72,131,236,16 // sub $0x10,%rsp
.byte 197,252,17,124,36,224 // vmovups %ymm7,-0x20(%rsp)
.byte 197,252,17,116,36,192 // vmovups %ymm6,-0x40(%rsp)
.byte 197,252,17,108,36,160 // vmovups %ymm5,-0x60(%rsp)
.byte 197,254,127,100,36,128 // vmovdqu %ymm4,-0x80(%rsp)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
.byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
.byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
@@ -19416,29 +19470,29 @@ _sk_gather_f16_avx:
.byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,193,249,126,210 // vmovq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,193,249,126,211 // vmovq %xmm2,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
.byte 196,225,249,126,195 // vmovq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15
- .byte 69,137,252 // mov %r15d,%r12d
- .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 65,137,223 // mov %ebx,%r15d
+ .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12
+ .byte 69,137,229 // mov %r12d,%r13d
+ .byte 73,193,236,32 // shr $0x20,%r12
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,193,122,126,4,216 // vmovq (%r8,%rbx,8),%xmm0
- .byte 196,129,122,126,12,240 // vmovq (%r8,%r14,8),%xmm1
+ .byte 196,193,122,126,4,217 // vmovq (%r9,%rbx,8),%xmm0
+ .byte 196,129,122,126,12,249 // vmovq (%r9,%r15,8),%xmm1
.byte 197,113,108,200 // vpunpcklqdq %xmm0,%xmm1,%xmm9
- .byte 196,129,122,126,12,248 // vmovq (%r8,%r15,8),%xmm1
- .byte 196,129,122,126,20,224 // vmovq (%r8,%r12,8),%xmm2
+ .byte 196,129,122,126,12,225 // vmovq (%r9,%r12,8),%xmm1
+ .byte 196,129,122,126,20,233 // vmovq (%r9,%r13,8),%xmm2
.byte 197,233,108,201 // vpunpcklqdq %xmm1,%xmm2,%xmm1
- .byte 196,129,122,126,20,208 // vmovq (%r8,%r10,8),%xmm2
- .byte 196,129,122,126,28,216 // vmovq (%r8,%r11,8),%xmm3
+ .byte 196,129,122,126,20,217 // vmovq (%r9,%r11,8),%xmm2
+ .byte 196,129,122,126,28,241 // vmovq (%r9,%r14,8),%xmm3
.byte 197,97,108,210 // vpunpcklqdq %xmm2,%xmm3,%xmm10
- .byte 196,65,122,126,4,192 // vmovq (%r8,%rax,8),%xmm8
- .byte 196,129,122,126,28,200 // vmovq (%r8,%r9,8),%xmm3
+ .byte 196,65,122,126,4,193 // vmovq (%r9,%rax,8),%xmm8
+ .byte 196,129,122,126,28,209 // vmovq (%r9,%r10,8),%xmm3
.byte 196,193,97,108,216 // vpunpcklqdq %xmm8,%xmm3,%xmm3
.byte 197,177,97,193 // vpunpcklwd %xmm1,%xmm9,%xmm0
.byte 197,177,105,201 // vpunpckhwd %xmm1,%xmm9,%xmm1
@@ -19453,13 +19507,13 @@ _sk_gather_f16_avx:
.byte 197,249,105,210 // vpunpckhwd %xmm2,%xmm0,%xmm2
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,194,1 // vinsertf128 $0x1,%xmm2,%ymm0,%ymm0
- .byte 196,98,125,24,37,59,32,0,0 // vbroadcastss 0x203b(%rip),%ymm12 # 68b8 <_sk_callback_avx+0x43c>
+ .byte 196,98,125,24,37,169,32,0,0 // vbroadcastss 0x20a9(%rip),%ymm12 # 690c <_sk_callback_avx+0x444>
.byte 196,193,124,84,212 // vandps %ymm12,%ymm0,%ymm2
.byte 197,252,87,194 // vxorps %ymm2,%ymm0,%ymm0
.byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14
- .byte 196,98,121,24,29,39,32,0,0 // vbroadcastss 0x2027(%rip),%xmm11 # 68bc <_sk_callback_avx+0x440>
+ .byte 196,98,121,24,29,149,32,0,0 // vbroadcastss 0x2095(%rip),%xmm11 # 6910 <_sk_callback_avx+0x448>
.byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3
- .byte 196,98,121,24,45,29,32,0,0 // vbroadcastss 0x201d(%rip),%xmm13 # 68c0 <_sk_callback_avx+0x444>
+ .byte 196,98,121,24,45,139,32,0,0 // vbroadcastss 0x208b(%rip),%xmm13 # 6914 <_sk_callback_avx+0x44c>
.byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3
.byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10
.byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -19473,7 +19527,7 @@ _sk_gather_f16_avx:
.byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
.byte 197,252,86,194 // vorps %ymm2,%ymm0,%ymm0
.byte 196,227,125,25,194,1 // vextractf128 $0x1,%ymm0,%xmm2
- .byte 196,226,121,24,29,211,31,0,0 // vbroadcastss 0x1fd3(%rip),%xmm3 # 68c4 <_sk_callback_avx+0x448>
+ .byte 196,226,121,24,29,65,32,0,0 // vbroadcastss 0x2041(%rip),%xmm3 # 6918 <_sk_callback_avx+0x450>
.byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
.byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0
.byte 196,227,125,24,194,1 // vinsertf128 $0x1,%xmm2,%ymm0,%ymm0
@@ -19561,9 +19615,10 @@ _sk_gather_f16_avx:
.byte 197,252,16,108,36,160 // vmovups -0x60(%rsp),%ymm5
.byte 197,252,16,116,36,192 // vmovups -0x40(%rsp),%ymm6
.byte 197,252,16,124,36,224 // vmovups -0x20(%rsp),%ymm7
- .byte 72,131,196,24 // add $0x18,%rsp
+ .byte 72,131,196,16 // add $0x10,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
+ .byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -19577,12 +19632,12 @@ _sk_store_f16_avx:
.byte 197,252,17,52,36 // vmovups %ymm6,(%rsp)
.byte 197,252,17,108,36,224 // vmovups %ymm5,-0x20(%rsp)
.byte 197,252,17,100,36,192 // vmovups %ymm4,-0x40(%rsp)
- .byte 196,98,125,24,13,236,29,0,0 // vbroadcastss 0x1dec(%rip),%ymm9 # 68c8 <_sk_callback_avx+0x44c>
+ .byte 196,98,125,24,13,88,30,0,0 // vbroadcastss 0x1e58(%rip),%ymm9 # 691c <_sk_callback_avx+0x454>
.byte 196,65,124,84,209 // vandps %ymm9,%ymm0,%ymm10
.byte 197,252,17,68,36,128 // vmovups %ymm0,-0x80(%rsp)
.byte 196,65,124,87,218 // vxorps %ymm10,%ymm0,%ymm11
.byte 196,67,125,25,220,1 // vextractf128 $0x1,%ymm11,%xmm12
- .byte 196,98,121,24,5,209,29,0,0 // vbroadcastss 0x1dd1(%rip),%xmm8 # 68cc <_sk_callback_avx+0x450>
+ .byte 196,98,121,24,5,61,30,0,0 // vbroadcastss 0x1e3d(%rip),%xmm8 # 6920 <_sk_callback_avx+0x458>
.byte 196,65,57,102,236 // vpcmpgtd %xmm12,%xmm8,%xmm13
.byte 196,65,57,102,243 // vpcmpgtd %xmm11,%xmm8,%xmm14
.byte 196,67,13,24,237,1 // vinsertf128 $0x1,%xmm13,%ymm14,%ymm13
@@ -19592,7 +19647,7 @@ _sk_store_f16_avx:
.byte 196,67,13,24,242,1 // vinsertf128 $0x1,%xmm10,%ymm14,%ymm14
.byte 196,193,33,114,211,13 // vpsrld $0xd,%xmm11,%xmm11
.byte 196,193,25,114,212,13 // vpsrld $0xd,%xmm12,%xmm12
- .byte 196,98,125,24,21,152,29,0,0 // vbroadcastss 0x1d98(%rip),%ymm10 # 68d0 <_sk_callback_avx+0x454>
+ .byte 196,98,125,24,21,4,30,0,0 // vbroadcastss 0x1e04(%rip),%ymm10 # 6924 <_sk_callback_avx+0x45c>
.byte 196,65,12,86,242 // vorps %ymm10,%ymm14,%ymm14
.byte 196,67,125,25,247,1 // vextractf128 $0x1,%ymm14,%xmm15
.byte 196,65,1,254,228 // vpaddd %xmm12,%xmm15,%xmm12
@@ -19673,12 +19728,12 @@ _sk_store_f16_avx:
.byte 197,121,106,193 // vpunpckhdq %xmm1,%xmm0,%xmm8
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,66 // jne 4d16 <_sk_store_f16_avx+0x25e>
- .byte 197,120,17,28,248 // vmovups %xmm11,(%rax,%rdi,8)
- .byte 197,120,17,84,248,16 // vmovups %xmm10,0x10(%rax,%rdi,8)
- .byte 197,120,17,76,248,32 // vmovups %xmm9,0x20(%rax,%rdi,8)
- .byte 197,122,127,68,248,48 // vmovdqu %xmm8,0x30(%rax,%rdi,8)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,66 // jne 4cfe <_sk_store_f16_avx+0x25e>
+ .byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8)
+ .byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8)
+ .byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8)
+ .byte 197,122,127,68,208,48 // vmovdqu %xmm8,0x30(%rax,%rdx,8)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,16,68,36,128 // vmovups -0x80(%rsp),%ymm0
.byte 197,252,16,76,36,160 // vmovups -0x60(%rsp),%ymm1
@@ -19688,38 +19743,38 @@ _sk_store_f16_avx:
.byte 197,252,16,124,36,32 // vmovups 0x20(%rsp),%ymm7
.byte 72,131,196,88 // add $0x58,%rsp
.byte 255,224 // jmpq *%rax
- .byte 197,121,214,28,248 // vmovq %xmm11,(%rax,%rdi,8)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,202 // je 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,23,92,248,8 // vmovhpd %xmm11,0x8(%rax,%rdi,8)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,190 // jb 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,214,84,248,16 // vmovq %xmm10,0x10(%rax,%rdi,8)
- .byte 116,182 // je 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,23,84,248,24 // vmovhpd %xmm10,0x18(%rax,%rdi,8)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,170 // jb 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,214,76,248,32 // vmovq %xmm9,0x20(%rax,%rdi,8)
- .byte 116,162 // je 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,23,76,248,40 // vmovhpd %xmm9,0x28(%rax,%rdi,8)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,150 // jb 4ceb <_sk_store_f16_avx+0x233>
- .byte 197,121,214,68,248,48 // vmovq %xmm8,0x30(%rax,%rdi,8)
- .byte 235,142 // jmp 4ceb <_sk_store_f16_avx+0x233>
+ .byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,202 // je 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,190 // jb 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8)
+ .byte 116,182 // je 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,170 // jb 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8)
+ .byte 116,162 // je 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,150 // jb 4cd3 <_sk_store_f16_avx+0x233>
+ .byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8)
+ .byte 235,142 // jmp 4cd3 <_sk_store_f16_avx+0x233>
HIDDEN _sk_load_u16_be_avx
.globl _sk_load_u16_be_avx
FUNCTION(_sk_load_u16_be_avx)
_sk_load_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,253,0,0,0 // jne 4e70 <_sk_load_u16_be_avx+0x113>
- .byte 196,65,121,16,4,64 // vmovupd (%r8,%rax,2),%xmm8
- .byte 196,193,121,16,84,64,16 // vmovupd 0x10(%r8,%rax,2),%xmm2
- .byte 196,193,121,16,92,64,32 // vmovupd 0x20(%r8,%rax,2),%xmm3
- .byte 196,65,122,111,76,64,48 // vmovdqu 0x30(%r8,%rax,2),%xmm9
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,253,0,0,0 // jne 4e58 <_sk_load_u16_be_avx+0x113>
+ .byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8
+ .byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2
+ .byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3
+ .byte 196,65,122,111,76,65,48 // vmovdqu 0x30(%r9,%rax,2),%xmm9
.byte 197,185,97,194 // vpunpcklwd %xmm2,%xmm8,%xmm0
.byte 197,185,105,210 // vpunpckhwd %xmm2,%xmm8,%xmm2
.byte 196,193,97,97,201 // vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -19737,7 +19792,7 @@ _sk_load_u16_be_avx:
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,29,240,26,0,0 // vbroadcastss 0x1af0(%rip),%ymm11 # 68d4 <_sk_callback_avx+0x458>
+ .byte 196,98,125,24,29,92,27,0,0 // vbroadcastss 0x1b5c(%rip),%ymm11 # 6928 <_sk_callback_avx+0x460>
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,177,109,202 // vpunpckhqdq %xmm2,%xmm9,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -19768,46 +19823,46 @@ _sk_load_u16_be_avx:
.byte 196,193,100,89,219 // vmulps %ymm11,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 196,65,123,16,4,64 // vmovsd (%r8,%rax,2),%xmm8
+ .byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,85 // je 4ed6 <_sk_load_u16_be_avx+0x179>
- .byte 196,65,57,22,68,64,8 // vmovhpd 0x8(%r8,%rax,2),%xmm8,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,72 // jb 4ed6 <_sk_load_u16_be_avx+0x179>
- .byte 196,193,123,16,84,64,16 // vmovsd 0x10(%r8,%rax,2),%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 116,72 // je 4ee3 <_sk_load_u16_be_avx+0x186>
- .byte 196,193,105,22,84,64,24 // vmovhpd 0x18(%r8,%rax,2),%xmm2,%xmm2
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,59 // jb 4ee3 <_sk_load_u16_be_avx+0x186>
- .byte 196,193,123,16,92,64,32 // vmovsd 0x20(%r8,%rax,2),%xmm3
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 15,132,213,254,255,255 // je 4d8e <_sk_load_u16_be_avx+0x31>
- .byte 196,193,97,22,92,64,40 // vmovhpd 0x28(%r8,%rax,2),%xmm3,%xmm3
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 15,130,196,254,255,255 // jb 4d8e <_sk_load_u16_be_avx+0x31>
- .byte 196,65,122,126,76,64,48 // vmovq 0x30(%r8,%rax,2),%xmm9
- .byte 233,184,254,255,255 // jmpq 4d8e <_sk_load_u16_be_avx+0x31>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,85 // je 4ebe <_sk_load_u16_be_avx+0x179>
+ .byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,72 // jb 4ebe <_sk_load_u16_be_avx+0x179>
+ .byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 116,72 // je 4ecb <_sk_load_u16_be_avx+0x186>
+ .byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,59 // jb 4ecb <_sk_load_u16_be_avx+0x186>
+ .byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 15,132,213,254,255,255 // je 4d76 <_sk_load_u16_be_avx+0x31>
+ .byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 15,130,196,254,255,255 // jb 4d76 <_sk_load_u16_be_avx+0x31>
+ .byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9
+ .byte 233,184,254,255,255 // jmpq 4d76 <_sk_load_u16_be_avx+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,171,254,255,255 // jmpq 4d8e <_sk_load_u16_be_avx+0x31>
+ .byte 233,171,254,255,255 // jmpq 4d76 <_sk_load_u16_be_avx+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,162,254,255,255 // jmpq 4d8e <_sk_load_u16_be_avx+0x31>
+ .byte 233,162,254,255,255 // jmpq 4d76 <_sk_load_u16_be_avx+0x31>
HIDDEN _sk_load_rgb_u16_be_avx
.globl _sk_load_rgb_u16_be_avx
FUNCTION(_sk_load_rgb_u16_be_avx)
_sk_load_rgb_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,127 // lea (%rdi,%rdi,2),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,243,0,0,0 // jne 4ff1 <_sk_load_rgb_u16_be_avx+0x105>
- .byte 196,193,122,111,4,64 // vmovdqu (%r8,%rax,2),%xmm0
- .byte 196,193,122,111,84,64,12 // vmovdqu 0xc(%r8,%rax,2),%xmm2
- .byte 196,193,122,111,76,64,24 // vmovdqu 0x18(%r8,%rax,2),%xmm1
- .byte 196,193,122,111,92,64,32 // vmovdqu 0x20(%r8,%rax,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,243,0,0,0 // jne 4fd9 <_sk_load_rgb_u16_be_avx+0x105>
+ .byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0
+ .byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2
+ .byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1
+ .byte 196,193,122,111,92,65,32 // vmovdqu 0x20(%r9,%rax,2),%xmm3
.byte 197,225,115,219,4 // vpsrldq $0x4,%xmm3,%xmm3
.byte 197,185,115,216,6 // vpsrldq $0x6,%xmm0,%xmm8
.byte 197,177,115,218,6 // vpsrldq $0x6,%xmm2,%xmm9
@@ -19830,7 +19885,7 @@ _sk_load_rgb_u16_be_avx:
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,29,80,25,0,0 // vbroadcastss 0x1950(%rip),%ymm11 # 68d8 <_sk_callback_avx+0x45c>
+ .byte 196,98,125,24,29,188,25,0,0 // vbroadcastss 0x19bc(%rip),%ymm11 # 692c <_sk_callback_avx+0x464>
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -19851,50 +19906,50 @@ _sk_load_rgb_u16_be_avx:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,237,24,0,0 // vbroadcastss 0x18ed(%rip),%ymm3 # 68dc <_sk_callback_avx+0x460>
- .byte 255,224 // jmpq *%rax
- .byte 196,193,121,110,4,64 // vmovd (%r8,%rax,2),%xmm0
- .byte 196,193,121,196,68,64,4,2 // vpinsrw $0x2,0x4(%r8,%rax,2),%xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,5 // jne 500a <_sk_load_rgb_u16_be_avx+0x11e>
- .byte 233,40,255,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 196,193,121,110,76,64,6 // vmovd 0x6(%r8,%rax,2),%xmm1
- .byte 196,65,113,196,68,64,10,2 // vpinsrw $0x2,0xa(%r8,%rax,2),%xmm1,%xmm8
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,26 // jb 5039 <_sk_load_rgb_u16_be_avx+0x14d>
- .byte 196,193,121,110,76,64,12 // vmovd 0xc(%r8,%rax,2),%xmm1
- .byte 196,193,113,196,84,64,16,2 // vpinsrw $0x2,0x10(%r8,%rax,2),%xmm1,%xmm2
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 117,10 // jne 503e <_sk_load_rgb_u16_be_avx+0x152>
- .byte 233,249,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,244,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 196,193,121,110,76,64,18 // vmovd 0x12(%r8,%rax,2),%xmm1
- .byte 196,65,113,196,76,64,22,2 // vpinsrw $0x2,0x16(%r8,%rax,2),%xmm1,%xmm9
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,26 // jb 506d <_sk_load_rgb_u16_be_avx+0x181>
- .byte 196,193,121,110,76,64,24 // vmovd 0x18(%r8,%rax,2),%xmm1
- .byte 196,193,113,196,76,64,28,2 // vpinsrw $0x2,0x1c(%r8,%rax,2),%xmm1,%xmm1
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 117,10 // jne 5072 <_sk_load_rgb_u16_be_avx+0x186>
- .byte 233,197,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,192,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 196,193,121,110,92,64,30 // vmovd 0x1e(%r8,%rax,2),%xmm3
- .byte 196,65,97,196,92,64,34,2 // vpinsrw $0x2,0x22(%r8,%rax,2),%xmm3,%xmm11
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,20 // jb 509b <_sk_load_rgb_u16_be_avx+0x1af>
- .byte 196,193,121,110,92,64,36 // vmovd 0x24(%r8,%rax,2),%xmm3
- .byte 196,193,97,196,92,64,40,2 // vpinsrw $0x2,0x28(%r8,%rax,2),%xmm3,%xmm3
- .byte 233,151,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,146,254,255,255 // jmpq 4f32 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 196,226,125,24,29,89,25,0,0 // vbroadcastss 0x1959(%rip),%ymm3 # 6930 <_sk_callback_avx+0x468>
+ .byte 255,224 // jmpq *%rax
+ .byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0
+ .byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,5 // jne 4ff2 <_sk_load_rgb_u16_be_avx+0x11e>
+ .byte 233,40,255,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1
+ .byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,26 // jb 5021 <_sk_load_rgb_u16_be_avx+0x14d>
+ .byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1
+ .byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 117,10 // jne 5026 <_sk_load_rgb_u16_be_avx+0x152>
+ .byte 233,249,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,244,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1
+ .byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,26 // jb 5055 <_sk_load_rgb_u16_be_avx+0x181>
+ .byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1
+ .byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 117,10 // jne 505a <_sk_load_rgb_u16_be_avx+0x186>
+ .byte 233,197,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,192,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3
+ .byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,20 // jb 5083 <_sk_load_rgb_u16_be_avx+0x1af>
+ .byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3
+ .byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
+ .byte 233,151,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,146,254,255,255 // jmpq 4f1a <_sk_load_rgb_u16_be_avx+0x46>
HIDDEN _sk_store_u16_be_avx
.globl _sk_store_u16_be_avx
FUNCTION(_sk_store_u16_be_avx)
_sk_store_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 196,98,125,24,5,42,24,0,0 // vbroadcastss 0x182a(%rip),%ymm8 # 68e0 <_sk_callback_avx+0x464>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 196,98,125,24,5,150,24,0,0 // vbroadcastss 0x1896(%rip),%ymm8 # 6934 <_sk_callback_avx+0x46c>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10
@@ -19931,57 +19986,57 @@ _sk_store_u16_be_avx:
.byte 196,65,25,106,209 // vpunpckhdq %xmm9,%xmm12,%xmm10
.byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9
.byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,31 // jne 519a <_sk_store_u16_be_avx+0xfa>
- .byte 196,65,120,17,28,64 // vmovups %xmm11,(%r8,%rax,2)
- .byte 196,65,120,17,84,64,16 // vmovups %xmm10,0x10(%r8,%rax,2)
- .byte 196,65,120,17,76,64,32 // vmovups %xmm9,0x20(%r8,%rax,2)
- .byte 196,65,122,127,68,64,48 // vmovdqu %xmm8,0x30(%r8,%rax,2)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,65,121,214,28,64 // vmovq %xmm11,(%r8,%rax,2)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,23,92,64,8 // vmovhpd %xmm11,0x8(%r8,%rax,2)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,214,84,64,16 // vmovq %xmm10,0x10(%r8,%rax,2)
- .byte 116,218 // je 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,23,84,64,24 // vmovhpd %xmm10,0x18(%r8,%rax,2)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,205 // jb 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,214,76,64,32 // vmovq %xmm9,0x20(%r8,%rax,2)
- .byte 116,196 // je 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,23,76,64,40 // vmovhpd %xmm9,0x28(%r8,%rax,2)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,183 // jb 5196 <_sk_store_u16_be_avx+0xf6>
- .byte 196,65,121,214,68,64,48 // vmovq %xmm8,0x30(%r8,%rax,2)
- .byte 235,174 // jmp 5196 <_sk_store_u16_be_avx+0xf6>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,31 // jne 5182 <_sk_store_u16_be_avx+0xfa>
+ .byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2)
+ .byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2)
+ .byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2)
+ .byte 196,65,122,127,68,65,48 // vmovdqu %xmm8,0x30(%r9,%rax,2)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2)
+ .byte 116,218 // je 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,205 // jb 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2)
+ .byte 116,196 // je 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,183 // jb 517e <_sk_store_u16_be_avx+0xf6>
+ .byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2)
+ .byte 235,174 // jmp 517e <_sk_store_u16_be_avx+0xf6>
HIDDEN _sk_load_f32_avx
.globl _sk_load_f32_avx
FUNCTION(_sk_load_f32_avx)
_sk_load_f32_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 119,110 // ja 525e <_sk_load_f32_avx+0x76>
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 76,141,21,134,0,0,0 // lea 0x86(%rip),%r10 # 5288 <_sk_load_f32_avx+0xa0>
- .byte 73,99,4,138 // movslq (%r10,%rcx,4),%rax
- .byte 76,1,208 // add %r10,%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,3,125,24,68,136,112,1 // vinsertf128 $0x1,0x70(%r8,%r9,4),%ymm0,%ymm8
- .byte 196,131,125,24,92,136,96,1 // vinsertf128 $0x1,0x60(%r8,%r9,4),%ymm0,%ymm3
- .byte 196,131,125,24,76,136,80,1 // vinsertf128 $0x1,0x50(%r8,%r9,4),%ymm0,%ymm1
- .byte 196,131,125,24,84,136,64,1 // vinsertf128 $0x1,0x40(%r8,%r9,4),%ymm0,%ymm2
- .byte 196,129,121,16,68,136,48 // vmovupd 0x30(%r8,%r9,4),%xmm0
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 119,110 // ja 5246 <_sk_load_f32_avx+0x76>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 5270 <_sk_load_f32_avx+0xa0>
+ .byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
+ .byte 76,1,216 // add %r11,%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,3,125,24,68,145,112,1 // vinsertf128 $0x1,0x70(%r9,%r10,4),%ymm0,%ymm8
+ .byte 196,131,125,24,92,145,96,1 // vinsertf128 $0x1,0x60(%r9,%r10,4),%ymm0,%ymm3
+ .byte 196,131,125,24,76,145,80,1 // vinsertf128 $0x1,0x50(%r9,%r10,4),%ymm0,%ymm1
+ .byte 196,131,125,24,84,145,64,1 // vinsertf128 $0x1,0x40(%r9,%r10,4),%ymm0,%ymm2
+ .byte 196,129,121,16,68,145,48 // vmovupd 0x30(%r9,%r10,4),%xmm0
.byte 196,195,125,13,192,12 // vblendpd $0xc,%ymm8,%ymm0,%ymm0
- .byte 196,1,121,16,68,136,32 // vmovupd 0x20(%r8,%r9,4),%xmm8
+ .byte 196,1,121,16,68,145,32 // vmovupd 0x20(%r9,%r10,4),%xmm8
.byte 196,99,61,13,203,12 // vblendpd $0xc,%ymm3,%ymm8,%ymm9
- .byte 196,129,121,16,92,136,16 // vmovupd 0x10(%r8,%r9,4),%xmm3
+ .byte 196,129,121,16,92,145,16 // vmovupd 0x10(%r9,%r10,4),%xmm3
.byte 196,99,101,13,209,12 // vblendpd $0xc,%ymm1,%ymm3,%ymm10
- .byte 196,129,121,16,12,136 // vmovupd (%r8,%r9,4),%xmm1
+ .byte 196,129,121,16,12,145 // vmovupd (%r9,%r10,4),%xmm1
.byte 196,227,117,13,202,12 // vblendpd $0xc,%ymm2,%ymm1,%ymm1
.byte 196,193,116,20,210 // vunpcklps %ymm10,%ymm1,%ymm2
.byte 196,193,116,21,218 // vunpckhps %ymm10,%ymm1,%ymm3
@@ -20015,8 +20070,8 @@ HIDDEN _sk_store_f32_avx
FUNCTION(_sk_store_f32_avx)
_sk_store_f32_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 197,124,20,193 // vunpcklps %ymm1,%ymm0,%ymm8
.byte 197,124,21,217 // vunpckhps %ymm1,%ymm0,%ymm11
.byte 197,108,20,203 // vunpcklps %ymm3,%ymm2,%ymm9
@@ -20025,36 +20080,36 @@ _sk_store_f32_avx:
.byte 196,65,61,21,201 // vunpckhpd %ymm9,%ymm8,%ymm9
.byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8
.byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,55 // jne 5315 <_sk_store_f32_avx+0x6d>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,55 // jne 52fd <_sk_store_f32_avx+0x6d>
.byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
.byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
.byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
.byte 196,67,61,6,195,49 // vperm2f128 $0x31,%ymm11,%ymm8,%ymm8
- .byte 196,65,125,17,36,128 // vmovupd %ymm12,(%r8,%rax,4)
- .byte 196,65,125,17,108,128,32 // vmovupd %ymm13,0x20(%r8,%rax,4)
- .byte 196,65,125,17,76,128,64 // vmovupd %ymm9,0x40(%r8,%rax,4)
- .byte 196,65,125,17,68,128,96 // vmovupd %ymm8,0x60(%r8,%rax,4)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 196,65,121,17,20,128 // vmovupd %xmm10,(%r8,%rax,4)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 5311 <_sk_store_f32_avx+0x69>
- .byte 196,65,121,17,76,128,16 // vmovupd %xmm9,0x10(%r8,%rax,4)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 5311 <_sk_store_f32_avx+0x69>
- .byte 196,65,121,17,68,128,32 // vmovupd %xmm8,0x20(%r8,%rax,4)
- .byte 116,218 // je 5311 <_sk_store_f32_avx+0x69>
- .byte 196,65,121,17,92,128,48 // vmovupd %xmm11,0x30(%r8,%rax,4)
- .byte 72,131,249,5 // cmp $0x5,%rcx
- .byte 114,205 // jb 5311 <_sk_store_f32_avx+0x69>
- .byte 196,67,125,25,84,128,64,1 // vextractf128 $0x1,%ymm10,0x40(%r8,%rax,4)
- .byte 116,195 // je 5311 <_sk_store_f32_avx+0x69>
- .byte 196,67,125,25,76,128,80,1 // vextractf128 $0x1,%ymm9,0x50(%r8,%rax,4)
- .byte 72,131,249,7 // cmp $0x7,%rcx
- .byte 114,181 // jb 5311 <_sk_store_f32_avx+0x69>
- .byte 196,67,125,25,68,128,96,1 // vextractf128 $0x1,%ymm8,0x60(%r8,%rax,4)
- .byte 235,171 // jmp 5311 <_sk_store_f32_avx+0x69>
+ .byte 196,65,125,17,36,129 // vmovupd %ymm12,(%r9,%rax,4)
+ .byte 196,65,125,17,108,129,32 // vmovupd %ymm13,0x20(%r9,%rax,4)
+ .byte 196,65,125,17,76,129,64 // vmovupd %ymm9,0x40(%r9,%rax,4)
+ .byte 196,65,125,17,68,129,96 // vmovupd %ymm8,0x60(%r9,%rax,4)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4)
+ .byte 116,218 // je 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4)
+ .byte 73,131,248,5 // cmp $0x5,%r8
+ .byte 114,205 // jb 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
+ .byte 116,195 // je 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
+ .byte 73,131,248,7 // cmp $0x7,%r8
+ .byte 114,181 // jb 52f9 <_sk_store_f32_avx+0x69>
+ .byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
+ .byte 235,171 // jmp 52f9 <_sk_store_f32_avx+0x69>
HIDDEN _sk_clamp_x_avx
.globl _sk_clamp_x_avx
@@ -20158,7 +20213,7 @@ FUNCTION(_sk_clamp_x_1_avx)
_sk_clamp_x_1_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,90,20,0,0 // vbroadcastss 0x145a(%rip),%ymm8 # 68e4 <_sk_callback_avx+0x468>
+ .byte 196,98,125,24,5,198,20,0,0 // vbroadcastss 0x14c6(%rip),%ymm8 # 6938 <_sk_callback_avx+0x470>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -20176,9 +20231,9 @@ HIDDEN _sk_mirror_x_1_avx
.globl _sk_mirror_x_1_avx
FUNCTION(_sk_mirror_x_1_avx)
_sk_mirror_x_1_avx:
- .byte 196,98,125,24,5,61,20,0,0 // vbroadcastss 0x143d(%rip),%ymm8 # 68e8 <_sk_callback_avx+0x46c>
+ .byte 196,98,125,24,5,169,20,0,0 // vbroadcastss 0x14a9(%rip),%ymm8 # 693c <_sk_callback_avx+0x474>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,13,51,20,0,0 // vbroadcastss 0x1433(%rip),%ymm9 # 68ec <_sk_callback_avx+0x470>
+ .byte 196,98,125,24,13,159,20,0,0 // vbroadcastss 0x149f(%rip),%ymm9 # 6940 <_sk_callback_avx+0x478>
.byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9
.byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9
.byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9
@@ -20194,12 +20249,12 @@ HIDDEN _sk_luminance_to_alpha_avx
.globl _sk_luminance_to_alpha_avx
FUNCTION(_sk_luminance_to_alpha_avx)
_sk_luminance_to_alpha_avx:
- .byte 196,226,125,24,29,3,20,0,0 // vbroadcastss 0x1403(%rip),%ymm3 # 68f0 <_sk_callback_avx+0x474>
+ .byte 196,226,125,24,29,111,20,0,0 // vbroadcastss 0x146f(%rip),%ymm3 # 6944 <_sk_callback_avx+0x47c>
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,29,250,19,0,0 // vbroadcastss 0x13fa(%rip),%ymm3 # 68f4 <_sk_callback_avx+0x478>
+ .byte 196,226,125,24,29,102,20,0,0 // vbroadcastss 0x1466(%rip),%ymm3 # 6948 <_sk_callback_avx+0x480>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,237,19,0,0 // vbroadcastss 0x13ed(%rip),%ymm1 # 68f8 <_sk_callback_avx+0x47c>
+ .byte 196,226,125,24,13,89,20,0,0 // vbroadcastss 0x1459(%rip),%ymm1 # 694c <_sk_callback_avx+0x484>
.byte 197,236,89,201 // vmulps %ymm1,%ymm2,%ymm1
.byte 197,252,88,217 // vaddps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -20418,141 +20473,141 @@ _sk_evenly_spaced_gradient_avx:
.byte 72,139,24 // mov (%rax),%rbx
.byte 72,139,104,8 // mov 0x8(%rax),%rbp
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 5861 <_sk_evenly_spaced_gradient_avx+0x1f>
+ .byte 120,7 // js 5849 <_sk_evenly_spaced_gradient_avx+0x1f>
.byte 196,225,242,42,203 // vcvtsi2ss %rbx,%xmm1,%xmm1
- .byte 235,21 // jmp 5876 <_sk_evenly_spaced_gradient_avx+0x34>
- .byte 73,137,216 // mov %rbx,%r8
- .byte 73,209,232 // shr %r8
+ .byte 235,21 // jmp 585e <_sk_evenly_spaced_gradient_avx+0x34>
+ .byte 73,137,217 // mov %rbx,%r9
+ .byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
- .byte 76,9,195 // or %r8,%rbx
+ .byte 76,9,203 // or %r9,%rbx
.byte 196,225,242,42,203 // vcvtsi2ss %rbx,%xmm1,%xmm1
.byte 197,242,88,201 // vaddss %xmm1,%xmm1,%xmm1
.byte 196,227,121,4,201,0 // vpermilps $0x0,%xmm1,%xmm1
.byte 196,227,117,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm1,%ymm1
.byte 197,244,89,200 // vmulps %ymm0,%ymm1,%ymm1
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,195,249,22,200,1 // vpextrq $0x1,%xmm1,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 196,193,249,126,202 // vmovq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 196,195,249,22,201,1 // vpextrq $0x1,%xmm1,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,193,249,126,203 // vmovq %xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
- .byte 196,195,249,22,207,1 // vpextrq $0x1,%xmm1,%r15
- .byte 69,137,254 // mov %r15d,%r14d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,193,249,126,205 // vmovq %xmm1,%r13
- .byte 69,137,236 // mov %r13d,%r12d
- .byte 73,193,237,32 // shr $0x20,%r13
- .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1
- .byte 196,163,113,33,76,173,0,16 // vinsertps $0x10,0x0(%rbp,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ .byte 196,195,249,22,204,1 // vpextrq $0x1,%xmm1,%r12
+ .byte 69,137,231 // mov %r12d,%r15d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
+ .byte 65,137,221 // mov %ebx,%r13d
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
.byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
+ .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,84,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm2
- .byte 196,163,105,33,84,149,0,16 // vinsertps $0x10,0x0(%rbp,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,92,133,0 // vmovss 0x0(%rbp,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm8
- .byte 72,139,88,40 // mov 0x28(%rax),%rbx
- .byte 196,161,122,16,20,163 // vmovss (%rbx,%r12,4),%xmm2
- .byte 196,163,105,33,20,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,179 // vmovss (%rbx,%r14,4),%xmm3
+ .byte 72,139,104,40 // mov 0x28(%rax),%rbp
+ .byte 196,161,122,16,84,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm2
+ .byte 196,227,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,187 // vmovss (%rbx,%r15,4),%xmm3
+ .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,155 // vmovss (%rbx,%r11,4),%xmm3
- .byte 196,163,97,33,28,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- .byte 196,161,122,16,12,139 // vmovss (%rbx,%r9,4),%xmm1
+ .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3
+ .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1
.byte 196,227,97,33,201,32 // vinsertps $0x20,%xmm1,%xmm3,%xmm1
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1
.byte 196,99,117,24,226,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm12
- .byte 72,139,88,16 // mov 0x10(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,28,179 // vmovss (%rbx,%r14,4),%xmm3
+ .byte 72,139,104,16 // mov 0x10(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3
.byte 196,227,113,33,203,32 // vinsertps $0x20,%xmm3,%xmm1,%xmm1
- .byte 196,161,122,16,28,187 // vmovss (%rbx,%r15,4),%xmm3
+ .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3
.byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1
- .byte 196,161,122,16,28,155 // vmovss (%rbx,%r11,4),%xmm3
- .byte 196,163,97,33,28,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- .byte 196,161,122,16,20,139 // vmovss (%rbx,%r9,4),%xmm2
+ .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3
+ .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ .byte 196,161,122,16,84,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm2
.byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,233,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm13
- .byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,48 // mov 0x30(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm9
- .byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,24 // mov 0x18(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm10
- .byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,56 // mov 0x38(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm11
- .byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,32 // mov 0x20(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
+ .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,99,109,24,241,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm14
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 196,161,122,16,12,160 // vmovss (%rax,%r12,4),%xmm1
- .byte 196,163,113,33,12,168,16 // vinsertps $0x10,(%rax,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,176 // vmovss (%rax,%r14,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ .byte 196,161,122,16,12,168 // vmovss (%rax,%r13,4),%xmm1
+ .byte 196,227,113,33,12,152,16 // vinsertps $0x10,(%rax,%rbx,4),%xmm1,%xmm1
.byte 196,161,122,16,20,184 // vmovss (%rax,%r15,4),%xmm2
+ .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ .byte 196,161,122,16,20,160 // vmovss (%rax,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,152 // vmovss (%rax,%r11,4),%xmm2
- .byte 196,163,105,33,20,144,16 // vinsertps $0x10,(%rax,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,136 // vmovss (%rax,%r9,4),%xmm3
+ .byte 196,161,122,16,20,176 // vmovss (%rax,%r14,4),%xmm2
+ .byte 196,163,105,33,20,152,16 // vinsertps $0x10,(%rax,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,28,144 // vmovss (%rax,%r10,4),%xmm3
.byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,128 // vmovss (%rax,%r8,4),%xmm3
+ .byte 196,161,122,16,28,136 // vmovss (%rax,%r9,4),%xmm3
.byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
.byte 196,227,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm3
.byte 197,188,89,200 // vmulps %ymm0,%ymm8,%ymm1
@@ -20577,18 +20632,18 @@ HIDDEN _sk_gauss_a_to_rgba_avx
.globl _sk_gauss_a_to_rgba_avx
FUNCTION(_sk_gauss_a_to_rgba_avx)
_sk_gauss_a_to_rgba_avx:
- .byte 196,226,125,24,5,88,13,0,0 // vbroadcastss 0xd58(%rip),%ymm0 # 68fc <_sk_callback_avx+0x480>
+ .byte 196,226,125,24,5,148,13,0,0 // vbroadcastss 0xd94(%rip),%ymm0 # 6950 <_sk_callback_avx+0x488>
.byte 197,228,89,192 // vmulps %ymm0,%ymm3,%ymm0
- .byte 196,226,125,24,13,79,13,0,0 // vbroadcastss 0xd4f(%rip),%ymm1 # 6900 <_sk_callback_avx+0x484>
+ .byte 196,226,125,24,13,139,13,0,0 // vbroadcastss 0xd8b(%rip),%ymm1 # 6954 <_sk_callback_avx+0x48c>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,66,13,0,0 // vbroadcastss 0xd42(%rip),%ymm1 # 6904 <_sk_callback_avx+0x488>
+ .byte 196,226,125,24,13,126,13,0,0 // vbroadcastss 0xd7e(%rip),%ymm1 # 6958 <_sk_callback_avx+0x490>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,53,13,0,0 // vbroadcastss 0xd35(%rip),%ymm1 # 6908 <_sk_callback_avx+0x48c>
+ .byte 196,226,125,24,13,113,13,0,0 // vbroadcastss 0xd71(%rip),%ymm1 # 695c <_sk_callback_avx+0x494>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,40,13,0,0 // vbroadcastss 0xd28(%rip),%ymm1 # 690c <_sk_callback_avx+0x490>
+ .byte 196,226,125,24,13,100,13,0,0 // vbroadcastss 0xd64(%rip),%ymm1 # 6960 <_sk_callback_avx+0x498>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
@@ -20606,16 +20661,17 @@ _sk_gradient_avx:
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
+ .byte 197,252,17,124,36,216 // vmovups %ymm7,-0x28(%rsp)
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
- .byte 73,131,248,2 // cmp $0x2,%r8
- .byte 114,80 // jb 5c61 <_sk_gradient_avx+0x69>
+ .byte 73,131,249,2 // cmp $0x2,%r9
+ .byte 114,80 // jb 5c7f <_sk_gradient_avx+0x6f>
.byte 72,139,88,72 // mov 0x48(%rax),%rbx
- .byte 73,255,200 // dec %r8
+ .byte 73,255,201 // dec %r9
.byte 72,131,195,4 // add $0x4,%rbx
.byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9
- .byte 196,98,125,24,21,230,12,0,0 // vbroadcastss 0xce6(%rip),%ymm10 # 6910 <_sk_callback_avx+0x494>
+ .byte 196,98,125,24,21,28,13,0,0 // vbroadcastss 0xd1c(%rip),%ymm10 # 6964 <_sk_callback_avx+0x49c>
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 196,98,125,24,3 // vbroadcastss (%rbx),%ymm8
.byte 197,60,194,192,2 // vcmpleps %ymm0,%ymm8,%ymm8
@@ -20626,132 +20682,132 @@ _sk_gradient_avx:
.byte 197,185,254,201 // vpaddd %xmm1,%xmm8,%xmm1
.byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
.byte 72,131,195,4 // add $0x4,%rbx
- .byte 73,255,200 // dec %r8
- .byte 117,205 // jne 5c2e <_sk_gradient_avx+0x36>
- .byte 196,195,249,22,200,1 // vpextrq $0x1,%xmm1,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 196,193,249,126,202 // vmovq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 73,255,201 // dec %r9
+ .byte 117,205 // jne 5c4c <_sk_gradient_avx+0x3c>
+ .byte 196,195,249,22,201,1 // vpextrq $0x1,%xmm1,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 196,193,249,126,203 // vmovq %xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
- .byte 196,195,249,22,207,1 // vpextrq $0x1,%xmm1,%r15
- .byte 69,137,254 // mov %r15d,%r14d
- .byte 73,193,239,32 // shr $0x20,%r15
- .byte 196,193,249,126,205 // vmovq %xmm1,%r13
- .byte 69,137,236 // mov %r13d,%r12d
- .byte 73,193,237,32 // shr $0x20,%r13
+ .byte 196,195,249,22,204,1 // vpextrq $0x1,%xmm1,%r12
+ .byte 69,137,231 // mov %r12d,%r15d
+ .byte 73,193,236,32 // shr $0x20,%r12
+ .byte 196,225,249,126,203 // vmovq %xmm1,%rbx
+ .byte 65,137,221 // mov %ebx,%r13d
+ .byte 72,193,235,32 // shr $0x20,%rbx
.byte 72,139,104,8 // mov 0x8(%rax),%rbp
- .byte 72,139,88,16 // mov 0x10(%rax),%rbx
- .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1
- .byte 196,163,113,33,76,173,0,16 // vinsertps $0x10,0x0(%rbp,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
.byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,84,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm2
- .byte 196,163,105,33,84,149,0,16 // vinsertps $0x10,0x0(%rbp,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,92,133,0 // vmovss 0x0(%rbp,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,99,109,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm8
+ .byte 196,99,113,33,194,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm8
+ .byte 196,33,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm9
+ .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3
+ .byte 196,35,97,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm10
+ .byte 196,33,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm11
+ .byte 196,33,122,16,100,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm12
.byte 72,139,104,40 // mov 0x28(%rax),%rbp
- .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
- .byte 196,163,105,33,84,173,0,16 // vinsertps $0x10,0x0(%rbp,%r13,4),%xmm2,%xmm2
+ .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3
+ .byte 196,99,97,33,108,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm13
+ .byte 196,33,122,16,116,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm14
+ .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15
.byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
+ .byte 196,163,97,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm7
+ .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1
+ .byte 196,161,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm2
+ .byte 72,139,104,16 // mov 0x10(%rax),%rbp
+ .byte 196,67,57,33,193,48 // vinsertps $0x30,%xmm9,%xmm8,%xmm8
+ .byte 196,195,41,33,219,32 // vinsertps $0x20,%xmm11,%xmm10,%xmm3
+ .byte 196,195,97,33,220,48 // vinsertps $0x30,%xmm12,%xmm3,%xmm3
+ .byte 196,67,101,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm3,%ymm8
+ .byte 196,195,17,33,222,32 // vinsertps $0x20,%xmm14,%xmm13,%xmm3
+ .byte 196,195,97,33,223,48 // vinsertps $0x30,%xmm15,%xmm3,%xmm3
+ .byte 196,227,65,33,201,32 // vinsertps $0x20,%xmm1,%xmm7,%xmm1
+ .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
+ .byte 196,99,117,24,227,1 // vinsertf128 $0x1,%xmm3,%ymm1,%ymm12
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
.byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,92,157,0 // vmovss 0x0(%rbp,%r11,4),%xmm3
- .byte 196,163,97,33,92,149,0,16 // vinsertps $0x10,0x0(%rbp,%r10,4),%xmm3,%xmm3
- .byte 196,161,122,16,76,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm1
- .byte 196,227,97,33,201,32 // vinsertps $0x20,%xmm1,%xmm3,%xmm1
- .byte 196,161,122,16,92,133,0 // vmovss 0x0(%rbp,%r8,4),%xmm3
- .byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1
- .byte 196,99,117,24,226,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm12
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,28,179 // vmovss (%rbx,%r14,4),%xmm3
.byte 196,227,113,33,203,32 // vinsertps $0x20,%xmm3,%xmm1,%xmm1
- .byte 196,161,122,16,28,187 // vmovss (%rbx,%r15,4),%xmm3
+ .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3
.byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1
- .byte 196,161,122,16,28,155 // vmovss (%rbx,%r11,4),%xmm3
- .byte 196,163,97,33,28,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- .byte 196,161,122,16,20,139 // vmovss (%rbx,%r9,4),%xmm2
- .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,99,109,24,233,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm13
- .byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3
+ .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7
+ .byte 196,227,97,33,223,32 // vinsertps $0x20,%xmm7,%xmm3,%xmm3
+ .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7
+ .byte 196,227,97,33,223,48 // vinsertps $0x30,%xmm7,%xmm3,%xmm3
+ .byte 196,99,101,24,233,1 // vinsertf128 $0x1,%xmm1,%ymm3,%ymm13
+ .byte 72,139,104,48 // mov 0x30(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,124,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm7
+ .byte 196,227,113,33,207,32 // vinsertps $0x20,%xmm7,%xmm1,%xmm1
+ .byte 196,161,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm7
+ .byte 196,227,113,33,207,48 // vinsertps $0x30,%xmm7,%xmm1,%xmm1
+ .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7
+ .byte 196,163,65,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7
+ .byte 196,161,122,16,84,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm2
+ .byte 196,227,65,33,210,32 // vinsertps $0x20,%xmm2,%xmm7,%xmm2
+ .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7
+ .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2
.byte 196,99,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm9
- .byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,24 // mov 0x18(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7
+ .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7
+ .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2
.byte 196,99,109,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm10
- .byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,56 // mov 0x38(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
.byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2
+ .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7
+ .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7
+ .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2
.byte 196,99,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm11
- .byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 196,161,122,16,12,163 // vmovss (%rbx,%r12,4),%xmm1
- .byte 196,163,113,33,12,171,16 // vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,179 // vmovss (%rbx,%r14,4),%xmm2
+ .byte 72,139,104,32 // mov 0x20(%rax),%rbp
+ .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1
+ .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2
.byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,187 // vmovss (%rbx,%r15,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,155 // vmovss (%rbx,%r11,4),%xmm2
- .byte 196,163,105,33,20,147,16 // vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,139 // vmovss (%rbx,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,131 // vmovss (%rbx,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
- .byte 196,99,109,24,241,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm14
+ .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2
+ .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7
+ .byte 196,35,65,33,116,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm14
+ .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3
+ .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7
+ .byte 196,99,113,33,250,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm15
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 196,161,122,16,12,160 // vmovss (%rax,%r12,4),%xmm1
- .byte 196,163,113,33,12,168,16 // vinsertps $0x10,(%rax,%r13,4),%xmm1,%xmm1
- .byte 196,161,122,16,20,176 // vmovss (%rax,%r14,4),%xmm2
- .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,184 // vmovss (%rax,%r15,4),%xmm2
- .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1
- .byte 196,161,122,16,20,152 // vmovss (%rax,%r11,4),%xmm2
- .byte 196,163,105,33,20,144,16 // vinsertps $0x10,(%rax,%r10,4),%xmm2,%xmm2
- .byte 196,161,122,16,28,136 // vmovss (%rax,%r9,4),%xmm3
- .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2
- .byte 196,161,122,16,28,128 // vmovss (%rax,%r8,4),%xmm3
- .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ .byte 196,161,122,16,20,168 // vmovss (%rax,%r13,4),%xmm2
+ .byte 196,227,105,33,20,152,16 // vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2
+ .byte 196,227,9,33,219,32 // vinsertps $0x20,%xmm3,%xmm14,%xmm3
+ .byte 196,161,122,16,12,184 // vmovss (%rax,%r15,4),%xmm1
+ .byte 196,227,97,33,223,48 // vinsertps $0x30,%xmm7,%xmm3,%xmm3
+ .byte 196,161,122,16,60,160 // vmovss (%rax,%r12,4),%xmm7
+ .byte 196,67,101,24,247,1 // vinsertf128 $0x1,%xmm15,%ymm3,%ymm14
+ .byte 196,161,122,16,28,176 // vmovss (%rax,%r14,4),%xmm3
+ .byte 196,163,97,33,28,152,16 // vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3
+ .byte 196,227,105,33,201,32 // vinsertps $0x20,%xmm1,%xmm2,%xmm1
+ .byte 196,161,122,16,20,144 // vmovss (%rax,%r10,4),%xmm2
+ .byte 196,227,113,33,207,48 // vinsertps $0x30,%xmm7,%xmm1,%xmm1
+ .byte 196,161,122,16,60,136 // vmovss (%rax,%r9,4),%xmm7
+ .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2
+ .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2
.byte 196,227,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm3
.byte 197,188,89,200 // vmulps %ymm0,%ymm8,%ymm1
.byte 196,65,116,88,196 // vaddps %ymm12,%ymm1,%ymm8
@@ -20763,6 +20819,7 @@ _sk_gradient_avx:
.byte 197,252,88,219 // vaddps %ymm3,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,124,41,192 // vmovaps %ymm8,%ymm0
+ .byte 197,252,16,124,36,216 // vmovups -0x28(%rsp),%ymm7
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
@@ -20809,27 +20866,27 @@ _sk_xy_to_unit_angle_avx:
.byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12
.byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11
.byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12
- .byte 196,98,125,24,45,10,9,0,0 // vbroadcastss 0x90a(%rip),%ymm13 # 6914 <_sk_callback_avx+0x498>
+ .byte 196,98,125,24,45,18,9,0,0 // vbroadcastss 0x912(%rip),%ymm13 # 6968 <_sk_callback_avx+0x4a0>
.byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13
- .byte 196,98,125,24,53,0,9,0,0 // vbroadcastss 0x900(%rip),%ymm14 # 6918 <_sk_callback_avx+0x49c>
+ .byte 196,98,125,24,53,8,9,0,0 // vbroadcastss 0x908(%rip),%ymm14 # 696c <_sk_callback_avx+0x4a4>
.byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13
.byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13
- .byte 196,98,125,24,53,241,8,0,0 // vbroadcastss 0x8f1(%rip),%ymm14 # 691c <_sk_callback_avx+0x4a0>
+ .byte 196,98,125,24,53,249,8,0,0 // vbroadcastss 0x8f9(%rip),%ymm14 # 6970 <_sk_callback_avx+0x4a8>
.byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13
.byte 196,65,28,89,229 // vmulps %ymm13,%ymm12,%ymm12
- .byte 196,98,125,24,45,226,8,0,0 // vbroadcastss 0x8e2(%rip),%ymm13 # 6920 <_sk_callback_avx+0x4a4>
+ .byte 196,98,125,24,45,234,8,0,0 // vbroadcastss 0x8ea(%rip),%ymm13 # 6974 <_sk_callback_avx+0x4ac>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
.byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,205,8,0,0 // vbroadcastss 0x8cd(%rip),%ymm10 # 6924 <_sk_callback_avx+0x4a8>
+ .byte 196,98,125,24,21,213,8,0,0 // vbroadcastss 0x8d5(%rip),%ymm10 # 6978 <_sk_callback_avx+0x4b0>
.byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10
.byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9
.byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,21,183,8,0,0 // vbroadcastss 0x8b7(%rip),%ymm10 # 6928 <_sk_callback_avx+0x4ac>
+ .byte 196,98,125,24,21,191,8,0,0 // vbroadcastss 0x8bf(%rip),%ymm10 # 697c <_sk_callback_avx+0x4b4>
.byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9
- .byte 196,98,125,24,21,161,8,0,0 // vbroadcastss 0x8a1(%rip),%ymm10 # 692c <_sk_callback_avx+0x4b0>
+ .byte 196,98,125,24,21,169,8,0,0 // vbroadcastss 0x8a9(%rip),%ymm10 # 6980 <_sk_callback_avx+0x4b8>
.byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10
.byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0
.byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9
@@ -20853,7 +20910,7 @@ HIDDEN _sk_save_xy_avx
FUNCTION(_sk_save_xy_avx)
_sk_save_xy_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,107,8,0,0 // vbroadcastss 0x86b(%rip),%ymm8 # 6930 <_sk_callback_avx+0x4b4>
+ .byte 196,98,125,24,5,115,8,0,0 // vbroadcastss 0x873(%rip),%ymm8 # 6984 <_sk_callback_avx+0x4bc>
.byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9
.byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
@@ -20890,9 +20947,9 @@ HIDDEN _sk_bilinear_nx_avx
FUNCTION(_sk_bilinear_nx_avx)
_sk_bilinear_nx_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,247,7,0,0 // vbroadcastss 0x7f7(%rip),%ymm0 # 6934 <_sk_callback_avx+0x4b8>
+ .byte 196,226,125,24,5,255,7,0,0 // vbroadcastss 0x7ff(%rip),%ymm0 # 6988 <_sk_callback_avx+0x4c0>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,238,7,0,0 // vbroadcastss 0x7ee(%rip),%ymm8 # 6938 <_sk_callback_avx+0x4bc>
+ .byte 196,98,125,24,5,246,7,0,0 // vbroadcastss 0x7f6(%rip),%ymm8 # 698c <_sk_callback_avx+0x4c4>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -20903,7 +20960,7 @@ HIDDEN _sk_bilinear_px_avx
FUNCTION(_sk_bilinear_px_avx)
_sk_bilinear_px_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,214,7,0,0 // vbroadcastss 0x7d6(%rip),%ymm0 # 693c <_sk_callback_avx+0x4c0>
+ .byte 196,226,125,24,5,222,7,0,0 // vbroadcastss 0x7de(%rip),%ymm0 # 6990 <_sk_callback_avx+0x4c8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -20915,9 +20972,9 @@ HIDDEN _sk_bilinear_ny_avx
FUNCTION(_sk_bilinear_ny_avx)
_sk_bilinear_ny_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,186,7,0,0 // vbroadcastss 0x7ba(%rip),%ymm1 # 6940 <_sk_callback_avx+0x4c4>
+ .byte 196,226,125,24,13,194,7,0,0 // vbroadcastss 0x7c2(%rip),%ymm1 # 6994 <_sk_callback_avx+0x4cc>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,176,7,0,0 // vbroadcastss 0x7b0(%rip),%ymm8 # 6944 <_sk_callback_avx+0x4c8>
+ .byte 196,98,125,24,5,184,7,0,0 // vbroadcastss 0x7b8(%rip),%ymm8 # 6998 <_sk_callback_avx+0x4d0>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -20928,7 +20985,7 @@ HIDDEN _sk_bilinear_py_avx
FUNCTION(_sk_bilinear_py_avx)
_sk_bilinear_py_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,152,7,0,0 // vbroadcastss 0x798(%rip),%ymm1 # 6948 <_sk_callback_avx+0x4cc>
+ .byte 196,226,125,24,13,160,7,0,0 // vbroadcastss 0x7a0(%rip),%ymm1 # 699c <_sk_callback_avx+0x4d4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -20940,14 +20997,14 @@ HIDDEN _sk_bicubic_n3x_avx
FUNCTION(_sk_bicubic_n3x_avx)
_sk_bicubic_n3x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,123,7,0,0 // vbroadcastss 0x77b(%rip),%ymm0 # 694c <_sk_callback_avx+0x4d0>
+ .byte 196,226,125,24,5,131,7,0,0 // vbroadcastss 0x783(%rip),%ymm0 # 69a0 <_sk_callback_avx+0x4d8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,114,7,0,0 // vbroadcastss 0x772(%rip),%ymm8 # 6950 <_sk_callback_avx+0x4d4>
+ .byte 196,98,125,24,5,122,7,0,0 // vbroadcastss 0x77a(%rip),%ymm8 # 69a4 <_sk_callback_avx+0x4dc>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,99,7,0,0 // vbroadcastss 0x763(%rip),%ymm10 # 6954 <_sk_callback_avx+0x4d8>
+ .byte 196,98,125,24,21,107,7,0,0 // vbroadcastss 0x76b(%rip),%ymm10 # 69a8 <_sk_callback_avx+0x4e0>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,89,7,0,0 // vbroadcastss 0x759(%rip),%ymm10 # 6958 <_sk_callback_avx+0x4dc>
+ .byte 196,98,125,24,21,97,7,0,0 // vbroadcastss 0x761(%rip),%ymm10 # 69ac <_sk_callback_avx+0x4e4>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -20959,19 +21016,19 @@ HIDDEN _sk_bicubic_n1x_avx
FUNCTION(_sk_bicubic_n1x_avx)
_sk_bicubic_n1x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,60,7,0,0 // vbroadcastss 0x73c(%rip),%ymm0 # 695c <_sk_callback_avx+0x4e0>
+ .byte 196,226,125,24,5,68,7,0,0 // vbroadcastss 0x744(%rip),%ymm0 # 69b0 <_sk_callback_avx+0x4e8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,51,7,0,0 // vbroadcastss 0x733(%rip),%ymm8 # 6960 <_sk_callback_avx+0x4e4>
+ .byte 196,98,125,24,5,59,7,0,0 // vbroadcastss 0x73b(%rip),%ymm8 # 69b4 <_sk_callback_avx+0x4ec>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,41,7,0,0 // vbroadcastss 0x729(%rip),%ymm9 # 6964 <_sk_callback_avx+0x4e8>
+ .byte 196,98,125,24,13,49,7,0,0 // vbroadcastss 0x731(%rip),%ymm9 # 69b8 <_sk_callback_avx+0x4f0>
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,31,7,0,0 // vbroadcastss 0x71f(%rip),%ymm10 # 6968 <_sk_callback_avx+0x4ec>
+ .byte 196,98,125,24,21,39,7,0,0 // vbroadcastss 0x727(%rip),%ymm10 # 69bc <_sk_callback_avx+0x4f4>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,16,7,0,0 // vbroadcastss 0x710(%rip),%ymm10 # 696c <_sk_callback_avx+0x4f0>
+ .byte 196,98,125,24,21,24,7,0,0 // vbroadcastss 0x718(%rip),%ymm10 # 69c0 <_sk_callback_avx+0x4f8>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,1,7,0,0 // vbroadcastss 0x701(%rip),%ymm9 # 6970 <_sk_callback_avx+0x4f4>
+ .byte 196,98,125,24,13,9,7,0,0 // vbroadcastss 0x709(%rip),%ymm9 # 69c4 <_sk_callback_avx+0x4fc>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -20982,17 +21039,17 @@ HIDDEN _sk_bicubic_p1x_avx
FUNCTION(_sk_bicubic_p1x_avx)
_sk_bicubic_p1x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,233,6,0,0 // vbroadcastss 0x6e9(%rip),%ymm8 # 6974 <_sk_callback_avx+0x4f8>
+ .byte 196,98,125,24,5,241,6,0,0 // vbroadcastss 0x6f1(%rip),%ymm8 # 69c8 <_sk_callback_avx+0x500>
.byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0
.byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9
- .byte 196,98,125,24,21,219,6,0,0 // vbroadcastss 0x6db(%rip),%ymm10 # 6978 <_sk_callback_avx+0x4fc>
+ .byte 196,98,125,24,21,227,6,0,0 // vbroadcastss 0x6e3(%rip),%ymm10 # 69cc <_sk_callback_avx+0x504>
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
- .byte 196,98,125,24,29,209,6,0,0 // vbroadcastss 0x6d1(%rip),%ymm11 # 697c <_sk_callback_avx+0x500>
+ .byte 196,98,125,24,29,217,6,0,0 // vbroadcastss 0x6d9(%rip),%ymm11 # 69d0 <_sk_callback_avx+0x508>
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
.byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
- .byte 196,98,125,24,13,184,6,0,0 // vbroadcastss 0x6b8(%rip),%ymm9 # 6980 <_sk_callback_avx+0x504>
+ .byte 196,98,125,24,13,192,6,0,0 // vbroadcastss 0x6c0(%rip),%ymm9 # 69d4 <_sk_callback_avx+0x50c>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -21003,13 +21060,13 @@ HIDDEN _sk_bicubic_p3x_avx
FUNCTION(_sk_bicubic_p3x_avx)
_sk_bicubic_p3x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,160,6,0,0 // vbroadcastss 0x6a0(%rip),%ymm0 # 6984 <_sk_callback_avx+0x508>
+ .byte 196,226,125,24,5,168,6,0,0 // vbroadcastss 0x6a8(%rip),%ymm0 # 69d8 <_sk_callback_avx+0x510>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,141,6,0,0 // vbroadcastss 0x68d(%rip),%ymm10 # 6988 <_sk_callback_avx+0x50c>
+ .byte 196,98,125,24,21,149,6,0,0 // vbroadcastss 0x695(%rip),%ymm10 # 69dc <_sk_callback_avx+0x514>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,131,6,0,0 // vbroadcastss 0x683(%rip),%ymm10 # 698c <_sk_callback_avx+0x510>
+ .byte 196,98,125,24,21,139,6,0,0 // vbroadcastss 0x68b(%rip),%ymm10 # 69e0 <_sk_callback_avx+0x518>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -21021,14 +21078,14 @@ HIDDEN _sk_bicubic_n3y_avx
FUNCTION(_sk_bicubic_n3y_avx)
_sk_bicubic_n3y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,102,6,0,0 // vbroadcastss 0x666(%rip),%ymm1 # 6990 <_sk_callback_avx+0x514>
+ .byte 196,226,125,24,13,110,6,0,0 // vbroadcastss 0x66e(%rip),%ymm1 # 69e4 <_sk_callback_avx+0x51c>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,92,6,0,0 // vbroadcastss 0x65c(%rip),%ymm8 # 6994 <_sk_callback_avx+0x518>
+ .byte 196,98,125,24,5,100,6,0,0 // vbroadcastss 0x664(%rip),%ymm8 # 69e8 <_sk_callback_avx+0x520>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,77,6,0,0 // vbroadcastss 0x64d(%rip),%ymm10 # 6998 <_sk_callback_avx+0x51c>
+ .byte 196,98,125,24,21,85,6,0,0 // vbroadcastss 0x655(%rip),%ymm10 # 69ec <_sk_callback_avx+0x524>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,67,6,0,0 // vbroadcastss 0x643(%rip),%ymm10 # 699c <_sk_callback_avx+0x520>
+ .byte 196,98,125,24,21,75,6,0,0 // vbroadcastss 0x64b(%rip),%ymm10 # 69f0 <_sk_callback_avx+0x528>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -21040,19 +21097,19 @@ HIDDEN _sk_bicubic_n1y_avx
FUNCTION(_sk_bicubic_n1y_avx)
_sk_bicubic_n1y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,38,6,0,0 // vbroadcastss 0x626(%rip),%ymm1 # 69a0 <_sk_callback_avx+0x524>
+ .byte 196,226,125,24,13,46,6,0,0 // vbroadcastss 0x62e(%rip),%ymm1 # 69f4 <_sk_callback_avx+0x52c>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,28,6,0,0 // vbroadcastss 0x61c(%rip),%ymm8 # 69a4 <_sk_callback_avx+0x528>
+ .byte 196,98,125,24,5,36,6,0,0 // vbroadcastss 0x624(%rip),%ymm8 # 69f8 <_sk_callback_avx+0x530>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,18,6,0,0 // vbroadcastss 0x612(%rip),%ymm9 # 69a8 <_sk_callback_avx+0x52c>
+ .byte 196,98,125,24,13,26,6,0,0 // vbroadcastss 0x61a(%rip),%ymm9 # 69fc <_sk_callback_avx+0x534>
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,8,6,0,0 // vbroadcastss 0x608(%rip),%ymm10 # 69ac <_sk_callback_avx+0x530>
+ .byte 196,98,125,24,21,16,6,0,0 // vbroadcastss 0x610(%rip),%ymm10 # 6a00 <_sk_callback_avx+0x538>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,249,5,0,0 // vbroadcastss 0x5f9(%rip),%ymm10 # 69b0 <_sk_callback_avx+0x534>
+ .byte 196,98,125,24,21,1,6,0,0 // vbroadcastss 0x601(%rip),%ymm10 # 6a04 <_sk_callback_avx+0x53c>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,234,5,0,0 // vbroadcastss 0x5ea(%rip),%ymm9 # 69b4 <_sk_callback_avx+0x538>
+ .byte 196,98,125,24,13,242,5,0,0 // vbroadcastss 0x5f2(%rip),%ymm9 # 6a08 <_sk_callback_avx+0x540>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -21063,17 +21120,17 @@ HIDDEN _sk_bicubic_p1y_avx
FUNCTION(_sk_bicubic_p1y_avx)
_sk_bicubic_p1y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,210,5,0,0 // vbroadcastss 0x5d2(%rip),%ymm8 # 69b8 <_sk_callback_avx+0x53c>
+ .byte 196,98,125,24,5,218,5,0,0 // vbroadcastss 0x5da(%rip),%ymm8 # 6a0c <_sk_callback_avx+0x544>
.byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1
.byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9
- .byte 196,98,125,24,21,195,5,0,0 // vbroadcastss 0x5c3(%rip),%ymm10 # 69bc <_sk_callback_avx+0x540>
+ .byte 196,98,125,24,21,203,5,0,0 // vbroadcastss 0x5cb(%rip),%ymm10 # 6a10 <_sk_callback_avx+0x548>
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
- .byte 196,98,125,24,29,185,5,0,0 // vbroadcastss 0x5b9(%rip),%ymm11 # 69c0 <_sk_callback_avx+0x544>
+ .byte 196,98,125,24,29,193,5,0,0 // vbroadcastss 0x5c1(%rip),%ymm11 # 6a14 <_sk_callback_avx+0x54c>
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
.byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
- .byte 196,98,125,24,13,160,5,0,0 // vbroadcastss 0x5a0(%rip),%ymm9 # 69c4 <_sk_callback_avx+0x548>
+ .byte 196,98,125,24,13,168,5,0,0 // vbroadcastss 0x5a8(%rip),%ymm9 # 6a18 <_sk_callback_avx+0x550>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -21084,13 +21141,13 @@ HIDDEN _sk_bicubic_p3y_avx
FUNCTION(_sk_bicubic_p3y_avx)
_sk_bicubic_p3y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,136,5,0,0 // vbroadcastss 0x588(%rip),%ymm1 # 69c8 <_sk_callback_avx+0x54c>
+ .byte 196,226,125,24,13,144,5,0,0 // vbroadcastss 0x590(%rip),%ymm1 # 6a1c <_sk_callback_avx+0x554>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,116,5,0,0 // vbroadcastss 0x574(%rip),%ymm10 # 69cc <_sk_callback_avx+0x550>
+ .byte 196,98,125,24,21,124,5,0,0 // vbroadcastss 0x57c(%rip),%ymm10 # 6a20 <_sk_callback_avx+0x558>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,106,5,0,0 // vbroadcastss 0x56a(%rip),%ymm10 # 69d0 <_sk_callback_avx+0x554>
+ .byte 196,98,125,24,21,114,5,0,0 // vbroadcastss 0x572(%rip),%ymm10 # 6a24 <_sk_callback_avx+0x55c>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -21101,22 +21158,24 @@ HIDDEN _sk_callback_avx
.globl _sk_callback_avx
FUNCTION(_sk_callback_avx)
_sk_callback_avx:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 72,129,236,144,0,0,0 // sub $0x90,%rsp
+ .byte 72,129,236,136,0,0,0 // sub $0x88,%rsp
.byte 197,252,17,124,36,96 // vmovups %ymm7,0x60(%rsp)
.byte 197,252,17,116,36,64 // vmovups %ymm6,0x40(%rsp)
.byte 197,252,17,108,36,32 // vmovups %ymm5,0x20(%rsp)
.byte 197,252,17,36,36 // vmovups %ymm4,(%rsp)
- .byte 73,137,205 // mov %rcx,%r13
- .byte 73,137,214 // mov %rdx,%r14
- .byte 73,137,255 // mov %rdi,%r15
+ .byte 76,137,195 // mov %r8,%rbx
+ .byte 73,137,206 // mov %rcx,%r14
+ .byte 73,137,215 // mov %rdx,%r15
+ .byte 73,137,252 // mov %rdi,%r12
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,137,195 // mov %rax,%rbx
- .byte 73,137,244 // mov %rsi,%r12
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 73,137,245 // mov %rsi,%r13
.byte 197,252,20,225 // vunpcklps %ymm1,%ymm0,%ymm4
.byte 197,252,21,193 // vunpckhps %ymm1,%ymm0,%ymm0
.byte 197,236,20,203 // vunpcklps %ymm3,%ymm2,%ymm1
@@ -21129,17 +21188,17 @@ _sk_callback_avx:
.byte 196,227,93,24,232,1 // vinsertf128 $0x1,%xmm0,%ymm4,%ymm5
.byte 196,227,101,6,201,49 // vperm2f128 $0x31,%ymm1,%ymm3,%ymm1
.byte 196,227,93,6,192,49 // vperm2f128 $0x31,%ymm0,%ymm4,%ymm0
- .byte 197,253,17,83,8 // vmovupd %ymm2,0x8(%rbx)
- .byte 197,253,17,107,40 // vmovupd %ymm5,0x28(%rbx)
- .byte 197,253,17,75,72 // vmovupd %ymm1,0x48(%rbx)
- .byte 197,253,17,67,104 // vmovupd %ymm0,0x68(%rbx)
- .byte 77,133,237 // test %r13,%r13
+ .byte 197,253,17,85,8 // vmovupd %ymm2,0x8(%rbp)
+ .byte 197,253,17,109,40 // vmovupd %ymm5,0x28(%rbp)
+ .byte 197,253,17,77,72 // vmovupd %ymm1,0x48(%rbp)
+ .byte 197,253,17,69,104 // vmovupd %ymm0,0x68(%rbp)
+ .byte 72,133,219 // test %rbx,%rbx
.byte 190,8,0,0,0 // mov $0x8,%esi
- .byte 65,15,69,245 // cmovne %r13d,%esi
- .byte 72,137,223 // mov %rbx,%rdi
+ .byte 15,69,243 // cmovne %ebx,%esi
+ .byte 72,137,239 // mov %rbp,%rdi
.byte 197,248,119 // vzeroupper
- .byte 255,19 // callq *(%rbx)
- .byte 72,139,131,136,0,0,0 // mov 0x88(%rbx),%rax
+ .byte 255,85,0 // callq *0x0(%rbp)
+ .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax
.byte 197,248,16,0 // vmovups (%rax),%xmm0
.byte 197,248,16,72,16 // vmovups 0x10(%rax),%xmm1
.byte 197,248,16,80,32 // vmovups 0x20(%rax),%xmm2
@@ -21156,21 +21215,23 @@ _sk_callback_avx:
.byte 197,221,21,201 // vunpckhpd %ymm1,%ymm4,%ymm1
.byte 197,213,20,211 // vunpcklpd %ymm3,%ymm5,%ymm2
.byte 197,213,21,219 // vunpckhpd %ymm3,%ymm5,%ymm3
- .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,238 // mov %r13,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,255 // mov %r15,%rdi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,233 // mov %r13,%rcx
+ .byte 76,137,231 // mov %r12,%rdi
+ .byte 76,137,250 // mov %r15,%rdx
+ .byte 76,137,241 // mov %r14,%rcx
+ .byte 73,137,216 // mov %rbx,%r8
.byte 197,252,16,36,36 // vmovups (%rsp),%ymm4
.byte 197,252,16,108,36,32 // vmovups 0x20(%rsp),%ymm5
.byte 197,252,16,116,36,64 // vmovups 0x40(%rsp),%ymm6
.byte 197,252,16,124,36,96 // vmovups 0x60(%rsp),%ymm7
- .byte 72,129,196,144,0,0,0 // add $0x90,%rsp
+ .byte 72,129,196,136,0,0,0 // add $0x88,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
BALIGN4
@@ -21214,25 +21275,25 @@ BALIGN4
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 6655 <.literal4+0xb1>
+ .byte 71,225,61 // rex.RXB loope 66a9 <.literal4+0xb1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 6665 <.literal4+0xc1>
+ .byte 71,225,61 // rex.RXB loope 66b9 <.literal4+0xc1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 6675 <.literal4+0xd1>
+ .byte 71,225,61 // rex.RXB loope 66c9 <.literal4+0xd1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 6685 <.literal4+0xe1>
+ .byte 71,225,61 // rex.RXB loope 66d9 <.literal4+0xe1>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
@@ -21284,7 +21345,7 @@ BALIGN4
.byte 190,129,128,128,59 // mov $0x3b808081,%esi
.byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 66d9 <.literal4+0x135>
+ .byte 224,7 // loopne 672d <.literal4+0x135>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -21300,10 +21361,10 @@ BALIGN4
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
.byte 0,52,255 // add %dh,(%rdi,%rdi,8)
.byte 255 // (bad)
- .byte 127,0 // jg 6700 <.literal4+0x15c>
+ .byte 127,0 // jg 6754 <.literal4+0x15c>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6779 <.literal4+0x1d5>
+ .byte 119,115 // ja 67cd <.literal4+0x1d5>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -21317,10 +21378,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6734 <.literal4+0x190>
+ .byte 127,0 // jg 6788 <.literal4+0x190>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 67ad <.literal4+0x209>
+ .byte 119,115 // ja 6801 <.literal4+0x209>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -21334,10 +21395,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6768 <.literal4+0x1c4>
+ .byte 127,0 // jg 67bc <.literal4+0x1c4>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 67e1 <.literal4+0x23d>
+ .byte 119,115 // ja 6835 <.literal4+0x23d>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -21351,10 +21412,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 679c <.literal4+0x1f8>
+ .byte 127,0 // jg 67f0 <.literal4+0x1f8>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6815 <.literal4+0x271>
+ .byte 119,115 // ja 6869 <.literal4+0x271>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -21367,7 +21428,7 @@ BALIGN4
.byte 0,75,0 // add %cl,0x0(%rbx)
.byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax)
.byte 66,0,0 // rex.X add %al,(%rax)
- .byte 127,67 // jg 6813 <.literal4+0x26f>
+ .byte 127,67 // jg 6867 <.literal4+0x26f>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -21379,10 +21440,10 @@ BALIGN4
.byte 190,80,128,3,62 // mov $0x3e038050,%esi
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6833 <.literal4+0x28f>
+ .byte 118,63 // jbe 6887 <.literal4+0x28f>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
- .byte 127,67 // jg 6847 <.literal4+0x2a3>
+ .byte 127,67 // jg 689b <.literal4+0x2a3>
.byte 129,128,128,59,0,0,128,63,129,128 // addl $0x80813f80,0x3b80(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
@@ -21391,7 +21452,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6829 <.literal4+0x285>
+ .byte 224,7 // loopne 687d <.literal4+0x285>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -21403,7 +21464,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6845 <.literal4+0x2a1>
+ .byte 224,7 // loopne 6899 <.literal4+0x2a1>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -21414,7 +21475,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 689a <.literal4+0x2f6>
+ .byte 124,66 // jl 68ee <.literal4+0x2f6>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax)
@@ -21432,9 +21493,9 @@ BALIGN4
.byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax)
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax)
- .byte 112,65 // jo 68dd <.literal4+0x339>
+ .byte 112,65 // jo 6931 <.literal4+0x339>
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
- .byte 127,67 // jg 68eb <.literal4+0x347>
+ .byte 127,67 // jg 693f <.literal4+0x347>
.byte 0,128,0,0,0,0 // add %al,0x0(%rax)
.byte 0,128,0,4,0,128 // add %al,-0x7ffffc00(%rax)
.byte 0,0 // add %al,(%rax)
@@ -21450,7 +21511,7 @@ BALIGN4
.byte 0,128,55,0,0,128 // add %al,-0x7fffffc9(%rax)
.byte 63 // (bad)
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 692b <.literal4+0x387>
+ .byte 127,71 // jg 697f <.literal4+0x387>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,191,0,0,0 // add %al,0xbf(%rax)
@@ -21715,22 +21776,26 @@ HIDDEN _sk_start_pipeline_sse41
.globl _sk_start_pipeline_sse41
FUNCTION(_sk_start_pipeline_sse41)
_sk_start_pipeline_sse41:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 73,137,204 // mov %rcx,%r12
- .byte 73,137,214 // mov %rdx,%r14
+ .byte 80 // push %rax
+ .byte 77,137,198 // mov %r8,%r14
+ .byte 73,137,213 // mov %rdx,%r13
+ .byte 73,137,247 // mov %rsi,%r15
.byte 72,137,251 // mov %rdi,%rbx
+ .byte 72,137,206 // mov %rcx,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,247 // mov %rsi,%r15
+ .byte 73,137,244 // mov %rsi,%r12
.byte 72,141,75,4 // lea 0x4(%rbx),%rcx
- .byte 76,57,225 // cmp %r12,%rcx
- .byte 118,5 // jbe 25 <_sk_start_pipeline_sse41+0x25>
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 235,63 // jmp 64 <_sk_start_pipeline_sse41+0x64>
- .byte 185,0,0,0,0 // mov $0x0,%ecx
+ .byte 76,57,233 // cmp %r13,%rcx
+ .byte 118,5 // jbe 2d <_sk_start_pipeline_sse41+0x2d>
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 235,66 // jmp 6f <_sk_start_pipeline_sse41+0x6f>
+ .byte 65,184,0,0,0,0 // mov $0x0,%r8d
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -21739,19 +21804,20 @@ _sk_start_pipeline_sse41:
.byte 15,87,237 // xorps %xmm5,%xmm5
.byte 15,87,246 // xorps %xmm6,%xmm6
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 73,137,197 // mov %rax,%r13
- .byte 65,255,213 // callq *%r13
- .byte 76,137,232 // mov %r13,%rax
- .byte 72,141,123,4 // lea 0x4(%rbx),%rdi
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 255,213 // callq *%rbp
+ .byte 72,137,232 // mov %rbp,%rax
+ .byte 72,141,83,4 // lea 0x4(%rbx),%rdx
.byte 72,131,195,8 // add $0x8,%rbx
- .byte 76,57,227 // cmp %r12,%rbx
- .byte 72,137,251 // mov %rdi,%rbx
- .byte 118,193 // jbe 25 <_sk_start_pipeline_sse41+0x25>
- .byte 73,41,252 // sub %rdi,%r12
- .byte 116,44 // je 95 <_sk_start_pipeline_sse41+0x95>
+ .byte 76,57,235 // cmp %r13,%rbx
+ .byte 72,137,211 // mov %rdx,%rbx
+ .byte 118,190 // jbe 2d <_sk_start_pipeline_sse41+0x2d>
+ .byte 73,41,213 // sub %rdx,%r13
+ .byte 116,52 // je a8 <_sk_start_pipeline_sse41+0xa8>
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -21760,20 +21826,25 @@ _sk_start_pipeline_sse41:
.byte 15,87,237 // xorps %xmm5,%xmm5
.byte 15,87,246 // xorps %xmm6,%xmm6
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,225 // mov %r12,%rcx
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 77,137,232 // mov %r13,%r8
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 195 // retq
HIDDEN _sk_just_return_sse41
@@ -21786,20 +21857,19 @@ HIDDEN _sk_seed_shader_sse41
.globl _sk_seed_shader_sse41
FUNCTION(_sk_seed_shader_sse41)
_sk_seed_shader_sse41:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 102,15,110,199 // movd %edi,%xmm0
+ .byte 102,15,110,194 // movd %edx,%xmm0
.byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
- .byte 15,40,21,203,79,0,0 // movaps 0x4fcb(%rip),%xmm2 # 5080 <_sk_callback_sse41+0xed>
+ .byte 15,40,21,5,80,0,0 // movaps 0x5005(%rip),%xmm2 # 50d0 <_sk_callback_sse41+0xfc>
.byte 15,88,202 // addps %xmm2,%xmm1
- .byte 15,16,2 // movups (%rdx),%xmm0
+ .byte 15,16,7 // movups (%rdi),%xmm0
.byte 15,88,193 // addps %xmm1,%xmm0
- .byte 102,15,110,8 // movd (%rax),%xmm1
+ .byte 102,15,110,201 // movd %ecx,%xmm1
.byte 102,15,112,201,0 // pshufd $0x0,%xmm1,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,21,186,79,0,0 // movaps 0x4fba(%rip),%xmm2 # 5090 <_sk_callback_sse41+0xfd>
+ .byte 15,40,21,244,79,0,0 // movaps 0x4ff4(%rip),%xmm2 # 50e0 <_sk_callback_sse41+0x10c>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,87,237 // xorps %xmm5,%xmm5
@@ -21812,22 +21882,21 @@ HIDDEN _sk_dither_sse41
FUNCTION(_sk_dither_sse41)
_sk_dither_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 102,68,15,110,199 // movd %edi,%xmm8
+ .byte 102,68,15,110,194 // movd %edx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
- .byte 243,68,15,111,74,32 // movdqu 0x20(%rdx),%xmm9
+ .byte 243,68,15,111,79,32 // movdqu 0x20(%rdi),%xmm9
.byte 102,69,15,254,200 // paddd %xmm8,%xmm9
- .byte 76,139,0 // mov (%rax),%r8
- .byte 102,69,15,110,0 // movd (%r8),%xmm8
+ .byte 102,68,15,110,193 // movd %ecx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 102,69,15,239,193 // pxor %xmm9,%xmm8
- .byte 102,68,15,111,21,133,79,0,0 // movdqa 0x4f85(%rip),%xmm10 # 50a0 <_sk_callback_sse41+0x10d>
+ .byte 102,68,15,111,21,194,79,0,0 // movdqa 0x4fc2(%rip),%xmm10 # 50f0 <_sk_callback_sse41+0x11c>
.byte 102,69,15,111,216 // movdqa %xmm8,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,65,15,114,243,5 // pslld $0x5,%xmm11
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 102,65,15,114,242,4 // pslld $0x4,%xmm10
- .byte 102,68,15,111,37,113,79,0,0 // movdqa 0x4f71(%rip),%xmm12 # 50b0 <_sk_callback_sse41+0x11d>
- .byte 102,68,15,111,45,120,79,0,0 // movdqa 0x4f78(%rip),%xmm13 # 50c0 <_sk_callback_sse41+0x12d>
+ .byte 102,68,15,111,37,174,79,0,0 // movdqa 0x4fae(%rip),%xmm12 # 5100 <_sk_callback_sse41+0x12c>
+ .byte 102,68,15,111,45,181,79,0,0 // movdqa 0x4fb5(%rip),%xmm13 # 5110 <_sk_callback_sse41+0x13c>
.byte 102,69,15,111,240 // movdqa %xmm8,%xmm14
.byte 102,69,15,219,245 // pand %xmm13,%xmm14
.byte 102,65,15,114,246,2 // pslld $0x2,%xmm14
@@ -21839,13 +21908,13 @@ _sk_dither_sse41:
.byte 102,65,15,114,209,2 // psrld $0x2,%xmm9
.byte 102,69,15,235,234 // por %xmm10,%xmm13
.byte 102,69,15,235,233 // por %xmm9,%xmm13
- .byte 102,69,15,235,235 // por %xmm11,%xmm13
- .byte 102,69,15,235,198 // por %xmm14,%xmm8
- .byte 102,69,15,235,197 // por %xmm13,%xmm8
- .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,51,79,0,0 // mulps 0x4f33(%rip),%xmm8 # 50d0 <_sk_callback_sse41+0x13d>
- .byte 68,15,88,5,59,79,0,0 // addps 0x4f3b(%rip),%xmm8 # 50e0 <_sk_callback_sse41+0x14d>
- .byte 243,68,15,16,80,8 // movss 0x8(%rax),%xmm10
+ .byte 102,69,15,235,243 // por %xmm11,%xmm14
+ .byte 102,69,15,235,245 // por %xmm13,%xmm14
+ .byte 102,69,15,235,240 // por %xmm8,%xmm14
+ .byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8
+ .byte 68,15,89,5,112,79,0,0 // mulps 0x4f70(%rip),%xmm8 # 5120 <_sk_callback_sse41+0x14c>
+ .byte 68,15,88,5,120,79,0,0 // addps 0x4f78(%rip),%xmm8 # 5130 <_sk_callback_sse41+0x15c>
+ .byte 243,68,15,16,16 // movss (%rax),%xmm10
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,88,194 // addps %xmm10,%xmm0
@@ -21921,7 +21990,7 @@ HIDDEN _sk_srcatop_sse41
FUNCTION(_sk_srcatop_sse41)
_sk_srcatop_sse41:
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 68,15,40,5,148,78,0,0 // movaps 0x4e94(%rip),%xmm8 # 50f0 <_sk_callback_sse41+0x15d>
+ .byte 68,15,40,5,210,78,0,0 // movaps 0x4ed2(%rip),%xmm8 # 5140 <_sk_callback_sse41+0x16c>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -21946,7 +22015,7 @@ FUNCTION(_sk_dstatop_sse41)
_sk_dstatop_sse41:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
.byte 68,15,89,196 // mulps %xmm4,%xmm8
- .byte 68,15,40,13,87,78,0,0 // movaps 0x4e57(%rip),%xmm9 # 5100 <_sk_callback_sse41+0x16d>
+ .byte 68,15,40,13,149,78,0,0 // movaps 0x4e95(%rip),%xmm9 # 5150 <_sk_callback_sse41+0x17c>
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
@@ -21993,7 +22062,7 @@ HIDDEN _sk_srcout_sse41
.globl _sk_srcout_sse41
FUNCTION(_sk_srcout_sse41)
_sk_srcout_sse41:
- .byte 68,15,40,5,251,77,0,0 // movaps 0x4dfb(%rip),%xmm8 # 5110 <_sk_callback_sse41+0x17d>
+ .byte 68,15,40,5,57,78,0,0 // movaps 0x4e39(%rip),%xmm8 # 5160 <_sk_callback_sse41+0x18c>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
@@ -22006,7 +22075,7 @@ HIDDEN _sk_dstout_sse41
.globl _sk_dstout_sse41
FUNCTION(_sk_dstout_sse41)
_sk_dstout_sse41:
- .byte 68,15,40,5,235,77,0,0 // movaps 0x4deb(%rip),%xmm8 # 5120 <_sk_callback_sse41+0x18d>
+ .byte 68,15,40,5,41,78,0,0 // movaps 0x4e29(%rip),%xmm8 # 5170 <_sk_callback_sse41+0x19c>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
@@ -22023,7 +22092,7 @@ HIDDEN _sk_srcover_sse41
.globl _sk_srcover_sse41
FUNCTION(_sk_srcover_sse41)
_sk_srcover_sse41:
- .byte 68,15,40,5,206,77,0,0 // movaps 0x4dce(%rip),%xmm8 # 5130 <_sk_callback_sse41+0x19d>
+ .byte 68,15,40,5,12,78,0,0 // movaps 0x4e0c(%rip),%xmm8 # 5180 <_sk_callback_sse41+0x1ac>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -22043,7 +22112,7 @@ HIDDEN _sk_dstover_sse41
.globl _sk_dstover_sse41
FUNCTION(_sk_dstover_sse41)
_sk_dstover_sse41:
- .byte 68,15,40,5,162,77,0,0 // movaps 0x4da2(%rip),%xmm8 # 5140 <_sk_callback_sse41+0x1ad>
+ .byte 68,15,40,5,224,77,0,0 // movaps 0x4de0(%rip),%xmm8 # 5190 <_sk_callback_sse41+0x1bc>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -22071,7 +22140,7 @@ HIDDEN _sk_multiply_sse41
.globl _sk_multiply_sse41
FUNCTION(_sk_multiply_sse41)
_sk_multiply_sse41:
- .byte 68,15,40,5,118,77,0,0 // movaps 0x4d76(%rip),%xmm8 # 5150 <_sk_callback_sse41+0x1bd>
+ .byte 68,15,40,5,180,77,0,0 // movaps 0x4db4(%rip),%xmm8 # 51a0 <_sk_callback_sse41+0x1cc>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,209 // movaps %xmm9,%xmm10
@@ -22146,7 +22215,7 @@ HIDDEN _sk_xor__sse41
FUNCTION(_sk_xor__sse41)
_sk_xor__sse41:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
- .byte 15,40,29,171,76,0,0 // movaps 0x4cab(%rip),%xmm3 # 5160 <_sk_callback_sse41+0x1cd>
+ .byte 15,40,29,233,76,0,0 // movaps 0x4ce9(%rip),%xmm3 # 51b0 <_sk_callback_sse41+0x1dc>
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
@@ -22194,7 +22263,7 @@ _sk_darken_sse41:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,95,209 // maxps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,22,76,0,0 // movaps 0x4c16(%rip),%xmm2 # 5170 <_sk_callback_sse41+0x1dd>
+ .byte 15,40,21,84,76,0,0 // movaps 0x4c54(%rip),%xmm2 # 51c0 <_sk_callback_sse41+0x1ec>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -22228,7 +22297,7 @@ _sk_lighten_sse41:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,187,75,0,0 // movaps 0x4bbb(%rip),%xmm2 # 5180 <_sk_callback_sse41+0x1ed>
+ .byte 15,40,21,249,75,0,0 // movaps 0x4bf9(%rip),%xmm2 # 51d0 <_sk_callback_sse41+0x1fc>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -22265,7 +22334,7 @@ _sk_difference_sse41:
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,85,75,0,0 // movaps 0x4b55(%rip),%xmm2 # 5190 <_sk_callback_sse41+0x1fd>
+ .byte 15,40,21,147,75,0,0 // movaps 0x4b93(%rip),%xmm2 # 51e0 <_sk_callback_sse41+0x20c>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -22293,7 +22362,7 @@ _sk_exclusion_sse41:
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,21,75,0,0 // movaps 0x4b15(%rip),%xmm2 # 51a0 <_sk_callback_sse41+0x20d>
+ .byte 15,40,21,83,75,0,0 // movaps 0x4b53(%rip),%xmm2 # 51f0 <_sk_callback_sse41+0x21c>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -22306,7 +22375,7 @@ HIDDEN _sk_colorburn_sse41
FUNCTION(_sk_colorburn_sse41)
_sk_colorburn_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,8,75,0,0 // movaps 0x4b08(%rip),%xmm10 # 51b0 <_sk_callback_sse41+0x21d>
+ .byte 68,15,40,21,70,75,0,0 // movaps 0x4b46(%rip),%xmm10 # 5200 <_sk_callback_sse41+0x22c>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,203 // movaps %xmm11,%xmm9
@@ -22388,7 +22457,7 @@ HIDDEN _sk_colordodge_sse41
FUNCTION(_sk_colordodge_sse41)
_sk_colordodge_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,230,73,0,0 // movaps 0x49e6(%rip),%xmm10 # 51c0 <_sk_callback_sse41+0x22d>
+ .byte 68,15,40,21,36,74,0,0 // movaps 0x4a24(%rip),%xmm10 # 5210 <_sk_callback_sse41+0x23c>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
@@ -22470,7 +22539,7 @@ _sk_hardlight_sse41:
.byte 15,40,244 // movaps %xmm4,%xmm6
.byte 15,40,227 // movaps %xmm3,%xmm4
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 68,15,40,21,191,72,0,0 // movaps 0x48bf(%rip),%xmm10 # 51d0 <_sk_callback_sse41+0x23d>
+ .byte 68,15,40,21,253,72,0,0 // movaps 0x48fd(%rip),%xmm10 # 5220 <_sk_callback_sse41+0x24c>
.byte 65,15,40,234 // movaps %xmm10,%xmm5
.byte 15,92,239 // subps %xmm7,%xmm5
.byte 15,40,197 // movaps %xmm5,%xmm0
@@ -22553,7 +22622,7 @@ FUNCTION(_sk_overlay_sse41)
_sk_overlay_sse41:
.byte 68,15,40,201 // movaps %xmm1,%xmm9
.byte 68,15,40,240 // movaps %xmm0,%xmm14
- .byte 68,15,40,21,164,71,0,0 // movaps 0x47a4(%rip),%xmm10 # 51e0 <_sk_callback_sse41+0x24d>
+ .byte 68,15,40,21,226,71,0,0 // movaps 0x47e2(%rip),%xmm10 # 5230 <_sk_callback_sse41+0x25c>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 65,15,40,195 // movaps %xmm11,%xmm0
@@ -22638,7 +22707,7 @@ _sk_softlight_sse41:
.byte 15,40,198 // movaps %xmm6,%xmm0
.byte 15,94,199 // divps %xmm7,%xmm0
.byte 65,15,84,193 // andps %xmm9,%xmm0
- .byte 15,40,13,123,70,0,0 // movaps 0x467b(%rip),%xmm1 # 51f0 <_sk_callback_sse41+0x25d>
+ .byte 15,40,13,185,70,0,0 // movaps 0x46b9(%rip),%xmm1 # 5240 <_sk_callback_sse41+0x26c>
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 68,15,92,208 // subps %xmm0,%xmm10
.byte 68,15,40,240 // movaps %xmm0,%xmm14
@@ -22651,10 +22720,10 @@ _sk_softlight_sse41:
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,89,210 // mulps %xmm2,%xmm2
.byte 15,88,208 // addps %xmm0,%xmm2
- .byte 68,15,40,45,89,70,0,0 // movaps 0x4659(%rip),%xmm13 # 5200 <_sk_callback_sse41+0x26d>
+ .byte 68,15,40,45,151,70,0,0 // movaps 0x4697(%rip),%xmm13 # 5250 <_sk_callback_sse41+0x27c>
.byte 69,15,88,245 // addps %xmm13,%xmm14
.byte 68,15,89,242 // mulps %xmm2,%xmm14
- .byte 68,15,40,37,89,70,0,0 // movaps 0x4659(%rip),%xmm12 # 5210 <_sk_callback_sse41+0x27d>
+ .byte 68,15,40,37,151,70,0,0 // movaps 0x4697(%rip),%xmm12 # 5260 <_sk_callback_sse41+0x28c>
.byte 69,15,89,252 // mulps %xmm12,%xmm15
.byte 69,15,88,254 // addps %xmm14,%xmm15
.byte 15,40,198 // movaps %xmm6,%xmm0
@@ -22840,12 +22909,12 @@ _sk_hue_sse41:
.byte 68,15,84,208 // andps %xmm0,%xmm10
.byte 15,84,200 // andps %xmm0,%xmm1
.byte 68,15,84,232 // andps %xmm0,%xmm13
- .byte 15,40,5,196,67,0,0 // movaps 0x43c4(%rip),%xmm0 # 5220 <_sk_callback_sse41+0x28d>
+ .byte 15,40,5,2,68,0,0 // movaps 0x4402(%rip),%xmm0 # 5270 <_sk_callback_sse41+0x29c>
.byte 68,15,89,224 // mulps %xmm0,%xmm12
- .byte 15,40,21,201,67,0,0 // movaps 0x43c9(%rip),%xmm2 # 5230 <_sk_callback_sse41+0x29d>
+ .byte 15,40,21,7,68,0,0 // movaps 0x4407(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x2ac>
.byte 15,89,250 // mulps %xmm2,%xmm7
.byte 65,15,88,252 // addps %xmm12,%xmm7
- .byte 68,15,40,53,202,67,0,0 // movaps 0x43ca(%rip),%xmm14 # 5240 <_sk_callback_sse41+0x2ad>
+ .byte 68,15,40,53,8,68,0,0 // movaps 0x4408(%rip),%xmm14 # 5290 <_sk_callback_sse41+0x2bc>
.byte 68,15,40,252 // movaps %xmm4,%xmm15
.byte 69,15,89,254 // mulps %xmm14,%xmm15
.byte 68,15,88,255 // addps %xmm7,%xmm15
@@ -22928,7 +22997,7 @@ _sk_hue_sse41:
.byte 65,15,88,214 // addps %xmm14,%xmm2
.byte 15,40,196 // movaps %xmm4,%xmm0
.byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1
- .byte 68,15,40,13,142,66,0,0 // movaps 0x428e(%rip),%xmm9 # 5250 <_sk_callback_sse41+0x2bd>
+ .byte 68,15,40,13,204,66,0,0 // movaps 0x42cc(%rip),%xmm9 # 52a0 <_sk_callback_sse41+0x2cc>
.byte 65,15,40,225 // movaps %xmm9,%xmm4
.byte 15,92,229 // subps %xmm5,%xmm4
.byte 15,40,68,36,200 // movaps -0x38(%rsp),%xmm0
@@ -23022,14 +23091,14 @@ _sk_saturation_sse41:
.byte 68,15,84,215 // andps %xmm7,%xmm10
.byte 68,15,84,223 // andps %xmm7,%xmm11
.byte 68,15,84,199 // andps %xmm7,%xmm8
- .byte 15,40,21,72,65,0,0 // movaps 0x4148(%rip),%xmm2 # 5260 <_sk_callback_sse41+0x2cd>
+ .byte 15,40,21,134,65,0,0 // movaps 0x4186(%rip),%xmm2 # 52b0 <_sk_callback_sse41+0x2dc>
.byte 15,40,221 // movaps %xmm5,%xmm3
.byte 15,89,218 // mulps %xmm2,%xmm3
- .byte 15,40,13,75,65,0,0 // movaps 0x414b(%rip),%xmm1 # 5270 <_sk_callback_sse41+0x2dd>
+ .byte 15,40,13,137,65,0,0 // movaps 0x4189(%rip),%xmm1 # 52c0 <_sk_callback_sse41+0x2ec>
.byte 15,40,254 // movaps %xmm6,%xmm7
.byte 15,89,249 // mulps %xmm1,%xmm7
.byte 15,88,251 // addps %xmm3,%xmm7
- .byte 68,15,40,45,74,65,0,0 // movaps 0x414a(%rip),%xmm13 # 5280 <_sk_callback_sse41+0x2ed>
+ .byte 68,15,40,45,136,65,0,0 // movaps 0x4188(%rip),%xmm13 # 52d0 <_sk_callback_sse41+0x2fc>
.byte 69,15,89,245 // mulps %xmm13,%xmm14
.byte 68,15,88,247 // addps %xmm7,%xmm14
.byte 65,15,40,218 // movaps %xmm10,%xmm3
@@ -23110,7 +23179,7 @@ _sk_saturation_sse41:
.byte 65,15,88,253 // addps %xmm13,%xmm7
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 102,68,15,56,20,223 // blendvps %xmm0,%xmm7,%xmm11
- .byte 68,15,40,13,16,64,0,0 // movaps 0x4010(%rip),%xmm9 # 5290 <_sk_callback_sse41+0x2fd>
+ .byte 68,15,40,13,78,64,0,0 // movaps 0x404e(%rip),%xmm9 # 52e0 <_sk_callback_sse41+0x30c>
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 68,15,92,204 // subps %xmm4,%xmm9
.byte 15,40,124,36,168 // movaps -0x58(%rsp),%xmm7
@@ -23165,14 +23234,14 @@ _sk_color_sse41:
.byte 15,40,231 // movaps %xmm7,%xmm4
.byte 68,15,89,244 // mulps %xmm4,%xmm14
.byte 15,89,204 // mulps %xmm4,%xmm1
- .byte 68,15,40,13,91,63,0,0 // movaps 0x3f5b(%rip),%xmm9 # 52a0 <_sk_callback_sse41+0x30d>
+ .byte 68,15,40,13,153,63,0,0 // movaps 0x3f99(%rip),%xmm9 # 52f0 <_sk_callback_sse41+0x31c>
.byte 65,15,40,250 // movaps %xmm10,%xmm7
.byte 65,15,89,249 // mulps %xmm9,%xmm7
- .byte 68,15,40,21,91,63,0,0 // movaps 0x3f5b(%rip),%xmm10 # 52b0 <_sk_callback_sse41+0x31d>
+ .byte 68,15,40,21,153,63,0,0 // movaps 0x3f99(%rip),%xmm10 # 5300 <_sk_callback_sse41+0x32c>
.byte 65,15,40,219 // movaps %xmm11,%xmm3
.byte 65,15,89,218 // mulps %xmm10,%xmm3
.byte 15,88,223 // addps %xmm7,%xmm3
- .byte 68,15,40,29,88,63,0,0 // movaps 0x3f58(%rip),%xmm11 # 52c0 <_sk_callback_sse41+0x32d>
+ .byte 68,15,40,29,150,63,0,0 // movaps 0x3f96(%rip),%xmm11 # 5310 <_sk_callback_sse41+0x33c>
.byte 69,15,40,236 // movaps %xmm12,%xmm13
.byte 69,15,89,235 // mulps %xmm11,%xmm13
.byte 68,15,88,235 // addps %xmm3,%xmm13
@@ -23257,7 +23326,7 @@ _sk_color_sse41:
.byte 65,15,88,251 // addps %xmm11,%xmm7
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 102,15,56,20,207 // blendvps %xmm0,%xmm7,%xmm1
- .byte 68,15,40,13,20,62,0,0 // movaps 0x3e14(%rip),%xmm9 # 52d0 <_sk_callback_sse41+0x33d>
+ .byte 68,15,40,13,82,62,0,0 // movaps 0x3e52(%rip),%xmm9 # 5320 <_sk_callback_sse41+0x34c>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 68,15,89,192 // mulps %xmm0,%xmm8
@@ -23309,13 +23378,13 @@ _sk_luminosity_sse41:
.byte 69,15,89,216 // mulps %xmm8,%xmm11
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,89,205 // mulps %xmm5,%xmm9
- .byte 68,15,40,5,108,61,0,0 // movaps 0x3d6c(%rip),%xmm8 # 52e0 <_sk_callback_sse41+0x34d>
+ .byte 68,15,40,5,170,61,0,0 // movaps 0x3daa(%rip),%xmm8 # 5330 <_sk_callback_sse41+0x35c>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
- .byte 68,15,40,21,112,61,0,0 // movaps 0x3d70(%rip),%xmm10 # 52f0 <_sk_callback_sse41+0x35d>
+ .byte 68,15,40,21,174,61,0,0 // movaps 0x3dae(%rip),%xmm10 # 5340 <_sk_callback_sse41+0x36c>
.byte 15,40,233 // movaps %xmm1,%xmm5
.byte 65,15,89,234 // mulps %xmm10,%xmm5
.byte 15,88,232 // addps %xmm0,%xmm5
- .byte 68,15,40,37,110,61,0,0 // movaps 0x3d6e(%rip),%xmm12 # 5300 <_sk_callback_sse41+0x36d>
+ .byte 68,15,40,37,172,61,0,0 // movaps 0x3dac(%rip),%xmm12 # 5350 <_sk_callback_sse41+0x37c>
.byte 68,15,40,242 // movaps %xmm2,%xmm14
.byte 69,15,89,244 // mulps %xmm12,%xmm14
.byte 68,15,88,245 // addps %xmm5,%xmm14
@@ -23400,7 +23469,7 @@ _sk_luminosity_sse41:
.byte 65,15,88,244 // addps %xmm12,%xmm6
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 102,68,15,56,20,206 // blendvps %xmm0,%xmm6,%xmm9
- .byte 15,40,5,36,60,0,0 // movaps 0x3c24(%rip),%xmm0 # 5310 <_sk_callback_sse41+0x37d>
+ .byte 15,40,5,98,60,0,0 // movaps 0x3c62(%rip),%xmm0 # 5360 <_sk_callback_sse41+0x38c>
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,92,215 // subps %xmm7,%xmm2
.byte 15,89,226 // mulps %xmm2,%xmm4
@@ -23439,24 +23508,24 @@ FUNCTION(_sk_srcover_rgba_8888_sse41)
_sk_srcover_rgba_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,217,0,0,0 // jne 1840 <_sk_srcover_rgba_8888_sse41+0xe7>
- .byte 243,15,111,60,184 // movdqu (%rax,%rdi,4),%xmm7
- .byte 72,133,201 // test %rcx,%rcx
- .byte 102,15,111,37,169,59,0,0 // movdqa 0x3ba9(%rip),%xmm4 # 5320 <_sk_callback_sse41+0x38d>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,217,0,0,0 // jne 1852 <_sk_srcover_rgba_8888_sse41+0xe7>
+ .byte 243,15,111,60,144 // movdqu (%rax,%rdx,4),%xmm7
+ .byte 77,133,192 // test %r8,%r8
+ .byte 102,15,111,37,231,59,0,0 // movdqa 0x3be7(%rip),%xmm4 # 5370 <_sk_callback_sse41+0x39c>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
.byte 102,15,111,239 // movdqa %xmm7,%xmm5
- .byte 102,15,56,0,45,165,59,0,0 // pshufb 0x3ba5(%rip),%xmm5 # 5330 <_sk_callback_sse41+0x39d>
+ .byte 102,15,56,0,45,227,59,0,0 // pshufb 0x3be3(%rip),%xmm5 # 5380 <_sk_callback_sse41+0x3ac>
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
.byte 102,15,111,247 // movdqa %xmm7,%xmm6
- .byte 102,15,56,0,53,165,59,0,0 // pshufb 0x3ba5(%rip),%xmm6 # 5340 <_sk_callback_sse41+0x3ad>
+ .byte 102,15,56,0,53,227,59,0,0 // pshufb 0x3be3(%rip),%xmm6 # 5390 <_sk_callback_sse41+0x3bc>
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 102,15,114,215,24 // psrld $0x18,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 68,15,40,5,162,59,0,0 // movaps 0x3ba2(%rip),%xmm8 # 5350 <_sk_callback_sse41+0x3bd>
+ .byte 68,15,40,5,224,59,0,0 // movaps 0x3be0(%rip),%xmm8 # 53a0 <_sk_callback_sse41+0x3cc>
.byte 68,15,92,195 // subps %xmm3,%xmm8
- .byte 68,15,40,37,166,59,0,0 // movaps 0x3ba6(%rip),%xmm12 # 5360 <_sk_callback_sse41+0x3cd>
+ .byte 68,15,40,37,228,59,0,0 // movaps 0x3be4(%rip),%xmm12 # 53b0 <_sk_callback_sse41+0x3dc>
.byte 65,15,89,196 // mulps %xmm12,%xmm0
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -23482,40 +23551,40 @@ _sk_srcover_rgba_8888_sse41:
.byte 102,15,114,240,24 // pslld $0x18,%xmm0
.byte 102,15,235,194 // por %xmm2,%xmm0
.byte 102,15,235,193 // por %xmm1,%xmm0
- .byte 117,89 // jne 1880 <_sk_srcover_rgba_8888_sse41+0x127>
- .byte 243,15,127,4,184 // movdqu %xmm0,(%rax,%rdi,4)
+ .byte 117,89 // jne 1892 <_sk_srcover_rgba_8888_sse41+0x127>
+ .byte 243,15,127,4,144 // movdqu %xmm0,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 65,15,40,202 // movaps %xmm10,%xmm1
.byte 65,15,40,211 // movaps %xmm11,%xmm2
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,255 // pxor %xmm7,%xmm7
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,35 // je 1874 <_sk_srcover_rgba_8888_sse41+0x11b>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 186c <_sk_srcover_rgba_8888_sse41+0x113>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 15,133,11,255,255,255 // jne 176c <_sk_srcover_rgba_8888_sse41+0x13>
- .byte 102,15,110,100,184,8 // movd 0x8(%rax,%rdi,4),%xmm4
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,35 // je 1886 <_sk_srcover_rgba_8888_sse41+0x11b>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 187e <_sk_srcover_rgba_8888_sse41+0x113>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 15,133,11,255,255,255 // jne 177e <_sk_srcover_rgba_8888_sse41+0x13>
+ .byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7
- .byte 102,15,58,34,124,184,4,1 // pinsrd $0x1,0x4(%rax,%rdi,4),%xmm7
- .byte 102,15,58,34,60,184,0 // pinsrd $0x0,(%rax,%rdi,4),%xmm7
- .byte 233,236,254,255,255 // jmpq 176c <_sk_srcover_rgba_8888_sse41+0x13>
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,28 // je 18a9 <_sk_srcover_rgba_8888_sse41+0x150>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,14 // je 18a1 <_sk_srcover_rgba_8888_sse41+0x148>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,147 // jne 182c <_sk_srcover_rgba_8888_sse41+0xd3>
- .byte 102,15,58,22,68,184,8,2 // pextrd $0x2,%xmm0,0x8(%rax,%rdi,4)
- .byte 102,15,58,22,68,184,4,1 // pextrd $0x1,%xmm0,0x4(%rax,%rdi,4)
- .byte 102,15,126,4,184 // movd %xmm0,(%rax,%rdi,4)
- .byte 233,121,255,255,255 // jmpq 182c <_sk_srcover_rgba_8888_sse41+0xd3>
+ .byte 102,15,58,34,124,144,4,1 // pinsrd $0x1,0x4(%rax,%rdx,4),%xmm7
+ .byte 102,15,58,34,60,144,0 // pinsrd $0x0,(%rax,%rdx,4),%xmm7
+ .byte 233,236,254,255,255 // jmpq 177e <_sk_srcover_rgba_8888_sse41+0x13>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,28 // je 18bb <_sk_srcover_rgba_8888_sse41+0x150>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,14 // je 18b3 <_sk_srcover_rgba_8888_sse41+0x148>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,147 // jne 183e <_sk_srcover_rgba_8888_sse41+0xd3>
+ .byte 102,15,58,22,68,144,8,2 // pextrd $0x2,%xmm0,0x8(%rax,%rdx,4)
+ .byte 102,15,58,22,68,144,4,1 // pextrd $0x1,%xmm0,0x4(%rax,%rdx,4)
+ .byte 102,15,126,4,144 // movd %xmm0,(%rax,%rdx,4)
+ .byte 233,121,255,255,255 // jmpq 183e <_sk_srcover_rgba_8888_sse41+0xd3>
HIDDEN _sk_clamp_0_sse41
.globl _sk_clamp_0_sse41
@@ -23533,7 +23602,7 @@ HIDDEN _sk_clamp_1_sse41
.globl _sk_clamp_1_sse41
FUNCTION(_sk_clamp_1_sse41)
_sk_clamp_1_sse41:
- .byte 68,15,40,5,157,58,0,0 // movaps 0x3a9d(%rip),%xmm8 # 5370 <_sk_callback_sse41+0x3dd>
+ .byte 68,15,40,5,219,58,0,0 // movaps 0x3adb(%rip),%xmm8 # 53c0 <_sk_callback_sse41+0x3ec>
.byte 65,15,93,192 // minps %xmm8,%xmm0
.byte 65,15,93,200 // minps %xmm8,%xmm1
.byte 65,15,93,208 // minps %xmm8,%xmm2
@@ -23545,7 +23614,7 @@ HIDDEN _sk_clamp_a_sse41
.globl _sk_clamp_a_sse41
FUNCTION(_sk_clamp_a_sse41)
_sk_clamp_a_sse41:
- .byte 15,93,29,146,58,0,0 // minps 0x3a92(%rip),%xmm3 # 5380 <_sk_callback_sse41+0x3ed>
+ .byte 15,93,29,208,58,0,0 // minps 0x3ad0(%rip),%xmm3 # 53d0 <_sk_callback_sse41+0x3fc>
.byte 15,93,195 // minps %xmm3,%xmm0
.byte 15,93,203 // minps %xmm3,%xmm1
.byte 15,93,211 // minps %xmm3,%xmm2
@@ -23632,7 +23701,7 @@ HIDDEN _sk_unpremul_sse41
FUNCTION(_sk_unpremul_sse41)
_sk_unpremul_sse41:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
- .byte 68,15,40,13,253,57,0,0 // movaps 0x39fd(%rip),%xmm9 # 5390 <_sk_callback_sse41+0x3fd>
+ .byte 68,15,40,13,59,58,0,0 // movaps 0x3a3b(%rip),%xmm9 # 53e0 <_sk_callback_sse41+0x40c>
.byte 68,15,94,203 // divps %xmm3,%xmm9
.byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8
.byte 69,15,84,193 // andps %xmm9,%xmm8
@@ -23646,20 +23715,20 @@ HIDDEN _sk_from_srgb_sse41
.globl _sk_from_srgb_sse41
FUNCTION(_sk_from_srgb_sse41)
_sk_from_srgb_sse41:
- .byte 68,15,40,29,232,57,0,0 // movaps 0x39e8(%rip),%xmm11 # 53a0 <_sk_callback_sse41+0x40d>
+ .byte 68,15,40,29,38,58,0,0 // movaps 0x3a26(%rip),%xmm11 # 53f0 <_sk_callback_sse41+0x41c>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
.byte 68,15,40,208 // movaps %xmm0,%xmm10
.byte 69,15,89,210 // mulps %xmm10,%xmm10
- .byte 68,15,40,37,224,57,0,0 // movaps 0x39e0(%rip),%xmm12 # 53b0 <_sk_callback_sse41+0x41d>
+ .byte 68,15,40,37,30,58,0,0 // movaps 0x3a1e(%rip),%xmm12 # 5400 <_sk_callback_sse41+0x42c>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,196 // mulps %xmm12,%xmm8
- .byte 68,15,40,45,224,57,0,0 // movaps 0x39e0(%rip),%xmm13 # 53c0 <_sk_callback_sse41+0x42d>
+ .byte 68,15,40,45,30,58,0,0 // movaps 0x3a1e(%rip),%xmm13 # 5410 <_sk_callback_sse41+0x43c>
.byte 69,15,88,197 // addps %xmm13,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
- .byte 68,15,40,53,224,57,0,0 // movaps 0x39e0(%rip),%xmm14 # 53d0 <_sk_callback_sse41+0x43d>
+ .byte 68,15,40,53,30,58,0,0 // movaps 0x3a1e(%rip),%xmm14 # 5420 <_sk_callback_sse41+0x44c>
.byte 69,15,88,198 // addps %xmm14,%xmm8
- .byte 68,15,40,61,228,57,0,0 // movaps 0x39e4(%rip),%xmm15 # 53e0 <_sk_callback_sse41+0x44d>
+ .byte 68,15,40,61,34,58,0,0 // movaps 0x3a22(%rip),%xmm15 # 5430 <_sk_callback_sse41+0x45c>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 68,15,40,209 // movaps %xmm1,%xmm10
@@ -23702,22 +23771,22 @@ _sk_to_srgb_sse41:
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 68,15,82,192 // rsqrtps %xmm0,%xmm8
- .byte 68,15,40,29,92,57,0,0 // movaps 0x395c(%rip),%xmm11 # 53f0 <_sk_callback_sse41+0x45d>
+ .byte 68,15,40,29,154,57,0,0 // movaps 0x399a(%rip),%xmm11 # 5440 <_sk_callback_sse41+0x46c>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
- .byte 68,15,40,37,92,57,0,0 // movaps 0x395c(%rip),%xmm12 # 5400 <_sk_callback_sse41+0x46d>
+ .byte 68,15,40,37,154,57,0,0 // movaps 0x399a(%rip),%xmm12 # 5450 <_sk_callback_sse41+0x47c>
.byte 69,15,40,248 // movaps %xmm8,%xmm15
.byte 69,15,89,252 // mulps %xmm12,%xmm15
- .byte 68,15,40,21,92,57,0,0 // movaps 0x395c(%rip),%xmm10 # 5410 <_sk_callback_sse41+0x47d>
+ .byte 68,15,40,21,154,57,0,0 // movaps 0x399a(%rip),%xmm10 # 5460 <_sk_callback_sse41+0x48c>
.byte 69,15,88,250 // addps %xmm10,%xmm15
.byte 69,15,89,248 // mulps %xmm8,%xmm15
- .byte 68,15,40,45,92,57,0,0 // movaps 0x395c(%rip),%xmm13 # 5420 <_sk_callback_sse41+0x48d>
+ .byte 68,15,40,45,154,57,0,0 // movaps 0x399a(%rip),%xmm13 # 5470 <_sk_callback_sse41+0x49c>
.byte 69,15,88,253 // addps %xmm13,%xmm15
- .byte 68,15,40,53,96,57,0,0 // movaps 0x3960(%rip),%xmm14 # 5430 <_sk_callback_sse41+0x49d>
+ .byte 68,15,40,53,158,57,0,0 // movaps 0x399e(%rip),%xmm14 # 5480 <_sk_callback_sse41+0x4ac>
.byte 69,15,88,198 // addps %xmm14,%xmm8
.byte 69,15,83,192 // rcpps %xmm8,%xmm8
.byte 69,15,89,199 // mulps %xmm15,%xmm8
- .byte 68,15,40,61,92,57,0,0 // movaps 0x395c(%rip),%xmm15 # 5440 <_sk_callback_sse41+0x4ad>
+ .byte 68,15,40,61,154,57,0,0 // movaps 0x399a(%rip),%xmm15 # 5490 <_sk_callback_sse41+0x4bc>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 68,15,82,202 // rsqrtps %xmm2,%xmm9
@@ -23770,7 +23839,7 @@ _sk_rgb_to_hsl_sse41:
.byte 68,15,93,226 // minps %xmm2,%xmm12
.byte 65,15,40,203 // movaps %xmm11,%xmm1
.byte 65,15,92,204 // subps %xmm12,%xmm1
- .byte 68,15,40,53,169,56,0,0 // movaps 0x38a9(%rip),%xmm14 # 5450 <_sk_callback_sse41+0x4bd>
+ .byte 68,15,40,53,231,56,0,0 // movaps 0x38e7(%rip),%xmm14 # 54a0 <_sk_callback_sse41+0x4cc>
.byte 68,15,94,241 // divps %xmm1,%xmm14
.byte 69,15,40,211 // movaps %xmm11,%xmm10
.byte 69,15,194,208,0 // cmpeqps %xmm8,%xmm10
@@ -23779,27 +23848,27 @@ _sk_rgb_to_hsl_sse41:
.byte 65,15,89,198 // mulps %xmm14,%xmm0
.byte 69,15,40,249 // movaps %xmm9,%xmm15
.byte 68,15,194,250,1 // cmpltps %xmm2,%xmm15
- .byte 68,15,84,61,144,56,0,0 // andps 0x3890(%rip),%xmm15 # 5460 <_sk_callback_sse41+0x4cd>
+ .byte 68,15,84,61,206,56,0,0 // andps 0x38ce(%rip),%xmm15 # 54b0 <_sk_callback_sse41+0x4dc>
.byte 68,15,88,248 // addps %xmm0,%xmm15
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,194,193,0 // cmpeqps %xmm9,%xmm0
.byte 65,15,92,208 // subps %xmm8,%xmm2
.byte 65,15,89,214 // mulps %xmm14,%xmm2
- .byte 68,15,40,45,131,56,0,0 // movaps 0x3883(%rip),%xmm13 # 5470 <_sk_callback_sse41+0x4dd>
+ .byte 68,15,40,45,193,56,0,0 // movaps 0x38c1(%rip),%xmm13 # 54c0 <_sk_callback_sse41+0x4ec>
.byte 65,15,88,213 // addps %xmm13,%xmm2
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 69,15,89,198 // mulps %xmm14,%xmm8
- .byte 68,15,88,5,127,56,0,0 // addps 0x387f(%rip),%xmm8 # 5480 <_sk_callback_sse41+0x4ed>
+ .byte 68,15,88,5,189,56,0,0 // addps 0x38bd(%rip),%xmm8 # 54d0 <_sk_callback_sse41+0x4fc>
.byte 102,68,15,56,20,194 // blendvps %xmm0,%xmm2,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 102,69,15,56,20,199 // blendvps %xmm0,%xmm15,%xmm8
- .byte 68,15,89,5,119,56,0,0 // mulps 0x3877(%rip),%xmm8 # 5490 <_sk_callback_sse41+0x4fd>
+ .byte 68,15,89,5,181,56,0,0 // mulps 0x38b5(%rip),%xmm8 # 54e0 <_sk_callback_sse41+0x50c>
.byte 69,15,40,203 // movaps %xmm11,%xmm9
.byte 69,15,194,204,4 // cmpneqps %xmm12,%xmm9
.byte 69,15,84,193 // andps %xmm9,%xmm8
.byte 69,15,92,235 // subps %xmm11,%xmm13
.byte 69,15,88,220 // addps %xmm12,%xmm11
- .byte 15,40,5,107,56,0,0 // movaps 0x386b(%rip),%xmm0 # 54a0 <_sk_callback_sse41+0x50d>
+ .byte 15,40,5,169,56,0,0 // movaps 0x38a9(%rip),%xmm0 # 54f0 <_sk_callback_sse41+0x51c>
.byte 65,15,40,211 // movaps %xmm11,%xmm2
.byte 15,89,208 // mulps %xmm0,%xmm2
.byte 15,194,194,1 // cmpltps %xmm2,%xmm0
@@ -23821,7 +23890,7 @@ _sk_hsl_to_rgb_sse41:
.byte 15,41,100,36,184 // movaps %xmm4,-0x48(%rsp)
.byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp)
.byte 68,15,40,208 // movaps %xmm0,%xmm10
- .byte 68,15,40,13,49,56,0,0 // movaps 0x3831(%rip),%xmm9 # 54b0 <_sk_callback_sse41+0x51d>
+ .byte 68,15,40,13,111,56,0,0 // movaps 0x386f(%rip),%xmm9 # 5500 <_sk_callback_sse41+0x52c>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,194,194,2 // cmpleps %xmm2,%xmm0
.byte 15,40,217 // movaps %xmm1,%xmm3
@@ -23834,19 +23903,19 @@ _sk_hsl_to_rgb_sse41:
.byte 15,41,84,36,152 // movaps %xmm2,-0x68(%rsp)
.byte 69,15,88,192 // addps %xmm8,%xmm8
.byte 68,15,92,197 // subps %xmm5,%xmm8
- .byte 68,15,40,53,12,56,0,0 // movaps 0x380c(%rip),%xmm14 # 54c0 <_sk_callback_sse41+0x52d>
+ .byte 68,15,40,53,74,56,0,0 // movaps 0x384a(%rip),%xmm14 # 5510 <_sk_callback_sse41+0x53c>
.byte 69,15,88,242 // addps %xmm10,%xmm14
.byte 102,65,15,58,8,198,1 // roundps $0x1,%xmm14,%xmm0
.byte 68,15,92,240 // subps %xmm0,%xmm14
- .byte 68,15,40,29,5,56,0,0 // movaps 0x3805(%rip),%xmm11 # 54d0 <_sk_callback_sse41+0x53d>
+ .byte 68,15,40,29,67,56,0,0 // movaps 0x3843(%rip),%xmm11 # 5520 <_sk_callback_sse41+0x54c>
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 15,40,245 // movaps %xmm5,%xmm6
.byte 65,15,92,240 // subps %xmm8,%xmm6
- .byte 15,40,61,254,55,0,0 // movaps 0x37fe(%rip),%xmm7 # 54e0 <_sk_callback_sse41+0x54d>
+ .byte 15,40,61,60,56,0,0 // movaps 0x383c(%rip),%xmm7 # 5530 <_sk_callback_sse41+0x55c>
.byte 69,15,40,238 // movaps %xmm14,%xmm13
.byte 68,15,89,239 // mulps %xmm7,%xmm13
- .byte 15,40,29,255,55,0,0 // movaps 0x37ff(%rip),%xmm3 # 54f0 <_sk_callback_sse41+0x55d>
+ .byte 15,40,29,61,56,0,0 // movaps 0x383d(%rip),%xmm3 # 5540 <_sk_callback_sse41+0x56c>
.byte 68,15,40,227 // movaps %xmm3,%xmm12
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 68,15,89,230 // mulps %xmm6,%xmm12
@@ -23856,7 +23925,7 @@ _sk_hsl_to_rgb_sse41:
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 68,15,40,253 // movaps %xmm5,%xmm15
.byte 102,69,15,56,20,252 // blendvps %xmm0,%xmm12,%xmm15
- .byte 68,15,40,37,222,55,0,0 // movaps 0x37de(%rip),%xmm12 # 5500 <_sk_callback_sse41+0x56d>
+ .byte 68,15,40,37,28,56,0,0 // movaps 0x381c(%rip),%xmm12 # 5550 <_sk_callback_sse41+0x57c>
.byte 65,15,40,196 // movaps %xmm12,%xmm0
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 68,15,89,238 // mulps %xmm6,%xmm13
@@ -23890,7 +23959,7 @@ _sk_hsl_to_rgb_sse41:
.byte 65,15,40,198 // movaps %xmm14,%xmm0
.byte 15,40,84,36,152 // movaps -0x68(%rsp),%xmm2
.byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1
- .byte 68,15,88,21,86,55,0,0 // addps 0x3756(%rip),%xmm10 # 5510 <_sk_callback_sse41+0x57d>
+ .byte 68,15,88,21,148,55,0,0 // addps 0x3794(%rip),%xmm10 # 5560 <_sk_callback_sse41+0x58c>
.byte 102,65,15,58,8,194,1 // roundps $0x1,%xmm10,%xmm0
.byte 68,15,92,208 // subps %xmm0,%xmm10
.byte 69,15,194,218,2 // cmpleps %xmm10,%xmm11
@@ -23939,13 +24008,13 @@ HIDDEN _sk_scale_u8_sse41
FUNCTION(_sk_scale_u8_sse41)
_sk_scale_u8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,52 // jne 1e93 <_sk_scale_u8_sse41+0x3e>
- .byte 102,69,15,56,49,4,57 // pmovzxbd (%r9,%rdi,1),%xmm8
- .byte 102,68,15,219,5,177,54,0,0 // pand 0x36b1(%rip),%xmm8 # 5520 <_sk_callback_sse41+0x58d>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,52 // jne 1ea5 <_sk_scale_u8_sse41+0x3e>
+ .byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8
+ .byte 102,68,15,219,5,239,54,0,0 // pand 0x36ef(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x59c>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,181,54,0,0 // mulps 0x36b5(%rip),%xmm8 # 5530 <_sk_callback_sse41+0x59d>
+ .byte 68,15,89,5,243,54,0,0 // mulps 0x36f3(%rip),%xmm8 # 5580 <_sk_callback_sse41+0x5ac>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
@@ -23953,23 +24022,23 @@ _sk_scale_u8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,42 // je 1ecf <_sk_scale_u8_sse41+0x7a>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,23 // je 1ec2 <_sk_scale_u8_sse41+0x6d>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,181 // jne 1e66 <_sk_scale_u8_sse41+0x11>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,42 // je 1ee1 <_sk_scale_u8_sse41+0x7a>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,23 // je 1ed4 <_sk_scale_u8_sse41+0x6d>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,181 // jne 1e78 <_sk_scale_u8_sse41+0x11>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,68,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm8
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,68,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm8
- .byte 235,137 // jmp 1e66 <_sk_scale_u8_sse41+0x11>
+ .byte 235,137 // jmp 1e78 <_sk_scale_u8_sse41+0x11>
HIDDEN _sk_lerp_1_float_sse41
.globl _sk_lerp_1_float_sse41
@@ -23998,13 +24067,13 @@ HIDDEN _sk_lerp_u8_sse41
FUNCTION(_sk_lerp_u8_sse41)
_sk_lerp_u8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,72 // jne 1f67 <_sk_lerp_u8_sse41+0x52>
- .byte 102,69,15,56,49,4,57 // pmovzxbd (%r9,%rdi,1),%xmm8
- .byte 102,68,15,219,5,17,54,0,0 // pand 0x3611(%rip),%xmm8 # 5540 <_sk_callback_sse41+0x5ad>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,72 // jne 1f79 <_sk_lerp_u8_sse41+0x52>
+ .byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8
+ .byte 102,68,15,219,5,79,54,0,0 // pand 0x364f(%rip),%xmm8 # 5590 <_sk_callback_sse41+0x5bc>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,21,54,0,0 // mulps 0x3615(%rip),%xmm8 # 5550 <_sk_callback_sse41+0x5bd>
+ .byte 68,15,89,5,83,54,0,0 // mulps 0x3653(%rip),%xmm8 # 55a0 <_sk_callback_sse41+0x5cc>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -24019,44 +24088,44 @@ _sk_lerp_u8_sse41:
.byte 15,88,223 // addps %xmm7,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,42 // je 1fa3 <_sk_lerp_u8_sse41+0x8e>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,23 // je 1f96 <_sk_lerp_u8_sse41+0x81>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,161 // jne 1f26 <_sk_lerp_u8_sse41+0x11>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,42 // je 1fb5 <_sk_lerp_u8_sse41+0x8e>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,23 // je 1fa8 <_sk_lerp_u8_sse41+0x81>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,161 // jne 1f38 <_sk_lerp_u8_sse41+0x11>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,68,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm8
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,68,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm8
- .byte 233,114,255,255,255 // jmpq 1f26 <_sk_lerp_u8_sse41+0x11>
+ .byte 233,114,255,255,255 // jmpq 1f38 <_sk_lerp_u8_sse41+0x11>
HIDDEN _sk_lerp_565_sse41
.globl _sk_lerp_565_sse41
FUNCTION(_sk_lerp_565_sse41)
_sk_lerp_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,152,0,0,0 // jne 205a <_sk_lerp_565_sse41+0xa6>
- .byte 102,69,15,56,51,12,121 // pmovzxwd (%r9,%rdi,2),%xmm9
- .byte 102,68,15,111,5,142,53,0,0 // movdqa 0x358e(%rip),%xmm8 # 5560 <_sk_callback_sse41+0x5cd>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,152,0,0,0 // jne 206c <_sk_lerp_565_sse41+0xa6>
+ .byte 102,69,15,56,51,12,82 // pmovzxwd (%r10,%rdx,2),%xmm9
+ .byte 102,68,15,111,5,204,53,0,0 // movdqa 0x35cc(%rip),%xmm8 # 55b0 <_sk_callback_sse41+0x5dc>
.byte 102,69,15,219,193 // pand %xmm9,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,141,53,0,0 // mulps 0x358d(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x5dd>
- .byte 102,68,15,111,21,148,53,0,0 // movdqa 0x3594(%rip),%xmm10 # 5580 <_sk_callback_sse41+0x5ed>
+ .byte 68,15,89,5,203,53,0,0 // mulps 0x35cb(%rip),%xmm8 # 55c0 <_sk_callback_sse41+0x5ec>
+ .byte 102,68,15,111,21,210,53,0,0 // movdqa 0x35d2(%rip),%xmm10 # 55d0 <_sk_callback_sse41+0x5fc>
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
- .byte 68,15,89,21,147,53,0,0 // mulps 0x3593(%rip),%xmm10 # 5590 <_sk_callback_sse41+0x5fd>
- .byte 102,68,15,219,13,154,53,0,0 // pand 0x359a(%rip),%xmm9 # 55a0 <_sk_callback_sse41+0x60d>
+ .byte 68,15,89,21,209,53,0,0 // mulps 0x35d1(%rip),%xmm10 # 55e0 <_sk_callback_sse41+0x60c>
+ .byte 102,68,15,219,13,216,53,0,0 // pand 0x35d8(%rip),%xmm9 # 55f0 <_sk_callback_sse41+0x61c>
.byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9
- .byte 68,15,89,13,158,53,0,0 // mulps 0x359e(%rip),%xmm9 # 55b0 <_sk_callback_sse41+0x61d>
+ .byte 68,15,89,13,220,53,0,0 // mulps 0x35dc(%rip),%xmm9 # 5600 <_sk_callback_sse41+0x62c>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -24078,111 +24147,114 @@ _sk_lerp_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,46 // je 209a <_sk_lerp_565_sse41+0xe6>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,27 // je 208d <_sk_lerp_565_sse41+0xd9>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 15,133,77,255,255,255 // jne 1fc9 <_sk_lerp_565_sse41+0x15>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,46 // je 20ac <_sk_lerp_565_sse41+0xe6>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,27 // je 209f <_sk_lerp_565_sse41+0xd9>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 15,133,77,255,255,255 // jne 1fdb <_sk_lerp_565_sse41+0x15>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,200,69 // pshufd $0x45,%xmm8,%xmm9
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,68,15,58,34,200,1 // pinsrd $0x1,%eax,%xmm9
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,68,15,58,34,200,0 // pinsrd $0x0,%eax,%xmm9
- .byte 233,30,255,255,255 // jmpq 1fc9 <_sk_lerp_565_sse41+0x15>
+ .byte 233,30,255,255,255 // jmpq 1fdb <_sk_lerp_565_sse41+0x15>
HIDDEN _sk_load_tables_sse41
.globl _sk_load_tables_sse41
FUNCTION(_sk_load_tables_sse41)
_sk_load_tables_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,20,1,0,0 // jne 21cd <_sk_load_tables_sse41+0x122>
- .byte 243,69,15,111,4,184 // movdqu (%r8,%rdi,4),%xmm8
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,24,1,0,0 // jne 21e3 <_sk_load_tables_sse41+0x126>
+ .byte 243,69,15,111,4,145 // movdqu (%r9,%rdx,4),%xmm8
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 102,15,111,5,246,52,0,0 // movdqa 0x34f6(%rip),%xmm0 # 55c0 <_sk_callback_sse41+0x62d>
+ .byte 102,15,111,5,50,53,0,0 // movdqa 0x3532(%rip),%xmm0 # 5610 <_sk_callback_sse41+0x63c>
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
- .byte 102,73,15,58,22,192,1 // pextrq $0x1,%xmm0,%r8
- .byte 102,73,15,126,193 // movq %xmm0,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 102,73,15,126,194 // movq %xmm0,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 69,15,182,241 // movzbl %r9b,%r14d
.byte 73,193,233,30 // shr $0x1e,%r9
- .byte 69,15,182,216 // movzbl %r8b,%r11d
- .byte 73,193,232,30 // shr $0x1e,%r8
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,4,147 // movss (%rbx,%r10,4),%xmm0
- .byte 102,66,15,58,33,4,11,16 // insertps $0x10,(%rbx,%r9,1),%xmm0
- .byte 102,66,15,58,33,4,155,32 // insertps $0x20,(%rbx,%r11,4),%xmm0
- .byte 102,66,15,58,33,4,3,48 // insertps $0x30,(%rbx,%r8,1),%xmm0
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
+ .byte 102,66,15,58,33,4,19,16 // insertps $0x10,(%rbx,%r10,1),%xmm0
+ .byte 102,66,15,58,33,4,179,32 // insertps $0x20,(%rbx,%r14,4),%xmm0
+ .byte 102,66,15,58,33,4,11,48 // insertps $0x30,(%rbx,%r9,1),%xmm0
.byte 102,65,15,111,200 // movdqa %xmm8,%xmm1
- .byte 102,15,56,0,13,177,52,0,0 // pshufb 0x34b1(%rip),%xmm1 # 55d0 <_sk_callback_sse41+0x63d>
- .byte 102,73,15,58,22,200,1 // pextrq $0x1,%xmm1,%r8
+ .byte 102,15,56,0,13,237,52,0,0 // pshufb 0x34ed(%rip),%xmm1 # 5620 <_sk_callback_sse41+0x64c>
+ .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 68,15,182,203 // movzbl %bl,%r9d
+ .byte 68,15,182,211 // movzbl %bl,%r10d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,15,182,208 // movzbl %r8b,%r10d
- .byte 73,193,232,30 // shr $0x1e,%r8
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
- .byte 102,65,15,58,33,12,30,16 // insertps $0x10,(%r14,%rbx,1),%xmm1
- .byte 243,67,15,16,20,150 // movss (%r14,%r10,4),%xmm2
+ .byte 69,15,182,217 // movzbl %r9b,%r11d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 243,67,15,16,12,151 // movss (%r15,%r10,4),%xmm1
+ .byte 102,65,15,58,33,12,31,16 // insertps $0x10,(%r15,%rbx,1),%xmm1
+ .byte 243,67,15,16,20,159 // movss (%r15,%r11,4),%xmm2
.byte 102,15,58,33,202,32 // insertps $0x20,%xmm2,%xmm1
- .byte 243,67,15,16,20,6 // movss (%r14,%r8,1),%xmm2
+ .byte 243,67,15,16,20,15 // movss (%r15,%r9,1),%xmm2
.byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1
- .byte 76,139,64,24 // mov 0x18(%rax),%r8
+ .byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 102,65,15,111,208 // movdqa %xmm8,%xmm2
- .byte 102,15,56,0,21,109,52,0,0 // pshufb 0x346d(%rip),%xmm2 # 55e0 <_sk_callback_sse41+0x64d>
+ .byte 102,15,56,0,21,169,52,0,0 // pshufb 0x34a9(%rip),%xmm2 # 5630 <_sk_callback_sse41+0x65c>
.byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 68,15,182,200 // movzbl %al,%r9d
+ .byte 68,15,182,208 // movzbl %al,%r10d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 68,15,182,211 // movzbl %bl,%r10d
+ .byte 68,15,182,219 // movzbl %bl,%r11d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 243,67,15,16,20,136 // movss (%r8,%r9,4),%xmm2
- .byte 102,65,15,58,33,20,0,16 // insertps $0x10,(%r8,%rax,1),%xmm2
- .byte 243,67,15,16,28,144 // movss (%r8,%r10,4),%xmm3
+ .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
+ .byte 102,65,15,58,33,20,1,16 // insertps $0x10,(%r9,%rax,1),%xmm2
+ .byte 243,67,15,16,28,153 // movss (%r9,%r11,4),%xmm3
.byte 102,15,58,33,211,32 // insertps $0x20,%xmm3,%xmm2
- .byte 243,65,15,16,28,24 // movss (%r8,%rbx,1),%xmm3
+ .byte 243,65,15,16,28,25 // movss (%r9,%rbx,1),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 102,65,15,114,208,24 // psrld $0x18,%xmm8
.byte 65,15,91,216 // cvtdq2ps %xmm8,%xmm3
- .byte 15,89,29,42,52,0,0 // mulps 0x342a(%rip),%xmm3 # 55f0 <_sk_callback_sse41+0x65d>
+ .byte 15,89,29,102,52,0,0 // mulps 0x3466(%rip),%xmm3 # 5640 <_sk_callback_sse41+0x66c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 65,137,201 // mov %ecx,%r9d
- .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 69,137,194 // mov %r8d,%r10d
+ .byte 65,128,226,3 // and $0x3,%r10b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,38 // je 2205 <_sk_load_tables_sse41+0x15a>
- .byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,23 // je 21fc <_sk_load_tables_sse41+0x151>
- .byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 15,133,208,254,255,255 // jne 20bf <_sk_load_tables_sse41+0x14>
- .byte 102,65,15,110,68,184,8 // movd 0x8(%r8,%rdi,4),%xmm0
+ .byte 65,128,250,1 // cmp $0x1,%r10b
+ .byte 116,38 // je 221b <_sk_load_tables_sse41+0x15e>
+ .byte 65,128,250,2 // cmp $0x2,%r10b
+ .byte 116,23 // je 2212 <_sk_load_tables_sse41+0x155>
+ .byte 65,128,250,3 // cmp $0x3,%r10b
+ .byte 15,133,204,254,255,255 // jne 20d1 <_sk_load_tables_sse41+0x14>
+ .byte 102,65,15,110,68,145,8 // movd 0x8(%r9,%rdx,4),%xmm0
.byte 102,68,15,112,192,69 // pshufd $0x45,%xmm0,%xmm8
- .byte 102,69,15,58,34,68,184,4,1 // pinsrd $0x1,0x4(%r8,%rdi,4),%xmm8
- .byte 102,69,15,58,34,4,184,0 // pinsrd $0x0,(%r8,%rdi,4),%xmm8
- .byte 233,173,254,255,255 // jmpq 20bf <_sk_load_tables_sse41+0x14>
+ .byte 102,69,15,58,34,68,145,4,1 // pinsrd $0x1,0x4(%r9,%rdx,4),%xmm8
+ .byte 102,69,15,58,34,4,145,0 // pinsrd $0x0,(%r9,%rdx,4),%xmm8
+ .byte 233,169,254,255,255 // jmpq 20d1 <_sk_load_tables_sse41+0x14>
HIDDEN _sk_load_tables_u16_be_sse41
.globl _sk_load_tables_u16_be_sse41
FUNCTION(_sk_load_tables_u16_be_sse41)
_sk_load_tables_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,95,1,0,0 // jne 2387 <_sk_load_tables_u16_be_sse41+0x175>
- .byte 102,67,15,16,4,72 // movupd (%r8,%r9,2),%xmm0
- .byte 243,67,15,111,76,72,16 // movdqu 0x10(%r8,%r9,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,99,1,0,0 // jne 23a1 <_sk_load_tables_u16_be_sse41+0x179>
+ .byte 102,67,15,16,4,81 // movupd (%r9,%r10,2),%xmm0
+ .byte 243,67,15,111,76,81,16 // movdqu 0x10(%r9,%r10,2),%xmm1
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 102,68,15,40,200 // movapd %xmm0,%xmm9
@@ -24191,52 +24263,52 @@ _sk_load_tables_u16_be_sse41:
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,97,200 // punpcklwd %xmm0,%xmm1
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
- .byte 102,68,15,111,5,163,51,0,0 // movdqa 0x33a3(%rip),%xmm8 # 5600 <_sk_callback_sse41+0x66d>
+ .byte 102,68,15,111,5,219,51,0,0 // movdqa 0x33db(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x67c>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
- .byte 102,73,15,58,22,192,1 // pextrq $0x1,%xmm0,%r8
- .byte 102,73,15,126,193 // movq %xmm0,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 102,73,15,126,194 // movq %xmm0,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 69,15,182,241 // movzbl %r9b,%r14d
.byte 73,193,233,30 // shr $0x1e,%r9
- .byte 69,15,182,216 // movzbl %r8b,%r11d
- .byte 73,193,232,30 // shr $0x1e,%r8
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,4,147 // movss (%rbx,%r10,4),%xmm0
- .byte 102,66,15,58,33,4,11,16 // insertps $0x10,(%rbx,%r9,1),%xmm0
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
+ .byte 102,66,15,58,33,4,19,16 // insertps $0x10,(%rbx,%r10,1),%xmm0
+ .byte 243,66,15,16,20,179 // movss (%rbx,%r14,4),%xmm2
.byte 102,15,58,33,194,32 // insertps $0x20,%xmm2,%xmm0
- .byte 243,66,15,16,20,3 // movss (%rbx,%r8,1),%xmm2
+ .byte 243,66,15,16,20,11 // movss (%rbx,%r9,1),%xmm2
.byte 102,15,58,33,194,48 // insertps $0x30,%xmm2,%xmm0
- .byte 102,15,56,0,13,82,51,0,0 // pshufb 0x3352(%rip),%xmm1 # 5610 <_sk_callback_sse41+0x67d>
+ .byte 102,15,56,0,13,138,51,0,0 // pshufb 0x338a(%rip),%xmm1 # 5660 <_sk_callback_sse41+0x68c>
.byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1
- .byte 102,73,15,58,22,200,1 // pextrq $0x1,%xmm1,%r8
+ .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 68,15,182,203 // movzbl %bl,%r9d
+ .byte 68,15,182,211 // movzbl %bl,%r10d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,15,182,208 // movzbl %r8b,%r10d
- .byte 73,193,232,30 // shr $0x1e,%r8
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
- .byte 102,65,15,58,33,12,30,16 // insertps $0x10,(%r14,%rbx,1),%xmm1
- .byte 243,67,15,16,20,150 // movss (%r14,%r10,4),%xmm2
+ .byte 69,15,182,217 // movzbl %r9b,%r11d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 243,67,15,16,12,151 // movss (%r15,%r10,4),%xmm1
+ .byte 102,65,15,58,33,12,31,16 // insertps $0x10,(%r15,%rbx,1),%xmm1
+ .byte 243,67,15,16,20,159 // movss (%r15,%r11,4),%xmm2
.byte 102,15,58,33,202,32 // insertps $0x20,%xmm2,%xmm1
- .byte 243,67,15,16,20,6 // movss (%r14,%r8,1),%xmm2
+ .byte 243,67,15,16,20,15 // movss (%r15,%r9,1),%xmm2
.byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1
- .byte 76,139,64,24 // mov 0x18(%rax),%r8
+ .byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 102,69,15,219,193 // pand %xmm9,%xmm8
.byte 102,65,15,56,51,208 // pmovzxwd %xmm8,%xmm2
.byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 68,15,182,200 // movzbl %al,%r9d
+ .byte 68,15,182,208 // movzbl %al,%r10d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 68,15,182,211 // movzbl %bl,%r10d
+ .byte 68,15,182,219 // movzbl %bl,%r11d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 243,67,15,16,20,136 // movss (%r8,%r9,4),%xmm2
- .byte 102,65,15,58,33,20,0,16 // insertps $0x10,(%r8,%rax,1),%xmm2
- .byte 243,67,15,16,28,144 // movss (%r8,%r10,4),%xmm3
+ .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
+ .byte 102,65,15,58,33,20,1,16 // insertps $0x10,(%r9,%rax,1),%xmm2
+ .byte 243,67,15,16,28,153 // movss (%r9,%r11,4),%xmm3
.byte 102,15,58,33,211,32 // insertps $0x20,%xmm3,%xmm2
- .byte 243,65,15,16,28,24 // movss (%r8,%rbx,1),%xmm3
+ .byte 243,65,15,16,28,25 // movss (%r9,%rbx,1),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 102,65,15,112,217,78 // pshufd $0x4e,%xmm9,%xmm3
.byte 102,68,15,111,195 // movdqa %xmm3,%xmm8
@@ -24245,118 +24317,121 @@ _sk_load_tables_u16_be_sse41:
.byte 102,65,15,235,216 // por %xmm8,%xmm3
.byte 102,15,56,51,219 // pmovzxwd %xmm3,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,160,50,0,0 // mulps 0x32a0(%rip),%xmm3 # 5620 <_sk_callback_sse41+0x68d>
+ .byte 15,89,29,216,50,0,0 // mulps 0x32d8(%rip),%xmm3 # 5670 <_sk_callback_sse41+0x69c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 242,67,15,16,4,72 // movsd (%r8,%r9,2),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,13 // jne 23a0 <_sk_load_tables_u16_be_sse41+0x18e>
+ .byte 242,67,15,16,4,81 // movsd (%r9,%r10,2),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,13 // jne 23ba <_sk_load_tables_u16_be_sse41+0x192>
.byte 243,15,126,192 // movq %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,149,254,255,255 // jmpq 2235 <_sk_load_tables_u16_be_sse41+0x23>
- .byte 102,67,15,22,68,72,8 // movhpd 0x8(%r8,%r9,2),%xmm0
+ .byte 233,145,254,255,255 // jmpq 224b <_sk_load_tables_u16_be_sse41+0x23>
+ .byte 102,67,15,22,68,81,8 // movhpd 0x8(%r9,%r10,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,128,254,255,255 // jb 2235 <_sk_load_tables_u16_be_sse41+0x23>
- .byte 243,67,15,126,76,72,16 // movq 0x10(%r8,%r9,2),%xmm1
- .byte 233,116,254,255,255 // jmpq 2235 <_sk_load_tables_u16_be_sse41+0x23>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,124,254,255,255 // jb 224b <_sk_load_tables_u16_be_sse41+0x23>
+ .byte 243,67,15,126,76,81,16 // movq 0x10(%r9,%r10,2),%xmm1
+ .byte 233,112,254,255,255 // jmpq 224b <_sk_load_tables_u16_be_sse41+0x23>
HIDDEN _sk_load_tables_rgb_u16_be_sse41
.globl _sk_load_tables_rgb_u16_be_sse41
FUNCTION(_sk_load_tables_rgb_u16_be_sse41)
_sk_load_tables_rgb_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,127 // lea (%rdi,%rdi,2),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,79,1,0,0 // jne 2522 <_sk_load_tables_rgb_u16_be_sse41+0x161>
- .byte 243,67,15,111,20,72 // movdqu (%r8,%r9,2),%xmm2
- .byte 243,67,15,111,76,72,8 // movdqu 0x8(%r8,%r9,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,83,1,0,0 // jne 2540 <_sk_load_tables_rgb_u16_be_sse41+0x165>
+ .byte 243,67,15,111,20,81 // movdqu (%r9,%r10,2),%xmm2
+ .byte 243,67,15,111,76,81,8 // movdqu 0x8(%r9,%r10,2),%xmm1
.byte 102,15,115,217,4 // psrldq $0x4,%xmm1
.byte 102,68,15,111,202 // movdqa %xmm2,%xmm9
.byte 102,65,15,115,217,6 // psrldq $0x6,%xmm9
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,115,216,6 // psrldq $0x6,%xmm0
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 102,15,97,209 // punpcklwd %xmm1,%xmm2
.byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9
.byte 102,15,111,202 // movdqa %xmm2,%xmm1
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
- .byte 102,68,15,111,5,25,50,0,0 // movdqa 0x3219(%rip),%xmm8 # 5630 <_sk_callback_sse41+0x69d>
+ .byte 102,68,15,111,5,77,50,0,0 // movdqa 0x324d(%rip),%xmm8 # 5680 <_sk_callback_sse41+0x6ac>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
- .byte 102,73,15,58,22,192,1 // pextrq $0x1,%xmm0,%r8
- .byte 102,73,15,126,193 // movq %xmm0,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 102,73,15,126,194 // movq %xmm0,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 69,15,182,241 // movzbl %r9b,%r14d
.byte 73,193,233,30 // shr $0x1e,%r9
- .byte 69,15,182,216 // movzbl %r8b,%r11d
- .byte 73,193,232,30 // shr $0x1e,%r8
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,4,147 // movss (%rbx,%r10,4),%xmm0
- .byte 102,66,15,58,33,4,11,16 // insertps $0x10,(%rbx,%r9,1),%xmm0
- .byte 243,66,15,16,28,155 // movss (%rbx,%r11,4),%xmm3
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
+ .byte 102,66,15,58,33,4,19,16 // insertps $0x10,(%rbx,%r10,1),%xmm0
+ .byte 243,66,15,16,28,179 // movss (%rbx,%r14,4),%xmm3
.byte 102,15,58,33,195,32 // insertps $0x20,%xmm3,%xmm0
- .byte 243,66,15,16,28,3 // movss (%rbx,%r8,1),%xmm3
+ .byte 243,66,15,16,28,11 // movss (%rbx,%r9,1),%xmm3
.byte 102,15,58,33,195,48 // insertps $0x30,%xmm3,%xmm0
- .byte 102,15,56,0,13,200,49,0,0 // pshufb 0x31c8(%rip),%xmm1 # 5640 <_sk_callback_sse41+0x6ad>
+ .byte 102,15,56,0,13,252,49,0,0 // pshufb 0x31fc(%rip),%xmm1 # 5690 <_sk_callback_sse41+0x6bc>
.byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1
- .byte 102,73,15,58,22,200,1 // pextrq $0x1,%xmm1,%r8
+ .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 68,15,182,203 // movzbl %bl,%r9d
+ .byte 68,15,182,211 // movzbl %bl,%r10d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,15,182,208 // movzbl %r8b,%r10d
- .byte 73,193,232,30 // shr $0x1e,%r8
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
- .byte 102,65,15,58,33,12,30,16 // insertps $0x10,(%r14,%rbx,1),%xmm1
- .byte 243,67,15,16,28,150 // movss (%r14,%r10,4),%xmm3
+ .byte 69,15,182,217 // movzbl %r9b,%r11d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 243,67,15,16,12,151 // movss (%r15,%r10,4),%xmm1
+ .byte 102,65,15,58,33,12,31,16 // insertps $0x10,(%r15,%rbx,1),%xmm1
+ .byte 243,67,15,16,28,159 // movss (%r15,%r11,4),%xmm3
.byte 102,15,58,33,203,32 // insertps $0x20,%xmm3,%xmm1
- .byte 243,67,15,16,28,6 // movss (%r14,%r8,1),%xmm3
+ .byte 243,67,15,16,28,15 // movss (%r15,%r9,1),%xmm3
.byte 102,15,58,33,203,48 // insertps $0x30,%xmm3,%xmm1
- .byte 76,139,64,24 // mov 0x18(%rax),%r8
+ .byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 102,65,15,105,209 // punpckhwd %xmm9,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,56,51,210 // pmovzxwd %xmm2,%xmm2
.byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 68,15,182,200 // movzbl %al,%r9d
+ .byte 68,15,182,208 // movzbl %al,%r10d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 68,15,182,211 // movzbl %bl,%r10d
+ .byte 68,15,182,219 // movzbl %bl,%r11d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 243,67,15,16,20,136 // movss (%r8,%r9,4),%xmm2
- .byte 102,65,15,58,33,20,0,16 // insertps $0x10,(%r8,%rax,1),%xmm2
- .byte 243,67,15,16,28,144 // movss (%r8,%r10,4),%xmm3
+ .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
+ .byte 102,65,15,58,33,20,1,16 // insertps $0x10,(%r9,%rax,1),%xmm2
+ .byte 243,67,15,16,28,153 // movss (%r9,%r11,4),%xmm3
.byte 102,15,58,33,211,32 // insertps $0x20,%xmm3,%xmm2
- .byte 243,65,15,16,28,24 // movss (%r8,%rbx,1),%xmm3
+ .byte 243,65,15,16,28,25 // movss (%r9,%rbx,1),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,51,49,0,0 // movaps 0x3133(%rip),%xmm3 # 5650 <_sk_callback_sse41+0x6bd>
+ .byte 15,40,29,103,49,0,0 // movaps 0x3167(%rip),%xmm3 # 56a0 <_sk_callback_sse41+0x6cc>
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 102,67,15,110,20,72 // movd (%r8,%r9,2),%xmm2
- .byte 102,67,15,196,84,72,4,2 // pinsrw $0x2,0x4(%r8,%r9,2),%xmm2
+ .byte 102,67,15,110,20,81 // movd (%r9,%r10,2),%xmm2
+ .byte 102,67,15,196,84,81,4,2 // pinsrw $0x2,0x4(%r9,%r10,2),%xmm2
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,14 // jne 2548 <_sk_load_tables_rgb_u16_be_sse41+0x187>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,14 // jne 2566 <_sk_load_tables_rgb_u16_be_sse41+0x18b>
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
- .byte 233,177,254,255,255 // jmpq 23f9 <_sk_load_tables_rgb_u16_be_sse41+0x38>
- .byte 102,71,15,110,76,72,6 // movd 0x6(%r8,%r9,2),%xmm9
- .byte 102,71,15,196,76,72,10,2 // pinsrw $0x2,0xa(%r8,%r9,2),%xmm9
+ .byte 233,173,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ .byte 102,71,15,110,76,81,6 // movd 0x6(%r9,%r10,2),%xmm9
+ .byte 102,71,15,196,76,81,10,2 // pinsrw $0x2,0xa(%r9,%r10,2),%xmm9
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,24 // jb 2579 <_sk_load_tables_rgb_u16_be_sse41+0x1b8>
- .byte 102,67,15,110,76,72,12 // movd 0xc(%r8,%r9,2),%xmm1
- .byte 102,67,15,196,76,72,16,2 // pinsrw $0x2,0x10(%r8,%r9,2),%xmm1
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,24 // jb 2597 <_sk_load_tables_rgb_u16_be_sse41+0x1bc>
+ .byte 102,67,15,110,76,81,12 // movd 0xc(%r9,%r10,2),%xmm1
+ .byte 102,67,15,196,76,81,16,2 // pinsrw $0x2,0x10(%r9,%r10,2),%xmm1
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,128,254,255,255 // jmpq 23f9 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ .byte 233,124,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38>
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,119,254,255,255 // jmpq 23f9 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ .byte 233,115,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38>
HIDDEN _sk_byte_tables_sse41
.globl _sk_byte_tables_sse41
@@ -24364,84 +24439,86 @@ FUNCTION(_sk_byte_tables_sse41)
_sk_byte_tables_sse41:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,207,48,0,0 // movaps 0x30cf(%rip),%xmm8 # 5660 <_sk_callback_sse41+0x6cd>
+ .byte 68,15,40,5,255,48,0,0 // movaps 0x30ff(%rip),%xmm8 # 56b0 <_sk_callback_sse41+0x6dc>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
- .byte 102,73,15,58,22,192,1 // pextrq $0x1,%xmm0,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 76,139,56 // mov (%rax),%r15
- .byte 76,139,112,8 // mov 0x8(%rax),%r14
- .byte 102,67,15,58,32,4,31,0 // pinsrb $0x0,(%r15,%r11,1),%xmm0
- .byte 102,67,15,58,32,4,23,1 // pinsrb $0x1,(%r15,%r10,1),%xmm0
- .byte 67,15,182,28,15 // movzbl (%r15,%r9,1),%ebx
+ .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 76,139,32 // mov (%rax),%r12
+ .byte 76,139,120,8 // mov 0x8(%rax),%r15
+ .byte 102,67,15,58,32,4,52,0 // pinsrb $0x0,(%r12,%r14,1),%xmm0
+ .byte 102,67,15,58,32,4,28,1 // pinsrb $0x1,(%r12,%r11,1),%xmm0
+ .byte 67,15,182,28,20 // movzbl (%r12,%r10,1),%ebx
.byte 102,15,58,32,195,2 // pinsrb $0x2,%ebx,%xmm0
- .byte 67,15,182,28,7 // movzbl (%r15,%r8,1),%ebx
+ .byte 67,15,182,28,12 // movzbl (%r12,%r9,1),%ebx
.byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,13,128,48,0,0 // movaps 0x3080(%rip),%xmm9 # 5670 <_sk_callback_sse41+0x6dd>
+ .byte 68,15,40,13,176,48,0,0 // movaps 0x30b0(%rip),%xmm9 # 56c0 <_sk_callback_sse41+0x6ec>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,72,15,58,22,203,1 // pextrq $0x1,%xmm1,%rbx
- .byte 65,137,216 // mov %ebx,%r8d
+ .byte 65,137,217 // mov %ebx,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,73,15,126,201 // movq %xmm1,%r9
- .byte 69,137,202 // mov %r9d,%r10d
- .byte 73,193,233,32 // shr $0x20,%r9
- .byte 102,67,15,58,32,12,22,0 // pinsrb $0x0,(%r14,%r10,1),%xmm1
- .byte 102,67,15,58,32,12,14,1 // pinsrb $0x1,(%r14,%r9,1),%xmm1
- .byte 71,15,182,4,6 // movzbl (%r14,%r8,1),%r8d
- .byte 102,65,15,58,32,200,2 // pinsrb $0x2,%r8d,%xmm1
- .byte 65,15,182,28,30 // movzbl (%r14,%rbx,1),%ebx
+ .byte 102,73,15,126,202 // movq %xmm1,%r10
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 102,67,15,58,32,12,31,0 // pinsrb $0x0,(%r15,%r11,1),%xmm1
+ .byte 102,67,15,58,32,12,23,1 // pinsrb $0x1,(%r15,%r10,1),%xmm1
+ .byte 71,15,182,12,15 // movzbl (%r15,%r9,1),%r9d
+ .byte 102,65,15,58,32,201,2 // pinsrb $0x2,%r9d,%xmm1
+ .byte 65,15,182,28,31 // movzbl (%r15,%rbx,1),%ebx
.byte 102,15,58,32,203,3 // pinsrb $0x3,%ebx,%xmm1
.byte 102,15,56,49,201 // pmovzxbd %xmm1,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,201 // mulps %xmm9,%xmm1
- .byte 76,139,80,16 // mov 0x10(%rax),%r10
+ .byte 76,139,88,16 // mov 0x10(%rax),%r11
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,91,210 // cvtps2dq %xmm2,%xmm2
- .byte 102,73,15,58,22,208,1 // pextrq $0x1,%xmm2,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
+ .byte 102,73,15,58,22,209,1 // pextrq $0x1,%xmm2,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 65,137,219 // mov %ebx,%r11d
+ .byte 65,137,222 // mov %ebx,%r14d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,67,15,58,32,20,26,0 // pinsrb $0x0,(%r10,%r11,1),%xmm2
- .byte 102,65,15,58,32,20,26,1 // pinsrb $0x1,(%r10,%rbx,1),%xmm2
- .byte 67,15,182,28,10 // movzbl (%r10,%r9,1),%ebx
+ .byte 102,67,15,58,32,20,51,0 // pinsrb $0x0,(%r11,%r14,1),%xmm2
+ .byte 102,65,15,58,32,20,27,1 // pinsrb $0x1,(%r11,%rbx,1),%xmm2
+ .byte 67,15,182,28,19 // movzbl (%r11,%r10,1),%ebx
.byte 102,15,58,32,211,2 // pinsrb $0x2,%ebx,%xmm2
- .byte 67,15,182,28,2 // movzbl (%r10,%r8,1),%ebx
+ .byte 67,15,182,28,11 // movzbl (%r11,%r9,1),%ebx
.byte 102,15,58,32,211,3 // pinsrb $0x3,%ebx,%xmm2
.byte 102,15,56,49,210 // pmovzxbd %xmm2,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
- .byte 76,139,72,24 // mov 0x18(%rax),%r9
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 102,15,91,219 // cvtps2dq %xmm3,%xmm3
.byte 102,72,15,58,22,219,1 // pextrq $0x1,%xmm3,%rbx
- .byte 65,137,216 // mov %ebx,%r8d
+ .byte 65,137,217 // mov %ebx,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
.byte 102,72,15,126,216 // movq %xmm3,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,67,15,58,32,28,17,0 // pinsrb $0x0,(%r9,%r10,1),%xmm3
- .byte 102,65,15,58,32,28,1,1 // pinsrb $0x1,(%r9,%rax,1),%xmm3
- .byte 67,15,182,4,1 // movzbl (%r9,%r8,1),%eax
+ .byte 102,67,15,58,32,28,26,0 // pinsrb $0x0,(%r10,%r11,1),%xmm3
+ .byte 102,65,15,58,32,28,2,1 // pinsrb $0x1,(%r10,%rax,1),%xmm3
+ .byte 67,15,182,4,10 // movzbl (%r10,%r9,1),%eax
.byte 102,15,58,32,216,2 // pinsrb $0x2,%eax,%xmm3
- .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax
+ .byte 65,15,182,4,26 // movzbl (%r10,%rbx,1),%eax
.byte 102,15,58,32,216,3 // pinsrb $0x3,%eax,%xmm3
.byte 102,15,56,49,219 // pmovzxbd %xmm3,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
.byte 65,15,89,217 // mulps %xmm9,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
+ .byte 65,92 // pop %r12
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -24452,72 +24529,74 @@ FUNCTION(_sk_byte_tables_rgb_sse41)
_sk_byte_tables_rgb_sse41:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
+ .byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,139,64,24 // mov 0x18(%rax),%r8d
- .byte 65,255,200 // dec %r8d
- .byte 102,69,15,110,192 // movd %r8d,%xmm8
+ .byte 68,139,72,24 // mov 0x18(%rax),%r9d
+ .byte 65,255,201 // dec %r9d
+ .byte 102,69,15,110,193 // movd %r9d,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
- .byte 102,73,15,58,22,192,1 // pextrq $0x1,%xmm0,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 77,137,194 // mov %r8,%r10
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,73,15,126,192 // movq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,198 // mov %r8,%r14
- .byte 73,193,238,32 // shr $0x20,%r14
- .byte 76,139,56 // mov (%rax),%r15
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 102,67,15,58,32,4,31,0 // pinsrb $0x0,(%r15,%r11,1),%xmm0
- .byte 102,67,15,58,32,4,55,1 // pinsrb $0x1,(%r15,%r14,1),%xmm0
- .byte 67,15,182,28,15 // movzbl (%r15,%r9,1),%ebx
+ .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 77,137,203 // mov %r9,%r11
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,73,15,126,193 // movq %xmm0,%r9
+ .byte 69,137,206 // mov %r9d,%r14d
+ .byte 77,137,207 // mov %r9,%r15
+ .byte 73,193,239,32 // shr $0x20,%r15
+ .byte 76,139,32 // mov (%rax),%r12
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 102,67,15,58,32,4,52,0 // pinsrb $0x0,(%r12,%r14,1),%xmm0
+ .byte 102,67,15,58,32,4,60,1 // pinsrb $0x1,(%r12,%r15,1),%xmm0
+ .byte 67,15,182,28,20 // movzbl (%r12,%r10,1),%ebx
.byte 102,15,58,32,195,2 // pinsrb $0x2,%ebx,%xmm0
- .byte 67,15,182,28,23 // movzbl (%r15,%r10,1),%ebx
+ .byte 67,15,182,28,28 // movzbl (%r12,%r11,1),%ebx
.byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,13,252,46,0,0 // movaps 0x2efc(%rip),%xmm9 # 5680 <_sk_callback_sse41+0x6ed>
+ .byte 68,15,40,13,40,47,0,0 // movaps 0x2f28(%rip),%xmm9 # 56d0 <_sk_callback_sse41+0x6fc>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,72,15,58,22,203,1 // pextrq $0x1,%xmm1,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
+ .byte 65,137,218 // mov %ebx,%r10d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,73,15,126,202 // movq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,58,32,12,24,0 // pinsrb $0x0,(%r8,%r11,1),%xmm1
- .byte 102,67,15,58,32,12,16,1 // pinsrb $0x1,(%r8,%r10,1),%xmm1
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 102,65,15,58,32,201,2 // pinsrb $0x2,%r9d,%xmm1
- .byte 65,15,182,28,24 // movzbl (%r8,%rbx,1),%ebx
+ .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,67,15,58,32,12,49,0 // pinsrb $0x0,(%r9,%r14,1),%xmm1
+ .byte 102,67,15,58,32,12,25,1 // pinsrb $0x1,(%r9,%r11,1),%xmm1
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 102,65,15,58,32,202,2 // pinsrb $0x2,%r10d,%xmm1
+ .byte 65,15,182,28,25 // movzbl (%r9,%rbx,1),%ebx
.byte 102,15,58,32,203,3 // pinsrb $0x3,%ebx,%xmm1
.byte 102,15,56,49,201 // pmovzxbd %xmm1,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,201 // mulps %xmm9,%xmm1
- .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,91,210 // cvtps2dq %xmm2,%xmm2
.byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx
- .byte 65,137,216 // mov %ebx,%r8d
+ .byte 65,137,217 // mov %ebx,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,67,15,58,32,20,17,0 // pinsrb $0x0,(%r9,%r10,1),%xmm2
- .byte 102,65,15,58,32,20,1,1 // pinsrb $0x1,(%r9,%rax,1),%xmm2
- .byte 67,15,182,4,1 // movzbl (%r9,%r8,1),%eax
+ .byte 102,67,15,58,32,20,26,0 // pinsrb $0x0,(%r10,%r11,1),%xmm2
+ .byte 102,65,15,58,32,20,2,1 // pinsrb $0x1,(%r10,%rax,1),%xmm2
+ .byte 67,15,182,4,10 // movzbl (%r10,%r9,1),%eax
.byte 102,15,58,32,208,2 // pinsrb $0x2,%eax,%xmm2
- .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax
+ .byte 65,15,182,4,26 // movzbl (%r10,%rbx,1),%eax
.byte 102,15,58,32,208,3 // pinsrb $0x3,%eax,%xmm2
.byte 102,15,56,49,210 // pmovzxbd %xmm2,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
+ .byte 65,92 // pop %r12
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
@@ -24526,8 +24605,9 @@ HIDDEN _sk_table_r_sse41
.globl _sk_table_r_sse41
FUNCTION(_sk_table_r_sse41)
_sk_table_r_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -24536,26 +24616,28 @@ _sk_table_r_sse41:
.byte 68,15,89,192 // mulps %xmm0,%xmm8
.byte 102,65,15,91,192 // cvtps2dq %xmm8,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,16,4,152 // movss (%r8,%r11,4),%xmm0
- .byte 102,67,15,58,33,4,144,16 // insertps $0x10,(%r8,%r10,4),%xmm0
- .byte 243,71,15,16,4,136 // movss (%r8,%r9,4),%xmm8
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,65,15,16,4,153 // movss (%r9,%rbx,4),%xmm0
+ .byte 102,67,15,58,33,4,153,16 // insertps $0x10,(%r9,%r11,4),%xmm0
+ .byte 243,71,15,16,4,145 // movss (%r9,%r10,4),%xmm8
.byte 102,65,15,58,33,192,32 // insertps $0x20,%xmm8,%xmm0
- .byte 243,69,15,16,4,128 // movss (%r8,%rax,4),%xmm8
+ .byte 243,69,15,16,4,129 // movss (%r9,%rax,4),%xmm8
.byte 102,65,15,58,33,192,48 // insertps $0x30,%xmm8,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_g_sse41
.globl _sk_table_g_sse41
FUNCTION(_sk_table_g_sse41)
_sk_table_g_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -24564,26 +24646,28 @@ _sk_table_g_sse41:
.byte 68,15,89,193 // mulps %xmm1,%xmm8
.byte 102,65,15,91,200 // cvtps2dq %xmm8,%xmm1
.byte 102,72,15,58,22,200,1 // pextrq $0x1,%xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,202 // movq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,16,12,152 // movss (%r8,%r11,4),%xmm1
- .byte 102,67,15,58,33,12,144,16 // insertps $0x10,(%r8,%r10,4),%xmm1
- .byte 243,71,15,16,4,136 // movss (%r8,%r9,4),%xmm8
+ .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,65,15,16,12,153 // movss (%r9,%rbx,4),%xmm1
+ .byte 102,67,15,58,33,12,153,16 // insertps $0x10,(%r9,%r11,4),%xmm1
+ .byte 243,71,15,16,4,145 // movss (%r9,%r10,4),%xmm8
.byte 102,65,15,58,33,200,32 // insertps $0x20,%xmm8,%xmm1
- .byte 243,69,15,16,4,128 // movss (%r8,%rax,4),%xmm8
+ .byte 243,69,15,16,4,129 // movss (%r9,%rax,4),%xmm8
.byte 102,65,15,58,33,200,48 // insertps $0x30,%xmm8,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_b_sse41
.globl _sk_table_b_sse41
FUNCTION(_sk_table_b_sse41)
_sk_table_b_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -24592,26 +24676,28 @@ _sk_table_b_sse41:
.byte 68,15,89,194 // mulps %xmm2,%xmm8
.byte 102,65,15,91,208 // cvtps2dq %xmm8,%xmm2
.byte 102,72,15,58,22,208,1 // pextrq $0x1,%xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,210 // movq %xmm2,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,16,20,152 // movss (%r8,%r11,4),%xmm2
- .byte 102,67,15,58,33,20,144,16 // insertps $0x10,(%r8,%r10,4),%xmm2
- .byte 243,71,15,16,4,136 // movss (%r8,%r9,4),%xmm8
+ .byte 102,73,15,126,211 // movq %xmm2,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,65,15,16,20,153 // movss (%r9,%rbx,4),%xmm2
+ .byte 102,67,15,58,33,20,153,16 // insertps $0x10,(%r9,%r11,4),%xmm2
+ .byte 243,71,15,16,4,145 // movss (%r9,%r10,4),%xmm8
.byte 102,65,15,58,33,208,32 // insertps $0x20,%xmm8,%xmm2
- .byte 243,69,15,16,4,128 // movss (%r8,%rax,4),%xmm8
+ .byte 243,69,15,16,4,129 // movss (%r9,%rax,4),%xmm8
.byte 102,65,15,58,33,208,48 // insertps $0x30,%xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_a_sse41
.globl _sk_table_a_sse41
FUNCTION(_sk_table_a_sse41)
_sk_table_a_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -24620,18 +24706,19 @@ _sk_table_a_sse41:
.byte 68,15,89,195 // mulps %xmm3,%xmm8
.byte 102,65,15,91,216 // cvtps2dq %xmm8,%xmm3
.byte 102,72,15,58,22,216,1 // pextrq $0x1,%xmm3,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,218 // movq %xmm3,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,16,28,152 // movss (%r8,%r11,4),%xmm3
- .byte 102,67,15,58,33,28,144,16 // insertps $0x10,(%r8,%r10,4),%xmm3
- .byte 243,71,15,16,4,136 // movss (%r8,%r9,4),%xmm8
+ .byte 102,73,15,126,219 // movq %xmm3,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,65,15,16,28,153 // movss (%r9,%rbx,4),%xmm3
+ .byte 102,67,15,58,33,28,153,16 // insertps $0x10,(%r9,%r11,4),%xmm3
+ .byte 243,71,15,16,4,145 // movss (%r9,%r10,4),%xmm8
.byte 102,65,15,58,33,216,32 // insertps $0x20,%xmm8,%xmm3
- .byte 243,69,15,16,4,128 // movss (%r8,%rax,4),%xmm8
+ .byte 243,69,15,16,4,129 // movss (%r9,%rax,4),%xmm8
.byte 102,65,15,58,33,216,48 // insertps $0x30,%xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_parametric_r_sse41
@@ -24657,31 +24744,31 @@ _sk_parametric_r_sse41:
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,194 // cvtdq2ps %xmm10,%xmm8
- .byte 68,15,89,5,78,44,0,0 // mulps 0x2c4e(%rip),%xmm8 # 5690 <_sk_callback_sse41+0x6fd>
- .byte 68,15,84,21,86,44,0,0 // andps 0x2c56(%rip),%xmm10 # 56a0 <_sk_callback_sse41+0x70d>
- .byte 68,15,86,21,94,44,0,0 // orps 0x2c5e(%rip),%xmm10 # 56b0 <_sk_callback_sse41+0x71d>
- .byte 68,15,88,5,102,44,0,0 // addps 0x2c66(%rip),%xmm8 # 56c0 <_sk_callback_sse41+0x72d>
- .byte 68,15,40,37,110,44,0,0 // movaps 0x2c6e(%rip),%xmm12 # 56d0 <_sk_callback_sse41+0x73d>
+ .byte 68,15,89,5,112,44,0,0 // mulps 0x2c70(%rip),%xmm8 # 56e0 <_sk_callback_sse41+0x70c>
+ .byte 68,15,84,21,120,44,0,0 // andps 0x2c78(%rip),%xmm10 # 56f0 <_sk_callback_sse41+0x71c>
+ .byte 68,15,86,21,128,44,0,0 // orps 0x2c80(%rip),%xmm10 # 5700 <_sk_callback_sse41+0x72c>
+ .byte 68,15,88,5,136,44,0,0 // addps 0x2c88(%rip),%xmm8 # 5710 <_sk_callback_sse41+0x73c>
+ .byte 68,15,40,37,144,44,0,0 // movaps 0x2c90(%rip),%xmm12 # 5720 <_sk_callback_sse41+0x74c>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,196 // subps %xmm12,%xmm8
- .byte 68,15,88,21,110,44,0,0 // addps 0x2c6e(%rip),%xmm10 # 56e0 <_sk_callback_sse41+0x74d>
- .byte 68,15,40,37,118,44,0,0 // movaps 0x2c76(%rip),%xmm12 # 56f0 <_sk_callback_sse41+0x75d>
+ .byte 68,15,88,21,144,44,0,0 // addps 0x2c90(%rip),%xmm10 # 5730 <_sk_callback_sse41+0x75c>
+ .byte 68,15,40,37,152,44,0,0 // movaps 0x2c98(%rip),%xmm12 # 5740 <_sk_callback_sse41+0x76c>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,196 // subps %xmm12,%xmm8
.byte 69,15,89,195 // mulps %xmm11,%xmm8
.byte 102,69,15,58,8,208,1 // roundps $0x1,%xmm8,%xmm10
.byte 69,15,40,216 // movaps %xmm8,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,5,99,44,0,0 // addps 0x2c63(%rip),%xmm8 # 5700 <_sk_callback_sse41+0x76d>
- .byte 68,15,40,21,107,44,0,0 // movaps 0x2c6b(%rip),%xmm10 # 5710 <_sk_callback_sse41+0x77d>
+ .byte 68,15,88,5,133,44,0,0 // addps 0x2c85(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x77c>
+ .byte 68,15,40,21,141,44,0,0 // movaps 0x2c8d(%rip),%xmm10 # 5760 <_sk_callback_sse41+0x78c>
.byte 69,15,89,211 // mulps %xmm11,%xmm10
.byte 69,15,92,194 // subps %xmm10,%xmm8
- .byte 68,15,40,21,107,44,0,0 // movaps 0x2c6b(%rip),%xmm10 # 5720 <_sk_callback_sse41+0x78d>
+ .byte 68,15,40,21,141,44,0,0 // movaps 0x2c8d(%rip),%xmm10 # 5770 <_sk_callback_sse41+0x79c>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 68,15,40,29,111,44,0,0 // movaps 0x2c6f(%rip),%xmm11 # 5730 <_sk_callback_sse41+0x79d>
+ .byte 68,15,40,29,145,44,0,0 // movaps 0x2c91(%rip),%xmm11 # 5780 <_sk_callback_sse41+0x7ac>
.byte 69,15,94,218 // divps %xmm10,%xmm11
.byte 69,15,88,216 // addps %xmm8,%xmm11
- .byte 68,15,89,29,111,44,0,0 // mulps 0x2c6f(%rip),%xmm11 # 5740 <_sk_callback_sse41+0x7ad>
+ .byte 68,15,89,29,145,44,0,0 // mulps 0x2c91(%rip),%xmm11 # 5790 <_sk_callback_sse41+0x7bc>
.byte 102,69,15,91,211 // cvtps2dq %xmm11,%xmm10
.byte 243,68,15,16,64,20 // movss 0x14(%rax),%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
@@ -24689,7 +24776,7 @@ _sk_parametric_r_sse41:
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,86,44,0,0 // minps 0x2c56(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x7bd>
+ .byte 68,15,93,5,120,44,0,0 // minps 0x2c78(%rip),%xmm8 # 57a0 <_sk_callback_sse41+0x7cc>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -24719,31 +24806,31 @@ _sk_parametric_g_sse41:
.byte 68,15,88,217 // addps %xmm1,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,247,43,0,0 // mulps 0x2bf7(%rip),%xmm12 # 5760 <_sk_callback_sse41+0x7cd>
- .byte 68,15,84,29,255,43,0,0 // andps 0x2bff(%rip),%xmm11 # 5770 <_sk_callback_sse41+0x7dd>
- .byte 68,15,86,29,7,44,0,0 // orps 0x2c07(%rip),%xmm11 # 5780 <_sk_callback_sse41+0x7ed>
- .byte 68,15,88,37,15,44,0,0 // addps 0x2c0f(%rip),%xmm12 # 5790 <_sk_callback_sse41+0x7fd>
- .byte 15,40,13,24,44,0,0 // movaps 0x2c18(%rip),%xmm1 # 57a0 <_sk_callback_sse41+0x80d>
+ .byte 68,15,89,37,25,44,0,0 // mulps 0x2c19(%rip),%xmm12 # 57b0 <_sk_callback_sse41+0x7dc>
+ .byte 68,15,84,29,33,44,0,0 // andps 0x2c21(%rip),%xmm11 # 57c0 <_sk_callback_sse41+0x7ec>
+ .byte 68,15,86,29,41,44,0,0 // orps 0x2c29(%rip),%xmm11 # 57d0 <_sk_callback_sse41+0x7fc>
+ .byte 68,15,88,37,49,44,0,0 // addps 0x2c31(%rip),%xmm12 # 57e0 <_sk_callback_sse41+0x80c>
+ .byte 15,40,13,58,44,0,0 // movaps 0x2c3a(%rip),%xmm1 # 57f0 <_sk_callback_sse41+0x81c>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
- .byte 68,15,88,29,24,44,0,0 // addps 0x2c18(%rip),%xmm11 # 57b0 <_sk_callback_sse41+0x81d>
- .byte 15,40,13,33,44,0,0 // movaps 0x2c21(%rip),%xmm1 # 57c0 <_sk_callback_sse41+0x82d>
+ .byte 68,15,88,29,58,44,0,0 // addps 0x2c3a(%rip),%xmm11 # 5800 <_sk_callback_sse41+0x82c>
+ .byte 15,40,13,67,44,0,0 // movaps 0x2c43(%rip),%xmm1 # 5810 <_sk_callback_sse41+0x83c>
.byte 65,15,94,203 // divps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,14,44,0,0 // addps 0x2c0e(%rip),%xmm12 # 57d0 <_sk_callback_sse41+0x83d>
- .byte 15,40,13,23,44,0,0 // movaps 0x2c17(%rip),%xmm1 # 57e0 <_sk_callback_sse41+0x84d>
+ .byte 68,15,88,37,48,44,0,0 // addps 0x2c30(%rip),%xmm12 # 5820 <_sk_callback_sse41+0x84c>
+ .byte 15,40,13,57,44,0,0 // movaps 0x2c39(%rip),%xmm1 # 5830 <_sk_callback_sse41+0x85c>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
- .byte 68,15,40,21,23,44,0,0 // movaps 0x2c17(%rip),%xmm10 # 57f0 <_sk_callback_sse41+0x85d>
+ .byte 68,15,40,21,57,44,0,0 // movaps 0x2c39(%rip),%xmm10 # 5840 <_sk_callback_sse41+0x86c>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,13,28,44,0,0 // movaps 0x2c1c(%rip),%xmm1 # 5800 <_sk_callback_sse41+0x86d>
+ .byte 15,40,13,62,44,0,0 // movaps 0x2c3e(%rip),%xmm1 # 5850 <_sk_callback_sse41+0x87c>
.byte 65,15,94,202 // divps %xmm10,%xmm1
.byte 65,15,88,204 // addps %xmm12,%xmm1
- .byte 15,89,13,29,44,0,0 // mulps 0x2c1d(%rip),%xmm1 # 5810 <_sk_callback_sse41+0x87d>
+ .byte 15,89,13,63,44,0,0 // mulps 0x2c3f(%rip),%xmm1 # 5860 <_sk_callback_sse41+0x88c>
.byte 102,68,15,91,209 // cvtps2dq %xmm1,%xmm10
.byte 243,15,16,72,20 // movss 0x14(%rax),%xmm1
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
@@ -24751,7 +24838,7 @@ _sk_parametric_g_sse41:
.byte 102,65,15,56,20,201 // blendvps %xmm0,%xmm9,%xmm1
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,200 // maxps %xmm0,%xmm1
- .byte 15,93,13,8,44,0,0 // minps 0x2c08(%rip),%xmm1 # 5820 <_sk_callback_sse41+0x88d>
+ .byte 15,93,13,42,44,0,0 // minps 0x2c2a(%rip),%xmm1 # 5870 <_sk_callback_sse41+0x89c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -24781,31 +24868,31 @@ _sk_parametric_b_sse41:
.byte 68,15,88,218 // addps %xmm2,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,169,43,0,0 // mulps 0x2ba9(%rip),%xmm12 # 5830 <_sk_callback_sse41+0x89d>
- .byte 68,15,84,29,177,43,0,0 // andps 0x2bb1(%rip),%xmm11 # 5840 <_sk_callback_sse41+0x8ad>
- .byte 68,15,86,29,185,43,0,0 // orps 0x2bb9(%rip),%xmm11 # 5850 <_sk_callback_sse41+0x8bd>
- .byte 68,15,88,37,193,43,0,0 // addps 0x2bc1(%rip),%xmm12 # 5860 <_sk_callback_sse41+0x8cd>
- .byte 15,40,21,202,43,0,0 // movaps 0x2bca(%rip),%xmm2 # 5870 <_sk_callback_sse41+0x8dd>
+ .byte 68,15,89,37,203,43,0,0 // mulps 0x2bcb(%rip),%xmm12 # 5880 <_sk_callback_sse41+0x8ac>
+ .byte 68,15,84,29,211,43,0,0 // andps 0x2bd3(%rip),%xmm11 # 5890 <_sk_callback_sse41+0x8bc>
+ .byte 68,15,86,29,219,43,0,0 // orps 0x2bdb(%rip),%xmm11 # 58a0 <_sk_callback_sse41+0x8cc>
+ .byte 68,15,88,37,227,43,0,0 // addps 0x2be3(%rip),%xmm12 # 58b0 <_sk_callback_sse41+0x8dc>
+ .byte 15,40,21,236,43,0,0 // movaps 0x2bec(%rip),%xmm2 # 58c0 <_sk_callback_sse41+0x8ec>
.byte 65,15,89,211 // mulps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
- .byte 68,15,88,29,202,43,0,0 // addps 0x2bca(%rip),%xmm11 # 5880 <_sk_callback_sse41+0x8ed>
- .byte 15,40,21,211,43,0,0 // movaps 0x2bd3(%rip),%xmm2 # 5890 <_sk_callback_sse41+0x8fd>
+ .byte 68,15,88,29,236,43,0,0 // addps 0x2bec(%rip),%xmm11 # 58d0 <_sk_callback_sse41+0x8fc>
+ .byte 15,40,21,245,43,0,0 // movaps 0x2bf5(%rip),%xmm2 # 58e0 <_sk_callback_sse41+0x90c>
.byte 65,15,94,211 // divps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,192,43,0,0 // addps 0x2bc0(%rip),%xmm12 # 58a0 <_sk_callback_sse41+0x90d>
- .byte 15,40,21,201,43,0,0 // movaps 0x2bc9(%rip),%xmm2 # 58b0 <_sk_callback_sse41+0x91d>
+ .byte 68,15,88,37,226,43,0,0 // addps 0x2be2(%rip),%xmm12 # 58f0 <_sk_callback_sse41+0x91c>
+ .byte 15,40,21,235,43,0,0 // movaps 0x2beb(%rip),%xmm2 # 5900 <_sk_callback_sse41+0x92c>
.byte 65,15,89,211 // mulps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
- .byte 68,15,40,21,201,43,0,0 // movaps 0x2bc9(%rip),%xmm10 # 58c0 <_sk_callback_sse41+0x92d>
+ .byte 68,15,40,21,235,43,0,0 // movaps 0x2beb(%rip),%xmm10 # 5910 <_sk_callback_sse41+0x93c>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,21,206,43,0,0 // movaps 0x2bce(%rip),%xmm2 # 58d0 <_sk_callback_sse41+0x93d>
+ .byte 15,40,21,240,43,0,0 // movaps 0x2bf0(%rip),%xmm2 # 5920 <_sk_callback_sse41+0x94c>
.byte 65,15,94,210 // divps %xmm10,%xmm2
.byte 65,15,88,212 // addps %xmm12,%xmm2
- .byte 15,89,21,207,43,0,0 // mulps 0x2bcf(%rip),%xmm2 # 58e0 <_sk_callback_sse41+0x94d>
+ .byte 15,89,21,241,43,0,0 // mulps 0x2bf1(%rip),%xmm2 # 5930 <_sk_callback_sse41+0x95c>
.byte 102,68,15,91,210 // cvtps2dq %xmm2,%xmm10
.byte 243,15,16,80,20 // movss 0x14(%rax),%xmm2
.byte 15,198,210,0 // shufps $0x0,%xmm2,%xmm2
@@ -24813,7 +24900,7 @@ _sk_parametric_b_sse41:
.byte 102,65,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm2
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,208 // maxps %xmm0,%xmm2
- .byte 15,93,21,186,43,0,0 // minps 0x2bba(%rip),%xmm2 # 58f0 <_sk_callback_sse41+0x95d>
+ .byte 15,93,21,220,43,0,0 // minps 0x2bdc(%rip),%xmm2 # 5940 <_sk_callback_sse41+0x96c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -24843,31 +24930,31 @@ _sk_parametric_a_sse41:
.byte 68,15,88,219 // addps %xmm3,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,91,43,0,0 // mulps 0x2b5b(%rip),%xmm12 # 5900 <_sk_callback_sse41+0x96d>
- .byte 68,15,84,29,99,43,0,0 // andps 0x2b63(%rip),%xmm11 # 5910 <_sk_callback_sse41+0x97d>
- .byte 68,15,86,29,107,43,0,0 // orps 0x2b6b(%rip),%xmm11 # 5920 <_sk_callback_sse41+0x98d>
- .byte 68,15,88,37,115,43,0,0 // addps 0x2b73(%rip),%xmm12 # 5930 <_sk_callback_sse41+0x99d>
- .byte 15,40,29,124,43,0,0 // movaps 0x2b7c(%rip),%xmm3 # 5940 <_sk_callback_sse41+0x9ad>
+ .byte 68,15,89,37,125,43,0,0 // mulps 0x2b7d(%rip),%xmm12 # 5950 <_sk_callback_sse41+0x97c>
+ .byte 68,15,84,29,133,43,0,0 // andps 0x2b85(%rip),%xmm11 # 5960 <_sk_callback_sse41+0x98c>
+ .byte 68,15,86,29,141,43,0,0 // orps 0x2b8d(%rip),%xmm11 # 5970 <_sk_callback_sse41+0x99c>
+ .byte 68,15,88,37,149,43,0,0 // addps 0x2b95(%rip),%xmm12 # 5980 <_sk_callback_sse41+0x9ac>
+ .byte 15,40,29,158,43,0,0 // movaps 0x2b9e(%rip),%xmm3 # 5990 <_sk_callback_sse41+0x9bc>
.byte 65,15,89,219 // mulps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
- .byte 68,15,88,29,124,43,0,0 // addps 0x2b7c(%rip),%xmm11 # 5950 <_sk_callback_sse41+0x9bd>
- .byte 15,40,29,133,43,0,0 // movaps 0x2b85(%rip),%xmm3 # 5960 <_sk_callback_sse41+0x9cd>
+ .byte 68,15,88,29,158,43,0,0 // addps 0x2b9e(%rip),%xmm11 # 59a0 <_sk_callback_sse41+0x9cc>
+ .byte 15,40,29,167,43,0,0 // movaps 0x2ba7(%rip),%xmm3 # 59b0 <_sk_callback_sse41+0x9dc>
.byte 65,15,94,219 // divps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,114,43,0,0 // addps 0x2b72(%rip),%xmm12 # 5970 <_sk_callback_sse41+0x9dd>
- .byte 15,40,29,123,43,0,0 // movaps 0x2b7b(%rip),%xmm3 # 5980 <_sk_callback_sse41+0x9ed>
+ .byte 68,15,88,37,148,43,0,0 // addps 0x2b94(%rip),%xmm12 # 59c0 <_sk_callback_sse41+0x9ec>
+ .byte 15,40,29,157,43,0,0 // movaps 0x2b9d(%rip),%xmm3 # 59d0 <_sk_callback_sse41+0x9fc>
.byte 65,15,89,219 // mulps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
- .byte 68,15,40,21,123,43,0,0 // movaps 0x2b7b(%rip),%xmm10 # 5990 <_sk_callback_sse41+0x9fd>
+ .byte 68,15,40,21,157,43,0,0 // movaps 0x2b9d(%rip),%xmm10 # 59e0 <_sk_callback_sse41+0xa0c>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,29,128,43,0,0 // movaps 0x2b80(%rip),%xmm3 # 59a0 <_sk_callback_sse41+0xa0d>
+ .byte 15,40,29,162,43,0,0 // movaps 0x2ba2(%rip),%xmm3 # 59f0 <_sk_callback_sse41+0xa1c>
.byte 65,15,94,218 // divps %xmm10,%xmm3
.byte 65,15,88,220 // addps %xmm12,%xmm3
- .byte 15,89,29,129,43,0,0 // mulps 0x2b81(%rip),%xmm3 # 59b0 <_sk_callback_sse41+0xa1d>
+ .byte 15,89,29,163,43,0,0 // mulps 0x2ba3(%rip),%xmm3 # 5a00 <_sk_callback_sse41+0xa2c>
.byte 102,68,15,91,211 // cvtps2dq %xmm3,%xmm10
.byte 243,15,16,88,20 // movss 0x14(%rax),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
@@ -24875,7 +24962,7 @@ _sk_parametric_a_sse41:
.byte 102,65,15,56,20,217 // blendvps %xmm0,%xmm9,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,216 // maxps %xmm0,%xmm3
- .byte 15,93,29,108,43,0,0 // minps 0x2b6c(%rip),%xmm3 # 59c0 <_sk_callback_sse41+0xa2d>
+ .byte 15,93,29,142,43,0,0 // minps 0x2b8e(%rip),%xmm3 # 5a10 <_sk_callback_sse41+0xa3c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -24885,29 +24972,29 @@ HIDDEN _sk_lab_to_xyz_sse41
FUNCTION(_sk_lab_to_xyz_sse41)
_sk_lab_to_xyz_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,89,5,104,43,0,0 // mulps 0x2b68(%rip),%xmm8 # 59d0 <_sk_callback_sse41+0xa3d>
- .byte 68,15,40,13,112,43,0,0 // movaps 0x2b70(%rip),%xmm9 # 59e0 <_sk_callback_sse41+0xa4d>
+ .byte 68,15,89,5,138,43,0,0 // mulps 0x2b8a(%rip),%xmm8 # 5a20 <_sk_callback_sse41+0xa4c>
+ .byte 68,15,40,13,146,43,0,0 // movaps 0x2b92(%rip),%xmm9 # 5a30 <_sk_callback_sse41+0xa5c>
.byte 65,15,89,201 // mulps %xmm9,%xmm1
- .byte 15,40,5,117,43,0,0 // movaps 0x2b75(%rip),%xmm0 # 59f0 <_sk_callback_sse41+0xa5d>
+ .byte 15,40,5,151,43,0,0 // movaps 0x2b97(%rip),%xmm0 # 5a40 <_sk_callback_sse41+0xa6c>
.byte 15,88,200 // addps %xmm0,%xmm1
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 15,88,208 // addps %xmm0,%xmm2
- .byte 68,15,88,5,115,43,0,0 // addps 0x2b73(%rip),%xmm8 # 5a00 <_sk_callback_sse41+0xa6d>
- .byte 68,15,89,5,123,43,0,0 // mulps 0x2b7b(%rip),%xmm8 # 5a10 <_sk_callback_sse41+0xa7d>
- .byte 15,89,13,132,43,0,0 // mulps 0x2b84(%rip),%xmm1 # 5a20 <_sk_callback_sse41+0xa8d>
+ .byte 68,15,88,5,149,43,0,0 // addps 0x2b95(%rip),%xmm8 # 5a50 <_sk_callback_sse41+0xa7c>
+ .byte 68,15,89,5,157,43,0,0 // mulps 0x2b9d(%rip),%xmm8 # 5a60 <_sk_callback_sse41+0xa8c>
+ .byte 15,89,13,166,43,0,0 // mulps 0x2ba6(%rip),%xmm1 # 5a70 <_sk_callback_sse41+0xa9c>
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 15,89,21,137,43,0,0 // mulps 0x2b89(%rip),%xmm2 # 5a30 <_sk_callback_sse41+0xa9d>
+ .byte 15,89,21,171,43,0,0 // mulps 0x2bab(%rip),%xmm2 # 5a80 <_sk_callback_sse41+0xaac>
.byte 69,15,40,208 // movaps %xmm8,%xmm10
.byte 68,15,92,210 // subps %xmm2,%xmm10
.byte 68,15,40,217 // movaps %xmm1,%xmm11
.byte 69,15,89,219 // mulps %xmm11,%xmm11
.byte 68,15,89,217 // mulps %xmm1,%xmm11
- .byte 68,15,40,13,125,43,0,0 // movaps 0x2b7d(%rip),%xmm9 # 5a40 <_sk_callback_sse41+0xaad>
+ .byte 68,15,40,13,159,43,0,0 // movaps 0x2b9f(%rip),%xmm9 # 5a90 <_sk_callback_sse41+0xabc>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0
- .byte 15,40,21,125,43,0,0 // movaps 0x2b7d(%rip),%xmm2 # 5a50 <_sk_callback_sse41+0xabd>
+ .byte 15,40,21,159,43,0,0 // movaps 0x2b9f(%rip),%xmm2 # 5aa0 <_sk_callback_sse41+0xacc>
.byte 15,88,202 // addps %xmm2,%xmm1
- .byte 68,15,40,37,130,43,0,0 // movaps 0x2b82(%rip),%xmm12 # 5a60 <_sk_callback_sse41+0xacd>
+ .byte 68,15,40,37,164,43,0,0 // movaps 0x2ba4(%rip),%xmm12 # 5ab0 <_sk_callback_sse41+0xadc>
.byte 65,15,89,204 // mulps %xmm12,%xmm1
.byte 102,65,15,56,20,203 // blendvps %xmm0,%xmm11,%xmm1
.byte 69,15,40,216 // movaps %xmm8,%xmm11
@@ -24926,8 +25013,8 @@ _sk_lab_to_xyz_sse41:
.byte 65,15,89,212 // mulps %xmm12,%xmm2
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 102,65,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm2
- .byte 15,89,13,59,43,0,0 // mulps 0x2b3b(%rip),%xmm1 # 5a70 <_sk_callback_sse41+0xadd>
- .byte 15,89,21,68,43,0,0 // mulps 0x2b44(%rip),%xmm2 # 5a80 <_sk_callback_sse41+0xaed>
+ .byte 15,89,13,93,43,0,0 // mulps 0x2b5d(%rip),%xmm1 # 5ac0 <_sk_callback_sse41+0xaec>
+ .byte 15,89,21,102,43,0,0 // mulps 0x2b66(%rip),%xmm2 # 5ad0 <_sk_callback_sse41+0xafc>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 65,15,40,200 // movaps %xmm8,%xmm1
@@ -24938,42 +25025,43 @@ HIDDEN _sk_load_a8_sse41
FUNCTION(_sk_load_a8_sse41)
_sk_load_a8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,38 // jne 2f77 <_sk_load_a8_sse41+0x30>
- .byte 102,65,15,56,49,4,57 // pmovzxbd (%r9,%rdi,1),%xmm0
- .byte 102,15,219,5,48,43,0,0 // pand 0x2b30(%rip),%xmm0 # 5a90 <_sk_callback_sse41+0xafd>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,38 // jne 2fa5 <_sk_load_a8_sse41+0x30>
+ .byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0
+ .byte 102,15,219,5,82,43,0,0 // pand 0x2b52(%rip),%xmm0 # 5ae0 <_sk_callback_sse41+0xb0c>
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,54,43,0,0 // mulps 0x2b36(%rip),%xmm3 # 5aa0 <_sk_callback_sse41+0xb0d>
+ .byte 15,89,29,88,43,0,0 // mulps 0x2b58(%rip),%xmm3 # 5af0 <_sk_callback_sse41+0xb1c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,39 // je 2faf <_sk_load_a8_sse41+0x68>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 2fa3 <_sk_load_a8_sse41+0x5c>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,196 // jne 2f58 <_sk_load_a8_sse41+0x11>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,39 // je 2fdd <_sk_load_a8_sse41+0x68>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 2fd1 <_sk_load_a8_sse41+0x5c>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,196 // jne 2f86 <_sk_load_a8_sse41+0x11>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm0
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm0
- .byte 235,156 // jmp 2f58 <_sk_load_a8_sse41+0x11>
+ .byte 235,156 // jmp 2f86 <_sk_load_a8_sse41+0x11>
HIDDEN _sk_gather_a8_sse41
.globl _sk_gather_a8_sse41
FUNCTION(_sk_gather_a8_sse41)
_sk_gather_a8_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -24981,24 +25069,25 @@ _sk_gather_a8_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,58,32,4,24,0 // pinsrb $0x0,(%r8,%r11,1),%xmm0
- .byte 102,67,15,58,32,4,16,1 // pinsrb $0x1,(%r8,%r10,1),%xmm0
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 102,65,15,58,32,193,2 // pinsrb $0x2,%r9d,%xmm0
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,58,32,4,25,0 // pinsrb $0x0,(%r9,%rbx,1),%xmm0
+ .byte 102,67,15,58,32,4,25,1 // pinsrb $0x1,(%r9,%r11,1),%xmm0
+ .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx
+ .byte 102,15,58,32,195,2 // pinsrb $0x2,%ebx,%xmm0
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,132,42,0,0 // mulps 0x2a84(%rip),%xmm3 # 5ab0 <_sk_callback_sse41+0xb1d>
+ .byte 15,89,29,166,42,0,0 // mulps 0x2aa6(%rip),%xmm3 # 5b00 <_sk_callback_sse41+0xb2c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,15,239,210 // pxor %xmm2,%xmm2
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_a8_sse41
@@ -25006,73 +25095,74 @@ HIDDEN _sk_store_a8_sse41
FUNCTION(_sk_store_a8_sse41)
_sk_store_a8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 68,15,40,5,120,42,0,0 // movaps 0x2a78(%rip),%xmm8 # 5ac0 <_sk_callback_sse41+0xb2d>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 68,15,40,5,153,42,0,0 // movaps 0x2a99(%rip),%xmm8 # 5b10 <_sk_callback_sse41+0xb3c>
.byte 68,15,89,195 // mulps %xmm3,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
.byte 102,69,15,103,192 // packuswb %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,13 // jne 306e <_sk_store_a8_sse41+0x33>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,13 // jne 309d <_sk_store_a8_sse41+0x33>
.byte 102,68,15,126,192 // movd %xmm8,%eax
- .byte 65,137,4,57 // mov %eax,(%r9,%rdi,1)
+ .byte 65,137,4,18 // mov %eax,(%r10,%rdx,1)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,69,15,56,49,192 // pmovzxbd %xmm8,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,30 // je 309f <_sk_store_a8_sse41+0x64>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,15 // je 3096 <_sk_store_a8_sse41+0x5b>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,221 // jne 306a <_sk_store_a8_sse41+0x2f>
- .byte 102,69,15,58,20,68,57,2,8 // pextrb $0x8,%xmm8,0x2(%r9,%rdi,1)
- .byte 102,69,15,58,20,68,57,1,4 // pextrb $0x4,%xmm8,0x1(%r9,%rdi,1)
- .byte 102,69,15,58,20,4,57,0 // pextrb $0x0,%xmm8,(%r9,%rdi,1)
- .byte 235,193 // jmp 306a <_sk_store_a8_sse41+0x2f>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,30 // je 30ce <_sk_store_a8_sse41+0x64>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,15 // je 30c5 <_sk_store_a8_sse41+0x5b>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,221 // jne 3099 <_sk_store_a8_sse41+0x2f>
+ .byte 102,69,15,58,20,68,18,2,8 // pextrb $0x8,%xmm8,0x2(%r10,%rdx,1)
+ .byte 102,69,15,58,20,68,18,1,4 // pextrb $0x4,%xmm8,0x1(%r10,%rdx,1)
+ .byte 102,69,15,58,20,4,18,0 // pextrb $0x0,%xmm8,(%r10,%rdx,1)
+ .byte 235,193 // jmp 3099 <_sk_store_a8_sse41+0x2f>
HIDDEN _sk_load_g8_sse41
.globl _sk_load_g8_sse41
FUNCTION(_sk_load_g8_sse41)
_sk_load_g8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,42 // jne 30dd <_sk_load_g8_sse41+0x34>
- .byte 102,65,15,56,49,4,57 // pmovzxbd (%r9,%rdi,1),%xmm0
- .byte 102,15,219,5,14,42,0,0 // pand 0x2a0e(%rip),%xmm0 # 5ad0 <_sk_callback_sse41+0xb3d>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,42 // jne 310c <_sk_load_g8_sse41+0x34>
+ .byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0
+ .byte 102,15,219,5,47,42,0,0 // pand 0x2a2f(%rip),%xmm0 # 5b20 <_sk_callback_sse41+0xb4c>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,20,42,0,0 // mulps 0x2a14(%rip),%xmm0 # 5ae0 <_sk_callback_sse41+0xb4d>
+ .byte 15,89,5,53,42,0,0 // mulps 0x2a35(%rip),%xmm0 # 5b30 <_sk_callback_sse41+0xb5c>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,27,42,0,0 // movaps 0x2a1b(%rip),%xmm3 # 5af0 <_sk_callback_sse41+0xb5d>
+ .byte 15,40,29,60,42,0,0 // movaps 0x2a3c(%rip),%xmm3 # 5b40 <_sk_callback_sse41+0xb6c>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,39 // je 3115 <_sk_load_g8_sse41+0x6c>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 3109 <_sk_load_g8_sse41+0x60>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,192 // jne 30ba <_sk_load_g8_sse41+0x11>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,39 // je 3144 <_sk_load_g8_sse41+0x6c>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 3138 <_sk_load_g8_sse41+0x60>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,192 // jne 30e9 <_sk_load_g8_sse41+0x11>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm0
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm0
- .byte 235,152 // jmp 30ba <_sk_load_g8_sse41+0x11>
+ .byte 235,152 // jmp 30e9 <_sk_load_g8_sse41+0x11>
HIDDEN _sk_gather_g8_sse41
.globl _sk_gather_g8_sse41
FUNCTION(_sk_gather_g8_sse41)
_sk_gather_g8_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25080,24 +25170,25 @@ _sk_gather_g8_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,58,32,4,24,0 // pinsrb $0x0,(%r8,%r11,1),%xmm0
- .byte 102,67,15,58,32,4,16,1 // pinsrb $0x1,(%r8,%r10,1),%xmm0
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 102,65,15,58,32,193,2 // pinsrb $0x2,%r9d,%xmm0
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,58,32,4,25,0 // pinsrb $0x0,(%r9,%rbx,1),%xmm0
+ .byte 102,67,15,58,32,4,25,1 // pinsrb $0x1,(%r9,%r11,1),%xmm0
+ .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx
+ .byte 102,15,58,32,195,2 // pinsrb $0x2,%ebx,%xmm0
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,110,41,0,0 // mulps 0x296e(%rip),%xmm0 # 5b00 <_sk_callback_sse41+0xb6d>
+ .byte 15,89,5,143,41,0,0 // mulps 0x298f(%rip),%xmm0 # 5b50 <_sk_callback_sse41+0xb7c>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,117,41,0,0 // movaps 0x2975(%rip),%xmm3 # 5b10 <_sk_callback_sse41+0xb7d>
+ .byte 15,40,29,150,41,0,0 // movaps 0x2996(%rip),%xmm3 # 5b60 <_sk_callback_sse41+0xb8c>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_gather_i8_sse41
@@ -25105,14 +25196,15 @@ HIDDEN _sk_gather_i8_sse41
FUNCTION(_sk_gather_i8_sse41)
_sk_gather_i8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,192 // mov %rax,%r8
- .byte 77,133,192 // test %r8,%r8
- .byte 116,5 // je 31b2 <_sk_gather_i8_sse41+0xf>
- .byte 76,137,192 // mov %r8,%rax
- .byte 235,2 // jmp 31b4 <_sk_gather_i8_sse41+0x11>
+ .byte 73,137,193 // mov %rax,%r9
+ .byte 77,133,201 // test %r9,%r9
+ .byte 116,5 // je 31e2 <_sk_gather_i8_sse41+0xf>
+ .byte 76,137,200 // mov %r9,%rax
+ .byte 235,2 // jmp 31e4 <_sk_gather_i8_sse41+0x11>
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,139,16 // mov (%rax),%r10
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25120,38 +25212,38 @@ _sk_gather_i8_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,195 // movq %xmm0,%r11
- .byte 68,137,219 // mov %r11d,%ebx
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 102,65,15,58,32,4,25,0 // pinsrb $0x0,(%r9,%rbx,1),%xmm0
- .byte 102,67,15,58,32,4,25,1 // pinsrb $0x1,(%r9,%r11,1),%xmm0
- .byte 102,67,15,58,32,4,17,2 // pinsrb $0x2,(%r9,%r10,1),%xmm0
- .byte 102,65,15,58,32,4,1,3 // pinsrb $0x3,(%r9,%rax,1),%xmm0
+ .byte 102,72,15,126,195 // movq %xmm0,%rbx
+ .byte 65,137,222 // mov %ebx,%r14d
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 102,67,15,58,32,4,50,0 // pinsrb $0x0,(%r10,%r14,1),%xmm0
+ .byte 102,65,15,58,32,4,26,1 // pinsrb $0x1,(%r10,%rbx,1),%xmm0
+ .byte 102,67,15,58,32,4,26,2 // pinsrb $0x2,(%r10,%r11,1),%xmm0
+ .byte 102,65,15,58,32,4,2,3 // pinsrb $0x3,(%r10,%rax,1),%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
- .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
+ .byte 102,73,15,58,22,194,1 // pextrq $0x1,%xmm0,%r10
.byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 73,139,64,8 // mov 0x8(%r8),%rax
- .byte 65,137,216 // mov %ebx,%r8d
+ .byte 73,139,65,8 // mov 0x8(%r9),%rax
+ .byte 65,137,217 // mov %ebx,%r9d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,137,202 // mov %r9d,%r10d
- .byte 73,193,233,30 // shr $0x1e,%r9
- .byte 102,66,15,110,28,128 // movd (%rax,%r8,4),%xmm3
+ .byte 69,137,211 // mov %r10d,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 102,66,15,110,28,136 // movd (%rax,%r9,4),%xmm3
.byte 102,15,58,34,28,24,1 // pinsrd $0x1,(%rax,%rbx,1),%xmm3
- .byte 102,66,15,58,34,28,144,2 // pinsrd $0x2,(%rax,%r10,4),%xmm3
- .byte 102,66,15,58,34,28,8,3 // pinsrd $0x3,(%rax,%r9,1),%xmm3
- .byte 102,15,111,5,203,40,0,0 // movdqa 0x28cb(%rip),%xmm0 # 5b20 <_sk_callback_sse41+0xb8d>
+ .byte 102,66,15,58,34,28,152,2 // pinsrd $0x2,(%rax,%r11,4),%xmm3
+ .byte 102,66,15,58,34,28,16,3 // pinsrd $0x3,(%rax,%r10,1),%xmm3
+ .byte 102,15,111,5,233,40,0,0 // movdqa 0x28e9(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xb9c>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,204,40,0,0 // movaps 0x28cc(%rip),%xmm8 # 5b30 <_sk_callback_sse41+0xb9d>
+ .byte 68,15,40,5,234,40,0,0 // movaps 0x28ea(%rip),%xmm8 # 5b80 <_sk_callback_sse41+0xbac>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,203,40,0,0 // pshufb 0x28cb(%rip),%xmm1 # 5b40 <_sk_callback_sse41+0xbad>
+ .byte 102,15,56,0,13,233,40,0,0 // pshufb 0x28e9(%rip),%xmm1 # 5b90 <_sk_callback_sse41+0xbbc>
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,199,40,0,0 // pshufb 0x28c7(%rip),%xmm2 # 5b50 <_sk_callback_sse41+0xbbd>
+ .byte 102,15,56,0,21,229,40,0,0 // pshufb 0x28e5(%rip),%xmm2 # 5ba0 <_sk_callback_sse41+0xbcc>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -25159,6 +25251,7 @@ _sk_gather_i8_sse41:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
+ .byte 65,94 // pop %r14
.byte 255,224 // jmpq *%rax
HIDDEN _sk_load_565_sse41
@@ -25166,48 +25259,49 @@ HIDDEN _sk_load_565_sse41
FUNCTION(_sk_load_565_sse41)
_sk_load_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,80 // jne 32fb <_sk_load_565_sse41+0x5a>
- .byte 102,65,15,56,51,20,121 // pmovzxwd (%r9,%rdi,2),%xmm2
- .byte 102,15,111,5,166,40,0,0 // movdqa 0x28a6(%rip),%xmm0 # 5b60 <_sk_callback_sse41+0xbcd>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,80 // jne 332f <_sk_load_565_sse41+0x5a>
+ .byte 102,65,15,56,51,20,82 // pmovzxwd (%r10,%rdx,2),%xmm2
+ .byte 102,15,111,5,194,40,0,0 // movdqa 0x28c2(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xbdc>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,168,40,0,0 // mulps 0x28a8(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xbdd>
- .byte 102,15,111,13,176,40,0,0 // movdqa 0x28b0(%rip),%xmm1 # 5b80 <_sk_callback_sse41+0xbed>
+ .byte 15,89,5,196,40,0,0 // mulps 0x28c4(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xbec>
+ .byte 102,15,111,13,204,40,0,0 // movdqa 0x28cc(%rip),%xmm1 # 5bd0 <_sk_callback_sse41+0xbfc>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,178,40,0,0 // mulps 0x28b2(%rip),%xmm1 # 5b90 <_sk_callback_sse41+0xbfd>
- .byte 102,15,219,21,186,40,0,0 // pand 0x28ba(%rip),%xmm2 # 5ba0 <_sk_callback_sse41+0xc0d>
+ .byte 15,89,13,206,40,0,0 // mulps 0x28ce(%rip),%xmm1 # 5be0 <_sk_callback_sse41+0xc0c>
+ .byte 102,15,219,21,214,40,0,0 // pand 0x28d6(%rip),%xmm2 # 5bf0 <_sk_callback_sse41+0xc1c>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,192,40,0,0 // mulps 0x28c0(%rip),%xmm2 # 5bb0 <_sk_callback_sse41+0xc1d>
+ .byte 15,89,21,220,40,0,0 // mulps 0x28dc(%rip),%xmm2 # 5c00 <_sk_callback_sse41+0xc2c>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,199,40,0,0 // movaps 0x28c7(%rip),%xmm3 # 5bc0 <_sk_callback_sse41+0xc2d>
+ .byte 15,40,29,227,40,0,0 // movaps 0x28e3(%rip),%xmm3 # 5c10 <_sk_callback_sse41+0xc3c>
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,210 // pxor %xmm2,%xmm2
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,39 // je 3333 <_sk_load_565_sse41+0x92>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 3327 <_sk_load_565_sse41+0x86>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,154 // jne 32b2 <_sk_load_565_sse41+0x11>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,39 // je 3367 <_sk_load_565_sse41+0x92>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 335b <_sk_load_565_sse41+0x86>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,154 // jne 32e6 <_sk_load_565_sse41+0x11>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,15,58,34,208,1 // pinsrd $0x1,%eax,%xmm2
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,58,34,208,0 // pinsrd $0x0,%eax,%xmm2
- .byte 233,111,255,255,255 // jmpq 32b2 <_sk_load_565_sse41+0x11>
+ .byte 233,111,255,255,255 // jmpq 32e6 <_sk_load_565_sse41+0x11>
HIDDEN _sk_gather_565_sse41
.globl _sk_gather_565_sse41
FUNCTION(_sk_gather_565_sse41)
_sk_gather_565_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25215,31 +25309,32 @@ _sk_gather_565_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,196,4,88,0 // pinsrw $0x0,(%r8,%r11,2),%xmm0
- .byte 102,67,15,196,4,80,1 // pinsrw $0x1,(%r8,%r10,2),%xmm0
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 102,65,15,196,193,2 // pinsrw $0x2,%r9d,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,196,4,89,0 // pinsrw $0x0,(%r9,%rbx,2),%xmm0
+ .byte 102,67,15,196,4,89,1 // pinsrw $0x1,(%r9,%r11,2),%xmm0
+ .byte 67,15,183,28,81 // movzwl (%r9,%r10,2),%ebx
+ .byte 102,15,196,195,2 // pinsrw $0x2,%ebx,%xmm0
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0
.byte 102,15,56,51,208 // pmovzxwd %xmm0,%xmm2
- .byte 102,15,111,5,35,40,0,0 // movdqa 0x2823(%rip),%xmm0 # 5bd0 <_sk_callback_sse41+0xc3d>
+ .byte 102,15,111,5,63,40,0,0 // movdqa 0x283f(%rip),%xmm0 # 5c20 <_sk_callback_sse41+0xc4c>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,37,40,0,0 // mulps 0x2825(%rip),%xmm0 # 5be0 <_sk_callback_sse41+0xc4d>
- .byte 102,15,111,13,45,40,0,0 // movdqa 0x282d(%rip),%xmm1 # 5bf0 <_sk_callback_sse41+0xc5d>
+ .byte 15,89,5,65,40,0,0 // mulps 0x2841(%rip),%xmm0 # 5c30 <_sk_callback_sse41+0xc5c>
+ .byte 102,15,111,13,73,40,0,0 // movdqa 0x2849(%rip),%xmm1 # 5c40 <_sk_callback_sse41+0xc6c>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,47,40,0,0 // mulps 0x282f(%rip),%xmm1 # 5c00 <_sk_callback_sse41+0xc6d>
- .byte 102,15,219,21,55,40,0,0 // pand 0x2837(%rip),%xmm2 # 5c10 <_sk_callback_sse41+0xc7d>
+ .byte 15,89,13,75,40,0,0 // mulps 0x284b(%rip),%xmm1 # 5c50 <_sk_callback_sse41+0xc7c>
+ .byte 102,15,219,21,83,40,0,0 // pand 0x2853(%rip),%xmm2 # 5c60 <_sk_callback_sse41+0xc8c>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,61,40,0,0 // mulps 0x283d(%rip),%xmm2 # 5c20 <_sk_callback_sse41+0xc8d>
+ .byte 15,89,21,89,40,0,0 // mulps 0x2859(%rip),%xmm2 # 5c70 <_sk_callback_sse41+0xc9c>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,68,40,0,0 // movaps 0x2844(%rip),%xmm3 # 5c30 <_sk_callback_sse41+0xc9d>
+ .byte 15,40,29,96,40,0,0 // movaps 0x2860(%rip),%xmm3 # 5c80 <_sk_callback_sse41+0xcac>
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_565_sse41
@@ -25248,12 +25343,12 @@ FUNCTION(_sk_store_565_sse41)
_sk_store_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,69,40,0,0 // movaps 0x2845(%rip),%xmm8 # 5c40 <_sk_callback_sse41+0xcad>
+ .byte 68,15,40,5,96,40,0,0 // movaps 0x2860(%rip),%xmm8 # 5c90 <_sk_callback_sse41+0xcbc>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
.byte 102,65,15,114,241,11 // pslld $0xb,%xmm9
- .byte 68,15,40,21,58,40,0,0 // movaps 0x283a(%rip),%xmm10 # 5c50 <_sk_callback_sse41+0xcbd>
+ .byte 68,15,40,21,85,40,0,0 // movaps 0x2855(%rip),%xmm10 # 5ca0 <_sk_callback_sse41+0xccc>
.byte 68,15,89,209 // mulps %xmm1,%xmm10
.byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10
.byte 102,65,15,114,242,5 // pslld $0x5,%xmm10
@@ -25262,75 +25357,76 @@ _sk_store_565_sse41:
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,69,15,86,194 // orpd %xmm10,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 344d <_sk_store_565_sse41+0x5f>
- .byte 242,68,15,17,4,120 // movsd %xmm8,(%rax,%rdi,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3482 <_sk_store_565_sse41+0x5f>
+ .byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,69,15,56,51,192 // pmovzxwd %xmm8,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,30 // je 347e <_sk_store_565_sse41+0x90>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,15 // je 3475 <_sk_store_565_sse41+0x87>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,221 // jne 3449 <_sk_store_565_sse41+0x5b>
- .byte 102,68,15,58,21,68,120,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdi,2)
- .byte 102,68,15,58,21,68,120,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdi,2)
- .byte 102,68,15,58,21,4,120,0 // pextrw $0x0,%xmm8,(%rax,%rdi,2)
- .byte 235,193 // jmp 3449 <_sk_store_565_sse41+0x5b>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,30 // je 34b3 <_sk_store_565_sse41+0x90>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,15 // je 34aa <_sk_store_565_sse41+0x87>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,221 // jne 347e <_sk_store_565_sse41+0x5b>
+ .byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
+ .byte 102,68,15,58,21,68,80,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdx,2)
+ .byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2)
+ .byte 235,193 // jmp 347e <_sk_store_565_sse41+0x5b>
HIDDEN _sk_load_4444_sse41
.globl _sk_load_4444_sse41
FUNCTION(_sk_load_4444_sse41)
_sk_load_4444_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,95 // jne 34f1 <_sk_load_4444_sse41+0x69>
- .byte 102,65,15,56,51,28,121 // pmovzxwd (%r9,%rdi,2),%xmm3
- .byte 102,15,111,5,191,39,0,0 // movdqa 0x27bf(%rip),%xmm0 # 5c60 <_sk_callback_sse41+0xccd>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,95 // jne 3526 <_sk_load_4444_sse41+0x69>
+ .byte 102,65,15,56,51,28,82 // pmovzxwd (%r10,%rdx,2),%xmm3
+ .byte 102,15,111,5,218,39,0,0 // movdqa 0x27da(%rip),%xmm0 # 5cb0 <_sk_callback_sse41+0xcdc>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,193,39,0,0 // mulps 0x27c1(%rip),%xmm0 # 5c70 <_sk_callback_sse41+0xcdd>
- .byte 102,15,111,13,201,39,0,0 // movdqa 0x27c9(%rip),%xmm1 # 5c80 <_sk_callback_sse41+0xced>
+ .byte 15,89,5,220,39,0,0 // mulps 0x27dc(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xcec>
+ .byte 102,15,111,13,228,39,0,0 // movdqa 0x27e4(%rip),%xmm1 # 5cd0 <_sk_callback_sse41+0xcfc>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,203,39,0,0 // mulps 0x27cb(%rip),%xmm1 # 5c90 <_sk_callback_sse41+0xcfd>
- .byte 102,15,111,21,211,39,0,0 // movdqa 0x27d3(%rip),%xmm2 # 5ca0 <_sk_callback_sse41+0xd0d>
+ .byte 15,89,13,230,39,0,0 // mulps 0x27e6(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xd0c>
+ .byte 102,15,111,21,238,39,0,0 // movdqa 0x27ee(%rip),%xmm2 # 5cf0 <_sk_callback_sse41+0xd1c>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,213,39,0,0 // mulps 0x27d5(%rip),%xmm2 # 5cb0 <_sk_callback_sse41+0xd1d>
- .byte 102,15,219,29,221,39,0,0 // pand 0x27dd(%rip),%xmm3 # 5cc0 <_sk_callback_sse41+0xd2d>
+ .byte 15,89,21,240,39,0,0 // mulps 0x27f0(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xd2c>
+ .byte 102,15,219,29,248,39,0,0 // pand 0x27f8(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0xd3c>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,227,39,0,0 // mulps 0x27e3(%rip),%xmm3 # 5cd0 <_sk_callback_sse41+0xd3d>
+ .byte 15,89,29,254,39,0,0 // mulps 0x27fe(%rip),%xmm3 # 5d20 <_sk_callback_sse41+0xd4c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,39 // je 3529 <_sk_load_4444_sse41+0xa1>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 351d <_sk_load_4444_sse41+0x95>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,139 // jne 3499 <_sk_load_4444_sse41+0x11>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,39 // je 355e <_sk_load_4444_sse41+0xa1>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 3552 <_sk_load_4444_sse41+0x95>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,139 // jne 34ce <_sk_load_4444_sse41+0x11>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,15,58,34,216,1 // pinsrd $0x1,%eax,%xmm3
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,58,34,216,0 // pinsrd $0x0,%eax,%xmm3
- .byte 233,96,255,255,255 // jmpq 3499 <_sk_load_4444_sse41+0x11>
+ .byte 233,96,255,255,255 // jmpq 34ce <_sk_load_4444_sse41+0x11>
HIDDEN _sk_gather_4444_sse41
.globl _sk_gather_4444_sse41
FUNCTION(_sk_gather_4444_sse41)
_sk_gather_4444_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25338,34 +25434,35 @@ _sk_gather_4444_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,196,4,88,0 // pinsrw $0x0,(%r8,%r11,2),%xmm0
- .byte 102,67,15,196,4,80,1 // pinsrw $0x1,(%r8,%r10,2),%xmm0
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 102,65,15,196,193,2 // pinsrw $0x2,%r9d,%xmm0
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,196,4,89,0 // pinsrw $0x0,(%r9,%rbx,2),%xmm0
+ .byte 102,67,15,196,4,89,1 // pinsrw $0x1,(%r9,%r11,2),%xmm0
+ .byte 67,15,183,28,81 // movzwl (%r9,%r10,2),%ebx
+ .byte 102,15,196,195,2 // pinsrw $0x2,%ebx,%xmm0
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0
.byte 102,15,56,51,216 // pmovzxwd %xmm0,%xmm3
- .byte 102,15,111,5,61,39,0,0 // movdqa 0x273d(%rip),%xmm0 # 5ce0 <_sk_callback_sse41+0xd4d>
+ .byte 102,15,111,5,88,39,0,0 // movdqa 0x2758(%rip),%xmm0 # 5d30 <_sk_callback_sse41+0xd5c>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,63,39,0,0 // mulps 0x273f(%rip),%xmm0 # 5cf0 <_sk_callback_sse41+0xd5d>
- .byte 102,15,111,13,71,39,0,0 // movdqa 0x2747(%rip),%xmm1 # 5d00 <_sk_callback_sse41+0xd6d>
+ .byte 15,89,5,90,39,0,0 // mulps 0x275a(%rip),%xmm0 # 5d40 <_sk_callback_sse41+0xd6c>
+ .byte 102,15,111,13,98,39,0,0 // movdqa 0x2762(%rip),%xmm1 # 5d50 <_sk_callback_sse41+0xd7c>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,73,39,0,0 // mulps 0x2749(%rip),%xmm1 # 5d10 <_sk_callback_sse41+0xd7d>
- .byte 102,15,111,21,81,39,0,0 // movdqa 0x2751(%rip),%xmm2 # 5d20 <_sk_callback_sse41+0xd8d>
+ .byte 15,89,13,100,39,0,0 // mulps 0x2764(%rip),%xmm1 # 5d60 <_sk_callback_sse41+0xd8c>
+ .byte 102,15,111,21,108,39,0,0 // movdqa 0x276c(%rip),%xmm2 # 5d70 <_sk_callback_sse41+0xd9c>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,83,39,0,0 // mulps 0x2753(%rip),%xmm2 # 5d30 <_sk_callback_sse41+0xd9d>
- .byte 102,15,219,29,91,39,0,0 // pand 0x275b(%rip),%xmm3 # 5d40 <_sk_callback_sse41+0xdad>
+ .byte 15,89,21,110,39,0,0 // mulps 0x276e(%rip),%xmm2 # 5d80 <_sk_callback_sse41+0xdac>
+ .byte 102,15,219,29,118,39,0,0 // pand 0x2776(%rip),%xmm3 # 5d90 <_sk_callback_sse41+0xdbc>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,97,39,0,0 // mulps 0x2761(%rip),%xmm3 # 5d50 <_sk_callback_sse41+0xdbd>
+ .byte 15,89,29,124,39,0,0 // mulps 0x277c(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0xdcc>
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_4444_sse41
@@ -25374,7 +25471,7 @@ FUNCTION(_sk_store_4444_sse41)
_sk_store_4444_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,96,39,0,0 // movaps 0x2760(%rip),%xmm8 # 5d60 <_sk_callback_sse41+0xdcd>
+ .byte 68,15,40,5,122,39,0,0 // movaps 0x277a(%rip),%xmm8 # 5db0 <_sk_callback_sse41+0xddc>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -25393,24 +25490,24 @@ _sk_store_4444_sse41:
.byte 102,69,15,86,193 // orpd %xmm9,%xmm8
.byte 102,69,15,86,194 // orpd %xmm10,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3666 <_sk_store_4444_sse41+0x73>
- .byte 242,68,15,17,4,120 // movsd %xmm8,(%rax,%rdi,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 369c <_sk_store_4444_sse41+0x73>
+ .byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,69,15,56,51,192 // pmovzxwd %xmm8,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,30 // je 3697 <_sk_store_4444_sse41+0xa4>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,15 // je 368e <_sk_store_4444_sse41+0x9b>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,221 // jne 3662 <_sk_store_4444_sse41+0x6f>
- .byte 102,68,15,58,21,68,120,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdi,2)
- .byte 102,68,15,58,21,68,120,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdi,2)
- .byte 102,68,15,58,21,4,120,0 // pextrw $0x0,%xmm8,(%rax,%rdi,2)
- .byte 235,193 // jmp 3662 <_sk_store_4444_sse41+0x6f>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,30 // je 36cd <_sk_store_4444_sse41+0xa4>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,15 // je 36c4 <_sk_store_4444_sse41+0x9b>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,221 // jne 3698 <_sk_store_4444_sse41+0x6f>
+ .byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
+ .byte 102,68,15,58,21,68,80,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdx,2)
+ .byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2)
+ .byte 235,193 // jmp 3698 <_sk_store_4444_sse41+0x6f>
HIDDEN _sk_load_8888_sse41
.globl _sk_load_8888_sse41
@@ -25418,20 +25515,20 @@ FUNCTION(_sk_load_8888_sse41)
_sk_load_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,88 // jne 3703 <_sk_load_8888_sse41+0x62>
- .byte 243,15,111,28,184 // movdqu (%rax,%rdi,4),%xmm3
- .byte 102,15,111,5,184,38,0,0 // movdqa 0x26b8(%rip),%xmm0 # 5d70 <_sk_callback_sse41+0xddd>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,88 // jne 3739 <_sk_load_8888_sse41+0x62>
+ .byte 243,15,111,28,144 // movdqu (%rax,%rdx,4),%xmm3
+ .byte 102,15,111,5,210,38,0,0 // movdqa 0x26d2(%rip),%xmm0 # 5dc0 <_sk_callback_sse41+0xdec>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,185,38,0,0 // movaps 0x26b9(%rip),%xmm8 # 5d80 <_sk_callback_sse41+0xded>
+ .byte 68,15,40,5,211,38,0,0 // movaps 0x26d3(%rip),%xmm8 # 5dd0 <_sk_callback_sse41+0xdfc>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,184,38,0,0 // pshufb 0x26b8(%rip),%xmm1 # 5d90 <_sk_callback_sse41+0xdfd>
+ .byte 102,15,56,0,13,210,38,0,0 // pshufb 0x26d2(%rip),%xmm1 # 5de0 <_sk_callback_sse41+0xe0c>
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,180,38,0,0 // pshufb 0x26b4(%rip),%xmm2 # 5da0 <_sk_callback_sse41+0xe0d>
+ .byte 102,15,56,0,21,206,38,0,0 // pshufb 0x26ce(%rip),%xmm2 # 5df0 <_sk_callback_sse41+0xe1c>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -25439,27 +25536,28 @@ _sk_load_8888_sse41:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,31 // je 3733 <_sk_load_8888_sse41+0x92>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,17 // je 372b <_sk_load_8888_sse41+0x8a>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,144 // jne 36b0 <_sk_load_8888_sse41+0xf>
- .byte 102,15,110,68,184,8 // movd 0x8(%rax,%rdi,4),%xmm0
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,31 // je 3769 <_sk_load_8888_sse41+0x92>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,17 // je 3761 <_sk_load_8888_sse41+0x8a>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,144 // jne 36e6 <_sk_load_8888_sse41+0xf>
+ .byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
- .byte 102,15,58,34,92,184,4,1 // pinsrd $0x1,0x4(%rax,%rdi,4),%xmm3
- .byte 102,15,58,34,28,184,0 // pinsrd $0x0,(%rax,%rdi,4),%xmm3
- .byte 233,113,255,255,255 // jmpq 36b0 <_sk_load_8888_sse41+0xf>
+ .byte 102,15,58,34,92,144,4,1 // pinsrd $0x1,0x4(%rax,%rdx,4),%xmm3
+ .byte 102,15,58,34,28,144,0 // pinsrd $0x0,(%rax,%rdx,4),%xmm3
+ .byte 233,113,255,255,255 // jmpq 36e6 <_sk_load_8888_sse41+0xf>
HIDDEN _sk_gather_8888_sse41
.globl _sk_gather_8888_sse41
FUNCTION(_sk_gather_8888_sse41)
_sk_gather_8888_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25467,32 +25565,33 @@ _sk_gather_8888_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,58,22,194,1 // pextrq $0x1,%xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,110,28,136 // movd (%r8,%r9,4),%xmm3
- .byte 102,65,15,58,34,28,128,1 // pinsrd $0x1,(%r8,%rax,4),%xmm3
- .byte 102,67,15,58,34,28,152,2 // pinsrd $0x2,(%r8,%r11,4),%xmm3
- .byte 102,67,15,58,34,28,144,3 // pinsrd $0x3,(%r8,%r10,4),%xmm3
- .byte 102,15,111,5,17,38,0,0 // movdqa 0x2611(%rip),%xmm0 # 5db0 <_sk_callback_sse41+0xe1d>
+ .byte 102,73,15,58,22,195,1 // pextrq $0x1,%xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,67,15,110,28,145 // movd (%r9,%r10,4),%xmm3
+ .byte 102,65,15,58,34,28,129,1 // pinsrd $0x1,(%r9,%rax,4),%xmm3
+ .byte 102,65,15,58,34,28,153,2 // pinsrd $0x2,(%r9,%rbx,4),%xmm3
+ .byte 102,67,15,58,34,28,153,3 // pinsrd $0x3,(%r9,%r11,4),%xmm3
+ .byte 102,15,111,5,42,38,0,0 // movdqa 0x262a(%rip),%xmm0 # 5e00 <_sk_callback_sse41+0xe2c>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,18,38,0,0 // movaps 0x2612(%rip),%xmm8 # 5dc0 <_sk_callback_sse41+0xe2d>
+ .byte 68,15,40,5,43,38,0,0 // movaps 0x262b(%rip),%xmm8 # 5e10 <_sk_callback_sse41+0xe3c>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,17,38,0,0 // pshufb 0x2611(%rip),%xmm1 # 5dd0 <_sk_callback_sse41+0xe3d>
+ .byte 102,15,56,0,13,42,38,0,0 // pshufb 0x262a(%rip),%xmm1 # 5e20 <_sk_callback_sse41+0xe4c>
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,13,38,0,0 // pshufb 0x260d(%rip),%xmm2 # 5de0 <_sk_callback_sse41+0xe4d>
+ .byte 102,15,56,0,21,38,38,0,0 // pshufb 0x2626(%rip),%xmm2 # 5e30 <_sk_callback_sse41+0xe5c>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_8888_sse41
@@ -25501,7 +25600,7 @@ FUNCTION(_sk_store_8888_sse41)
_sk_store_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,249,37,0,0 // movaps 0x25f9(%rip),%xmm8 # 5df0 <_sk_callback_sse41+0xe5d>
+ .byte 68,15,40,5,17,38,0,0 // movaps 0x2611(%rip),%xmm8 # 5e40 <_sk_callback_sse41+0xe6c>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -25519,23 +25618,23 @@ _sk_store_8888_sse41:
.byte 102,65,15,114,240,24 // pslld $0x18,%xmm8
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3857 <_sk_store_8888_sse41+0x6d>
- .byte 243,68,15,127,4,184 // movdqu %xmm8,(%rax,%rdi,4)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,30 // je 3882 <_sk_store_8888_sse41+0x98>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,15 // je 3879 <_sk_store_8888_sse41+0x8f>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,227 // jne 3853 <_sk_store_8888_sse41+0x69>
- .byte 102,68,15,58,22,68,184,8,2 // pextrd $0x2,%xmm8,0x8(%rax,%rdi,4)
- .byte 102,68,15,58,22,68,184,4,1 // pextrd $0x1,%xmm8,0x4(%rax,%rdi,4)
- .byte 102,68,15,126,4,184 // movd %xmm8,(%rax,%rdi,4)
- .byte 235,201 // jmp 3853 <_sk_store_8888_sse41+0x69>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 388f <_sk_store_8888_sse41+0x6d>
+ .byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,30 // je 38ba <_sk_store_8888_sse41+0x98>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,15 // je 38b1 <_sk_store_8888_sse41+0x8f>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,227 // jne 388b <_sk_store_8888_sse41+0x69>
+ .byte 102,68,15,58,22,68,144,8,2 // pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
+ .byte 102,68,15,58,22,68,144,4,1 // pextrd $0x1,%xmm8,0x4(%rax,%rdx,4)
+ .byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
+ .byte 235,201 // jmp 388b <_sk_store_8888_sse41+0x69>
HIDDEN _sk_load_f16_sse41
.globl _sk_load_f16_sse41
@@ -25543,10 +25642,10 @@ FUNCTION(_sk_load_f16_sse41)
_sk_load_f16_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,60,1,0,0 // jne 39d4 <_sk_load_f16_sse41+0x14a>
- .byte 102,15,16,4,248 // movupd (%rax,%rdi,8),%xmm0
- .byte 243,15,111,76,248,16 // movdqu 0x10(%rax,%rdi,8),%xmm1
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,60,1,0,0 // jne 3a0c <_sk_load_f16_sse41+0x14a>
+ .byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0
+ .byte 243,15,111,76,208,16 // movdqu 0x10(%rax,%rdx,8),%xmm1
.byte 102,68,15,40,200 // movapd %xmm0,%xmm9
.byte 102,68,15,97,201 // punpcklwd %xmm1,%xmm9
.byte 102,15,105,193 // punpckhwd %xmm1,%xmm0
@@ -25554,18 +25653,18 @@ _sk_load_f16_sse41:
.byte 102,68,15,97,216 // punpcklwd %xmm0,%xmm11
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
.byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1
- .byte 102,68,15,111,5,49,37,0,0 // movdqa 0x2531(%rip),%xmm8 # 5e00 <_sk_callback_sse41+0xe6d>
+ .byte 102,68,15,111,5,73,37,0,0 // movdqa 0x2549(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0xe7c>
.byte 102,15,111,209 // movdqa %xmm1,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,239,202 // pxor %xmm2,%xmm1
- .byte 102,15,111,29,44,37,0,0 // movdqa 0x252c(%rip),%xmm3 # 5e10 <_sk_callback_sse41+0xe7d>
+ .byte 102,15,111,29,68,37,0,0 // movdqa 0x2544(%rip),%xmm3 # 5e60 <_sk_callback_sse41+0xe8c>
.byte 102,15,114,242,16 // pslld $0x10,%xmm2
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0
.byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0
.byte 102,15,114,241,13 // pslld $0xd,%xmm1
.byte 102,15,235,202 // por %xmm2,%xmm1
- .byte 102,68,15,111,21,24,37,0,0 // movdqa 0x2518(%rip),%xmm10 # 5e20 <_sk_callback_sse41+0xe8d>
+ .byte 102,68,15,111,21,48,37,0,0 // movdqa 0x2530(%rip),%xmm10 # 5e70 <_sk_callback_sse41+0xe9c>
.byte 102,65,15,254,202 // paddd %xmm10,%xmm1
.byte 102,15,219,193 // pand %xmm1,%xmm0
.byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11
@@ -25606,25 +25705,26 @@ _sk_load_f16_sse41:
.byte 102,65,15,219,217 // pand %xmm9,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 242,15,16,4,248 // movsd (%rax,%rdi,8),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,13 // jne 39ec <_sk_load_f16_sse41+0x162>
+ .byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,13 // jne 3a24 <_sk_load_f16_sse41+0x162>
.byte 243,15,126,192 // movq %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,183,254,255,255 // jmpq 38a3 <_sk_load_f16_sse41+0x19>
- .byte 102,15,22,68,248,8 // movhpd 0x8(%rax,%rdi,8),%xmm0
+ .byte 233,183,254,255,255 // jmpq 38db <_sk_load_f16_sse41+0x19>
+ .byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,163,254,255,255 // jb 38a3 <_sk_load_f16_sse41+0x19>
- .byte 243,15,126,76,248,16 // movq 0x10(%rax,%rdi,8),%xmm1
- .byte 233,152,254,255,255 // jmpq 38a3 <_sk_load_f16_sse41+0x19>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,163,254,255,255 // jb 38db <_sk_load_f16_sse41+0x19>
+ .byte 243,15,126,76,208,16 // movq 0x10(%rax,%rdx,8),%xmm1
+ .byte 233,152,254,255,255 // jmpq 38db <_sk_load_f16_sse41+0x19>
HIDDEN _sk_gather_f16_sse41
.globl _sk_gather_f16_sse41
FUNCTION(_sk_gather_f16_sse41)
_sk_gather_f16_sse41:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -25632,16 +25732,16 @@ _sk_gather_f16_sse41:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,194 // paddd %xmm2,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,58,22,194,1 // pextrq $0x1,%xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,126,4,208 // movq (%r8,%r10,8),%xmm0
- .byte 243,67,15,126,12,216 // movq (%r8,%r11,8),%xmm1
+ .byte 102,73,15,58,22,195,1 // pextrq $0x1,%xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,67,15,126,4,217 // movq (%r9,%r11,8),%xmm0
+ .byte 243,65,15,126,12,217 // movq (%r9,%rbx,8),%xmm1
.byte 102,15,108,200 // punpcklqdq %xmm0,%xmm1
- .byte 243,65,15,126,4,192 // movq (%r8,%rax,8),%xmm0
- .byte 243,67,15,126,20,200 // movq (%r8,%r9,8),%xmm2
+ .byte 243,65,15,126,4,193 // movq (%r9,%rax,8),%xmm0
+ .byte 243,67,15,126,20,209 // movq (%r9,%r10,8),%xmm2
.byte 102,15,108,208 // punpcklqdq %xmm0,%xmm2
.byte 102,68,15,111,202 // movdqa %xmm2,%xmm9
.byte 102,68,15,97,201 // punpcklwd %xmm1,%xmm9
@@ -25650,18 +25750,18 @@ _sk_gather_f16_sse41:
.byte 102,68,15,97,218 // punpcklwd %xmm2,%xmm11
.byte 102,68,15,105,202 // punpckhwd %xmm2,%xmm9
.byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1
- .byte 102,68,15,111,5,159,35,0,0 // movdqa 0x239f(%rip),%xmm8 # 5e30 <_sk_callback_sse41+0xe9d>
+ .byte 102,68,15,111,5,182,35,0,0 // movdqa 0x23b6(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0xeac>
.byte 102,15,111,209 // movdqa %xmm1,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,239,202 // pxor %xmm2,%xmm1
- .byte 102,15,111,29,154,35,0,0 // movdqa 0x239a(%rip),%xmm3 # 5e40 <_sk_callback_sse41+0xead>
+ .byte 102,15,111,29,177,35,0,0 // movdqa 0x23b1(%rip),%xmm3 # 5e90 <_sk_callback_sse41+0xebc>
.byte 102,15,114,242,16 // pslld $0x10,%xmm2
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0
.byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0
.byte 102,15,114,241,13 // pslld $0xd,%xmm1
.byte 102,15,235,202 // por %xmm2,%xmm1
- .byte 102,68,15,111,21,134,35,0,0 // movdqa 0x2386(%rip),%xmm10 # 5e50 <_sk_callback_sse41+0xebd>
+ .byte 102,68,15,111,21,157,35,0,0 // movdqa 0x239d(%rip),%xmm10 # 5ea0 <_sk_callback_sse41+0xecc>
.byte 102,65,15,254,202 // paddd %xmm10,%xmm1
.byte 102,15,219,193 // pand %xmm1,%xmm0
.byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11
@@ -25701,6 +25801,7 @@ _sk_gather_f16_sse41:
.byte 102,69,15,254,202 // paddd %xmm10,%xmm9
.byte 102,65,15,219,217 // pand %xmm9,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_f16_sse41
@@ -25709,17 +25810,17 @@ FUNCTION(_sk_store_f16_sse41)
_sk_store_f16_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 102,68,15,111,21,188,34,0,0 // movdqa 0x22bc(%rip),%xmm10 # 5e60 <_sk_callback_sse41+0xecd>
+ .byte 102,68,15,111,21,210,34,0,0 // movdqa 0x22d2(%rip),%xmm10 # 5eb0 <_sk_callback_sse41+0xedc>
.byte 102,68,15,111,216 // movdqa %xmm0,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,68,15,111,232 // movdqa %xmm0,%xmm13
.byte 102,69,15,239,235 // pxor %xmm11,%xmm13
- .byte 102,68,15,111,13,175,34,0,0 // movdqa 0x22af(%rip),%xmm9 # 5e70 <_sk_callback_sse41+0xedd>
+ .byte 102,68,15,111,13,197,34,0,0 // movdqa 0x22c5(%rip),%xmm9 # 5ec0 <_sk_callback_sse41+0xeec>
.byte 102,65,15,114,211,16 // psrld $0x10,%xmm11
.byte 102,69,15,111,193 // movdqa %xmm9,%xmm8
.byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8
.byte 102,65,15,114,213,13 // psrld $0xd,%xmm13
- .byte 102,68,15,111,37,160,34,0,0 // movdqa 0x22a0(%rip),%xmm12 # 5e80 <_sk_callback_sse41+0xeed>
+ .byte 102,68,15,111,37,182,34,0,0 // movdqa 0x22b6(%rip),%xmm12 # 5ed0 <_sk_callback_sse41+0xefc>
.byte 102,69,15,235,220 // por %xmm12,%xmm11
.byte 102,69,15,254,221 // paddd %xmm13,%xmm11
.byte 102,69,15,223,195 // pandn %xmm11,%xmm8
@@ -25762,34 +25863,34 @@ _sk_store_f16_sse41:
.byte 102,69,15,97,217 // punpcklwd %xmm9,%xmm11
.byte 102,69,15,111,200 // movdqa %xmm8,%xmm9
.byte 102,69,15,98,203 // punpckldq %xmm11,%xmm9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,21 // jne 3cd6 <_sk_store_f16_sse41+0x140>
- .byte 68,15,17,12,248 // movups %xmm9,(%rax,%rdi,8)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,21 // jne 3d10 <_sk_store_f16_sse41+0x140>
+ .byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8)
.byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8
- .byte 243,68,15,127,68,248,16 // movdqu %xmm8,0x10(%rax,%rdi,8)
+ .byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 102,68,15,214,12,248 // movq %xmm9,(%rax,%rdi,8)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 3cd2 <_sk_store_f16_sse41+0x13c>
- .byte 102,68,15,23,76,248,8 // movhpd %xmm9,0x8(%rax,%rdi,8)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 3cd2 <_sk_store_f16_sse41+0x13c>
+ .byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 3d0c <_sk_store_f16_sse41+0x13c>
+ .byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 3d0c <_sk_store_f16_sse41+0x13c>
.byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8
- .byte 102,68,15,214,68,248,16 // movq %xmm8,0x10(%rax,%rdi,8)
- .byte 235,213 // jmp 3cd2 <_sk_store_f16_sse41+0x13c>
+ .byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8)
+ .byte 235,213 // jmp 3d0c <_sk_store_f16_sse41+0x13c>
HIDDEN _sk_load_u16_be_sse41
.globl _sk_load_u16_be_sse41
FUNCTION(_sk_load_u16_be_sse41)
_sk_load_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,185,0,0,0 // jne 3dcc <_sk_load_u16_be_sse41+0xcf>
- .byte 102,65,15,16,4,64 // movupd (%r8,%rax,2),%xmm0
- .byte 243,65,15,111,76,64,16 // movdqu 0x10(%r8,%rax,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,185,0,0,0 // jne 3e06 <_sk_load_u16_be_sse41+0xcf>
+ .byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0
+ .byte 243,65,15,111,76,65,16 // movdqu 0x10(%r9,%rax,2),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
.byte 102,15,97,209 // punpcklwd %xmm1,%xmm2
.byte 102,15,105,193 // punpckhwd %xmm1,%xmm0
@@ -25803,7 +25904,7 @@ _sk_load_u16_be_sse41:
.byte 102,15,235,200 // por %xmm0,%xmm1
.byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,49,33,0,0 // movaps 0x2131(%rip),%xmm8 # 5e90 <_sk_callback_sse41+0xefd>
+ .byte 68,15,40,5,71,33,0,0 // movaps 0x2147(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xf0c>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -25829,30 +25930,30 @@ _sk_load_u16_be_sse41:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 242,65,15,16,4,64 // movsd (%r8,%rax,2),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,13 // jne 3de5 <_sk_load_u16_be_sse41+0xe8>
+ .byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,13 // jne 3e1f <_sk_load_u16_be_sse41+0xe8>
.byte 243,15,126,192 // movq %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,59,255,255,255 // jmpq 3d20 <_sk_load_u16_be_sse41+0x23>
- .byte 102,65,15,22,68,64,8 // movhpd 0x8(%r8,%rax,2),%xmm0
+ .byte 233,59,255,255,255 // jmpq 3d5a <_sk_load_u16_be_sse41+0x23>
+ .byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,38,255,255,255 // jb 3d20 <_sk_load_u16_be_sse41+0x23>
- .byte 243,65,15,126,76,64,16 // movq 0x10(%r8,%rax,2),%xmm1
- .byte 233,26,255,255,255 // jmpq 3d20 <_sk_load_u16_be_sse41+0x23>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,38,255,255,255 // jb 3d5a <_sk_load_u16_be_sse41+0x23>
+ .byte 243,65,15,126,76,65,16 // movq 0x10(%r9,%rax,2),%xmm1
+ .byte 233,26,255,255,255 // jmpq 3d5a <_sk_load_u16_be_sse41+0x23>
HIDDEN _sk_load_rgb_u16_be_sse41
.globl _sk_load_rgb_u16_be_sse41
FUNCTION(_sk_load_rgb_u16_be_sse41)
_sk_load_rgb_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,127 // lea (%rdi,%rdi,2),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,170,0,0,0 // jne 3ec2 <_sk_load_rgb_u16_be_sse41+0xbc>
- .byte 243,65,15,111,20,64 // movdqu (%r8,%rax,2),%xmm2
- .byte 243,65,15,111,92,64,8 // movdqu 0x8(%r8,%rax,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,170,0,0,0 // jne 3efc <_sk_load_rgb_u16_be_sse41+0xbc>
+ .byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2
+ .byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3
.byte 102,15,115,219,4 // psrldq $0x4,%xmm3
.byte 102,15,111,194 // movdqa %xmm2,%xmm0
.byte 102,15,115,216,6 // psrldq $0x6,%xmm0
@@ -25870,7 +25971,7 @@ _sk_load_rgb_u16_be_sse41:
.byte 102,15,235,200 // por %xmm0,%xmm1
.byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,41,32,0,0 // movaps 0x2029(%rip),%xmm8 # 5ea0 <_sk_callback_sse41+0xf0d>
+ .byte 68,15,40,5,63,32,0,0 // movaps 0x203f(%rip),%xmm8 # 5ef0 <_sk_callback_sse41+0xf1c>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -25887,36 +25988,36 @@ _sk_load_rgb_u16_be_sse41:
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,240,31,0,0 // movaps 0x1ff0(%rip),%xmm3 # 5eb0 <_sk_callback_sse41+0xf1d>
+ .byte 15,40,29,6,32,0,0 // movaps 0x2006(%rip),%xmm3 # 5f00 <_sk_callback_sse41+0xf2c>
.byte 255,224 // jmpq *%rax
- .byte 102,65,15,110,20,64 // movd (%r8,%rax,2),%xmm2
- .byte 102,65,15,196,84,64,4,2 // pinsrw $0x2,0x4(%r8,%rax,2),%xmm2
+ .byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2
+ .byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,13 // jne 3ee7 <_sk_load_rgb_u16_be_sse41+0xe1>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,13 // jne 3f21 <_sk_load_rgb_u16_be_sse41+0xe1>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,85,255,255,255 // jmpq 3e3c <_sk_load_rgb_u16_be_sse41+0x36>
- .byte 102,65,15,110,68,64,6 // movd 0x6(%r8,%rax,2),%xmm0
- .byte 102,65,15,196,68,64,10,2 // pinsrw $0x2,0xa(%r8,%rax,2),%xmm0
+ .byte 233,85,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0
+ .byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,24 // jb 3f18 <_sk_load_rgb_u16_be_sse41+0x112>
- .byte 102,65,15,110,92,64,12 // movd 0xc(%r8,%rax,2),%xmm3
- .byte 102,65,15,196,92,64,16,2 // pinsrw $0x2,0x10(%r8,%rax,2),%xmm3
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,24 // jb 3f52 <_sk_load_rgb_u16_be_sse41+0x112>
+ .byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3
+ .byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,36,255,255,255 // jmpq 3e3c <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 233,36,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 233,27,255,255,255 // jmpq 3e3c <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 233,27,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36>
HIDDEN _sk_store_u16_be_sse41
.globl _sk_store_u16_be_sse41
FUNCTION(_sk_store_u16_be_sse41)
_sk_store_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 68,15,40,21,138,31,0,0 // movaps 0x1f8a(%rip),%xmm10 # 5ec0 <_sk_callback_sse41+0xf2d>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 68,15,40,21,160,31,0,0 // movaps 0x1fa0(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0xf3c>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
@@ -25952,38 +26053,38 @@ _sk_store_u16_be_sse41:
.byte 102,69,15,97,202 // punpcklwd %xmm10,%xmm9
.byte 102,69,15,111,208 // movdqa %xmm8,%xmm10
.byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,21 // jne 4004 <_sk_store_u16_be_sse41+0xe3>
- .byte 69,15,17,20,64 // movups %xmm10,(%r8,%rax,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,21 // jne 403e <_sk_store_u16_be_sse41+0xe3>
+ .byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2)
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
- .byte 243,69,15,127,68,64,16 // movdqu %xmm8,0x10(%r8,%rax,2)
+ .byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 102,69,15,214,20,64 // movq %xmm10,(%r8,%rax,2)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 4000 <_sk_store_u16_be_sse41+0xdf>
- .byte 102,69,15,23,84,64,8 // movhpd %xmm10,0x8(%r8,%rax,2)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 4000 <_sk_store_u16_be_sse41+0xdf>
+ .byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 403a <_sk_store_u16_be_sse41+0xdf>
+ .byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 403a <_sk_store_u16_be_sse41+0xdf>
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
- .byte 102,69,15,214,68,64,16 // movq %xmm8,0x10(%r8,%rax,2)
- .byte 235,213 // jmp 4000 <_sk_store_u16_be_sse41+0xdf>
+ .byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2)
+ .byte 235,213 // jmp 403a <_sk_store_u16_be_sse41+0xdf>
HIDDEN _sk_load_f32_sse41
.globl _sk_load_f32_sse41
FUNCTION(_sk_load_f32_sse41)
_sk_load_f32_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%r8
- .byte 72,137,248 // mov %rdi,%rax
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 76,141,12,149,0,0,0,0 // lea 0x0(,%rdx,4),%r9
+ .byte 72,137,208 // mov %rdx,%rax
.byte 72,193,224,4 // shl $0x4,%rax
- .byte 69,15,16,4,1 // movups (%r9,%rax,1),%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,66 // jne 408b <_sk_load_f32_sse41+0x60>
- .byte 67,15,16,68,129,16 // movups 0x10(%r9,%r8,4),%xmm0
- .byte 67,15,16,92,129,32 // movups 0x20(%r9,%r8,4),%xmm3
- .byte 71,15,16,76,129,48 // movups 0x30(%r9,%r8,4),%xmm9
+ .byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,66 // jne 40c5 <_sk_load_f32_sse41+0x60>
+ .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
+ .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
+ .byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
.byte 65,15,40,208 // movaps %xmm8,%xmm2
.byte 15,20,208 // unpcklps %xmm0,%xmm2
.byte 15,40,203 // movaps %xmm3,%xmm1
@@ -25999,27 +26100,27 @@ _sk_load_f32_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,8 // jne 409d <_sk_load_f32_sse41+0x72>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,8 // jne 40d7 <_sk_load_f32_sse41+0x72>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
- .byte 235,190 // jmp 405b <_sk_load_f32_sse41+0x30>
- .byte 67,15,16,68,129,16 // movups 0x10(%r9,%r8,4),%xmm0
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,8 // jb 40b1 <_sk_load_f32_sse41+0x86>
- .byte 67,15,16,92,129,32 // movups 0x20(%r9,%r8,4),%xmm3
- .byte 235,170 // jmp 405b <_sk_load_f32_sse41+0x30>
+ .byte 235,190 // jmp 4095 <_sk_load_f32_sse41+0x30>
+ .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,8 // jb 40eb <_sk_load_f32_sse41+0x86>
+ .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
+ .byte 235,170 // jmp 4095 <_sk_load_f32_sse41+0x30>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 235,165 // jmp 405b <_sk_load_f32_sse41+0x30>
+ .byte 235,165 // jmp 4095 <_sk_load_f32_sse41+0x30>
HIDDEN _sk_store_f32_sse41
.globl _sk_store_f32_sse41
FUNCTION(_sk_store_f32_sse41)
_sk_store_f32_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%r8
- .byte 72,137,248 // mov %rdi,%rax
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 76,141,12,149,0,0,0,0 // lea 0x0(,%rdx,4),%r9
+ .byte 72,137,208 // mov %rdx,%rax
.byte 72,193,224,4 // shl $0x4,%rax
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 68,15,20,201 // unpcklps %xmm1,%xmm9
@@ -26034,22 +26135,22 @@ _sk_store_f32_sse41:
.byte 69,15,18,193 // movhlps %xmm9,%xmm8
.byte 69,15,40,202 // movaps %xmm10,%xmm9
.byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9
- .byte 102,69,15,17,36,1 // movupd %xmm12,(%r9,%rax,1)
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,29 // jne 4128 <_sk_store_f32_sse41+0x72>
+ .byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,29 // jne 4162 <_sk_store_f32_sse41+0x72>
.byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10
- .byte 71,15,17,68,129,16 // movups %xmm8,0x10(%r9,%r8,4)
- .byte 102,71,15,17,76,129,32 // movupd %xmm9,0x20(%r9,%r8,4)
- .byte 102,71,15,17,84,129,48 // movupd %xmm10,0x30(%r9,%r8,4)
+ .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
+ .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
+ .byte 102,71,15,17,84,138,48 // movupd %xmm10,0x30(%r10,%r9,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,246 // je 4124 <_sk_store_f32_sse41+0x6e>
- .byte 71,15,17,68,129,16 // movups %xmm8,0x10(%r9,%r8,4)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,234 // jb 4124 <_sk_store_f32_sse41+0x6e>
- .byte 102,71,15,17,76,129,32 // movupd %xmm9,0x20(%r9,%r8,4)
- .byte 235,225 // jmp 4124 <_sk_store_f32_sse41+0x6e>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,246 // je 415e <_sk_store_f32_sse41+0x6e>
+ .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,234 // jb 415e <_sk_store_f32_sse41+0x6e>
+ .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
+ .byte 235,225 // jmp 415e <_sk_store_f32_sse41+0x6e>
HIDDEN _sk_clamp_x_sse41
.globl _sk_clamp_x_sse41
@@ -26161,7 +26262,7 @@ FUNCTION(_sk_clamp_x_1_sse41)
_sk_clamp_x_1_sse41:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,97,28,0,0 // minps 0x1c61(%rip),%xmm8 # 5ed0 <_sk_callback_sse41+0xf3d>
+ .byte 68,15,93,5,119,28,0,0 // minps 0x1c77(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0xf4c>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -26179,9 +26280,9 @@ HIDDEN _sk_mirror_x_1_sse41
.globl _sk_mirror_x_1_sse41
FUNCTION(_sk_mirror_x_1_sse41)
_sk_mirror_x_1_sse41:
- .byte 68,15,40,5,82,28,0,0 // movaps 0x1c52(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xf4d>
+ .byte 68,15,40,5,104,28,0,0 // movaps 0x1c68(%rip),%xmm8 # 5f30 <_sk_callback_sse41+0xf5c>
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,13,86,28,0,0 // movaps 0x1c56(%rip),%xmm9 # 5ef0 <_sk_callback_sse41+0xf5d>
+ .byte 68,15,40,13,108,28,0,0 // movaps 0x1c6c(%rip),%xmm9 # 5f40 <_sk_callback_sse41+0xf6c>
.byte 68,15,89,200 // mulps %xmm0,%xmm9
.byte 102,69,15,58,8,201,1 // roundps $0x1,%xmm9,%xmm9
.byte 69,15,88,201 // addps %xmm9,%xmm9
@@ -26198,10 +26299,10 @@ HIDDEN _sk_luminance_to_alpha_sse41
FUNCTION(_sk_luminance_to_alpha_sse41)
_sk_luminance_to_alpha_sse41:
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 15,89,5,53,28,0,0 // mulps 0x1c35(%rip),%xmm0 # 5f00 <_sk_callback_sse41+0xf6d>
- .byte 15,89,13,62,28,0,0 // mulps 0x1c3e(%rip),%xmm1 # 5f10 <_sk_callback_sse41+0xf7d>
+ .byte 15,89,5,75,28,0,0 // mulps 0x1c4b(%rip),%xmm0 # 5f50 <_sk_callback_sse41+0xf7c>
+ .byte 15,89,13,84,28,0,0 // mulps 0x1c54(%rip),%xmm1 # 5f60 <_sk_callback_sse41+0xf8c>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,29,68,28,0,0 // mulps 0x1c44(%rip),%xmm3 # 5f20 <_sk_callback_sse41+0xf8d>
+ .byte 15,89,29,90,28,0,0 // mulps 0x1c5a(%rip),%xmm3 # 5f70 <_sk_callback_sse41+0xf9c>
.byte 15,88,217 // addps %xmm1,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
@@ -26473,84 +26574,85 @@ HIDDEN _sk_evenly_spaced_gradient_sse41
.globl _sk_evenly_spaced_gradient_sse41
FUNCTION(_sk_evenly_spaced_gradient_sse41)
_sk_evenly_spaced_gradient_sse41:
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,24 // mov (%rax),%rbx
.byte 76,139,112,8 // mov 0x8(%rax),%r14
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 4718 <_sk_evenly_spaced_gradient_sse41+0x18>
+ .byte 120,7 // js 4754 <_sk_evenly_spaced_gradient_sse41+0x1a>
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
- .byte 235,21 // jmp 472d <_sk_evenly_spaced_gradient_sse41+0x2d>
- .byte 73,137,216 // mov %rbx,%r8
- .byte 73,209,232 // shr %r8
+ .byte 235,21 // jmp 4769 <_sk_evenly_spaced_gradient_sse41+0x2f>
+ .byte 73,137,217 // mov %rbx,%r9
+ .byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
- .byte 76,9,195 // or %r8,%rbx
+ .byte 76,9,203 // or %r9,%rbx
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
.byte 243,15,88,201 // addss %xmm1,%xmm1
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
.byte 15,89,200 // mulps %xmm0,%xmm1
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,73,15,58,22,200,1 // pextrq $0x1,%xmm1,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 102,73,15,126,202 // movq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,71,15,16,4,158 // movss (%r14,%r11,4),%xmm8
- .byte 102,71,15,58,33,4,150,16 // insertps $0x10,(%r14,%r10,4),%xmm8
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
+ .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 69,137,223 // mov %r11d,%r15d
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,71,15,16,4,190 // movss (%r14,%r15,4),%xmm8
+ .byte 102,71,15,58,33,4,158,16 // insertps $0x10,(%r14,%r11,4),%xmm8
+ .byte 243,67,15,16,12,150 // movss (%r14,%r10,4),%xmm1
.byte 102,68,15,58,33,193,32 // insertps $0x20,%xmm1,%xmm8
- .byte 243,67,15,16,12,134 // movss (%r14,%r8,4),%xmm1
+ .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
.byte 102,68,15,58,33,193,48 // insertps $0x30,%xmm1,%xmm8
.byte 72,139,88,40 // mov 0x28(%rax),%rbx
- .byte 243,70,15,16,12,155 // movss (%rbx,%r11,4),%xmm9
- .byte 102,70,15,58,33,12,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm9
- .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
+ .byte 243,70,15,16,12,187 // movss (%rbx,%r15,4),%xmm9
+ .byte 102,70,15,58,33,12,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm9
+ .byte 243,66,15,16,12,147 // movss (%rbx,%r10,4),%xmm1
.byte 102,68,15,58,33,201,32 // insertps $0x20,%xmm1,%xmm9
- .byte 243,66,15,16,12,131 // movss (%rbx,%r8,4),%xmm1
+ .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
.byte 102,68,15,58,33,201,48 // insertps $0x30,%xmm1,%xmm9
.byte 72,139,88,16 // mov 0x10(%rax),%rbx
- .byte 243,66,15,16,12,155 // movss (%rbx,%r11,4),%xmm1
- .byte 102,66,15,58,33,12,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm1
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
+ .byte 243,66,15,16,12,187 // movss (%rbx,%r15,4),%xmm1
+ .byte 102,66,15,58,33,12,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm1
+ .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
.byte 102,15,58,33,202,32 // insertps $0x20,%xmm2,%xmm1
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
.byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1
.byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 243,70,15,16,20,155 // movss (%rbx,%r11,4),%xmm10
- .byte 102,70,15,58,33,20,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm10
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
+ .byte 243,70,15,16,20,187 // movss (%rbx,%r15,4),%xmm10
+ .byte 102,70,15,58,33,20,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm10
+ .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
.byte 102,68,15,58,33,210,32 // insertps $0x20,%xmm2,%xmm10
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
.byte 102,68,15,58,33,210,48 // insertps $0x30,%xmm2,%xmm10
.byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
- .byte 102,66,15,58,33,20,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm2
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
+ .byte 243,66,15,16,20,187 // movss (%rbx,%r15,4),%xmm2
+ .byte 102,66,15,58,33,20,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm2
+ .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
.byte 102,15,58,33,211,32 // insertps $0x20,%xmm3,%xmm2
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 243,70,15,16,28,155 // movss (%rbx,%r11,4),%xmm11
- .byte 102,70,15,58,33,28,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm11
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
+ .byte 243,70,15,16,28,187 // movss (%rbx,%r15,4),%xmm11
+ .byte 102,70,15,58,33,28,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm11
+ .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
.byte 102,68,15,58,33,219,32 // insertps $0x20,%xmm3,%xmm11
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
.byte 102,68,15,58,33,219,48 // insertps $0x30,%xmm3,%xmm11
.byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 243,66,15,16,28,155 // movss (%rbx,%r11,4),%xmm3
- .byte 102,66,15,58,33,28,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm3
- .byte 243,70,15,16,36,139 // movss (%rbx,%r9,4),%xmm12
+ .byte 243,66,15,16,28,187 // movss (%rbx,%r15,4),%xmm3
+ .byte 102,66,15,58,33,28,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm3
+ .byte 243,70,15,16,36,147 // movss (%rbx,%r10,4),%xmm12
.byte 102,65,15,58,33,220,32 // insertps $0x20,%xmm12,%xmm3
- .byte 243,70,15,16,36,131 // movss (%rbx,%r8,4),%xmm12
+ .byte 243,70,15,16,36,139 // movss (%rbx,%r9,4),%xmm12
.byte 102,65,15,58,33,220,48 // insertps $0x30,%xmm12,%xmm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 243,70,15,16,36,152 // movss (%rax,%r11,4),%xmm12
- .byte 102,70,15,58,33,36,144,16 // insertps $0x10,(%rax,%r10,4),%xmm12
- .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
+ .byte 243,70,15,16,36,184 // movss (%rax,%r15,4),%xmm12
+ .byte 102,70,15,58,33,36,152,16 // insertps $0x10,(%rax,%r11,4),%xmm12
+ .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
.byte 102,69,15,58,33,229,32 // insertps $0x20,%xmm13,%xmm12
- .byte 243,70,15,16,44,128 // movss (%rax,%r8,4),%xmm13
+ .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
.byte 102,69,15,58,33,229,48 // insertps $0x30,%xmm13,%xmm12
.byte 68,15,89,192 // mulps %xmm0,%xmm8
.byte 69,15,88,193 // addps %xmm9,%xmm8
@@ -26564,21 +26666,22 @@ _sk_evenly_spaced_gradient_sse41:
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
HIDDEN _sk_gauss_a_to_rgba_sse41
.globl _sk_gauss_a_to_rgba_sse41
FUNCTION(_sk_gauss_a_to_rgba_sse41)
_sk_gauss_a_to_rgba_sse41:
- .byte 15,40,5,87,22,0,0 // movaps 0x1657(%rip),%xmm0 # 5f30 <_sk_callback_sse41+0xf9d>
+ .byte 15,40,5,105,22,0,0 // movaps 0x1669(%rip),%xmm0 # 5f80 <_sk_callback_sse41+0xfac>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,93,22,0,0 // addps 0x165d(%rip),%xmm0 # 5f40 <_sk_callback_sse41+0xfad>
+ .byte 15,88,5,111,22,0,0 // addps 0x166f(%rip),%xmm0 # 5f90 <_sk_callback_sse41+0xfbc>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,99,22,0,0 // addps 0x1663(%rip),%xmm0 # 5f50 <_sk_callback_sse41+0xfbd>
+ .byte 15,88,5,117,22,0,0 // addps 0x1675(%rip),%xmm0 # 5fa0 <_sk_callback_sse41+0xfcc>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,105,22,0,0 // addps 0x1669(%rip),%xmm0 # 5f60 <_sk_callback_sse41+0xfcd>
+ .byte 15,88,5,123,22,0,0 // addps 0x167b(%rip),%xmm0 # 5fb0 <_sk_callback_sse41+0xfdc>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,111,22,0,0 // addps 0x166f(%rip),%xmm0 # 5f70 <_sk_callback_sse41+0xfdd>
+ .byte 15,88,5,129,22,0,0 // addps 0x1681(%rip),%xmm0 # 5fc0 <_sk_callback_sse41+0xfec>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
@@ -26589,87 +26692,88 @@ HIDDEN _sk_gradient_sse41
.globl _sk_gradient_sse41
FUNCTION(_sk_gradient_sse41)
_sk_gradient_sse41:
+ .byte 65,87 // push %r15
+ .byte 65,86 // push %r14
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 73,131,248,2 // cmp $0x2,%r8
- .byte 114,51 // jb 4950 <_sk_gradient_sse41+0x42>
- .byte 76,139,72,72 // mov 0x48(%rax),%r9
- .byte 73,255,200 // dec %r8
- .byte 73,131,193,4 // add $0x4,%r9
+ .byte 73,131,249,2 // cmp $0x2,%r9
+ .byte 114,50 // jb 4992 <_sk_gradient_sse41+0x46>
+ .byte 72,139,88,72 // mov 0x48(%rax),%rbx
+ .byte 73,255,201 // dec %r9
+ .byte 72,131,195,4 // add $0x4,%rbx
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 15,40,21,77,22,0,0 // movaps 0x164d(%rip),%xmm2 # 5f80 <_sk_callback_sse41+0xfed>
- .byte 243,65,15,16,25 // movss (%r9),%xmm3
+ .byte 15,40,21,90,22,0,0 // movaps 0x165a(%rip),%xmm2 # 5fd0 <_sk_callback_sse41+0xffc>
+ .byte 243,15,16,27 // movss (%rbx),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
.byte 15,84,218 // andps %xmm2,%xmm3
.byte 102,15,254,203 // paddd %xmm3,%xmm1
- .byte 73,131,193,4 // add $0x4,%r9
- .byte 73,255,200 // dec %r8
- .byte 117,227 // jne 4933 <_sk_gradient_sse41+0x25>
- .byte 65,86 // push %r14
- .byte 83 // push %rbx
- .byte 102,73,15,58,22,200,1 // pextrq $0x1,%xmm1,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 102,73,15,126,202 // movq %xmm1,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 72,131,195,4 // add $0x4,%rbx
+ .byte 73,255,201 // dec %r9
+ .byte 117,228 // jne 4976 <_sk_gradient_sse41+0x2a>
+ .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 69,137,222 // mov %r11d,%r14d
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,70,15,16,4,155 // movss (%rbx,%r11,4),%xmm8
- .byte 102,70,15,58,33,4,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm8
- .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,70,15,16,4,179 // movss (%rbx,%r14,4),%xmm8
+ .byte 102,70,15,58,33,4,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm8
+ .byte 243,66,15,16,12,147 // movss (%rbx,%r10,4),%xmm1
.byte 102,68,15,58,33,193,32 // insertps $0x20,%xmm1,%xmm8
- .byte 243,66,15,16,12,131 // movss (%rbx,%r8,4),%xmm1
+ .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
.byte 102,68,15,58,33,193,48 // insertps $0x30,%xmm1,%xmm8
.byte 72,139,88,40 // mov 0x28(%rax),%rbx
- .byte 243,70,15,16,12,155 // movss (%rbx,%r11,4),%xmm9
- .byte 102,70,15,58,33,12,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm9
- .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
+ .byte 243,70,15,16,12,179 // movss (%rbx,%r14,4),%xmm9
+ .byte 102,70,15,58,33,12,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm9
+ .byte 243,66,15,16,12,147 // movss (%rbx,%r10,4),%xmm1
.byte 102,68,15,58,33,201,32 // insertps $0x20,%xmm1,%xmm9
- .byte 243,66,15,16,12,131 // movss (%rbx,%r8,4),%xmm1
+ .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
.byte 102,68,15,58,33,201,48 // insertps $0x30,%xmm1,%xmm9
- .byte 243,67,15,16,12,158 // movss (%r14,%r11,4),%xmm1
- .byte 102,67,15,58,33,12,150,16 // insertps $0x10,(%r14,%r10,4),%xmm1
- .byte 243,67,15,16,20,142 // movss (%r14,%r9,4),%xmm2
+ .byte 243,67,15,16,12,183 // movss (%r15,%r14,4),%xmm1
+ .byte 102,67,15,58,33,12,159,16 // insertps $0x10,(%r15,%r11,4),%xmm1
+ .byte 243,67,15,16,20,151 // movss (%r15,%r10,4),%xmm2
.byte 102,15,58,33,202,32 // insertps $0x20,%xmm2,%xmm1
- .byte 243,67,15,16,20,134 // movss (%r14,%r8,4),%xmm2
+ .byte 243,67,15,16,20,143 // movss (%r15,%r9,4),%xmm2
.byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1
.byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 243,70,15,16,20,155 // movss (%rbx,%r11,4),%xmm10
- .byte 102,70,15,58,33,20,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm10
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
+ .byte 243,70,15,16,20,179 // movss (%rbx,%r14,4),%xmm10
+ .byte 102,70,15,58,33,20,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm10
+ .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
.byte 102,68,15,58,33,210,32 // insertps $0x20,%xmm2,%xmm10
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
.byte 102,68,15,58,33,210,48 // insertps $0x30,%xmm2,%xmm10
.byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
- .byte 102,66,15,58,33,20,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm2
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
+ .byte 243,66,15,16,20,179 // movss (%rbx,%r14,4),%xmm2
+ .byte 102,66,15,58,33,20,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm2
+ .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
.byte 102,15,58,33,211,32 // insertps $0x20,%xmm3,%xmm2
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 243,70,15,16,28,155 // movss (%rbx,%r11,4),%xmm11
- .byte 102,70,15,58,33,28,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm11
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
+ .byte 243,70,15,16,28,179 // movss (%rbx,%r14,4),%xmm11
+ .byte 102,70,15,58,33,28,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm11
+ .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
.byte 102,68,15,58,33,219,32 // insertps $0x20,%xmm3,%xmm11
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
.byte 102,68,15,58,33,219,48 // insertps $0x30,%xmm3,%xmm11
.byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 243,66,15,16,28,155 // movss (%rbx,%r11,4),%xmm3
- .byte 102,66,15,58,33,28,147,16 // insertps $0x10,(%rbx,%r10,4),%xmm3
- .byte 243,70,15,16,36,139 // movss (%rbx,%r9,4),%xmm12
+ .byte 243,66,15,16,28,179 // movss (%rbx,%r14,4),%xmm3
+ .byte 102,66,15,58,33,28,155,16 // insertps $0x10,(%rbx,%r11,4),%xmm3
+ .byte 243,70,15,16,36,147 // movss (%rbx,%r10,4),%xmm12
.byte 102,65,15,58,33,220,32 // insertps $0x20,%xmm12,%xmm3
- .byte 243,70,15,16,36,131 // movss (%rbx,%r8,4),%xmm12
+ .byte 243,70,15,16,36,139 // movss (%rbx,%r9,4),%xmm12
.byte 102,65,15,58,33,220,48 // insertps $0x30,%xmm12,%xmm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 243,70,15,16,36,152 // movss (%rax,%r11,4),%xmm12
- .byte 102,70,15,58,33,36,144,16 // insertps $0x10,(%rax,%r10,4),%xmm12
- .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
+ .byte 243,70,15,16,36,176 // movss (%rax,%r14,4),%xmm12
+ .byte 102,70,15,58,33,36,152,16 // insertps $0x10,(%rax,%r11,4),%xmm12
+ .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
.byte 102,69,15,58,33,229,32 // insertps $0x20,%xmm13,%xmm12
- .byte 243,70,15,16,44,128 // movss (%rax,%r8,4),%xmm13
+ .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
.byte 102,69,15,58,33,229,48 // insertps $0x30,%xmm13,%xmm12
.byte 68,15,89,192 // mulps %xmm0,%xmm8
.byte 69,15,88,193 // addps %xmm9,%xmm8
@@ -26683,6 +26787,7 @@ _sk_gradient_sse41:
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
HIDDEN _sk_evenly_spaced_2_stop_gradient_sse41
@@ -26737,26 +26842,26 @@ _sk_xy_to_unit_angle_sse41:
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,40,236 // movaps %xmm12,%xmm13
.byte 69,15,89,237 // mulps %xmm13,%xmm13
- .byte 68,15,40,21,236,19,0,0 // movaps 0x13ec(%rip),%xmm10 # 5f90 <_sk_callback_sse41+0xffd>
+ .byte 68,15,40,21,251,19,0,0 // movaps 0x13fb(%rip),%xmm10 # 5fe0 <_sk_callback_sse41+0x100c>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,240,19,0,0 // addps 0x13f0(%rip),%xmm10 # 5fa0 <_sk_callback_sse41+0x100d>
+ .byte 68,15,88,21,255,19,0,0 // addps 0x13ff(%rip),%xmm10 # 5ff0 <_sk_callback_sse41+0x101c>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,244,19,0,0 // addps 0x13f4(%rip),%xmm10 # 5fb0 <_sk_callback_sse41+0x101d>
+ .byte 68,15,88,21,3,20,0,0 // addps 0x1403(%rip),%xmm10 # 6000 <_sk_callback_sse41+0x102c>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,248,19,0,0 // addps 0x13f8(%rip),%xmm10 # 5fc0 <_sk_callback_sse41+0x102d>
+ .byte 68,15,88,21,7,20,0,0 // addps 0x1407(%rip),%xmm10 # 6010 <_sk_callback_sse41+0x103c>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0
- .byte 68,15,40,29,247,19,0,0 // movaps 0x13f7(%rip),%xmm11 # 5fd0 <_sk_callback_sse41+0x103d>
+ .byte 68,15,40,29,6,20,0,0 // movaps 0x1406(%rip),%xmm11 # 6020 <_sk_callback_sse41+0x104c>
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10
.byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9
- .byte 68,15,40,29,240,19,0,0 // movaps 0x13f0(%rip),%xmm11 # 5fe0 <_sk_callback_sse41+0x104d>
+ .byte 68,15,40,29,255,19,0,0 // movaps 0x13ff(%rip),%xmm11 # 6030 <_sk_callback_sse41+0x105c>
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 65,15,194,192,1 // cmpltps %xmm8,%xmm0
- .byte 68,15,40,13,226,19,0,0 // movaps 0x13e2(%rip),%xmm9 # 5ff0 <_sk_callback_sse41+0x105d>
+ .byte 68,15,40,13,241,19,0,0 // movaps 0x13f1(%rip),%xmm9 # 6040 <_sk_callback_sse41+0x106c>
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 102,69,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm10
.byte 69,15,194,194,7 // cmpordps %xmm10,%xmm8
@@ -26782,7 +26887,7 @@ HIDDEN _sk_save_xy_sse41
FUNCTION(_sk_save_xy_sse41)
_sk_save_xy_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,182,19,0,0 // movaps 0x13b6(%rip),%xmm8 # 6000 <_sk_callback_sse41+0x106d>
+ .byte 68,15,40,5,197,19,0,0 // movaps 0x13c5(%rip),%xmm8 # 6050 <_sk_callback_sse41+0x107c>
.byte 15,17,0 // movups %xmm0,(%rax)
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,88,200 // addps %xmm8,%xmm9
@@ -26826,8 +26931,8 @@ _sk_bilinear_nx_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,56,19,0,0 // addps 0x1338(%rip),%xmm0 # 6010 <_sk_callback_sse41+0x107d>
- .byte 68,15,40,13,64,19,0,0 // movaps 0x1340(%rip),%xmm9 # 6020 <_sk_callback_sse41+0x108d>
+ .byte 15,88,5,71,19,0,0 // addps 0x1347(%rip),%xmm0 # 6060 <_sk_callback_sse41+0x108c>
+ .byte 68,15,40,13,79,19,0,0 // movaps 0x134f(%rip),%xmm9 # 6070 <_sk_callback_sse41+0x109c>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -26840,7 +26945,7 @@ _sk_bilinear_px_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,47,19,0,0 // addps 0x132f(%rip),%xmm0 # 6030 <_sk_callback_sse41+0x109d>
+ .byte 15,88,5,62,19,0,0 // addps 0x133e(%rip),%xmm0 # 6080 <_sk_callback_sse41+0x10ac>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -26852,8 +26957,8 @@ _sk_bilinear_ny_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,33,19,0,0 // addps 0x1321(%rip),%xmm1 # 6040 <_sk_callback_sse41+0x10ad>
- .byte 68,15,40,13,41,19,0,0 // movaps 0x1329(%rip),%xmm9 # 6050 <_sk_callback_sse41+0x10bd>
+ .byte 15,88,13,48,19,0,0 // addps 0x1330(%rip),%xmm1 # 6090 <_sk_callback_sse41+0x10bc>
+ .byte 68,15,40,13,56,19,0,0 // movaps 0x1338(%rip),%xmm9 # 60a0 <_sk_callback_sse41+0x10cc>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -26866,7 +26971,7 @@ _sk_bilinear_py_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,23,19,0,0 // addps 0x1317(%rip),%xmm1 # 6060 <_sk_callback_sse41+0x10cd>
+ .byte 15,88,13,38,19,0,0 // addps 0x1326(%rip),%xmm1 # 60b0 <_sk_callback_sse41+0x10dc>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -26878,13 +26983,13 @@ _sk_bicubic_n3x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,10,19,0,0 // addps 0x130a(%rip),%xmm0 # 6070 <_sk_callback_sse41+0x10dd>
- .byte 68,15,40,13,18,19,0,0 // movaps 0x1312(%rip),%xmm9 # 6080 <_sk_callback_sse41+0x10ed>
+ .byte 15,88,5,25,19,0,0 // addps 0x1319(%rip),%xmm0 # 60c0 <_sk_callback_sse41+0x10ec>
+ .byte 68,15,40,13,33,19,0,0 // movaps 0x1321(%rip),%xmm9 # 60d0 <_sk_callback_sse41+0x10fc>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,14,19,0,0 // mulps 0x130e(%rip),%xmm9 # 6090 <_sk_callback_sse41+0x10fd>
- .byte 68,15,88,13,22,19,0,0 // addps 0x1316(%rip),%xmm9 # 60a0 <_sk_callback_sse41+0x110d>
+ .byte 68,15,89,13,29,19,0,0 // mulps 0x131d(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x110c>
+ .byte 68,15,88,13,37,19,0,0 // addps 0x1325(%rip),%xmm9 # 60f0 <_sk_callback_sse41+0x111c>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -26897,16 +27002,16 @@ _sk_bicubic_n1x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,5,19,0,0 // addps 0x1305(%rip),%xmm0 # 60b0 <_sk_callback_sse41+0x111d>
- .byte 68,15,40,13,13,19,0,0 // movaps 0x130d(%rip),%xmm9 # 60c0 <_sk_callback_sse41+0x112d>
+ .byte 15,88,5,20,19,0,0 // addps 0x1314(%rip),%xmm0 # 6100 <_sk_callback_sse41+0x112c>
+ .byte 68,15,40,13,28,19,0,0 // movaps 0x131c(%rip),%xmm9 # 6110 <_sk_callback_sse41+0x113c>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,17,19,0,0 // movaps 0x1311(%rip),%xmm8 # 60d0 <_sk_callback_sse41+0x113d>
+ .byte 68,15,40,5,32,19,0,0 // movaps 0x1320(%rip),%xmm8 # 6120 <_sk_callback_sse41+0x114c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,21,19,0,0 // addps 0x1315(%rip),%xmm8 # 60e0 <_sk_callback_sse41+0x114d>
+ .byte 68,15,88,5,36,19,0,0 // addps 0x1324(%rip),%xmm8 # 6130 <_sk_callback_sse41+0x115c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,25,19,0,0 // addps 0x1319(%rip),%xmm8 # 60f0 <_sk_callback_sse41+0x115d>
+ .byte 68,15,88,5,40,19,0,0 // addps 0x1328(%rip),%xmm8 # 6140 <_sk_callback_sse41+0x116c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,29,19,0,0 // addps 0x131d(%rip),%xmm8 # 6100 <_sk_callback_sse41+0x116d>
+ .byte 68,15,88,5,44,19,0,0 // addps 0x132c(%rip),%xmm8 # 6150 <_sk_callback_sse41+0x117c>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -26916,17 +27021,17 @@ HIDDEN _sk_bicubic_p1x_sse41
FUNCTION(_sk_bicubic_p1x_sse41)
_sk_bicubic_p1x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,23,19,0,0 // movaps 0x1317(%rip),%xmm8 # 6110 <_sk_callback_sse41+0x117d>
+ .byte 68,15,40,5,38,19,0,0 // movaps 0x1326(%rip),%xmm8 # 6160 <_sk_callback_sse41+0x118c>
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,21,19,19,0,0 // movaps 0x1313(%rip),%xmm10 # 6120 <_sk_callback_sse41+0x118d>
+ .byte 68,15,40,21,34,19,0,0 // movaps 0x1322(%rip),%xmm10 # 6170 <_sk_callback_sse41+0x119c>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,23,19,0,0 // addps 0x1317(%rip),%xmm10 # 6130 <_sk_callback_sse41+0x119d>
+ .byte 68,15,88,21,38,19,0,0 // addps 0x1326(%rip),%xmm10 # 6180 <_sk_callback_sse41+0x11ac>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,19,19,0,0 // addps 0x1313(%rip),%xmm10 # 6140 <_sk_callback_sse41+0x11ad>
+ .byte 68,15,88,21,34,19,0,0 // addps 0x1322(%rip),%xmm10 # 6190 <_sk_callback_sse41+0x11bc>
.byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -26938,11 +27043,11 @@ _sk_bicubic_p3x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,6,19,0,0 // addps 0x1306(%rip),%xmm0 # 6150 <_sk_callback_sse41+0x11bd>
+ .byte 15,88,5,21,19,0,0 // addps 0x1315(%rip),%xmm0 # 61a0 <_sk_callback_sse41+0x11cc>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,6,19,0,0 // mulps 0x1306(%rip),%xmm8 # 6160 <_sk_callback_sse41+0x11cd>
- .byte 68,15,88,5,14,19,0,0 // addps 0x130e(%rip),%xmm8 # 6170 <_sk_callback_sse41+0x11dd>
+ .byte 68,15,89,5,21,19,0,0 // mulps 0x1315(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x11dc>
+ .byte 68,15,88,5,29,19,0,0 // addps 0x131d(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x11ec>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -26955,13 +27060,13 @@ _sk_bicubic_n3y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,252,18,0,0 // addps 0x12fc(%rip),%xmm1 # 6180 <_sk_callback_sse41+0x11ed>
- .byte 68,15,40,13,4,19,0,0 // movaps 0x1304(%rip),%xmm9 # 6190 <_sk_callback_sse41+0x11fd>
+ .byte 15,88,13,11,19,0,0 // addps 0x130b(%rip),%xmm1 # 61d0 <_sk_callback_sse41+0x11fc>
+ .byte 68,15,40,13,19,19,0,0 // movaps 0x1313(%rip),%xmm9 # 61e0 <_sk_callback_sse41+0x120c>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,0,19,0,0 // mulps 0x1300(%rip),%xmm9 # 61a0 <_sk_callback_sse41+0x120d>
- .byte 68,15,88,13,8,19,0,0 // addps 0x1308(%rip),%xmm9 # 61b0 <_sk_callback_sse41+0x121d>
+ .byte 68,15,89,13,15,19,0,0 // mulps 0x130f(%rip),%xmm9 # 61f0 <_sk_callback_sse41+0x121c>
+ .byte 68,15,88,13,23,19,0,0 // addps 0x1317(%rip),%xmm9 # 6200 <_sk_callback_sse41+0x122c>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -26974,16 +27079,16 @@ _sk_bicubic_n1y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,246,18,0,0 // addps 0x12f6(%rip),%xmm1 # 61c0 <_sk_callback_sse41+0x122d>
- .byte 68,15,40,13,254,18,0,0 // movaps 0x12fe(%rip),%xmm9 # 61d0 <_sk_callback_sse41+0x123d>
+ .byte 15,88,13,5,19,0,0 // addps 0x1305(%rip),%xmm1 # 6210 <_sk_callback_sse41+0x123c>
+ .byte 68,15,40,13,13,19,0,0 // movaps 0x130d(%rip),%xmm9 # 6220 <_sk_callback_sse41+0x124c>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,2,19,0,0 // movaps 0x1302(%rip),%xmm8 # 61e0 <_sk_callback_sse41+0x124d>
+ .byte 68,15,40,5,17,19,0,0 // movaps 0x1311(%rip),%xmm8 # 6230 <_sk_callback_sse41+0x125c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,6,19,0,0 // addps 0x1306(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x125d>
+ .byte 68,15,88,5,21,19,0,0 // addps 0x1315(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x126c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,10,19,0,0 // addps 0x130a(%rip),%xmm8 # 6200 <_sk_callback_sse41+0x126d>
+ .byte 68,15,88,5,25,19,0,0 // addps 0x1319(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x127c>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,14,19,0,0 // addps 0x130e(%rip),%xmm8 # 6210 <_sk_callback_sse41+0x127d>
+ .byte 68,15,88,5,29,19,0,0 // addps 0x131d(%rip),%xmm8 # 6260 <_sk_callback_sse41+0x128c>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -26993,17 +27098,17 @@ HIDDEN _sk_bicubic_p1y_sse41
FUNCTION(_sk_bicubic_p1y_sse41)
_sk_bicubic_p1y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,8,19,0,0 // movaps 0x1308(%rip),%xmm8 # 6220 <_sk_callback_sse41+0x128d>
+ .byte 68,15,40,5,23,19,0,0 // movaps 0x1317(%rip),%xmm8 # 6270 <_sk_callback_sse41+0x129c>
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 68,15,40,21,3,19,0,0 // movaps 0x1303(%rip),%xmm10 # 6230 <_sk_callback_sse41+0x129d>
+ .byte 68,15,40,21,18,19,0,0 // movaps 0x1312(%rip),%xmm10 # 6280 <_sk_callback_sse41+0x12ac>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,7,19,0,0 // addps 0x1307(%rip),%xmm10 # 6240 <_sk_callback_sse41+0x12ad>
+ .byte 68,15,88,21,22,19,0,0 // addps 0x1316(%rip),%xmm10 # 6290 <_sk_callback_sse41+0x12bc>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,3,19,0,0 // addps 0x1303(%rip),%xmm10 # 6250 <_sk_callback_sse41+0x12bd>
+ .byte 68,15,88,21,18,19,0,0 // addps 0x1312(%rip),%xmm10 # 62a0 <_sk_callback_sse41+0x12cc>
.byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -27015,11 +27120,11 @@ _sk_bicubic_p3y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,245,18,0,0 // addps 0x12f5(%rip),%xmm1 # 6260 <_sk_callback_sse41+0x12cd>
+ .byte 15,88,13,4,19,0,0 // addps 0x1304(%rip),%xmm1 # 62b0 <_sk_callback_sse41+0x12dc>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,245,18,0,0 // mulps 0x12f5(%rip),%xmm8 # 6270 <_sk_callback_sse41+0x12dd>
- .byte 68,15,88,5,253,18,0,0 // addps 0x12fd(%rip),%xmm8 # 6280 <_sk_callback_sse41+0x12ed>
+ .byte 68,15,89,5,4,19,0,0 // mulps 0x1304(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x12ec>
+ .byte 68,15,88,5,12,19,0,0 // addps 0x130c(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x12fc>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -27029,22 +27134,24 @@ HIDDEN _sk_callback_sse41
.globl _sk_callback_sse41
FUNCTION(_sk_callback_sse41)
_sk_callback_sse41:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 72,131,236,64 // sub $0x40,%rsp
+ .byte 72,131,236,72 // sub $0x48,%rsp
.byte 15,41,124,36,48 // movaps %xmm7,0x30(%rsp)
.byte 15,41,116,36,32 // movaps %xmm6,0x20(%rsp)
.byte 15,41,108,36,16 // movaps %xmm5,0x10(%rsp)
.byte 15,41,36,36 // movaps %xmm4,(%rsp)
- .byte 73,137,205 // mov %rcx,%r13
- .byte 73,137,214 // mov %rdx,%r14
- .byte 73,137,255 // mov %rdi,%r15
+ .byte 76,137,195 // mov %r8,%rbx
+ .byte 73,137,206 // mov %rcx,%r14
+ .byte 73,137,215 // mov %rdx,%r15
+ .byte 73,137,252 // mov %rdi,%r12
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,137,195 // mov %rax,%rbx
- .byte 73,137,244 // mov %rsi,%r12
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 73,137,245 // mov %rsi,%r13
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 15,20,225 // unpcklps %xmm1,%xmm4
.byte 15,40,234 // movaps %xmm2,%xmm5
@@ -27056,17 +27163,17 @@ _sk_callback_sse41:
.byte 15,18,236 // movhlps %xmm4,%xmm5
.byte 15,40,216 // movaps %xmm0,%xmm3
.byte 102,15,20,218 // unpcklpd %xmm2,%xmm3
- .byte 102,15,17,75,8 // movupd %xmm1,0x8(%rbx)
+ .byte 102,15,17,77,8 // movupd %xmm1,0x8(%rbp)
.byte 15,18,208 // movhlps %xmm0,%xmm2
- .byte 15,17,107,24 // movups %xmm5,0x18(%rbx)
- .byte 102,15,17,91,40 // movupd %xmm3,0x28(%rbx)
- .byte 15,17,83,56 // movups %xmm2,0x38(%rbx)
- .byte 77,133,237 // test %r13,%r13
+ .byte 15,17,109,24 // movups %xmm5,0x18(%rbp)
+ .byte 102,15,17,93,40 // movupd %xmm3,0x28(%rbp)
+ .byte 15,17,85,56 // movups %xmm2,0x38(%rbp)
+ .byte 72,133,219 // test %rbx,%rbx
.byte 190,4,0,0,0 // mov $0x4,%esi
- .byte 65,15,69,245 // cmovne %r13d,%esi
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 255,19 // callq *(%rbx)
- .byte 72,139,131,136,0,0,0 // mov 0x88(%rbx),%rax
+ .byte 15,69,243 // cmovne %ebx,%esi
+ .byte 72,137,239 // mov %rbp,%rdi
+ .byte 255,85,0 // callq *0x0(%rbp)
+ .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax
.byte 15,16,32 // movups (%rax),%xmm4
.byte 15,16,64,16 // movups 0x10(%rax),%xmm0
.byte 15,16,88,32 // movups 0x20(%rax),%xmm3
@@ -27083,21 +27190,23 @@ _sk_callback_sse41:
.byte 15,40,212 // movaps %xmm4,%xmm2
.byte 102,15,20,211 // unpcklpd %xmm3,%xmm2
.byte 15,18,220 // movhlps %xmm4,%xmm3
- .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,238 // mov %r13,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,255 // mov %r15,%rdi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,233 // mov %r13,%rcx
+ .byte 76,137,231 // mov %r12,%rdi
+ .byte 76,137,250 // mov %r15,%rdx
+ .byte 76,137,241 // mov %r14,%rcx
+ .byte 73,137,216 // mov %rbx,%r8
.byte 15,40,36,36 // movaps (%rsp),%xmm4
.byte 15,40,108,36,16 // movaps 0x10(%rsp),%xmm5
.byte 15,40,116,36,32 // movaps 0x20(%rsp),%xmm6
.byte 15,40,124,36,48 // movaps 0x30(%rsp),%xmm7
- .byte 72,131,196,64 // add $0x40,%rsp
+ .byte 72,131,196,72 // add $0x48,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
BALIGN16
@@ -27244,11 +27353,11 @@ BALIGN16
.byte 128,191,0,0,128,191,0 // cmpb $0x0,-0x40800000(%rdi)
.byte 0,224 // add %ah,%al
.byte 64,0,0 // add %al,(%rax)
- .byte 224,64 // loopne 5258 <.literal16+0x1d8>
+ .byte 224,64 // loopne 52a8 <.literal16+0x1d8>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 525c <.literal16+0x1dc>
+ .byte 224,64 // loopne 52ac <.literal16+0x1dc>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 5260 <.literal16+0x1e0>
+ .byte 224,64 // loopne 52b0 <.literal16+0x1e0>
.byte 154 // (bad)
.byte 153 // cltd
.byte 153 // cltd
@@ -27268,13 +27377,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5281 <.literal16+0x201>
+ .byte 71,225,61 // rex.RXB loope 52d1 <.literal16+0x201>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5285 <.literal16+0x205>
+ .byte 71,225,61 // rex.RXB loope 52d5 <.literal16+0x205>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5289 <.literal16+0x209>
+ .byte 71,225,61 // rex.RXB loope 52d9 <.literal16+0x209>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 528d <.literal16+0x20d>
+ .byte 71,225,61 // rex.RXB loope 52dd <.literal16+0x20d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -27299,13 +27408,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 52c1 <.literal16+0x241>
+ .byte 71,225,61 // rex.RXB loope 5311 <.literal16+0x241>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 52c5 <.literal16+0x245>
+ .byte 71,225,61 // rex.RXB loope 5315 <.literal16+0x245>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 52c9 <.literal16+0x249>
+ .byte 71,225,61 // rex.RXB loope 5319 <.literal16+0x249>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 52cd <.literal16+0x24d>
+ .byte 71,225,61 // rex.RXB loope 531d <.literal16+0x24d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -27330,13 +27439,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5301 <.literal16+0x281>
+ .byte 71,225,61 // rex.RXB loope 5351 <.literal16+0x281>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5305 <.literal16+0x285>
+ .byte 71,225,61 // rex.RXB loope 5355 <.literal16+0x285>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5309 <.literal16+0x289>
+ .byte 71,225,61 // rex.RXB loope 5359 <.literal16+0x289>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 530d <.literal16+0x28d>
+ .byte 71,225,61 // rex.RXB loope 535d <.literal16+0x28d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -27361,13 +27470,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5341 <.literal16+0x2c1>
+ .byte 71,225,61 // rex.RXB loope 5391 <.literal16+0x2c1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5345 <.literal16+0x2c5>
+ .byte 71,225,61 // rex.RXB loope 5395 <.literal16+0x2c5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5349 <.literal16+0x2c9>
+ .byte 71,225,61 // rex.RXB loope 5399 <.literal16+0x2c9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 534d <.literal16+0x2cd>
+ .byte 71,225,61 // rex.RXB loope 539d <.literal16+0x2cd>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -27384,10 +27493,10 @@ BALIGN16
.byte 0,1 // add %al,(%rcx)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005338 <_sk_callback_sse41+0xa0003a5>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005388 <_sk_callback_sse41+0xa0003b4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005340 <_sk_callback_sse41+0x30003ad>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005390 <_sk_callback_sse41+0x30003bc>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -27406,11 +27515,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
.byte 67,0,0 // rex.XB add %al,(%r8)
- .byte 127,67 // jg 53ab <.literal16+0x32b>
+ .byte 127,67 // jg 53fb <.literal16+0x32b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 53af <.literal16+0x32f>
+ .byte 127,67 // jg 53ff <.literal16+0x32f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 53b3 <.literal16+0x333>
+ .byte 127,67 // jg 5403 <.literal16+0x333>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -27645,13 +27754,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5589 <.literal16+0x509>
+ .byte 224,7 // loopne 55d9 <.literal16+0x509>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 558d <.literal16+0x50d>
+ .byte 224,7 // loopne 55dd <.literal16+0x50d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5591 <.literal16+0x511>
+ .byte 224,7 // loopne 55e1 <.literal16+0x511>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5595 <.literal16+0x515>
+ .byte 224,7 // loopne 55e5 <.literal16+0x515>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -27685,10 +27794,10 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a0055d8 <_sk_callback_sse41+0xa000645>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005628 <_sk_callback_sse41+0xa000654>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 30055e0 <_sk_callback_sse41+0x300064d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005630 <_sk_callback_sse41+0x300065c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -27743,11 +27852,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 56ab <.literal16+0x62b>
+ .byte 127,67 // jg 56fb <.literal16+0x62b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 56af <.literal16+0x62f>
+ .byte 127,67 // jg 56ff <.literal16+0x62f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 56b3 <.literal16+0x633>
+ .byte 127,67 // jg 5703 <.literal16+0x633>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%rax)
@@ -27762,16 +27871,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 56a4 <.literal16+0x624>
+ .byte 127,0 // jg 56f4 <.literal16+0x624>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 56a8 <.literal16+0x628>
+ .byte 127,0 // jg 56f8 <.literal16+0x628>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 56ac <.literal16+0x62c>
+ .byte 127,0 // jg 56fc <.literal16+0x62c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 56b0 <.literal16+0x630>
+ .byte 127,0 // jg 5700 <.literal16+0x630>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -27780,7 +27889,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5735 <.literal16+0x6b5>
+ .byte 119,115 // ja 5785 <.literal16+0x6b5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -27791,7 +27900,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5699 <.literal16+0x619>
+ .byte 117,191 // jne 56e9 <.literal16+0x619>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -27803,7 +27912,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a396da <_sk_callback_sse41+0xffffffffe9a34747>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3972a <_sk_callback_sse41+0xffffffffe9a34756>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -27858,16 +27967,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5774 <.literal16+0x6f4>
+ .byte 127,0 // jg 57c4 <.literal16+0x6f4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5778 <.literal16+0x6f8>
+ .byte 127,0 // jg 57c8 <.literal16+0x6f8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 577c <.literal16+0x6fc>
+ .byte 127,0 // jg 57cc <.literal16+0x6fc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5780 <.literal16+0x700>
+ .byte 127,0 // jg 57d0 <.literal16+0x700>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -27876,7 +27985,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5805 <.literal16+0x785>
+ .byte 119,115 // ja 5855 <.literal16+0x785>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -27887,7 +27996,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5769 <.literal16+0x6e9>
+ .byte 117,191 // jne 57b9 <.literal16+0x6e9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -27899,7 +28008,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a397aa <_sk_callback_sse41+0xffffffffe9a34817>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a397fa <_sk_callback_sse41+0xffffffffe9a34826>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -27954,16 +28063,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5844 <.literal16+0x7c4>
+ .byte 127,0 // jg 5894 <.literal16+0x7c4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5848 <.literal16+0x7c8>
+ .byte 127,0 // jg 5898 <.literal16+0x7c8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 584c <.literal16+0x7cc>
+ .byte 127,0 // jg 589c <.literal16+0x7cc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5850 <.literal16+0x7d0>
+ .byte 127,0 // jg 58a0 <.literal16+0x7d0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -27972,7 +28081,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 58d5 <.literal16+0x855>
+ .byte 119,115 // ja 5925 <.literal16+0x855>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -27983,7 +28092,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5839 <.literal16+0x7b9>
+ .byte 117,191 // jne 5889 <.literal16+0x7b9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -27995,7 +28104,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3987a <_sk_callback_sse41+0xffffffffe9a348e7>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a398ca <_sk_callback_sse41+0xffffffffe9a348f6>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -28050,16 +28159,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5914 <.literal16+0x894>
+ .byte 127,0 // jg 5964 <.literal16+0x894>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5918 <.literal16+0x898>
+ .byte 127,0 // jg 5968 <.literal16+0x898>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 591c <.literal16+0x89c>
+ .byte 127,0 // jg 596c <.literal16+0x89c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5920 <.literal16+0x8a0>
+ .byte 127,0 // jg 5970 <.literal16+0x8a0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -28068,7 +28177,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 59a5 <.literal16+0x925>
+ .byte 119,115 // ja 59f5 <.literal16+0x925>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -28079,7 +28188,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5909 <.literal16+0x889>
+ .byte 117,191 // jne 5959 <.literal16+0x889>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -28091,7 +28200,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3994a <_sk_callback_sse41+0xffffffffe9a349b7>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3999a <_sk_callback_sse41+0xffffffffe9a349c6>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -28142,13 +28251,13 @@ BALIGN16
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
- .byte 127,67 // jg 5a27 <.literal16+0x9a7>
+ .byte 127,67 // jg 5a77 <.literal16+0x9a7>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5a2b <.literal16+0x9ab>
+ .byte 127,67 // jg 5a7b <.literal16+0x9ab>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5a2f <.literal16+0x9af>
+ .byte 127,67 // jg 5a7f <.literal16+0x9af>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5a33 <.literal16+0x9b3>
+ .byte 127,67 // jg 5a83 <.literal16+0x9b3>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -28195,16 +28304,16 @@ BALIGN16
.byte 128,3,62 // addb $0x3e,(%rbx)
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5ab3 <.literal16+0xa33>
+ .byte 118,63 // jbe 5b03 <.literal16+0xa33>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5ab7 <.literal16+0xa37>
+ .byte 118,63 // jbe 5b07 <.literal16+0xa37>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5abb <.literal16+0xa3b>
+ .byte 118,63 // jbe 5b0b <.literal16+0xa3b>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5abf <.literal16+0xa3f>
+ .byte 118,63 // jbe 5b0f <.literal16+0xa3f>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
@@ -28224,11 +28333,11 @@ BALIGN16
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5b0b <.literal16+0xa8b>
+ .byte 127,67 // jg 5b5b <.literal16+0xa8b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5b0f <.literal16+0xa8f>
+ .byte 127,67 // jg 5b5f <.literal16+0xa8f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5b13 <.literal16+0xa93>
+ .byte 127,67 // jg 5b63 <.literal16+0xa93>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -28265,7 +28374,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005b50 <_sk_callback_sse41+0x3000bbd>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005ba0 <_sk_callback_sse41+0x3000bcc>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -28294,13 +28403,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5b89 <.literal16+0xb09>
+ .byte 224,7 // loopne 5bd9 <.literal16+0xb09>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5b8d <.literal16+0xb0d>
+ .byte 224,7 // loopne 5bdd <.literal16+0xb0d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5b91 <.literal16+0xb11>
+ .byte 224,7 // loopne 5be1 <.literal16+0xb11>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5b95 <.literal16+0xb15>
+ .byte 224,7 // loopne 5be5 <.literal16+0xb15>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -28346,13 +28455,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5bf9 <.literal16+0xb79>
+ .byte 224,7 // loopne 5c49 <.literal16+0xb79>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5bfd <.literal16+0xb7d>
+ .byte 224,7 // loopne 5c4d <.literal16+0xb7d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5c01 <.literal16+0xb81>
+ .byte 224,7 // loopne 5c51 <.literal16+0xb81>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5c05 <.literal16+0xb85>
+ .byte 224,7 // loopne 5c55 <.literal16+0xb85>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -28390,13 +28499,13 @@ BALIGN16
.byte 65,0,0 // add %al,(%r8)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 5c96 <.literal16+0xc16>
+ .byte 124,66 // jl 5ce6 <.literal16+0xc16>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 5c9a <.literal16+0xc1a>
+ .byte 124,66 // jl 5cea <.literal16+0xc1a>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 5c9e <.literal16+0xc1e>
+ .byte 124,66 // jl 5cee <.literal16+0xc1e>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 5ca2 <.literal16+0xc22>
+ .byte 124,66 // jl 5cf2 <.literal16+0xc22>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,240 // add %dh,%al
@@ -28486,13 +28595,13 @@ BALIGN16
.byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%rax)
.byte 61,137,136,136,61 // cmp $0x3d888889,%eax
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 5da5 <.literal16+0xd25>
+ .byte 112,65 // jo 5df5 <.literal16+0xd25>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 5da9 <.literal16+0xd29>
+ .byte 112,65 // jo 5df9 <.literal16+0xd29>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 5dad <.literal16+0xd2d>
+ .byte 112,65 // jo 5dfd <.literal16+0xd2d>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 5db1 <.literal16+0xd31>
+ .byte 112,65 // jo 5e01 <.literal16+0xd31>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -28507,7 +28616,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005da0 <_sk_callback_sse41+0x3000e0d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005df0 <_sk_callback_sse41+0x3000e1c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -28534,7 +28643,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005de0 <_sk_callback_sse41+0x3000e4d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005e30 <_sk_callback_sse41+0x3000e5c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -28549,11 +28658,11 @@ BALIGN16
.byte 255,0 // incl (%rax)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5e3b <.literal16+0xdbb>
+ .byte 127,67 // jg 5e8b <.literal16+0xdbb>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5e3f <.literal16+0xdbf>
+ .byte 127,67 // jg 5e8f <.literal16+0xdbf>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5e43 <.literal16+0xdc3>
+ .byte 127,67 // jg 5e93 <.literal16+0xdc3>
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
.byte 0,0 // add %al,(%rax)
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
@@ -28629,13 +28738,13 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 5f0b <.literal16+0xe8b>
+ .byte 127,71 // jg 5f5b <.literal16+0xe8b>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 5f0f <.literal16+0xe8f>
+ .byte 127,71 // jg 5f5f <.literal16+0xe8f>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 5f13 <.literal16+0xe93>
+ .byte 127,71 // jg 5f63 <.literal16+0xe93>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 5f17 <.literal16+0xe97>
+ .byte 127,71 // jg 5f67 <.literal16+0xe97>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -28681,10 +28790,10 @@ BALIGN16
.byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax
.byte 152 // cwtl
.byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx)
- .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0704a <_sk_callback_sse41+0x2dc020b7>
+ .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0709a <_sk_callback_sse41+0x2dc020c6>
.byte 17,192 // adc %eax,%eax
.byte 45,16,17,192,18 // sub $0x12c01110,%eax
- .byte 120,57 // js 5f7c <.literal16+0xefc>
+ .byte 120,57 // js 5fcc <.literal16+0xefc>
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
@@ -28806,11 +28915,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 60b2 <.literal16+0x1032>
+ .byte 62,114,28 // jb,pt 6102 <.literal16+0x1032>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 60b6 <.literal16+0x1036>
+ .byte 62,114,28 // jb,pt 6106 <.literal16+0x1036>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 60ba <.literal16+0x103a>
+ .byte 62,114,28 // jb,pt 610a <.literal16+0x103a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -28854,7 +28963,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ef45 <_sk_callback_sse41+0x3d639fb2>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ef95 <_sk_callback_sse41+0x3d639fc1>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -28880,7 +28989,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ef85 <_sk_callback_sse41+0x3d639ff2>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63efd5 <_sk_callback_sse41+0x3d63a001>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -28889,13 +28998,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 617e <.literal16+0x10fe>
+ .byte 114,28 // jb 61ce <.literal16+0x10fe>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 6182 <.literal16+0x1102>
+ .byte 62,114,28 // jb,pt 61d2 <.literal16+0x1102>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 6186 <.literal16+0x1106>
+ .byte 62,114,28 // jb,pt 61d6 <.literal16+0x1106>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 618a <.literal16+0x110a>
+ .byte 62,114,28 // jb,pt 61da <.literal16+0x110a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -28916,11 +29025,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 61c2 <.literal16+0x1142>
+ .byte 62,114,28 // jb,pt 6212 <.literal16+0x1142>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 61c6 <.literal16+0x1146>
+ .byte 62,114,28 // jb,pt 6216 <.literal16+0x1146>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 61ca <.literal16+0x114a>
+ .byte 62,114,28 // jb,pt 621a <.literal16+0x114a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -28964,7 +29073,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f055 <_sk_callback_sse41+0x3d63a0c2>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0a5 <_sk_callback_sse41+0x3d63a0d1>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -28990,7 +29099,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f095 <_sk_callback_sse41+0x3d63a102>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0e5 <_sk_callback_sse41+0x3d63a111>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -28999,13 +29108,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 628e <.literal16+0x120e>
+ .byte 114,28 // jb 62de <.literal16+0x120e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 6292 <_sk_callback_sse41+0x12ff>
+ .byte 62,114,28 // jb,pt 62e2 <_sk_callback_sse41+0x130e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 6296 <_sk_callback_sse41+0x1303>
+ .byte 62,114,28 // jb,pt 62e6 <_sk_callback_sse41+0x1312>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 629a <_sk_callback_sse41+0x1307>
+ .byte 62,114,28 // jb,pt 62ea <_sk_callback_sse41+0x1316>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -29021,22 +29130,26 @@ HIDDEN _sk_start_pipeline_sse2
.globl _sk_start_pipeline_sse2
FUNCTION(_sk_start_pipeline_sse2)
_sk_start_pipeline_sse2:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 73,137,204 // mov %rcx,%r12
- .byte 73,137,214 // mov %rdx,%r14
+ .byte 80 // push %rax
+ .byte 77,137,198 // mov %r8,%r14
+ .byte 73,137,213 // mov %rdx,%r13
+ .byte 73,137,247 // mov %rsi,%r15
.byte 72,137,251 // mov %rdi,%rbx
+ .byte 72,137,206 // mov %rcx,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,247 // mov %rsi,%r15
+ .byte 73,137,244 // mov %rsi,%r12
.byte 72,141,75,4 // lea 0x4(%rbx),%rcx
- .byte 76,57,225 // cmp %r12,%rcx
- .byte 118,5 // jbe 25 <_sk_start_pipeline_sse2+0x25>
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 235,63 // jmp 64 <_sk_start_pipeline_sse2+0x64>
- .byte 185,0,0,0,0 // mov $0x0,%ecx
+ .byte 76,57,233 // cmp %r13,%rcx
+ .byte 118,5 // jbe 2d <_sk_start_pipeline_sse2+0x2d>
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 235,66 // jmp 6f <_sk_start_pipeline_sse2+0x6f>
+ .byte 65,184,0,0,0,0 // mov $0x0,%r8d
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -29045,19 +29158,20 @@ _sk_start_pipeline_sse2:
.byte 15,87,237 // xorps %xmm5,%xmm5
.byte 15,87,246 // xorps %xmm6,%xmm6
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 73,137,197 // mov %rax,%r13
- .byte 65,255,213 // callq *%r13
- .byte 76,137,232 // mov %r13,%rax
- .byte 72,141,123,4 // lea 0x4(%rbx),%rdi
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 72,137,218 // mov %rbx,%rdx
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 255,213 // callq *%rbp
+ .byte 72,137,232 // mov %rbp,%rax
+ .byte 72,141,83,4 // lea 0x4(%rbx),%rdx
.byte 72,131,195,8 // add $0x8,%rbx
- .byte 76,57,227 // cmp %r12,%rbx
- .byte 72,137,251 // mov %rdi,%rbx
- .byte 118,193 // jbe 25 <_sk_start_pipeline_sse2+0x25>
- .byte 73,41,252 // sub %rdi,%r12
- .byte 116,44 // je 95 <_sk_start_pipeline_sse2+0x95>
+ .byte 76,57,235 // cmp %r13,%rbx
+ .byte 72,137,211 // mov %rdx,%rbx
+ .byte 118,190 // jbe 2d <_sk_start_pipeline_sse2+0x2d>
+ .byte 73,41,213 // sub %rdx,%r13
+ .byte 116,52 // je a8 <_sk_start_pipeline_sse2+0xa8>
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -29066,20 +29180,25 @@ _sk_start_pipeline_sse2:
.byte 15,87,237 // xorps %xmm5,%xmm5
.byte 15,87,246 // xorps %xmm6,%xmm6
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 76,137,254 // mov %r15,%rsi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,225 // mov %r12,%rcx
+ .byte 76,137,247 // mov %r14,%rdi
+ .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,249 // mov %r15,%rcx
+ .byte 77,137,232 // mov %r13,%r8
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
+ .byte 72,131,196,8 // add $0x8,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 195 // retq
HIDDEN _sk_just_return_sse2
@@ -29092,20 +29211,19 @@ HIDDEN _sk_seed_shader_sse2
.globl _sk_seed_shader_sse2
FUNCTION(_sk_seed_shader_sse2)
_sk_seed_shader_sse2:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 102,15,110,199 // movd %edi,%xmm0
+ .byte 102,15,110,194 // movd %edx,%xmm0
.byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
- .byte 15,40,21,43,85,0,0 // movaps 0x552b(%rip),%xmm2 # 55e0 <_sk_callback_sse2+0xf0>
+ .byte 15,40,21,85,85,0,0 // movaps 0x5555(%rip),%xmm2 # 5620 <_sk_callback_sse2+0xf5>
.byte 15,88,202 // addps %xmm2,%xmm1
- .byte 15,16,2 // movups (%rdx),%xmm0
+ .byte 15,16,7 // movups (%rdi),%xmm0
.byte 15,88,193 // addps %xmm1,%xmm0
- .byte 102,15,110,8 // movd (%rax),%xmm1
+ .byte 102,15,110,201 // movd %ecx,%xmm1
.byte 102,15,112,201,0 // pshufd $0x0,%xmm1,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,21,26,85,0,0 // movaps 0x551a(%rip),%xmm2 # 55f0 <_sk_callback_sse2+0x100>
+ .byte 15,40,21,68,85,0,0 // movaps 0x5544(%rip),%xmm2 # 5630 <_sk_callback_sse2+0x105>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,87,237 // xorps %xmm5,%xmm5
@@ -29118,22 +29236,21 @@ HIDDEN _sk_dither_sse2
FUNCTION(_sk_dither_sse2)
_sk_dither_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 102,68,15,110,199 // movd %edi,%xmm8
+ .byte 102,68,15,110,194 // movd %edx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
- .byte 243,68,15,111,74,32 // movdqu 0x20(%rdx),%xmm9
+ .byte 243,68,15,111,79,32 // movdqu 0x20(%rdi),%xmm9
.byte 102,69,15,254,200 // paddd %xmm8,%xmm9
- .byte 76,139,0 // mov (%rax),%r8
- .byte 102,69,15,110,0 // movd (%r8),%xmm8
+ .byte 102,68,15,110,193 // movd %ecx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 102,69,15,239,193 // pxor %xmm9,%xmm8
- .byte 102,68,15,111,21,229,84,0,0 // movdqa 0x54e5(%rip),%xmm10 # 5600 <_sk_callback_sse2+0x110>
+ .byte 102,68,15,111,21,18,85,0,0 // movdqa 0x5512(%rip),%xmm10 # 5640 <_sk_callback_sse2+0x115>
.byte 102,69,15,111,216 // movdqa %xmm8,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,65,15,114,243,5 // pslld $0x5,%xmm11
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 102,65,15,114,242,4 // pslld $0x4,%xmm10
- .byte 102,68,15,111,37,209,84,0,0 // movdqa 0x54d1(%rip),%xmm12 # 5610 <_sk_callback_sse2+0x120>
- .byte 102,68,15,111,45,216,84,0,0 // movdqa 0x54d8(%rip),%xmm13 # 5620 <_sk_callback_sse2+0x130>
+ .byte 102,68,15,111,37,254,84,0,0 // movdqa 0x54fe(%rip),%xmm12 # 5650 <_sk_callback_sse2+0x125>
+ .byte 102,68,15,111,45,5,85,0,0 // movdqa 0x5505(%rip),%xmm13 # 5660 <_sk_callback_sse2+0x135>
.byte 102,69,15,111,240 // movdqa %xmm8,%xmm14
.byte 102,69,15,219,245 // pand %xmm13,%xmm14
.byte 102,65,15,114,246,2 // pslld $0x2,%xmm14
@@ -29145,13 +29262,13 @@ _sk_dither_sse2:
.byte 102,65,15,114,209,2 // psrld $0x2,%xmm9
.byte 102,69,15,235,234 // por %xmm10,%xmm13
.byte 102,69,15,235,233 // por %xmm9,%xmm13
- .byte 102,69,15,235,235 // por %xmm11,%xmm13
- .byte 102,69,15,235,198 // por %xmm14,%xmm8
- .byte 102,69,15,235,197 // por %xmm13,%xmm8
- .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,147,84,0,0 // mulps 0x5493(%rip),%xmm8 # 5630 <_sk_callback_sse2+0x140>
- .byte 68,15,88,5,155,84,0,0 // addps 0x549b(%rip),%xmm8 # 5640 <_sk_callback_sse2+0x150>
- .byte 243,68,15,16,80,8 // movss 0x8(%rax),%xmm10
+ .byte 102,69,15,235,243 // por %xmm11,%xmm14
+ .byte 102,69,15,235,245 // por %xmm13,%xmm14
+ .byte 102,69,15,235,240 // por %xmm8,%xmm14
+ .byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8
+ .byte 68,15,89,5,192,84,0,0 // mulps 0x54c0(%rip),%xmm8 # 5670 <_sk_callback_sse2+0x145>
+ .byte 68,15,88,5,200,84,0,0 // addps 0x54c8(%rip),%xmm8 # 5680 <_sk_callback_sse2+0x155>
+ .byte 243,68,15,16,16 // movss (%rax),%xmm10
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,88,194 // addps %xmm10,%xmm0
@@ -29227,7 +29344,7 @@ HIDDEN _sk_srcatop_sse2
FUNCTION(_sk_srcatop_sse2)
_sk_srcatop_sse2:
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 68,15,40,5,244,83,0,0 // movaps 0x53f4(%rip),%xmm8 # 5650 <_sk_callback_sse2+0x160>
+ .byte 68,15,40,5,34,84,0,0 // movaps 0x5422(%rip),%xmm8 # 5690 <_sk_callback_sse2+0x165>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -29252,7 +29369,7 @@ FUNCTION(_sk_dstatop_sse2)
_sk_dstatop_sse2:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
.byte 68,15,89,196 // mulps %xmm4,%xmm8
- .byte 68,15,40,13,183,83,0,0 // movaps 0x53b7(%rip),%xmm9 # 5660 <_sk_callback_sse2+0x170>
+ .byte 68,15,40,13,229,83,0,0 // movaps 0x53e5(%rip),%xmm9 # 56a0 <_sk_callback_sse2+0x175>
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
@@ -29299,7 +29416,7 @@ HIDDEN _sk_srcout_sse2
.globl _sk_srcout_sse2
FUNCTION(_sk_srcout_sse2)
_sk_srcout_sse2:
- .byte 68,15,40,5,91,83,0,0 // movaps 0x535b(%rip),%xmm8 # 5670 <_sk_callback_sse2+0x180>
+ .byte 68,15,40,5,137,83,0,0 // movaps 0x5389(%rip),%xmm8 # 56b0 <_sk_callback_sse2+0x185>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
@@ -29312,7 +29429,7 @@ HIDDEN _sk_dstout_sse2
.globl _sk_dstout_sse2
FUNCTION(_sk_dstout_sse2)
_sk_dstout_sse2:
- .byte 68,15,40,5,75,83,0,0 // movaps 0x534b(%rip),%xmm8 # 5680 <_sk_callback_sse2+0x190>
+ .byte 68,15,40,5,121,83,0,0 // movaps 0x5379(%rip),%xmm8 # 56c0 <_sk_callback_sse2+0x195>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
@@ -29329,7 +29446,7 @@ HIDDEN _sk_srcover_sse2
.globl _sk_srcover_sse2
FUNCTION(_sk_srcover_sse2)
_sk_srcover_sse2:
- .byte 68,15,40,5,46,83,0,0 // movaps 0x532e(%rip),%xmm8 # 5690 <_sk_callback_sse2+0x1a0>
+ .byte 68,15,40,5,92,83,0,0 // movaps 0x535c(%rip),%xmm8 # 56d0 <_sk_callback_sse2+0x1a5>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -29349,7 +29466,7 @@ HIDDEN _sk_dstover_sse2
.globl _sk_dstover_sse2
FUNCTION(_sk_dstover_sse2)
_sk_dstover_sse2:
- .byte 68,15,40,5,2,83,0,0 // movaps 0x5302(%rip),%xmm8 # 56a0 <_sk_callback_sse2+0x1b0>
+ .byte 68,15,40,5,48,83,0,0 // movaps 0x5330(%rip),%xmm8 # 56e0 <_sk_callback_sse2+0x1b5>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -29377,7 +29494,7 @@ HIDDEN _sk_multiply_sse2
.globl _sk_multiply_sse2
FUNCTION(_sk_multiply_sse2)
_sk_multiply_sse2:
- .byte 68,15,40,5,214,82,0,0 // movaps 0x52d6(%rip),%xmm8 # 56b0 <_sk_callback_sse2+0x1c0>
+ .byte 68,15,40,5,4,83,0,0 // movaps 0x5304(%rip),%xmm8 # 56f0 <_sk_callback_sse2+0x1c5>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,209 // movaps %xmm9,%xmm10
@@ -29452,7 +29569,7 @@ HIDDEN _sk_xor__sse2
FUNCTION(_sk_xor__sse2)
_sk_xor__sse2:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
- .byte 15,40,29,11,82,0,0 // movaps 0x520b(%rip),%xmm3 # 56c0 <_sk_callback_sse2+0x1d0>
+ .byte 15,40,29,57,82,0,0 // movaps 0x5239(%rip),%xmm3 # 5700 <_sk_callback_sse2+0x1d5>
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
@@ -29500,7 +29617,7 @@ _sk_darken_sse2:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,95,209 // maxps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,118,81,0,0 // movaps 0x5176(%rip),%xmm2 # 56d0 <_sk_callback_sse2+0x1e0>
+ .byte 15,40,21,164,81,0,0 // movaps 0x51a4(%rip),%xmm2 # 5710 <_sk_callback_sse2+0x1e5>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -29534,7 +29651,7 @@ _sk_lighten_sse2:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,27,81,0,0 // movaps 0x511b(%rip),%xmm2 # 56e0 <_sk_callback_sse2+0x1f0>
+ .byte 15,40,21,73,81,0,0 // movaps 0x5149(%rip),%xmm2 # 5720 <_sk_callback_sse2+0x1f5>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -29571,7 +29688,7 @@ _sk_difference_sse2:
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,181,80,0,0 // movaps 0x50b5(%rip),%xmm2 # 56f0 <_sk_callback_sse2+0x200>
+ .byte 15,40,21,227,80,0,0 // movaps 0x50e3(%rip),%xmm2 # 5730 <_sk_callback_sse2+0x205>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -29599,7 +29716,7 @@ _sk_exclusion_sse2:
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,117,80,0,0 // movaps 0x5075(%rip),%xmm2 # 5700 <_sk_callback_sse2+0x210>
+ .byte 15,40,21,163,80,0,0 // movaps 0x50a3(%rip),%xmm2 # 5740 <_sk_callback_sse2+0x215>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -29612,7 +29729,7 @@ HIDDEN _sk_colorburn_sse2
FUNCTION(_sk_colorburn_sse2)
_sk_colorburn_sse2:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,104,80,0,0 // movaps 0x5068(%rip),%xmm10 # 5710 <_sk_callback_sse2+0x220>
+ .byte 68,15,40,21,150,80,0,0 // movaps 0x5096(%rip),%xmm10 # 5750 <_sk_callback_sse2+0x225>
.byte 69,15,40,202 // movaps %xmm10,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,217 // movaps %xmm9,%xmm11
@@ -29706,7 +29823,7 @@ HIDDEN _sk_colordodge_sse2
FUNCTION(_sk_colordodge_sse2)
_sk_colordodge_sse2:
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 68,15,40,21,30,79,0,0 // movaps 0x4f1e(%rip),%xmm10 # 5720 <_sk_callback_sse2+0x230>
+ .byte 68,15,40,21,76,79,0,0 // movaps 0x4f4c(%rip),%xmm10 # 5760 <_sk_callback_sse2+0x235>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
@@ -29800,7 +29917,7 @@ _sk_hardlight_sse2:
.byte 15,41,116,36,232 // movaps %xmm6,-0x18(%rsp)
.byte 15,40,245 // movaps %xmm5,%xmm6
.byte 15,40,236 // movaps %xmm4,%xmm5
- .byte 68,15,40,29,211,77,0,0 // movaps 0x4dd3(%rip),%xmm11 # 5730 <_sk_callback_sse2+0x240>
+ .byte 68,15,40,29,1,78,0,0 // movaps 0x4e01(%rip),%xmm11 # 5770 <_sk_callback_sse2+0x245>
.byte 69,15,40,211 // movaps %xmm11,%xmm10
.byte 68,15,92,215 // subps %xmm7,%xmm10
.byte 69,15,40,194 // movaps %xmm10,%xmm8
@@ -29888,7 +30005,7 @@ FUNCTION(_sk_overlay_sse2)
_sk_overlay_sse2:
.byte 68,15,40,193 // movaps %xmm1,%xmm8
.byte 68,15,40,232 // movaps %xmm0,%xmm13
- .byte 68,15,40,13,161,76,0,0 // movaps 0x4ca1(%rip),%xmm9 # 5740 <_sk_callback_sse2+0x250>
+ .byte 68,15,40,13,207,76,0,0 // movaps 0x4ccf(%rip),%xmm9 # 5780 <_sk_callback_sse2+0x255>
.byte 69,15,40,209 // movaps %xmm9,%xmm10
.byte 68,15,92,215 // subps %xmm7,%xmm10
.byte 69,15,40,218 // movaps %xmm10,%xmm11
@@ -29979,7 +30096,7 @@ _sk_softlight_sse2:
.byte 68,15,40,213 // movaps %xmm5,%xmm10
.byte 68,15,94,215 // divps %xmm7,%xmm10
.byte 69,15,84,212 // andps %xmm12,%xmm10
- .byte 68,15,40,13,94,75,0,0 // movaps 0x4b5e(%rip),%xmm9 # 5750 <_sk_callback_sse2+0x260>
+ .byte 68,15,40,13,140,75,0,0 // movaps 0x4b8c(%rip),%xmm9 # 5790 <_sk_callback_sse2+0x265>
.byte 69,15,40,249 // movaps %xmm9,%xmm15
.byte 69,15,92,250 // subps %xmm10,%xmm15
.byte 69,15,40,218 // movaps %xmm10,%xmm11
@@ -29992,10 +30109,10 @@ _sk_softlight_sse2:
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 65,15,88,194 // addps %xmm10,%xmm0
- .byte 68,15,40,53,56,75,0,0 // movaps 0x4b38(%rip),%xmm14 # 5760 <_sk_callback_sse2+0x270>
+ .byte 68,15,40,53,102,75,0,0 // movaps 0x4b66(%rip),%xmm14 # 57a0 <_sk_callback_sse2+0x275>
.byte 69,15,88,222 // addps %xmm14,%xmm11
.byte 68,15,89,216 // mulps %xmm0,%xmm11
- .byte 68,15,40,21,56,75,0,0 // movaps 0x4b38(%rip),%xmm10 # 5770 <_sk_callback_sse2+0x280>
+ .byte 68,15,40,21,102,75,0,0 // movaps 0x4b66(%rip),%xmm10 # 57b0 <_sk_callback_sse2+0x285>
.byte 69,15,89,234 // mulps %xmm10,%xmm13
.byte 69,15,88,235 // addps %xmm11,%xmm13
.byte 15,88,228 // addps %xmm4,%xmm4
@@ -30140,7 +30257,7 @@ _sk_hue_sse2:
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 68,15,89,211 // mulps %xmm3,%xmm10
- .byte 68,15,40,5,123,73,0,0 // movaps 0x497b(%rip),%xmm8 # 57b0 <_sk_callback_sse2+0x2c0>
+ .byte 68,15,40,5,169,73,0,0 // movaps 0x49a9(%rip),%xmm8 # 57f0 <_sk_callback_sse2+0x2c5>
.byte 69,15,40,216 // movaps %xmm8,%xmm11
.byte 15,40,207 // movaps %xmm7,%xmm1
.byte 68,15,92,217 // subps %xmm1,%xmm11
@@ -30188,12 +30305,12 @@ _sk_hue_sse2:
.byte 69,15,84,206 // andps %xmm14,%xmm9
.byte 69,15,84,214 // andps %xmm14,%xmm10
.byte 65,15,84,214 // andps %xmm14,%xmm2
- .byte 68,15,40,61,136,72,0,0 // movaps 0x4888(%rip),%xmm15 # 5780 <_sk_callback_sse2+0x290>
+ .byte 68,15,40,61,182,72,0,0 // movaps 0x48b6(%rip),%xmm15 # 57c0 <_sk_callback_sse2+0x295>
.byte 65,15,89,231 // mulps %xmm15,%xmm4
- .byte 15,40,5,141,72,0,0 // movaps 0x488d(%rip),%xmm0 # 5790 <_sk_callback_sse2+0x2a0>
+ .byte 15,40,5,187,72,0,0 // movaps 0x48bb(%rip),%xmm0 # 57d0 <_sk_callback_sse2+0x2a5>
.byte 15,89,240 // mulps %xmm0,%xmm6
.byte 15,88,244 // addps %xmm4,%xmm6
- .byte 68,15,40,53,143,72,0,0 // movaps 0x488f(%rip),%xmm14 # 57a0 <_sk_callback_sse2+0x2b0>
+ .byte 68,15,40,53,189,72,0,0 // movaps 0x48bd(%rip),%xmm14 # 57e0 <_sk_callback_sse2+0x2b5>
.byte 68,15,40,239 // movaps %xmm7,%xmm13
.byte 69,15,89,238 // mulps %xmm14,%xmm13
.byte 68,15,88,238 // addps %xmm6,%xmm13
@@ -30371,14 +30488,14 @@ _sk_saturation_sse2:
.byte 68,15,84,211 // andps %xmm3,%xmm10
.byte 68,15,84,203 // andps %xmm3,%xmm9
.byte 15,84,195 // andps %xmm3,%xmm0
- .byte 68,15,40,5,33,70,0,0 // movaps 0x4621(%rip),%xmm8 # 57c0 <_sk_callback_sse2+0x2d0>
+ .byte 68,15,40,5,79,70,0,0 // movaps 0x464f(%rip),%xmm8 # 5800 <_sk_callback_sse2+0x2d5>
.byte 15,40,214 // movaps %xmm6,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
- .byte 15,40,13,35,70,0,0 // movaps 0x4623(%rip),%xmm1 # 57d0 <_sk_callback_sse2+0x2e0>
+ .byte 15,40,13,81,70,0,0 // movaps 0x4651(%rip),%xmm1 # 5810 <_sk_callback_sse2+0x2e5>
.byte 15,40,221 // movaps %xmm5,%xmm3
.byte 15,89,217 // mulps %xmm1,%xmm3
.byte 15,88,218 // addps %xmm2,%xmm3
- .byte 68,15,40,37,34,70,0,0 // movaps 0x4622(%rip),%xmm12 # 57e0 <_sk_callback_sse2+0x2f0>
+ .byte 68,15,40,37,80,70,0,0 // movaps 0x4650(%rip),%xmm12 # 5820 <_sk_callback_sse2+0x2f5>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
.byte 68,15,88,235 // addps %xmm3,%xmm13
.byte 65,15,40,210 // movaps %xmm10,%xmm2
@@ -30423,7 +30540,7 @@ _sk_saturation_sse2:
.byte 15,40,223 // movaps %xmm7,%xmm3
.byte 15,40,236 // movaps %xmm4,%xmm5
.byte 15,89,221 // mulps %xmm5,%xmm3
- .byte 68,15,40,5,135,69,0,0 // movaps 0x4587(%rip),%xmm8 # 57f0 <_sk_callback_sse2+0x300>
+ .byte 68,15,40,5,181,69,0,0 // movaps 0x45b5(%rip),%xmm8 # 5830 <_sk_callback_sse2+0x305>
.byte 65,15,40,224 // movaps %xmm8,%xmm4
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 15,88,253 // addps %xmm5,%xmm7
@@ -30524,14 +30641,14 @@ _sk_color_sse2:
.byte 68,15,40,213 // movaps %xmm5,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,40,208 // movaps %xmm8,%xmm2
- .byte 68,15,40,45,37,68,0,0 // movaps 0x4425(%rip),%xmm13 # 5800 <_sk_callback_sse2+0x310>
+ .byte 68,15,40,45,83,68,0,0 // movaps 0x4453(%rip),%xmm13 # 5840 <_sk_callback_sse2+0x315>
.byte 68,15,40,198 // movaps %xmm6,%xmm8
.byte 69,15,89,197 // mulps %xmm13,%xmm8
- .byte 68,15,40,53,37,68,0,0 // movaps 0x4425(%rip),%xmm14 # 5810 <_sk_callback_sse2+0x320>
+ .byte 68,15,40,53,83,68,0,0 // movaps 0x4453(%rip),%xmm14 # 5850 <_sk_callback_sse2+0x325>
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,89,198 // mulps %xmm14,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,29,33,68,0,0 // movaps 0x4421(%rip),%xmm11 # 5820 <_sk_callback_sse2+0x330>
+ .byte 68,15,40,29,79,68,0,0 // movaps 0x444f(%rip),%xmm11 # 5860 <_sk_callback_sse2+0x335>
.byte 69,15,89,227 // mulps %xmm11,%xmm12
.byte 68,15,88,224 // addps %xmm0,%xmm12
.byte 65,15,40,193 // movaps %xmm9,%xmm0
@@ -30539,7 +30656,7 @@ _sk_color_sse2:
.byte 69,15,40,250 // movaps %xmm10,%xmm15
.byte 69,15,89,254 // mulps %xmm14,%xmm15
.byte 68,15,88,248 // addps %xmm0,%xmm15
- .byte 68,15,40,5,13,68,0,0 // movaps 0x440d(%rip),%xmm8 # 5830 <_sk_callback_sse2+0x340>
+ .byte 68,15,40,5,59,68,0,0 // movaps 0x443b(%rip),%xmm8 # 5870 <_sk_callback_sse2+0x345>
.byte 65,15,40,224 // movaps %xmm8,%xmm4
.byte 15,92,226 // subps %xmm2,%xmm4
.byte 15,89,252 // mulps %xmm4,%xmm7
@@ -30675,15 +30792,15 @@ _sk_luminosity_sse2:
.byte 68,15,40,205 // movaps %xmm5,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
.byte 15,89,222 // mulps %xmm6,%xmm3
- .byte 68,15,40,37,36,66,0,0 // movaps 0x4224(%rip),%xmm12 # 5840 <_sk_callback_sse2+0x350>
+ .byte 68,15,40,37,82,66,0,0 // movaps 0x4252(%rip),%xmm12 # 5880 <_sk_callback_sse2+0x355>
.byte 68,15,40,199 // movaps %xmm7,%xmm8
.byte 69,15,89,196 // mulps %xmm12,%xmm8
- .byte 68,15,40,45,36,66,0,0 // movaps 0x4224(%rip),%xmm13 # 5850 <_sk_callback_sse2+0x360>
+ .byte 68,15,40,45,82,66,0,0 // movaps 0x4252(%rip),%xmm13 # 5890 <_sk_callback_sse2+0x365>
.byte 68,15,40,241 // movaps %xmm1,%xmm14
.byte 69,15,89,245 // mulps %xmm13,%xmm14
.byte 69,15,88,240 // addps %xmm8,%xmm14
- .byte 68,15,40,29,32,66,0,0 // movaps 0x4220(%rip),%xmm11 # 5860 <_sk_callback_sse2+0x370>
- .byte 68,15,40,5,40,66,0,0 // movaps 0x4228(%rip),%xmm8 # 5870 <_sk_callback_sse2+0x380>
+ .byte 68,15,40,29,78,66,0,0 // movaps 0x424e(%rip),%xmm11 # 58a0 <_sk_callback_sse2+0x375>
+ .byte 68,15,40,5,86,66,0,0 // movaps 0x4256(%rip),%xmm8 # 58b0 <_sk_callback_sse2+0x385>
.byte 69,15,40,248 // movaps %xmm8,%xmm15
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 68,15,92,248 // subps %xmm0,%xmm15
@@ -30818,11 +30935,11 @@ FUNCTION(_sk_srcover_rgba_8888_sse2)
_sk_srcover_rgba_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,227,0,0,0 // jne 1920 <_sk_srcover_rgba_8888_sse2+0xf1>
- .byte 243,68,15,111,4,184 // movdqu (%rax,%rdi,4),%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 102,15,111,53,50,64,0,0 // movdqa 0x4032(%rip),%xmm6 # 5880 <_sk_callback_sse2+0x390>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,227,0,0,0 // jne 1932 <_sk_srcover_rgba_8888_sse2+0xf1>
+ .byte 243,68,15,111,4,144 // movdqu (%rax,%rdx,4),%xmm8
+ .byte 77,133,192 // test %r8,%r8
+ .byte 102,15,111,53,96,64,0,0 // movdqa 0x4060(%rip),%xmm6 # 58c0 <_sk_callback_sse2+0x395>
.byte 102,65,15,111,224 // movdqa %xmm8,%xmm4
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
@@ -30836,9 +30953,9 @@ _sk_srcover_rgba_8888_sse2:
.byte 15,91,247 // cvtdq2ps %xmm7,%xmm6
.byte 102,65,15,114,208,24 // psrld $0x18,%xmm8
.byte 65,15,91,248 // cvtdq2ps %xmm8,%xmm7
- .byte 68,15,40,5,2,64,0,0 // movaps 0x4002(%rip),%xmm8 # 5890 <_sk_callback_sse2+0x3a0>
+ .byte 68,15,40,5,48,64,0,0 // movaps 0x4030(%rip),%xmm8 # 58d0 <_sk_callback_sse2+0x3a5>
.byte 68,15,92,195 // subps %xmm3,%xmm8
- .byte 68,15,40,37,6,64,0,0 // movaps 0x4006(%rip),%xmm12 # 58a0 <_sk_callback_sse2+0x3b0>
+ .byte 68,15,40,37,52,64,0,0 // movaps 0x4034(%rip),%xmm12 # 58e0 <_sk_callback_sse2+0x3b5>
.byte 65,15,89,196 // mulps %xmm12,%xmm0
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -30864,46 +30981,46 @@ _sk_srcover_rgba_8888_sse2:
.byte 102,15,114,240,24 // pslld $0x18,%xmm0
.byte 102,15,235,194 // por %xmm2,%xmm0
.byte 102,15,235,193 // por %xmm1,%xmm0
- .byte 117,106 // jne 1971 <_sk_srcover_rgba_8888_sse2+0x142>
- .byte 243,15,127,4,184 // movdqu %xmm0,(%rax,%rdi,4)
+ .byte 117,106 // jne 1983 <_sk_srcover_rgba_8888_sse2+0x142>
+ .byte 243,15,127,4,144 // movdqu %xmm0,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 65,15,40,202 // movaps %xmm10,%xmm1
.byte 65,15,40,211 // movaps %xmm11,%xmm2
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,48 // je 1962 <_sk_srcover_rgba_8888_sse2+0x133>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,22 // je 194e <_sk_srcover_rgba_8888_sse2+0x11f>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 15,133,1,255,255,255 // jne 1843 <_sk_srcover_rgba_8888_sse2+0x14>
- .byte 102,15,110,100,184,8 // movd 0x8(%rax,%rdi,4),%xmm4
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,48 // je 1974 <_sk_srcover_rgba_8888_sse2+0x133>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,22 // je 1960 <_sk_srcover_rgba_8888_sse2+0x11f>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 15,133,1,255,255,255 // jne 1855 <_sk_srcover_rgba_8888_sse2+0x14>
+ .byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,68,15,112,196,69 // pshufd $0x45,%xmm4,%xmm8
- .byte 243,15,16,100,184,4 // movss 0x4(%rax,%rdi,4),%xmm4
+ .byte 243,15,16,100,144,4 // movss 0x4(%rax,%rdx,4),%xmm4
.byte 65,15,198,224,0 // shufps $0x0,%xmm8,%xmm4
.byte 65,15,198,224,226 // shufps $0xe2,%xmm8,%xmm4
.byte 68,15,40,196 // movaps %xmm4,%xmm8
- .byte 243,15,16,36,184 // movss (%rax,%rdi,4),%xmm4
+ .byte 243,15,16,36,144 // movss (%rax,%rdx,4),%xmm4
.byte 243,68,15,16,196 // movss %xmm4,%xmm8
- .byte 233,210,254,255,255 // jmpq 1843 <_sk_srcover_rgba_8888_sse2+0x14>
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,34 // je 19a0 <_sk_srcover_rgba_8888_sse2+0x171>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,17 // je 1995 <_sk_srcover_rgba_8888_sse2+0x166>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,130 // jne 190c <_sk_srcover_rgba_8888_sse2+0xdd>
+ .byte 233,210,254,255,255 // jmpq 1855 <_sk_srcover_rgba_8888_sse2+0x14>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,34 // je 19b2 <_sk_srcover_rgba_8888_sse2+0x171>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,17 // je 19a7 <_sk_srcover_rgba_8888_sse2+0x166>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,130 // jne 191e <_sk_srcover_rgba_8888_sse2+0xdd>
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
- .byte 102,15,126,76,184,8 // movd %xmm1,0x8(%rax,%rdi,4)
+ .byte 102,15,126,76,144,8 // movd %xmm1,0x8(%rax,%rdx,4)
.byte 102,15,112,200,229 // pshufd $0xe5,%xmm0,%xmm1
- .byte 102,15,126,76,184,4 // movd %xmm1,0x4(%rax,%rdi,4)
- .byte 102,15,126,4,184 // movd %xmm0,(%rax,%rdi,4)
- .byte 233,98,255,255,255 // jmpq 190c <_sk_srcover_rgba_8888_sse2+0xdd>
+ .byte 102,15,126,76,144,4 // movd %xmm1,0x4(%rax,%rdx,4)
+ .byte 102,15,126,4,144 // movd %xmm0,(%rax,%rdx,4)
+ .byte 233,98,255,255,255 // jmpq 191e <_sk_srcover_rgba_8888_sse2+0xdd>
HIDDEN _sk_clamp_0_sse2
.globl _sk_clamp_0_sse2
@@ -30921,7 +31038,7 @@ HIDDEN _sk_clamp_1_sse2
.globl _sk_clamp_1_sse2
FUNCTION(_sk_clamp_1_sse2)
_sk_clamp_1_sse2:
- .byte 68,15,40,5,230,62,0,0 // movaps 0x3ee6(%rip),%xmm8 # 58b0 <_sk_callback_sse2+0x3c0>
+ .byte 68,15,40,5,20,63,0,0 // movaps 0x3f14(%rip),%xmm8 # 58f0 <_sk_callback_sse2+0x3c5>
.byte 65,15,93,192 // minps %xmm8,%xmm0
.byte 65,15,93,200 // minps %xmm8,%xmm1
.byte 65,15,93,208 // minps %xmm8,%xmm2
@@ -30933,7 +31050,7 @@ HIDDEN _sk_clamp_a_sse2
.globl _sk_clamp_a_sse2
FUNCTION(_sk_clamp_a_sse2)
_sk_clamp_a_sse2:
- .byte 15,93,29,219,62,0,0 // minps 0x3edb(%rip),%xmm3 # 58c0 <_sk_callback_sse2+0x3d0>
+ .byte 15,93,29,9,63,0,0 // minps 0x3f09(%rip),%xmm3 # 5900 <_sk_callback_sse2+0x3d5>
.byte 15,93,195 // minps %xmm3,%xmm0
.byte 15,93,203 // minps %xmm3,%xmm1
.byte 15,93,211 // minps %xmm3,%xmm2
@@ -31020,7 +31137,7 @@ HIDDEN _sk_unpremul_sse2
FUNCTION(_sk_unpremul_sse2)
_sk_unpremul_sse2:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
- .byte 68,15,40,13,70,62,0,0 // movaps 0x3e46(%rip),%xmm9 # 58d0 <_sk_callback_sse2+0x3e0>
+ .byte 68,15,40,13,116,62,0,0 // movaps 0x3e74(%rip),%xmm9 # 5910 <_sk_callback_sse2+0x3e5>
.byte 68,15,94,203 // divps %xmm3,%xmm9
.byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8
.byte 69,15,84,193 // andps %xmm9,%xmm8
@@ -31034,20 +31151,20 @@ HIDDEN _sk_from_srgb_sse2
.globl _sk_from_srgb_sse2
FUNCTION(_sk_from_srgb_sse2)
_sk_from_srgb_sse2:
- .byte 68,15,40,5,49,62,0,0 // movaps 0x3e31(%rip),%xmm8 # 58e0 <_sk_callback_sse2+0x3f0>
+ .byte 68,15,40,5,95,62,0,0 // movaps 0x3e5f(%rip),%xmm8 # 5920 <_sk_callback_sse2+0x3f5>
.byte 68,15,40,232 // movaps %xmm0,%xmm13
.byte 69,15,89,232 // mulps %xmm8,%xmm13
.byte 68,15,40,216 // movaps %xmm0,%xmm11
.byte 69,15,89,219 // mulps %xmm11,%xmm11
- .byte 68,15,40,13,41,62,0,0 // movaps 0x3e29(%rip),%xmm9 # 58f0 <_sk_callback_sse2+0x400>
+ .byte 68,15,40,13,87,62,0,0 // movaps 0x3e57(%rip),%xmm9 # 5930 <_sk_callback_sse2+0x405>
.byte 68,15,40,240 // movaps %xmm0,%xmm14
.byte 69,15,89,241 // mulps %xmm9,%xmm14
- .byte 68,15,40,21,41,62,0,0 // movaps 0x3e29(%rip),%xmm10 # 5900 <_sk_callback_sse2+0x410>
+ .byte 68,15,40,21,87,62,0,0 // movaps 0x3e57(%rip),%xmm10 # 5940 <_sk_callback_sse2+0x415>
.byte 69,15,88,242 // addps %xmm10,%xmm14
.byte 69,15,89,243 // mulps %xmm11,%xmm14
- .byte 68,15,40,29,41,62,0,0 // movaps 0x3e29(%rip),%xmm11 # 5910 <_sk_callback_sse2+0x420>
+ .byte 68,15,40,29,87,62,0,0 // movaps 0x3e57(%rip),%xmm11 # 5950 <_sk_callback_sse2+0x425>
.byte 69,15,88,243 // addps %xmm11,%xmm14
- .byte 68,15,40,37,45,62,0,0 // movaps 0x3e2d(%rip),%xmm12 # 5920 <_sk_callback_sse2+0x430>
+ .byte 68,15,40,37,91,62,0,0 // movaps 0x3e5b(%rip),%xmm12 # 5960 <_sk_callback_sse2+0x435>
.byte 65,15,194,196,1 // cmpltps %xmm12,%xmm0
.byte 68,15,84,232 // andps %xmm0,%xmm13
.byte 65,15,85,198 // andnps %xmm14,%xmm0
@@ -31084,22 +31201,22 @@ HIDDEN _sk_to_srgb_sse2
FUNCTION(_sk_to_srgb_sse2)
_sk_to_srgb_sse2:
.byte 68,15,82,232 // rsqrtps %xmm0,%xmm13
- .byte 68,15,40,5,186,61,0,0 // movaps 0x3dba(%rip),%xmm8 # 5930 <_sk_callback_sse2+0x440>
+ .byte 68,15,40,5,232,61,0,0 // movaps 0x3de8(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x445>
.byte 68,15,40,240 // movaps %xmm0,%xmm14
.byte 69,15,89,240 // mulps %xmm8,%xmm14
- .byte 68,15,40,13,186,61,0,0 // movaps 0x3dba(%rip),%xmm9 # 5940 <_sk_callback_sse2+0x450>
+ .byte 68,15,40,13,232,61,0,0 // movaps 0x3de8(%rip),%xmm9 # 5980 <_sk_callback_sse2+0x455>
.byte 69,15,40,253 // movaps %xmm13,%xmm15
.byte 69,15,89,249 // mulps %xmm9,%xmm15
- .byte 68,15,40,21,186,61,0,0 // movaps 0x3dba(%rip),%xmm10 # 5950 <_sk_callback_sse2+0x460>
+ .byte 68,15,40,21,232,61,0,0 // movaps 0x3de8(%rip),%xmm10 # 5990 <_sk_callback_sse2+0x465>
.byte 69,15,88,250 // addps %xmm10,%xmm15
.byte 69,15,89,253 // mulps %xmm13,%xmm15
- .byte 68,15,40,29,186,61,0,0 // movaps 0x3dba(%rip),%xmm11 # 5960 <_sk_callback_sse2+0x470>
+ .byte 68,15,40,29,232,61,0,0 // movaps 0x3de8(%rip),%xmm11 # 59a0 <_sk_callback_sse2+0x475>
.byte 69,15,88,251 // addps %xmm11,%xmm15
- .byte 68,15,40,37,190,61,0,0 // movaps 0x3dbe(%rip),%xmm12 # 5970 <_sk_callback_sse2+0x480>
+ .byte 68,15,40,37,236,61,0,0 // movaps 0x3dec(%rip),%xmm12 # 59b0 <_sk_callback_sse2+0x485>
.byte 69,15,88,236 // addps %xmm12,%xmm13
.byte 69,15,83,237 // rcpps %xmm13,%xmm13
.byte 69,15,89,239 // mulps %xmm15,%xmm13
- .byte 68,15,40,61,186,61,0,0 // movaps 0x3dba(%rip),%xmm15 # 5980 <_sk_callback_sse2+0x490>
+ .byte 68,15,40,61,232,61,0,0 // movaps 0x3de8(%rip),%xmm15 # 59c0 <_sk_callback_sse2+0x495>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 68,15,84,240 // andps %xmm0,%xmm14
.byte 65,15,85,197 // andnps %xmm13,%xmm0
@@ -31149,7 +31266,7 @@ _sk_rgb_to_hsl_sse2:
.byte 68,15,93,218 // minps %xmm2,%xmm11
.byte 65,15,40,202 // movaps %xmm10,%xmm1
.byte 65,15,92,203 // subps %xmm11,%xmm1
- .byte 68,15,40,45,19,61,0,0 // movaps 0x3d13(%rip),%xmm13 # 5990 <_sk_callback_sse2+0x4a0>
+ .byte 68,15,40,45,65,61,0,0 // movaps 0x3d41(%rip),%xmm13 # 59d0 <_sk_callback_sse2+0x4a5>
.byte 68,15,94,233 // divps %xmm1,%xmm13
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,194,192,0 // cmpeqps %xmm8,%xmm0
@@ -31158,30 +31275,30 @@ _sk_rgb_to_hsl_sse2:
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,40,241 // movaps %xmm9,%xmm14
.byte 68,15,194,242,1 // cmpltps %xmm2,%xmm14
- .byte 68,15,84,53,249,60,0,0 // andps 0x3cf9(%rip),%xmm14 # 59a0 <_sk_callback_sse2+0x4b0>
+ .byte 68,15,84,53,39,61,0,0 // andps 0x3d27(%rip),%xmm14 # 59e0 <_sk_callback_sse2+0x4b5>
.byte 69,15,88,244 // addps %xmm12,%xmm14
.byte 69,15,40,250 // movaps %xmm10,%xmm15
.byte 69,15,194,249,0 // cmpeqps %xmm9,%xmm15
.byte 65,15,92,208 // subps %xmm8,%xmm2
.byte 65,15,89,213 // mulps %xmm13,%xmm2
- .byte 68,15,40,37,236,60,0,0 // movaps 0x3cec(%rip),%xmm12 # 59b0 <_sk_callback_sse2+0x4c0>
+ .byte 68,15,40,37,26,61,0,0 // movaps 0x3d1a(%rip),%xmm12 # 59f0 <_sk_callback_sse2+0x4c5>
.byte 65,15,88,212 // addps %xmm12,%xmm2
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 69,15,89,197 // mulps %xmm13,%xmm8
- .byte 68,15,88,5,232,60,0,0 // addps 0x3ce8(%rip),%xmm8 # 59c0 <_sk_callback_sse2+0x4d0>
+ .byte 68,15,88,5,22,61,0,0 // addps 0x3d16(%rip),%xmm8 # 5a00 <_sk_callback_sse2+0x4d5>
.byte 65,15,84,215 // andps %xmm15,%xmm2
.byte 69,15,85,248 // andnps %xmm8,%xmm15
.byte 68,15,86,250 // orps %xmm2,%xmm15
.byte 68,15,84,240 // andps %xmm0,%xmm14
.byte 65,15,85,199 // andnps %xmm15,%xmm0
.byte 65,15,86,198 // orps %xmm14,%xmm0
- .byte 15,89,5,217,60,0,0 // mulps 0x3cd9(%rip),%xmm0 # 59d0 <_sk_callback_sse2+0x4e0>
+ .byte 15,89,5,7,61,0,0 // mulps 0x3d07(%rip),%xmm0 # 5a10 <_sk_callback_sse2+0x4e5>
.byte 69,15,40,194 // movaps %xmm10,%xmm8
.byte 69,15,194,195,4 // cmpneqps %xmm11,%xmm8
.byte 65,15,84,192 // andps %xmm8,%xmm0
.byte 69,15,92,226 // subps %xmm10,%xmm12
.byte 69,15,88,211 // addps %xmm11,%xmm10
- .byte 68,15,40,13,204,60,0,0 // movaps 0x3ccc(%rip),%xmm9 # 59e0 <_sk_callback_sse2+0x4f0>
+ .byte 68,15,40,13,250,60,0,0 // movaps 0x3cfa(%rip),%xmm9 # 5a20 <_sk_callback_sse2+0x4f5>
.byte 65,15,40,210 // movaps %xmm10,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 68,15,194,202,1 // cmpltps %xmm2,%xmm9
@@ -31205,7 +31322,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp)
.byte 68,15,40,218 // movaps %xmm2,%xmm11
.byte 15,40,240 // movaps %xmm0,%xmm6
- .byte 68,15,40,13,139,60,0,0 // movaps 0x3c8b(%rip),%xmm9 # 59f0 <_sk_callback_sse2+0x500>
+ .byte 68,15,40,13,185,60,0,0 // movaps 0x3cb9(%rip),%xmm9 # 5a30 <_sk_callback_sse2+0x505>
.byte 69,15,40,209 // movaps %xmm9,%xmm10
.byte 69,15,194,211,2 // cmpleps %xmm11,%xmm10
.byte 15,40,193 // movaps %xmm1,%xmm0
@@ -31222,28 +31339,28 @@ _sk_hsl_to_rgb_sse2:
.byte 69,15,88,211 // addps %xmm11,%xmm10
.byte 69,15,88,219 // addps %xmm11,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 15,40,5,84,60,0,0 // movaps 0x3c54(%rip),%xmm0 # 5a00 <_sk_callback_sse2+0x510>
+ .byte 15,40,5,130,60,0,0 // movaps 0x3c82(%rip),%xmm0 # 5a40 <_sk_callback_sse2+0x515>
.byte 15,88,198 // addps %xmm6,%xmm0
.byte 243,15,91,200 // cvttps2dq %xmm0,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,40,216 // movaps %xmm0,%xmm3
.byte 15,194,217,1 // cmpltps %xmm1,%xmm3
- .byte 15,84,29,76,60,0,0 // andps 0x3c4c(%rip),%xmm3 # 5a10 <_sk_callback_sse2+0x520>
+ .byte 15,84,29,122,60,0,0 // andps 0x3c7a(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525>
.byte 15,92,203 // subps %xmm3,%xmm1
.byte 15,92,193 // subps %xmm1,%xmm0
- .byte 68,15,40,45,78,60,0,0 // movaps 0x3c4e(%rip),%xmm13 # 5a20 <_sk_callback_sse2+0x530>
+ .byte 68,15,40,45,124,60,0,0 // movaps 0x3c7c(%rip),%xmm13 # 5a60 <_sk_callback_sse2+0x535>
.byte 69,15,40,197 // movaps %xmm13,%xmm8
.byte 68,15,194,192,2 // cmpleps %xmm0,%xmm8
.byte 69,15,40,242 // movaps %xmm10,%xmm14
.byte 69,15,92,243 // subps %xmm11,%xmm14
.byte 65,15,40,217 // movaps %xmm9,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
- .byte 15,40,21,94,60,0,0 // movaps 0x3c5e(%rip),%xmm2 # 5a50 <_sk_callback_sse2+0x560>
+ .byte 15,40,21,140,60,0,0 // movaps 0x3c8c(%rip),%xmm2 # 5a90 <_sk_callback_sse2+0x565>
.byte 68,15,40,250 // movaps %xmm2,%xmm15
.byte 68,15,194,248,2 // cmpleps %xmm0,%xmm15
- .byte 15,40,13,46,60,0,0 // movaps 0x3c2e(%rip),%xmm1 # 5a30 <_sk_callback_sse2+0x540>
+ .byte 15,40,13,92,60,0,0 // movaps 0x3c5c(%rip),%xmm1 # 5a70 <_sk_callback_sse2+0x545>
.byte 15,89,193 // mulps %xmm1,%xmm0
- .byte 15,40,45,52,60,0,0 // movaps 0x3c34(%rip),%xmm5 # 5a40 <_sk_callback_sse2+0x550>
+ .byte 15,40,45,98,60,0,0 // movaps 0x3c62(%rip),%xmm5 # 5a80 <_sk_callback_sse2+0x555>
.byte 15,40,229 // movaps %xmm5,%xmm4
.byte 15,92,224 // subps %xmm0,%xmm4
.byte 65,15,89,230 // mulps %xmm14,%xmm4
@@ -31266,7 +31383,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,222 // movaps %xmm6,%xmm3
.byte 15,194,216,1 // cmpltps %xmm0,%xmm3
- .byte 15,84,29,169,59,0,0 // andps 0x3ba9(%rip),%xmm3 # 5a10 <_sk_callback_sse2+0x520>
+ .byte 15,84,29,215,59,0,0 // andps 0x3bd7(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525>
.byte 15,92,195 // subps %xmm3,%xmm0
.byte 68,15,40,230 // movaps %xmm6,%xmm12
.byte 68,15,92,224 // subps %xmm0,%xmm12
@@ -31296,12 +31413,12 @@ _sk_hsl_to_rgb_sse2:
.byte 15,40,124,36,136 // movaps -0x78(%rsp),%xmm7
.byte 15,40,231 // movaps %xmm7,%xmm4
.byte 15,85,227 // andnps %xmm3,%xmm4
- .byte 15,88,53,129,59,0,0 // addps 0x3b81(%rip),%xmm6 # 5a60 <_sk_callback_sse2+0x570>
+ .byte 15,88,53,175,59,0,0 // addps 0x3baf(%rip),%xmm6 # 5aa0 <_sk_callback_sse2+0x575>
.byte 243,15,91,198 // cvttps2dq %xmm6,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,222 // movaps %xmm6,%xmm3
.byte 15,194,216,1 // cmpltps %xmm0,%xmm3
- .byte 15,84,29,28,59,0,0 // andps 0x3b1c(%rip),%xmm3 # 5a10 <_sk_callback_sse2+0x520>
+ .byte 15,84,29,74,59,0,0 // andps 0x3b4a(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525>
.byte 15,92,195 // subps %xmm3,%xmm0
.byte 15,92,240 // subps %xmm0,%xmm6
.byte 15,89,206 // mulps %xmm6,%xmm1
@@ -31359,15 +31476,15 @@ HIDDEN _sk_scale_u8_sse2
FUNCTION(_sk_scale_u8_sse2)
_sk_scale_u8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,61 // jne 1fe7 <_sk_scale_u8_sse2+0x47>
- .byte 102,69,15,110,4,57 // movd (%r9,%rdi,1),%xmm8
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,61 // jne 1ff9 <_sk_scale_u8_sse2+0x47>
+ .byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8
.byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 102,68,15,219,5,173,58,0,0 // pand 0x3aad(%rip),%xmm8 # 5a70 <_sk_callback_sse2+0x580>
+ .byte 102,68,15,219,5,219,58,0,0 // pand 0x3adb(%rip),%xmm8 # 5ab0 <_sk_callback_sse2+0x585>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,177,58,0,0 // mulps 0x3ab1(%rip),%xmm8 # 5a80 <_sk_callback_sse2+0x590>
+ .byte 68,15,89,5,223,58,0,0 // mulps 0x3adf(%rip),%xmm8 # 5ac0 <_sk_callback_sse2+0x595>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
@@ -31375,27 +31492,27 @@ _sk_scale_u8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,54 // je 202f <_sk_scale_u8_sse2+0x8f>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,23 // je 2016 <_sk_scale_u8_sse2+0x76>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,181 // jne 1fba <_sk_scale_u8_sse2+0x1a>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,54 // je 2041 <_sk_scale_u8_sse2+0x8f>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,23 // je 2028 <_sk_scale_u8_sse2+0x76>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,181 // jne 1fcc <_sk_scale_u8_sse2+0x1a>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,68,15,110,200 // movd %eax,%xmm9
.byte 69,15,198,200,0 // shufps $0x0,%xmm8,%xmm9
.byte 69,15,198,200,226 // shufps $0xe2,%xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,68,15,110,200 // movd %eax,%xmm9
.byte 243,69,15,16,193 // movss %xmm9,%xmm8
- .byte 233,119,255,255,255 // jmpq 1fba <_sk_scale_u8_sse2+0x1a>
+ .byte 233,119,255,255,255 // jmpq 1fcc <_sk_scale_u8_sse2+0x1a>
HIDDEN _sk_lerp_1_float_sse2
.globl _sk_lerp_1_float_sse2
@@ -31424,15 +31541,15 @@ HIDDEN _sk_lerp_u8_sse2
FUNCTION(_sk_lerp_u8_sse2)
_sk_lerp_u8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,81 // jne 20d6 <_sk_lerp_u8_sse2+0x5b>
- .byte 102,69,15,110,4,57 // movd (%r9,%rdi,1),%xmm8
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,81 // jne 20e8 <_sk_lerp_u8_sse2+0x5b>
+ .byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8
.byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 102,68,15,219,5,242,57,0,0 // pand 0x39f2(%rip),%xmm8 # 5a90 <_sk_callback_sse2+0x5a0>
+ .byte 102,68,15,219,5,32,58,0,0 // pand 0x3a20(%rip),%xmm8 # 5ad0 <_sk_callback_sse2+0x5a5>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,246,57,0,0 // mulps 0x39f6(%rip),%xmm8 # 5aa0 <_sk_callback_sse2+0x5b0>
+ .byte 68,15,89,5,36,58,0,0 // mulps 0x3a24(%rip),%xmm8 # 5ae0 <_sk_callback_sse2+0x5b5>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -31447,49 +31564,49 @@ _sk_lerp_u8_sse2:
.byte 15,88,223 // addps %xmm7,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,54 // je 211e <_sk_lerp_u8_sse2+0xa3>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,23 // je 2105 <_sk_lerp_u8_sse2+0x8a>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,161 // jne 2095 <_sk_lerp_u8_sse2+0x1a>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,54 // je 2130 <_sk_lerp_u8_sse2+0xa3>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,23 // je 2117 <_sk_lerp_u8_sse2+0x8a>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,161 // jne 20a7 <_sk_lerp_u8_sse2+0x1a>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,68,15,110,200 // movd %eax,%xmm9
.byte 69,15,198,200,0 // shufps $0x0,%xmm8,%xmm9
.byte 69,15,198,200,226 // shufps $0xe2,%xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,68,15,110,200 // movd %eax,%xmm9
.byte 243,69,15,16,193 // movss %xmm9,%xmm8
- .byte 233,99,255,255,255 // jmpq 2095 <_sk_lerp_u8_sse2+0x1a>
+ .byte 233,99,255,255,255 // jmpq 20a7 <_sk_lerp_u8_sse2+0x1a>
HIDDEN _sk_lerp_565_sse2
.globl _sk_lerp_565_sse2
FUNCTION(_sk_lerp_565_sse2)
_sk_lerp_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,156,0,0,0 // jne 21dc <_sk_lerp_565_sse2+0xaa>
- .byte 243,69,15,126,12,121 // movq (%r9,%rdi,2),%xmm9
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,156,0,0,0 // jne 21ee <_sk_lerp_565_sse2+0xaa>
+ .byte 243,69,15,126,12,82 // movq (%r10,%rdx,2),%xmm9
.byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9
- .byte 102,68,15,111,5,92,57,0,0 // movdqa 0x395c(%rip),%xmm8 # 5ab0 <_sk_callback_sse2+0x5c0>
+ .byte 102,68,15,111,5,138,57,0,0 // movdqa 0x398a(%rip),%xmm8 # 5af0 <_sk_callback_sse2+0x5c5>
.byte 102,69,15,219,193 // pand %xmm9,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,91,57,0,0 // mulps 0x395b(%rip),%xmm8 # 5ac0 <_sk_callback_sse2+0x5d0>
- .byte 102,68,15,111,21,98,57,0,0 // movdqa 0x3962(%rip),%xmm10 # 5ad0 <_sk_callback_sse2+0x5e0>
+ .byte 68,15,89,5,137,57,0,0 // mulps 0x3989(%rip),%xmm8 # 5b00 <_sk_callback_sse2+0x5d5>
+ .byte 102,68,15,111,21,144,57,0,0 // movdqa 0x3990(%rip),%xmm10 # 5b10 <_sk_callback_sse2+0x5e5>
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
- .byte 68,15,89,21,97,57,0,0 // mulps 0x3961(%rip),%xmm10 # 5ae0 <_sk_callback_sse2+0x5f0>
- .byte 102,68,15,219,13,104,57,0,0 // pand 0x3968(%rip),%xmm9 # 5af0 <_sk_callback_sse2+0x600>
+ .byte 68,15,89,21,143,57,0,0 // mulps 0x398f(%rip),%xmm10 # 5b20 <_sk_callback_sse2+0x5f5>
+ .byte 102,68,15,219,13,150,57,0,0 // pand 0x3996(%rip),%xmm9 # 5b30 <_sk_callback_sse2+0x605>
.byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9
- .byte 68,15,89,13,108,57,0,0 // mulps 0x396c(%rip),%xmm9 # 5b00 <_sk_callback_sse2+0x610>
+ .byte 68,15,89,13,154,57,0,0 // mulps 0x399a(%rip),%xmm9 # 5b40 <_sk_callback_sse2+0x615>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -31511,130 +31628,133 @@ _sk_lerp_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,216 // movaps %xmm8,%xmm3
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,58 // je 2228 <_sk_lerp_565_sse2+0xf6>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,27 // je 220f <_sk_lerp_565_sse2+0xdd>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 15,133,77,255,255,255 // jne 214b <_sk_lerp_565_sse2+0x19>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,58 // je 223a <_sk_lerp_565_sse2+0xf6>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,27 // je 2221 <_sk_lerp_565_sse2+0xdd>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 15,133,77,255,255,255 // jne 215d <_sk_lerp_565_sse2+0x19>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 102,69,15,112,200,69 // pshufd $0x45,%xmm8,%xmm9
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 69,15,198,193,0 // shufps $0x0,%xmm9,%xmm8
.byte 69,15,198,193,226 // shufps $0xe2,%xmm9,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
.byte 243,69,15,16,200 // movss %xmm8,%xmm9
- .byte 233,15,255,255,255 // jmpq 214b <_sk_lerp_565_sse2+0x19>
+ .byte 233,15,255,255,255 // jmpq 215d <_sk_lerp_565_sse2+0x19>
HIDDEN _sk_load_tables_sse2
.globl _sk_load_tables_sse2
FUNCTION(_sk_load_tables_sse2)
_sk_load_tables_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,32,1,0,0 // jne 236a <_sk_load_tables_sse2+0x12e>
- .byte 243,69,15,111,12,184 // movdqu (%r8,%rdi,4),%xmm9
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,36,1,0,0 // jne 2380 <_sk_load_tables_sse2+0x132>
+ .byte 243,69,15,111,12,145 // movdqu (%r9,%rdx,4),%xmm9
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 102,68,15,111,5,180,56,0,0 // movdqa 0x38b4(%rip),%xmm8 # 5b10 <_sk_callback_sse2+0x620>
+ .byte 102,68,15,111,5,224,56,0,0 // movdqa 0x38e0(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x625>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
- .byte 102,73,15,126,200 // movq %xmm1,%r8
- .byte 102,73,15,126,193 // movq %xmm0,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 102,73,15,126,201 // movq %xmm1,%r9
+ .byte 102,73,15,126,194 // movq %xmm0,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 69,15,182,241 // movzbl %r9b,%r14d
.byte 73,193,233,30 // shr $0x1e,%r9
- .byte 69,15,182,216 // movzbl %r8b,%r11d
- .byte 73,193,232,30 // shr $0x1e,%r8
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,12,11 // movss (%rbx,%r9,1),%xmm1
- .byte 243,66,15,16,4,3 // movss (%rbx,%r8,1),%xmm0
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,12,19 // movss (%rbx,%r10,1),%xmm1
+ .byte 243,66,15,16,4,11 // movss (%rbx,%r9,1),%xmm0
.byte 15,20,200 // unpcklps %xmm0,%xmm1
- .byte 243,66,15,16,4,147 // movss (%rbx,%r10,4),%xmm0
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
+ .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
+ .byte 243,66,15,16,20,179 // movss (%rbx,%r14,4),%xmm2
.byte 15,20,194 // unpcklps %xmm2,%xmm0
.byte 15,20,193 // unpcklps %xmm1,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
.byte 102,65,15,219,200 // pand %xmm8,%xmm1
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
- .byte 102,73,15,126,208 // movq %xmm2,%r8
+ .byte 102,73,15,126,209 // movq %xmm2,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 68,15,182,203 // movzbl %bl,%r9d
+ .byte 68,15,182,211 // movzbl %bl,%r10d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,15,182,208 // movzbl %r8b,%r10d
- .byte 73,193,232,30 // shr $0x1e,%r8
- .byte 243,65,15,16,20,30 // movss (%r14,%rbx,1),%xmm2
- .byte 243,67,15,16,12,6 // movss (%r14,%r8,1),%xmm1
+ .byte 69,15,182,217 // movzbl %r9b,%r11d
+ .byte 73,193,233,30 // shr $0x1e,%r9
+ .byte 243,65,15,16,20,31 // movss (%r15,%rbx,1),%xmm2
+ .byte 243,67,15,16,12,15 // movss (%r15,%r9,1),%xmm1
.byte 15,20,209 // unpcklps %xmm1,%xmm2
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
- .byte 243,67,15,16,28,150 // movss (%r14,%r10,4),%xmm3
+ .byte 243,67,15,16,12,151 // movss (%r15,%r10,4),%xmm1
+ .byte 243,67,15,16,28,159 // movss (%r15,%r11,4),%xmm3
.byte 15,20,203 // unpcklps %xmm3,%xmm1
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 76,139,64,24 // mov 0x18(%rax),%r8
+ .byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 102,65,15,111,209 // movdqa %xmm9,%xmm2
.byte 102,15,114,210,16 // psrld $0x10,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,112,218,78 // pshufd $0x4e,%xmm2,%xmm3
.byte 102,72,15,126,219 // movq %xmm3,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 68,15,182,200 // movzbl %al,%r9d
+ .byte 68,15,182,208 // movzbl %al,%r10d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 68,15,182,211 // movzbl %bl,%r10d
+ .byte 68,15,182,219 // movzbl %bl,%r11d
.byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 243,69,15,16,4,0 // movss (%r8,%rax,1),%xmm8
- .byte 243,65,15,16,20,24 // movss (%r8,%rbx,1),%xmm2
+ .byte 243,69,15,16,4,1 // movss (%r9,%rax,1),%xmm8
+ .byte 243,65,15,16,20,25 // movss (%r9,%rbx,1),%xmm2
.byte 68,15,20,194 // unpcklps %xmm2,%xmm8
- .byte 243,67,15,16,20,136 // movss (%r8,%r9,4),%xmm2
- .byte 243,67,15,16,28,144 // movss (%r8,%r10,4),%xmm3
+ .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
+ .byte 243,67,15,16,28,153 // movss (%r9,%r11,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,208 // unpcklps %xmm8,%xmm2
.byte 102,65,15,114,209,24 // psrld $0x18,%xmm9
.byte 65,15,91,217 // cvtdq2ps %xmm9,%xmm3
- .byte 15,89,29,189,55,0,0 // mulps 0x37bd(%rip),%xmm3 # 5b20 <_sk_callback_sse2+0x630>
+ .byte 15,89,29,233,55,0,0 // mulps 0x37e9(%rip),%xmm3 # 5b60 <_sk_callback_sse2+0x635>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 65,137,201 // mov %ecx,%r9d
- .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 69,137,194 // mov %r8d,%r10d
+ .byte 65,128,226,3 // and $0x3,%r10b
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
- .byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,50 // je 23ae <_sk_load_tables_sse2+0x172>
- .byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,23 // je 2399 <_sk_load_tables_sse2+0x15d>
- .byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 15,133,196,254,255,255 // jne 2250 <_sk_load_tables_sse2+0x14>
- .byte 102,65,15,110,68,184,8 // movd 0x8(%r8,%rdi,4),%xmm0
+ .byte 65,128,250,1 // cmp $0x1,%r10b
+ .byte 116,50 // je 23c4 <_sk_load_tables_sse2+0x176>
+ .byte 65,128,250,2 // cmp $0x2,%r10b
+ .byte 116,23 // je 23af <_sk_load_tables_sse2+0x161>
+ .byte 65,128,250,3 // cmp $0x3,%r10b
+ .byte 15,133,192,254,255,255 // jne 2262 <_sk_load_tables_sse2+0x14>
+ .byte 102,65,15,110,68,145,8 // movd 0x8(%r9,%rdx,4),%xmm0
.byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9
- .byte 243,65,15,16,68,184,4 // movss 0x4(%r8,%rdi,4),%xmm0
+ .byte 243,65,15,16,68,145,4 // movss 0x4(%r9,%rdx,4),%xmm0
.byte 65,15,198,193,0 // shufps $0x0,%xmm9,%xmm0
.byte 65,15,198,193,226 // shufps $0xe2,%xmm9,%xmm0
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 243,65,15,16,4,184 // movss (%r8,%rdi,4),%xmm0
+ .byte 243,65,15,16,4,145 // movss (%r9,%rdx,4),%xmm0
.byte 243,68,15,16,200 // movss %xmm0,%xmm9
- .byte 233,146,254,255,255 // jmpq 2250 <_sk_load_tables_sse2+0x14>
+ .byte 233,142,254,255,255 // jmpq 2262 <_sk_load_tables_sse2+0x14>
HIDDEN _sk_load_tables_u16_be_sse2
.globl _sk_load_tables_u16_be_sse2
FUNCTION(_sk_load_tables_u16_be_sse2)
_sk_load_tables_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,189,0,0,0,0 // lea 0x0(,%rdi,4),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,97,1,0,0 // jne 2535 <_sk_load_tables_u16_be_sse2+0x177>
- .byte 102,67,15,16,4,72 // movupd (%r8,%r9,2),%xmm0
- .byte 102,67,15,16,76,72,16 // movupd 0x10(%r8,%r9,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,101,1,0,0 // jne 254f <_sk_load_tables_u16_be_sse2+0x17b>
+ .byte 102,67,15,16,4,81 // movupd (%r9,%r10,2),%xmm0
+ .byte 102,67,15,16,76,81,16 // movupd 0x10(%r9,%r10,2),%xmm1
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 102,68,15,40,200 // movapd %xmm0,%xmm9
@@ -31643,25 +31763,25 @@ _sk_load_tables_u16_be_sse2:
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,97,200 // punpcklwd %xmm0,%xmm1
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
- .byte 102,68,15,111,21,39,55,0,0 // movdqa 0x3727(%rip),%xmm10 # 5b30 <_sk_callback_sse2+0x640>
+ .byte 102,68,15,111,21,79,55,0,0 // movdqa 0x374f(%rip),%xmm10 # 5b70 <_sk_callback_sse2+0x645>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,194 // pand %xmm10,%xmm0
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
.byte 102,65,15,97,192 // punpcklwd %xmm8,%xmm0
.byte 102,15,112,216,78 // pshufd $0x4e,%xmm0,%xmm3
- .byte 102,73,15,126,216 // movq %xmm3,%r8
- .byte 69,15,182,200 // movzbl %r8b,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,15,182,218 // movzbl %r10b,%r11d
- .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 102,73,15,126,217 // movq %xmm3,%r9
+ .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 69,15,182,243 // movzbl %r11b,%r14d
+ .byte 73,193,235,30 // shr $0x1e,%r11
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,28,19 // movss (%rbx,%r10,1),%xmm3
- .byte 243,66,15,16,4,131 // movss (%rbx,%r8,4),%xmm0
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,28,27 // movss (%rbx,%r11,1),%xmm3
+ .byte 243,66,15,16,4,139 // movss (%rbx,%r9,4),%xmm0
.byte 15,20,216 // unpcklps %xmm0,%xmm3
- .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
+ .byte 243,66,15,16,4,179 // movss (%rbx,%r14,4),%xmm0
+ .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
.byte 15,20,194 // unpcklps %xmm2,%xmm0
.byte 15,20,195 // unpcklps %xmm3,%xmm0
.byte 102,15,115,217,8 // psrldq $0x8,%xmm1
@@ -31669,33 +31789,33 @@ _sk_load_tables_u16_be_sse2:
.byte 102,65,15,97,200 // punpcklwd %xmm8,%xmm1
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 68,15,182,195 // movzbl %bl,%r8d
+ .byte 68,15,182,203 // movzbl %bl,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,73,15,126,201 // movq %xmm1,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
- .byte 73,193,233,30 // shr $0x1e,%r9
- .byte 243,67,15,16,20,14 // movss (%r14,%r9,1),%xmm2
- .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 102,73,15,126,202 // movq %xmm1,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 243,67,15,16,20,23 // movss (%r15,%r10,1),%xmm2
+ .byte 243,65,15,16,12,159 // movss (%r15,%rbx,4),%xmm1
.byte 15,20,209 // unpcklps %xmm1,%xmm2
- .byte 243,67,15,16,12,150 // movss (%r14,%r10,4),%xmm1
- .byte 243,67,15,16,28,134 // movss (%r14,%r8,4),%xmm3
+ .byte 243,67,15,16,12,159 // movss (%r15,%r11,4),%xmm1
+ .byte 243,67,15,16,28,143 // movss (%r15,%r9,4),%xmm3
.byte 15,20,203 // unpcklps %xmm3,%xmm1
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 76,139,72,24 // mov 0x18(%rax),%r9
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 102,69,15,97,208 // punpcklwd %xmm8,%xmm10
.byte 102,65,15,112,210,78 // pshufd $0x4e,%xmm10,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 68,15,182,195 // movzbl %bl,%r8d
+ .byte 68,15,182,203 // movzbl %bl,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
.byte 102,76,15,126,208 // movq %xmm10,%rax
- .byte 68,15,182,208 // movzbl %al,%r10d
+ .byte 68,15,182,216 // movzbl %al,%r11d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 243,69,15,16,20,1 // movss (%r9,%rax,1),%xmm10
- .byte 243,65,15,16,20,153 // movss (%r9,%rbx,4),%xmm2
+ .byte 243,69,15,16,20,2 // movss (%r10,%rax,1),%xmm10
+ .byte 243,65,15,16,20,154 // movss (%r10,%rbx,4),%xmm2
.byte 68,15,20,210 // unpcklps %xmm2,%xmm10
- .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
- .byte 243,67,15,16,28,129 // movss (%r9,%r8,4),%xmm3
+ .byte 243,67,15,16,20,154 // movss (%r10,%r11,4),%xmm2
+ .byte 243,67,15,16,28,138 // movss (%r10,%r9,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,210 // unpcklps %xmm10,%xmm2
.byte 102,65,15,112,217,78 // pshufd $0x4e,%xmm9,%xmm3
@@ -31705,206 +31825,210 @@ _sk_load_tables_u16_be_sse2:
.byte 102,65,15,235,217 // por %xmm9,%xmm3
.byte 102,65,15,97,216 // punpcklwd %xmm8,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,18,54,0,0 // mulps 0x3612(%rip),%xmm3 # 5b40 <_sk_callback_sse2+0x650>
+ .byte 15,89,29,58,54,0,0 // mulps 0x363a(%rip),%xmm3 # 5b80 <_sk_callback_sse2+0x655>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 242,67,15,16,4,72 // movsd (%r8,%r9,2),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,17 // jne 2552 <_sk_load_tables_u16_be_sse2+0x194>
+ .byte 242,67,15,16,4,81 // movsd (%r9,%r10,2),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,17 // jne 256c <_sk_load_tables_u16_be_sse2+0x198>
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 102,15,20,193 // unpcklpd %xmm1,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 233,143,254,255,255 // jmpq 23e1 <_sk_load_tables_u16_be_sse2+0x23>
- .byte 102,67,15,22,68,72,8 // movhpd 0x8(%r8,%r9,2),%xmm0
+ .byte 233,139,254,255,255 // jmpq 23f7 <_sk_load_tables_u16_be_sse2+0x23>
+ .byte 102,67,15,22,68,81,8 // movhpd 0x8(%r9,%r10,2),%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,122,254,255,255 // jb 23e1 <_sk_load_tables_u16_be_sse2+0x23>
- .byte 242,67,15,16,76,72,16 // movsd 0x10(%r8,%r9,2),%xmm1
- .byte 233,110,254,255,255 // jmpq 23e1 <_sk_load_tables_u16_be_sse2+0x23>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,118,254,255,255 // jb 23f7 <_sk_load_tables_u16_be_sse2+0x23>
+ .byte 242,67,15,16,76,81,16 // movsd 0x10(%r9,%r10,2),%xmm1
+ .byte 233,106,254,255,255 // jmpq 23f7 <_sk_load_tables_u16_be_sse2+0x23>
HIDDEN _sk_load_tables_rgb_u16_be_sse2
.globl _sk_load_tables_rgb_u16_be_sse2
FUNCTION(_sk_load_tables_rgb_u16_be_sse2)
_sk_load_tables_rgb_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 76,141,12,127 // lea (%rdi,%rdi,2),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,80,1,0,0 // jne 26d5 <_sk_load_tables_rgb_u16_be_sse2+0x162>
- .byte 243,71,15,111,28,72 // movdqu (%r8,%r9,2),%xmm11
- .byte 243,67,15,111,76,72,8 // movdqu 0x8(%r8,%r9,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,84,1,0,0 // jne 26f3 <_sk_load_tables_rgb_u16_be_sse2+0x166>
+ .byte 243,71,15,111,28,81 // movdqu (%r9,%r10,2),%xmm11
+ .byte 243,67,15,111,76,81,8 // movdqu 0x8(%r9,%r10,2),%xmm1
.byte 102,15,115,217,4 // psrldq $0x4,%xmm1
.byte 102,69,15,111,211 // movdqa %xmm11,%xmm10
.byte 102,65,15,115,218,6 // psrldq $0x6,%xmm10
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,115,216,6 // psrldq $0x6,%xmm0
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 102,68,15,97,217 // punpcklwd %xmm1,%xmm11
.byte 102,68,15,97,208 // punpcklwd %xmm0,%xmm10
.byte 102,65,15,111,195 // movdqa %xmm11,%xmm0
.byte 102,65,15,97,194 // punpcklwd %xmm10,%xmm0
- .byte 102,68,15,111,5,133,53,0,0 // movdqa 0x3585(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x660>
+ .byte 102,68,15,111,5,169,53,0,0 // movdqa 0x35a9(%rip),%xmm8 # 5b90 <_sk_callback_sse2+0x665>
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0
.byte 102,15,112,216,78 // pshufd $0x4e,%xmm0,%xmm3
- .byte 102,73,15,126,216 // movq %xmm3,%r8
- .byte 69,15,182,200 // movzbl %r8b,%r9d
- .byte 73,193,232,32 // shr $0x20,%r8
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,15,182,218 // movzbl %r10b,%r11d
- .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 102,73,15,126,217 // movq %xmm3,%r9
+ .byte 69,15,182,209 // movzbl %r9b,%r10d
+ .byte 73,193,233,32 // shr $0x20,%r9
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 69,15,182,243 // movzbl %r11b,%r14d
+ .byte 73,193,235,30 // shr $0x1e,%r11
.byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,28,19 // movss (%rbx,%r10,1),%xmm3
- .byte 243,66,15,16,4,131 // movss (%rbx,%r8,4),%xmm0
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,66,15,16,28,27 // movss (%rbx,%r11,1),%xmm3
+ .byte 243,66,15,16,4,139 // movss (%rbx,%r9,4),%xmm0
.byte 15,20,216 // unpcklps %xmm0,%xmm3
- .byte 243,66,15,16,4,155 // movss (%rbx,%r11,4),%xmm0
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
+ .byte 243,66,15,16,4,179 // movss (%rbx,%r14,4),%xmm0
+ .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
.byte 15,20,194 // unpcklps %xmm2,%xmm0
.byte 15,20,195 // unpcklps %xmm3,%xmm0
.byte 102,65,15,219,200 // pand %xmm8,%xmm1
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 68,15,182,195 // movzbl %bl,%r8d
+ .byte 68,15,182,203 // movzbl %bl,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,73,15,126,201 // movq %xmm1,%r9
- .byte 69,15,182,209 // movzbl %r9b,%r10d
- .byte 73,193,233,30 // shr $0x1e,%r9
- .byte 243,67,15,16,20,14 // movss (%r14,%r9,1),%xmm2
- .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 102,73,15,126,202 // movq %xmm1,%r10
+ .byte 69,15,182,218 // movzbl %r10b,%r11d
+ .byte 73,193,234,30 // shr $0x1e,%r10
+ .byte 243,67,15,16,20,23 // movss (%r15,%r10,1),%xmm2
+ .byte 243,65,15,16,12,159 // movss (%r15,%rbx,4),%xmm1
.byte 15,20,209 // unpcklps %xmm1,%xmm2
- .byte 243,67,15,16,12,150 // movss (%r14,%r10,4),%xmm1
- .byte 243,67,15,16,28,134 // movss (%r14,%r8,4),%xmm3
+ .byte 243,67,15,16,12,159 // movss (%r15,%r11,4),%xmm1
+ .byte 243,67,15,16,28,143 // movss (%r15,%r9,4),%xmm3
.byte 15,20,203 // unpcklps %xmm3,%xmm1
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 76,139,72,24 // mov 0x18(%rax),%r9
+ .byte 76,139,80,24 // mov 0x18(%rax),%r10
.byte 102,69,15,105,218 // punpckhwd %xmm10,%xmm11
.byte 102,69,15,219,216 // pand %xmm8,%xmm11
.byte 102,69,15,97,217 // punpcklwd %xmm9,%xmm11
.byte 102,65,15,112,211,78 // pshufd $0x4e,%xmm11,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 68,15,182,195 // movzbl %bl,%r8d
+ .byte 68,15,182,203 // movzbl %bl,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
.byte 102,76,15,126,216 // movq %xmm11,%rax
- .byte 68,15,182,208 // movzbl %al,%r10d
+ .byte 68,15,182,216 // movzbl %al,%r11d
.byte 72,193,232,30 // shr $0x1e,%rax
- .byte 243,69,15,16,4,1 // movss (%r9,%rax,1),%xmm8
- .byte 243,65,15,16,20,153 // movss (%r9,%rbx,4),%xmm2
+ .byte 243,69,15,16,4,2 // movss (%r10,%rax,1),%xmm8
+ .byte 243,65,15,16,20,154 // movss (%r10,%rbx,4),%xmm2
.byte 68,15,20,194 // unpcklps %xmm2,%xmm8
- .byte 243,67,15,16,20,145 // movss (%r9,%r10,4),%xmm2
- .byte 243,67,15,16,28,129 // movss (%r9,%r8,4),%xmm3
+ .byte 243,67,15,16,20,154 // movss (%r10,%r11,4),%xmm2
+ .byte 243,67,15,16,28,138 // movss (%r10,%r9,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,208 // unpcklps %xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,144,52,0,0 // movaps 0x3490(%rip),%xmm3 # 5b60 <_sk_callback_sse2+0x670>
+ .byte 15,40,29,180,52,0,0 // movaps 0x34b4(%rip),%xmm3 # 5ba0 <_sk_callback_sse2+0x675>
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
- .byte 102,71,15,110,28,72 // movd (%r8,%r9,2),%xmm11
- .byte 102,71,15,196,92,72,4,2 // pinsrw $0x2,0x4(%r8,%r9,2),%xmm11
+ .byte 102,71,15,110,28,81 // movd (%r9,%r10,2),%xmm11
+ .byte 102,71,15,196,92,81,4,2 // pinsrw $0x2,0x4(%r9,%r10,2),%xmm11
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,14 // jne 26fb <_sk_load_tables_rgb_u16_be_sse2+0x188>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,14 // jne 2719 <_sk_load_tables_rgb_u16_be_sse2+0x18c>
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
- .byte 233,176,254,255,255 // jmpq 25ab <_sk_load_tables_rgb_u16_be_sse2+0x38>
- .byte 102,71,15,110,84,72,6 // movd 0x6(%r8,%r9,2),%xmm10
- .byte 102,71,15,196,84,72,10,2 // pinsrw $0x2,0xa(%r8,%r9,2),%xmm10
+ .byte 233,172,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ .byte 102,71,15,110,84,81,6 // movd 0x6(%r9,%r10,2),%xmm10
+ .byte 102,71,15,196,84,81,10,2 // pinsrw $0x2,0xa(%r9,%r10,2),%xmm10
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,24 // jb 272c <_sk_load_tables_rgb_u16_be_sse2+0x1b9>
- .byte 102,67,15,110,76,72,12 // movd 0xc(%r8,%r9,2),%xmm1
- .byte 102,67,15,196,76,72,16,2 // pinsrw $0x2,0x10(%r8,%r9,2),%xmm1
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,24 // jb 274a <_sk_load_tables_rgb_u16_be_sse2+0x1bd>
+ .byte 102,67,15,110,76,81,12 // movd 0xc(%r9,%r10,2),%xmm1
+ .byte 102,67,15,196,76,81,16,2 // pinsrw $0x2,0x10(%r9,%r10,2),%xmm1
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,127,254,255,255 // jmpq 25ab <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ .byte 233,123,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38>
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,118,254,255,255 // jmpq 25ab <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ .byte 233,114,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38>
HIDDEN _sk_byte_tables_sse2
.globl _sk_byte_tables_sse2
FUNCTION(_sk_byte_tables_sse2)
_sk_byte_tables_sse2:
.byte 85 // push %rbp
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,45,52,0,0 // movaps 0x342d(%rip),%xmm8 # 5b70 <_sk_callback_sse2+0x680>
+ .byte 68,15,40,5,77,52,0,0 // movaps 0x344d(%rip),%xmm8 # 5bb0 <_sk_callback_sse2+0x685>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
- .byte 102,73,15,126,192 // movq %xmm0,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 77,137,194 // mov %r8,%r10
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 102,73,15,126,193 // movq %xmm0,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 77,137,203 // mov %r9,%r11
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,73,15,126,192 // movq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,198 // mov %r8,%r14
- .byte 73,193,238,32 // shr $0x20,%r14
+ .byte 102,73,15,126,193 // movq %xmm0,%r9
+ .byte 69,137,206 // mov %r9d,%r14d
+ .byte 77,137,207 // mov %r9,%r15
+ .byte 73,193,239,32 // shr $0x20,%r15
.byte 72,139,24 // mov (%rax),%rbx
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 70,15,182,28,27 // movzbl (%rbx,%r11,1),%r11d
- .byte 66,15,182,44,51 // movzbl (%rbx,%r14,1),%ebp
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 70,15,182,52,51 // movzbl (%rbx,%r14,1),%r14d
+ .byte 66,15,182,44,59 // movzbl (%rbx,%r15,1),%ebp
.byte 193,229,8 // shl $0x8,%ebp
- .byte 68,9,221 // or %r11d,%ebp
- .byte 70,15,182,12,11 // movzbl (%rbx,%r9,1),%r9d
- .byte 66,15,182,28,19 // movzbl (%rbx,%r10,1),%ebx
+ .byte 68,9,245 // or %r14d,%ebp
+ .byte 70,15,182,20,19 // movzbl (%rbx,%r10,1),%r10d
+ .byte 66,15,182,28,27 // movzbl (%rbx,%r11,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,203 // or %r9d,%ebx
+ .byte 68,9,211 // or %r10d,%ebx
.byte 102,15,196,195,0 // pinsrw $0x0,%ebx,%xmm0
.byte 102,15,196,197,1 // pinsrw $0x1,%ebp,%xmm0
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0
.byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,21,199,51,0,0 // movaps 0x33c7(%rip),%xmm10 # 5b80 <_sk_callback_sse2+0x690>
+ .byte 68,15,40,21,231,51,0,0 // movaps 0x33e7(%rip),%xmm10 # 5bc0 <_sk_callback_sse2+0x695>
.byte 65,15,89,194 // mulps %xmm10,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,72,15,126,205 // movq %xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
+ .byte 65,137,234 // mov %ebp,%r10d
.byte 72,193,237,32 // shr $0x20,%rbp
.byte 102,15,112,201,78 // pshufd $0x4e,%xmm1,%xmm1
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
+ .byte 65,137,219 // mov %ebx,%r11d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 71,15,182,20,16 // movzbl (%r8,%r10,1),%r10d
- .byte 65,15,182,28,24 // movzbl (%r8,%rbx,1),%ebx
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 65,15,182,28,25 // movzbl (%r9,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,211 // or %r10d,%ebx
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
+ .byte 68,9,219 // or %r11d,%ebx
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
.byte 193,229,8 // shl $0x8,%ebp
- .byte 68,9,205 // or %r9d,%ebp
+ .byte 68,9,213 // or %r10d,%ebp
.byte 102,15,196,205,0 // pinsrw $0x0,%ebp,%xmm1
.byte 102,15,196,203,1 // pinsrw $0x1,%ebx,%xmm1
.byte 102,65,15,96,201 // punpcklbw %xmm9,%xmm1
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,202 // mulps %xmm10,%xmm1
- .byte 76,139,72,16 // mov 0x10(%rax),%r9
+ .byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,91,210 // cvtps2dq %xmm2,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 65,137,216 // mov %ebx,%r8d
+ .byte 65,137,217 // mov %ebx,%r9d
.byte 72,193,235,32 // shr $0x20,%rbx
.byte 102,15,112,210,78 // pshufd $0x4e,%xmm2,%xmm2
.byte 102,72,15,126,213 // movq %xmm2,%rbp
- .byte 65,137,234 // mov %ebp,%r10d
+ .byte 65,137,235 // mov %ebp,%r11d
.byte 72,193,237,32 // shr $0x20,%rbp
- .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
- .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
+ .byte 71,15,182,28,26 // movzbl (%r10,%r11,1),%r11d
+ .byte 65,15,182,44,42 // movzbl (%r10,%rbp,1),%ebp
.byte 193,229,8 // shl $0x8,%ebp
- .byte 68,9,213 // or %r10d,%ebp
- .byte 71,15,182,4,1 // movzbl (%r9,%r8,1),%r8d
- .byte 65,15,182,28,25 // movzbl (%r9,%rbx,1),%ebx
+ .byte 68,9,221 // or %r11d,%ebp
+ .byte 71,15,182,12,10 // movzbl (%r10,%r9,1),%r9d
+ .byte 65,15,182,28,26 // movzbl (%r10,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,195 // or %r8d,%ebx
+ .byte 68,9,203 // or %r9d,%ebx
.byte 102,15,196,211,0 // pinsrw $0x0,%ebx,%xmm2
.byte 102,15,196,213,1 // pinsrw $0x1,%ebp,%xmm2
.byte 102,65,15,96,209 // punpcklbw %xmm9,%xmm2
@@ -31915,20 +32039,20 @@ _sk_byte_tables_sse2:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 102,15,91,219 // cvtps2dq %xmm3,%xmm3
.byte 102,72,15,126,221 // movq %xmm3,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
+ .byte 65,137,233 // mov %ebp,%r9d
.byte 72,193,237,32 // shr $0x20,%rbp
.byte 102,15,112,219,78 // pshufd $0x4e,%xmm3,%xmm3
.byte 102,72,15,126,219 // movq %xmm3,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
+ .byte 65,137,218 // mov %ebx,%r10d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 70,15,182,12,8 // movzbl (%rax,%r9,1),%r9d
+ .byte 70,15,182,20,16 // movzbl (%rax,%r10,1),%r10d
.byte 15,182,28,24 // movzbl (%rax,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,203 // or %r9d,%ebx
- .byte 70,15,182,4,0 // movzbl (%rax,%r8,1),%r8d
+ .byte 68,9,211 // or %r10d,%ebx
+ .byte 70,15,182,12,8 // movzbl (%rax,%r9,1),%r9d
.byte 15,182,4,40 // movzbl (%rax,%rbp,1),%eax
.byte 193,224,8 // shl $0x8,%eax
- .byte 68,9,192 // or %r8d,%eax
+ .byte 68,9,200 // or %r9d,%eax
.byte 102,15,196,216,0 // pinsrw $0x0,%eax,%xmm3
.byte 102,15,196,219,1 // pinsrw $0x1,%ebx,%xmm3
.byte 102,65,15,96,217 // punpcklbw %xmm9,%xmm3
@@ -31938,6 +32062,7 @@ _sk_byte_tables_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
@@ -31946,60 +32071,61 @@ HIDDEN _sk_byte_tables_rgb_sse2
FUNCTION(_sk_byte_tables_rgb_sse2)
_sk_byte_tables_rgb_sse2:
.byte 85 // push %rbp
+ .byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,139,64,24 // mov 0x18(%rax),%r8d
- .byte 65,255,200 // dec %r8d
- .byte 102,69,15,110,192 // movd %r8d,%xmm8
+ .byte 68,139,72,24 // mov 0x18(%rax),%r9d
+ .byte 65,255,201 // dec %r9d
+ .byte 102,69,15,110,193 // movd %r9d,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
- .byte 102,73,15,126,192 // movq %xmm0,%r8
- .byte 69,137,193 // mov %r8d,%r9d
- .byte 77,137,194 // mov %r8,%r10
- .byte 73,193,234,32 // shr $0x20,%r10
+ .byte 102,73,15,126,193 // movq %xmm0,%r9
+ .byte 69,137,202 // mov %r9d,%r10d
+ .byte 77,137,203 // mov %r9,%r11
+ .byte 73,193,235,32 // shr $0x20,%r11
.byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,73,15,126,192 // movq %xmm0,%r8
- .byte 69,137,195 // mov %r8d,%r11d
- .byte 77,137,198 // mov %r8,%r14
- .byte 73,193,238,32 // shr $0x20,%r14
+ .byte 102,73,15,126,193 // movq %xmm0,%r9
+ .byte 69,137,206 // mov %r9d,%r14d
+ .byte 77,137,207 // mov %r9,%r15
+ .byte 73,193,239,32 // shr $0x20,%r15
.byte 72,139,24 // mov (%rax),%rbx
- .byte 76,139,64,8 // mov 0x8(%rax),%r8
- .byte 70,15,182,28,27 // movzbl (%rbx,%r11,1),%r11d
- .byte 66,15,182,44,51 // movzbl (%rbx,%r14,1),%ebp
+ .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 70,15,182,52,51 // movzbl (%rbx,%r14,1),%r14d
+ .byte 66,15,182,44,59 // movzbl (%rbx,%r15,1),%ebp
.byte 193,229,8 // shl $0x8,%ebp
- .byte 68,9,221 // or %r11d,%ebp
- .byte 70,15,182,12,11 // movzbl (%rbx,%r9,1),%r9d
- .byte 66,15,182,28,19 // movzbl (%rbx,%r10,1),%ebx
+ .byte 68,9,245 // or %r14d,%ebp
+ .byte 70,15,182,20,19 // movzbl (%rbx,%r10,1),%r10d
+ .byte 66,15,182,28,27 // movzbl (%rbx,%r11,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,203 // or %r9d,%ebx
+ .byte 68,9,211 // or %r10d,%ebx
.byte 102,15,196,195,0 // pinsrw $0x0,%ebx,%xmm0
.byte 102,15,196,197,1 // pinsrw $0x1,%ebp,%xmm0
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0
.byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,21,19,50,0,0 // movaps 0x3213(%rip),%xmm10 # 5b90 <_sk_callback_sse2+0x6a0>
+ .byte 68,15,40,21,47,50,0,0 // movaps 0x322f(%rip),%xmm10 # 5bd0 <_sk_callback_sse2+0x6a5>
.byte 65,15,89,194 // mulps %xmm10,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,72,15,126,205 // movq %xmm1,%rbp
- .byte 65,137,233 // mov %ebp,%r9d
+ .byte 65,137,234 // mov %ebp,%r10d
.byte 72,193,237,32 // shr $0x20,%rbp
.byte 102,15,112,201,78 // pshufd $0x4e,%xmm1,%xmm1
.byte 102,72,15,126,203 // movq %xmm1,%rbx
- .byte 65,137,218 // mov %ebx,%r10d
+ .byte 65,137,219 // mov %ebx,%r11d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 71,15,182,20,16 // movzbl (%r8,%r10,1),%r10d
- .byte 65,15,182,28,24 // movzbl (%r8,%rbx,1),%ebx
+ .byte 71,15,182,28,25 // movzbl (%r9,%r11,1),%r11d
+ .byte 65,15,182,28,25 // movzbl (%r9,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,211 // or %r10d,%ebx
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 65,15,182,44,40 // movzbl (%r8,%rbp,1),%ebp
+ .byte 68,9,219 // or %r11d,%ebx
+ .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d
+ .byte 65,15,182,44,41 // movzbl (%r9,%rbp,1),%ebp
.byte 193,229,8 // shl $0x8,%ebp
- .byte 68,9,205 // or %r9d,%ebp
+ .byte 68,9,213 // or %r10d,%ebp
.byte 102,15,196,205,0 // pinsrw $0x0,%ebp,%xmm1
.byte 102,15,196,203,1 // pinsrw $0x1,%ebx,%xmm1
.byte 102,65,15,96,201 // punpcklbw %xmm9,%xmm1
@@ -32010,20 +32136,20 @@ _sk_byte_tables_rgb_sse2:
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,91,210 // cvtps2dq %xmm2,%xmm2
.byte 102,72,15,126,213 // movq %xmm2,%rbp
- .byte 65,137,232 // mov %ebp,%r8d
+ .byte 65,137,233 // mov %ebp,%r9d
.byte 72,193,237,32 // shr $0x20,%rbp
.byte 102,15,112,210,78 // pshufd $0x4e,%xmm2,%xmm2
.byte 102,72,15,126,211 // movq %xmm2,%rbx
- .byte 65,137,217 // mov %ebx,%r9d
+ .byte 65,137,218 // mov %ebx,%r10d
.byte 72,193,235,32 // shr $0x20,%rbx
- .byte 70,15,182,12,8 // movzbl (%rax,%r9,1),%r9d
+ .byte 70,15,182,20,16 // movzbl (%rax,%r10,1),%r10d
.byte 15,182,28,24 // movzbl (%rax,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
- .byte 68,9,203 // or %r9d,%ebx
- .byte 70,15,182,4,0 // movzbl (%rax,%r8,1),%r8d
+ .byte 68,9,211 // or %r10d,%ebx
+ .byte 70,15,182,12,8 // movzbl (%rax,%r9,1),%r9d
.byte 15,182,4,40 // movzbl (%rax,%rbp,1),%eax
.byte 193,224,8 // shl $0x8,%eax
- .byte 68,9,192 // or %r8d,%eax
+ .byte 68,9,200 // or %r9d,%eax
.byte 102,15,196,208,0 // pinsrw $0x0,%eax,%xmm2
.byte 102,15,196,211,1 // pinsrw $0x1,%ebx,%xmm2
.byte 102,65,15,96,209 // punpcklbw %xmm9,%xmm2
@@ -32033,6 +32159,7 @@ _sk_byte_tables_rgb_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
@@ -32040,8 +32167,9 @@ HIDDEN _sk_table_r_sse2
.globl _sk_table_r_sse2
FUNCTION(_sk_table_r_sse2)
_sk_table_r_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -32051,27 +32179,29 @@ _sk_table_r_sse2:
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,112,192,78 // pshufd $0x4e,%xmm8,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,77,15,126,194 // movq %xmm8,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,71,15,16,4,144 // movss (%r8,%r10,4),%xmm8
- .byte 243,65,15,16,4,128 // movss (%r8,%rax,4),%xmm0
+ .byte 102,77,15,126,195 // movq %xmm8,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,71,15,16,4,153 // movss (%r9,%r11,4),%xmm8
+ .byte 243,65,15,16,4,129 // movss (%r9,%rax,4),%xmm0
.byte 68,15,20,192 // unpcklps %xmm0,%xmm8
- .byte 243,67,15,16,4,152 // movss (%r8,%r11,4),%xmm0
- .byte 243,71,15,16,12,136 // movss (%r8,%r9,4),%xmm9
+ .byte 243,65,15,16,4,153 // movss (%r9,%rbx,4),%xmm0
+ .byte 243,71,15,16,12,145 // movss (%r9,%r10,4),%xmm9
.byte 65,15,20,193 // unpcklps %xmm9,%xmm0
.byte 65,15,20,192 // unpcklps %xmm8,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_g_sse2
.globl _sk_table_g_sse2
FUNCTION(_sk_table_g_sse2)
_sk_table_g_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -32081,27 +32211,29 @@ _sk_table_g_sse2:
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,77,15,126,194 // movq %xmm8,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,71,15,16,4,144 // movss (%r8,%r10,4),%xmm8
- .byte 243,65,15,16,12,128 // movss (%r8,%rax,4),%xmm1
+ .byte 102,77,15,126,195 // movq %xmm8,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,71,15,16,4,153 // movss (%r9,%r11,4),%xmm8
+ .byte 243,65,15,16,12,129 // movss (%r9,%rax,4),%xmm1
.byte 68,15,20,193 // unpcklps %xmm1,%xmm8
- .byte 243,67,15,16,12,152 // movss (%r8,%r11,4),%xmm1
- .byte 243,71,15,16,12,136 // movss (%r8,%r9,4),%xmm9
+ .byte 243,65,15,16,12,153 // movss (%r9,%rbx,4),%xmm1
+ .byte 243,71,15,16,12,145 // movss (%r9,%r10,4),%xmm9
.byte 65,15,20,201 // unpcklps %xmm9,%xmm1
.byte 65,15,20,200 // unpcklps %xmm8,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_b_sse2
.globl _sk_table_b_sse2
FUNCTION(_sk_table_b_sse2)
_sk_table_b_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -32111,27 +32243,29 @@ _sk_table_b_sse2:
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,112,208,78 // pshufd $0x4e,%xmm8,%xmm2
.byte 102,72,15,126,208 // movq %xmm2,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,77,15,126,194 // movq %xmm8,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,71,15,16,4,144 // movss (%r8,%r10,4),%xmm8
- .byte 243,65,15,16,20,128 // movss (%r8,%rax,4),%xmm2
+ .byte 102,77,15,126,195 // movq %xmm8,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,71,15,16,4,153 // movss (%r9,%r11,4),%xmm8
+ .byte 243,65,15,16,20,129 // movss (%r9,%rax,4),%xmm2
.byte 68,15,20,194 // unpcklps %xmm2,%xmm8
- .byte 243,67,15,16,20,152 // movss (%r8,%r11,4),%xmm2
- .byte 243,71,15,16,12,136 // movss (%r8,%r9,4),%xmm9
+ .byte 243,65,15,16,20,153 // movss (%r9,%rbx,4),%xmm2
+ .byte 243,71,15,16,12,145 // movss (%r9,%r10,4),%xmm9
.byte 65,15,20,209 // unpcklps %xmm9,%xmm2
.byte 65,15,20,208 // unpcklps %xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_table_a_sse2
.globl _sk_table_a_sse2
FUNCTION(_sk_table_a_sse2)
_sk_table_a_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 139,64,8 // mov 0x8(%rax),%eax
.byte 255,200 // dec %eax
.byte 102,68,15,110,192 // movd %eax,%xmm8
@@ -32141,19 +32275,20 @@ _sk_table_a_sse2:
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,112,216,78 // pshufd $0x4e,%xmm8,%xmm3
.byte 102,72,15,126,216 // movq %xmm3,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,77,15,126,194 // movq %xmm8,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,71,15,16,4,144 // movss (%r8,%r10,4),%xmm8
- .byte 243,65,15,16,28,128 // movss (%r8,%rax,4),%xmm3
+ .byte 102,77,15,126,195 // movq %xmm8,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,71,15,16,4,153 // movss (%r9,%r11,4),%xmm8
+ .byte 243,65,15,16,28,129 // movss (%r9,%rax,4),%xmm3
.byte 68,15,20,195 // unpcklps %xmm3,%xmm8
- .byte 243,67,15,16,28,152 // movss (%r8,%r11,4),%xmm3
- .byte 243,71,15,16,12,136 // movss (%r8,%r9,4),%xmm9
+ .byte 243,65,15,16,28,153 // movss (%r9,%rbx,4),%xmm3
+ .byte 243,71,15,16,12,145 // movss (%r9,%r10,4),%xmm9
.byte 65,15,20,217 // unpcklps %xmm9,%xmm3
.byte 65,15,20,216 // unpcklps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_parametric_r_sse2
@@ -32179,15 +32314,15 @@ _sk_parametric_r_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,81,47,0,0 // mulps 0x2f51(%rip),%xmm9 # 5ba0 <_sk_callback_sse2+0x6b0>
- .byte 68,15,84,21,89,47,0,0 // andps 0x2f59(%rip),%xmm10 # 5bb0 <_sk_callback_sse2+0x6c0>
- .byte 68,15,86,21,97,47,0,0 // orps 0x2f61(%rip),%xmm10 # 5bc0 <_sk_callback_sse2+0x6d0>
- .byte 68,15,88,13,105,47,0,0 // addps 0x2f69(%rip),%xmm9 # 5bd0 <_sk_callback_sse2+0x6e0>
- .byte 68,15,40,37,113,47,0,0 // movaps 0x2f71(%rip),%xmm12 # 5be0 <_sk_callback_sse2+0x6f0>
+ .byte 68,15,89,13,99,47,0,0 // mulps 0x2f63(%rip),%xmm9 # 5be0 <_sk_callback_sse2+0x6b5>
+ .byte 68,15,84,21,107,47,0,0 // andps 0x2f6b(%rip),%xmm10 # 5bf0 <_sk_callback_sse2+0x6c5>
+ .byte 68,15,86,21,115,47,0,0 // orps 0x2f73(%rip),%xmm10 # 5c00 <_sk_callback_sse2+0x6d5>
+ .byte 68,15,88,13,123,47,0,0 // addps 0x2f7b(%rip),%xmm9 # 5c10 <_sk_callback_sse2+0x6e5>
+ .byte 68,15,40,37,131,47,0,0 // movaps 0x2f83(%rip),%xmm12 # 5c20 <_sk_callback_sse2+0x6f5>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,113,47,0,0 // addps 0x2f71(%rip),%xmm10 # 5bf0 <_sk_callback_sse2+0x700>
- .byte 68,15,40,37,121,47,0,0 // movaps 0x2f79(%rip),%xmm12 # 5c00 <_sk_callback_sse2+0x710>
+ .byte 68,15,88,21,131,47,0,0 // addps 0x2f83(%rip),%xmm10 # 5c30 <_sk_callback_sse2+0x705>
+ .byte 68,15,40,37,139,47,0,0 // movaps 0x2f8b(%rip),%xmm12 # 5c40 <_sk_callback_sse2+0x715>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -32195,22 +32330,22 @@ _sk_parametric_r_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,99,47,0,0 // movaps 0x2f63(%rip),%xmm10 # 5c10 <_sk_callback_sse2+0x720>
+ .byte 68,15,40,21,117,47,0,0 // movaps 0x2f75(%rip),%xmm10 # 5c50 <_sk_callback_sse2+0x725>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,87,47,0,0 // addps 0x2f57(%rip),%xmm9 # 5c20 <_sk_callback_sse2+0x730>
- .byte 68,15,40,37,95,47,0,0 // movaps 0x2f5f(%rip),%xmm12 # 5c30 <_sk_callback_sse2+0x740>
+ .byte 68,15,88,13,105,47,0,0 // addps 0x2f69(%rip),%xmm9 # 5c60 <_sk_callback_sse2+0x735>
+ .byte 68,15,40,37,113,47,0,0 // movaps 0x2f71(%rip),%xmm12 # 5c70 <_sk_callback_sse2+0x745>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,95,47,0,0 // movaps 0x2f5f(%rip),%xmm12 # 5c40 <_sk_callback_sse2+0x750>
+ .byte 68,15,40,37,113,47,0,0 // movaps 0x2f71(%rip),%xmm12 # 5c80 <_sk_callback_sse2+0x755>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,99,47,0,0 // movaps 0x2f63(%rip),%xmm13 # 5c50 <_sk_callback_sse2+0x760>
+ .byte 68,15,40,45,117,47,0,0 // movaps 0x2f75(%rip),%xmm13 # 5c90 <_sk_callback_sse2+0x765>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,99,47,0,0 // mulps 0x2f63(%rip),%xmm13 # 5c60 <_sk_callback_sse2+0x770>
+ .byte 68,15,89,45,117,47,0,0 // mulps 0x2f75(%rip),%xmm13 # 5ca0 <_sk_callback_sse2+0x775>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -32246,15 +32381,15 @@ _sk_parametric_g_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,227,46,0,0 // mulps 0x2ee3(%rip),%xmm9 # 5c70 <_sk_callback_sse2+0x780>
- .byte 68,15,84,21,235,46,0,0 // andps 0x2eeb(%rip),%xmm10 # 5c80 <_sk_callback_sse2+0x790>
- .byte 68,15,86,21,243,46,0,0 // orps 0x2ef3(%rip),%xmm10 # 5c90 <_sk_callback_sse2+0x7a0>
- .byte 68,15,88,13,251,46,0,0 // addps 0x2efb(%rip),%xmm9 # 5ca0 <_sk_callback_sse2+0x7b0>
- .byte 68,15,40,37,3,47,0,0 // movaps 0x2f03(%rip),%xmm12 # 5cb0 <_sk_callback_sse2+0x7c0>
+ .byte 68,15,89,13,245,46,0,0 // mulps 0x2ef5(%rip),%xmm9 # 5cb0 <_sk_callback_sse2+0x785>
+ .byte 68,15,84,21,253,46,0,0 // andps 0x2efd(%rip),%xmm10 # 5cc0 <_sk_callback_sse2+0x795>
+ .byte 68,15,86,21,5,47,0,0 // orps 0x2f05(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x7a5>
+ .byte 68,15,88,13,13,47,0,0 // addps 0x2f0d(%rip),%xmm9 # 5ce0 <_sk_callback_sse2+0x7b5>
+ .byte 68,15,40,37,21,47,0,0 // movaps 0x2f15(%rip),%xmm12 # 5cf0 <_sk_callback_sse2+0x7c5>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,3,47,0,0 // addps 0x2f03(%rip),%xmm10 # 5cc0 <_sk_callback_sse2+0x7d0>
- .byte 68,15,40,37,11,47,0,0 // movaps 0x2f0b(%rip),%xmm12 # 5cd0 <_sk_callback_sse2+0x7e0>
+ .byte 68,15,88,21,21,47,0,0 // addps 0x2f15(%rip),%xmm10 # 5d00 <_sk_callback_sse2+0x7d5>
+ .byte 68,15,40,37,29,47,0,0 // movaps 0x2f1d(%rip),%xmm12 # 5d10 <_sk_callback_sse2+0x7e5>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -32262,22 +32397,22 @@ _sk_parametric_g_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,245,46,0,0 // movaps 0x2ef5(%rip),%xmm10 # 5ce0 <_sk_callback_sse2+0x7f0>
+ .byte 68,15,40,21,7,47,0,0 // movaps 0x2f07(%rip),%xmm10 # 5d20 <_sk_callback_sse2+0x7f5>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,233,46,0,0 // addps 0x2ee9(%rip),%xmm9 # 5cf0 <_sk_callback_sse2+0x800>
- .byte 68,15,40,37,241,46,0,0 // movaps 0x2ef1(%rip),%xmm12 # 5d00 <_sk_callback_sse2+0x810>
+ .byte 68,15,88,13,251,46,0,0 // addps 0x2efb(%rip),%xmm9 # 5d30 <_sk_callback_sse2+0x805>
+ .byte 68,15,40,37,3,47,0,0 // movaps 0x2f03(%rip),%xmm12 # 5d40 <_sk_callback_sse2+0x815>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,241,46,0,0 // movaps 0x2ef1(%rip),%xmm12 # 5d10 <_sk_callback_sse2+0x820>
+ .byte 68,15,40,37,3,47,0,0 // movaps 0x2f03(%rip),%xmm12 # 5d50 <_sk_callback_sse2+0x825>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,245,46,0,0 // movaps 0x2ef5(%rip),%xmm13 # 5d20 <_sk_callback_sse2+0x830>
+ .byte 68,15,40,45,7,47,0,0 // movaps 0x2f07(%rip),%xmm13 # 5d60 <_sk_callback_sse2+0x835>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,245,46,0,0 // mulps 0x2ef5(%rip),%xmm13 # 5d30 <_sk_callback_sse2+0x840>
+ .byte 68,15,89,45,7,47,0,0 // mulps 0x2f07(%rip),%xmm13 # 5d70 <_sk_callback_sse2+0x845>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -32313,15 +32448,15 @@ _sk_parametric_b_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,117,46,0,0 // mulps 0x2e75(%rip),%xmm9 # 5d40 <_sk_callback_sse2+0x850>
- .byte 68,15,84,21,125,46,0,0 // andps 0x2e7d(%rip),%xmm10 # 5d50 <_sk_callback_sse2+0x860>
- .byte 68,15,86,21,133,46,0,0 // orps 0x2e85(%rip),%xmm10 # 5d60 <_sk_callback_sse2+0x870>
- .byte 68,15,88,13,141,46,0,0 // addps 0x2e8d(%rip),%xmm9 # 5d70 <_sk_callback_sse2+0x880>
- .byte 68,15,40,37,149,46,0,0 // movaps 0x2e95(%rip),%xmm12 # 5d80 <_sk_callback_sse2+0x890>
+ .byte 68,15,89,13,135,46,0,0 // mulps 0x2e87(%rip),%xmm9 # 5d80 <_sk_callback_sse2+0x855>
+ .byte 68,15,84,21,143,46,0,0 // andps 0x2e8f(%rip),%xmm10 # 5d90 <_sk_callback_sse2+0x865>
+ .byte 68,15,86,21,151,46,0,0 // orps 0x2e97(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x875>
+ .byte 68,15,88,13,159,46,0,0 // addps 0x2e9f(%rip),%xmm9 # 5db0 <_sk_callback_sse2+0x885>
+ .byte 68,15,40,37,167,46,0,0 // movaps 0x2ea7(%rip),%xmm12 # 5dc0 <_sk_callback_sse2+0x895>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,149,46,0,0 // addps 0x2e95(%rip),%xmm10 # 5d90 <_sk_callback_sse2+0x8a0>
- .byte 68,15,40,37,157,46,0,0 // movaps 0x2e9d(%rip),%xmm12 # 5da0 <_sk_callback_sse2+0x8b0>
+ .byte 68,15,88,21,167,46,0,0 // addps 0x2ea7(%rip),%xmm10 # 5dd0 <_sk_callback_sse2+0x8a5>
+ .byte 68,15,40,37,175,46,0,0 // movaps 0x2eaf(%rip),%xmm12 # 5de0 <_sk_callback_sse2+0x8b5>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -32329,22 +32464,22 @@ _sk_parametric_b_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,135,46,0,0 // movaps 0x2e87(%rip),%xmm10 # 5db0 <_sk_callback_sse2+0x8c0>
+ .byte 68,15,40,21,153,46,0,0 // movaps 0x2e99(%rip),%xmm10 # 5df0 <_sk_callback_sse2+0x8c5>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,123,46,0,0 // addps 0x2e7b(%rip),%xmm9 # 5dc0 <_sk_callback_sse2+0x8d0>
- .byte 68,15,40,37,131,46,0,0 // movaps 0x2e83(%rip),%xmm12 # 5dd0 <_sk_callback_sse2+0x8e0>
+ .byte 68,15,88,13,141,46,0,0 // addps 0x2e8d(%rip),%xmm9 # 5e00 <_sk_callback_sse2+0x8d5>
+ .byte 68,15,40,37,149,46,0,0 // movaps 0x2e95(%rip),%xmm12 # 5e10 <_sk_callback_sse2+0x8e5>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,131,46,0,0 // movaps 0x2e83(%rip),%xmm12 # 5de0 <_sk_callback_sse2+0x8f0>
+ .byte 68,15,40,37,149,46,0,0 // movaps 0x2e95(%rip),%xmm12 # 5e20 <_sk_callback_sse2+0x8f5>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,135,46,0,0 // movaps 0x2e87(%rip),%xmm13 # 5df0 <_sk_callback_sse2+0x900>
+ .byte 68,15,40,45,153,46,0,0 // movaps 0x2e99(%rip),%xmm13 # 5e30 <_sk_callback_sse2+0x905>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,135,46,0,0 // mulps 0x2e87(%rip),%xmm13 # 5e00 <_sk_callback_sse2+0x910>
+ .byte 68,15,89,45,153,46,0,0 // mulps 0x2e99(%rip),%xmm13 # 5e40 <_sk_callback_sse2+0x915>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -32380,15 +32515,15 @@ _sk_parametric_a_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,7,46,0,0 // mulps 0x2e07(%rip),%xmm9 # 5e10 <_sk_callback_sse2+0x920>
- .byte 68,15,84,21,15,46,0,0 // andps 0x2e0f(%rip),%xmm10 # 5e20 <_sk_callback_sse2+0x930>
- .byte 68,15,86,21,23,46,0,0 // orps 0x2e17(%rip),%xmm10 # 5e30 <_sk_callback_sse2+0x940>
- .byte 68,15,88,13,31,46,0,0 // addps 0x2e1f(%rip),%xmm9 # 5e40 <_sk_callback_sse2+0x950>
- .byte 68,15,40,37,39,46,0,0 // movaps 0x2e27(%rip),%xmm12 # 5e50 <_sk_callback_sse2+0x960>
+ .byte 68,15,89,13,25,46,0,0 // mulps 0x2e19(%rip),%xmm9 # 5e50 <_sk_callback_sse2+0x925>
+ .byte 68,15,84,21,33,46,0,0 // andps 0x2e21(%rip),%xmm10 # 5e60 <_sk_callback_sse2+0x935>
+ .byte 68,15,86,21,41,46,0,0 // orps 0x2e29(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x945>
+ .byte 68,15,88,13,49,46,0,0 // addps 0x2e31(%rip),%xmm9 # 5e80 <_sk_callback_sse2+0x955>
+ .byte 68,15,40,37,57,46,0,0 // movaps 0x2e39(%rip),%xmm12 # 5e90 <_sk_callback_sse2+0x965>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,39,46,0,0 // addps 0x2e27(%rip),%xmm10 # 5e60 <_sk_callback_sse2+0x970>
- .byte 68,15,40,37,47,46,0,0 // movaps 0x2e2f(%rip),%xmm12 # 5e70 <_sk_callback_sse2+0x980>
+ .byte 68,15,88,21,57,46,0,0 // addps 0x2e39(%rip),%xmm10 # 5ea0 <_sk_callback_sse2+0x975>
+ .byte 68,15,40,37,65,46,0,0 // movaps 0x2e41(%rip),%xmm12 # 5eb0 <_sk_callback_sse2+0x985>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -32396,22 +32531,22 @@ _sk_parametric_a_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,25,46,0,0 // movaps 0x2e19(%rip),%xmm10 # 5e80 <_sk_callback_sse2+0x990>
+ .byte 68,15,40,21,43,46,0,0 // movaps 0x2e2b(%rip),%xmm10 # 5ec0 <_sk_callback_sse2+0x995>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,13,46,0,0 // addps 0x2e0d(%rip),%xmm9 # 5e90 <_sk_callback_sse2+0x9a0>
- .byte 68,15,40,37,21,46,0,0 // movaps 0x2e15(%rip),%xmm12 # 5ea0 <_sk_callback_sse2+0x9b0>
+ .byte 68,15,88,13,31,46,0,0 // addps 0x2e1f(%rip),%xmm9 # 5ed0 <_sk_callback_sse2+0x9a5>
+ .byte 68,15,40,37,39,46,0,0 // movaps 0x2e27(%rip),%xmm12 # 5ee0 <_sk_callback_sse2+0x9b5>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,21,46,0,0 // movaps 0x2e15(%rip),%xmm12 # 5eb0 <_sk_callback_sse2+0x9c0>
+ .byte 68,15,40,37,39,46,0,0 // movaps 0x2e27(%rip),%xmm12 # 5ef0 <_sk_callback_sse2+0x9c5>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,25,46,0,0 // movaps 0x2e19(%rip),%xmm13 # 5ec0 <_sk_callback_sse2+0x9d0>
+ .byte 68,15,40,45,43,46,0,0 // movaps 0x2e2b(%rip),%xmm13 # 5f00 <_sk_callback_sse2+0x9d5>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,25,46,0,0 // mulps 0x2e19(%rip),%xmm13 # 5ed0 <_sk_callback_sse2+0x9e0>
+ .byte 68,15,89,45,43,46,0,0 // mulps 0x2e2b(%rip),%xmm13 # 5f10 <_sk_callback_sse2+0x9e5>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -32428,29 +32563,29 @@ HIDDEN _sk_lab_to_xyz_sse2
.globl _sk_lab_to_xyz_sse2
FUNCTION(_sk_lab_to_xyz_sse2)
_sk_lab_to_xyz_sse2:
- .byte 15,89,5,246,45,0,0 // mulps 0x2df6(%rip),%xmm0 # 5ee0 <_sk_callback_sse2+0x9f0>
- .byte 68,15,40,5,254,45,0,0 // movaps 0x2dfe(%rip),%xmm8 # 5ef0 <_sk_callback_sse2+0xa00>
+ .byte 15,89,5,8,46,0,0 // mulps 0x2e08(%rip),%xmm0 # 5f20 <_sk_callback_sse2+0x9f5>
+ .byte 68,15,40,5,16,46,0,0 // movaps 0x2e10(%rip),%xmm8 # 5f30 <_sk_callback_sse2+0xa05>
.byte 65,15,89,200 // mulps %xmm8,%xmm1
- .byte 68,15,40,13,2,46,0,0 // movaps 0x2e02(%rip),%xmm9 # 5f00 <_sk_callback_sse2+0xa10>
+ .byte 68,15,40,13,20,46,0,0 // movaps 0x2e14(%rip),%xmm9 # 5f40 <_sk_callback_sse2+0xa15>
.byte 65,15,88,201 // addps %xmm9,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 65,15,88,209 // addps %xmm9,%xmm2
- .byte 15,88,5,255,45,0,0 // addps 0x2dff(%rip),%xmm0 # 5f10 <_sk_callback_sse2+0xa20>
- .byte 15,89,5,8,46,0,0 // mulps 0x2e08(%rip),%xmm0 # 5f20 <_sk_callback_sse2+0xa30>
- .byte 15,89,13,17,46,0,0 // mulps 0x2e11(%rip),%xmm1 # 5f30 <_sk_callback_sse2+0xa40>
+ .byte 15,88,5,17,46,0,0 // addps 0x2e11(%rip),%xmm0 # 5f50 <_sk_callback_sse2+0xa25>
+ .byte 15,89,5,26,46,0,0 // mulps 0x2e1a(%rip),%xmm0 # 5f60 <_sk_callback_sse2+0xa35>
+ .byte 15,89,13,35,46,0,0 // mulps 0x2e23(%rip),%xmm1 # 5f70 <_sk_callback_sse2+0xa45>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,21,23,46,0,0 // mulps 0x2e17(%rip),%xmm2 # 5f40 <_sk_callback_sse2+0xa50>
+ .byte 15,89,21,41,46,0,0 // mulps 0x2e29(%rip),%xmm2 # 5f80 <_sk_callback_sse2+0xa55>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 68,15,92,202 // subps %xmm2,%xmm9
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
.byte 68,15,89,225 // mulps %xmm1,%xmm12
- .byte 15,40,21,12,46,0,0 // movaps 0x2e0c(%rip),%xmm2 # 5f50 <_sk_callback_sse2+0xa60>
+ .byte 15,40,21,30,46,0,0 // movaps 0x2e1e(%rip),%xmm2 # 5f90 <_sk_callback_sse2+0xa65>
.byte 68,15,40,194 // movaps %xmm2,%xmm8
.byte 69,15,194,196,1 // cmpltps %xmm12,%xmm8
- .byte 68,15,40,21,11,46,0,0 // movaps 0x2e0b(%rip),%xmm10 # 5f60 <_sk_callback_sse2+0xa70>
+ .byte 68,15,40,21,29,46,0,0 // movaps 0x2e1d(%rip),%xmm10 # 5fa0 <_sk_callback_sse2+0xa75>
.byte 65,15,88,202 // addps %xmm10,%xmm1
- .byte 68,15,40,29,15,46,0,0 // movaps 0x2e0f(%rip),%xmm11 # 5f70 <_sk_callback_sse2+0xa80>
+ .byte 68,15,40,29,33,46,0,0 // movaps 0x2e21(%rip),%xmm11 # 5fb0 <_sk_callback_sse2+0xa85>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 69,15,84,224 // andps %xmm8,%xmm12
.byte 68,15,85,193 // andnps %xmm1,%xmm8
@@ -32474,8 +32609,8 @@ _sk_lab_to_xyz_sse2:
.byte 15,84,194 // andps %xmm2,%xmm0
.byte 65,15,85,209 // andnps %xmm9,%xmm2
.byte 15,86,208 // orps %xmm0,%xmm2
- .byte 68,15,89,5,191,45,0,0 // mulps 0x2dbf(%rip),%xmm8 # 5f80 <_sk_callback_sse2+0xa90>
- .byte 15,89,21,200,45,0,0 // mulps 0x2dc8(%rip),%xmm2 # 5f90 <_sk_callback_sse2+0xaa0>
+ .byte 68,15,89,5,209,45,0,0 // mulps 0x2dd1(%rip),%xmm8 # 5fc0 <_sk_callback_sse2+0xa95>
+ .byte 15,89,21,218,45,0,0 // mulps 0x2dda(%rip),%xmm2 # 5fd0 <_sk_callback_sse2+0xaa5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -32485,48 +32620,50 @@ HIDDEN _sk_load_a8_sse2
FUNCTION(_sk_load_a8_sse2)
_sk_load_a8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,45 // jne 3207 <_sk_load_a8_sse2+0x37>
- .byte 102,65,15,110,4,57 // movd (%r9,%rdi,1),%xmm0
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,45 // jne 3235 <_sk_load_a8_sse2+0x37>
+ .byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0
.byte 102,15,96,192 // punpcklbw %xmm0,%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
- .byte 102,15,219,5,176,45,0,0 // pand 0x2db0(%rip),%xmm0 # 5fa0 <_sk_callback_sse2+0xab0>
+ .byte 102,15,219,5,194,45,0,0 // pand 0x2dc2(%rip),%xmm0 # 5fe0 <_sk_callback_sse2+0xab5>
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,182,45,0,0 // mulps 0x2db6(%rip),%xmm3 # 5fb0 <_sk_callback_sse2+0xac0>
+ .byte 15,89,29,200,45,0,0 // mulps 0x2dc8(%rip),%xmm3 # 5ff0 <_sk_callback_sse2+0xac5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,48 // je 3248 <_sk_load_a8_sse2+0x78>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 3233 <_sk_load_a8_sse2+0x63>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,196 // jne 31e8 <_sk_load_a8_sse2+0x18>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,48 // je 3276 <_sk_load_a8_sse2+0x78>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 3261 <_sk_load_a8_sse2+0x63>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,196 // jne 3216 <_sk_load_a8_sse2+0x18>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,15,110,200 // movd %eax,%xmm1
.byte 15,198,200,0 // shufps $0x0,%xmm0,%xmm1
.byte 15,198,200,226 // shufps $0xe2,%xmm0,%xmm1
.byte 15,40,193 // movaps %xmm1,%xmm0
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,15,110,200 // movd %eax,%xmm1
.byte 243,15,16,193 // movss %xmm1,%xmm0
- .byte 235,145 // jmp 31e8 <_sk_load_a8_sse2+0x18>
+ .byte 235,145 // jmp 3216 <_sk_load_a8_sse2+0x18>
HIDDEN _sk_gather_a8_sse2
.globl _sk_gather_a8_sse2
FUNCTION(_sk_gather_a8_sse2)
_sk_gather_a8_sse2:
+ .byte 85 // push %rbp
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -32539,31 +32676,33 @@ _sk_gather_a8_sse2:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
.byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 71,15,182,28,24 // movzbl (%r8,%r11,1),%r11d
- .byte 71,15,182,20,16 // movzbl (%r8,%r10,1),%r10d
- .byte 65,193,226,8 // shl $0x8,%r10d
- .byte 69,9,218 // or %r11d,%r10d
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 65,15,182,44,25 // movzbl (%r9,%rbx,1),%ebp
+ .byte 67,15,182,28,25 // movzbl (%r9,%r11,1),%ebx
+ .byte 193,227,8 // shl $0x8,%ebx
+ .byte 9,235 // or %ebp,%ebx
+ .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 193,224,8 // shl $0x8,%eax
- .byte 68,9,200 // or %r9d,%eax
+ .byte 9,232 // or %ebp,%eax
.byte 102,15,196,192,0 // pinsrw $0x0,%eax,%xmm0
- .byte 102,65,15,196,194,1 // pinsrw $0x1,%r10d,%xmm0
+ .byte 102,15,196,195,1 // pinsrw $0x1,%ebx,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,212,44,0,0 // mulps 0x2cd4(%rip),%xmm3 # 5fc0 <_sk_callback_sse2+0xad0>
+ .byte 15,89,29,232,44,0,0 // mulps 0x2ce8(%rip),%xmm3 # 6000 <_sk_callback_sse2+0xad5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,15,239,210 // pxor %xmm2,%xmm2
+ .byte 91 // pop %rbx
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_a8_sse2
@@ -32571,88 +32710,90 @@ HIDDEN _sk_store_a8_sse2
FUNCTION(_sk_store_a8_sse2)
_sk_store_a8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 68,15,40,5,200,44,0,0 // movaps 0x2cc8(%rip),%xmm8 # 5fd0 <_sk_callback_sse2+0xae0>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 68,15,40,5,218,44,0,0 // movaps 0x2cda(%rip),%xmm8 # 6010 <_sk_callback_sse2+0xae5>
.byte 68,15,89,195 // mulps %xmm3,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,114,240,16 // pslld $0x10,%xmm8
.byte 102,65,15,114,224,16 // psrad $0x10,%xmm8
.byte 102,69,15,107,192 // packssdw %xmm8,%xmm8
.byte 102,69,15,103,192 // packuswb %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,13 // jne 3339 <_sk_store_a8_sse2+0x3e>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,13 // jne 3367 <_sk_store_a8_sse2+0x3e>
.byte 102,68,15,126,192 // movd %xmm8,%eax
- .byte 65,137,4,57 // mov %eax,(%r9,%rdi,1)
+ .byte 65,137,4,18 // mov %eax,(%r10,%rdx,1)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,44 // je 337c <_sk_store_a8_sse2+0x81>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,22 // je 336c <_sk_store_a8_sse2+0x71>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,217 // jne 3335 <_sk_store_a8_sse2+0x3a>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,44 // je 33aa <_sk_store_a8_sse2+0x81>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,22 // je 339a <_sk_store_a8_sse2+0x71>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,217 // jne 3363 <_sk_store_a8_sse2+0x3a>
.byte 102,68,15,127,68,36,232 // movdqa %xmm8,-0x18(%rsp)
.byte 138,68,36,240 // mov -0x10(%rsp),%al
- .byte 65,136,68,57,2 // mov %al,0x2(%r9,%rdi,1)
+ .byte 65,136,68,18,2 // mov %al,0x2(%r10,%rdx,1)
.byte 102,68,15,127,68,36,216 // movdqa %xmm8,-0x28(%rsp)
.byte 138,68,36,220 // mov -0x24(%rsp),%al
- .byte 65,136,68,57,1 // mov %al,0x1(%r9,%rdi,1)
+ .byte 65,136,68,18,1 // mov %al,0x1(%r10,%rdx,1)
.byte 102,68,15,127,68,36,200 // movdqa %xmm8,-0x38(%rsp)
.byte 138,68,36,200 // mov -0x38(%rsp),%al
- .byte 65,136,4,57 // mov %al,(%r9,%rdi,1)
- .byte 235,168 // jmp 3335 <_sk_store_a8_sse2+0x3a>
+ .byte 65,136,4,18 // mov %al,(%r10,%rdx,1)
+ .byte 235,168 // jmp 3363 <_sk_store_a8_sse2+0x3a>
HIDDEN _sk_load_g8_sse2
.globl _sk_load_g8_sse2
FUNCTION(_sk_load_g8_sse2)
_sk_load_g8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,49 // jne 33c8 <_sk_load_g8_sse2+0x3b>
- .byte 102,65,15,110,4,57 // movd (%r9,%rdi,1),%xmm0
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,49 // jne 33f6 <_sk_load_g8_sse2+0x3b>
+ .byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0
.byte 102,15,96,192 // punpcklbw %xmm0,%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
- .byte 102,15,219,5,51,44,0,0 // pand 0x2c33(%rip),%xmm0 # 5fe0 <_sk_callback_sse2+0xaf0>
+ .byte 102,15,219,5,69,44,0,0 // pand 0x2c45(%rip),%xmm0 # 6020 <_sk_callback_sse2+0xaf5>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,57,44,0,0 // mulps 0x2c39(%rip),%xmm0 # 5ff0 <_sk_callback_sse2+0xb00>
+ .byte 15,89,5,75,44,0,0 // mulps 0x2c4b(%rip),%xmm0 # 6030 <_sk_callback_sse2+0xb05>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,64,44,0,0 // movaps 0x2c40(%rip),%xmm3 # 6000 <_sk_callback_sse2+0xb10>
+ .byte 15,40,29,82,44,0,0 // movaps 0x2c52(%rip),%xmm3 # 6040 <_sk_callback_sse2+0xb15>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,48 // je 3409 <_sk_load_g8_sse2+0x7c>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 33f4 <_sk_load_g8_sse2+0x67>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,192 // jne 33a5 <_sk_load_g8_sse2+0x18>
- .byte 65,15,182,68,57,2 // movzbl 0x2(%r9,%rdi,1),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,48 // je 3437 <_sk_load_g8_sse2+0x7c>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 3422 <_sk_load_g8_sse2+0x67>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,192 // jne 33d3 <_sk_load_g8_sse2+0x18>
+ .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0
- .byte 65,15,182,68,57,1 // movzbl 0x1(%r9,%rdi,1),%eax
+ .byte 65,15,182,68,18,1 // movzbl 0x1(%r10,%rdx,1),%eax
.byte 102,15,110,200 // movd %eax,%xmm1
.byte 15,198,200,0 // shufps $0x0,%xmm0,%xmm1
.byte 15,198,200,226 // shufps $0xe2,%xmm0,%xmm1
.byte 15,40,193 // movaps %xmm1,%xmm0
- .byte 65,15,182,4,57 // movzbl (%r9,%rdi,1),%eax
+ .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax
.byte 102,15,110,200 // movd %eax,%xmm1
.byte 243,15,16,193 // movss %xmm1,%xmm0
- .byte 235,141 // jmp 33a5 <_sk_load_g8_sse2+0x18>
+ .byte 235,141 // jmp 33d3 <_sk_load_g8_sse2+0x18>
HIDDEN _sk_gather_g8_sse2
.globl _sk_gather_g8_sse2
FUNCTION(_sk_gather_g8_sse2)
_sk_gather_g8_sse2:
+ .byte 85 // push %rbp
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -32665,31 +32806,33 @@ _sk_gather_g8_sse2:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
.byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 71,15,182,28,24 // movzbl (%r8,%r11,1),%r11d
- .byte 71,15,182,20,16 // movzbl (%r8,%r10,1),%r10d
- .byte 65,193,226,8 // shl $0x8,%r10d
- .byte 69,9,218 // or %r11d,%r10d
- .byte 71,15,182,12,8 // movzbl (%r8,%r9,1),%r9d
- .byte 65,15,182,4,0 // movzbl (%r8,%rax,1),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 65,15,182,44,25 // movzbl (%r9,%rbx,1),%ebp
+ .byte 67,15,182,28,25 // movzbl (%r9,%r11,1),%ebx
+ .byte 193,227,8 // shl $0x8,%ebx
+ .byte 9,235 // or %ebp,%ebx
+ .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
+ .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
.byte 193,224,8 // shl $0x8,%eax
- .byte 68,9,200 // or %r9d,%eax
+ .byte 9,232 // or %ebp,%eax
.byte 102,15,196,192,0 // pinsrw $0x0,%eax,%xmm0
- .byte 102,65,15,196,194,1 // pinsrw $0x1,%r10d,%xmm0
+ .byte 102,15,196,195,1 // pinsrw $0x1,%ebx,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,99,43,0,0 // mulps 0x2b63(%rip),%xmm0 # 6010 <_sk_callback_sse2+0xb20>
+ .byte 15,89,5,119,43,0,0 // mulps 0x2b77(%rip),%xmm0 # 6050 <_sk_callback_sse2+0xb25>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,106,43,0,0 // movaps 0x2b6a(%rip),%xmm3 # 6020 <_sk_callback_sse2+0xb30>
+ .byte 15,40,29,126,43,0,0 // movaps 0x2b7e(%rip),%xmm3 # 6060 <_sk_callback_sse2+0xb35>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
+ .byte 91 // pop %rbx
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
HIDDEN _sk_gather_i8_sse2
@@ -32697,15 +32840,16 @@ HIDDEN _sk_gather_i8_sse2
FUNCTION(_sk_gather_i8_sse2)
_sk_gather_i8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,192 // mov %rax,%r8
- .byte 77,133,192 // test %r8,%r8
- .byte 116,5 // je 34cd <_sk_gather_i8_sse2+0xf>
- .byte 76,137,192 // mov %r8,%rax
- .byte 235,2 // jmp 34cf <_sk_gather_i8_sse2+0x11>
+ .byte 73,137,193 // mov %rax,%r9
+ .byte 77,133,201 // test %r9,%r9
+ .byte 116,5 // je 34fb <_sk_gather_i8_sse2+0xf>
+ .byte 76,137,200 // mov %r9,%rax
+ .byte 235,2 // jmp 34fd <_sk_gather_i8_sse2+0x11>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 85 // push %rbp
+ .byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 76,139,8 // mov (%rax),%r9
+ .byte 76,139,16 // mov (%rax),%r10
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -32718,18 +32862,18 @@ _sk_gather_i8_sse2:
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,194 // mov %eax,%r10d
+ .byte 65,137,195 // mov %eax,%r11d
.byte 72,193,232,32 // shr $0x20,%rax
.byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,73,15,126,195 // movq %xmm0,%r11
- .byte 68,137,219 // mov %r11d,%ebx
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 65,15,182,44,25 // movzbl (%r9,%rbx,1),%ebp
- .byte 67,15,182,28,25 // movzbl (%r9,%r11,1),%ebx
+ .byte 102,72,15,126,195 // movq %xmm0,%rbx
+ .byte 65,137,222 // mov %ebx,%r14d
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 67,15,182,44,50 // movzbl (%r10,%r14,1),%ebp
+ .byte 65,15,182,28,26 // movzbl (%r10,%rbx,1),%ebx
.byte 193,227,8 // shl $0x8,%ebx
.byte 9,235 // or %ebp,%ebx
- .byte 67,15,182,44,17 // movzbl (%r9,%r10,1),%ebp
- .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax
+ .byte 67,15,182,44,26 // movzbl (%r10,%r11,1),%ebp
+ .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
.byte 193,224,8 // shl $0x8,%eax
.byte 9,232 // or %ebp,%eax
.byte 102,15,196,192,0 // pinsrw $0x0,%eax,%xmm0
@@ -32739,24 +32883,24 @@ _sk_gather_i8_sse2:
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 68,15,182,200 // movzbl %al,%r9d
+ .byte 68,15,182,208 // movzbl %al,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
.byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 73,139,104,8 // mov 0x8(%r8),%rbp
- .byte 68,15,182,195 // movzbl %bl,%r8d
+ .byte 73,139,105,8 // mov 0x8(%r9),%rbp
+ .byte 68,15,182,203 // movzbl %bl,%r9d
.byte 72,193,235,30 // shr $0x1e,%rbx
.byte 102,15,110,68,29,0 // movd 0x0(%rbp,%rbx,1),%xmm0
.byte 102,15,110,76,133,0 // movd 0x0(%rbp,%rax,4),%xmm1
.byte 102,15,98,193 // punpckldq %xmm1,%xmm0
- .byte 102,70,15,110,76,133,0 // movd 0x0(%rbp,%r8,4),%xmm9
- .byte 102,66,15,110,76,141,0 // movd 0x0(%rbp,%r9,4),%xmm1
+ .byte 102,70,15,110,76,141,0 // movd 0x0(%rbp,%r9,4),%xmm9
+ .byte 102,66,15,110,76,149,0 // movd 0x0(%rbp,%r10,4),%xmm1
.byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9
.byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9
- .byte 102,15,111,21,135,42,0,0 // movdqa 0x2a87(%rip),%xmm2 # 6030 <_sk_callback_sse2+0xb40>
+ .byte 102,15,111,21,151,42,0,0 // movdqa 0x2a97(%rip),%xmm2 # 6070 <_sk_callback_sse2+0xb45>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,131,42,0,0 // movaps 0x2a83(%rip),%xmm8 # 6040 <_sk_callback_sse2+0xb50>
+ .byte 68,15,40,5,147,42,0,0 // movaps 0x2a93(%rip),%xmm8 # 6080 <_sk_callback_sse2+0xb55>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -32773,6 +32917,7 @@ _sk_gather_i8_sse2:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
+ .byte 65,94 // pop %r14
.byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
@@ -32781,53 +32926,54 @@ HIDDEN _sk_load_565_sse2
FUNCTION(_sk_load_565_sse2)
_sk_load_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,83 // jne 365c <_sk_load_565_sse2+0x5d>
- .byte 243,65,15,126,20,121 // movq (%r9,%rdi,2),%xmm2
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,83 // jne 368e <_sk_load_565_sse2+0x5d>
+ .byte 243,65,15,126,20,82 // movq (%r10,%rdx,2),%xmm2
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,5,53,42,0,0 // movdqa 0x2a35(%rip),%xmm0 # 6050 <_sk_callback_sse2+0xb60>
+ .byte 102,15,111,5,67,42,0,0 // movdqa 0x2a43(%rip),%xmm0 # 6090 <_sk_callback_sse2+0xb65>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,55,42,0,0 // mulps 0x2a37(%rip),%xmm0 # 6060 <_sk_callback_sse2+0xb70>
- .byte 102,15,111,13,63,42,0,0 // movdqa 0x2a3f(%rip),%xmm1 # 6070 <_sk_callback_sse2+0xb80>
+ .byte 15,89,5,69,42,0,0 // mulps 0x2a45(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xb75>
+ .byte 102,15,111,13,77,42,0,0 // movdqa 0x2a4d(%rip),%xmm1 # 60b0 <_sk_callback_sse2+0xb85>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,65,42,0,0 // mulps 0x2a41(%rip),%xmm1 # 6080 <_sk_callback_sse2+0xb90>
- .byte 102,15,219,21,73,42,0,0 // pand 0x2a49(%rip),%xmm2 # 6090 <_sk_callback_sse2+0xba0>
+ .byte 15,89,13,79,42,0,0 // mulps 0x2a4f(%rip),%xmm1 # 60c0 <_sk_callback_sse2+0xb95>
+ .byte 102,15,219,21,87,42,0,0 // pand 0x2a57(%rip),%xmm2 # 60d0 <_sk_callback_sse2+0xba5>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,79,42,0,0 // mulps 0x2a4f(%rip),%xmm2 # 60a0 <_sk_callback_sse2+0xbb0>
+ .byte 15,89,21,93,42,0,0 // mulps 0x2a5d(%rip),%xmm2 # 60e0 <_sk_callback_sse2+0xbb5>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,86,42,0,0 // movaps 0x2a56(%rip),%xmm3 # 60b0 <_sk_callback_sse2+0xbc0>
+ .byte 15,40,29,100,42,0,0 // movaps 0x2a64(%rip),%xmm3 # 60f0 <_sk_callback_sse2+0xbc5>
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,210 // pxor %xmm2,%xmm2
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,48 // je 369d <_sk_load_565_sse2+0x9e>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 3688 <_sk_load_565_sse2+0x89>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,154 // jne 3613 <_sk_load_565_sse2+0x14>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,48 // je 36cf <_sk_load_565_sse2+0x9e>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 36ba <_sk_load_565_sse2+0x89>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,154 // jne 3645 <_sk_load_565_sse2+0x14>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 15,198,194,0 // shufps $0x0,%xmm2,%xmm0
.byte 15,198,194,226 // shufps $0xe2,%xmm2,%xmm0
.byte 15,40,208 // movaps %xmm0,%xmm2
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 243,15,16,208 // movss %xmm0,%xmm2
- .byte 233,100,255,255,255 // jmpq 3613 <_sk_load_565_sse2+0x14>
+ .byte 233,100,255,255,255 // jmpq 3645 <_sk_load_565_sse2+0x14>
HIDDEN _sk_gather_565_sse2
.globl _sk_gather_565_sse2
FUNCTION(_sk_gather_565_sse2)
_sk_gather_565_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -32841,32 +32987,33 @@ _sk_gather_565_sse2:
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,196,20,88,0 // pinsrw $0x0,(%r8,%r11,2),%xmm2
- .byte 102,67,15,196,20,80,1 // pinsrw $0x1,(%r8,%r10,2),%xmm2
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 102,65,15,196,209,2 // pinsrw $0x2,%r9d,%xmm2
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,196,20,89,0 // pinsrw $0x0,(%r9,%rbx,2),%xmm2
+ .byte 102,67,15,196,20,89,1 // pinsrw $0x1,(%r9,%r11,2),%xmm2
+ .byte 67,15,183,28,81 // movzwl (%r9,%r10,2),%ebx
+ .byte 102,15,196,211,2 // pinsrw $0x2,%ebx,%xmm2
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,208,3 // pinsrw $0x3,%eax,%xmm2
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,5,139,41,0,0 // movdqa 0x298b(%rip),%xmm0 # 60c0 <_sk_callback_sse2+0xbd0>
+ .byte 102,15,111,5,153,41,0,0 // movdqa 0x2999(%rip),%xmm0 # 6100 <_sk_callback_sse2+0xbd5>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,141,41,0,0 // mulps 0x298d(%rip),%xmm0 # 60d0 <_sk_callback_sse2+0xbe0>
- .byte 102,15,111,13,149,41,0,0 // movdqa 0x2995(%rip),%xmm1 # 60e0 <_sk_callback_sse2+0xbf0>
+ .byte 15,89,5,155,41,0,0 // mulps 0x299b(%rip),%xmm0 # 6110 <_sk_callback_sse2+0xbe5>
+ .byte 102,15,111,13,163,41,0,0 // movdqa 0x29a3(%rip),%xmm1 # 6120 <_sk_callback_sse2+0xbf5>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,151,41,0,0 // mulps 0x2997(%rip),%xmm1 # 60f0 <_sk_callback_sse2+0xc00>
- .byte 102,15,219,21,159,41,0,0 // pand 0x299f(%rip),%xmm2 # 6100 <_sk_callback_sse2+0xc10>
+ .byte 15,89,13,165,41,0,0 // mulps 0x29a5(%rip),%xmm1 # 6130 <_sk_callback_sse2+0xc05>
+ .byte 102,15,219,21,173,41,0,0 // pand 0x29ad(%rip),%xmm2 # 6140 <_sk_callback_sse2+0xc15>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,165,41,0,0 // mulps 0x29a5(%rip),%xmm2 # 6110 <_sk_callback_sse2+0xc20>
+ .byte 15,89,21,179,41,0,0 // mulps 0x29b3(%rip),%xmm2 # 6150 <_sk_callback_sse2+0xc25>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,172,41,0,0 // movaps 0x29ac(%rip),%xmm3 # 6120 <_sk_callback_sse2+0xc30>
+ .byte 15,40,29,186,41,0,0 // movaps 0x29ba(%rip),%xmm3 # 6160 <_sk_callback_sse2+0xc35>
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_565_sse2
@@ -32874,13 +33021,13 @@ HIDDEN _sk_store_565_sse2
FUNCTION(_sk_store_565_sse2)
_sk_store_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 68,15,40,5,173,41,0,0 // movaps 0x29ad(%rip),%xmm8 # 6130 <_sk_callback_sse2+0xc40>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 68,15,40,5,186,41,0,0 // movaps 0x29ba(%rip),%xmm8 # 6170 <_sk_callback_sse2+0xc45>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
.byte 102,65,15,114,241,11 // pslld $0xb,%xmm9
- .byte 68,15,40,21,162,41,0,0 // movaps 0x29a2(%rip),%xmm10 # 6140 <_sk_callback_sse2+0xc50>
+ .byte 68,15,40,21,175,41,0,0 // movaps 0x29af(%rip),%xmm10 # 6180 <_sk_callback_sse2+0xc55>
.byte 68,15,89,209 // mulps %xmm1,%xmm10
.byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10
.byte 102,65,15,114,242,5 // pslld $0x5,%xmm10
@@ -32891,83 +33038,84 @@ _sk_store_565_sse2:
.byte 102,65,15,114,240,16 // pslld $0x10,%xmm8
.byte 102,65,15,114,224,16 // psrad $0x10,%xmm8
.byte 102,69,15,107,192 // packssdw %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 37e0 <_sk_store_565_sse2+0x6a>
- .byte 242,69,15,17,4,121 // movsd %xmm8,(%r9,%rdi,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3813 <_sk_store_565_sse2+0x6a>
+ .byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,36 // je 3816 <_sk_store_565_sse2+0xa0>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,18 // je 380a <_sk_store_565_sse2+0x94>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,222 // jne 37dc <_sk_store_565_sse2+0x66>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,36 // je 3849 <_sk_store_565_sse2+0xa0>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,18 // je 383d <_sk_store_565_sse2+0x94>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,222 // jne 380f <_sk_store_565_sse2+0x66>
.byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax
- .byte 102,65,137,68,121,4 // mov %ax,0x4(%r9,%rdi,2)
+ .byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2)
.byte 102,65,15,197,192,2 // pextrw $0x2,%xmm8,%eax
- .byte 102,65,137,68,121,2 // mov %ax,0x2(%r9,%rdi,2)
+ .byte 102,65,137,68,82,2 // mov %ax,0x2(%r10,%rdx,2)
.byte 102,68,15,126,192 // movd %xmm8,%eax
- .byte 102,65,137,4,121 // mov %ax,(%r9,%rdi,2)
- .byte 235,186 // jmp 37dc <_sk_store_565_sse2+0x66>
+ .byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2)
+ .byte 235,186 // jmp 380f <_sk_store_565_sse2+0x66>
HIDDEN _sk_load_4444_sse2
.globl _sk_load_4444_sse2
FUNCTION(_sk_load_4444_sse2)
_sk_load_4444_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,98 // jne 388e <_sk_load_4444_sse2+0x6c>
- .byte 243,65,15,126,28,121 // movq (%r9,%rdi,2),%xmm3
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,98 // jne 38c1 <_sk_load_4444_sse2+0x6c>
+ .byte 243,65,15,126,28,82 // movq (%r10,%rdx,2),%xmm3
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,5,18,41,0,0 // movdqa 0x2912(%rip),%xmm0 # 6150 <_sk_callback_sse2+0xc60>
+ .byte 102,15,111,5,31,41,0,0 // movdqa 0x291f(%rip),%xmm0 # 6190 <_sk_callback_sse2+0xc65>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,20,41,0,0 // mulps 0x2914(%rip),%xmm0 # 6160 <_sk_callback_sse2+0xc70>
- .byte 102,15,111,13,28,41,0,0 // movdqa 0x291c(%rip),%xmm1 # 6170 <_sk_callback_sse2+0xc80>
+ .byte 15,89,5,33,41,0,0 // mulps 0x2921(%rip),%xmm0 # 61a0 <_sk_callback_sse2+0xc75>
+ .byte 102,15,111,13,41,41,0,0 // movdqa 0x2929(%rip),%xmm1 # 61b0 <_sk_callback_sse2+0xc85>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,30,41,0,0 // mulps 0x291e(%rip),%xmm1 # 6180 <_sk_callback_sse2+0xc90>
- .byte 102,15,111,21,38,41,0,0 // movdqa 0x2926(%rip),%xmm2 # 6190 <_sk_callback_sse2+0xca0>
+ .byte 15,89,13,43,41,0,0 // mulps 0x292b(%rip),%xmm1 # 61c0 <_sk_callback_sse2+0xc95>
+ .byte 102,15,111,21,51,41,0,0 // movdqa 0x2933(%rip),%xmm2 # 61d0 <_sk_callback_sse2+0xca5>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,40,41,0,0 // mulps 0x2928(%rip),%xmm2 # 61a0 <_sk_callback_sse2+0xcb0>
- .byte 102,15,219,29,48,41,0,0 // pand 0x2930(%rip),%xmm3 # 61b0 <_sk_callback_sse2+0xcc0>
+ .byte 15,89,21,53,41,0,0 // mulps 0x2935(%rip),%xmm2 # 61e0 <_sk_callback_sse2+0xcb5>
+ .byte 102,15,219,29,61,41,0,0 // pand 0x293d(%rip),%xmm3 # 61f0 <_sk_callback_sse2+0xcc5>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,54,41,0,0 // mulps 0x2936(%rip),%xmm3 # 61c0 <_sk_callback_sse2+0xcd0>
+ .byte 15,89,29,67,41,0,0 // mulps 0x2943(%rip),%xmm3 # 6200 <_sk_callback_sse2+0xcd5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,48 // je 38cf <_sk_load_4444_sse2+0xad>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,21 // je 38ba <_sk_load_4444_sse2+0x98>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,139 // jne 3836 <_sk_load_4444_sse2+0x14>
- .byte 65,15,183,68,121,4 // movzwl 0x4(%r9,%rdi,2),%eax
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,48 // je 3902 <_sk_load_4444_sse2+0xad>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,21 // je 38ed <_sk_load_4444_sse2+0x98>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,139 // jne 3869 <_sk_load_4444_sse2+0x14>
+ .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
- .byte 65,15,183,68,121,2 // movzwl 0x2(%r9,%rdi,2),%eax
+ .byte 65,15,183,68,82,2 // movzwl 0x2(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 15,198,195,0 // shufps $0x0,%xmm3,%xmm0
.byte 15,198,195,226 // shufps $0xe2,%xmm3,%xmm0
.byte 15,40,216 // movaps %xmm0,%xmm3
- .byte 65,15,183,4,121 // movzwl (%r9,%rdi,2),%eax
+ .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 243,15,16,216 // movss %xmm0,%xmm3
- .byte 233,85,255,255,255 // jmpq 3836 <_sk_load_4444_sse2+0x14>
+ .byte 233,85,255,255,255 // jmpq 3869 <_sk_load_4444_sse2+0x14>
HIDDEN _sk_gather_4444_sse2
.globl _sk_gather_4444_sse2
FUNCTION(_sk_gather_4444_sse2)
_sk_gather_4444_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -32981,35 +33129,36 @@ _sk_gather_4444_sse2:
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,196,28,88,0 // pinsrw $0x0,(%r8,%r11,2),%xmm3
- .byte 102,67,15,196,28,80,1 // pinsrw $0x1,(%r8,%r10,2),%xmm3
- .byte 71,15,183,12,72 // movzwl (%r8,%r9,2),%r9d
- .byte 102,65,15,196,217,2 // pinsrw $0x2,%r9d,%xmm3
- .byte 65,15,183,4,64 // movzwl (%r8,%rax,2),%eax
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,65,15,196,28,89,0 // pinsrw $0x0,(%r9,%rbx,2),%xmm3
+ .byte 102,67,15,196,28,89,1 // pinsrw $0x1,(%r9,%r11,2),%xmm3
+ .byte 67,15,183,28,81 // movzwl (%r9,%r10,2),%ebx
+ .byte 102,15,196,219,2 // pinsrw $0x2,%ebx,%xmm3
+ .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,216,3 // pinsrw $0x3,%eax,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,5,105,40,0,0 // movdqa 0x2869(%rip),%xmm0 # 61d0 <_sk_callback_sse2+0xce0>
+ .byte 102,15,111,5,118,40,0,0 // movdqa 0x2876(%rip),%xmm0 # 6210 <_sk_callback_sse2+0xce5>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,107,40,0,0 // mulps 0x286b(%rip),%xmm0 # 61e0 <_sk_callback_sse2+0xcf0>
- .byte 102,15,111,13,115,40,0,0 // movdqa 0x2873(%rip),%xmm1 # 61f0 <_sk_callback_sse2+0xd00>
+ .byte 15,89,5,120,40,0,0 // mulps 0x2878(%rip),%xmm0 # 6220 <_sk_callback_sse2+0xcf5>
+ .byte 102,15,111,13,128,40,0,0 // movdqa 0x2880(%rip),%xmm1 # 6230 <_sk_callback_sse2+0xd05>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,117,40,0,0 // mulps 0x2875(%rip),%xmm1 # 6200 <_sk_callback_sse2+0xd10>
- .byte 102,15,111,21,125,40,0,0 // movdqa 0x287d(%rip),%xmm2 # 6210 <_sk_callback_sse2+0xd20>
+ .byte 15,89,13,130,40,0,0 // mulps 0x2882(%rip),%xmm1 # 6240 <_sk_callback_sse2+0xd15>
+ .byte 102,15,111,21,138,40,0,0 // movdqa 0x288a(%rip),%xmm2 # 6250 <_sk_callback_sse2+0xd25>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,127,40,0,0 // mulps 0x287f(%rip),%xmm2 # 6220 <_sk_callback_sse2+0xd30>
- .byte 102,15,219,29,135,40,0,0 // pand 0x2887(%rip),%xmm3 # 6230 <_sk_callback_sse2+0xd40>
+ .byte 15,89,21,140,40,0,0 // mulps 0x288c(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xd35>
+ .byte 102,15,219,29,148,40,0,0 // pand 0x2894(%rip),%xmm3 # 6270 <_sk_callback_sse2+0xd45>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,141,40,0,0 // mulps 0x288d(%rip),%xmm3 # 6240 <_sk_callback_sse2+0xd50>
+ .byte 15,89,29,154,40,0,0 // mulps 0x289a(%rip),%xmm3 # 6280 <_sk_callback_sse2+0xd55>
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_4444_sse2
@@ -33017,8 +33166,8 @@ HIDDEN _sk_store_4444_sse2
FUNCTION(_sk_store_4444_sse2)
_sk_store_4444_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 68,15,40,5,140,40,0,0 // movaps 0x288c(%rip),%xmm8 # 6250 <_sk_callback_sse2+0xd60>
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 68,15,40,5,152,40,0,0 // movaps 0x2898(%rip),%xmm8 # 6290 <_sk_callback_sse2+0xd65>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -33039,27 +33188,27 @@ _sk_store_4444_sse2:
.byte 102,65,15,114,240,16 // pslld $0x10,%xmm8
.byte 102,65,15,114,224,16 // psrad $0x10,%xmm8
.byte 102,69,15,107,192 // packssdw %xmm8,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3a35 <_sk_store_4444_sse2+0x7e>
- .byte 242,69,15,17,4,121 // movsd %xmm8,(%r9,%rdi,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3a69 <_sk_store_4444_sse2+0x7e>
+ .byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,36 // je 3a6b <_sk_store_4444_sse2+0xb4>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,18 // je 3a5f <_sk_store_4444_sse2+0xa8>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,222 // jne 3a31 <_sk_store_4444_sse2+0x7a>
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,36 // je 3a9f <_sk_store_4444_sse2+0xb4>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,18 // je 3a93 <_sk_store_4444_sse2+0xa8>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,222 // jne 3a65 <_sk_store_4444_sse2+0x7a>
.byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax
- .byte 102,65,137,68,121,4 // mov %ax,0x4(%r9,%rdi,2)
+ .byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2)
.byte 102,65,15,197,192,2 // pextrw $0x2,%xmm8,%eax
- .byte 102,65,137,68,121,2 // mov %ax,0x2(%r9,%rdi,2)
+ .byte 102,65,137,68,82,2 // mov %ax,0x2(%r10,%rdx,2)
.byte 102,68,15,126,192 // movd %xmm8,%eax
- .byte 102,65,137,4,121 // mov %ax,(%r9,%rdi,2)
- .byte 235,186 // jmp 3a31 <_sk_store_4444_sse2+0x7a>
+ .byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2)
+ .byte 235,186 // jmp 3a65 <_sk_store_4444_sse2+0x7a>
HIDDEN _sk_load_8888_sse2
.globl _sk_load_8888_sse2
@@ -33067,14 +33216,14 @@ FUNCTION(_sk_load_8888_sse2)
_sk_load_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,98 // jne 3ae3 <_sk_load_8888_sse2+0x6c>
- .byte 243,68,15,111,12,184 // movdqu (%rax,%rdi,4),%xmm9
- .byte 102,15,111,21,209,39,0,0 // movdqa 0x27d1(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xd70>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,98 // jne 3b17 <_sk_load_8888_sse2+0x6c>
+ .byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9
+ .byte 102,15,111,21,221,39,0,0 // movdqa 0x27dd(%rip),%xmm2 # 62a0 <_sk_callback_sse2+0xd75>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,205,39,0,0 // movaps 0x27cd(%rip),%xmm8 # 6270 <_sk_callback_sse2+0xd80>
+ .byte 68,15,40,5,217,39,0,0 // movaps 0x27d9(%rip),%xmm8 # 62b0 <_sk_callback_sse2+0xd85>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -33091,31 +33240,32 @@ _sk_load_8888_sse2:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,44 // je 3b21 <_sk_load_8888_sse2+0xaa>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,18 // je 3b0d <_sk_load_8888_sse2+0x96>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,134 // jne 3a87 <_sk_load_8888_sse2+0x10>
- .byte 102,15,110,68,184,8 // movd 0x8(%rax,%rdi,4),%xmm0
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,44 // je 3b55 <_sk_load_8888_sse2+0xaa>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,18 // je 3b41 <_sk_load_8888_sse2+0x96>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,134 // jne 3abb <_sk_load_8888_sse2+0x10>
+ .byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9
- .byte 243,15,16,68,184,4 // movss 0x4(%rax,%rdi,4),%xmm0
+ .byte 243,15,16,68,144,4 // movss 0x4(%rax,%rdx,4),%xmm0
.byte 65,15,198,193,0 // shufps $0x0,%xmm9,%xmm0
.byte 65,15,198,193,226 // shufps $0xe2,%xmm9,%xmm0
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 243,15,16,4,184 // movss (%rax,%rdi,4),%xmm0
+ .byte 243,15,16,4,144 // movss (%rax,%rdx,4),%xmm0
.byte 243,68,15,16,200 // movss %xmm0,%xmm9
- .byte 233,87,255,255,255 // jmpq 3a87 <_sk_load_8888_sse2+0x10>
+ .byte 233,87,255,255,255 // jmpq 3abb <_sk_load_8888_sse2+0x10>
HIDDEN _sk_gather_8888_sse2
.globl _sk_gather_8888_sse2
FUNCTION(_sk_gather_8888_sse2)
_sk_gather_8888_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -33129,23 +33279,23 @@ _sk_gather_8888_sse2:
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,67,15,110,4,144 // movd (%r8,%r10,4),%xmm0
- .byte 102,65,15,110,12,128 // movd (%r8,%rax,4),%xmm1
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 102,67,15,110,4,153 // movd (%r9,%r11,4),%xmm0
+ .byte 102,65,15,110,12,129 // movd (%r9,%rax,4),%xmm1
.byte 102,15,98,193 // punpckldq %xmm1,%xmm0
- .byte 102,71,15,110,12,152 // movd (%r8,%r11,4),%xmm9
- .byte 102,67,15,110,12,136 // movd (%r8,%r9,4),%xmm1
+ .byte 102,69,15,110,12,153 // movd (%r9,%rbx,4),%xmm9
+ .byte 102,67,15,110,12,145 // movd (%r9,%r10,4),%xmm1
.byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9
.byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9
- .byte 102,15,111,21,207,38,0,0 // movdqa 0x26cf(%rip),%xmm2 # 6280 <_sk_callback_sse2+0xd90>
+ .byte 102,15,111,21,218,38,0,0 // movdqa 0x26da(%rip),%xmm2 # 62c0 <_sk_callback_sse2+0xd95>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,203,38,0,0 // movaps 0x26cb(%rip),%xmm8 # 6290 <_sk_callback_sse2+0xda0>
+ .byte 68,15,40,5,214,38,0,0 // movaps 0x26d6(%rip),%xmm8 # 62d0 <_sk_callback_sse2+0xda5>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -33161,6 +33311,7 @@ _sk_gather_8888_sse2:
.byte 65,15,91,217 // cvtdq2ps %xmm9,%xmm3
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_8888_sse2
@@ -33169,7 +33320,7 @@ FUNCTION(_sk_store_8888_sse2)
_sk_store_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,142,38,0,0 // movaps 0x268e(%rip),%xmm8 # 62a0 <_sk_callback_sse2+0xdb0>
+ .byte 68,15,40,5,152,38,0,0 // movaps 0x2698(%rip),%xmm8 # 62e0 <_sk_callback_sse2+0xdb5>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -33187,25 +33338,25 @@ _sk_store_8888_sse2:
.byte 102,65,15,114,240,24 // pslld $0x18,%xmm8
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,10 // jne 3c72 <_sk_store_8888_sse2+0x6d>
- .byte 243,68,15,127,4,184 // movdqu %xmm8,(%rax,%rdi,4)
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 255,224 // jmpq *%rax
- .byte 65,137,200 // mov %ecx,%r8d
- .byte 65,128,224,3 // and $0x3,%r8b
- .byte 65,128,248,1 // cmp $0x1,%r8b
- .byte 116,38 // je 3ca5 <_sk_store_8888_sse2+0xa0>
- .byte 65,128,248,2 // cmp $0x2,%r8b
- .byte 116,19 // je 3c98 <_sk_store_8888_sse2+0x93>
- .byte 65,128,248,3 // cmp $0x3,%r8b
- .byte 117,227 // jne 3c6e <_sk_store_8888_sse2+0x69>
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,10 // jne 3ca8 <_sk_store_8888_sse2+0x6d>
+ .byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
+ .byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 255,224 // jmpq *%rax
+ .byte 69,137,193 // mov %r8d,%r9d
+ .byte 65,128,225,3 // and $0x3,%r9b
+ .byte 65,128,249,1 // cmp $0x1,%r9b
+ .byte 116,38 // je 3cdb <_sk_store_8888_sse2+0xa0>
+ .byte 65,128,249,2 // cmp $0x2,%r9b
+ .byte 116,19 // je 3cce <_sk_store_8888_sse2+0x93>
+ .byte 65,128,249,3 // cmp $0x3,%r9b
+ .byte 117,227 // jne 3ca4 <_sk_store_8888_sse2+0x69>
.byte 102,69,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm9
- .byte 102,68,15,126,76,184,8 // movd %xmm9,0x8(%rax,%rdi,4)
+ .byte 102,68,15,126,76,144,8 // movd %xmm9,0x8(%rax,%rdx,4)
.byte 102,69,15,112,200,229 // pshufd $0xe5,%xmm8,%xmm9
- .byte 102,68,15,126,76,184,4 // movd %xmm9,0x4(%rax,%rdi,4)
- .byte 102,68,15,126,4,184 // movd %xmm8,(%rax,%rdi,4)
- .byte 235,193 // jmp 3c6e <_sk_store_8888_sse2+0x69>
+ .byte 102,68,15,126,76,144,4 // movd %xmm9,0x4(%rax,%rdx,4)
+ .byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
+ .byte 235,193 // jmp 3ca4 <_sk_store_8888_sse2+0x69>
HIDDEN _sk_load_f16_sse2
.globl _sk_load_f16_sse2
@@ -33213,10 +33364,10 @@ FUNCTION(_sk_load_f16_sse2)
_sk_load_f16_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,96,1,0,0 // jne 3e1b <_sk_load_f16_sse2+0x16e>
- .byte 102,15,16,4,248 // movupd (%rax,%rdi,8),%xmm0
- .byte 102,15,16,76,248,16 // movupd 0x10(%rax,%rdi,8),%xmm1
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,96,1,0,0 // jne 3e51 <_sk_load_f16_sse2+0x16e>
+ .byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0
+ .byte 102,15,16,76,208,16 // movupd 0x10(%rax,%rdx,8),%xmm1
.byte 102,68,15,40,192 // movapd %xmm0,%xmm8
.byte 102,68,15,97,193 // punpcklwd %xmm1,%xmm8
.byte 102,15,105,193 // punpckhwd %xmm1,%xmm0
@@ -33226,7 +33377,7 @@ _sk_load_f16_sse2:
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
.byte 102,65,15,111,206 // movdqa %xmm14,%xmm1
.byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1
- .byte 102,68,15,111,13,181,37,0,0 // movdqa 0x25b5(%rip),%xmm9 # 62b0 <_sk_callback_sse2+0xdc0>
+ .byte 102,68,15,111,13,191,37,0,0 // movdqa 0x25bf(%rip),%xmm9 # 62f0 <_sk_callback_sse2+0xdc5>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,193 // pand %xmm9,%xmm0
.byte 102,15,239,200 // pxor %xmm0,%xmm1
@@ -33234,11 +33385,11 @@ _sk_load_f16_sse2:
.byte 102,68,15,111,233 // movdqa %xmm1,%xmm13
.byte 102,65,15,114,245,13 // pslld $0xd,%xmm13
.byte 102,68,15,235,232 // por %xmm0,%xmm13
- .byte 102,68,15,111,29,154,37,0,0 // movdqa 0x259a(%rip),%xmm11 # 62c0 <_sk_callback_sse2+0xdd0>
+ .byte 102,68,15,111,29,164,37,0,0 // movdqa 0x25a4(%rip),%xmm11 # 6300 <_sk_callback_sse2+0xdd5>
.byte 102,69,15,254,235 // paddd %xmm11,%xmm13
- .byte 102,68,15,111,37,156,37,0,0 // movdqa 0x259c(%rip),%xmm12 # 62d0 <_sk_callback_sse2+0xde0>
+ .byte 102,68,15,111,37,166,37,0,0 // movdqa 0x25a6(%rip),%xmm12 # 6310 <_sk_callback_sse2+0xde5>
.byte 102,65,15,239,204 // pxor %xmm12,%xmm1
- .byte 102,15,111,29,159,37,0,0 // movdqa 0x259f(%rip),%xmm3 # 62e0 <_sk_callback_sse2+0xdf0>
+ .byte 102,15,111,29,169,37,0,0 // movdqa 0x25a9(%rip),%xmm3 # 6320 <_sk_callback_sse2+0xdf5>
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
.byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0
.byte 102,65,15,223,197 // pandn %xmm13,%xmm0
@@ -33284,26 +33435,27 @@ _sk_load_f16_sse2:
.byte 102,65,15,223,218 // pandn %xmm10,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 242,15,16,4,248 // movsd (%rax,%rdi,8),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,17 // jne 3e37 <_sk_load_f16_sse2+0x18a>
+ .byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,17 // jne 3e6d <_sk_load_f16_sse2+0x18a>
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 102,15,20,193 // unpcklpd %xmm1,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 233,143,254,255,255 // jmpq 3cc6 <_sk_load_f16_sse2+0x19>
- .byte 102,15,22,68,248,8 // movhpd 0x8(%rax,%rdi,8),%xmm0
+ .byte 233,143,254,255,255 // jmpq 3cfc <_sk_load_f16_sse2+0x19>
+ .byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,123,254,255,255 // jb 3cc6 <_sk_load_f16_sse2+0x19>
- .byte 242,15,16,76,248,16 // movsd 0x10(%rax,%rdi,8),%xmm1
- .byte 233,112,254,255,255 // jmpq 3cc6 <_sk_load_f16_sse2+0x19>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,123,254,255,255 // jb 3cfc <_sk_load_f16_sse2+0x19>
+ .byte 242,15,16,76,208,16 // movsd 0x10(%rax,%rdx,8),%xmm1
+ .byte 233,112,254,255,255 // jmpq 3cfc <_sk_load_f16_sse2+0x19>
HIDDEN _sk_gather_f16_sse2
.globl _sk_gather_f16_sse2
FUNCTION(_sk_gather_f16_sse2)
_sk_gather_f16_sse2:
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
@@ -33317,16 +33469,16 @@ _sk_gather_f16_sse2:
.byte 102,15,254,193 // paddd %xmm1,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 65,137,193 // mov %eax,%r9d
+ .byte 65,137,194 // mov %eax,%r10d
.byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,73,15,126,194 // movq %xmm0,%r10
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 243,67,15,126,4,208 // movq (%r8,%r10,8),%xmm0
- .byte 243,67,15,126,12,216 // movq (%r8,%r11,8),%xmm1
+ .byte 102,73,15,126,195 // movq %xmm0,%r11
+ .byte 68,137,219 // mov %r11d,%ebx
+ .byte 73,193,235,32 // shr $0x20,%r11
+ .byte 243,67,15,126,4,217 // movq (%r9,%r11,8),%xmm0
+ .byte 243,65,15,126,12,217 // movq (%r9,%rbx,8),%xmm1
.byte 102,15,108,200 // punpcklqdq %xmm0,%xmm1
- .byte 243,65,15,126,4,192 // movq (%r8,%rax,8),%xmm0
- .byte 243,67,15,126,20,200 // movq (%r8,%r9,8),%xmm2
+ .byte 243,65,15,126,4,193 // movq (%r9,%rax,8),%xmm0
+ .byte 243,67,15,126,20,209 // movq (%r9,%r10,8),%xmm2
.byte 102,15,108,208 // punpcklqdq %xmm0,%xmm2
.byte 102,68,15,111,193 // movdqa %xmm1,%xmm8
.byte 102,68,15,97,194 // punpcklwd %xmm2,%xmm8
@@ -33337,7 +33489,7 @@ _sk_gather_f16_sse2:
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
.byte 102,65,15,111,206 // movdqa %xmm14,%xmm1
.byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1
- .byte 102,68,15,111,13,242,35,0,0 // movdqa 0x23f2(%rip),%xmm9 # 62f0 <_sk_callback_sse2+0xe00>
+ .byte 102,68,15,111,13,251,35,0,0 // movdqa 0x23fb(%rip),%xmm9 # 6330 <_sk_callback_sse2+0xe05>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,193 // pand %xmm9,%xmm0
.byte 102,15,239,200 // pxor %xmm0,%xmm1
@@ -33345,11 +33497,11 @@ _sk_gather_f16_sse2:
.byte 102,68,15,111,233 // movdqa %xmm1,%xmm13
.byte 102,65,15,114,245,13 // pslld $0xd,%xmm13
.byte 102,68,15,235,232 // por %xmm0,%xmm13
- .byte 102,68,15,111,29,215,35,0,0 // movdqa 0x23d7(%rip),%xmm11 # 6300 <_sk_callback_sse2+0xe10>
+ .byte 102,68,15,111,29,224,35,0,0 // movdqa 0x23e0(%rip),%xmm11 # 6340 <_sk_callback_sse2+0xe15>
.byte 102,69,15,254,235 // paddd %xmm11,%xmm13
- .byte 102,68,15,111,37,217,35,0,0 // movdqa 0x23d9(%rip),%xmm12 # 6310 <_sk_callback_sse2+0xe20>
+ .byte 102,68,15,111,37,226,35,0,0 // movdqa 0x23e2(%rip),%xmm12 # 6350 <_sk_callback_sse2+0xe25>
.byte 102,65,15,239,204 // pxor %xmm12,%xmm1
- .byte 102,15,111,29,220,35,0,0 // movdqa 0x23dc(%rip),%xmm3 # 6320 <_sk_callback_sse2+0xe30>
+ .byte 102,15,111,29,229,35,0,0 // movdqa 0x23e5(%rip),%xmm3 # 6360 <_sk_callback_sse2+0xe35>
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
.byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0
.byte 102,65,15,223,197 // pandn %xmm13,%xmm0
@@ -33394,6 +33546,7 @@ _sk_gather_f16_sse2:
.byte 102,65,15,102,216 // pcmpgtd %xmm8,%xmm3
.byte 102,65,15,223,218 // pandn %xmm10,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
+ .byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_f16_sse2
@@ -33402,17 +33555,17 @@ FUNCTION(_sk_store_f16_sse2)
_sk_store_f16_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 102,68,15,111,21,4,35,0,0 // movdqa 0x2304(%rip),%xmm10 # 6330 <_sk_callback_sse2+0xe40>
+ .byte 102,68,15,111,21,12,35,0,0 // movdqa 0x230c(%rip),%xmm10 # 6370 <_sk_callback_sse2+0xe45>
.byte 102,68,15,111,224 // movdqa %xmm0,%xmm12
.byte 102,69,15,219,226 // pand %xmm10,%xmm12
.byte 102,68,15,111,232 // movdqa %xmm0,%xmm13
.byte 102,69,15,239,236 // pxor %xmm12,%xmm13
- .byte 102,68,15,111,13,247,34,0,0 // movdqa 0x22f7(%rip),%xmm9 # 6340 <_sk_callback_sse2+0xe50>
+ .byte 102,68,15,111,13,255,34,0,0 // movdqa 0x22ff(%rip),%xmm9 # 6380 <_sk_callback_sse2+0xe55>
.byte 102,65,15,114,212,16 // psrld $0x10,%xmm12
.byte 102,69,15,111,193 // movdqa %xmm9,%xmm8
.byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8
.byte 102,65,15,114,213,13 // psrld $0xd,%xmm13
- .byte 102,68,15,111,29,232,34,0,0 // movdqa 0x22e8(%rip),%xmm11 # 6350 <_sk_callback_sse2+0xe60>
+ .byte 102,68,15,111,29,240,34,0,0 // movdqa 0x22f0(%rip),%xmm11 # 6390 <_sk_callback_sse2+0xe65>
.byte 102,69,15,235,227 // por %xmm11,%xmm12
.byte 102,69,15,254,229 // paddd %xmm13,%xmm12
.byte 102,65,15,114,244,16 // pslld $0x10,%xmm12
@@ -33463,34 +33616,34 @@ _sk_store_f16_sse2:
.byte 102,69,15,97,225 // punpcklwd %xmm9,%xmm12
.byte 102,69,15,111,200 // movdqa %xmm8,%xmm9
.byte 102,69,15,98,204 // punpckldq %xmm12,%xmm9
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,21 // jne 418a <_sk_store_f16_sse2+0x16c>
- .byte 68,15,17,12,248 // movups %xmm9,(%rax,%rdi,8)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,21 // jne 41c2 <_sk_store_f16_sse2+0x16c>
+ .byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8)
.byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8
- .byte 243,68,15,127,68,248,16 // movdqu %xmm8,0x10(%rax,%rdi,8)
+ .byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 102,68,15,214,12,248 // movq %xmm9,(%rax,%rdi,8)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 4186 <_sk_store_f16_sse2+0x168>
- .byte 102,68,15,23,76,248,8 // movhpd %xmm9,0x8(%rax,%rdi,8)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 4186 <_sk_store_f16_sse2+0x168>
+ .byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 41be <_sk_store_f16_sse2+0x168>
+ .byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 41be <_sk_store_f16_sse2+0x168>
.byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8
- .byte 102,68,15,214,68,248,16 // movq %xmm8,0x10(%rax,%rdi,8)
- .byte 235,213 // jmp 4186 <_sk_store_f16_sse2+0x168>
+ .byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8)
+ .byte 235,213 // jmp 41be <_sk_store_f16_sse2+0x168>
HIDDEN _sk_load_u16_be_sse2
.globl _sk_load_u16_be_sse2
FUNCTION(_sk_load_u16_be_sse2)
_sk_load_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,190,0,0,0 // jne 4285 <_sk_load_u16_be_sse2+0xd4>
- .byte 102,65,15,16,4,64 // movupd (%r8,%rax,2),%xmm0
- .byte 102,65,15,16,76,64,16 // movupd 0x10(%r8,%rax,2),%xmm1
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,190,0,0,0 // jne 42bd <_sk_load_u16_be_sse2+0xd4>
+ .byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0
+ .byte 102,65,15,16,76,65,16 // movupd 0x10(%r9,%rax,2),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
.byte 102,15,97,209 // punpcklwd %xmm1,%xmm2
.byte 102,15,105,193 // punpckhwd %xmm1,%xmm0
@@ -33505,7 +33658,7 @@ _sk_load_u16_be_sse2:
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
.byte 15,91,193 // cvtdq2ps %xmm1,%xmm0
- .byte 68,15,40,5,72,33,0,0 // movaps 0x2148(%rip),%xmm8 # 6360 <_sk_callback_sse2+0xe70>
+ .byte 68,15,40,5,80,33,0,0 // movaps 0x2150(%rip),%xmm8 # 63a0 <_sk_callback_sse2+0xe75>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -33531,31 +33684,31 @@ _sk_load_u16_be_sse2:
.byte 65,15,89,216 // mulps %xmm8,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 242,65,15,16,4,64 // movsd (%r8,%rax,2),%xmm0
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,17 // jne 42a2 <_sk_load_u16_be_sse2+0xf1>
+ .byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,17 // jne 42da <_sk_load_u16_be_sse2+0xf1>
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 102,15,20,193 // unpcklpd %xmm1,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 233,50,255,255,255 // jmpq 41d4 <_sk_load_u16_be_sse2+0x23>
- .byte 102,65,15,22,68,64,8 // movhpd 0x8(%r8,%rax,2),%xmm0
+ .byte 233,50,255,255,255 // jmpq 420c <_sk_load_u16_be_sse2+0x23>
+ .byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 15,130,29,255,255,255 // jb 41d4 <_sk_load_u16_be_sse2+0x23>
- .byte 242,65,15,16,76,64,16 // movsd 0x10(%r8,%rax,2),%xmm1
- .byte 233,17,255,255,255 // jmpq 41d4 <_sk_load_u16_be_sse2+0x23>
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 15,130,29,255,255,255 // jb 420c <_sk_load_u16_be_sse2+0x23>
+ .byte 242,65,15,16,76,65,16 // movsd 0x10(%r9,%rax,2),%xmm1
+ .byte 233,17,255,255,255 // jmpq 420c <_sk_load_u16_be_sse2+0x23>
HIDDEN _sk_load_rgb_u16_be_sse2
.globl _sk_load_rgb_u16_be_sse2
FUNCTION(_sk_load_rgb_u16_be_sse2)
_sk_load_rgb_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,127 // lea (%rdi,%rdi,2),%rax
- .byte 72,133,201 // test %rcx,%rcx
- .byte 15,133,175,0,0,0 // jne 4384 <_sk_load_rgb_u16_be_sse2+0xc1>
- .byte 243,65,15,111,20,64 // movdqu (%r8,%rax,2),%xmm2
- .byte 243,65,15,111,92,64,8 // movdqu 0x8(%r8,%rax,2),%xmm3
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
+ .byte 77,133,192 // test %r8,%r8
+ .byte 15,133,175,0,0,0 // jne 43bc <_sk_load_rgb_u16_be_sse2+0xc1>
+ .byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2
+ .byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3
.byte 102,15,115,219,4 // psrldq $0x4,%xmm3
.byte 102,15,111,194 // movdqa %xmm2,%xmm0
.byte 102,15,115,216,6 // psrldq $0x6,%xmm0
@@ -33574,7 +33727,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
.byte 102,65,15,97,200 // punpcklwd %xmm8,%xmm1
.byte 15,91,193 // cvtdq2ps %xmm1,%xmm0
- .byte 68,15,40,13,55,32,0,0 // movaps 0x2037(%rip),%xmm9 # 6370 <_sk_callback_sse2+0xe80>
+ .byte 68,15,40,13,63,32,0,0 // movaps 0x203f(%rip),%xmm9 # 63b0 <_sk_callback_sse2+0xe85>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -33591,36 +33744,36 @@ _sk_load_rgb_u16_be_sse2:
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,254,31,0,0 // movaps 0x1ffe(%rip),%xmm3 # 6380 <_sk_callback_sse2+0xe90>
+ .byte 15,40,29,6,32,0,0 // movaps 0x2006(%rip),%xmm3 # 63c0 <_sk_callback_sse2+0xe95>
.byte 255,224 // jmpq *%rax
- .byte 102,65,15,110,20,64 // movd (%r8,%rax,2),%xmm2
- .byte 102,65,15,196,84,64,4,2 // pinsrw $0x2,0x4(%r8,%rax,2),%xmm2
+ .byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2
+ .byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,13 // jne 43a9 <_sk_load_rgb_u16_be_sse2+0xe6>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,13 // jne 43e1 <_sk_load_rgb_u16_be_sse2+0xe6>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,80,255,255,255 // jmpq 42f9 <_sk_load_rgb_u16_be_sse2+0x36>
- .byte 102,65,15,110,68,64,6 // movd 0x6(%r8,%rax,2),%xmm0
- .byte 102,65,15,196,68,64,10,2 // pinsrw $0x2,0xa(%r8,%rax,2),%xmm0
+ .byte 233,80,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0
+ .byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,24 // jb 43da <_sk_load_rgb_u16_be_sse2+0x117>
- .byte 102,65,15,110,92,64,12 // movd 0xc(%r8,%rax,2),%xmm3
- .byte 102,65,15,196,92,64,16,2 // pinsrw $0x2,0x10(%r8,%rax,2),%xmm3
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,24 // jb 4412 <_sk_load_rgb_u16_be_sse2+0x117>
+ .byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3
+ .byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,31,255,255,255 // jmpq 42f9 <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 233,31,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 233,22,255,255,255 // jmpq 42f9 <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 233,22,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36>
HIDDEN _sk_store_u16_be_sse2
.globl _sk_store_u16_be_sse2
FUNCTION(_sk_store_u16_be_sse2)
_sk_store_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
- .byte 72,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%rax
- .byte 68,15,40,21,152,31,0,0 // movaps 0x1f98(%rip),%xmm10 # 6390 <_sk_callback_sse2+0xea0>
+ .byte 76,139,8 // mov (%rax),%r9
+ .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
+ .byte 68,15,40,21,160,31,0,0 // movaps 0x1fa0(%rip),%xmm10 # 63d0 <_sk_callback_sse2+0xea5>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
@@ -33664,38 +33817,38 @@ _sk_store_u16_be_sse2:
.byte 102,69,15,97,202 // punpcklwd %xmm10,%xmm9
.byte 102,69,15,111,208 // movdqa %xmm8,%xmm10
.byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,21 // jne 44f2 <_sk_store_u16_be_sse2+0x10f>
- .byte 69,15,17,20,64 // movups %xmm10,(%r8,%rax,2)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,21 // jne 452a <_sk_store_u16_be_sse2+0x10f>
+ .byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2)
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
- .byte 243,69,15,127,68,64,16 // movdqu %xmm8,0x10(%r8,%rax,2)
+ .byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 102,69,15,214,20,64 // movq %xmm10,(%r8,%rax,2)
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,240 // je 44ee <_sk_store_u16_be_sse2+0x10b>
- .byte 102,69,15,23,84,64,8 // movhpd %xmm10,0x8(%r8,%rax,2)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,227 // jb 44ee <_sk_store_u16_be_sse2+0x10b>
+ .byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2)
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,240 // je 4526 <_sk_store_u16_be_sse2+0x10b>
+ .byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,227 // jb 4526 <_sk_store_u16_be_sse2+0x10b>
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
- .byte 102,69,15,214,68,64,16 // movq %xmm8,0x10(%r8,%rax,2)
- .byte 235,213 // jmp 44ee <_sk_store_u16_be_sse2+0x10b>
+ .byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2)
+ .byte 235,213 // jmp 4526 <_sk_store_u16_be_sse2+0x10b>
HIDDEN _sk_load_f32_sse2
.globl _sk_load_f32_sse2
FUNCTION(_sk_load_f32_sse2)
_sk_load_f32_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%r8
- .byte 72,137,248 // mov %rdi,%rax
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 76,141,12,149,0,0,0,0 // lea 0x0(,%rdx,4),%r9
+ .byte 72,137,208 // mov %rdx,%rax
.byte 72,193,224,4 // shl $0x4,%rax
- .byte 69,15,16,4,1 // movups (%r9,%rax,1),%xmm8
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,66 // jne 4579 <_sk_load_f32_sse2+0x60>
- .byte 67,15,16,68,129,16 // movups 0x10(%r9,%r8,4),%xmm0
- .byte 67,15,16,92,129,32 // movups 0x20(%r9,%r8,4),%xmm3
- .byte 71,15,16,76,129,48 // movups 0x30(%r9,%r8,4),%xmm9
+ .byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,66 // jne 45b1 <_sk_load_f32_sse2+0x60>
+ .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
+ .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
+ .byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
.byte 65,15,40,208 // movaps %xmm8,%xmm2
.byte 15,20,208 // unpcklps %xmm0,%xmm2
.byte 15,40,203 // movaps %xmm3,%xmm1
@@ -33711,27 +33864,27 @@ _sk_load_f32_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 117,8 // jne 458b <_sk_load_f32_sse2+0x72>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 117,8 // jne 45c3 <_sk_load_f32_sse2+0x72>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
- .byte 235,190 // jmp 4549 <_sk_load_f32_sse2+0x30>
- .byte 67,15,16,68,129,16 // movups 0x10(%r9,%r8,4),%xmm0
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,8 // jb 459f <_sk_load_f32_sse2+0x86>
- .byte 67,15,16,92,129,32 // movups 0x20(%r9,%r8,4),%xmm3
- .byte 235,170 // jmp 4549 <_sk_load_f32_sse2+0x30>
+ .byte 235,190 // jmp 4581 <_sk_load_f32_sse2+0x30>
+ .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,8 // jb 45d7 <_sk_load_f32_sse2+0x86>
+ .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
+ .byte 235,170 // jmp 4581 <_sk_load_f32_sse2+0x30>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 235,165 // jmp 4549 <_sk_load_f32_sse2+0x30>
+ .byte 235,165 // jmp 4581 <_sk_load_f32_sse2+0x30>
HIDDEN _sk_store_f32_sse2
.globl _sk_store_f32_sse2
FUNCTION(_sk_store_f32_sse2)
_sk_store_f32_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,8 // mov (%rax),%r9
- .byte 76,141,4,189,0,0,0,0 // lea 0x0(,%rdi,4),%r8
- .byte 72,137,248 // mov %rdi,%rax
+ .byte 76,139,16 // mov (%rax),%r10
+ .byte 76,141,12,149,0,0,0,0 // lea 0x0(,%rdx,4),%r9
+ .byte 72,137,208 // mov %rdx,%rax
.byte 72,193,224,4 // shl $0x4,%rax
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 68,15,20,201 // unpcklps %xmm1,%xmm9
@@ -33746,22 +33899,22 @@ _sk_store_f32_sse2:
.byte 69,15,18,193 // movhlps %xmm9,%xmm8
.byte 69,15,40,202 // movaps %xmm10,%xmm9
.byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9
- .byte 102,69,15,17,36,1 // movupd %xmm12,(%r9,%rax,1)
- .byte 72,133,201 // test %rcx,%rcx
- .byte 117,29 // jne 4616 <_sk_store_f32_sse2+0x72>
+ .byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1)
+ .byte 77,133,192 // test %r8,%r8
+ .byte 117,29 // jne 464e <_sk_store_f32_sse2+0x72>
.byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10
- .byte 71,15,17,68,129,16 // movups %xmm8,0x10(%r9,%r8,4)
- .byte 102,71,15,17,76,129,32 // movupd %xmm9,0x20(%r9,%r8,4)
- .byte 102,71,15,17,84,129,48 // movupd %xmm10,0x30(%r9,%r8,4)
+ .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
+ .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
+ .byte 102,71,15,17,84,138,48 // movupd %xmm10,0x30(%r10,%r9,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
- .byte 72,131,249,1 // cmp $0x1,%rcx
- .byte 116,246 // je 4612 <_sk_store_f32_sse2+0x6e>
- .byte 71,15,17,68,129,16 // movups %xmm8,0x10(%r9,%r8,4)
- .byte 72,131,249,3 // cmp $0x3,%rcx
- .byte 114,234 // jb 4612 <_sk_store_f32_sse2+0x6e>
- .byte 102,71,15,17,76,129,32 // movupd %xmm9,0x20(%r9,%r8,4)
- .byte 235,225 // jmp 4612 <_sk_store_f32_sse2+0x6e>
+ .byte 73,131,248,1 // cmp $0x1,%r8
+ .byte 116,246 // je 464a <_sk_store_f32_sse2+0x6e>
+ .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
+ .byte 73,131,248,3 // cmp $0x3,%r8
+ .byte 114,234 // jb 464a <_sk_store_f32_sse2+0x6e>
+ .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
+ .byte 235,225 // jmp 464a <_sk_store_f32_sse2+0x6e>
HIDDEN _sk_clamp_x_sse2
.globl _sk_clamp_x_sse2
@@ -33803,7 +33956,7 @@ _sk_repeat_x_sse2:
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,9,29,0,0 // andps 0x1d09(%rip),%xmm9 # 63a0 <_sk_callback_sse2+0xeb0>
+ .byte 68,15,84,13,17,29,0,0 // andps 0x1d11(%rip),%xmm9 # 63e0 <_sk_callback_sse2+0xeb5>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,92,194 // subps %xmm10,%xmm0
@@ -33822,7 +33975,7 @@ _sk_repeat_y_sse2:
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,223,28,0,0 // andps 0x1cdf(%rip),%xmm9 # 63b0 <_sk_callback_sse2+0xec0>
+ .byte 68,15,84,13,231,28,0,0 // andps 0x1ce7(%rip),%xmm9 # 63f0 <_sk_callback_sse2+0xec5>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,92,202 // subps %xmm10,%xmm1
@@ -33845,7 +33998,7 @@ _sk_mirror_x_sse2:
.byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11
.byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11
.byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10
- .byte 68,15,84,21,163,28,0,0 // andps 0x1ca3(%rip),%xmm10 # 63c0 <_sk_callback_sse2+0xed0>
+ .byte 68,15,84,21,171,28,0,0 // andps 0x1cab(%rip),%xmm10 # 6400 <_sk_callback_sse2+0xed5>
.byte 69,15,87,228 // xorps %xmm12,%xmm12
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 69,15,89,216 // mulps %xmm8,%xmm11
@@ -33872,7 +34025,7 @@ _sk_mirror_y_sse2:
.byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11
.byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11
.byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10
- .byte 68,15,84,21,87,28,0,0 // andps 0x1c57(%rip),%xmm10 # 63d0 <_sk_callback_sse2+0xee0>
+ .byte 68,15,84,21,95,28,0,0 // andps 0x1c5f(%rip),%xmm10 # 6410 <_sk_callback_sse2+0xee5>
.byte 69,15,87,228 // xorps %xmm12,%xmm12
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 69,15,89,216 // mulps %xmm8,%xmm11
@@ -33889,7 +34042,7 @@ FUNCTION(_sk_clamp_x_1_sse2)
_sk_clamp_x_1_sse2:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,55,28,0,0 // minps 0x1c37(%rip),%xmm8 # 63e0 <_sk_callback_sse2+0xef0>
+ .byte 68,15,93,5,63,28,0,0 // minps 0x1c3f(%rip),%xmm8 # 6420 <_sk_callback_sse2+0xef5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -33902,7 +34055,7 @@ _sk_repeat_x_1_sse2:
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9
- .byte 68,15,84,13,37,28,0,0 // andps 0x1c25(%rip),%xmm9 # 63f0 <_sk_callback_sse2+0xf00>
+ .byte 68,15,84,13,45,28,0,0 // andps 0x1c2d(%rip),%xmm9 # 6430 <_sk_callback_sse2+0xf05>
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 65,15,92,192 // subps %xmm8,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -33912,14 +34065,14 @@ HIDDEN _sk_mirror_x_1_sse2
.globl _sk_mirror_x_1_sse2
FUNCTION(_sk_mirror_x_1_sse2)
_sk_mirror_x_1_sse2:
- .byte 68,15,40,5,33,28,0,0 // movaps 0x1c21(%rip),%xmm8 # 6400 <_sk_callback_sse2+0xf10>
+ .byte 68,15,40,5,41,28,0,0 // movaps 0x1c29(%rip),%xmm8 # 6440 <_sk_callback_sse2+0xf15>
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,13,37,28,0,0 // movaps 0x1c25(%rip),%xmm9 # 6410 <_sk_callback_sse2+0xf20>
+ .byte 68,15,40,13,45,28,0,0 // movaps 0x1c2d(%rip),%xmm9 # 6450 <_sk_callback_sse2+0xf25>
.byte 68,15,89,200 // mulps %xmm0,%xmm9
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,27,28,0,0 // andps 0x1c1b(%rip),%xmm9 # 6420 <_sk_callback_sse2+0xf30>
+ .byte 68,15,84,13,35,28,0,0 // andps 0x1c23(%rip),%xmm9 # 6460 <_sk_callback_sse2+0xf35>
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,88,210 // addps %xmm10,%xmm10
@@ -33935,10 +34088,10 @@ HIDDEN _sk_luminance_to_alpha_sse2
FUNCTION(_sk_luminance_to_alpha_sse2)
_sk_luminance_to_alpha_sse2:
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 15,89,5,1,28,0,0 // mulps 0x1c01(%rip),%xmm0 # 6430 <_sk_callback_sse2+0xf40>
- .byte 15,89,13,10,28,0,0 // mulps 0x1c0a(%rip),%xmm1 # 6440 <_sk_callback_sse2+0xf50>
+ .byte 15,89,5,9,28,0,0 // mulps 0x1c09(%rip),%xmm0 # 6470 <_sk_callback_sse2+0xf45>
+ .byte 15,89,13,18,28,0,0 // mulps 0x1c12(%rip),%xmm1 # 6480 <_sk_callback_sse2+0xf55>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,29,16,28,0,0 // mulps 0x1c10(%rip),%xmm3 # 6450 <_sk_callback_sse2+0xf60>
+ .byte 15,89,29,24,28,0,0 // mulps 0x1c18(%rip),%xmm3 # 6490 <_sk_callback_sse2+0xf65>
.byte 15,88,217 // addps %xmm1,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
@@ -34216,86 +34369,86 @@ _sk_evenly_spaced_gradient_sse2:
.byte 72,139,24 // mov (%rax),%rbx
.byte 76,139,112,8 // mov 0x8(%rax),%r14
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 4c7c <_sk_evenly_spaced_gradient_sse2+0x18>
+ .byte 120,7 // js 4cb4 <_sk_evenly_spaced_gradient_sse2+0x18>
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
- .byte 235,21 // jmp 4c91 <_sk_evenly_spaced_gradient_sse2+0x2d>
- .byte 73,137,216 // mov %rbx,%r8
- .byte 73,209,232 // shr %r8
+ .byte 235,21 // jmp 4cc9 <_sk_evenly_spaced_gradient_sse2+0x2d>
+ .byte 73,137,217 // mov %rbx,%r9
+ .byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
- .byte 76,9,195 // or %r8,%rbx
+ .byte 76,9,203 // or %r9,%rbx
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
.byte 243,15,88,201 // addss %xmm1,%xmm1
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
.byte 15,89,200 // mulps %xmm0,%xmm1
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
- .byte 102,73,15,126,210 // movq %xmm2,%r10
- .byte 69,137,208 // mov %r10d,%r8d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 102,73,15,126,211 // movq %xmm2,%r11
.byte 69,137,217 // mov %r11d,%r9d
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 243,67,15,16,12,158 // movss (%r14,%r11,4),%xmm1
- .byte 243,67,15,16,20,150 // movss (%r14,%r10,4),%xmm2
+ .byte 102,72,15,126,203 // movq %xmm1,%rbx
+ .byte 65,137,218 // mov %ebx,%r10d
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 243,71,15,16,4,142 // movss (%r14,%r9,4),%xmm8
- .byte 243,67,15,16,20,134 // movss (%r14,%r8,4),%xmm2
+ .byte 243,71,15,16,4,150 // movss (%r14,%r10,4),%xmm8
+ .byte 243,67,15,16,20,142 // movss (%r14,%r9,4),%xmm2
.byte 68,15,20,194 // unpcklps %xmm2,%xmm8
.byte 68,15,20,193 // unpcklps %xmm1,%xmm8
- .byte 72,139,88,40 // mov 0x28(%rax),%rbx
- .byte 243,66,15,16,12,155 // movss (%rbx,%r11,4),%xmm1
- .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
+ .byte 76,139,112,40 // mov 0x28(%rax),%r14
+ .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 243,70,15,16,12,139 // movss (%rbx,%r9,4),%xmm9
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,71,15,16,12,150 // movss (%r14,%r10,4),%xmm9
+ .byte 243,67,15,16,20,142 // movss (%r14,%r9,4),%xmm2
.byte 68,15,20,202 // unpcklps %xmm2,%xmm9
.byte 68,15,20,201 // unpcklps %xmm1,%xmm9
- .byte 72,139,88,16 // mov 0x10(%rax),%rbx
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
- .byte 243,66,15,16,12,147 // movss (%rbx,%r10,4),%xmm1
+ .byte 76,139,112,16 // mov 0x10(%rax),%r14
+ .byte 243,65,15,16,20,158 // movss (%r14,%rbx,4),%xmm2
+ .byte 243,67,15,16,12,158 // movss (%r14,%r11,4),%xmm1
.byte 15,20,209 // unpcklps %xmm1,%xmm2
- .byte 243,66,15,16,12,139 // movss (%rbx,%r9,4),%xmm1
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,67,15,16,12,150 // movss (%r14,%r10,4),%xmm1
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 15,20,203 // unpcklps %xmm3,%xmm1
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,48 // mov 0x30(%rax),%r14
+ .byte 243,65,15,16,20,158 // movss (%r14,%rbx,4),%xmm2
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
- .byte 243,70,15,16,20,139 // movss (%rbx,%r9,4),%xmm10
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,71,15,16,20,150 // movss (%r14,%r10,4),%xmm10
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 68,15,20,211 // unpcklps %xmm3,%xmm10
.byte 68,15,20,210 // unpcklps %xmm2,%xmm10
- .byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 243,70,15,16,28,155 // movss (%rbx,%r11,4),%xmm11
- .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
+ .byte 76,139,112,24 // mov 0x18(%rax),%r14
+ .byte 243,69,15,16,28,158 // movss (%r14,%rbx,4),%xmm11
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 68,15,20,218 // unpcklps %xmm2,%xmm11
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,67,15,16,20,150 // movss (%r14,%r10,4),%xmm2
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,211 // unpcklps %xmm11,%xmm2
- .byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 243,70,15,16,36,155 // movss (%rbx,%r11,4),%xmm12
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,56 // mov 0x38(%rax),%r14
+ .byte 243,69,15,16,36,158 // movss (%r14,%rbx,4),%xmm12
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 68,15,20,227 // unpcklps %xmm3,%xmm12
- .byte 243,70,15,16,28,139 // movss (%rbx,%r9,4),%xmm11
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,71,15,16,28,150 // movss (%r14,%r10,4),%xmm11
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 68,15,20,219 // unpcklps %xmm3,%xmm11
.byte 69,15,20,220 // unpcklps %xmm12,%xmm11
- .byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 243,70,15,16,36,155 // movss (%rbx,%r11,4),%xmm12
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,32 // mov 0x20(%rax),%r14
+ .byte 243,69,15,16,36,158 // movss (%r14,%rbx,4),%xmm12
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 68,15,20,227 // unpcklps %xmm3,%xmm12
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
- .byte 243,70,15,16,44,131 // movss (%rbx,%r8,4),%xmm13
+ .byte 243,67,15,16,28,150 // movss (%r14,%r10,4),%xmm3
+ .byte 243,71,15,16,44,142 // movss (%r14,%r9,4),%xmm13
.byte 65,15,20,221 // unpcklps %xmm13,%xmm3
.byte 65,15,20,220 // unpcklps %xmm12,%xmm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 243,70,15,16,36,152 // movss (%rax,%r11,4),%xmm12
- .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
+ .byte 243,68,15,16,36,152 // movss (%rax,%rbx,4),%xmm12
+ .byte 243,70,15,16,44,152 // movss (%rax,%r11,4),%xmm13
.byte 69,15,20,229 // unpcklps %xmm13,%xmm12
- .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
- .byte 243,70,15,16,52,128 // movss (%rax,%r8,4),%xmm14
+ .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
+ .byte 243,70,15,16,52,136 // movss (%rax,%r9,4),%xmm14
.byte 69,15,20,238 // unpcklps %xmm14,%xmm13
.byte 69,15,20,236 // unpcklps %xmm12,%xmm13
.byte 68,15,89,192 // mulps %xmm0,%xmm8
@@ -34316,15 +34469,15 @@ HIDDEN _sk_gauss_a_to_rgba_sse2
.globl _sk_gauss_a_to_rgba_sse2
FUNCTION(_sk_gauss_a_to_rgba_sse2)
_sk_gauss_a_to_rgba_sse2:
- .byte 15,40,5,67,22,0,0 // movaps 0x1643(%rip),%xmm0 # 6460 <_sk_callback_sse2+0xf70>
+ .byte 15,40,5,75,22,0,0 // movaps 0x164b(%rip),%xmm0 # 64a0 <_sk_callback_sse2+0xf75>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,73,22,0,0 // addps 0x1649(%rip),%xmm0 # 6470 <_sk_callback_sse2+0xf80>
+ .byte 15,88,5,81,22,0,0 // addps 0x1651(%rip),%xmm0 # 64b0 <_sk_callback_sse2+0xf85>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,79,22,0,0 // addps 0x164f(%rip),%xmm0 # 6480 <_sk_callback_sse2+0xf90>
+ .byte 15,88,5,87,22,0,0 // addps 0x1657(%rip),%xmm0 # 64c0 <_sk_callback_sse2+0xf95>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,85,22,0,0 // addps 0x1655(%rip),%xmm0 # 6490 <_sk_callback_sse2+0xfa0>
+ .byte 15,88,5,93,22,0,0 // addps 0x165d(%rip),%xmm0 # 64d0 <_sk_callback_sse2+0xfa5>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,91,22,0,0 // addps 0x165b(%rip),%xmm0 # 64a0 <_sk_callback_sse2+0xfb0>
+ .byte 15,88,5,99,22,0,0 // addps 0x1663(%rip),%xmm0 # 64e0 <_sk_callback_sse2+0xfb5>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
@@ -34335,95 +34488,96 @@ HIDDEN _sk_gradient_sse2
.globl _sk_gradient_sse2
FUNCTION(_sk_gradient_sse2)
_sk_gradient_sse2:
+ .byte 65,87 // push %r15
+ .byte 65,86 // push %r14
+ .byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,0 // mov (%rax),%r8
+ .byte 76,139,8 // mov (%rax),%r9
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 73,131,248,2 // cmp $0x2,%r8
- .byte 114,51 // jb 4e94 <_sk_gradient_sse2+0x42>
- .byte 76,139,72,72 // mov 0x48(%rax),%r9
- .byte 73,255,200 // dec %r8
- .byte 73,131,193,4 // add $0x4,%r9
+ .byte 73,131,249,2 // cmp $0x2,%r9
+ .byte 114,50 // jb 4ed0 <_sk_gradient_sse2+0x46>
+ .byte 72,139,88,72 // mov 0x48(%rax),%rbx
+ .byte 73,255,201 // dec %r9
+ .byte 72,131,195,4 // add $0x4,%rbx
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 15,40,21,57,22,0,0 // movaps 0x1639(%rip),%xmm2 # 64b0 <_sk_callback_sse2+0xfc0>
- .byte 243,65,15,16,25 // movss (%r9),%xmm3
+ .byte 15,40,21,60,22,0,0 // movaps 0x163c(%rip),%xmm2 # 64f0 <_sk_callback_sse2+0xfc5>
+ .byte 243,15,16,27 // movss (%rbx),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
.byte 15,84,218 // andps %xmm2,%xmm3
.byte 102,15,254,203 // paddd %xmm3,%xmm1
- .byte 73,131,193,4 // add $0x4,%r9
- .byte 73,255,200 // dec %r8
- .byte 117,227 // jne 4e77 <_sk_gradient_sse2+0x25>
- .byte 65,86 // push %r14
- .byte 83 // push %rbx
+ .byte 72,131,195,4 // add $0x4,%rbx
+ .byte 73,255,201 // dec %r9
+ .byte 117,228 // jne 4eb4 <_sk_gradient_sse2+0x2a>
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
- .byte 102,73,15,126,210 // movq %xmm2,%r10
- .byte 69,137,208 // mov %r10d,%r8d
- .byte 73,193,234,32 // shr $0x20,%r10
- .byte 102,73,15,126,203 // movq %xmm1,%r11
+ .byte 102,73,15,126,211 // movq %xmm2,%r11
.byte 69,137,217 // mov %r11d,%r9d
.byte 73,193,235,32 // shr $0x20,%r11
- .byte 72,139,88,8 // mov 0x8(%rax),%rbx
- .byte 76,139,112,16 // mov 0x10(%rax),%r14
- .byte 243,66,15,16,12,155 // movss (%rbx,%r11,4),%xmm1
- .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
+ .byte 102,72,15,126,203 // movq %xmm1,%rbx
+ .byte 65,137,218 // mov %ebx,%r10d
+ .byte 72,193,235,32 // shr $0x20,%rbx
+ .byte 76,139,112,8 // mov 0x8(%rax),%r14
+ .byte 76,139,120,16 // mov 0x10(%rax),%r15
+ .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 243,70,15,16,4,139 // movss (%rbx,%r9,4),%xmm8
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,71,15,16,4,150 // movss (%r14,%r10,4),%xmm8
+ .byte 243,67,15,16,20,142 // movss (%r14,%r9,4),%xmm2
.byte 68,15,20,194 // unpcklps %xmm2,%xmm8
.byte 68,15,20,193 // unpcklps %xmm1,%xmm8
- .byte 72,139,88,40 // mov 0x28(%rax),%rbx
- .byte 243,66,15,16,12,155 // movss (%rbx,%r11,4),%xmm1
- .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
+ .byte 76,139,112,40 // mov 0x28(%rax),%r14
+ .byte 243,65,15,16,12,158 // movss (%r14,%rbx,4),%xmm1
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 243,70,15,16,12,139 // movss (%rbx,%r9,4),%xmm9
- .byte 243,66,15,16,20,131 // movss (%rbx,%r8,4),%xmm2
+ .byte 243,71,15,16,12,150 // movss (%r14,%r10,4),%xmm9
+ .byte 243,67,15,16,20,142 // movss (%r14,%r9,4),%xmm2
.byte 68,15,20,202 // unpcklps %xmm2,%xmm9
.byte 68,15,20,201 // unpcklps %xmm1,%xmm9
- .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
- .byte 243,67,15,16,12,150 // movss (%r14,%r10,4),%xmm1
+ .byte 243,65,15,16,20,159 // movss (%r15,%rbx,4),%xmm2
+ .byte 243,67,15,16,12,159 // movss (%r15,%r11,4),%xmm1
.byte 15,20,209 // unpcklps %xmm1,%xmm2
- .byte 243,67,15,16,12,142 // movss (%r14,%r9,4),%xmm1
- .byte 243,67,15,16,28,134 // movss (%r14,%r8,4),%xmm3
+ .byte 243,67,15,16,12,151 // movss (%r15,%r10,4),%xmm1
+ .byte 243,67,15,16,28,143 // movss (%r15,%r9,4),%xmm3
.byte 15,20,203 // unpcklps %xmm3,%xmm1
.byte 15,20,202 // unpcklps %xmm2,%xmm1
- .byte 72,139,88,48 // mov 0x30(%rax),%rbx
- .byte 243,66,15,16,20,155 // movss (%rbx,%r11,4),%xmm2
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,48 // mov 0x30(%rax),%r14
+ .byte 243,65,15,16,20,158 // movss (%r14,%rbx,4),%xmm2
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
- .byte 243,70,15,16,20,139 // movss (%rbx,%r9,4),%xmm10
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,71,15,16,20,150 // movss (%r14,%r10,4),%xmm10
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 68,15,20,211 // unpcklps %xmm3,%xmm10
.byte 68,15,20,210 // unpcklps %xmm2,%xmm10
- .byte 72,139,88,24 // mov 0x18(%rax),%rbx
- .byte 243,70,15,16,28,155 // movss (%rbx,%r11,4),%xmm11
- .byte 243,66,15,16,20,147 // movss (%rbx,%r10,4),%xmm2
+ .byte 76,139,112,24 // mov 0x18(%rax),%r14
+ .byte 243,69,15,16,28,158 // movss (%r14,%rbx,4),%xmm11
+ .byte 243,67,15,16,20,158 // movss (%r14,%r11,4),%xmm2
.byte 68,15,20,218 // unpcklps %xmm2,%xmm11
- .byte 243,66,15,16,20,139 // movss (%rbx,%r9,4),%xmm2
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,67,15,16,20,150 // movss (%r14,%r10,4),%xmm2
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,211 // unpcklps %xmm11,%xmm2
- .byte 72,139,88,56 // mov 0x38(%rax),%rbx
- .byte 243,70,15,16,36,155 // movss (%rbx,%r11,4),%xmm12
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,56 // mov 0x38(%rax),%r14
+ .byte 243,69,15,16,36,158 // movss (%r14,%rbx,4),%xmm12
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 68,15,20,227 // unpcklps %xmm3,%xmm12
- .byte 243,70,15,16,28,139 // movss (%rbx,%r9,4),%xmm11
- .byte 243,66,15,16,28,131 // movss (%rbx,%r8,4),%xmm3
+ .byte 243,71,15,16,28,150 // movss (%r14,%r10,4),%xmm11
+ .byte 243,67,15,16,28,142 // movss (%r14,%r9,4),%xmm3
.byte 68,15,20,219 // unpcklps %xmm3,%xmm11
.byte 69,15,20,220 // unpcklps %xmm12,%xmm11
- .byte 72,139,88,32 // mov 0x20(%rax),%rbx
- .byte 243,70,15,16,36,155 // movss (%rbx,%r11,4),%xmm12
- .byte 243,66,15,16,28,147 // movss (%rbx,%r10,4),%xmm3
+ .byte 76,139,112,32 // mov 0x20(%rax),%r14
+ .byte 243,69,15,16,36,158 // movss (%r14,%rbx,4),%xmm12
+ .byte 243,67,15,16,28,158 // movss (%r14,%r11,4),%xmm3
.byte 68,15,20,227 // unpcklps %xmm3,%xmm12
- .byte 243,66,15,16,28,139 // movss (%rbx,%r9,4),%xmm3
- .byte 243,70,15,16,44,131 // movss (%rbx,%r8,4),%xmm13
+ .byte 243,67,15,16,28,150 // movss (%r14,%r10,4),%xmm3
+ .byte 243,71,15,16,44,142 // movss (%r14,%r9,4),%xmm13
.byte 65,15,20,221 // unpcklps %xmm13,%xmm3
.byte 65,15,20,220 // unpcklps %xmm12,%xmm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
- .byte 243,70,15,16,36,152 // movss (%rax,%r11,4),%xmm12
- .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
+ .byte 243,68,15,16,36,152 // movss (%rax,%rbx,4),%xmm12
+ .byte 243,70,15,16,44,152 // movss (%rax,%r11,4),%xmm13
.byte 69,15,20,229 // unpcklps %xmm13,%xmm12
- .byte 243,70,15,16,44,136 // movss (%rax,%r9,4),%xmm13
- .byte 243,70,15,16,52,128 // movss (%rax,%r8,4),%xmm14
+ .byte 243,70,15,16,44,144 // movss (%rax,%r10,4),%xmm13
+ .byte 243,70,15,16,52,136 // movss (%rax,%r9,4),%xmm14
.byte 69,15,20,238 // unpcklps %xmm14,%xmm13
.byte 69,15,20,236 // unpcklps %xmm12,%xmm13
.byte 68,15,89,192 // mulps %xmm0,%xmm8
@@ -34438,6 +34592,7 @@ _sk_gradient_sse2:
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
+ .byte 65,95 // pop %r15
.byte 255,224 // jmpq *%rax
HIDDEN _sk_evenly_spaced_2_stop_gradient_sse2
@@ -34492,29 +34647,29 @@ _sk_xy_to_unit_angle_sse2:
.byte 69,15,94,220 // divps %xmm12,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
- .byte 68,15,40,45,248,19,0,0 // movaps 0x13f8(%rip),%xmm13 # 64c0 <_sk_callback_sse2+0xfd0>
+ .byte 68,15,40,45,253,19,0,0 // movaps 0x13fd(%rip),%xmm13 # 6500 <_sk_callback_sse2+0xfd5>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,252,19,0,0 // addps 0x13fc(%rip),%xmm13 # 64d0 <_sk_callback_sse2+0xfe0>
+ .byte 68,15,88,45,1,20,0,0 // addps 0x1401(%rip),%xmm13 # 6510 <_sk_callback_sse2+0xfe5>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,0,20,0,0 // addps 0x1400(%rip),%xmm13 # 64e0 <_sk_callback_sse2+0xff0>
+ .byte 68,15,88,45,5,20,0,0 // addps 0x1405(%rip),%xmm13 # 6520 <_sk_callback_sse2+0xff5>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,4,20,0,0 // addps 0x1404(%rip),%xmm13 # 64f0 <_sk_callback_sse2+0x1000>
+ .byte 68,15,88,45,9,20,0,0 // addps 0x1409(%rip),%xmm13 # 6530 <_sk_callback_sse2+0x1005>
.byte 69,15,89,235 // mulps %xmm11,%xmm13
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,40,21,3,20,0,0 // movaps 0x1403(%rip),%xmm10 # 6500 <_sk_callback_sse2+0x1010>
+ .byte 68,15,40,21,8,20,0,0 // movaps 0x1408(%rip),%xmm10 # 6540 <_sk_callback_sse2+0x1015>
.byte 69,15,92,213 // subps %xmm13,%xmm10
.byte 69,15,84,209 // andps %xmm9,%xmm10
.byte 69,15,85,205 // andnps %xmm13,%xmm9
.byte 69,15,86,202 // orps %xmm10,%xmm9
.byte 68,15,194,192,1 // cmpltps %xmm0,%xmm8
- .byte 68,15,40,21,246,19,0,0 // movaps 0x13f6(%rip),%xmm10 # 6510 <_sk_callback_sse2+0x1020>
+ .byte 68,15,40,21,251,19,0,0 // movaps 0x13fb(%rip),%xmm10 # 6550 <_sk_callback_sse2+0x1025>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,84,208 // andps %xmm8,%xmm10
.byte 69,15,85,193 // andnps %xmm9,%xmm8
.byte 69,15,86,194 // orps %xmm10,%xmm8
.byte 68,15,40,201 // movaps %xmm1,%xmm9
.byte 68,15,194,200,1 // cmpltps %xmm0,%xmm9
- .byte 68,15,40,21,229,19,0,0 // movaps 0x13e5(%rip),%xmm10 # 6520 <_sk_callback_sse2+0x1030>
+ .byte 68,15,40,21,234,19,0,0 // movaps 0x13ea(%rip),%xmm10 # 6560 <_sk_callback_sse2+0x1035>
.byte 69,15,92,208 // subps %xmm8,%xmm10
.byte 69,15,84,209 // andps %xmm9,%xmm10
.byte 69,15,85,200 // andnps %xmm8,%xmm9
@@ -34541,7 +34696,7 @@ HIDDEN _sk_save_xy_sse2
FUNCTION(_sk_save_xy_sse2)
_sk_save_xy_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,183,19,0,0 // movaps 0x13b7(%rip),%xmm8 # 6530 <_sk_callback_sse2+0x1040>
+ .byte 68,15,40,5,188,19,0,0 // movaps 0x13bc(%rip),%xmm8 # 6570 <_sk_callback_sse2+0x1045>
.byte 15,17,0 // movups %xmm0,(%rax)
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,88,200 // addps %xmm8,%xmm9
@@ -34549,7 +34704,7 @@ _sk_save_xy_sse2:
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,40,217 // movaps %xmm9,%xmm11
.byte 69,15,194,218,1 // cmpltps %xmm10,%xmm11
- .byte 68,15,40,37,162,19,0,0 // movaps 0x13a2(%rip),%xmm12 # 6540 <_sk_callback_sse2+0x1050>
+ .byte 68,15,40,37,167,19,0,0 // movaps 0x13a7(%rip),%xmm12 # 6580 <_sk_callback_sse2+0x1055>
.byte 69,15,84,220 // andps %xmm12,%xmm11
.byte 69,15,92,211 // subps %xmm11,%xmm10
.byte 69,15,92,202 // subps %xmm10,%xmm9
@@ -34596,8 +34751,8 @@ _sk_bilinear_nx_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,27,19,0,0 // addps 0x131b(%rip),%xmm0 # 6550 <_sk_callback_sse2+0x1060>
- .byte 68,15,40,13,35,19,0,0 // movaps 0x1323(%rip),%xmm9 # 6560 <_sk_callback_sse2+0x1070>
+ .byte 15,88,5,32,19,0,0 // addps 0x1320(%rip),%xmm0 # 6590 <_sk_callback_sse2+0x1065>
+ .byte 68,15,40,13,40,19,0,0 // movaps 0x1328(%rip),%xmm9 # 65a0 <_sk_callback_sse2+0x1075>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34610,7 +34765,7 @@ _sk_bilinear_px_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,18,19,0,0 // addps 0x1312(%rip),%xmm0 # 6570 <_sk_callback_sse2+0x1080>
+ .byte 15,88,5,23,19,0,0 // addps 0x1317(%rip),%xmm0 # 65b0 <_sk_callback_sse2+0x1085>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34622,8 +34777,8 @@ _sk_bilinear_ny_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,4,19,0,0 // addps 0x1304(%rip),%xmm1 # 6580 <_sk_callback_sse2+0x1090>
- .byte 68,15,40,13,12,19,0,0 // movaps 0x130c(%rip),%xmm9 # 6590 <_sk_callback_sse2+0x10a0>
+ .byte 15,88,13,9,19,0,0 // addps 0x1309(%rip),%xmm1 # 65c0 <_sk_callback_sse2+0x1095>
+ .byte 68,15,40,13,17,19,0,0 // movaps 0x1311(%rip),%xmm9 # 65d0 <_sk_callback_sse2+0x10a5>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34636,7 +34791,7 @@ _sk_bilinear_py_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,250,18,0,0 // addps 0x12fa(%rip),%xmm1 # 65a0 <_sk_callback_sse2+0x10b0>
+ .byte 15,88,13,255,18,0,0 // addps 0x12ff(%rip),%xmm1 # 65e0 <_sk_callback_sse2+0x10b5>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34648,13 +34803,13 @@ _sk_bicubic_n3x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,237,18,0,0 // addps 0x12ed(%rip),%xmm0 # 65b0 <_sk_callback_sse2+0x10c0>
- .byte 68,15,40,13,245,18,0,0 // movaps 0x12f5(%rip),%xmm9 # 65c0 <_sk_callback_sse2+0x10d0>
+ .byte 15,88,5,242,18,0,0 // addps 0x12f2(%rip),%xmm0 # 65f0 <_sk_callback_sse2+0x10c5>
+ .byte 68,15,40,13,250,18,0,0 // movaps 0x12fa(%rip),%xmm9 # 6600 <_sk_callback_sse2+0x10d5>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,241,18,0,0 // mulps 0x12f1(%rip),%xmm9 # 65d0 <_sk_callback_sse2+0x10e0>
- .byte 68,15,88,13,249,18,0,0 // addps 0x12f9(%rip),%xmm9 # 65e0 <_sk_callback_sse2+0x10f0>
+ .byte 68,15,89,13,246,18,0,0 // mulps 0x12f6(%rip),%xmm9 # 6610 <_sk_callback_sse2+0x10e5>
+ .byte 68,15,88,13,254,18,0,0 // addps 0x12fe(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x10f5>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34667,16 +34822,16 @@ _sk_bicubic_n1x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,232,18,0,0 // addps 0x12e8(%rip),%xmm0 # 65f0 <_sk_callback_sse2+0x1100>
- .byte 68,15,40,13,240,18,0,0 // movaps 0x12f0(%rip),%xmm9 # 6600 <_sk_callback_sse2+0x1110>
+ .byte 15,88,5,237,18,0,0 // addps 0x12ed(%rip),%xmm0 # 6630 <_sk_callback_sse2+0x1105>
+ .byte 68,15,40,13,245,18,0,0 // movaps 0x12f5(%rip),%xmm9 # 6640 <_sk_callback_sse2+0x1115>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,244,18,0,0 // movaps 0x12f4(%rip),%xmm8 # 6610 <_sk_callback_sse2+0x1120>
+ .byte 68,15,40,5,249,18,0,0 // movaps 0x12f9(%rip),%xmm8 # 6650 <_sk_callback_sse2+0x1125>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,248,18,0,0 // addps 0x12f8(%rip),%xmm8 # 6620 <_sk_callback_sse2+0x1130>
+ .byte 68,15,88,5,253,18,0,0 // addps 0x12fd(%rip),%xmm8 # 6660 <_sk_callback_sse2+0x1135>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,252,18,0,0 // addps 0x12fc(%rip),%xmm8 # 6630 <_sk_callback_sse2+0x1140>
+ .byte 68,15,88,5,1,19,0,0 // addps 0x1301(%rip),%xmm8 # 6670 <_sk_callback_sse2+0x1145>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,0,19,0,0 // addps 0x1300(%rip),%xmm8 # 6640 <_sk_callback_sse2+0x1150>
+ .byte 68,15,88,5,5,19,0,0 // addps 0x1305(%rip),%xmm8 # 6680 <_sk_callback_sse2+0x1155>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34686,17 +34841,17 @@ HIDDEN _sk_bicubic_p1x_sse2
FUNCTION(_sk_bicubic_p1x_sse2)
_sk_bicubic_p1x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,250,18,0,0 // movaps 0x12fa(%rip),%xmm8 # 6650 <_sk_callback_sse2+0x1160>
+ .byte 68,15,40,5,255,18,0,0 // movaps 0x12ff(%rip),%xmm8 # 6690 <_sk_callback_sse2+0x1165>
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,21,246,18,0,0 // movaps 0x12f6(%rip),%xmm10 # 6660 <_sk_callback_sse2+0x1170>
+ .byte 68,15,40,21,251,18,0,0 // movaps 0x12fb(%rip),%xmm10 # 66a0 <_sk_callback_sse2+0x1175>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,250,18,0,0 // addps 0x12fa(%rip),%xmm10 # 6670 <_sk_callback_sse2+0x1180>
+ .byte 68,15,88,21,255,18,0,0 // addps 0x12ff(%rip),%xmm10 # 66b0 <_sk_callback_sse2+0x1185>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,246,18,0,0 // addps 0x12f6(%rip),%xmm10 # 6680 <_sk_callback_sse2+0x1190>
+ .byte 68,15,88,21,251,18,0,0 // addps 0x12fb(%rip),%xmm10 # 66c0 <_sk_callback_sse2+0x1195>
.byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34708,11 +34863,11 @@ _sk_bicubic_p3x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,233,18,0,0 // addps 0x12e9(%rip),%xmm0 # 6690 <_sk_callback_sse2+0x11a0>
+ .byte 15,88,5,238,18,0,0 // addps 0x12ee(%rip),%xmm0 # 66d0 <_sk_callback_sse2+0x11a5>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,233,18,0,0 // mulps 0x12e9(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x11b0>
- .byte 68,15,88,5,241,18,0,0 // addps 0x12f1(%rip),%xmm8 # 66b0 <_sk_callback_sse2+0x11c0>
+ .byte 68,15,89,5,238,18,0,0 // mulps 0x12ee(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x11b5>
+ .byte 68,15,88,5,246,18,0,0 // addps 0x12f6(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x11c5>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34725,13 +34880,13 @@ _sk_bicubic_n3y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,223,18,0,0 // addps 0x12df(%rip),%xmm1 # 66c0 <_sk_callback_sse2+0x11d0>
- .byte 68,15,40,13,231,18,0,0 // movaps 0x12e7(%rip),%xmm9 # 66d0 <_sk_callback_sse2+0x11e0>
+ .byte 15,88,13,228,18,0,0 // addps 0x12e4(%rip),%xmm1 # 6700 <_sk_callback_sse2+0x11d5>
+ .byte 68,15,40,13,236,18,0,0 // movaps 0x12ec(%rip),%xmm9 # 6710 <_sk_callback_sse2+0x11e5>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,227,18,0,0 // mulps 0x12e3(%rip),%xmm9 # 66e0 <_sk_callback_sse2+0x11f0>
- .byte 68,15,88,13,235,18,0,0 // addps 0x12eb(%rip),%xmm9 # 66f0 <_sk_callback_sse2+0x1200>
+ .byte 68,15,89,13,232,18,0,0 // mulps 0x12e8(%rip),%xmm9 # 6720 <_sk_callback_sse2+0x11f5>
+ .byte 68,15,88,13,240,18,0,0 // addps 0x12f0(%rip),%xmm9 # 6730 <_sk_callback_sse2+0x1205>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34744,16 +34899,16 @@ _sk_bicubic_n1y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,217,18,0,0 // addps 0x12d9(%rip),%xmm1 # 6700 <_sk_callback_sse2+0x1210>
- .byte 68,15,40,13,225,18,0,0 // movaps 0x12e1(%rip),%xmm9 # 6710 <_sk_callback_sse2+0x1220>
+ .byte 15,88,13,222,18,0,0 // addps 0x12de(%rip),%xmm1 # 6740 <_sk_callback_sse2+0x1215>
+ .byte 68,15,40,13,230,18,0,0 // movaps 0x12e6(%rip),%xmm9 # 6750 <_sk_callback_sse2+0x1225>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,229,18,0,0 // movaps 0x12e5(%rip),%xmm8 # 6720 <_sk_callback_sse2+0x1230>
+ .byte 68,15,40,5,234,18,0,0 // movaps 0x12ea(%rip),%xmm8 # 6760 <_sk_callback_sse2+0x1235>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,233,18,0,0 // addps 0x12e9(%rip),%xmm8 # 6730 <_sk_callback_sse2+0x1240>
+ .byte 68,15,88,5,238,18,0,0 // addps 0x12ee(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x1245>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,237,18,0,0 // addps 0x12ed(%rip),%xmm8 # 6740 <_sk_callback_sse2+0x1250>
+ .byte 68,15,88,5,242,18,0,0 // addps 0x12f2(%rip),%xmm8 # 6780 <_sk_callback_sse2+0x1255>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,241,18,0,0 // addps 0x12f1(%rip),%xmm8 # 6750 <_sk_callback_sse2+0x1260>
+ .byte 68,15,88,5,246,18,0,0 // addps 0x12f6(%rip),%xmm8 # 6790 <_sk_callback_sse2+0x1265>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34763,17 +34918,17 @@ HIDDEN _sk_bicubic_p1y_sse2
FUNCTION(_sk_bicubic_p1y_sse2)
_sk_bicubic_p1y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,235,18,0,0 // movaps 0x12eb(%rip),%xmm8 # 6760 <_sk_callback_sse2+0x1270>
+ .byte 68,15,40,5,240,18,0,0 // movaps 0x12f0(%rip),%xmm8 # 67a0 <_sk_callback_sse2+0x1275>
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 68,15,40,21,230,18,0,0 // movaps 0x12e6(%rip),%xmm10 # 6770 <_sk_callback_sse2+0x1280>
+ .byte 68,15,40,21,235,18,0,0 // movaps 0x12eb(%rip),%xmm10 # 67b0 <_sk_callback_sse2+0x1285>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,234,18,0,0 // addps 0x12ea(%rip),%xmm10 # 6780 <_sk_callback_sse2+0x1290>
+ .byte 68,15,88,21,239,18,0,0 // addps 0x12ef(%rip),%xmm10 # 67c0 <_sk_callback_sse2+0x1295>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,230,18,0,0 // addps 0x12e6(%rip),%xmm10 # 6790 <_sk_callback_sse2+0x12a0>
+ .byte 68,15,88,21,235,18,0,0 // addps 0x12eb(%rip),%xmm10 # 67d0 <_sk_callback_sse2+0x12a5>
.byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -34785,11 +34940,11 @@ _sk_bicubic_p3y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,216,18,0,0 // addps 0x12d8(%rip),%xmm1 # 67a0 <_sk_callback_sse2+0x12b0>
+ .byte 15,88,13,221,18,0,0 // addps 0x12dd(%rip),%xmm1 # 67e0 <_sk_callback_sse2+0x12b5>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,216,18,0,0 // mulps 0x12d8(%rip),%xmm8 # 67b0 <_sk_callback_sse2+0x12c0>
- .byte 68,15,88,5,224,18,0,0 // addps 0x12e0(%rip),%xmm8 # 67c0 <_sk_callback_sse2+0x12d0>
+ .byte 68,15,89,5,221,18,0,0 // mulps 0x12dd(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x12c5>
+ .byte 68,15,88,5,229,18,0,0 // addps 0x12e5(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x12d5>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -34799,22 +34954,24 @@ HIDDEN _sk_callback_sse2
.globl _sk_callback_sse2
FUNCTION(_sk_callback_sse2)
_sk_callback_sse2:
+ .byte 85 // push %rbp
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 65,85 // push %r13
.byte 65,84 // push %r12
.byte 83 // push %rbx
- .byte 72,131,236,64 // sub $0x40,%rsp
+ .byte 72,131,236,72 // sub $0x48,%rsp
.byte 15,41,124,36,48 // movaps %xmm7,0x30(%rsp)
.byte 15,41,116,36,32 // movaps %xmm6,0x20(%rsp)
.byte 15,41,108,36,16 // movaps %xmm5,0x10(%rsp)
.byte 15,41,36,36 // movaps %xmm4,(%rsp)
- .byte 73,137,205 // mov %rcx,%r13
- .byte 73,137,214 // mov %rdx,%r14
- .byte 73,137,255 // mov %rdi,%r15
+ .byte 76,137,195 // mov %r8,%rbx
+ .byte 73,137,206 // mov %rcx,%r14
+ .byte 73,137,215 // mov %rdx,%r15
+ .byte 73,137,252 // mov %rdi,%r12
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,137,195 // mov %rax,%rbx
- .byte 73,137,244 // mov %rsi,%r12
+ .byte 72,137,197 // mov %rax,%rbp
+ .byte 73,137,245 // mov %rsi,%r13
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 15,20,225 // unpcklps %xmm1,%xmm4
.byte 15,40,234 // movaps %xmm2,%xmm5
@@ -34826,17 +34983,17 @@ _sk_callback_sse2:
.byte 15,18,236 // movhlps %xmm4,%xmm5
.byte 15,40,216 // movaps %xmm0,%xmm3
.byte 102,15,20,218 // unpcklpd %xmm2,%xmm3
- .byte 102,15,17,75,8 // movupd %xmm1,0x8(%rbx)
+ .byte 102,15,17,77,8 // movupd %xmm1,0x8(%rbp)
.byte 15,18,208 // movhlps %xmm0,%xmm2
- .byte 15,17,107,24 // movups %xmm5,0x18(%rbx)
- .byte 102,15,17,91,40 // movupd %xmm3,0x28(%rbx)
- .byte 15,17,83,56 // movups %xmm2,0x38(%rbx)
- .byte 77,133,237 // test %r13,%r13
+ .byte 15,17,109,24 // movups %xmm5,0x18(%rbp)
+ .byte 102,15,17,93,40 // movupd %xmm3,0x28(%rbp)
+ .byte 15,17,85,56 // movups %xmm2,0x38(%rbp)
+ .byte 72,133,219 // test %rbx,%rbx
.byte 190,4,0,0,0 // mov $0x4,%esi
- .byte 65,15,69,245 // cmovne %r13d,%esi
- .byte 72,137,223 // mov %rbx,%rdi
- .byte 255,19 // callq *(%rbx)
- .byte 72,139,131,136,0,0,0 // mov 0x88(%rbx),%rax
+ .byte 15,69,243 // cmovne %ebx,%esi
+ .byte 72,137,239 // mov %rbp,%rdi
+ .byte 255,85,0 // callq *0x0(%rbp)
+ .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax
.byte 15,16,32 // movups (%rax),%xmm4
.byte 15,16,64,16 // movups 0x10(%rax),%xmm0
.byte 15,16,88,32 // movups 0x20(%rax),%xmm3
@@ -34853,21 +35010,23 @@ _sk_callback_sse2:
.byte 15,40,212 // movaps %xmm4,%xmm2
.byte 102,15,20,211 // unpcklpd %xmm3,%xmm2
.byte 15,18,220 // movhlps %xmm4,%xmm3
- .byte 76,137,230 // mov %r12,%rsi
+ .byte 76,137,238 // mov %r13,%rsi
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,137,255 // mov %r15,%rdi
- .byte 76,137,242 // mov %r14,%rdx
- .byte 76,137,233 // mov %r13,%rcx
+ .byte 76,137,231 // mov %r12,%rdi
+ .byte 76,137,250 // mov %r15,%rdx
+ .byte 76,137,241 // mov %r14,%rcx
+ .byte 73,137,216 // mov %rbx,%r8
.byte 15,40,36,36 // movaps (%rsp),%xmm4
.byte 15,40,108,36,16 // movaps 0x10(%rsp),%xmm5
.byte 15,40,116,36,32 // movaps 0x20(%rsp),%xmm6
.byte 15,40,124,36,48 // movaps 0x30(%rsp),%xmm7
- .byte 72,131,196,64 // add $0x40,%rsp
+ .byte 72,131,196,72 // add $0x48,%rsp
.byte 91 // pop %rbx
.byte 65,92 // pop %r12
.byte 65,93 // pop %r13
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
+ .byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
BALIGN16
@@ -35014,11 +35173,11 @@ BALIGN16
.byte 128,191,0,0,128,191,0 // cmpb $0x0,-0x40800000(%rdi)
.byte 0,224 // add %ah,%al
.byte 64,0,0 // add %al,(%rax)
- .byte 224,64 // loopne 57b8 <.literal16+0x1d8>
+ .byte 224,64 // loopne 57f8 <.literal16+0x1d8>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 57bc <.literal16+0x1dc>
+ .byte 224,64 // loopne 57fc <.literal16+0x1dc>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 57c0 <.literal16+0x1e0>
+ .byte 224,64 // loopne 5800 <.literal16+0x1e0>
.byte 154 // (bad)
.byte 153 // cltd
.byte 153 // cltd
@@ -35038,13 +35197,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 57e1 <.literal16+0x201>
+ .byte 71,225,61 // rex.RXB loope 5821 <.literal16+0x201>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 57e5 <.literal16+0x205>
+ .byte 71,225,61 // rex.RXB loope 5825 <.literal16+0x205>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 57e9 <.literal16+0x209>
+ .byte 71,225,61 // rex.RXB loope 5829 <.literal16+0x209>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 57ed <.literal16+0x20d>
+ .byte 71,225,61 // rex.RXB loope 582d <.literal16+0x20d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -35069,13 +35228,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5821 <.literal16+0x241>
+ .byte 71,225,61 // rex.RXB loope 5861 <.literal16+0x241>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5825 <.literal16+0x245>
+ .byte 71,225,61 // rex.RXB loope 5865 <.literal16+0x245>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5829 <.literal16+0x249>
+ .byte 71,225,61 // rex.RXB loope 5869 <.literal16+0x249>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 582d <.literal16+0x24d>
+ .byte 71,225,61 // rex.RXB loope 586d <.literal16+0x24d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -35100,13 +35259,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5861 <.literal16+0x281>
+ .byte 71,225,61 // rex.RXB loope 58a1 <.literal16+0x281>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5865 <.literal16+0x285>
+ .byte 71,225,61 // rex.RXB loope 58a5 <.literal16+0x285>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5869 <.literal16+0x289>
+ .byte 71,225,61 // rex.RXB loope 58a9 <.literal16+0x289>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 586d <.literal16+0x28d>
+ .byte 71,225,61 // rex.RXB loope 58ad <.literal16+0x28d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -35131,13 +35290,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 58a1 <.literal16+0x2c1>
+ .byte 71,225,61 // rex.RXB loope 58e1 <.literal16+0x2c1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 58a5 <.literal16+0x2c5>
+ .byte 71,225,61 // rex.RXB loope 58e5 <.literal16+0x2c5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 58a9 <.literal16+0x2c9>
+ .byte 71,225,61 // rex.RXB loope 58e9 <.literal16+0x2c9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 58ad <.literal16+0x2cd>
+ .byte 71,225,61 // rex.RXB loope 58ed <.literal16+0x2cd>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -35158,11 +35317,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
.byte 67,0,0 // rex.XB add %al,(%r8)
- .byte 127,67 // jg 58eb <.literal16+0x30b>
+ .byte 127,67 // jg 592b <.literal16+0x30b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 58ef <.literal16+0x30f>
+ .byte 127,67 // jg 592f <.literal16+0x30f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 58f3 <.literal16+0x313>
+ .byte 127,67 // jg 5933 <.literal16+0x313>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -35402,13 +35561,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5ad9 <.literal16+0x4f9>
+ .byte 224,7 // loopne 5b19 <.literal16+0x4f9>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5add <.literal16+0x4fd>
+ .byte 224,7 // loopne 5b1d <.literal16+0x4fd>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5ae1 <.literal16+0x501>
+ .byte 224,7 // loopne 5b21 <.literal16+0x501>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 5ae5 <.literal16+0x505>
+ .byte 224,7 // loopne 5b25 <.literal16+0x505>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -35473,11 +35632,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5bbb <.literal16+0x5db>
+ .byte 127,67 // jg 5bfb <.literal16+0x5db>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5bbf <.literal16+0x5df>
+ .byte 127,67 // jg 5bff <.literal16+0x5df>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5bc3 <.literal16+0x5e3>
+ .byte 127,67 // jg 5c03 <.literal16+0x5e3>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%rax)
@@ -35492,16 +35651,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5bb4 <.literal16+0x5d4>
+ .byte 127,0 // jg 5bf4 <.literal16+0x5d4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5bb8 <.literal16+0x5d8>
+ .byte 127,0 // jg 5bf8 <.literal16+0x5d8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5bbc <.literal16+0x5dc>
+ .byte 127,0 // jg 5bfc <.literal16+0x5dc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5bc0 <.literal16+0x5e0>
+ .byte 127,0 // jg 5c00 <.literal16+0x5e0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -35510,7 +35669,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5c45 <.literal16+0x665>
+ .byte 119,115 // ja 5c85 <.literal16+0x665>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -35521,7 +35680,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5ba9 <.literal16+0x5c9>
+ .byte 117,191 // jne 5be9 <.literal16+0x5c9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -35533,7 +35692,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a39bea <_sk_callback_sse2+0xffffffffe9a346fa>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a39c2a <_sk_callback_sse2+0xffffffffe9a346ff>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -35587,16 +35746,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5c84 <.literal16+0x6a4>
+ .byte 127,0 // jg 5cc4 <.literal16+0x6a4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5c88 <.literal16+0x6a8>
+ .byte 127,0 // jg 5cc8 <.literal16+0x6a8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5c8c <.literal16+0x6ac>
+ .byte 127,0 // jg 5ccc <.literal16+0x6ac>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5c90 <.literal16+0x6b0>
+ .byte 127,0 // jg 5cd0 <.literal16+0x6b0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -35605,7 +35764,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5d15 <.literal16+0x735>
+ .byte 119,115 // ja 5d55 <.literal16+0x735>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -35616,7 +35775,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5c79 <.literal16+0x699>
+ .byte 117,191 // jne 5cb9 <.literal16+0x699>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -35628,7 +35787,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a39cba <_sk_callback_sse2+0xffffffffe9a347ca>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a39cfa <_sk_callback_sse2+0xffffffffe9a347cf>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -35682,16 +35841,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5d54 <.literal16+0x774>
+ .byte 127,0 // jg 5d94 <.literal16+0x774>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5d58 <.literal16+0x778>
+ .byte 127,0 // jg 5d98 <.literal16+0x778>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5d5c <.literal16+0x77c>
+ .byte 127,0 // jg 5d9c <.literal16+0x77c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5d60 <.literal16+0x780>
+ .byte 127,0 // jg 5da0 <.literal16+0x780>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -35700,7 +35859,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5de5 <.literal16+0x805>
+ .byte 119,115 // ja 5e25 <.literal16+0x805>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -35711,7 +35870,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5d49 <.literal16+0x769>
+ .byte 117,191 // jne 5d89 <.literal16+0x769>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -35723,7 +35882,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a39d8a <_sk_callback_sse2+0xffffffffe9a3489a>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a39dca <_sk_callback_sse2+0xffffffffe9a3489f>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -35777,16 +35936,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5e24 <.literal16+0x844>
+ .byte 127,0 // jg 5e64 <.literal16+0x844>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5e28 <.literal16+0x848>
+ .byte 127,0 // jg 5e68 <.literal16+0x848>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5e2c <.literal16+0x84c>
+ .byte 127,0 // jg 5e6c <.literal16+0x84c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 5e30 <.literal16+0x850>
+ .byte 127,0 // jg 5e70 <.literal16+0x850>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -35795,7 +35954,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5eb5 <.literal16+0x8d5>
+ .byte 119,115 // ja 5ef5 <.literal16+0x8d5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -35806,7 +35965,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 5e19 <.literal16+0x839>
+ .byte 117,191 // jne 5e59 <.literal16+0x839>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -35818,7 +35977,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a39e5a <_sk_callback_sse2+0xffffffffe9a3496a>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a39e9a <_sk_callback_sse2+0xffffffffe9a3496f>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -35868,13 +36027,13 @@ BALIGN16
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
- .byte 127,67 // jg 5f37 <.literal16+0x957>
+ .byte 127,67 // jg 5f77 <.literal16+0x957>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5f3b <.literal16+0x95b>
+ .byte 127,67 // jg 5f7b <.literal16+0x95b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5f3f <.literal16+0x95f>
+ .byte 127,67 // jg 5f7f <.literal16+0x95f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5f43 <.literal16+0x963>
+ .byte 127,67 // jg 5f83 <.literal16+0x963>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -35921,16 +36080,16 @@ BALIGN16
.byte 128,3,62 // addb $0x3e,(%rbx)
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5fc3 <.literal16+0x9e3>
+ .byte 118,63 // jbe 6003 <.literal16+0x9e3>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5fc7 <.literal16+0x9e7>
+ .byte 118,63 // jbe 6007 <.literal16+0x9e7>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5fcb <.literal16+0x9eb>
+ .byte 118,63 // jbe 600b <.literal16+0x9eb>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5fcf <.literal16+0x9ef>
+ .byte 118,63 // jbe 600f <.literal16+0x9ef>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
@@ -35950,11 +36109,11 @@ BALIGN16
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 601b <.literal16+0xa3b>
+ .byte 127,67 // jg 605b <.literal16+0xa3b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 601f <.literal16+0xa3f>
+ .byte 127,67 // jg 605f <.literal16+0xa3f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6023 <.literal16+0xa43>
+ .byte 127,67 // jg 6063 <.literal16+0xa43>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -36002,13 +36161,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6079 <.literal16+0xa99>
+ .byte 224,7 // loopne 60b9 <.literal16+0xa99>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 607d <.literal16+0xa9d>
+ .byte 224,7 // loopne 60bd <.literal16+0xa9d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6081 <.literal16+0xaa1>
+ .byte 224,7 // loopne 60c1 <.literal16+0xaa1>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6085 <.literal16+0xaa5>
+ .byte 224,7 // loopne 60c5 <.literal16+0xaa5>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -36054,13 +36213,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 60e9 <.literal16+0xb09>
+ .byte 224,7 // loopne 6129 <.literal16+0xb09>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 60ed <.literal16+0xb0d>
+ .byte 224,7 // loopne 612d <.literal16+0xb0d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 60f1 <.literal16+0xb11>
+ .byte 224,7 // loopne 6131 <.literal16+0xb11>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 60f5 <.literal16+0xb15>
+ .byte 224,7 // loopne 6135 <.literal16+0xb15>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -36098,13 +36257,13 @@ BALIGN16
.byte 65,0,0 // add %al,(%r8)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 6186 <.literal16+0xba6>
+ .byte 124,66 // jl 61c6 <.literal16+0xba6>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 618a <.literal16+0xbaa>
+ .byte 124,66 // jl 61ca <.literal16+0xbaa>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 618e <.literal16+0xbae>
+ .byte 124,66 // jl 61ce <.literal16+0xbae>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6192 <.literal16+0xbb2>
+ .byte 124,66 // jl 61d2 <.literal16+0xbb2>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,240 // add %dh,%al
@@ -36194,13 +36353,13 @@ BALIGN16
.byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%rax)
.byte 61,137,136,136,61 // cmp $0x3d888889,%eax
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6295 <.literal16+0xcb5>
+ .byte 112,65 // jo 62d5 <.literal16+0xcb5>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6299 <.literal16+0xcb9>
+ .byte 112,65 // jo 62d9 <.literal16+0xcb9>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 629d <.literal16+0xcbd>
+ .byte 112,65 // jo 62dd <.literal16+0xcbd>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 62a1 <.literal16+0xcc1>
+ .byte 112,65 // jo 62e1 <.literal16+0xcc1>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -36222,11 +36381,11 @@ BALIGN16
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%rax)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 62eb <.literal16+0xd0b>
+ .byte 127,67 // jg 632b <.literal16+0xd0b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 62ef <.literal16+0xd0f>
+ .byte 127,67 // jg 632f <.literal16+0xd0f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 62f3 <.literal16+0xd13>
+ .byte 127,67 // jg 6333 <.literal16+0xd13>
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
.byte 0,0 // add %al,(%rax)
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
@@ -36302,13 +36461,13 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 63db <.literal16+0xdfb>
+ .byte 127,71 // jg 641b <.literal16+0xdfb>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 63df <.literal16+0xdff>
+ .byte 127,71 // jg 641f <.literal16+0xdff>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 63e3 <.literal16+0xe03>
+ .byte 127,71 // jg 6423 <.literal16+0xe03>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 63e7 <.literal16+0xe07>
+ .byte 127,71 // jg 6427 <.literal16+0xe07>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -36385,10 +36544,10 @@ BALIGN16
.byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax
.byte 152 // cwtl
.byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx)
- .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0757a <_sk_callback_sse2+0x2dc0208a>
+ .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc075ba <_sk_callback_sse2+0x2dc0208f>
.byte 17,192 // adc %eax,%eax
.byte 45,16,17,192,18 // sub $0x12c01110,%eax
- .byte 120,57 // js 64ac <.literal16+0xecc>
+ .byte 120,57 // js 64ec <.literal16+0xecc>
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
@@ -36516,11 +36675,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 65f2 <.literal16+0x1012>
+ .byte 62,114,28 // jb,pt 6632 <.literal16+0x1012>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 65f6 <.literal16+0x1016>
+ .byte 62,114,28 // jb,pt 6636 <.literal16+0x1016>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 65fa <.literal16+0x101a>
+ .byte 62,114,28 // jb,pt 663a <.literal16+0x101a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -36564,7 +36723,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f485 <_sk_callback_sse2+0x3d639f95>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f4c5 <_sk_callback_sse2+0x3d639f9a>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -36590,7 +36749,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f4c5 <_sk_callback_sse2+0x3d639fd5>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f505 <_sk_callback_sse2+0x3d639fda>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -36599,13 +36758,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 66be <.literal16+0x10de>
+ .byte 114,28 // jb 66fe <.literal16+0x10de>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 66c2 <.literal16+0x10e2>
+ .byte 62,114,28 // jb,pt 6702 <.literal16+0x10e2>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 66c6 <.literal16+0x10e6>
+ .byte 62,114,28 // jb,pt 6706 <.literal16+0x10e6>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 66ca <.literal16+0x10ea>
+ .byte 62,114,28 // jb,pt 670a <.literal16+0x10ea>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -36626,11 +36785,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 6702 <.literal16+0x1122>
+ .byte 62,114,28 // jb,pt 6742 <.literal16+0x1122>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 6706 <.literal16+0x1126>
+ .byte 62,114,28 // jb,pt 6746 <.literal16+0x1126>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 670a <.literal16+0x112a>
+ .byte 62,114,28 // jb,pt 674a <.literal16+0x112a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -36674,7 +36833,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f595 <_sk_callback_sse2+0x3d63a0a5>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f5d5 <_sk_callback_sse2+0x3d63a0aa>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -36700,7 +36859,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f5d5 <_sk_callback_sse2+0x3d63a0e5>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f615 <_sk_callback_sse2+0x3d63a0ea>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -36709,13 +36868,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 67ce <.literal16+0x11ee>
+ .byte 114,28 // jb 680e <.literal16+0x11ee>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 67d2 <_sk_callback_sse2+0x12e2>
+ .byte 62,114,28 // jb,pt 6812 <_sk_callback_sse2+0x12e7>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 67d6 <_sk_callback_sse2+0x12e6>
+ .byte 62,114,28 // jb,pt 6816 <_sk_callback_sse2+0x12eb>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 67da <_sk_callback_sse2+0x12ea>
+ .byte 62,114,28 // jb,pt 681a <_sk_callback_sse2+0x12ef>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
diff --git a/src/jumper/SkJumper_generated_win.S b/src/jumper/SkJumper_generated_win.S
index 0543822f9e..33d209ea38 100644
--- a/src/jumper/SkJumper_generated_win.S
+++ b/src/jumper/SkJumper_generated_win.S
@@ -18,8 +18,9 @@ _sk_start_pipeline_hsw LABEL PROC
DB 65,84 ; push %r12
DB 86 ; push %rsi
DB 87 ; push %rdi
+ DB 85 ; push %rbp
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp
DB 197,120,41,188,36,144,0,0,0 ; vmovaps %xmm15,0x90(%rsp)
DB 197,120,41,180,36,128,0,0,0 ; vmovaps %xmm14,0x80(%rsp)
DB 197,120,41,108,36,112 ; vmovaps %xmm13,0x70(%rsp)
@@ -30,19 +31,20 @@ _sk_start_pipeline_hsw LABEL PROC
DB 197,120,41,68,36,32 ; vmovaps %xmm8,0x20(%rsp)
DB 197,248,41,124,36,16 ; vmovaps %xmm7,0x10(%rsp)
DB 197,248,41,52,36 ; vmovaps %xmm6,(%rsp)
- DB 77,137,205 ; mov %r9,%r13
- DB 77,137,198 ; mov %r8,%r14
- DB 72,137,203 ; mov %rcx,%rbx
- DB 72,137,214 ; mov %rdx,%rsi
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,199 ; mov %rax,%r15
- DB 73,137,244 ; mov %rsi,%r12
- DB 72,141,67,8 ; lea 0x8(%rbx),%rax
- DB 76,57,232 ; cmp %r13,%rax
- DB 118,5 ; jbe 75 <_sk_start_pipeline_hsw+0x75>
- DB 72,137,223 ; mov %rbx,%rdi
- DB 235,65 ; jmp b6 <_sk_start_pipeline_hsw+0xb6>
- DB 185,0,0,0,0 ; mov $0x0,%ecx
+ DB 76,137,195 ; mov %r8,%rbx
+ DB 73,137,214 ; mov %rdx,%r14
+ DB 72,137,205 ; mov %rcx,%rbp
+ DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15
+ DB 76,137,206 ; mov %r9,%rsi
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 73,137,196 ; mov %rax,%r12
+ DB 73,137,245 ; mov %rsi,%r13
+ DB 72,141,69,8 ; lea 0x8(%rbp),%rax
+ DB 72,57,216 ; cmp %rbx,%rax
+ DB 118,5 ; jbe 7e <_sk_start_pipeline_hsw+0x7e>
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 235,69 ; jmp c3 <_sk_start_pipeline_hsw+0xc3>
+ DB 65,184,0,0,0,0 ; mov $0x0,%r8d
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -51,17 +53,18 @@ _sk_start_pipeline_hsw LABEL PROC
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6
DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7
- DB 72,137,223 ; mov %rbx,%rdi
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 65,255,215 ; callq *%r15
- DB 72,141,123,8 ; lea 0x8(%rbx),%rdi
- DB 72,131,195,16 ; add $0x10,%rbx
- DB 76,57,235 ; cmp %r13,%rbx
- DB 72,137,251 ; mov %rdi,%rbx
- DB 118,191 ; jbe 75 <_sk_start_pipeline_hsw+0x75>
- DB 73,41,253 ; sub %rdi,%r13
- DB 116,44 ; je e7 <_sk_start_pipeline_hsw+0xe7>
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 65,255,212 ; callq *%r12
+ DB 72,141,85,8 ; lea 0x8(%rbp),%rdx
+ DB 72,131,197,16 ; add $0x10,%rbp
+ DB 72,57,221 ; cmp %rbx,%rbp
+ DB 72,137,213 ; mov %rdx,%rbp
+ DB 118,187 ; jbe 7e <_sk_start_pipeline_hsw+0x7e>
+ DB 72,41,211 ; sub %rdx,%rbx
+ DB 116,47 ; je f7 <_sk_start_pipeline_hsw+0xf7>
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -70,10 +73,11 @@ _sk_start_pipeline_hsw LABEL PROC
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6
DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,233 ; mov %r13,%rcx
- DB 65,255,215 ; callq *%r15
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 73,137,216 ; mov %rbx,%r8
+ DB 65,255,212 ; callq *%r12
DB 197,248,40,52,36 ; vmovaps (%rsp),%xmm6
DB 197,248,40,124,36,16 ; vmovaps 0x10(%rsp),%xmm7
DB 197,120,40,68,36,32 ; vmovaps 0x20(%rsp),%xmm8
@@ -84,8 +88,9 @@ _sk_start_pipeline_hsw LABEL PROC
DB 197,120,40,108,36,112 ; vmovaps 0x70(%rsp),%xmm13
DB 197,120,40,180,36,128,0,0,0 ; vmovaps 0x80(%rsp),%xmm14
DB 197,120,40,188,36,144,0,0,0 ; vmovaps 0x90(%rsp),%xmm15
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp
DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 95 ; pop %rdi
DB 94 ; pop %rsi
DB 65,92 ; pop %r12
@@ -101,18 +106,18 @@ _sk_just_return_hsw LABEL PROC
PUBLIC _sk_seed_shader_hsw
_sk_seed_shader_hsw LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 197,249,110,199 ; vmovd %edi,%xmm0
+ DB 197,249,110,194 ; vmovd %edx,%xmm0
DB 196,226,125,88,192 ; vpbroadcastd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,61,73,0,0 ; vbroadcastss 0x493d(%rip),%ymm1 # 4a94 <_sk_callback_hsw+0x11a>
+ DB 196,226,125,24,13,42,73,0,0 ; vbroadcastss 0x492a(%rip),%ymm1 # 4a90 <_sk_callback_hsw+0x124>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
- DB 197,252,88,2 ; vaddps (%rdx),%ymm0,%ymm0
- DB 196,226,125,24,16 ; vbroadcastss (%rax),%ymm2
+ DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0
+ DB 197,249,110,209 ; vmovd %ecx,%xmm2
+ DB 196,226,125,88,210 ; vpbroadcastd %xmm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,21,33,73,0,0 ; vbroadcastss 0x4921(%rip),%ymm2 # 4a98 <_sk_callback_hsw+0x11e>
+ DB 196,226,125,24,21,10,73,0,0 ; vbroadcastss 0x490a(%rip),%ymm2 # 4a94 <_sk_callback_hsw+0x128>
DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
@@ -123,19 +128,19 @@ _sk_seed_shader_hsw LABEL PROC
PUBLIC _sk_dither_hsw
_sk_dither_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 197,121,110,199 ; vmovd %edi,%xmm8
+ DB 197,121,110,194 ; vmovd %edx,%xmm8
DB 196,66,125,88,192 ; vpbroadcastd %xmm8,%ymm8
- DB 197,61,254,66,32 ; vpaddd 0x20(%rdx),%ymm8,%ymm8
- DB 76,139,0 ; mov (%rax),%r8
- DB 196,66,125,88,8 ; vpbroadcastd (%r8),%ymm9
- DB 196,65,61,239,201 ; vpxor %ymm9,%ymm8,%ymm9
- DB 196,98,125,88,21,233,72,0,0 ; vpbroadcastd 0x48e9(%rip),%ymm10 # 4a9c <_sk_callback_hsw+0x122>
+ DB 197,61,254,71,32 ; vpaddd 0x20(%rdi),%ymm8,%ymm8
+ DB 197,121,110,201 ; vmovd %ecx,%xmm9
+ DB 196,66,125,88,201 ; vpbroadcastd %xmm9,%ymm9
+ DB 196,65,53,239,200 ; vpxor %ymm8,%ymm9,%ymm9
+ DB 196,98,125,88,21,209,72,0,0 ; vpbroadcastd 0x48d1(%rip),%ymm10 # 4a98 <_sk_callback_hsw+0x12c>
DB 196,65,53,219,218 ; vpand %ymm10,%ymm9,%ymm11
DB 196,193,37,114,243,5 ; vpslld $0x5,%ymm11,%ymm11
DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10
DB 196,193,45,114,242,4 ; vpslld $0x4,%ymm10,%ymm10
- DB 196,98,125,88,37,206,72,0,0 ; vpbroadcastd 0x48ce(%rip),%ymm12 # 4aa0 <_sk_callback_hsw+0x126>
- DB 196,98,125,88,45,201,72,0,0 ; vpbroadcastd 0x48c9(%rip),%ymm13 # 4aa4 <_sk_callback_hsw+0x12a>
+ DB 196,98,125,88,37,182,72,0,0 ; vpbroadcastd 0x48b6(%rip),%ymm12 # 4a9c <_sk_callback_hsw+0x130>
+ DB 196,98,125,88,45,177,72,0,0 ; vpbroadcastd 0x48b1(%rip),%ymm13 # 4aa0 <_sk_callback_hsw+0x134>
DB 196,65,53,219,245 ; vpand %ymm13,%ymm9,%ymm14
DB 196,193,13,114,246,2 ; vpslld $0x2,%ymm14,%ymm14
DB 196,65,61,219,237 ; vpand %ymm13,%ymm8,%ymm13
@@ -146,14 +151,14 @@ _sk_dither_hsw LABEL PROC
DB 196,193,61,114,208,2 ; vpsrld $0x2,%ymm8,%ymm8
DB 196,65,21,235,210 ; vpor %ymm10,%ymm13,%ymm10
DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8
- DB 196,65,61,235,195 ; vpor %ymm11,%ymm8,%ymm8
- DB 196,65,13,235,201 ; vpor %ymm9,%ymm14,%ymm9
+ DB 196,65,37,235,214 ; vpor %ymm14,%ymm11,%ymm10
+ DB 196,65,61,235,194 ; vpor %ymm10,%ymm8,%ymm8
DB 196,65,61,235,193 ; vpor %ymm9,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,123,72,0,0 ; vbroadcastss 0x487b(%rip),%ymm9 # 4aa8 <_sk_callback_hsw+0x12e>
- DB 196,98,125,24,21,118,72,0,0 ; vbroadcastss 0x4876(%rip),%ymm10 # 4aac <_sk_callback_hsw+0x132>
+ DB 196,98,125,24,13,99,72,0,0 ; vbroadcastss 0x4863(%rip),%ymm9 # 4aa4 <_sk_callback_hsw+0x138>
+ DB 196,98,125,24,21,94,72,0,0 ; vbroadcastss 0x485e(%rip),%ymm10 # 4aa8 <_sk_callback_hsw+0x13c>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,64,8 ; vbroadcastss 0x8(%rax),%ymm8
+ DB 196,98,125,24,0 ; vbroadcastss (%rax),%ymm8
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
DB 197,188,88,192 ; vaddps %ymm0,%ymm8,%ymm0
DB 197,188,88,201 ; vaddps %ymm1,%ymm8,%ymm1
@@ -210,7 +215,7 @@ _sk_clear_hsw LABEL PROC
PUBLIC _sk_srcatop_hsw
_sk_srcatop_hsw LABEL PROC
DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0
- DB 196,98,125,24,5,205,71,0,0 ; vbroadcastss 0x47cd(%rip),%ymm8 # 4ab0 <_sk_callback_hsw+0x136>
+ DB 196,98,125,24,5,182,71,0,0 ; vbroadcastss 0x47b6(%rip),%ymm8 # 4aac <_sk_callback_hsw+0x140>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,226,61,184,196 ; vfmadd231ps %ymm4,%ymm8,%ymm0
DB 197,244,89,207 ; vmulps %ymm7,%ymm1,%ymm1
@@ -224,7 +229,7 @@ _sk_srcatop_hsw LABEL PROC
PUBLIC _sk_dstatop_hsw
_sk_dstatop_hsw LABEL PROC
- DB 196,98,125,24,5,160,71,0,0 ; vbroadcastss 0x47a0(%rip),%ymm8 # 4ab4 <_sk_callback_hsw+0x13a>
+ DB 196,98,125,24,5,137,71,0,0 ; vbroadcastss 0x4789(%rip),%ymm8 # 4ab0 <_sk_callback_hsw+0x144>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,226,101,184,196 ; vfmadd231ps %ymm4,%ymm3,%ymm0
@@ -257,7 +262,7 @@ _sk_dstin_hsw LABEL PROC
PUBLIC _sk_srcout_hsw
_sk_srcout_hsw LABEL PROC
- DB 196,98,125,24,5,71,71,0,0 ; vbroadcastss 0x4747(%rip),%ymm8 # 4ab8 <_sk_callback_hsw+0x13e>
+ DB 196,98,125,24,5,48,71,0,0 ; vbroadcastss 0x4730(%rip),%ymm8 # 4ab4 <_sk_callback_hsw+0x148>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -268,7 +273,7 @@ _sk_srcout_hsw LABEL PROC
PUBLIC _sk_dstout_hsw
_sk_dstout_hsw LABEL PROC
- DB 196,226,125,24,5,42,71,0,0 ; vbroadcastss 0x472a(%rip),%ymm0 # 4abc <_sk_callback_hsw+0x142>
+ DB 196,226,125,24,5,19,71,0,0 ; vbroadcastss 0x4713(%rip),%ymm0 # 4ab8 <_sk_callback_hsw+0x14c>
DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3
DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0
DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1
@@ -279,7 +284,7 @@ _sk_dstout_hsw LABEL PROC
PUBLIC _sk_srcover_hsw
_sk_srcover_hsw LABEL PROC
- DB 196,98,125,24,5,13,71,0,0 ; vbroadcastss 0x470d(%rip),%ymm8 # 4ac0 <_sk_callback_hsw+0x146>
+ DB 196,98,125,24,5,246,70,0,0 ; vbroadcastss 0x46f6(%rip),%ymm8 # 4abc <_sk_callback_hsw+0x150>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0
DB 196,194,85,184,200 ; vfmadd231ps %ymm8,%ymm5,%ymm1
@@ -290,7 +295,7 @@ _sk_srcover_hsw LABEL PROC
PUBLIC _sk_dstover_hsw
_sk_dstover_hsw LABEL PROC
- DB 196,98,125,24,5,236,70,0,0 ; vbroadcastss 0x46ec(%rip),%ymm8 # 4ac4 <_sk_callback_hsw+0x14a>
+ DB 196,98,125,24,5,213,70,0,0 ; vbroadcastss 0x46d5(%rip),%ymm8 # 4ac0 <_sk_callback_hsw+0x154>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0
DB 196,226,61,168,205 ; vfmadd213ps %ymm5,%ymm8,%ymm1
@@ -310,7 +315,7 @@ _sk_modulate_hsw LABEL PROC
PUBLIC _sk_multiply_hsw
_sk_multiply_hsw LABEL PROC
- DB 196,98,125,24,5,183,70,0,0 ; vbroadcastss 0x46b7(%rip),%ymm8 # 4ac8 <_sk_callback_hsw+0x14e>
+ DB 196,98,125,24,5,160,70,0,0 ; vbroadcastss 0x46a0(%rip),%ymm8 # 4ac4 <_sk_callback_hsw+0x158>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -352,7 +357,7 @@ _sk_screen_hsw LABEL PROC
PUBLIC _sk_xor__hsw
_sk_xor__hsw LABEL PROC
- DB 196,98,125,24,5,50,70,0,0 ; vbroadcastss 0x4632(%rip),%ymm8 # 4acc <_sk_callback_hsw+0x152>
+ DB 196,98,125,24,5,27,70,0,0 ; vbroadcastss 0x461b(%rip),%ymm8 # 4ac8 <_sk_callback_hsw+0x15c>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -384,7 +389,7 @@ _sk_darken_hsw LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,186,69,0,0 ; vbroadcastss 0x45ba(%rip),%ymm8 # 4ad0 <_sk_callback_hsw+0x156>
+ DB 196,98,125,24,5,163,69,0,0 ; vbroadcastss 0x45a3(%rip),%ymm8 # 4acc <_sk_callback_hsw+0x160>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -407,7 +412,7 @@ _sk_lighten_hsw LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,105,69,0,0 ; vbroadcastss 0x4569(%rip),%ymm8 # 4ad4 <_sk_callback_hsw+0x15a>
+ DB 196,98,125,24,5,82,69,0,0 ; vbroadcastss 0x4552(%rip),%ymm8 # 4ad0 <_sk_callback_hsw+0x164>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -433,7 +438,7 @@ _sk_difference_hsw LABEL PROC
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,12,69,0,0 ; vbroadcastss 0x450c(%rip),%ymm8 # 4ad8 <_sk_callback_hsw+0x15e>
+ DB 196,98,125,24,5,245,68,0,0 ; vbroadcastss 0x44f5(%rip),%ymm8 # 4ad4 <_sk_callback_hsw+0x168>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -453,7 +458,7 @@ _sk_exclusion_hsw LABEL PROC
DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,202,68,0,0 ; vbroadcastss 0x44ca(%rip),%ymm8 # 4adc <_sk_callback_hsw+0x162>
+ DB 196,98,125,24,5,179,68,0,0 ; vbroadcastss 0x44b3(%rip),%ymm8 # 4ad8 <_sk_callback_hsw+0x16c>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -461,7 +466,7 @@ _sk_exclusion_hsw LABEL PROC
PUBLIC _sk_colorburn_hsw
_sk_colorburn_hsw LABEL PROC
- DB 196,98,125,24,5,184,68,0,0 ; vbroadcastss 0x44b8(%rip),%ymm8 # 4ae0 <_sk_callback_hsw+0x166>
+ DB 196,98,125,24,5,161,68,0,0 ; vbroadcastss 0x44a1(%rip),%ymm8 # 4adc <_sk_callback_hsw+0x170>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11
DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10
@@ -517,7 +522,7 @@ _sk_colorburn_hsw LABEL PROC
PUBLIC _sk_colordodge_hsw
_sk_colordodge_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,13,195,67,0,0 ; vbroadcastss 0x43c3(%rip),%ymm9 # 4ae4 <_sk_callback_hsw+0x16a>
+ DB 196,98,125,24,13,172,67,0,0 ; vbroadcastss 0x43ac(%rip),%ymm9 # 4ae0 <_sk_callback_hsw+0x174>
DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9
@@ -568,7 +573,7 @@ _sk_colordodge_hsw LABEL PROC
PUBLIC _sk_hardlight_hsw
_sk_hardlight_hsw LABEL PROC
- DB 196,98,125,24,5,228,66,0,0 ; vbroadcastss 0x42e4(%rip),%ymm8 # 4ae8 <_sk_callback_hsw+0x16e>
+ DB 196,98,125,24,5,205,66,0,0 ; vbroadcastss 0x42cd(%rip),%ymm8 # 4ae4 <_sk_callback_hsw+0x178>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -617,7 +622,7 @@ _sk_hardlight_hsw LABEL PROC
PUBLIC _sk_overlay_hsw
_sk_overlay_hsw LABEL PROC
- DB 196,98,125,24,5,28,66,0,0 ; vbroadcastss 0x421c(%rip),%ymm8 # 4aec <_sk_callback_hsw+0x172>
+ DB 196,98,125,24,5,5,66,0,0 ; vbroadcastss 0x4205(%rip),%ymm8 # 4ae8 <_sk_callback_hsw+0x17c>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -677,10 +682,10 @@ _sk_softlight_hsw LABEL PROC
DB 196,65,20,88,197 ; vaddps %ymm13,%ymm13,%ymm8
DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8
DB 196,66,61,168,192 ; vfmadd213ps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,29,35,65,0,0 ; vbroadcastss 0x4123(%rip),%ymm11 # 4af4 <_sk_callback_hsw+0x17a>
+ DB 196,98,125,24,29,12,65,0,0 ; vbroadcastss 0x410c(%rip),%ymm11 # 4af0 <_sk_callback_hsw+0x184>
DB 196,65,20,88,227 ; vaddps %ymm11,%ymm13,%ymm12
DB 196,65,28,89,192 ; vmulps %ymm8,%ymm12,%ymm8
- DB 196,98,125,24,37,20,65,0,0 ; vbroadcastss 0x4114(%rip),%ymm12 # 4af8 <_sk_callback_hsw+0x17e>
+ DB 196,98,125,24,37,253,64,0,0 ; vbroadcastss 0x40fd(%rip),%ymm12 # 4af4 <_sk_callback_hsw+0x188>
DB 196,66,21,184,196 ; vfmadd231ps %ymm12,%ymm13,%ymm8
DB 196,65,124,82,245 ; vrsqrtps %ymm13,%ymm14
DB 196,65,124,83,246 ; vrcpps %ymm14,%ymm14
@@ -690,7 +695,7 @@ _sk_softlight_hsw LABEL PROC
DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15
DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14
DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15
- DB 196,98,125,24,5,215,64,0,0 ; vbroadcastss 0x40d7(%rip),%ymm8 # 4af0 <_sk_callback_hsw+0x176>
+ DB 196,98,125,24,5,192,64,0,0 ; vbroadcastss 0x40c0(%rip),%ymm8 # 4aec <_sk_callback_hsw+0x180>
DB 196,65,60,92,237 ; vsubps %ymm13,%ymm8,%ymm13
DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0
DB 196,98,125,168,235 ; vfmadd213ps %ymm3,%ymm0,%ymm13
@@ -803,11 +808,11 @@ _sk_hue_hsw LABEL PROC
DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10
DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10
DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- DB 196,98,125,24,53,214,62,0,0 ; vbroadcastss 0x3ed6(%rip),%ymm14 # 4afc <_sk_callback_hsw+0x182>
- DB 196,98,125,24,61,209,62,0,0 ; vbroadcastss 0x3ed1(%rip),%ymm15 # 4b00 <_sk_callback_hsw+0x186>
+ DB 196,98,125,24,53,191,62,0,0 ; vbroadcastss 0x3ebf(%rip),%ymm14 # 4af8 <_sk_callback_hsw+0x18c>
+ DB 196,98,125,24,61,186,62,0,0 ; vbroadcastss 0x3eba(%rip),%ymm15 # 4afc <_sk_callback_hsw+0x190>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13
- DB 196,226,125,24,5,194,62,0,0 ; vbroadcastss 0x3ec2(%rip),%ymm0 # 4b04 <_sk_callback_hsw+0x18a>
+ DB 196,226,125,24,5,171,62,0,0 ; vbroadcastss 0x3eab(%rip),%ymm0 # 4b00 <_sk_callback_hsw+0x194>
DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13
DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10
DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -862,7 +867,7 @@ _sk_hue_hsw LABEL PROC
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9
DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8
- DB 196,226,125,24,13,175,61,0,0 ; vbroadcastss 0x3daf(%rip),%ymm1 # 4b08 <_sk_callback_hsw+0x18e>
+ DB 196,226,125,24,13,152,61,0,0 ; vbroadcastss 0x3d98(%rip),%ymm1 # 4b04 <_sk_callback_hsw+0x198>
DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11
@@ -916,11 +921,11 @@ _sk_saturation_hsw LABEL PROC
DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10
DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10
DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- DB 196,98,125,24,53,192,60,0,0 ; vbroadcastss 0x3cc0(%rip),%ymm14 # 4b0c <_sk_callback_hsw+0x192>
- DB 196,98,125,24,61,187,60,0,0 ; vbroadcastss 0x3cbb(%rip),%ymm15 # 4b10 <_sk_callback_hsw+0x196>
+ DB 196,98,125,24,53,169,60,0,0 ; vbroadcastss 0x3ca9(%rip),%ymm14 # 4b08 <_sk_callback_hsw+0x19c>
+ DB 196,98,125,24,61,164,60,0,0 ; vbroadcastss 0x3ca4(%rip),%ymm15 # 4b0c <_sk_callback_hsw+0x1a0>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13
- DB 196,226,125,24,5,172,60,0,0 ; vbroadcastss 0x3cac(%rip),%ymm0 # 4b14 <_sk_callback_hsw+0x19a>
+ DB 196,226,125,24,5,149,60,0,0 ; vbroadcastss 0x3c95(%rip),%ymm0 # 4b10 <_sk_callback_hsw+0x1a4>
DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13
DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10
DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -975,7 +980,7 @@ _sk_saturation_hsw LABEL PROC
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9
DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8
- DB 196,226,125,24,13,153,59,0,0 ; vbroadcastss 0x3b99(%rip),%ymm1 # 4b18 <_sk_callback_hsw+0x19e>
+ DB 196,226,125,24,13,130,59,0,0 ; vbroadcastss 0x3b82(%rip),%ymm1 # 4b14 <_sk_callback_hsw+0x1a8>
DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11
@@ -1003,11 +1008,11 @@ _sk_color_hsw LABEL PROC
DB 197,108,89,199 ; vmulps %ymm7,%ymm2,%ymm8
DB 197,116,89,215 ; vmulps %ymm7,%ymm1,%ymm10
DB 197,52,89,223 ; vmulps %ymm7,%ymm9,%ymm11
- DB 196,98,125,24,45,44,59,0,0 ; vbroadcastss 0x3b2c(%rip),%ymm13 # 4b1c <_sk_callback_hsw+0x1a2>
- DB 196,98,125,24,53,39,59,0,0 ; vbroadcastss 0x3b27(%rip),%ymm14 # 4b20 <_sk_callback_hsw+0x1a6>
+ DB 196,98,125,24,45,21,59,0,0 ; vbroadcastss 0x3b15(%rip),%ymm13 # 4b18 <_sk_callback_hsw+0x1ac>
+ DB 196,98,125,24,53,16,59,0,0 ; vbroadcastss 0x3b10(%rip),%ymm14 # 4b1c <_sk_callback_hsw+0x1b0>
DB 196,65,84,89,230 ; vmulps %ymm14,%ymm5,%ymm12
DB 196,66,93,184,229 ; vfmadd231ps %ymm13,%ymm4,%ymm12
- DB 196,98,125,24,61,24,59,0,0 ; vbroadcastss 0x3b18(%rip),%ymm15 # 4b24 <_sk_callback_hsw+0x1aa>
+ DB 196,98,125,24,61,1,59,0,0 ; vbroadcastss 0x3b01(%rip),%ymm15 # 4b20 <_sk_callback_hsw+0x1b4>
DB 196,66,77,184,231 ; vfmadd231ps %ymm15,%ymm6,%ymm12
DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9
DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -1063,7 +1068,7 @@ _sk_color_hsw LABEL PROC
DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1
DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8
DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9
- DB 196,226,125,24,5,250,57,0,0 ; vbroadcastss 0x39fa(%rip),%ymm0 # 4b28 <_sk_callback_hsw+0x1ae>
+ DB 196,226,125,24,5,227,57,0,0 ; vbroadcastss 0x39e3(%rip),%ymm0 # 4b24 <_sk_callback_hsw+0x1b8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -1091,11 +1096,11 @@ _sk_luminosity_hsw LABEL PROC
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
DB 197,100,89,213 ; vmulps %ymm5,%ymm3,%ymm10
DB 197,100,89,222 ; vmulps %ymm6,%ymm3,%ymm11
- DB 196,98,125,24,45,141,57,0,0 ; vbroadcastss 0x398d(%rip),%ymm13 # 4b2c <_sk_callback_hsw+0x1b2>
- DB 196,98,125,24,53,136,57,0,0 ; vbroadcastss 0x3988(%rip),%ymm14 # 4b30 <_sk_callback_hsw+0x1b6>
+ DB 196,98,125,24,45,118,57,0,0 ; vbroadcastss 0x3976(%rip),%ymm13 # 4b28 <_sk_callback_hsw+0x1bc>
+ DB 196,98,125,24,53,113,57,0,0 ; vbroadcastss 0x3971(%rip),%ymm14 # 4b2c <_sk_callback_hsw+0x1c0>
DB 196,65,116,89,230 ; vmulps %ymm14,%ymm1,%ymm12
DB 196,66,109,184,229 ; vfmadd231ps %ymm13,%ymm2,%ymm12
- DB 196,98,125,24,61,121,57,0,0 ; vbroadcastss 0x3979(%rip),%ymm15 # 4b34 <_sk_callback_hsw+0x1ba>
+ DB 196,98,125,24,61,98,57,0,0 ; vbroadcastss 0x3962(%rip),%ymm15 # 4b30 <_sk_callback_hsw+0x1c4>
DB 196,66,53,184,231 ; vfmadd231ps %ymm15,%ymm9,%ymm12
DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9
DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -1151,7 +1156,7 @@ _sk_luminosity_hsw LABEL PROC
DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1
DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8
DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9
- DB 196,226,125,24,5,91,56,0,0 ; vbroadcastss 0x385b(%rip),%ymm0 # 4b38 <_sk_callback_hsw+0x1be>
+ DB 196,226,125,24,5,68,56,0,0 ; vbroadcastss 0x3844(%rip),%ymm0 # 4b34 <_sk_callback_hsw+0x1c8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -1171,24 +1176,24 @@ _sk_luminosity_hsw LABEL PROC
PUBLIC _sk_srcover_rgba_8888_hsw
_sk_srcover_rgba_8888_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,180,0,0,0 ; jne 13ef <_sk_srcover_rgba_8888_hsw+0xcd>
- DB 196,193,124,16,57 ; vmovups (%r9),%ymm7
- DB 197,196,84,37,88,59,0,0 ; vandps 0x3b58(%rip),%ymm7,%ymm4 # 4ea0 <_sk_callback_hsw+0x526>
+ DB 15,133,180,0,0,0 ; jne 1402 <_sk_srcover_rgba_8888_hsw+0xcd>
+ DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
+ DB 197,196,84,37,69,59,0,0 ; vandps 0x3b45(%rip),%ymm7,%ymm4 # 4ea0 <_sk_callback_hsw+0x534>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,69,0,45,107,59,0,0 ; vpshufb 0x3b6b(%rip),%ymm7,%ymm5 # 4ec0 <_sk_callback_hsw+0x546>
+ DB 196,226,69,0,45,88,59,0,0 ; vpshufb 0x3b58(%rip),%ymm7,%ymm5 # 4ec0 <_sk_callback_hsw+0x554>
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,69,0,53,126,59,0,0 ; vpshufb 0x3b7e(%rip),%ymm7,%ymm6 # 4ee0 <_sk_callback_hsw+0x566>
+ DB 196,226,69,0,53,107,59,0,0 ; vpshufb 0x3b6b(%rip),%ymm7,%ymm6 # 4ee0 <_sk_callback_hsw+0x574>
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
DB 197,197,114,215,24 ; vpsrld $0x18,%ymm7,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,196,55,0,0 ; vbroadcastss 0x37c4(%rip),%ymm8 # 4b3c <_sk_callback_hsw+0x1c2>
+ DB 196,98,125,24,5,173,55,0,0 ; vbroadcastss 0x37ad(%rip),%ymm8 # 4b38 <_sk_callback_hsw+0x1cc>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
- DB 196,98,125,24,13,187,55,0,0 ; vbroadcastss 0x37bb(%rip),%ymm9 # 4b40 <_sk_callback_hsw+0x1c6>
+ DB 196,98,125,24,13,164,55,0,0 ; vbroadcastss 0x37a4(%rip),%ymm9 # 4b3c <_sk_callback_hsw+0x1d0>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0
DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
@@ -1208,10 +1213,10 @@ _sk_srcover_rgba_8888_hsw LABEL PROC
DB 196,65,53,235,202 ; vpor %ymm10,%ymm9,%ymm9
DB 196,65,61,235,193 ; vpor %ymm9,%ymm8,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,53 ; jne 1418 <_sk_srcover_rgba_8888_hsw+0xf6>
- DB 196,65,124,17,1 ; vmovups %ymm8,(%r9)
+ DB 117,53 ; jne 142b <_sk_srcover_rgba_8888_hsw+0xf6>
+ DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
@@ -1220,8 +1225,8 @@ _sk_srcover_rgba_8888_hsw LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,125,33,228 ; vpmovsxbd %xmm4,%ymm4
- DB 196,194,93,44,57 ; vmaskmovps (%r9),%ymm4,%ymm7
- DB 233,40,255,255,255 ; jmpq 1340 <_sk_srcover_rgba_8888_hsw+0x1e>
+ DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
+ DB 233,40,255,255,255 ; jmpq 1353 <_sk_srcover_rgba_8888_hsw+0x1e>
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
DB 192,225,3 ; shl $0x3,%cl
@@ -1229,8 +1234,8 @@ _sk_srcover_rgba_8888_hsw LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9
- DB 196,66,53,46,1 ; vmaskmovps %ymm8,%ymm9,(%r9)
- DB 235,170 ; jmp 13e8 <_sk_srcover_rgba_8888_hsw+0xc6>
+ DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
+ DB 235,170 ; jmp 13fb <_sk_srcover_rgba_8888_hsw+0xc6>
PUBLIC _sk_clamp_0_hsw
_sk_clamp_0_hsw LABEL PROC
@@ -1244,7 +1249,7 @@ _sk_clamp_0_hsw LABEL PROC
PUBLIC _sk_clamp_1_hsw
_sk_clamp_1_hsw LABEL PROC
- DB 196,98,125,24,5,224,54,0,0 ; vbroadcastss 0x36e0(%rip),%ymm8 # 4b44 <_sk_callback_hsw+0x1ca>
+ DB 196,98,125,24,5,201,54,0,0 ; vbroadcastss 0x36c9(%rip),%ymm8 # 4b40 <_sk_callback_hsw+0x1d4>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
@@ -1254,7 +1259,7 @@ _sk_clamp_1_hsw LABEL PROC
PUBLIC _sk_clamp_a_hsw
_sk_clamp_a_hsw LABEL PROC
- DB 196,98,125,24,5,195,54,0,0 ; vbroadcastss 0x36c3(%rip),%ymm8 # 4b48 <_sk_callback_hsw+0x1ce>
+ DB 196,98,125,24,5,172,54,0,0 ; vbroadcastss 0x36ac(%rip),%ymm8 # 4b44 <_sk_callback_hsw+0x1d8>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0
DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1
@@ -1326,7 +1331,7 @@ PUBLIC _sk_unpremul_hsw
_sk_unpremul_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9
- DB 196,98,125,24,21,11,54,0,0 ; vbroadcastss 0x360b(%rip),%ymm10 # 4b4c <_sk_callback_hsw+0x1d2>
+ DB 196,98,125,24,21,244,53,0,0 ; vbroadcastss 0x35f4(%rip),%ymm10 # 4b48 <_sk_callback_hsw+0x1dc>
DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10
DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
@@ -1337,16 +1342,16 @@ _sk_unpremul_hsw LABEL PROC
PUBLIC _sk_from_srgb_hsw
_sk_from_srgb_hsw LABEL PROC
- DB 196,98,125,24,5,236,53,0,0 ; vbroadcastss 0x35ec(%rip),%ymm8 # 4b50 <_sk_callback_hsw+0x1d6>
+ DB 196,98,125,24,5,213,53,0,0 ; vbroadcastss 0x35d5(%rip),%ymm8 # 4b4c <_sk_callback_hsw+0x1e0>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10
- DB 196,98,125,24,29,222,53,0,0 ; vbroadcastss 0x35de(%rip),%ymm11 # 4b54 <_sk_callback_hsw+0x1da>
- DB 196,98,125,24,37,217,53,0,0 ; vbroadcastss 0x35d9(%rip),%ymm12 # 4b58 <_sk_callback_hsw+0x1de>
+ DB 196,98,125,24,29,199,53,0,0 ; vbroadcastss 0x35c7(%rip),%ymm11 # 4b50 <_sk_callback_hsw+0x1e4>
+ DB 196,98,125,24,37,194,53,0,0 ; vbroadcastss 0x35c2(%rip),%ymm12 # 4b54 <_sk_callback_hsw+0x1e8>
DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13
DB 196,66,125,168,235 ; vfmadd213ps %ymm11,%ymm0,%ymm13
- DB 196,98,125,24,53,202,53,0,0 ; vbroadcastss 0x35ca(%rip),%ymm14 # 4b5c <_sk_callback_hsw+0x1e2>
+ DB 196,98,125,24,53,179,53,0,0 ; vbroadcastss 0x35b3(%rip),%ymm14 # 4b58 <_sk_callback_hsw+0x1ec>
DB 196,66,45,168,238 ; vfmadd213ps %ymm14,%ymm10,%ymm13
- DB 196,98,125,24,21,192,53,0,0 ; vbroadcastss 0x35c0(%rip),%ymm10 # 4b60 <_sk_callback_hsw+0x1e6>
+ DB 196,98,125,24,21,169,53,0,0 ; vbroadcastss 0x35a9(%rip),%ymm10 # 4b5c <_sk_callback_hsw+0x1f0>
DB 196,193,124,194,194,1 ; vcmpltps %ymm10,%ymm0,%ymm0
DB 196,195,21,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm13,%ymm0
DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9
@@ -1368,19 +1373,19 @@ _sk_from_srgb_hsw LABEL PROC
PUBLIC _sk_to_srgb_hsw
_sk_to_srgb_hsw LABEL PROC
DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9
- DB 196,98,125,24,5,100,53,0,0 ; vbroadcastss 0x3564(%rip),%ymm8 # 4b64 <_sk_callback_hsw+0x1ea>
+ DB 196,98,125,24,5,77,53,0,0 ; vbroadcastss 0x354d(%rip),%ymm8 # 4b60 <_sk_callback_hsw+0x1f4>
DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10
- DB 196,98,125,24,29,90,53,0,0 ; vbroadcastss 0x355a(%rip),%ymm11 # 4b68 <_sk_callback_hsw+0x1ee>
- DB 196,98,125,24,37,85,53,0,0 ; vbroadcastss 0x3555(%rip),%ymm12 # 4b6c <_sk_callback_hsw+0x1f2>
+ DB 196,98,125,24,29,67,53,0,0 ; vbroadcastss 0x3543(%rip),%ymm11 # 4b64 <_sk_callback_hsw+0x1f8>
+ DB 196,98,125,24,37,62,53,0,0 ; vbroadcastss 0x353e(%rip),%ymm12 # 4b68 <_sk_callback_hsw+0x1fc>
DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13
DB 196,66,53,168,235 ; vfmadd213ps %ymm11,%ymm9,%ymm13
- DB 196,98,125,24,53,70,53,0,0 ; vbroadcastss 0x3546(%rip),%ymm14 # 4b70 <_sk_callback_hsw+0x1f6>
+ DB 196,98,125,24,53,47,53,0,0 ; vbroadcastss 0x352f(%rip),%ymm14 # 4b6c <_sk_callback_hsw+0x200>
DB 196,66,53,168,238 ; vfmadd213ps %ymm14,%ymm9,%ymm13
- DB 196,98,125,24,61,60,53,0,0 ; vbroadcastss 0x353c(%rip),%ymm15 # 4b74 <_sk_callback_hsw+0x1fa>
+ DB 196,98,125,24,61,37,53,0,0 ; vbroadcastss 0x3525(%rip),%ymm15 # 4b70 <_sk_callback_hsw+0x204>
DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9
DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9
DB 196,65,20,89,201 ; vmulps %ymm9,%ymm13,%ymm9
- DB 196,98,125,24,45,40,53,0,0 ; vbroadcastss 0x3528(%rip),%ymm13 # 4b78 <_sk_callback_hsw+0x1fe>
+ DB 196,98,125,24,45,17,53,0,0 ; vbroadcastss 0x3511(%rip),%ymm13 # 4b74 <_sk_callback_hsw+0x208>
DB 196,193,124,194,197,1 ; vcmpltps %ymm13,%ymm0,%ymm0
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9
@@ -1412,26 +1417,26 @@ _sk_rgb_to_hsl_hsw LABEL PROC
DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9
DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9
DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,29,157,52,0,0 ; vbroadcastss 0x349d(%rip),%ymm11 # 4b7c <_sk_callback_hsw+0x202>
+ DB 196,98,125,24,29,134,52,0,0 ; vbroadcastss 0x3486(%rip),%ymm11 # 4b78 <_sk_callback_hsw+0x20c>
DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11
DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12
DB 197,116,194,234,1 ; vcmpltps %ymm2,%ymm1,%ymm13
- DB 196,98,125,24,53,138,52,0,0 ; vbroadcastss 0x348a(%rip),%ymm14 # 4b80 <_sk_callback_hsw+0x206>
+ DB 196,98,125,24,53,115,52,0,0 ; vbroadcastss 0x3473(%rip),%ymm14 # 4b7c <_sk_callback_hsw+0x210>
DB 196,65,4,87,255 ; vxorps %ymm15,%ymm15,%ymm15
DB 196,67,5,74,238,208 ; vblendvps %ymm13,%ymm14,%ymm15,%ymm13
DB 196,66,37,168,229 ; vfmadd213ps %ymm13,%ymm11,%ymm12
DB 197,236,92,208 ; vsubps %ymm0,%ymm2,%ymm2
DB 197,124,92,233 ; vsubps %ymm1,%ymm0,%ymm13
- DB 196,98,125,24,53,113,52,0,0 ; vbroadcastss 0x3471(%rip),%ymm14 # 4b88 <_sk_callback_hsw+0x20e>
+ DB 196,98,125,24,53,90,52,0,0 ; vbroadcastss 0x345a(%rip),%ymm14 # 4b84 <_sk_callback_hsw+0x218>
DB 196,66,37,168,238 ; vfmadd213ps %ymm14,%ymm11,%ymm13
- DB 196,98,125,24,53,95,52,0,0 ; vbroadcastss 0x345f(%rip),%ymm14 # 4b84 <_sk_callback_hsw+0x20a>
+ DB 196,98,125,24,53,72,52,0,0 ; vbroadcastss 0x3448(%rip),%ymm14 # 4b80 <_sk_callback_hsw+0x214>
DB 196,194,37,168,214 ; vfmadd213ps %ymm14,%ymm11,%ymm2
DB 197,188,194,201,0 ; vcmpeqps %ymm1,%ymm8,%ymm1
DB 196,227,21,74,202,16 ; vblendvps %ymm1,%ymm2,%ymm13,%ymm1
DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0
DB 196,195,117,74,196,0 ; vblendvps %ymm0,%ymm12,%ymm1,%ymm0
DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1
- DB 196,98,125,24,29,66,52,0,0 ; vbroadcastss 0x3442(%rip),%ymm11 # 4b90 <_sk_callback_hsw+0x216>
+ DB 196,98,125,24,29,43,52,0,0 ; vbroadcastss 0x342b(%rip),%ymm11 # 4b8c <_sk_callback_hsw+0x220>
DB 196,193,116,89,211 ; vmulps %ymm11,%ymm1,%ymm2
DB 197,36,194,218,1 ; vcmpltps %ymm2,%ymm11,%ymm11
DB 196,65,12,92,224 ; vsubps %ymm8,%ymm14,%ymm12
@@ -1441,7 +1446,7 @@ _sk_rgb_to_hsl_hsw LABEL PROC
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 196,195,125,74,199,128 ; vblendvps %ymm8,%ymm15,%ymm0,%ymm0
DB 196,195,117,74,207,128 ; vblendvps %ymm8,%ymm15,%ymm1,%ymm1
- DB 196,98,125,24,5,5,52,0,0 ; vbroadcastss 0x3405(%rip),%ymm8 # 4b8c <_sk_callback_hsw+0x212>
+ DB 196,98,125,24,5,238,51,0,0 ; vbroadcastss 0x33ee(%rip),%ymm8 # 4b88 <_sk_callback_hsw+0x21c>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -1456,30 +1461,30 @@ _sk_hsl_to_rgb_hsw LABEL PROC
DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp)
DB 197,252,40,233 ; vmovaps %ymm1,%ymm5
DB 197,252,40,224 ; vmovaps %ymm0,%ymm4
- DB 196,98,125,24,5,204,51,0,0 ; vbroadcastss 0x33cc(%rip),%ymm8 # 4b94 <_sk_callback_hsw+0x21a>
+ DB 196,98,125,24,5,181,51,0,0 ; vbroadcastss 0x33b5(%rip),%ymm8 # 4b90 <_sk_callback_hsw+0x224>
DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9
DB 197,84,89,210 ; vmulps %ymm2,%ymm5,%ymm10
DB 196,65,84,92,218 ; vsubps %ymm10,%ymm5,%ymm11
DB 196,67,45,74,203,144 ; vblendvps %ymm9,%ymm11,%ymm10,%ymm9
DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10
- DB 196,98,125,24,13,175,51,0,0 ; vbroadcastss 0x33af(%rip),%ymm9 # 4b98 <_sk_callback_hsw+0x21e>
+ DB 196,98,125,24,13,152,51,0,0 ; vbroadcastss 0x3398(%rip),%ymm9 # 4b94 <_sk_callback_hsw+0x228>
DB 196,66,109,170,202 ; vfmsub213ps %ymm10,%ymm2,%ymm9
- DB 196,98,125,24,29,165,51,0,0 ; vbroadcastss 0x33a5(%rip),%ymm11 # 4b9c <_sk_callback_hsw+0x222>
+ DB 196,98,125,24,29,142,51,0,0 ; vbroadcastss 0x338e(%rip),%ymm11 # 4b98 <_sk_callback_hsw+0x22c>
DB 196,65,92,88,219 ; vaddps %ymm11,%ymm4,%ymm11
DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12
DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15
DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11
- DB 196,98,125,24,45,143,51,0,0 ; vbroadcastss 0x338f(%rip),%ymm13 # 4ba4 <_sk_callback_hsw+0x22a>
+ DB 196,98,125,24,45,120,51,0,0 ; vbroadcastss 0x3378(%rip),%ymm13 # 4ba0 <_sk_callback_hsw+0x234>
DB 196,193,4,89,197 ; vmulps %ymm13,%ymm15,%ymm0
- DB 196,98,125,24,53,133,51,0,0 ; vbroadcastss 0x3385(%rip),%ymm14 # 4ba8 <_sk_callback_hsw+0x22e>
+ DB 196,98,125,24,53,110,51,0,0 ; vbroadcastss 0x336e(%rip),%ymm14 # 4ba4 <_sk_callback_hsw+0x238>
DB 197,12,92,224 ; vsubps %ymm0,%ymm14,%ymm12
DB 196,66,37,168,225 ; vfmadd213ps %ymm9,%ymm11,%ymm12
- DB 196,226,125,24,29,107,51,0,0 ; vbroadcastss 0x336b(%rip),%ymm3 # 4ba0 <_sk_callback_hsw+0x226>
+ DB 196,226,125,24,29,84,51,0,0 ; vbroadcastss 0x3354(%rip),%ymm3 # 4b9c <_sk_callback_hsw+0x230>
DB 196,193,100,194,255,2 ; vcmpleps %ymm15,%ymm3,%ymm7
DB 196,195,29,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm12,%ymm7
DB 196,65,60,194,231,2 ; vcmpleps %ymm15,%ymm8,%ymm12
DB 196,227,45,74,255,192 ; vblendvps %ymm12,%ymm7,%ymm10,%ymm7
- DB 196,98,125,24,37,86,51,0,0 ; vbroadcastss 0x3356(%rip),%ymm12 # 4bac <_sk_callback_hsw+0x232>
+ DB 196,98,125,24,37,63,51,0,0 ; vbroadcastss 0x333f(%rip),%ymm12 # 4ba8 <_sk_callback_hsw+0x23c>
DB 196,65,28,194,255,2 ; vcmpleps %ymm15,%ymm12,%ymm15
DB 196,194,37,168,193 ; vfmadd213ps %ymm9,%ymm11,%ymm0
DB 196,99,125,74,255,240 ; vblendvps %ymm15,%ymm7,%ymm0,%ymm15
@@ -1495,7 +1500,7 @@ _sk_hsl_to_rgb_hsw LABEL PROC
DB 197,156,194,192,2 ; vcmpleps %ymm0,%ymm12,%ymm0
DB 196,194,37,168,249 ; vfmadd213ps %ymm9,%ymm11,%ymm7
DB 196,227,69,74,201,0 ; vblendvps %ymm0,%ymm1,%ymm7,%ymm1
- DB 196,226,125,24,5,2,51,0,0 ; vbroadcastss 0x3302(%rip),%ymm0 # 4bb0 <_sk_callback_hsw+0x236>
+ DB 196,226,125,24,5,235,50,0,0 ; vbroadcastss 0x32eb(%rip),%ymm0 # 4bac <_sk_callback_hsw+0x240>
DB 197,220,88,192 ; vaddps %ymm0,%ymm4,%ymm0
DB 196,227,125,8,224,1 ; vroundps $0x1,%ymm0,%ymm4
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
@@ -1536,36 +1541,38 @@ _sk_scale_1_float_hsw LABEL PROC
PUBLIC _sk_scale_u8_hsw
_sk_scale_u8_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,51 ; jne 1994 <_sk_scale_u8_hsw+0x43>
+ DB 117,51 ; jne 19a7 <_sk_scale_u8_hsw+0x43>
DB 197,122,126,0 ; vmovq (%rax),%xmm8
DB 196,66,125,49,192 ; vpmovzxbd %xmm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,60,50,0,0 ; vbroadcastss 0x323c(%rip),%ymm9 # 4bb4 <_sk_callback_hsw+0x23a>
+ DB 196,98,125,24,13,37,50,0,0 ; vbroadcastss 0x3225(%rip),%ymm9 # 4bb0 <_sk_callback_hsw+0x244>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
DB 197,188,89,219 ; vmulps %ymm3,%ymm8,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 199c <_sk_scale_u8_hsw+0x4b>
- DB 196,65,249,110,193 ; vmovq %r9,%xmm8
- DB 235,172 ; jmp 1965 <_sk_scale_u8_hsw+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 19b0 <_sk_scale_u8_hsw+0x4c>
+ DB 196,65,249,110,194 ; vmovq %r10,%xmm8
+ DB 91 ; pop %rbx
+ DB 235,171 ; jmp 1978 <_sk_scale_u8_hsw+0x14>
PUBLIC _sk_lerp_1_float_hsw
_sk_lerp_1_float_hsw LABEL PROC
@@ -1584,16 +1591,16 @@ _sk_lerp_1_float_hsw LABEL PROC
PUBLIC _sk_lerp_u8_hsw
_sk_lerp_u8_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,71 ; jne 1a3f <_sk_lerp_u8_hsw+0x57>
+ DB 117,71 ; jne 1a53 <_sk_lerp_u8_hsw+0x57>
DB 197,122,126,0 ; vmovq (%rax),%xmm8
DB 196,66,125,49,192 ; vpmovzxbd %xmm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,169,49,0,0 ; vbroadcastss 0x31a9(%rip),%ymm9 # 4bb8 <_sk_callback_hsw+0x23e>
+ DB 196,98,125,24,13,145,49,0,0 ; vbroadcastss 0x3191(%rip),%ymm9 # 4bb4 <_sk_callback_hsw+0x248>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0
@@ -1604,43 +1611,45 @@ _sk_lerp_u8_hsw LABEL PROC
DB 197,228,92,223 ; vsubps %ymm7,%ymm3,%ymm3
DB 196,226,61,168,223 ; vfmadd213ps %ymm7,%ymm8,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 1a47 <_sk_lerp_u8_hsw+0x5f>
- DB 196,65,249,110,193 ; vmovq %r9,%xmm8
- DB 235,152 ; jmp 19fc <_sk_lerp_u8_hsw+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 1a5c <_sk_lerp_u8_hsw+0x60>
+ DB 196,65,249,110,194 ; vmovq %r10,%xmm8
+ DB 91 ; pop %rbx
+ DB 235,151 ; jmp 1a10 <_sk_lerp_u8_hsw+0x14>
PUBLIC _sk_lerp_565_hsw
_sk_lerp_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,169,0,0,0 ; jne 1b1b <_sk_lerp_565_hsw+0xb7>
- DB 196,65,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm8
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,169,0,0,0 ; jne 1b30 <_sk_lerp_565_hsw+0xb7>
+ DB 196,65,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm8
DB 196,66,125,51,192 ; vpmovzxwd %xmm8,%ymm8
- DB 196,98,125,88,13,54,49,0,0 ; vpbroadcastd 0x3136(%rip),%ymm9 # 4bbc <_sk_callback_hsw+0x242>
+ DB 196,98,125,88,13,29,49,0,0 ; vpbroadcastd 0x311d(%rip),%ymm9 # 4bb8 <_sk_callback_hsw+0x24c>
DB 196,65,61,219,201 ; vpand %ymm9,%ymm8,%ymm9
DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9
- DB 196,98,125,24,21,39,49,0,0 ; vbroadcastss 0x3127(%rip),%ymm10 # 4bc0 <_sk_callback_hsw+0x246>
+ DB 196,98,125,24,21,14,49,0,0 ; vbroadcastss 0x310e(%rip),%ymm10 # 4bbc <_sk_callback_hsw+0x250>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
- DB 196,98,125,88,21,29,49,0,0 ; vpbroadcastd 0x311d(%rip),%ymm10 # 4bc4 <_sk_callback_hsw+0x24a>
+ DB 196,98,125,88,21,4,49,0,0 ; vpbroadcastd 0x3104(%rip),%ymm10 # 4bc0 <_sk_callback_hsw+0x254>
DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10
DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10
- DB 196,98,125,24,29,14,49,0,0 ; vbroadcastss 0x310e(%rip),%ymm11 # 4bc8 <_sk_callback_hsw+0x24e>
+ DB 196,98,125,24,29,245,48,0,0 ; vbroadcastss 0x30f5(%rip),%ymm11 # 4bc4 <_sk_callback_hsw+0x258>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
- DB 196,98,125,88,29,4,49,0,0 ; vpbroadcastd 0x3104(%rip),%ymm11 # 4bcc <_sk_callback_hsw+0x252>
+ DB 196,98,125,88,29,235,48,0,0 ; vpbroadcastd 0x30eb(%rip),%ymm11 # 4bc8 <_sk_callback_hsw+0x25c>
DB 196,65,61,219,195 ; vpand %ymm11,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,29,245,48,0,0 ; vbroadcastss 0x30f5(%rip),%ymm11 # 4bd0 <_sk_callback_hsw+0x256>
+ DB 196,98,125,24,29,220,48,0,0 ; vbroadcastss 0x30dc(%rip),%ymm11 # 4bcc <_sk_callback_hsw+0x260>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,226,53,168,196 ; vfmadd213ps %ymm4,%ymm9,%ymm0
@@ -1656,98 +1665,100 @@ _sk_lerp_565_hsw LABEL PROC
DB 197,180,95,219 ; vmaxps %ymm3,%ymm9,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 15,135,68,255,255,255 ; ja 1a78 <_sk_lerp_565_hsw+0x14>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,77,0,0,0 ; lea 0x4d(%rip),%r9 # 1b8c <_sk_lerp_565_hsw+0x128>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 15,135,68,255,255,255 ; ja 1a8d <_sk_lerp_565_hsw+0x14>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,76,0,0,0 ; lea 0x4c(%rip),%r10 # 1ba0 <_sk_lerp_565_hsw+0x127>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8
- DB 196,65,57,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm8,%xmm8
- DB 233,239,254,255,255 ; jmpq 1a78 <_sk_lerp_565_hsw+0x14>
- DB 15,31,0 ; nopl (%rax)
- DB 241 ; icebp
+ DB 196,65,57,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8
+ DB 233,239,254,255,255 ; jmpq 1a8d <_sk_lerp_565_hsw+0x14>
+ DB 102,144 ; xchg %ax,%ax
+ DB 242,255 ; repnz (bad)
+ DB 255 ; (bad)
DB 255 ; (bad)
+ DB 234 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 233,255,255,255,225 ; jmpq ffffffffe2001b94 <_sk_callback_hsw+0xffffffffe1ffd21a>
+ DB 255,226 ; jmpq *%rdx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 217,255 ; fcos
+ DB 218,255 ; (bad)
DB 255 ; (bad)
- DB 255,209 ; callq *%rcx
+ DB 255,210 ; callq *%rdx
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,201 ; dec %ecx
+ DB 255,202 ; dec %edx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 188 ; .byte 0xbc
+ DB 189 ; .byte 0xbd
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
PUBLIC _sk_load_tables_hsw
_sk_load_tables_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,105 ; jne 1c26 <_sk_load_tables_hsw+0x7e>
- DB 196,193,124,16,25 ; vmovups (%r9),%ymm3
- DB 197,228,84,13,54,51,0,0 ; vandps 0x3336(%rip),%ymm3,%ymm1 # 4f00 <_sk_callback_hsw+0x586>
+ DB 117,105 ; jne 1c3a <_sk_load_tables_hsw+0x7e>
+ DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
+ DB 197,228,84,13,34,51,0,0 ; vandps 0x3322(%rip),%ymm3,%ymm1 # 4f00 <_sk_callback_hsw+0x594>
DB 196,65,61,118,192 ; vpcmpeqd %ymm8,%ymm8,%ymm8
DB 72,139,72,8 ; mov 0x8(%rax),%rcx
- DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
DB 196,226,109,146,4,137 ; vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0
- DB 196,226,101,0,21,54,51,0,0 ; vpshufb 0x3336(%rip),%ymm3,%ymm2 # 4f20 <_sk_callback_hsw+0x5a6>
+ DB 196,226,101,0,21,34,51,0,0 ; vpshufb 0x3322(%rip),%ymm3,%ymm2 # 4f20 <_sk_callback_hsw+0x5b4>
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
- DB 196,194,53,146,12,145 ; vgatherdps %ymm9,(%r9,%ymm2,4),%ymm1
+ DB 196,194,53,146,12,146 ; vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1
DB 72,139,64,24 ; mov 0x18(%rax),%rax
- DB 196,98,101,0,13,62,51,0,0 ; vpshufb 0x333e(%rip),%ymm3,%ymm9 # 4f40 <_sk_callback_hsw+0x5c6>
+ DB 196,98,101,0,13,42,51,0,0 ; vpshufb 0x332a(%rip),%ymm3,%ymm9 # 4f40 <_sk_callback_hsw+0x5d4>
DB 196,162,61,146,20,136 ; vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,186,47,0,0 ; vbroadcastss 0x2fba(%rip),%ymm8 # 4bd4 <_sk_callback_hsw+0x25a>
+ DB 196,98,125,24,5,162,47,0,0 ; vbroadcastss 0x2fa2(%rip),%ymm8 # 4bd0 <_sk_callback_hsw+0x264>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
DB 192,225,3 ; shl $0x3,%cl
- DB 73,199,194,255,255,255,255 ; mov $0xffffffffffffffff,%r10
- DB 73,211,234 ; shr %cl,%r10
- DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 73,199,195,255,255,255,255 ; mov $0xffffffffffffffff,%r11
+ DB 73,211,235 ; shr %cl,%r11
+ DB 196,193,249,110,195 ; vmovq %r11,%xmm0
DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0
- DB 196,194,125,44,25 ; vmaskmovps (%r9),%ymm0,%ymm3
- DB 233,115,255,255,255 ; jmpq 1bc2 <_sk_load_tables_hsw+0x1a>
+ DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
+ DB 233,115,255,255,255 ; jmpq 1bd6 <_sk_load_tables_hsw+0x1a>
PUBLIC _sk_load_tables_u16_be_hsw
_sk_load_tables_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,201,0,0,0 ; jne 1d2e <_sk_load_tables_u16_be_hsw+0xdf>
- DB 196,1,121,16,4,72 ; vmovupd (%r8,%r9,2),%xmm8
- DB 196,129,121,16,84,72,16 ; vmovupd 0x10(%r8,%r9,2),%xmm2
- DB 196,129,121,16,92,72,32 ; vmovupd 0x20(%r8,%r9,2),%xmm3
- DB 196,1,122,111,76,72,48 ; vmovdqu 0x30(%r8,%r9,2),%xmm9
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,201,0,0,0 ; jne 1d42 <_sk_load_tables_u16_be_hsw+0xdf>
+ DB 196,1,121,16,4,81 ; vmovupd (%r9,%r10,2),%xmm8
+ DB 196,129,121,16,84,81,16 ; vmovupd 0x10(%r9,%r10,2),%xmm2
+ DB 196,129,121,16,92,81,32 ; vmovupd 0x20(%r9,%r10,2),%xmm3
+ DB 196,1,122,111,76,81,48 ; vmovdqu 0x30(%r9,%r10,2),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,97,97,201 ; vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -1759,18 +1770,18 @@ _sk_load_tables_u16_be_hsw LABEL PROC
DB 197,185,108,200 ; vpunpcklqdq %xmm0,%xmm8,%xmm1
DB 197,185,109,208 ; vpunpckhqdq %xmm0,%xmm8,%xmm2
DB 197,49,108,195 ; vpunpcklqdq %xmm3,%xmm9,%xmm8
- DB 197,121,111,21,202,51,0,0 ; vmovdqa 0x33ca(%rip),%xmm10 # 5080 <_sk_callback_hsw+0x706>
+ DB 197,121,111,21,182,51,0,0 ; vmovdqa 0x33b6(%rip),%xmm10 # 5080 <_sk_callback_hsw+0x714>
DB 196,193,113,219,194 ; vpand %xmm10,%xmm1,%xmm0
DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1
DB 196,65,37,118,219 ; vpcmpeqd %ymm11,%ymm11,%ymm11
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 196,65,29,118,228 ; vpcmpeqd %ymm12,%ymm12,%ymm12
- DB 196,194,29,146,4,136 ; vgatherdps %ymm12,(%r8,%ymm1,4),%ymm0
+ DB 196,194,29,146,4,137 ; vgatherdps %ymm12,(%r9,%ymm1,4),%ymm0
DB 196,193,105,219,202 ; vpand %xmm10,%xmm2,%xmm1
DB 196,226,125,51,209 ; vpmovzxwd %xmm1,%ymm2
DB 196,65,29,118,228 ; vpcmpeqd %ymm12,%ymm12,%ymm12
- DB 196,194,29,146,12,145 ; vgatherdps %ymm12,(%r9,%ymm2,4),%ymm1
+ DB 196,194,29,146,12,146 ; vgatherdps %ymm12,(%r10,%ymm2,4),%ymm1
DB 72,139,64,24 ; mov 0x18(%rax),%rax
DB 196,193,57,219,210 ; vpand %xmm10,%xmm8,%xmm2
DB 196,98,125,51,194 ; vpmovzxwd %xmm2,%ymm8
@@ -1781,48 +1792,48 @@ _sk_load_tables_u16_be_hsw LABEL PROC
DB 197,185,235,219 ; vpor %xmm3,%xmm8,%xmm3
DB 196,226,125,51,219 ; vpmovzxwd %xmm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,179,46,0,0 ; vbroadcastss 0x2eb3(%rip),%ymm8 # 4bd8 <_sk_callback_hsw+0x25e>
+ DB 196,98,125,24,5,155,46,0,0 ; vbroadcastss 0x2e9b(%rip),%ymm8 # 4bd4 <_sk_callback_hsw+0x268>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 196,1,123,16,4,72 ; vmovsd (%r8,%r9,2),%xmm8
+ DB 196,1,123,16,4,81 ; vmovsd (%r9,%r10,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,85 ; je 1d94 <_sk_load_tables_u16_be_hsw+0x145>
- DB 196,1,57,22,68,72,8 ; vmovhpd 0x8(%r8,%r9,2),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,72 ; jb 1d94 <_sk_load_tables_u16_be_hsw+0x145>
- DB 196,129,123,16,84,72,16 ; vmovsd 0x10(%r8,%r9,2),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,72 ; je 1da1 <_sk_load_tables_u16_be_hsw+0x152>
- DB 196,129,105,22,84,72,24 ; vmovhpd 0x18(%r8,%r9,2),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,59 ; jb 1da1 <_sk_load_tables_u16_be_hsw+0x152>
- DB 196,129,123,16,92,72,32 ; vmovsd 0x20(%r8,%r9,2),%xmm3
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,9,255,255,255 ; je 1c80 <_sk_load_tables_u16_be_hsw+0x31>
- DB 196,129,97,22,92,72,40 ; vmovhpd 0x28(%r8,%r9,2),%xmm3,%xmm3
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,248,254,255,255 ; jb 1c80 <_sk_load_tables_u16_be_hsw+0x31>
- DB 196,1,122,126,76,72,48 ; vmovq 0x30(%r8,%r9,2),%xmm9
- DB 233,236,254,255,255 ; jmpq 1c80 <_sk_load_tables_u16_be_hsw+0x31>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,85 ; je 1da8 <_sk_load_tables_u16_be_hsw+0x145>
+ DB 196,1,57,22,68,81,8 ; vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,72 ; jb 1da8 <_sk_load_tables_u16_be_hsw+0x145>
+ DB 196,129,123,16,84,81,16 ; vmovsd 0x10(%r9,%r10,2),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,72 ; je 1db5 <_sk_load_tables_u16_be_hsw+0x152>
+ DB 196,129,105,22,84,81,24 ; vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,59 ; jb 1db5 <_sk_load_tables_u16_be_hsw+0x152>
+ DB 196,129,123,16,92,81,32 ; vmovsd 0x20(%r9,%r10,2),%xmm3
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,9,255,255,255 ; je 1c94 <_sk_load_tables_u16_be_hsw+0x31>
+ DB 196,129,97,22,92,81,40 ; vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,248,254,255,255 ; jb 1c94 <_sk_load_tables_u16_be_hsw+0x31>
+ DB 196,1,122,126,76,81,48 ; vmovq 0x30(%r9,%r10,2),%xmm9
+ DB 233,236,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,223,254,255,255 ; jmpq 1c80 <_sk_load_tables_u16_be_hsw+0x31>
+ DB 233,223,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,214,254,255,255 ; jmpq 1c80 <_sk_load_tables_u16_be_hsw+0x31>
+ DB 233,214,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31>
PUBLIC _sk_load_tables_rgb_u16_be_hsw
_sk_load_tables_rgb_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,127 ; lea (%rdi,%rdi,2),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,193,0,0,0 ; jne 1e7d <_sk_load_tables_rgb_u16_be_hsw+0xd3>
- DB 196,129,122,111,4,72 ; vmovdqu (%r8,%r9,2),%xmm0
- DB 196,129,122,111,84,72,12 ; vmovdqu 0xc(%r8,%r9,2),%xmm2
- DB 196,129,122,111,76,72,24 ; vmovdqu 0x18(%r8,%r9,2),%xmm1
- DB 196,129,122,111,92,72,32 ; vmovdqu 0x20(%r8,%r9,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,193,0,0,0 ; jne 1e91 <_sk_load_tables_rgb_u16_be_hsw+0xd3>
+ DB 196,129,122,111,4,81 ; vmovdqu (%r9,%r10,2),%xmm0
+ DB 196,129,122,111,84,81,12 ; vmovdqu 0xc(%r9,%r10,2),%xmm2
+ DB 196,129,122,111,76,81,24 ; vmovdqu 0x18(%r9,%r10,2),%xmm1
+ DB 196,129,122,111,92,81,32 ; vmovdqu 0x20(%r9,%r10,2),%xmm3
DB 197,225,115,219,4 ; vpsrldq $0x4,%xmm3,%xmm3
DB 197,185,115,216,6 ; vpsrldq $0x6,%xmm0,%xmm8
DB 197,177,115,218,6 ; vpsrldq $0x6,%xmm2,%xmm9
@@ -1839,344 +1850,314 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC
DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3
DB 197,185,109,210 ; vpunpckhqdq %xmm2,%xmm8,%xmm2
DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8
- DB 197,121,111,13,106,50,0,0 ; vmovdqa 0x326a(%rip),%xmm9 # 5090 <_sk_callback_hsw+0x716>
+ DB 197,121,111,13,86,50,0,0 ; vmovdqa 0x3256(%rip),%xmm9 # 5090 <_sk_callback_hsw+0x724>
DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0
DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 196,65,45,118,210 ; vpcmpeqd %ymm10,%ymm10,%ymm10
- DB 196,194,45,146,4,136 ; vgatherdps %ymm10,(%r8,%ymm1,4),%ymm0
+ DB 196,194,45,146,4,137 ; vgatherdps %ymm10,(%r9,%ymm1,4),%ymm0
DB 196,193,105,219,201 ; vpand %xmm9,%xmm2,%xmm1
DB 196,226,125,51,209 ; vpmovzxwd %xmm1,%ymm2
DB 196,65,45,118,210 ; vpcmpeqd %ymm10,%ymm10,%ymm10
- DB 196,194,45,146,12,145 ; vgatherdps %ymm10,(%r9,%ymm2,4),%ymm1
+ DB 196,194,45,146,12,146 ; vgatherdps %ymm10,(%r10,%ymm2,4),%ymm1
DB 72,139,64,24 ; mov 0x18(%rax),%rax
DB 196,193,57,219,209 ; vpand %xmm9,%xmm8,%xmm2
DB 196,98,125,51,194 ; vpmovzxwd %xmm2,%ymm8
DB 196,162,101,146,20,128 ; vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,97,45,0,0 ; vbroadcastss 0x2d61(%rip),%ymm3 # 4bdc <_sk_callback_hsw+0x262>
- DB 255,224 ; jmpq *%rax
- DB 196,129,121,110,4,72 ; vmovd (%r8,%r9,2),%xmm0
- DB 196,129,121,196,68,72,4,2 ; vpinsrw $0x2,0x4(%r8,%r9,2),%xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,5 ; jne 1e96 <_sk_load_tables_rgb_u16_be_hsw+0xec>
- DB 233,90,255,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 196,129,121,110,76,72,6 ; vmovd 0x6(%r8,%r9,2),%xmm1
- DB 196,1,113,196,68,72,10,2 ; vpinsrw $0x2,0xa(%r8,%r9,2),%xmm1,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,26 ; jb 1ec5 <_sk_load_tables_rgb_u16_be_hsw+0x11b>
- DB 196,129,121,110,76,72,12 ; vmovd 0xc(%r8,%r9,2),%xmm1
- DB 196,129,113,196,84,72,16,2 ; vpinsrw $0x2,0x10(%r8,%r9,2),%xmm1,%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 117,10 ; jne 1eca <_sk_load_tables_rgb_u16_be_hsw+0x120>
- DB 233,43,255,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 233,38,255,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 196,129,121,110,76,72,18 ; vmovd 0x12(%r8,%r9,2),%xmm1
- DB 196,1,113,196,76,72,22,2 ; vpinsrw $0x2,0x16(%r8,%r9,2),%xmm1,%xmm9
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,26 ; jb 1ef9 <_sk_load_tables_rgb_u16_be_hsw+0x14f>
- DB 196,129,121,110,76,72,24 ; vmovd 0x18(%r8,%r9,2),%xmm1
- DB 196,129,113,196,76,72,28,2 ; vpinsrw $0x2,0x1c(%r8,%r9,2),%xmm1,%xmm1
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 117,10 ; jne 1efe <_sk_load_tables_rgb_u16_be_hsw+0x154>
- DB 233,247,254,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 233,242,254,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 196,129,121,110,92,72,30 ; vmovd 0x1e(%r8,%r9,2),%xmm3
- DB 196,1,97,196,92,72,34,2 ; vpinsrw $0x2,0x22(%r8,%r9,2),%xmm3,%xmm11
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,20 ; jb 1f27 <_sk_load_tables_rgb_u16_be_hsw+0x17d>
- DB 196,129,121,110,92,72,36 ; vmovd 0x24(%r8,%r9,2),%xmm3
- DB 196,129,97,196,92,72,40,2 ; vpinsrw $0x2,0x28(%r8,%r9,2),%xmm3,%xmm3
- DB 233,201,254,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
- DB 233,196,254,255,255 ; jmpq 1df0 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 196,226,125,24,29,73,45,0,0 ; vbroadcastss 0x2d49(%rip),%ymm3 # 4bd8 <_sk_callback_hsw+0x26c>
+ DB 255,224 ; jmpq *%rax
+ DB 196,129,121,110,4,81 ; vmovd (%r9,%r10,2),%xmm0
+ DB 196,129,121,196,68,81,4,2 ; vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,5 ; jne 1eaa <_sk_load_tables_rgb_u16_be_hsw+0xec>
+ DB 233,90,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 196,129,121,110,76,81,6 ; vmovd 0x6(%r9,%r10,2),%xmm1
+ DB 196,1,113,196,68,81,10,2 ; vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,26 ; jb 1ed9 <_sk_load_tables_rgb_u16_be_hsw+0x11b>
+ DB 196,129,121,110,76,81,12 ; vmovd 0xc(%r9,%r10,2),%xmm1
+ DB 196,129,113,196,84,81,16,2 ; vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 117,10 ; jne 1ede <_sk_load_tables_rgb_u16_be_hsw+0x120>
+ DB 233,43,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 233,38,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 196,129,121,110,76,81,18 ; vmovd 0x12(%r9,%r10,2),%xmm1
+ DB 196,1,113,196,76,81,22,2 ; vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,26 ; jb 1f0d <_sk_load_tables_rgb_u16_be_hsw+0x14f>
+ DB 196,129,121,110,76,81,24 ; vmovd 0x18(%r9,%r10,2),%xmm1
+ DB 196,129,113,196,76,81,28,2 ; vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 117,10 ; jne 1f12 <_sk_load_tables_rgb_u16_be_hsw+0x154>
+ DB 233,247,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 233,242,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 196,129,121,110,92,81,30 ; vmovd 0x1e(%r9,%r10,2),%xmm3
+ DB 196,1,97,196,92,81,34,2 ; vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,20 ; jb 1f3b <_sk_load_tables_rgb_u16_be_hsw+0x17d>
+ DB 196,129,121,110,92,81,36 ; vmovd 0x24(%r9,%r10,2),%xmm3
+ DB 196,129,97,196,92,81,40,2 ; vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3
+ DB 233,201,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
+ DB 233,196,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46>
PUBLIC _sk_byte_tables_hsw
_sk_byte_tables_hsw LABEL PROC
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,159,44,0,0 ; vbroadcastss 0x2c9f(%rip),%ymm8 # 4be0 <_sk_callback_hsw+0x266>
+ DB 196,98,125,24,5,145,44,0,0 ; vbroadcastss 0x2c91(%rip),%ymm8 # 4bdc <_sk_callback_hsw+0x270>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 68,137,197 ; mov %r8d,%ebp
- DB 77,137,194 ; mov %r8,%r10
+ DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
+ DB 196,65,249,126,201 ; vmovq %xmm9,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,131,121,32,4,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ DB 196,67,249,22,202,1 ; vpextrq $0x1,%xmm9,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,121,32,20,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ DB 69,137,209 ; mov %r10d,%r9d
DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,192 ; vmovq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,199 ; mov %r8,%r15
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 69,137,198 ; mov %r8d,%r14d
- DB 77,137,196 ; mov %r8,%r12
- DB 73,193,236,32 ; shr $0x20,%r12
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,221 ; mov %ebx,%r13d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,57,1 ; vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,41 ; movzbl (%r9,%r13,1),%ebp
- DB 196,227,121,32,197,4 ; vpinsrb $0x4,%ebp,%xmm0,%xmm0
- DB 65,15,182,44,25 ; movzbl (%r9,%rbx,1),%ebp
- DB 196,227,121,32,197,5 ; vpinsrb $0x5,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,49 ; movzbl (%r9,%r14,1),%ebp
- DB 196,227,121,32,197,6 ; vpinsrb $0x6,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,33 ; movzbl (%r9,%r12,1),%ebp
- DB 196,227,121,32,197,7 ; vpinsrb $0x7,%ebp,%xmm0,%xmm0
- DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,240,43,0,0 ; vbroadcastss 0x2bf0(%rip),%ymm9 # 4be4 <_sk_callback_hsw+0x26a>
- DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
+ DB 196,99,125,57,200,1 ; vextracti128 $0x1,%ymm9,%xmm0
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,67,41,32,201,2 ; vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,3 ; vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,4 ; vpinsrb $0x4,%r10d,%xmm9,%xmm9
+ DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,49,32,193,5 ; vpinsrb $0x5,%r9d,%xmm9,%xmm0
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,121,32,193,6 ; vpinsrb $0x6,%r9d,%xmm0,%xmm0
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,121,32,202,7 ; vpinsrb $0x7,%r10d,%xmm0,%xmm9
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
- DB 196,227,249,22,205,1 ; vpextrq $0x1,%xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,121,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,201,1 ; vextracti128 $0x1,%ymm1,%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,121,32,195,3 ; vpinsrb $0x3,%r11d,%xmm0,%xmm0
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,121,32,195,4 ; vpinsrb $0x4,%r11d,%xmm0,%xmm0
DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,5 ; vpinsrb $0x5,%r10d,%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,207 ; vmovq %xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,12,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- DB 196,195,113,32,12,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,32 ; movzbl (%r8,%r12,1),%ebp
- DB 196,227,113,32,205,4 ; vpinsrb $0x4,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,56 ; movzbl (%r8,%r15,1),%ebp
- DB 196,227,113,32,205,5 ; vpinsrb $0x5,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,113,32,205,6 ; vpinsrb $0x6,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,113,32,205,7 ; vpinsrb $0x7,%ebp,%xmm1,%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,6 ; vpinsrb $0x6,%r10d,%xmm0,%xmm0
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,195,121,32,201,7 ; vpinsrb $0x7,%r9d,%xmm0,%xmm1
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 196,193,108,89,192 ; vmulps %ymm8,%ymm2,%ymm0
+ DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,20,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,105,32,20,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm2
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,105,32,210,2 ; vpinsrb $0x2,%r10d,%xmm2,%xmm2
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,105,32,211,3 ; vpinsrb $0x3,%r11d,%xmm2,%xmm2
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,105,32,211,4 ; vpinsrb $0x4,%r11d,%xmm2,%xmm2
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,105,32,194,5 ; vpinsrb $0x5,%r10d,%xmm2,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,6 ; vpinsrb $0x6,%r10d,%xmm0,%xmm0
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,195,121,32,209,7 ; vpinsrb $0x7,%r9d,%xmm0,%xmm2
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
+ DB 196,193,100,89,192 ; vmulps %ymm8,%ymm3,%ymm0
+ DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,28,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
+ DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,97,32,28,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm3,%xmm3
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
+ DB 71,15,182,12,10 ; movzbl (%r10,%r9,1),%r9d
+ DB 196,195,97,32,217,2 ; vpinsrb $0x2,%r9d,%xmm3,%xmm3
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,97,32,216,3 ; vpinsrb $0x3,%eax,%xmm3,%xmm3
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,97,32,216,4 ; vpinsrb $0x4,%eax,%xmm3,%xmm3
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 67,15,182,4,10 ; movzbl (%r10,%r9,1),%eax
+ DB 196,227,97,32,192,5 ; vpinsrb $0x5,%eax,%xmm3,%xmm0
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,121,32,216,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm3
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
+ DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0
+ DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
+ DB 196,98,125,24,5,54,42,0,0 ; vbroadcastss 0x2a36(%rip),%ymm8 # 4be0 <_sk_callback_hsw+0x274>
+ DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,57,210,1 ; vextracti128 $0x1,%ymm2,%xmm2
- DB 196,195,249,22,211,1 ; vpextrq $0x1,%xmm2,%r11
- DB 69,137,222 ; mov %r11d,%r14d
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,215 ; vmovq %xmm2,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,20,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm2
- DB 196,195,105,32,20,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm2,%xmm2
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,105,32,211,2 ; vpinsrb $0x2,%ebx,%xmm2,%xmm2
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,105,32,213,3 ; vpinsrb $0x3,%ebp,%xmm2,%xmm2
- DB 67,15,182,44,32 ; movzbl (%r8,%r12,1),%ebp
- DB 196,227,105,32,213,4 ; vpinsrb $0x4,%ebp,%xmm2,%xmm2
- DB 67,15,182,44,56 ; movzbl (%r8,%r15,1),%ebp
- DB 196,227,105,32,213,5 ; vpinsrb $0x5,%ebp,%xmm2,%xmm2
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,105,32,213,6 ; vpinsrb $0x6,%ebp,%xmm2,%xmm2
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,105,32,213,7 ; vpinsrb $0x7,%ebp,%xmm2,%xmm2
+ DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 196,226,125,49,210 ; vpmovzxbd %xmm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,193,108,89,209 ; vmulps %ymm9,%ymm2,%ymm2
- DB 72,139,64,24 ; mov 0x18(%rax),%rax
- DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
- DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
- DB 196,227,249,22,221,1 ; vpextrq $0x1,%xmm3,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,219 ; vmovq %xmm3,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,57,219,1 ; vextracti128 $0x1,%ymm3,%xmm3
- DB 196,195,249,22,218,1 ; vpextrq $0x1,%xmm3,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,222 ; vmovq %xmm3,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 196,163,121,32,28,8,0 ; vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm3
- DB 196,227,97,32,28,24,1 ; vpinsrb $0x1,(%rax,%rbx,1),%xmm3,%xmm3
- DB 66,15,182,28,0 ; movzbl (%rax,%r8,1),%ebx
- DB 196,227,97,32,219,2 ; vpinsrb $0x2,%ebx,%xmm3,%xmm3
- DB 15,182,44,40 ; movzbl (%rax,%rbp,1),%ebp
- DB 196,227,97,32,221,3 ; vpinsrb $0x3,%ebp,%xmm3,%xmm3
- DB 66,15,182,44,56 ; movzbl (%rax,%r15,1),%ebp
- DB 196,227,97,32,221,4 ; vpinsrb $0x4,%ebp,%xmm3,%xmm3
- DB 66,15,182,44,48 ; movzbl (%rax,%r14,1),%ebp
- DB 196,227,97,32,221,5 ; vpinsrb $0x5,%ebp,%xmm3,%xmm3
- DB 66,15,182,44,24 ; movzbl (%rax,%r11,1),%ebp
- DB 196,227,97,32,221,6 ; vpinsrb $0x6,%ebp,%xmm3,%xmm3
- DB 66,15,182,4,16 ; movzbl (%rax,%r10,1),%eax
+ DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 196,227,97,32,216,7 ; vpinsrb $0x7,%eax,%xmm3,%xmm3
DB 196,226,125,49,219 ; vpmovzxbd %xmm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,193,100,89,217 ; vmulps %ymm9,%ymm3,%ymm3
+ DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_byte_tables_rgb_hsw
_sk_byte_tables_rgb_hsw LABEL PROC
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,139,64,24 ; mov 0x18(%rax),%r8d
- DB 65,255,200 ; dec %r8d
- DB 196,65,121,110,192 ; vmovd %r8d,%xmm8
+ DB 68,139,72,24 ; mov 0x18(%rax),%r9d
+ DB 65,255,201 ; dec %r9d
+ DB 196,65,121,110,193 ; vmovd %r9d,%xmm8
DB 196,66,125,88,192 ; vpbroadcastd %xmm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 68,137,197 ; mov %r8d,%ebp
- DB 77,137,194 ; mov %r8,%r10
+ DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
+ DB 196,65,249,126,201 ; vmovq %xmm9,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,131,121,32,4,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ DB 196,67,249,22,202,1 ; vpextrq $0x1,%xmm9,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,121,32,20,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ DB 69,137,209 ; mov %r10d,%r9d
DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,192 ; vmovq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,199 ; mov %r8,%r15
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 69,137,198 ; mov %r8d,%r14d
- DB 77,137,196 ; mov %r8,%r12
- DB 73,193,236,32 ; shr $0x20,%r12
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,221 ; mov %ebx,%r13d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,57,1 ; vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,41 ; movzbl (%r9,%r13,1),%ebp
- DB 196,227,121,32,197,4 ; vpinsrb $0x4,%ebp,%xmm0,%xmm0
- DB 65,15,182,44,25 ; movzbl (%r9,%rbx,1),%ebp
- DB 196,227,121,32,197,5 ; vpinsrb $0x5,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,49 ; movzbl (%r9,%r14,1),%ebp
- DB 196,227,121,32,197,6 ; vpinsrb $0x6,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,33 ; movzbl (%r9,%r12,1),%ebp
- DB 196,227,121,32,197,7 ; vpinsrb $0x7,%ebp,%xmm0,%xmm0
- DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,41,41,0,0 ; vbroadcastss 0x2929(%rip),%ymm9 # 4be8 <_sk_callback_hsw+0x26e>
- DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
+ DB 196,99,125,57,200,1 ; vextracti128 $0x1,%ymm9,%xmm0
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,67,41,32,201,2 ; vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,3 ; vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,4 ; vpinsrb $0x4,%r10d,%xmm9,%xmm9
+ DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,49,32,193,5 ; vpinsrb $0x5,%r9d,%xmm9,%xmm0
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,121,32,193,6 ; vpinsrb $0x6,%r9d,%xmm0,%xmm0
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,121,32,202,7 ; vpinsrb $0x7,%r10d,%xmm0,%xmm9
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
- DB 196,227,249,22,205,1 ; vpextrq $0x1,%xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,121,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,201,1 ; vextracti128 $0x1,%ymm1,%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,121,32,195,3 ; vpinsrb $0x3,%r11d,%xmm0,%xmm0
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,195,121,32,195,4 ; vpinsrb $0x4,%r11d,%xmm0,%xmm0
DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,5 ; vpinsrb $0x5,%r10d,%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,6 ; vpinsrb $0x6,%r10d,%xmm0,%xmm0
DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,207 ; vmovq %xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,12,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- DB 196,195,113,32,12,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,32 ; movzbl (%r8,%r12,1),%ebp
- DB 196,227,113,32,205,4 ; vpinsrb $0x4,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,56 ; movzbl (%r8,%r15,1),%ebp
- DB 196,227,113,32,205,5 ; vpinsrb $0x5,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,113,32,205,6 ; vpinsrb $0x6,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,113,32,205,7 ; vpinsrb $0x7,%ebp,%xmm1,%xmm1
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,195,121,32,201,7 ; vpinsrb $0x7,%r9d,%xmm0,%xmm1
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
+ DB 197,188,89,194 ; vmulps %ymm2,%ymm8,%ymm0
+ DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,20,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
+ DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,105,32,20,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm2,%xmm2
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
+ DB 71,15,182,12,10 ; movzbl (%r10,%r9,1),%r9d
+ DB 196,195,105,32,209,2 ; vpinsrb $0x2,%r9d,%xmm2,%xmm2
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,105,32,208,3 ; vpinsrb $0x3,%eax,%xmm2,%xmm2
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,105,32,208,4 ; vpinsrb $0x4,%eax,%xmm2,%xmm2
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 67,15,182,4,10 ; movzbl (%r10,%r9,1),%eax
+ DB 196,227,105,32,192,5 ; vpinsrb $0x5,%eax,%xmm2,%xmm0
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,227,121,32,208,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm2
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
+ DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0
+ DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
+ DB 196,98,125,24,5,34,40,0,0 ; vbroadcastss 0x2822(%rip),%ymm8 # 4be4 <_sk_callback_hsw+0x278>
+ DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
- DB 72,139,64,16 ; mov 0x10(%rax),%rax
- DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
- DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,57,210,1 ; vextracti128 $0x1,%ymm2,%xmm2
- DB 196,195,249,22,210,1 ; vpextrq $0x1,%xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,214 ; vmovq %xmm2,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 196,163,121,32,20,8,0 ; vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm2
- DB 196,227,105,32,20,24,1 ; vpinsrb $0x1,(%rax,%rbx,1),%xmm2,%xmm2
- DB 66,15,182,28,0 ; movzbl (%rax,%r8,1),%ebx
- DB 196,227,105,32,211,2 ; vpinsrb $0x2,%ebx,%xmm2,%xmm2
- DB 15,182,44,40 ; movzbl (%rax,%rbp,1),%ebp
- DB 196,227,105,32,213,3 ; vpinsrb $0x3,%ebp,%xmm2,%xmm2
- DB 66,15,182,44,56 ; movzbl (%rax,%r15,1),%ebp
- DB 196,227,105,32,213,4 ; vpinsrb $0x4,%ebp,%xmm2,%xmm2
- DB 66,15,182,44,48 ; movzbl (%rax,%r14,1),%ebp
- DB 196,227,105,32,213,5 ; vpinsrb $0x5,%ebp,%xmm2,%xmm2
- DB 66,15,182,44,24 ; movzbl (%rax,%r11,1),%ebp
- DB 196,227,105,32,213,6 ; vpinsrb $0x6,%ebp,%xmm2,%xmm2
- DB 66,15,182,4,16 ; movzbl (%rax,%r10,1),%eax
+ DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 196,227,105,32,208,7 ; vpinsrb $0x7,%eax,%xmm2,%xmm2
DB 196,226,125,49,210 ; vpmovzxbd %xmm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,193,108,89,209 ; vmulps %ymm9,%ymm2,%ymm2
+ DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_r_hsw
_sk_table_r_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -2185,14 +2166,14 @@ _sk_table_r_hsw LABEL PROC
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,125,91,192 ; vcvtps2dq %ymm0,%ymm8
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
- DB 196,130,53,146,4,128 ; vgatherdps %ymm9,(%r8,%ymm8,4),%ymm0
+ DB 196,130,53,146,4,129 ; vgatherdps %ymm9,(%r9,%ymm8,4),%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_g_hsw
_sk_table_g_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -2201,14 +2182,14 @@ _sk_table_g_hsw LABEL PROC
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,125,91,193 ; vcvtps2dq %ymm1,%ymm8
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
- DB 196,130,53,146,12,128 ; vgatherdps %ymm9,(%r8,%ymm8,4),%ymm1
+ DB 196,130,53,146,12,129 ; vgatherdps %ymm9,(%r9,%ymm8,4),%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_b_hsw
_sk_table_b_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -2217,14 +2198,14 @@ _sk_table_b_hsw LABEL PROC
DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
DB 197,125,91,194 ; vcvtps2dq %ymm2,%ymm8
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
- DB 196,130,53,146,20,128 ; vgatherdps %ymm9,(%r8,%ymm8,4),%ymm2
+ DB 196,130,53,146,20,129 ; vgatherdps %ymm9,(%r9,%ymm8,4),%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_a_hsw
_sk_table_a_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -2233,7 +2214,7 @@ _sk_table_a_hsw LABEL PROC
DB 197,188,89,219 ; vmulps %ymm3,%ymm8,%ymm3
DB 197,125,91,195 ; vcvtps2dq %ymm3,%ymm8
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
- DB 196,130,53,146,28,128 ; vgatherdps %ymm9,(%r8,%ymm8,4),%ymm3
+ DB 196,130,53,146,28,129 ; vgatherdps %ymm9,(%r9,%ymm8,4),%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2250,33 +2231,33 @@ _sk_parametric_r_hsw LABEL PROC
DB 196,66,125,168,211 ; vfmadd213ps %ymm11,%ymm0,%ymm10
DB 196,226,125,24,0 ; vbroadcastss (%rax),%ymm0
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,220,38,0,0 ; vbroadcastss 0x26dc(%rip),%ymm12 # 4bec <_sk_callback_hsw+0x272>
- DB 196,98,125,24,45,215,38,0,0 ; vbroadcastss 0x26d7(%rip),%ymm13 # 4bf0 <_sk_callback_hsw+0x276>
+ DB 196,98,125,24,37,252,38,0,0 ; vbroadcastss 0x26fc(%rip),%ymm12 # 4be8 <_sk_callback_hsw+0x27c>
+ DB 196,98,125,24,45,247,38,0,0 ; vbroadcastss 0x26f7(%rip),%ymm13 # 4bec <_sk_callback_hsw+0x280>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,205,38,0,0 ; vbroadcastss 0x26cd(%rip),%ymm13 # 4bf4 <_sk_callback_hsw+0x27a>
+ DB 196,98,125,24,45,237,38,0,0 ; vbroadcastss 0x26ed(%rip),%ymm13 # 4bf0 <_sk_callback_hsw+0x284>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,195,38,0,0 ; vbroadcastss 0x26c3(%rip),%ymm13 # 4bf8 <_sk_callback_hsw+0x27e>
+ DB 196,98,125,24,45,227,38,0,0 ; vbroadcastss 0x26e3(%rip),%ymm13 # 4bf4 <_sk_callback_hsw+0x288>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,185,38,0,0 ; vbroadcastss 0x26b9(%rip),%ymm11 # 4bfc <_sk_callback_hsw+0x282>
+ DB 196,98,125,24,29,217,38,0,0 ; vbroadcastss 0x26d9(%rip),%ymm11 # 4bf8 <_sk_callback_hsw+0x28c>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,175,38,0,0 ; vbroadcastss 0x26af(%rip),%ymm12 # 4c00 <_sk_callback_hsw+0x286>
+ DB 196,98,125,24,37,207,38,0,0 ; vbroadcastss 0x26cf(%rip),%ymm12 # 4bfc <_sk_callback_hsw+0x290>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,165,38,0,0 ; vbroadcastss 0x26a5(%rip),%ymm12 # 4c04 <_sk_callback_hsw+0x28a>
+ DB 196,98,125,24,37,197,38,0,0 ; vbroadcastss 0x26c5(%rip),%ymm12 # 4c00 <_sk_callback_hsw+0x294>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,134,38,0,0 ; vbroadcastss 0x2686(%rip),%ymm11 # 4c08 <_sk_callback_hsw+0x28e>
+ DB 196,98,125,24,29,166,38,0,0 ; vbroadcastss 0x26a6(%rip),%ymm11 # 4c04 <_sk_callback_hsw+0x298>
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,124,38,0,0 ; vbroadcastss 0x267c(%rip),%ymm11 # 4c0c <_sk_callback_hsw+0x292>
+ DB 196,98,125,24,29,156,38,0,0 ; vbroadcastss 0x269c(%rip),%ymm11 # 4c08 <_sk_callback_hsw+0x29c>
DB 196,98,45,172,216 ; vfnmadd213ps %ymm0,%ymm10,%ymm11
- DB 196,226,125,24,5,114,38,0,0 ; vbroadcastss 0x2672(%rip),%ymm0 # 4c10 <_sk_callback_hsw+0x296>
+ DB 196,226,125,24,5,146,38,0,0 ; vbroadcastss 0x2692(%rip),%ymm0 # 4c0c <_sk_callback_hsw+0x2a0>
DB 196,193,124,92,194 ; vsubps %ymm10,%ymm0,%ymm0
- DB 196,98,125,24,21,104,38,0,0 ; vbroadcastss 0x2668(%rip),%ymm10 # 4c14 <_sk_callback_hsw+0x29a>
+ DB 196,98,125,24,21,136,38,0,0 ; vbroadcastss 0x2688(%rip),%ymm10 # 4c10 <_sk_callback_hsw+0x2a4>
DB 197,172,94,192 ; vdivps %ymm0,%ymm10,%ymm0
DB 197,164,88,192 ; vaddps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,21,91,38,0,0 ; vbroadcastss 0x265b(%rip),%ymm10 # 4c18 <_sk_callback_hsw+0x29e>
+ DB 196,98,125,24,21,123,38,0,0 ; vbroadcastss 0x267b(%rip),%ymm10 # 4c14 <_sk_callback_hsw+0x2a8>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2284,7 +2265,7 @@ _sk_parametric_r_hsw LABEL PROC
DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,50,38,0,0 ; vbroadcastss 0x2632(%rip),%ymm8 # 4c1c <_sk_callback_hsw+0x2a2>
+ DB 196,98,125,24,5,82,38,0,0 ; vbroadcastss 0x2652(%rip),%ymm8 # 4c18 <_sk_callback_hsw+0x2ac>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2302,33 +2283,33 @@ _sk_parametric_g_hsw LABEL PROC
DB 196,66,117,168,211 ; vfmadd213ps %ymm11,%ymm1,%ymm10
DB 196,226,125,24,8 ; vbroadcastss (%rax),%ymm1
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,234,37,0,0 ; vbroadcastss 0x25ea(%rip),%ymm12 # 4c20 <_sk_callback_hsw+0x2a6>
- DB 196,98,125,24,45,229,37,0,0 ; vbroadcastss 0x25e5(%rip),%ymm13 # 4c24 <_sk_callback_hsw+0x2aa>
+ DB 196,98,125,24,37,10,38,0,0 ; vbroadcastss 0x260a(%rip),%ymm12 # 4c1c <_sk_callback_hsw+0x2b0>
+ DB 196,98,125,24,45,5,38,0,0 ; vbroadcastss 0x2605(%rip),%ymm13 # 4c20 <_sk_callback_hsw+0x2b4>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,219,37,0,0 ; vbroadcastss 0x25db(%rip),%ymm13 # 4c28 <_sk_callback_hsw+0x2ae>
+ DB 196,98,125,24,45,251,37,0,0 ; vbroadcastss 0x25fb(%rip),%ymm13 # 4c24 <_sk_callback_hsw+0x2b8>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,209,37,0,0 ; vbroadcastss 0x25d1(%rip),%ymm13 # 4c2c <_sk_callback_hsw+0x2b2>
+ DB 196,98,125,24,45,241,37,0,0 ; vbroadcastss 0x25f1(%rip),%ymm13 # 4c28 <_sk_callback_hsw+0x2bc>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,199,37,0,0 ; vbroadcastss 0x25c7(%rip),%ymm11 # 4c30 <_sk_callback_hsw+0x2b6>
+ DB 196,98,125,24,29,231,37,0,0 ; vbroadcastss 0x25e7(%rip),%ymm11 # 4c2c <_sk_callback_hsw+0x2c0>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,189,37,0,0 ; vbroadcastss 0x25bd(%rip),%ymm12 # 4c34 <_sk_callback_hsw+0x2ba>
+ DB 196,98,125,24,37,221,37,0,0 ; vbroadcastss 0x25dd(%rip),%ymm12 # 4c30 <_sk_callback_hsw+0x2c4>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,179,37,0,0 ; vbroadcastss 0x25b3(%rip),%ymm12 # 4c38 <_sk_callback_hsw+0x2be>
+ DB 196,98,125,24,37,211,37,0,0 ; vbroadcastss 0x25d3(%rip),%ymm12 # 4c34 <_sk_callback_hsw+0x2c8>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10
DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10
- DB 196,98,125,24,29,148,37,0,0 ; vbroadcastss 0x2594(%rip),%ymm11 # 4c3c <_sk_callback_hsw+0x2c2>
+ DB 196,98,125,24,29,180,37,0,0 ; vbroadcastss 0x25b4(%rip),%ymm11 # 4c38 <_sk_callback_hsw+0x2cc>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,138,37,0,0 ; vbroadcastss 0x258a(%rip),%ymm11 # 4c40 <_sk_callback_hsw+0x2c6>
+ DB 196,98,125,24,29,170,37,0,0 ; vbroadcastss 0x25aa(%rip),%ymm11 # 4c3c <_sk_callback_hsw+0x2d0>
DB 196,98,45,172,217 ; vfnmadd213ps %ymm1,%ymm10,%ymm11
- DB 196,226,125,24,13,128,37,0,0 ; vbroadcastss 0x2580(%rip),%ymm1 # 4c44 <_sk_callback_hsw+0x2ca>
+ DB 196,226,125,24,13,160,37,0,0 ; vbroadcastss 0x25a0(%rip),%ymm1 # 4c40 <_sk_callback_hsw+0x2d4>
DB 196,193,116,92,202 ; vsubps %ymm10,%ymm1,%ymm1
- DB 196,98,125,24,21,118,37,0,0 ; vbroadcastss 0x2576(%rip),%ymm10 # 4c48 <_sk_callback_hsw+0x2ce>
+ DB 196,98,125,24,21,150,37,0,0 ; vbroadcastss 0x2596(%rip),%ymm10 # 4c44 <_sk_callback_hsw+0x2d8>
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 197,164,88,201 ; vaddps %ymm1,%ymm11,%ymm1
- DB 196,98,125,24,21,105,37,0,0 ; vbroadcastss 0x2569(%rip),%ymm10 # 4c4c <_sk_callback_hsw+0x2d2>
+ DB 196,98,125,24,21,137,37,0,0 ; vbroadcastss 0x2589(%rip),%ymm10 # 4c48 <_sk_callback_hsw+0x2dc>
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2336,7 +2317,7 @@ _sk_parametric_g_hsw LABEL PROC
DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,5,64,37,0,0 ; vbroadcastss 0x2540(%rip),%ymm8 # 4c50 <_sk_callback_hsw+0x2d6>
+ DB 196,98,125,24,5,96,37,0,0 ; vbroadcastss 0x2560(%rip),%ymm8 # 4c4c <_sk_callback_hsw+0x2e0>
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2354,33 +2335,33 @@ _sk_parametric_b_hsw LABEL PROC
DB 196,66,109,168,211 ; vfmadd213ps %ymm11,%ymm2,%ymm10
DB 196,226,125,24,16 ; vbroadcastss (%rax),%ymm2
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,248,36,0,0 ; vbroadcastss 0x24f8(%rip),%ymm12 # 4c54 <_sk_callback_hsw+0x2da>
- DB 196,98,125,24,45,243,36,0,0 ; vbroadcastss 0x24f3(%rip),%ymm13 # 4c58 <_sk_callback_hsw+0x2de>
+ DB 196,98,125,24,37,24,37,0,0 ; vbroadcastss 0x2518(%rip),%ymm12 # 4c50 <_sk_callback_hsw+0x2e4>
+ DB 196,98,125,24,45,19,37,0,0 ; vbroadcastss 0x2513(%rip),%ymm13 # 4c54 <_sk_callback_hsw+0x2e8>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,233,36,0,0 ; vbroadcastss 0x24e9(%rip),%ymm13 # 4c5c <_sk_callback_hsw+0x2e2>
+ DB 196,98,125,24,45,9,37,0,0 ; vbroadcastss 0x2509(%rip),%ymm13 # 4c58 <_sk_callback_hsw+0x2ec>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,223,36,0,0 ; vbroadcastss 0x24df(%rip),%ymm13 # 4c60 <_sk_callback_hsw+0x2e6>
+ DB 196,98,125,24,45,255,36,0,0 ; vbroadcastss 0x24ff(%rip),%ymm13 # 4c5c <_sk_callback_hsw+0x2f0>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,213,36,0,0 ; vbroadcastss 0x24d5(%rip),%ymm11 # 4c64 <_sk_callback_hsw+0x2ea>
+ DB 196,98,125,24,29,245,36,0,0 ; vbroadcastss 0x24f5(%rip),%ymm11 # 4c60 <_sk_callback_hsw+0x2f4>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,203,36,0,0 ; vbroadcastss 0x24cb(%rip),%ymm12 # 4c68 <_sk_callback_hsw+0x2ee>
+ DB 196,98,125,24,37,235,36,0,0 ; vbroadcastss 0x24eb(%rip),%ymm12 # 4c64 <_sk_callback_hsw+0x2f8>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,193,36,0,0 ; vbroadcastss 0x24c1(%rip),%ymm12 # 4c6c <_sk_callback_hsw+0x2f2>
+ DB 196,98,125,24,37,225,36,0,0 ; vbroadcastss 0x24e1(%rip),%ymm12 # 4c68 <_sk_callback_hsw+0x2fc>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10
DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10
- DB 196,98,125,24,29,162,36,0,0 ; vbroadcastss 0x24a2(%rip),%ymm11 # 4c70 <_sk_callback_hsw+0x2f6>
+ DB 196,98,125,24,29,194,36,0,0 ; vbroadcastss 0x24c2(%rip),%ymm11 # 4c6c <_sk_callback_hsw+0x300>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,152,36,0,0 ; vbroadcastss 0x2498(%rip),%ymm11 # 4c74 <_sk_callback_hsw+0x2fa>
+ DB 196,98,125,24,29,184,36,0,0 ; vbroadcastss 0x24b8(%rip),%ymm11 # 4c70 <_sk_callback_hsw+0x304>
DB 196,98,45,172,218 ; vfnmadd213ps %ymm2,%ymm10,%ymm11
- DB 196,226,125,24,21,142,36,0,0 ; vbroadcastss 0x248e(%rip),%ymm2 # 4c78 <_sk_callback_hsw+0x2fe>
+ DB 196,226,125,24,21,174,36,0,0 ; vbroadcastss 0x24ae(%rip),%ymm2 # 4c74 <_sk_callback_hsw+0x308>
DB 196,193,108,92,210 ; vsubps %ymm10,%ymm2,%ymm2
- DB 196,98,125,24,21,132,36,0,0 ; vbroadcastss 0x2484(%rip),%ymm10 # 4c7c <_sk_callback_hsw+0x302>
+ DB 196,98,125,24,21,164,36,0,0 ; vbroadcastss 0x24a4(%rip),%ymm10 # 4c78 <_sk_callback_hsw+0x30c>
DB 197,172,94,210 ; vdivps %ymm2,%ymm10,%ymm2
DB 197,164,88,210 ; vaddps %ymm2,%ymm11,%ymm2
- DB 196,98,125,24,21,119,36,0,0 ; vbroadcastss 0x2477(%rip),%ymm10 # 4c80 <_sk_callback_hsw+0x306>
+ DB 196,98,125,24,21,151,36,0,0 ; vbroadcastss 0x2497(%rip),%ymm10 # 4c7c <_sk_callback_hsw+0x310>
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2388,7 +2369,7 @@ _sk_parametric_b_hsw LABEL PROC
DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,78,36,0,0 ; vbroadcastss 0x244e(%rip),%ymm8 # 4c84 <_sk_callback_hsw+0x30a>
+ DB 196,98,125,24,5,110,36,0,0 ; vbroadcastss 0x246e(%rip),%ymm8 # 4c80 <_sk_callback_hsw+0x314>
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2406,33 +2387,33 @@ _sk_parametric_a_hsw LABEL PROC
DB 196,66,101,168,211 ; vfmadd213ps %ymm11,%ymm3,%ymm10
DB 196,226,125,24,24 ; vbroadcastss (%rax),%ymm3
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,6,36,0,0 ; vbroadcastss 0x2406(%rip),%ymm12 # 4c88 <_sk_callback_hsw+0x30e>
- DB 196,98,125,24,45,1,36,0,0 ; vbroadcastss 0x2401(%rip),%ymm13 # 4c8c <_sk_callback_hsw+0x312>
+ DB 196,98,125,24,37,38,36,0,0 ; vbroadcastss 0x2426(%rip),%ymm12 # 4c84 <_sk_callback_hsw+0x318>
+ DB 196,98,125,24,45,33,36,0,0 ; vbroadcastss 0x2421(%rip),%ymm13 # 4c88 <_sk_callback_hsw+0x31c>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,247,35,0,0 ; vbroadcastss 0x23f7(%rip),%ymm13 # 4c90 <_sk_callback_hsw+0x316>
+ DB 196,98,125,24,45,23,36,0,0 ; vbroadcastss 0x2417(%rip),%ymm13 # 4c8c <_sk_callback_hsw+0x320>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,237,35,0,0 ; vbroadcastss 0x23ed(%rip),%ymm13 # 4c94 <_sk_callback_hsw+0x31a>
+ DB 196,98,125,24,45,13,36,0,0 ; vbroadcastss 0x240d(%rip),%ymm13 # 4c90 <_sk_callback_hsw+0x324>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,227,35,0,0 ; vbroadcastss 0x23e3(%rip),%ymm11 # 4c98 <_sk_callback_hsw+0x31e>
+ DB 196,98,125,24,29,3,36,0,0 ; vbroadcastss 0x2403(%rip),%ymm11 # 4c94 <_sk_callback_hsw+0x328>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,217,35,0,0 ; vbroadcastss 0x23d9(%rip),%ymm12 # 4c9c <_sk_callback_hsw+0x322>
+ DB 196,98,125,24,37,249,35,0,0 ; vbroadcastss 0x23f9(%rip),%ymm12 # 4c98 <_sk_callback_hsw+0x32c>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,207,35,0,0 ; vbroadcastss 0x23cf(%rip),%ymm12 # 4ca0 <_sk_callback_hsw+0x326>
+ DB 196,98,125,24,37,239,35,0,0 ; vbroadcastss 0x23ef(%rip),%ymm12 # 4c9c <_sk_callback_hsw+0x330>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10
DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10
- DB 196,98,125,24,29,176,35,0,0 ; vbroadcastss 0x23b0(%rip),%ymm11 # 4ca4 <_sk_callback_hsw+0x32a>
+ DB 196,98,125,24,29,208,35,0,0 ; vbroadcastss 0x23d0(%rip),%ymm11 # 4ca0 <_sk_callback_hsw+0x334>
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,166,35,0,0 ; vbroadcastss 0x23a6(%rip),%ymm11 # 4ca8 <_sk_callback_hsw+0x32e>
+ DB 196,98,125,24,29,198,35,0,0 ; vbroadcastss 0x23c6(%rip),%ymm11 # 4ca4 <_sk_callback_hsw+0x338>
DB 196,98,45,172,219 ; vfnmadd213ps %ymm3,%ymm10,%ymm11
- DB 196,226,125,24,29,156,35,0,0 ; vbroadcastss 0x239c(%rip),%ymm3 # 4cac <_sk_callback_hsw+0x332>
+ DB 196,226,125,24,29,188,35,0,0 ; vbroadcastss 0x23bc(%rip),%ymm3 # 4ca8 <_sk_callback_hsw+0x33c>
DB 196,193,100,92,218 ; vsubps %ymm10,%ymm3,%ymm3
- DB 196,98,125,24,21,146,35,0,0 ; vbroadcastss 0x2392(%rip),%ymm10 # 4cb0 <_sk_callback_hsw+0x336>
+ DB 196,98,125,24,21,178,35,0,0 ; vbroadcastss 0x23b2(%rip),%ymm10 # 4cac <_sk_callback_hsw+0x340>
DB 197,172,94,219 ; vdivps %ymm3,%ymm10,%ymm3
DB 197,164,88,219 ; vaddps %ymm3,%ymm11,%ymm3
- DB 196,98,125,24,21,133,35,0,0 ; vbroadcastss 0x2385(%rip),%ymm10 # 4cb4 <_sk_callback_hsw+0x33a>
+ DB 196,98,125,24,21,165,35,0,0 ; vbroadcastss 0x23a5(%rip),%ymm10 # 4cb0 <_sk_callback_hsw+0x344>
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2440,33 +2421,33 @@ _sk_parametric_a_hsw LABEL PROC
DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3
- DB 196,98,125,24,5,92,35,0,0 ; vbroadcastss 0x235c(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x33e>
+ DB 196,98,125,24,5,124,35,0,0 ; vbroadcastss 0x237c(%rip),%ymm8 # 4cb4 <_sk_callback_hsw+0x348>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_lab_to_xyz_hsw
_sk_lab_to_xyz_hsw LABEL PROC
- DB 196,98,125,24,5,78,35,0,0 ; vbroadcastss 0x234e(%rip),%ymm8 # 4cbc <_sk_callback_hsw+0x342>
- DB 196,98,125,24,13,73,35,0,0 ; vbroadcastss 0x2349(%rip),%ymm9 # 4cc0 <_sk_callback_hsw+0x346>
- DB 196,98,125,24,21,68,35,0,0 ; vbroadcastss 0x2344(%rip),%ymm10 # 4cc4 <_sk_callback_hsw+0x34a>
+ DB 196,98,125,24,5,110,35,0,0 ; vbroadcastss 0x236e(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x34c>
+ DB 196,98,125,24,13,105,35,0,0 ; vbroadcastss 0x2369(%rip),%ymm9 # 4cbc <_sk_callback_hsw+0x350>
+ DB 196,98,125,24,21,100,35,0,0 ; vbroadcastss 0x2364(%rip),%ymm10 # 4cc0 <_sk_callback_hsw+0x354>
DB 196,194,53,168,202 ; vfmadd213ps %ymm10,%ymm9,%ymm1
DB 196,194,53,168,210 ; vfmadd213ps %ymm10,%ymm9,%ymm2
- DB 196,98,125,24,13,53,35,0,0 ; vbroadcastss 0x2335(%rip),%ymm9 # 4cc8 <_sk_callback_hsw+0x34e>
+ DB 196,98,125,24,13,85,35,0,0 ; vbroadcastss 0x2355(%rip),%ymm9 # 4cc4 <_sk_callback_hsw+0x358>
DB 196,66,125,184,200 ; vfmadd231ps %ymm8,%ymm0,%ymm9
- DB 196,226,125,24,5,43,35,0,0 ; vbroadcastss 0x232b(%rip),%ymm0 # 4ccc <_sk_callback_hsw+0x352>
+ DB 196,226,125,24,5,75,35,0,0 ; vbroadcastss 0x234b(%rip),%ymm0 # 4cc8 <_sk_callback_hsw+0x35c>
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
- DB 196,98,125,24,5,34,35,0,0 ; vbroadcastss 0x2322(%rip),%ymm8 # 4cd0 <_sk_callback_hsw+0x356>
+ DB 196,98,125,24,5,66,35,0,0 ; vbroadcastss 0x2342(%rip),%ymm8 # 4ccc <_sk_callback_hsw+0x360>
DB 196,98,117,168,192 ; vfmadd213ps %ymm0,%ymm1,%ymm8
- DB 196,98,125,24,13,24,35,0,0 ; vbroadcastss 0x2318(%rip),%ymm9 # 4cd4 <_sk_callback_hsw+0x35a>
+ DB 196,98,125,24,13,56,35,0,0 ; vbroadcastss 0x2338(%rip),%ymm9 # 4cd0 <_sk_callback_hsw+0x364>
DB 196,98,109,172,200 ; vfnmadd213ps %ymm0,%ymm2,%ymm9
DB 196,193,60,89,200 ; vmulps %ymm8,%ymm8,%ymm1
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
- DB 196,226,125,24,21,5,35,0,0 ; vbroadcastss 0x2305(%rip),%ymm2 # 4cd8 <_sk_callback_hsw+0x35e>
+ DB 196,226,125,24,21,37,35,0,0 ; vbroadcastss 0x2325(%rip),%ymm2 # 4cd4 <_sk_callback_hsw+0x368>
DB 197,108,194,209,1 ; vcmpltps %ymm1,%ymm2,%ymm10
- DB 196,98,125,24,29,251,34,0,0 ; vbroadcastss 0x22fb(%rip),%ymm11 # 4cdc <_sk_callback_hsw+0x362>
+ DB 196,98,125,24,29,27,35,0,0 ; vbroadcastss 0x231b(%rip),%ymm11 # 4cd8 <_sk_callback_hsw+0x36c>
DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8
- DB 196,98,125,24,37,241,34,0,0 ; vbroadcastss 0x22f1(%rip),%ymm12 # 4ce0 <_sk_callback_hsw+0x366>
+ DB 196,98,125,24,37,17,35,0,0 ; vbroadcastss 0x2311(%rip),%ymm12 # 4cdc <_sk_callback_hsw+0x370>
DB 196,65,60,89,196 ; vmulps %ymm12,%ymm8,%ymm8
DB 196,99,61,74,193,160 ; vblendvps %ymm10,%ymm1,%ymm8,%ymm8
DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1
@@ -2481,88 +2462,91 @@ _sk_lab_to_xyz_hsw LABEL PROC
DB 196,65,52,88,203 ; vaddps %ymm11,%ymm9,%ymm9
DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9
DB 196,227,53,74,208,32 ; vblendvps %ymm2,%ymm0,%ymm9,%ymm2
- DB 196,226,125,24,5,166,34,0,0 ; vbroadcastss 0x22a6(%rip),%ymm0 # 4ce4 <_sk_callback_hsw+0x36a>
+ DB 196,226,125,24,5,198,34,0,0 ; vbroadcastss 0x22c6(%rip),%ymm0 # 4ce0 <_sk_callback_hsw+0x374>
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,157,34,0,0 ; vbroadcastss 0x229d(%rip),%ymm8 # 4ce8 <_sk_callback_hsw+0x36e>
+ DB 196,98,125,24,5,189,34,0,0 ; vbroadcastss 0x22bd(%rip),%ymm8 # 4ce4 <_sk_callback_hsw+0x378>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_a8_hsw
_sk_load_a8_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,45 ; jne 2a91 <_sk_load_a8_hsw+0x3d>
+ DB 117,45 ; jne 2a6d <_sk_load_a8_hsw+0x3d>
DB 197,250,126,0 ; vmovq (%rax),%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,114,34,0,0 ; vbroadcastss 0x2272(%rip),%ymm1 # 4cec <_sk_callback_hsw+0x372>
+ DB 196,226,125,24,13,146,34,0,0 ; vbroadcastss 0x2292(%rip),%ymm1 # 4ce8 <_sk_callback_hsw+0x37c>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 2a99 <_sk_load_a8_hsw+0x45>
- DB 196,193,249,110,193 ; vmovq %r9,%xmm0
- DB 235,178 ; jmp 2a68 <_sk_load_a8_hsw+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 2a76 <_sk_load_a8_hsw+0x46>
+ DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 91 ; pop %rbx
+ DB 235,177 ; jmp 2a44 <_sk_load_a8_hsw+0x14>
PUBLIC _sk_gather_a8_hsw
_sk_gather_a8_hsw LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,199 ; vmovq %xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,4,24,0 ; vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,16,1 ; vpinsrb $0x1,(%r8,%r10,1),%xmm0,%xmm0
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 196,195,121,32,193,2 ; vpinsrb $0x2,%r9d,%xmm0,%xmm0
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 196,193,249,126,196 ; vmovq %xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0
- DB 67,15,182,4,32 ; movzbl (%r8,%r12,1),%eax
+ DB 67,15,182,4,41 ; movzbl (%r9,%r13,1),%eax
DB 196,227,121,32,192,4 ; vpinsrb $0x4,%eax,%xmm0,%xmm0
- DB 67,15,182,4,56 ; movzbl (%r8,%r15,1),%eax
+ DB 67,15,182,4,33 ; movzbl (%r9,%r12,1),%eax
DB 196,227,121,32,192,5 ; vpinsrb $0x5,%eax,%xmm0,%xmm0
- DB 67,15,182,4,48 ; movzbl (%r8,%r14,1),%eax
+ DB 67,15,182,4,57 ; movzbl (%r9,%r15,1),%eax
DB 196,227,121,32,192,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm0
- DB 65,15,182,4,24 ; movzbl (%r8,%rbx,1),%eax
+ DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax
DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,125,33,0,0 ; vbroadcastss 0x217d(%rip),%ymm1 # 4cf0 <_sk_callback_hsw+0x376>
+ DB 196,226,125,24,13,154,33,0,0 ; vbroadcastss 0x219a(%rip),%ymm1 # 4cec <_sk_callback_hsw+0x380>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -2570,6 +2554,7 @@ _sk_gather_a8_hsw LABEL PROC
DB 197,237,239,210 ; vpxor %ymm2,%ymm2,%ymm2
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -2577,143 +2562,146 @@ _sk_gather_a8_hsw LABEL PROC
PUBLIC _sk_store_a8_hsw
_sk_store_a8_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,88,33,0,0 ; vbroadcastss 0x2158(%rip),%ymm8 # 4cf4 <_sk_callback_hsw+0x37a>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,115,33,0,0 ; vbroadcastss 0x2173(%rip),%ymm8 # 4cf0 <_sk_callback_hsw+0x384>
DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8
DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 196,65,57,103,192 ; vpackuswb %xmm8,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 2bc5 <_sk_store_a8_hsw+0x37>
- DB 196,65,123,17,4,58 ; vmovsd %xmm8,(%r10,%rdi,1)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 2ba6 <_sk_store_a8_hsw+0x37>
+ DB 196,65,123,17,4,19 ; vmovsd %xmm8,(%r11,%rdx,1)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 2bc1 <_sk_store_a8_hsw+0x33>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 2ba2 <_sk_store_a8_hsw+0x33>
DB 196,66,121,48,192 ; vpmovzxbw %xmm8,%xmm8
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,67,0,0,0 ; lea 0x43(%rip),%r9 # 2c28 <_sk_store_a8_hsw+0x9a>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,20,68,58,6,12 ; vpextrb $0xc,%xmm8,0x6(%r10,%rdi,1)
- DB 196,67,121,20,68,58,5,10 ; vpextrb $0xa,%xmm8,0x5(%r10,%rdi,1)
- DB 196,67,121,20,68,58,4,8 ; vpextrb $0x8,%xmm8,0x4(%r10,%rdi,1)
- DB 196,67,121,20,68,58,3,6 ; vpextrb $0x6,%xmm8,0x3(%r10,%rdi,1)
- DB 196,67,121,20,68,58,2,4 ; vpextrb $0x4,%xmm8,0x2(%r10,%rdi,1)
- DB 196,67,121,20,68,58,1,2 ; vpextrb $0x2,%xmm8,0x1(%r10,%rdi,1)
- DB 196,67,121,20,4,58,0 ; vpextrb $0x0,%xmm8,(%r10,%rdi,1)
- DB 235,154 ; jmp 2bc1 <_sk_store_a8_hsw+0x33>
- DB 144 ; nop
- DB 246,255 ; idiv %bh
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 2c08 <_sk_store_a8_hsw+0x99>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,20,68,19,6,12 ; vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,5,10 ; vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,4,8 ; vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,3,6 ; vpextrb $0x6,%xmm8,0x3(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,1,2 ; vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1)
+ DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1)
+ DB 235,154 ; jmp 2ba2 <_sk_store_a8_hsw+0x33>
+ DB 247,255 ; idiv %edi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 238 ; out %al,(%dx)
+ DB 239 ; out %eax,(%dx)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,230 ; jmpq *%rsi
+ DB 255,231 ; jmpq *%rdi
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 222,255 ; fdivrp %st,%st(7)
+ DB 223,255 ; (bad)
DB 255 ; (bad)
- DB 255,214 ; callq *%rsi
+ DB 255,215 ; callq *%rdi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,206 ; dec %esi
+ DB 255,207 ; dec %edi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,198 ; inc %esi
+ DB 255,199 ; inc %edi
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
PUBLIC _sk_load_g8_hsw
_sk_load_g8_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,50 ; jne 2c86 <_sk_load_g8_hsw+0x42>
+ DB 117,50 ; jne 2c66 <_sk_load_g8_hsw+0x42>
DB 197,250,126,0 ; vmovq (%rax),%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,142,32,0,0 ; vbroadcastss 0x208e(%rip),%ymm1 # 4cf8 <_sk_callback_hsw+0x37e>
+ DB 196,226,125,24,13,170,32,0,0 ; vbroadcastss 0x20aa(%rip),%ymm1 # 4cf4 <_sk_callback_hsw+0x388>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,131,32,0,0 ; vbroadcastss 0x2083(%rip),%ymm3 # 4cfc <_sk_callback_hsw+0x382>
- DB 76,137,193 ; mov %r8,%rcx
+ DB 196,226,125,24,29,159,32,0,0 ; vbroadcastss 0x209f(%rip),%ymm3 # 4cf8 <_sk_callback_hsw+0x38c>
+ DB 76,137,201 ; mov %r9,%rcx
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 2c8e <_sk_load_g8_hsw+0x4a>
- DB 196,193,249,110,193 ; vmovq %r9,%xmm0
- DB 235,173 ; jmp 2c58 <_sk_load_g8_hsw+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 2c6f <_sk_load_g8_hsw+0x4b>
+ DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 91 ; pop %rbx
+ DB 235,172 ; jmp 2c38 <_sk_load_g8_hsw+0x14>
PUBLIC _sk_gather_g8_hsw
_sk_gather_g8_hsw LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,199 ; vmovq %xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,4,24,0 ; vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,16,1 ; vpinsrb $0x1,(%r8,%r10,1),%xmm0,%xmm0
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 196,195,121,32,193,2 ; vpinsrb $0x2,%r9d,%xmm0,%xmm0
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 196,193,249,126,196 ; vmovq %xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0
- DB 67,15,182,4,32 ; movzbl (%r8,%r12,1),%eax
+ DB 67,15,182,4,41 ; movzbl (%r9,%r13,1),%eax
DB 196,227,121,32,192,4 ; vpinsrb $0x4,%eax,%xmm0,%xmm0
- DB 67,15,182,4,56 ; movzbl (%r8,%r15,1),%eax
+ DB 67,15,182,4,33 ; movzbl (%r9,%r12,1),%eax
DB 196,227,121,32,192,5 ; vpinsrb $0x5,%eax,%xmm0,%xmm0
- DB 67,15,182,4,48 ; movzbl (%r8,%r14,1),%eax
+ DB 67,15,182,4,57 ; movzbl (%r9,%r15,1),%eax
DB 196,227,121,32,192,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm0
- DB 65,15,182,4,24 ; movzbl (%r8,%rbx,1),%eax
+ DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax
DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,152,31,0,0 ; vbroadcastss 0x1f98(%rip),%ymm1 # 4d00 <_sk_callback_hsw+0x386>
+ DB 196,226,125,24,13,177,31,0,0 ; vbroadcastss 0x1fb1(%rip),%ymm1 # 4cfc <_sk_callback_hsw+0x390>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,141,31,0,0 ; vbroadcastss 0x1f8d(%rip),%ymm3 # 4d04 <_sk_callback_hsw+0x38a>
+ DB 196,226,125,24,29,166,31,0,0 ; vbroadcastss 0x1fa6(%rip),%ymm3 # 4d00 <_sk_callback_hsw+0x394>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -2721,56 +2709,57 @@ _sk_gather_g8_hsw LABEL PROC
PUBLIC _sk_gather_i8_hsw
_sk_gather_i8_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,192 ; mov %rax,%r8
- DB 77,133,192 ; test %r8,%r8
- DB 116,5 ; je 2d97 <_sk_gather_i8_hsw+0xf>
- DB 76,137,192 ; mov %r8,%rax
- DB 235,2 ; jmp 2d99 <_sk_gather_i8_hsw+0x11>
+ DB 73,137,193 ; mov %rax,%r9
+ DB 77,133,201 ; test %r9,%r9
+ DB 116,5 ; je 2d7c <_sk_gather_i8_hsw+0xf>
+ DB 76,137,200 ; mov %r9,%rax
+ DB 235,2 ; jmp 2d7e <_sk_gather_i8_hsw+0x11>
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 76,139,8 ; mov (%rax),%r9
+ DB 76,139,16 ; mov (%rax),%r10
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,195 ; vmovq %xmm0,%r11
- DB 69,137,222 ; mov %r11d,%r14d
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
- DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
+ DB 65,137,222 ; mov %ebx,%r14d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,196 ; vmovq %xmm0,%r12
- DB 69,137,229 ; mov %r12d,%r13d
- DB 73,193,236,32 ; shr $0x20,%r12
- DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
- DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,17,2 ; vpinsrb $0x2,(%r9,%r10,1),%xmm0,%xmm0
- DB 196,195,121,32,4,1,3 ; vpinsrb $0x3,(%r9,%rax,1),%xmm0,%xmm0
- DB 196,131,121,32,4,41,4 ; vpinsrb $0x4,(%r9,%r13,1),%xmm0,%xmm0
- DB 196,131,121,32,4,33,5 ; vpinsrb $0x5,(%r9,%r12,1),%xmm0,%xmm0
- DB 196,131,121,32,4,57,6 ; vpinsrb $0x6,(%r9,%r15,1),%xmm0,%xmm0
- DB 196,195,121,32,4,25,7 ; vpinsrb $0x7,(%r9,%rbx,1),%xmm0,%xmm0
+ DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
+ DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
+ DB 69,137,252 ; mov %r15d,%r12d
+ DB 73,193,239,32 ; shr $0x20,%r15
+ DB 196,193,249,126,197 ; vmovq %xmm0,%r13
+ DB 68,137,237 ; mov %r13d,%ebp
+ DB 73,193,237,32 ; shr $0x20,%r13
+ DB 196,131,121,32,4,50,0 ; vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,26,1 ; vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,42,4 ; vpinsrb $0x4,(%r10,%rbp,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,42,5 ; vpinsrb $0x5,(%r10,%r13,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,34,6 ; vpinsrb $0x6,(%r10,%r12,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,58,7 ; vpinsrb $0x7,(%r10,%r15,1),%xmm0,%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
- DB 73,139,64,8 ; mov 0x8(%r8),%rax
+ DB 73,139,65,8 ; mov 0x8(%r9),%rax
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 196,226,117,144,28,128 ; vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3
- DB 197,229,219,5,25,33,0,0 ; vpand 0x2119(%rip),%ymm3,%ymm0 # 4f60 <_sk_callback_hsw+0x5e6>
+ DB 197,229,219,5,51,33,0,0 ; vpand 0x2133(%rip),%ymm3,%ymm0 # 4f60 <_sk_callback_hsw+0x5f4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,180,30,0,0 ; vbroadcastss 0x1eb4(%rip),%ymm8 # 4d08 <_sk_callback_hsw+0x38e>
+ DB 196,98,125,24,5,202,30,0,0 ; vbroadcastss 0x1eca(%rip),%ymm8 # 4d04 <_sk_callback_hsw+0x398>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,30,33,0,0 ; vpshufb 0x211e(%rip),%ymm3,%ymm1 # 4f80 <_sk_callback_hsw+0x606>
+ DB 196,226,101,0,13,56,33,0,0 ; vpshufb 0x2138(%rip),%ymm3,%ymm1 # 4f80 <_sk_callback_hsw+0x614>
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,44,33,0,0 ; vpshufb 0x212c(%rip),%ymm3,%ymm2 # 4fa0 <_sk_callback_hsw+0x626>
+ DB 196,226,101,0,21,70,33,0,0 ; vpshufb 0x2146(%rip),%ymm3,%ymm2 # 4fa0 <_sk_callback_hsw+0x634>
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -2782,153 +2771,158 @@ _sk_gather_i8_hsw LABEL PROC
DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_565_hsw
_sk_load_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,114 ; jne 2f14 <_sk_load_565_hsw+0x7c>
- DB 196,193,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm0
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,114 ; jne 2efb <_sk_load_565_hsw+0x7c>
+ DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2
- DB 196,226,125,88,5,86,30,0,0 ; vpbroadcastd 0x1e56(%rip),%ymm0 # 4d0c <_sk_callback_hsw+0x392>
+ DB 196,226,125,88,5,107,30,0,0 ; vpbroadcastd 0x1e6b(%rip),%ymm0 # 4d08 <_sk_callback_hsw+0x39c>
DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,73,30,0,0 ; vbroadcastss 0x1e49(%rip),%ymm1 # 4d10 <_sk_callback_hsw+0x396>
+ DB 196,226,125,24,13,94,30,0,0 ; vbroadcastss 0x1e5e(%rip),%ymm1 # 4d0c <_sk_callback_hsw+0x3a0>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,64,30,0,0 ; vpbroadcastd 0x1e40(%rip),%ymm1 # 4d14 <_sk_callback_hsw+0x39a>
+ DB 196,226,125,88,13,85,30,0,0 ; vpbroadcastd 0x1e55(%rip),%ymm1 # 4d10 <_sk_callback_hsw+0x3a4>
DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,51,30,0,0 ; vbroadcastss 0x1e33(%rip),%ymm3 # 4d18 <_sk_callback_hsw+0x39e>
+ DB 196,226,125,24,29,72,30,0,0 ; vbroadcastss 0x1e48(%rip),%ymm3 # 4d14 <_sk_callback_hsw+0x3a8>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,88,29,42,30,0,0 ; vpbroadcastd 0x1e2a(%rip),%ymm3 # 4d1c <_sk_callback_hsw+0x3a2>
+ DB 196,226,125,88,29,63,30,0,0 ; vpbroadcastd 0x1e3f(%rip),%ymm3 # 4d18 <_sk_callback_hsw+0x3ac>
DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,29,30,0,0 ; vbroadcastss 0x1e1d(%rip),%ymm3 # 4d20 <_sk_callback_hsw+0x3a6>
+ DB 196,226,125,24,29,50,30,0,0 ; vbroadcastss 0x1e32(%rip),%ymm3 # 4d1c <_sk_callback_hsw+0x3b0>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,18,30,0,0 ; vbroadcastss 0x1e12(%rip),%ymm3 # 4d24 <_sk_callback_hsw+0x3aa>
+ DB 196,226,125,24,29,39,30,0,0 ; vbroadcastss 0x1e27(%rip),%ymm3 # 4d20 <_sk_callback_hsw+0x3b4>
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,128 ; ja 2ea8 <_sk_load_565_hsw+0x10>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,73,0,0,0 ; lea 0x49(%rip),%r9 # 2f7c <_sk_load_565_hsw+0xe4>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,128 ; ja 2e8f <_sk_load_565_hsw+0x10>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 2f64 <_sk_load_565_hsw+0xe5>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 196,193,121,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- DB 233,44,255,255,255 ; jmpq 2ea8 <_sk_load_565_hsw+0x10>
- DB 244 ; hlt
- DB 255 ; (bad)
+ DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ DB 233,44,255,255,255 ; jmpq 2e8f <_sk_load_565_hsw+0x10>
+ DB 144 ; nop
+ DB 243,255 ; repz (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 236 ; in (%dx),%al
+ DB 235,255 ; jmp 2f69 <_sk_load_565_hsw+0xea>
DB 255 ; (bad)
+ DB 255,227 ; jmpq *%rbx
DB 255 ; (bad)
- DB 255,228 ; jmpq *%rsp
DB 255 ; (bad)
DB 255 ; (bad)
+ DB 219,255 ; (bad)
DB 255 ; (bad)
- DB 220,255 ; fdivr %st,%st(7)
+ DB 255,211 ; callq *%rbx
DB 255 ; (bad)
- DB 255,212 ; callq *%rsp
DB 255 ; (bad)
+ DB 255,203 ; dec %ebx
DB 255 ; (bad)
- DB 255,204 ; dec %esp
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,192 ; inc %eax
+ DB 191 ; .byte 0xbf
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
PUBLIC _sk_gather_565_hsw
_sk_gather_565_hsw LABEL PROC
+ DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,199 ; vmovq %xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 71,15,183,20,80 ; movzwl (%r8,%r10,2),%r10d
- DB 71,15,183,28,88 ; movzwl (%r8,%r11,2),%r11d
- DB 196,193,121,110,195 ; vmovd %r11d,%xmm0
- DB 196,193,121,196,194,1 ; vpinsrw $0x1,%r10d,%xmm0,%xmm0
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 196,193,121,196,193,2 ; vpinsrw $0x2,%r9d,%xmm0,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 196,193,249,126,196 ; vmovq %xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 71,15,183,28,89 ; movzwl (%r9,%r11,2),%r11d
+ DB 67,15,183,44,113 ; movzwl (%r9,%r14,2),%ebp
+ DB 197,249,110,197 ; vmovd %ebp,%xmm0
+ DB 196,193,121,196,195,1 ; vpinsrw $0x1,%r11d,%xmm0,%xmm0
+ DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp
+ DB 197,249,196,197,2 ; vpinsrw $0x2,%ebp,%xmm0,%xmm0
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 197,249,196,192,3 ; vpinsrw $0x3,%eax,%xmm0,%xmm0
- DB 67,15,183,4,96 ; movzwl (%r8,%r12,2),%eax
+ DB 67,15,183,4,105 ; movzwl (%r9,%r13,2),%eax
DB 197,249,196,192,4 ; vpinsrw $0x4,%eax,%xmm0,%xmm0
- DB 67,15,183,4,120 ; movzwl (%r8,%r15,2),%eax
+ DB 67,15,183,4,97 ; movzwl (%r9,%r12,2),%eax
DB 197,249,196,192,5 ; vpinsrw $0x5,%eax,%xmm0,%xmm0
- DB 67,15,183,4,112 ; movzwl (%r8,%r14,2),%eax
+ DB 67,15,183,4,121 ; movzwl (%r9,%r15,2),%eax
DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0
- DB 65,15,183,4,88 ; movzwl (%r8,%rbx,2),%eax
+ DB 65,15,183,4,89 ; movzwl (%r9,%rbx,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2
- DB 196,226,125,88,5,213,28,0,0 ; vpbroadcastd 0x1cd5(%rip),%ymm0 # 4d28 <_sk_callback_hsw+0x3ae>
+ DB 196,226,125,88,5,232,28,0,0 ; vpbroadcastd 0x1ce8(%rip),%ymm0 # 4d24 <_sk_callback_hsw+0x3b8>
DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,200,28,0,0 ; vbroadcastss 0x1cc8(%rip),%ymm1 # 4d2c <_sk_callback_hsw+0x3b2>
+ DB 196,226,125,24,13,219,28,0,0 ; vbroadcastss 0x1cdb(%rip),%ymm1 # 4d28 <_sk_callback_hsw+0x3bc>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,191,28,0,0 ; vpbroadcastd 0x1cbf(%rip),%ymm1 # 4d30 <_sk_callback_hsw+0x3b6>
+ DB 196,226,125,88,13,210,28,0,0 ; vpbroadcastd 0x1cd2(%rip),%ymm1 # 4d2c <_sk_callback_hsw+0x3c0>
DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,178,28,0,0 ; vbroadcastss 0x1cb2(%rip),%ymm3 # 4d34 <_sk_callback_hsw+0x3ba>
+ DB 196,226,125,24,29,197,28,0,0 ; vbroadcastss 0x1cc5(%rip),%ymm3 # 4d30 <_sk_callback_hsw+0x3c4>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,88,29,169,28,0,0 ; vpbroadcastd 0x1ca9(%rip),%ymm3 # 4d38 <_sk_callback_hsw+0x3be>
+ DB 196,226,125,88,29,188,28,0,0 ; vpbroadcastd 0x1cbc(%rip),%ymm3 # 4d34 <_sk_callback_hsw+0x3c8>
DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,156,28,0,0 ; vbroadcastss 0x1c9c(%rip),%ymm3 # 4d3c <_sk_callback_hsw+0x3c2>
+ DB 196,226,125,24,29,175,28,0,0 ; vbroadcastss 0x1caf(%rip),%ymm3 # 4d38 <_sk_callback_hsw+0x3cc>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,145,28,0,0 ; vbroadcastss 0x1c91(%rip),%ymm3 # 4d40 <_sk_callback_hsw+0x3c6>
+ DB 196,226,125,24,29,164,28,0,0 ; vbroadcastss 0x1ca4(%rip),%ymm3 # 4d3c <_sk_callback_hsw+0x3d0>
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_565_hsw
_sk_store_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,126,28,0,0 ; vbroadcastss 0x1c7e(%rip),%ymm8 # 4d44 <_sk_callback_hsw+0x3ca>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,142,28,0,0 ; vbroadcastss 0x1c8e(%rip),%ymm8 # 4d40 <_sk_callback_hsw+0x3d4>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,53,114,241,11 ; vpslld $0xb,%ymm9,%ymm9
- DB 196,98,125,24,21,105,28,0,0 ; vbroadcastss 0x1c69(%rip),%ymm10 # 4d48 <_sk_callback_hsw+0x3ce>
+ DB 196,98,125,24,21,121,28,0,0 ; vbroadcastss 0x1c79(%rip),%ymm10 # 4d44 <_sk_callback_hsw+0x3d8>
DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10
DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10
DB 196,193,45,114,242,5 ; vpslld $0x5,%ymm10,%ymm10
@@ -2938,29 +2932,29 @@ _sk_store_565_hsw LABEL PROC
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 311d <_sk_store_565_hsw+0x65>
- DB 196,65,122,127,4,122 ; vmovdqu %xmm8,(%r10,%rdi,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 3119 <_sk_store_565_hsw+0x61>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,68,0,0,0 ; lea 0x44(%rip),%r9 # 317c <_sk_store_565_hsw+0xc4>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,21,68,122,12,6 ; vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- DB 196,67,121,21,68,122,10,5 ; vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- DB 196,67,121,21,68,122,8,4 ; vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- DB 196,67,121,21,68,122,6,3 ; vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- DB 196,67,121,21,68,122,4,2 ; vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- DB 196,67,121,21,68,122,2,1 ; vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- DB 196,67,121,21,4,122,0 ; vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- DB 235,159 ; jmp 3119 <_sk_store_565_hsw+0x61>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3109 <_sk_store_565_hsw+0x65>
+ DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 3105 <_sk_store_565_hsw+0x61>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3168 <_sk_store_565_hsw+0xc4>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,6,3 ; vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ DB 235,159 ; jmp 3105 <_sk_store_565_hsw+0x61>
DB 102,144 ; xchg %ax,%ax
DB 245 ; cmc
DB 255 ; (bad)
@@ -2989,53 +2983,53 @@ _sk_store_565_hsw LABEL PROC
PUBLIC _sk_load_4444_hsw
_sk_load_4444_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,138,0,0,0 ; jne 3230 <_sk_load_4444_hsw+0x98>
- DB 196,193,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm0
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,138,0,0,0 ; jne 321c <_sk_load_4444_hsw+0x98>
+ DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3
- DB 196,226,125,88,5,146,27,0,0 ; vpbroadcastd 0x1b92(%rip),%ymm0 # 4d4c <_sk_callback_hsw+0x3d2>
+ DB 196,226,125,88,5,162,27,0,0 ; vpbroadcastd 0x1ba2(%rip),%ymm0 # 4d48 <_sk_callback_hsw+0x3dc>
DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,133,27,0,0 ; vbroadcastss 0x1b85(%rip),%ymm1 # 4d50 <_sk_callback_hsw+0x3d6>
+ DB 196,226,125,24,13,149,27,0,0 ; vbroadcastss 0x1b95(%rip),%ymm1 # 4d4c <_sk_callback_hsw+0x3e0>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,124,27,0,0 ; vpbroadcastd 0x1b7c(%rip),%ymm1 # 4d54 <_sk_callback_hsw+0x3da>
+ DB 196,226,125,88,13,140,27,0,0 ; vpbroadcastd 0x1b8c(%rip),%ymm1 # 4d50 <_sk_callback_hsw+0x3e4>
DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,111,27,0,0 ; vbroadcastss 0x1b6f(%rip),%ymm2 # 4d58 <_sk_callback_hsw+0x3de>
+ DB 196,226,125,24,21,127,27,0,0 ; vbroadcastss 0x1b7f(%rip),%ymm2 # 4d54 <_sk_callback_hsw+0x3e8>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,88,21,102,27,0,0 ; vpbroadcastd 0x1b66(%rip),%ymm2 # 4d5c <_sk_callback_hsw+0x3e2>
+ DB 196,226,125,88,21,118,27,0,0 ; vpbroadcastd 0x1b76(%rip),%ymm2 # 4d58 <_sk_callback_hsw+0x3ec>
DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,89,27,0,0 ; vbroadcastss 0x1b59(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x3e6>
+ DB 196,98,125,24,5,105,27,0,0 ; vbroadcastss 0x1b69(%rip),%ymm8 # 4d5c <_sk_callback_hsw+0x3f0>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,88,5,79,27,0,0 ; vpbroadcastd 0x1b4f(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x3ea>
+ DB 196,98,125,88,5,95,27,0,0 ; vpbroadcastd 0x1b5f(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x3f4>
DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,65,27,0,0 ; vbroadcastss 0x1b41(%rip),%ymm8 # 4d68 <_sk_callback_hsw+0x3ee>
+ DB 196,98,125,24,5,81,27,0,0 ; vbroadcastss 0x1b51(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x3f8>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 15,135,100,255,255,255 ; ja 31ac <_sk_load_4444_hsw+0x14>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,73,0,0,0 ; lea 0x49(%rip),%r9 # 329c <_sk_load_4444_hsw+0x104>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 15,135,100,255,255,255 ; ja 3198 <_sk_load_4444_hsw+0x14>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,73,0,0,0 ; lea 0x49(%rip),%r10 # 3288 <_sk_load_4444_hsw+0x104>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 196,193,121,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- DB 233,16,255,255,255 ; jmpq 31ac <_sk_load_4444_hsw+0x14>
+ DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ DB 233,16,255,255,255 ; jmpq 3198 <_sk_load_4444_hsw+0x14>
DB 244 ; hlt
DB 255 ; (bad)
DB 255 ; (bad)
@@ -3062,79 +3056,83 @@ _sk_load_4444_hsw LABEL PROC
PUBLIC _sk_gather_4444_hsw
_sk_gather_4444_hsw LABEL PROC
+ DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,199 ; vmovq %xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 71,15,183,20,80 ; movzwl (%r8,%r10,2),%r10d
- DB 71,15,183,28,88 ; movzwl (%r8,%r11,2),%r11d
- DB 196,193,121,110,195 ; vmovd %r11d,%xmm0
- DB 196,193,121,196,194,1 ; vpinsrw $0x1,%r10d,%xmm0,%xmm0
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 196,193,121,196,193,2 ; vpinsrw $0x2,%r9d,%xmm0,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 196,193,249,126,196 ; vmovq %xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 71,15,183,28,89 ; movzwl (%r9,%r11,2),%r11d
+ DB 67,15,183,44,113 ; movzwl (%r9,%r14,2),%ebp
+ DB 197,249,110,197 ; vmovd %ebp,%xmm0
+ DB 196,193,121,196,195,1 ; vpinsrw $0x1,%r11d,%xmm0,%xmm0
+ DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp
+ DB 197,249,196,197,2 ; vpinsrw $0x2,%ebp,%xmm0,%xmm0
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 197,249,196,192,3 ; vpinsrw $0x3,%eax,%xmm0,%xmm0
- DB 67,15,183,4,96 ; movzwl (%r8,%r12,2),%eax
+ DB 67,15,183,4,105 ; movzwl (%r9,%r13,2),%eax
DB 197,249,196,192,4 ; vpinsrw $0x4,%eax,%xmm0,%xmm0
- DB 67,15,183,4,120 ; movzwl (%r8,%r15,2),%eax
+ DB 67,15,183,4,97 ; movzwl (%r9,%r12,2),%eax
DB 197,249,196,192,5 ; vpinsrw $0x5,%eax,%xmm0,%xmm0
- DB 67,15,183,4,112 ; movzwl (%r8,%r14,2),%eax
+ DB 67,15,183,4,121 ; movzwl (%r9,%r15,2),%eax
DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0
- DB 65,15,183,4,88 ; movzwl (%r8,%rbx,2),%eax
+ DB 65,15,183,4,89 ; movzwl (%r9,%rbx,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3
- DB 196,226,125,88,5,249,25,0,0 ; vpbroadcastd 0x19f9(%rip),%ymm0 # 4d6c <_sk_callback_hsw+0x3f2>
+ DB 196,226,125,88,5,8,26,0,0 ; vpbroadcastd 0x1a08(%rip),%ymm0 # 4d68 <_sk_callback_hsw+0x3fc>
DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,236,25,0,0 ; vbroadcastss 0x19ec(%rip),%ymm1 # 4d70 <_sk_callback_hsw+0x3f6>
+ DB 196,226,125,24,13,251,25,0,0 ; vbroadcastss 0x19fb(%rip),%ymm1 # 4d6c <_sk_callback_hsw+0x400>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,227,25,0,0 ; vpbroadcastd 0x19e3(%rip),%ymm1 # 4d74 <_sk_callback_hsw+0x3fa>
+ DB 196,226,125,88,13,242,25,0,0 ; vpbroadcastd 0x19f2(%rip),%ymm1 # 4d70 <_sk_callback_hsw+0x404>
DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,214,25,0,0 ; vbroadcastss 0x19d6(%rip),%ymm2 # 4d78 <_sk_callback_hsw+0x3fe>
+ DB 196,226,125,24,21,229,25,0,0 ; vbroadcastss 0x19e5(%rip),%ymm2 # 4d74 <_sk_callback_hsw+0x408>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,88,21,205,25,0,0 ; vpbroadcastd 0x19cd(%rip),%ymm2 # 4d7c <_sk_callback_hsw+0x402>
+ DB 196,226,125,88,21,220,25,0,0 ; vpbroadcastd 0x19dc(%rip),%ymm2 # 4d78 <_sk_callback_hsw+0x40c>
DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,192,25,0,0 ; vbroadcastss 0x19c0(%rip),%ymm8 # 4d80 <_sk_callback_hsw+0x406>
+ DB 196,98,125,24,5,207,25,0,0 ; vbroadcastss 0x19cf(%rip),%ymm8 # 4d7c <_sk_callback_hsw+0x410>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,88,5,182,25,0,0 ; vpbroadcastd 0x19b6(%rip),%ymm8 # 4d84 <_sk_callback_hsw+0x40a>
+ DB 196,98,125,88,5,197,25,0,0 ; vpbroadcastd 0x19c5(%rip),%ymm8 # 4d80 <_sk_callback_hsw+0x414>
DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,168,25,0,0 ; vbroadcastss 0x19a8(%rip),%ymm8 # 4d88 <_sk_callback_hsw+0x40e>
+ DB 196,98,125,24,5,183,25,0,0 ; vbroadcastss 0x19b7(%rip),%ymm8 # 4d84 <_sk_callback_hsw+0x418>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_4444_hsw
_sk_store_4444_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,142,25,0,0 ; vbroadcastss 0x198e(%rip),%ymm8 # 4d8c <_sk_callback_hsw+0x412>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,154,25,0,0 ; vbroadcastss 0x199a(%rip),%ymm8 # 4d88 <_sk_callback_hsw+0x41c>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,53,114,241,12 ; vpslld $0xc,%ymm9,%ymm9
@@ -3151,29 +3149,29 @@ _sk_store_4444_hsw LABEL PROC
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3461 <_sk_store_4444_hsw+0x71>
- DB 196,65,122,127,4,122 ; vmovdqu %xmm8,(%r10,%rdi,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 345d <_sk_store_4444_hsw+0x6d>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,68,0,0,0 ; lea 0x44(%rip),%r9 # 34c0 <_sk_store_4444_hsw+0xd0>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,21,68,122,12,6 ; vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- DB 196,67,121,21,68,122,10,5 ; vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- DB 196,67,121,21,68,122,8,4 ; vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- DB 196,67,121,21,68,122,6,3 ; vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- DB 196,67,121,21,68,122,4,2 ; vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- DB 196,67,121,21,68,122,2,1 ; vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- DB 196,67,121,21,4,122,0 ; vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- DB 235,159 ; jmp 345d <_sk_store_4444_hsw+0x6d>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3451 <_sk_store_4444_hsw+0x71>
+ DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 344d <_sk_store_4444_hsw+0x6d>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 34b0 <_sk_store_4444_hsw+0xd0>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,6,3 ; vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ DB 235,159 ; jmp 344d <_sk_store_4444_hsw+0x6d>
DB 102,144 ; xchg %ax,%ax
DB 245 ; cmc
DB 255 ; (bad)
@@ -3201,28 +3199,28 @@ _sk_store_4444_hsw LABEL PROC
PUBLIC _sk_load_8888_hsw
_sk_load_8888_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3549 <_sk_load_8888_hsw+0x6d>
- DB 196,193,124,16,25 ; vmovups (%r9),%ymm3
- DB 197,228,84,5,194,26,0,0 ; vandps 0x1ac2(%rip),%ymm3,%ymm0 # 4fc0 <_sk_callback_hsw+0x646>
+ DB 117,88 ; jne 3539 <_sk_load_8888_hsw+0x6d>
+ DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
+ DB 197,228,84,5,210,26,0,0 ; vandps 0x1ad2(%rip),%ymm3,%ymm0 # 4fc0 <_sk_callback_hsw+0x654>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,133,24,0,0 ; vbroadcastss 0x1885(%rip),%ymm8 # 4d90 <_sk_callback_hsw+0x416>
+ DB 196,98,125,24,5,145,24,0,0 ; vbroadcastss 0x1891(%rip),%ymm8 # 4d8c <_sk_callback_hsw+0x420>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,199,26,0,0 ; vpshufb 0x1ac7(%rip),%ymm3,%ymm1 # 4fe0 <_sk_callback_hsw+0x666>
+ DB 196,226,101,0,13,215,26,0,0 ; vpshufb 0x1ad7(%rip),%ymm3,%ymm1 # 4fe0 <_sk_callback_hsw+0x674>
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,213,26,0,0 ; vpshufb 0x1ad5(%rip),%ymm3,%ymm2 # 5000 <_sk_callback_hsw+0x686>
+ DB 196,226,101,0,21,229,26,0,0 ; vpshufb 0x1ae5(%rip),%ymm3,%ymm2 # 5000 <_sk_callback_hsw+0x694>
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
@@ -3231,28 +3229,28 @@ _sk_load_8888_hsw LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0
- DB 196,194,125,44,25 ; vmaskmovps (%r9),%ymm0,%ymm3
- DB 235,135 ; jmp 34f6 <_sk_load_8888_hsw+0x1a>
+ DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
+ DB 235,135 ; jmp 34e6 <_sk_load_8888_hsw+0x1a>
PUBLIC _sk_gather_8888_hsw
_sk_gather_8888_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,194,117,144,28,128 ; vpgatherdd %ymm1,(%r8,%ymm0,4),%ymm3
- DB 197,229,219,5,131,26,0,0 ; vpand 0x1a83(%rip),%ymm3,%ymm0 # 5020 <_sk_callback_hsw+0x6a6>
+ DB 196,194,117,144,28,129 ; vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
+ DB 197,229,219,5,147,26,0,0 ; vpand 0x1a93(%rip),%ymm3,%ymm0 # 5020 <_sk_callback_hsw+0x6b4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,234,23,0,0 ; vbroadcastss 0x17ea(%rip),%ymm8 # 4d94 <_sk_callback_hsw+0x41a>
+ DB 196,98,125,24,5,246,23,0,0 ; vbroadcastss 0x17f6(%rip),%ymm8 # 4d90 <_sk_callback_hsw+0x424>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,136,26,0,0 ; vpshufb 0x1a88(%rip),%ymm3,%ymm1 # 5040 <_sk_callback_hsw+0x6c6>
+ DB 196,226,101,0,13,152,26,0,0 ; vpshufb 0x1a98(%rip),%ymm3,%ymm1 # 5040 <_sk_callback_hsw+0x6d4>
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,150,26,0,0 ; vpshufb 0x1a96(%rip),%ymm3,%ymm2 # 5060 <_sk_callback_hsw+0x6e6>
+ DB 196,226,101,0,21,166,26,0,0 ; vpshufb 0x1aa6(%rip),%ymm3,%ymm2 # 5060 <_sk_callback_hsw+0x6f4>
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -3263,11 +3261,11 @@ _sk_gather_8888_hsw LABEL PROC
PUBLIC _sk_store_8888_hsw
_sk_store_8888_hsw LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
- DB 196,98,125,24,5,154,23,0,0 ; vbroadcastss 0x179a(%rip),%ymm8 # 4d98 <_sk_callback_hsw+0x41e>
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
+ DB 196,98,125,24,5,166,23,0,0 ; vbroadcastss 0x17a6(%rip),%ymm8 # 4d94 <_sk_callback_hsw+0x428>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -3283,10 +3281,10 @@ _sk_store_8888_hsw LABEL PROC
DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,12 ; jne 3658 <_sk_store_8888_hsw+0x73>
- DB 196,65,124,17,1 ; vmovups %ymm8,(%r9)
+ DB 117,12 ; jne 3648 <_sk_store_8888_hsw+0x73>
+ DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
@@ -3295,19 +3293,19 @@ _sk_store_8888_hsw LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9
- DB 196,66,53,46,1 ; vmaskmovps %ymm8,%ymm9,(%r9)
- DB 235,211 ; jmp 3651 <_sk_store_8888_hsw+0x6c>
+ DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
+ DB 235,211 ; jmp 3641 <_sk_store_8888_hsw+0x6c>
PUBLIC _sk_load_f16_hsw
_sk_load_f16_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,97 ; jne 36e9 <_sk_load_f16_hsw+0x6b>
- DB 197,121,16,4,248 ; vmovupd (%rax,%rdi,8),%xmm8
- DB 197,249,16,84,248,16 ; vmovupd 0x10(%rax,%rdi,8),%xmm2
- DB 197,249,16,92,248,32 ; vmovupd 0x20(%rax,%rdi,8),%xmm3
- DB 197,122,111,76,248,48 ; vmovdqu 0x30(%rax,%rdi,8),%xmm9
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,97 ; jne 36d9 <_sk_load_f16_hsw+0x6b>
+ DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
+ DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2
+ DB 197,249,16,92,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm3
+ DB 197,122,111,76,208,48 ; vmovdqu 0x30(%rax,%rdx,8),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,97,97,201 ; vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -3326,37 +3324,37 @@ _sk_load_f16_hsw LABEL PROC
DB 196,226,125,19,219 ; vcvtph2ps %xmm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 197,123,16,4,248 ; vmovsd (%rax,%rdi,8),%xmm8
+ DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,79 ; je 3748 <_sk_load_f16_hsw+0xca>
- DB 197,57,22,68,248,8 ; vmovhpd 0x8(%rax,%rdi,8),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,67 ; jb 3748 <_sk_load_f16_hsw+0xca>
- DB 197,251,16,84,248,16 ; vmovsd 0x10(%rax,%rdi,8),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,68 ; je 3755 <_sk_load_f16_hsw+0xd7>
- DB 197,233,22,84,248,24 ; vmovhpd 0x18(%rax,%rdi,8),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,56 ; jb 3755 <_sk_load_f16_hsw+0xd7>
- DB 197,251,16,92,248,32 ; vmovsd 0x20(%rax,%rdi,8),%xmm3
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,114,255,255,255 ; je 369f <_sk_load_f16_hsw+0x21>
- DB 197,225,22,92,248,40 ; vmovhpd 0x28(%rax,%rdi,8),%xmm3,%xmm3
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,98,255,255,255 ; jb 369f <_sk_load_f16_hsw+0x21>
- DB 197,122,126,76,248,48 ; vmovq 0x30(%rax,%rdi,8),%xmm9
- DB 233,87,255,255,255 ; jmpq 369f <_sk_load_f16_hsw+0x21>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,79 ; je 3738 <_sk_load_f16_hsw+0xca>
+ DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,67 ; jb 3738 <_sk_load_f16_hsw+0xca>
+ DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,68 ; je 3745 <_sk_load_f16_hsw+0xd7>
+ DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,56 ; jb 3745 <_sk_load_f16_hsw+0xd7>
+ DB 197,251,16,92,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm3
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,114,255,255,255 ; je 368f <_sk_load_f16_hsw+0x21>
+ DB 197,225,22,92,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,98,255,255,255 ; jb 368f <_sk_load_f16_hsw+0x21>
+ DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
+ DB 233,87,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,74,255,255,255 ; jmpq 369f <_sk_load_f16_hsw+0x21>
+ DB 233,74,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,65,255,255,255 ; jmpq 369f <_sk_load_f16_hsw+0x21>
+ DB 233,65,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21>
PUBLIC _sk_gather_f16_hsw
_sk_gather_f16_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
@@ -3364,9 +3362,9 @@ _sk_gather_f16_hsw LABEL PROC
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
- DB 196,194,237,144,28,192 ; vpgatherdq %ymm2,(%r8,%xmm0,8),%ymm3
+ DB 196,194,237,144,28,193 ; vpgatherdq %ymm2,(%r9,%xmm0,8),%ymm3
DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
- DB 196,194,245,144,20,192 ; vpgatherdq %ymm1,(%r8,%xmm0,8),%ymm2
+ DB 196,194,245,144,20,193 ; vpgatherdq %ymm1,(%r9,%xmm0,8),%ymm2
DB 196,227,125,57,216,1 ; vextracti128 $0x1,%ymm3,%xmm0
DB 196,227,125,57,209,1 ; vextracti128 $0x1,%ymm2,%xmm1
DB 197,97,97,192 ; vpunpcklwd %xmm0,%xmm3,%xmm8
@@ -3404,44 +3402,44 @@ _sk_store_f16_hsw LABEL PROC
DB 196,65,25,106,209 ; vpunpckhdq %xmm9,%xmm12,%xmm10
DB 196,65,57,98,205 ; vpunpckldq %xmm13,%xmm8,%xmm9
DB 196,65,57,106,197 ; vpunpckhdq %xmm13,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,27 ; jne 384d <_sk_store_f16_hsw+0x65>
- DB 197,120,17,28,248 ; vmovups %xmm11,(%rax,%rdi,8)
- DB 197,120,17,84,248,16 ; vmovups %xmm10,0x10(%rax,%rdi,8)
- DB 197,120,17,76,248,32 ; vmovups %xmm9,0x20(%rax,%rdi,8)
- DB 197,122,127,68,248,48 ; vmovdqu %xmm8,0x30(%rax,%rdi,8)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 197,121,214,28,248 ; vmovq %xmm11,(%rax,%rdi,8)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,241 ; je 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,23,92,248,8 ; vmovhpd %xmm11,0x8(%rax,%rdi,8)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,229 ; jb 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,214,84,248,16 ; vmovq %xmm10,0x10(%rax,%rdi,8)
- DB 116,221 ; je 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,23,84,248,24 ; vmovhpd %xmm10,0x18(%rax,%rdi,8)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,209 ; jb 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,214,76,248,32 ; vmovq %xmm9,0x20(%rax,%rdi,8)
- DB 116,201 ; je 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,23,76,248,40 ; vmovhpd %xmm9,0x28(%rax,%rdi,8)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,189 ; jb 3849 <_sk_store_f16_hsw+0x61>
- DB 197,121,214,68,248,48 ; vmovq %xmm8,0x30(%rax,%rdi,8)
- DB 235,181 ; jmp 3849 <_sk_store_f16_hsw+0x61>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,27 ; jne 383d <_sk_store_f16_hsw+0x65>
+ DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8)
+ DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8)
+ DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8)
+ DB 197,122,127,68,208,48 ; vmovdqu %xmm8,0x30(%rax,%rdx,8)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,241 ; je 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,229 ; jb 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8)
+ DB 116,221 ; je 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,209 ; jb 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8)
+ DB 116,201 ; je 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,189 ; jb 3839 <_sk_store_f16_hsw+0x61>
+ DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8)
+ DB 235,181 ; jmp 3839 <_sk_store_f16_hsw+0x61>
PUBLIC _sk_load_u16_be_hsw
_sk_load_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,204,0,0,0 ; jne 3976 <_sk_load_u16_be_hsw+0xe2>
- DB 196,65,121,16,4,64 ; vmovupd (%r8,%rax,2),%xmm8
- DB 196,193,121,16,84,64,16 ; vmovupd 0x10(%r8,%rax,2),%xmm2
- DB 196,193,121,16,92,64,32 ; vmovupd 0x20(%r8,%rax,2),%xmm3
- DB 196,65,122,111,76,64,48 ; vmovdqu 0x30(%r8,%rax,2),%xmm9
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,204,0,0,0 ; jne 3966 <_sk_load_u16_be_hsw+0xe2>
+ DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8
+ DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2
+ DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3
+ DB 196,65,122,111,76,65,48 ; vmovdqu 0x30(%r9,%rax,2),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,97,97,201 ; vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -3456,7 +3454,7 @@ _sk_load_u16_be_hsw LABEL PROC
DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,21,145,20,0,0 ; vbroadcastss 0x1491(%rip),%ymm10 # 4d9c <_sk_callback_hsw+0x422>
+ DB 196,98,125,24,21,157,20,0,0 ; vbroadcastss 0x149d(%rip),%ymm10 # 4d98 <_sk_callback_hsw+0x42c>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -3481,44 +3479,44 @@ _sk_load_u16_be_hsw LABEL PROC
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 196,65,123,16,4,64 ; vmovsd (%r8,%rax,2),%xmm8
+ DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,85 ; je 39dc <_sk_load_u16_be_hsw+0x148>
- DB 196,65,57,22,68,64,8 ; vmovhpd 0x8(%r8,%rax,2),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,72 ; jb 39dc <_sk_load_u16_be_hsw+0x148>
- DB 196,193,123,16,84,64,16 ; vmovsd 0x10(%r8,%rax,2),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,72 ; je 39e9 <_sk_load_u16_be_hsw+0x155>
- DB 196,193,105,22,84,64,24 ; vmovhpd 0x18(%r8,%rax,2),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,59 ; jb 39e9 <_sk_load_u16_be_hsw+0x155>
- DB 196,193,123,16,92,64,32 ; vmovsd 0x20(%r8,%rax,2),%xmm3
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,6,255,255,255 ; je 38c5 <_sk_load_u16_be_hsw+0x31>
- DB 196,193,97,22,92,64,40 ; vmovhpd 0x28(%r8,%rax,2),%xmm3,%xmm3
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,245,254,255,255 ; jb 38c5 <_sk_load_u16_be_hsw+0x31>
- DB 196,65,122,126,76,64,48 ; vmovq 0x30(%r8,%rax,2),%xmm9
- DB 233,233,254,255,255 ; jmpq 38c5 <_sk_load_u16_be_hsw+0x31>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,85 ; je 39cc <_sk_load_u16_be_hsw+0x148>
+ DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,72 ; jb 39cc <_sk_load_u16_be_hsw+0x148>
+ DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,72 ; je 39d9 <_sk_load_u16_be_hsw+0x155>
+ DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,59 ; jb 39d9 <_sk_load_u16_be_hsw+0x155>
+ DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,6,255,255,255 ; je 38b5 <_sk_load_u16_be_hsw+0x31>
+ DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,245,254,255,255 ; jb 38b5 <_sk_load_u16_be_hsw+0x31>
+ DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9
+ DB 233,233,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,220,254,255,255 ; jmpq 38c5 <_sk_load_u16_be_hsw+0x31>
+ DB 233,220,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,211,254,255,255 ; jmpq 38c5 <_sk_load_u16_be_hsw+0x31>
+ DB 233,211,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31>
PUBLIC _sk_load_rgb_u16_be_hsw
_sk_load_rgb_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,127 ; lea (%rdi,%rdi,2),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,204,0,0,0 ; jne 3ad0 <_sk_load_rgb_u16_be_hsw+0xde>
- DB 196,193,122,111,4,64 ; vmovdqu (%r8,%rax,2),%xmm0
- DB 196,193,122,111,84,64,12 ; vmovdqu 0xc(%r8,%rax,2),%xmm2
- DB 196,193,122,111,76,64,24 ; vmovdqu 0x18(%r8,%rax,2),%xmm1
- DB 196,193,122,111,92,64,32 ; vmovdqu 0x20(%r8,%rax,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,204,0,0,0 ; jne 3ac0 <_sk_load_rgb_u16_be_hsw+0xde>
+ DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0
+ DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2
+ DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1
+ DB 196,193,122,111,92,65,32 ; vmovdqu 0x20(%r9,%rax,2),%xmm3
DB 197,225,115,219,4 ; vpsrldq $0x4,%xmm3,%xmm3
DB 197,185,115,216,6 ; vpsrldq $0x6,%xmm0,%xmm8
DB 197,177,115,218,6 ; vpsrldq $0x6,%xmm2,%xmm9
@@ -3538,7 +3536,7 @@ _sk_load_rgb_u16_be_hsw LABEL PROC
DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,21,34,19,0,0 ; vbroadcastss 0x1322(%rip),%ymm10 # 4da0 <_sk_callback_hsw+0x426>
+ DB 196,98,125,24,21,46,19,0,0 ; vbroadcastss 0x132e(%rip),%ymm10 # 4d9c <_sk_callback_hsw+0x430>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -3555,48 +3553,48 @@ _sk_load_rgb_u16_be_hsw LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,214,18,0,0 ; vbroadcastss 0x12d6(%rip),%ymm3 # 4da4 <_sk_callback_hsw+0x42a>
- DB 255,224 ; jmpq *%rax
- DB 196,193,121,110,4,64 ; vmovd (%r8,%rax,2),%xmm0
- DB 196,193,121,196,68,64,4,2 ; vpinsrw $0x2,0x4(%r8,%rax,2),%xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,5 ; jne 3ae9 <_sk_load_rgb_u16_be_hsw+0xf7>
- DB 233,79,255,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 196,193,121,110,76,64,6 ; vmovd 0x6(%r8,%rax,2),%xmm1
- DB 196,65,113,196,68,64,10,2 ; vpinsrw $0x2,0xa(%r8,%rax,2),%xmm1,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,26 ; jb 3b18 <_sk_load_rgb_u16_be_hsw+0x126>
- DB 196,193,121,110,76,64,12 ; vmovd 0xc(%r8,%rax,2),%xmm1
- DB 196,193,113,196,84,64,16,2 ; vpinsrw $0x2,0x10(%r8,%rax,2),%xmm1,%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 117,10 ; jne 3b1d <_sk_load_rgb_u16_be_hsw+0x12b>
- DB 233,32,255,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,27,255,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 196,193,121,110,76,64,18 ; vmovd 0x12(%r8,%rax,2),%xmm1
- DB 196,65,113,196,76,64,22,2 ; vpinsrw $0x2,0x16(%r8,%rax,2),%xmm1,%xmm9
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,26 ; jb 3b4c <_sk_load_rgb_u16_be_hsw+0x15a>
- DB 196,193,121,110,76,64,24 ; vmovd 0x18(%r8,%rax,2),%xmm1
- DB 196,193,113,196,76,64,28,2 ; vpinsrw $0x2,0x1c(%r8,%rax,2),%xmm1,%xmm1
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 117,10 ; jne 3b51 <_sk_load_rgb_u16_be_hsw+0x15f>
- DB 233,236,254,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,231,254,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 196,193,121,110,92,64,30 ; vmovd 0x1e(%r8,%rax,2),%xmm3
- DB 196,65,97,196,92,64,34,2 ; vpinsrw $0x2,0x22(%r8,%rax,2),%xmm3,%xmm11
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,20 ; jb 3b7a <_sk_load_rgb_u16_be_hsw+0x188>
- DB 196,193,121,110,92,64,36 ; vmovd 0x24(%r8,%rax,2),%xmm3
- DB 196,193,97,196,92,64,40,2 ; vpinsrw $0x2,0x28(%r8,%rax,2),%xmm3,%xmm3
- DB 233,190,254,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,185,254,255,255 ; jmpq 3a38 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 196,226,125,24,29,226,18,0,0 ; vbroadcastss 0x12e2(%rip),%ymm3 # 4da0 <_sk_callback_hsw+0x434>
+ DB 255,224 ; jmpq *%rax
+ DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0
+ DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,5 ; jne 3ad9 <_sk_load_rgb_u16_be_hsw+0xf7>
+ DB 233,79,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1
+ DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,26 ; jb 3b08 <_sk_load_rgb_u16_be_hsw+0x126>
+ DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1
+ DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 117,10 ; jne 3b0d <_sk_load_rgb_u16_be_hsw+0x12b>
+ DB 233,32,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,27,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1
+ DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,26 ; jb 3b3c <_sk_load_rgb_u16_be_hsw+0x15a>
+ DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1
+ DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 117,10 ; jne 3b41 <_sk_load_rgb_u16_be_hsw+0x15f>
+ DB 233,236,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,231,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3
+ DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,20 ; jb 3b6a <_sk_load_rgb_u16_be_hsw+0x188>
+ DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3
+ DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
+ DB 233,190,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,185,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46>
PUBLIC _sk_store_u16_be_hsw
_sk_store_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 196,98,125,24,5,19,18,0,0 ; vbroadcastss 0x1213(%rip),%ymm8 # 4da8 <_sk_callback_hsw+0x42e>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 196,98,125,24,5,31,18,0,0 ; vbroadcastss 0x121f(%rip),%ymm8 # 4da4 <_sk_callback_hsw+0x438>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10
@@ -3633,55 +3631,55 @@ _sk_store_u16_be_hsw LABEL PROC
DB 196,65,25,106,209 ; vpunpckhdq %xmm9,%xmm12,%xmm10
DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9
DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,31 ; jne 3c79 <_sk_store_u16_be_hsw+0xfa>
- DB 196,65,120,17,28,64 ; vmovups %xmm11,(%r8,%rax,2)
- DB 196,65,120,17,84,64,16 ; vmovups %xmm10,0x10(%r8,%rax,2)
- DB 196,65,120,17,76,64,32 ; vmovups %xmm9,0x20(%r8,%rax,2)
- DB 196,65,122,127,68,64,48 ; vmovdqu %xmm8,0x30(%r8,%rax,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 196,65,121,214,28,64 ; vmovq %xmm11,(%r8,%rax,2)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,23,92,64,8 ; vmovhpd %xmm11,0x8(%r8,%rax,2)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,214,84,64,16 ; vmovq %xmm10,0x10(%r8,%rax,2)
- DB 116,218 ; je 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,23,84,64,24 ; vmovhpd %xmm10,0x18(%r8,%rax,2)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,205 ; jb 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,214,76,64,32 ; vmovq %xmm9,0x20(%r8,%rax,2)
- DB 116,196 ; je 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,23,76,64,40 ; vmovhpd %xmm9,0x28(%r8,%rax,2)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,183 ; jb 3c75 <_sk_store_u16_be_hsw+0xf6>
- DB 196,65,121,214,68,64,48 ; vmovq %xmm8,0x30(%r8,%rax,2)
- DB 235,174 ; jmp 3c75 <_sk_store_u16_be_hsw+0xf6>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,31 ; jne 3c69 <_sk_store_u16_be_hsw+0xfa>
+ DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2)
+ DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2)
+ DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2)
+ DB 196,65,122,127,68,65,48 ; vmovdqu %xmm8,0x30(%r9,%rax,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2)
+ DB 116,218 ; je 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,205 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2)
+ DB 116,196 ; je 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,183 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6>
+ DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2)
+ DB 235,174 ; jmp 3c65 <_sk_store_u16_be_hsw+0xf6>
PUBLIC _sk_load_f32_hsw
_sk_load_f32_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 119,110 ; ja 3d3d <_sk_load_f32_hsw+0x76>
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,141,21,135,0,0,0 ; lea 0x87(%rip),%r10 # 3d68 <_sk_load_f32_hsw+0xa1>
- DB 73,99,4,138 ; movslq (%r10,%rcx,4),%rax
- DB 76,1,208 ; add %r10,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,3,125,24,68,136,112,1 ; vinsertf128 $0x1,0x70(%r8,%r9,4),%ymm0,%ymm8
- DB 196,131,125,24,92,136,96,1 ; vinsertf128 $0x1,0x60(%r8,%r9,4),%ymm0,%ymm3
- DB 196,131,125,24,76,136,80,1 ; vinsertf128 $0x1,0x50(%r8,%r9,4),%ymm0,%ymm1
- DB 196,131,125,24,84,136,64,1 ; vinsertf128 $0x1,0x40(%r8,%r9,4),%ymm0,%ymm2
- DB 196,129,121,16,68,136,48 ; vmovupd 0x30(%r8,%r9,4),%xmm0
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 119,110 ; ja 3d2d <_sk_load_f32_hsw+0x76>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 3d58 <_sk_load_f32_hsw+0xa1>
+ DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
+ DB 76,1,216 ; add %r11,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,3,125,24,68,145,112,1 ; vinsertf128 $0x1,0x70(%r9,%r10,4),%ymm0,%ymm8
+ DB 196,131,125,24,92,145,96,1 ; vinsertf128 $0x1,0x60(%r9,%r10,4),%ymm0,%ymm3
+ DB 196,131,125,24,76,145,80,1 ; vinsertf128 $0x1,0x50(%r9,%r10,4),%ymm0,%ymm1
+ DB 196,131,125,24,84,145,64,1 ; vinsertf128 $0x1,0x40(%r9,%r10,4),%ymm0,%ymm2
+ DB 196,129,121,16,68,145,48 ; vmovupd 0x30(%r9,%r10,4),%xmm0
DB 196,195,125,13,192,12 ; vblendpd $0xc,%ymm8,%ymm0,%ymm0
- DB 196,1,121,16,68,136,32 ; vmovupd 0x20(%r8,%r9,4),%xmm8
+ DB 196,1,121,16,68,145,32 ; vmovupd 0x20(%r9,%r10,4),%xmm8
DB 196,99,61,13,203,12 ; vblendpd $0xc,%ymm3,%ymm8,%ymm9
- DB 196,129,121,16,92,136,16 ; vmovupd 0x10(%r8,%r9,4),%xmm3
+ DB 196,129,121,16,92,145,16 ; vmovupd 0x10(%r9,%r10,4),%xmm3
DB 196,99,101,13,209,12 ; vblendpd $0xc,%ymm1,%ymm3,%ymm10
- DB 196,129,121,16,12,136 ; vmovupd (%r8,%r9,4),%xmm1
+ DB 196,129,121,16,12,145 ; vmovupd (%r9,%r10,4),%xmm1
DB 196,227,117,13,202,12 ; vblendpd $0xc,%ymm2,%ymm1,%ymm1
DB 196,193,116,20,210 ; vunpcklps %ymm10,%ymm1,%ymm2
DB 196,193,116,21,218 ; vunpckhps %ymm10,%ymm1,%ymm3
@@ -3715,8 +3713,8 @@ _sk_load_f32_hsw LABEL PROC
PUBLIC _sk_store_f32_hsw
_sk_store_f32_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 197,124,20,193 ; vunpcklps %ymm1,%ymm0,%ymm8
DB 197,124,21,217 ; vunpckhps %ymm1,%ymm0,%ymm11
DB 197,108,20,203 ; vunpcklps %ymm3,%ymm2,%ymm9
@@ -3725,36 +3723,36 @@ _sk_store_f32_hsw LABEL PROC
DB 196,65,61,21,201 ; vunpckhpd %ymm9,%ymm8,%ymm9
DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8
DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,55 ; jne 3df5 <_sk_store_f32_hsw+0x6d>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,55 ; jne 3de5 <_sk_store_f32_hsw+0x6d>
DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
DB 196,67,61,6,195,49 ; vperm2f128 $0x31,%ymm11,%ymm8,%ymm8
- DB 196,65,125,17,36,128 ; vmovupd %ymm12,(%r8,%rax,4)
- DB 196,65,125,17,108,128,32 ; vmovupd %ymm13,0x20(%r8,%rax,4)
- DB 196,65,125,17,76,128,64 ; vmovupd %ymm9,0x40(%r8,%rax,4)
- DB 196,65,125,17,68,128,96 ; vmovupd %ymm8,0x60(%r8,%rax,4)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 196,65,121,17,20,128 ; vmovupd %xmm10,(%r8,%rax,4)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,65,121,17,76,128,16 ; vmovupd %xmm9,0x10(%r8,%rax,4)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,65,121,17,68,128,32 ; vmovupd %xmm8,0x20(%r8,%rax,4)
- DB 116,218 ; je 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,65,121,17,92,128,48 ; vmovupd %xmm11,0x30(%r8,%rax,4)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,205 ; jb 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,67,125,25,84,128,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r8,%rax,4)
- DB 116,195 ; je 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,67,125,25,76,128,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r8,%rax,4)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,181 ; jb 3df1 <_sk_store_f32_hsw+0x69>
- DB 196,67,125,25,68,128,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r8,%rax,4)
- DB 235,171 ; jmp 3df1 <_sk_store_f32_hsw+0x69>
+ DB 196,65,125,17,36,129 ; vmovupd %ymm12,(%r9,%rax,4)
+ DB 196,65,125,17,108,129,32 ; vmovupd %ymm13,0x20(%r9,%rax,4)
+ DB 196,65,125,17,76,129,64 ; vmovupd %ymm9,0x40(%r9,%rax,4)
+ DB 196,65,125,17,68,129,96 ; vmovupd %ymm8,0x60(%r9,%rax,4)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4)
+ DB 116,218 ; je 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,205 ; jb 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
+ DB 116,195 ; je 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,181 ; jb 3de1 <_sk_store_f32_hsw+0x69>
+ DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
+ DB 235,171 ; jmp 3de1 <_sk_store_f32_hsw+0x69>
PUBLIC _sk_clamp_x_hsw
_sk_clamp_x_hsw LABEL PROC
@@ -3838,7 +3836,7 @@ PUBLIC _sk_clamp_x_1_hsw
_sk_clamp_x_1_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,102,14,0,0 ; vbroadcastss 0xe66(%rip),%ymm8 # 4dac <_sk_callback_hsw+0x432>
+ DB 196,98,125,24,5,114,14,0,0 ; vbroadcastss 0xe72(%rip),%ymm8 # 4da8 <_sk_callback_hsw+0x43c>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3852,9 +3850,9 @@ _sk_repeat_x_1_hsw LABEL PROC
PUBLIC _sk_mirror_x_1_hsw
_sk_mirror_x_1_hsw LABEL PROC
- DB 196,98,125,24,5,73,14,0,0 ; vbroadcastss 0xe49(%rip),%ymm8 # 4db0 <_sk_callback_hsw+0x436>
+ DB 196,98,125,24,5,85,14,0,0 ; vbroadcastss 0xe55(%rip),%ymm8 # 4dac <_sk_callback_hsw+0x440>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,13,63,14,0,0 ; vbroadcastss 0xe3f(%rip),%ymm9 # 4db4 <_sk_callback_hsw+0x43a>
+ DB 196,98,125,24,13,75,14,0,0 ; vbroadcastss 0xe4b(%rip),%ymm9 # 4db0 <_sk_callback_hsw+0x444>
DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9
DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9
DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9
@@ -3868,11 +3866,11 @@ _sk_mirror_x_1_hsw LABEL PROC
PUBLIC _sk_luminance_to_alpha_hsw
_sk_luminance_to_alpha_hsw LABEL PROC
- DB 196,226,125,24,29,15,14,0,0 ; vbroadcastss 0xe0f(%rip),%ymm3 # 4db8 <_sk_callback_hsw+0x43e>
- DB 196,98,125,24,5,10,14,0,0 ; vbroadcastss 0xe0a(%rip),%ymm8 # 4dbc <_sk_callback_hsw+0x442>
+ DB 196,226,125,24,29,27,14,0,0 ; vbroadcastss 0xe1b(%rip),%ymm3 # 4db4 <_sk_callback_hsw+0x448>
+ DB 196,98,125,24,5,22,14,0,0 ; vbroadcastss 0xe16(%rip),%ymm8 # 4db8 <_sk_callback_hsw+0x44c>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 196,226,125,184,203 ; vfmadd231ps %ymm3,%ymm0,%ymm1
- DB 196,226,125,24,29,251,13,0,0 ; vbroadcastss 0xdfb(%rip),%ymm3 # 4dc0 <_sk_callback_hsw+0x446>
+ DB 196,226,125,24,29,7,14,0,0 ; vbroadcastss 0xe07(%rip),%ymm3 # 4dbc <_sk_callback_hsw+0x450>
DB 196,226,109,168,217 ; vfmadd213ps %ymm1,%ymm2,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -4028,62 +4026,63 @@ _sk_matrix_perspective_hsw LABEL PROC
PUBLIC _sk_evenly_spaced_gradient_hsw
_sk_evenly_spaced_gradient_hsw LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 77,137,202 ; mov %r9,%r10
- DB 73,255,202 ; dec %r10
- DB 120,7 ; js 427d <_sk_evenly_spaced_gradient_hsw+0x18>
- DB 196,193,242,42,202 ; vcvtsi2ss %r10,%xmm1,%xmm1
- DB 235,22 ; jmp 4293 <_sk_evenly_spaced_gradient_hsw+0x2e>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
DB 77,137,211 ; mov %r10,%r11
- DB 73,209,235 ; shr %r11
- DB 65,131,226,1 ; and $0x1,%r10d
- DB 77,9,218 ; or %r11,%r10
- DB 196,193,242,42,202 ; vcvtsi2ss %r10,%xmm1,%xmm1
+ DB 73,255,203 ; dec %r11
+ DB 120,7 ; js 426e <_sk_evenly_spaced_gradient_hsw+0x19>
+ DB 196,193,242,42,203 ; vcvtsi2ss %r11,%xmm1,%xmm1
+ DB 235,22 ; jmp 4284 <_sk_evenly_spaced_gradient_hsw+0x2f>
+ DB 76,137,219 ; mov %r11,%rbx
+ DB 72,209,235 ; shr %rbx
+ DB 65,131,227,1 ; and $0x1,%r11d
+ DB 73,9,219 ; or %rbx,%r11
+ DB 196,193,242,42,203 ; vcvtsi2ss %r11,%xmm1,%xmm1
DB 197,242,88,201 ; vaddss %xmm1,%xmm1,%xmm1
DB 196,226,125,24,201 ; vbroadcastss %xmm1,%ymm1
DB 197,244,89,200 ; vmulps %ymm0,%ymm1,%ymm1
DB 197,126,91,217 ; vcvttps2dq %ymm1,%ymm11
- DB 73,131,249,8 ; cmp $0x8,%r9
- DB 119,70 ; ja 42ec <_sk_evenly_spaced_gradient_hsw+0x87>
- DB 196,66,37,22,0 ; vpermps (%r8),%ymm11,%ymm8
- DB 76,139,64,40 ; mov 0x28(%rax),%r8
- DB 196,66,37,22,8 ; vpermps (%r8),%ymm11,%ymm9
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
+ DB 73,131,250,8 ; cmp $0x8,%r10
+ DB 119,70 ; ja 42dd <_sk_evenly_spaced_gradient_hsw+0x88>
+ DB 196,66,37,22,1 ; vpermps (%r9),%ymm11,%ymm8
+ DB 72,139,88,40 ; mov 0x28(%rax),%rbx
+ DB 196,98,37,22,11 ; vpermps (%rbx),%ymm11,%ymm9
+ DB 72,139,88,16 ; mov 0x10(%rax),%rbx
DB 76,139,72,24 ; mov 0x18(%rax),%r9
- DB 196,194,37,22,8 ; vpermps (%r8),%ymm11,%ymm1
- DB 76,139,64,48 ; mov 0x30(%rax),%r8
- DB 196,66,37,22,16 ; vpermps (%r8),%ymm11,%ymm10
+ DB 196,226,37,22,11 ; vpermps (%rbx),%ymm11,%ymm1
+ DB 72,139,88,48 ; mov 0x30(%rax),%rbx
+ DB 196,98,37,22,19 ; vpermps (%rbx),%ymm11,%ymm10
DB 196,194,37,22,17 ; vpermps (%r9),%ymm11,%ymm2
- DB 76,139,64,56 ; mov 0x38(%rax),%r8
- DB 196,66,37,22,32 ; vpermps (%r8),%ymm11,%ymm12
- DB 76,139,64,32 ; mov 0x20(%rax),%r8
- DB 196,194,37,22,24 ; vpermps (%r8),%ymm11,%ymm3
+ DB 72,139,88,56 ; mov 0x38(%rax),%rbx
+ DB 196,98,37,22,35 ; vpermps (%rbx),%ymm11,%ymm12
+ DB 72,139,88,32 ; mov 0x20(%rax),%rbx
+ DB 196,226,37,22,27 ; vpermps (%rbx),%ymm11,%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,98,37,22,40 ; vpermps (%rax),%ymm11,%ymm13
- DB 235,110 ; jmp 435a <_sk_evenly_spaced_gradient_hsw+0xf5>
+ DB 235,110 ; jmp 434b <_sk_evenly_spaced_gradient_hsw+0xf6>
DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,2,117,146,4,152 ; vgatherdps %ymm1,(%r8,%ymm11,4),%ymm8
- DB 76,139,64,40 ; mov 0x28(%rax),%r8
+ DB 196,2,117,146,4,153 ; vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8
+ DB 72,139,88,40 ; mov 0x28(%rax),%rbx
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,2,117,146,12,152 ; vgatherdps %ymm1,(%r8,%ymm11,4),%ymm9
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
+ DB 196,34,117,146,12,155 ; vgatherdps %ymm1,(%rbx,%ymm11,4),%ymm9
+ DB 72,139,88,16 ; mov 0x10(%rax),%rbx
DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
- DB 196,130,109,146,12,152 ; vgatherdps %ymm2,(%r8,%ymm11,4),%ymm1
- DB 76,139,64,48 ; mov 0x30(%rax),%r8
+ DB 196,162,109,146,12,155 ; vgatherdps %ymm2,(%rbx,%ymm11,4),%ymm1
+ DB 72,139,88,48 ; mov 0x30(%rax),%rbx
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
- DB 196,2,109,146,20,152 ; vgatherdps %ymm2,(%r8,%ymm11,4),%ymm10
+ DB 196,34,109,146,20,155 ; vgatherdps %ymm2,(%rbx,%ymm11,4),%ymm10
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
DB 196,130,101,146,20,153 ; vgatherdps %ymm3,(%r9,%ymm11,4),%ymm2
- DB 76,139,64,56 ; mov 0x38(%rax),%r8
+ DB 72,139,88,56 ; mov 0x38(%rax),%rbx
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
- DB 196,2,101,146,36,152 ; vgatherdps %ymm3,(%r8,%ymm11,4),%ymm12
- DB 76,139,64,32 ; mov 0x20(%rax),%r8
+ DB 196,34,101,146,36,155 ; vgatherdps %ymm3,(%rbx,%ymm11,4),%ymm12
+ DB 72,139,88,32 ; mov 0x20(%rax),%rbx
DB 196,65,21,118,237 ; vpcmpeqd %ymm13,%ymm13,%ymm13
- DB 196,130,21,146,28,152 ; vgatherdps %ymm13,(%r8,%ymm11,4),%ymm3
+ DB 196,162,21,146,28,155 ; vgatherdps %ymm13,(%rbx,%ymm11,4),%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,34,13,146,44,152 ; vgatherdps %ymm14,(%rax,%ymm11,4),%ymm13
DB 196,66,125,168,193 ; vfmadd213ps %ymm9,%ymm0,%ymm8
@@ -4092,18 +4091,19 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC
DB 196,194,125,168,221 ; vfmadd213ps %ymm13,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,124,41,192 ; vmovaps %ymm8,%ymm0
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_gauss_a_to_rgba_hsw
_sk_gauss_a_to_rgba_hsw LABEL PROC
- DB 196,226,125,24,5,69,10,0,0 ; vbroadcastss 0xa45(%rip),%ymm0 # 4dc4 <_sk_callback_hsw+0x44a>
- DB 196,226,125,24,13,64,10,0,0 ; vbroadcastss 0xa40(%rip),%ymm1 # 4dc8 <_sk_callback_hsw+0x44e>
+ DB 196,226,125,24,5,79,10,0,0 ; vbroadcastss 0xa4f(%rip),%ymm0 # 4dc0 <_sk_callback_hsw+0x454>
+ DB 196,226,125,24,13,74,10,0,0 ; vbroadcastss 0xa4a(%rip),%ymm1 # 4dc4 <_sk_callback_hsw+0x458>
DB 196,226,101,168,200 ; vfmadd213ps %ymm0,%ymm3,%ymm1
- DB 196,226,125,24,5,54,10,0,0 ; vbroadcastss 0xa36(%rip),%ymm0 # 4dcc <_sk_callback_hsw+0x452>
+ DB 196,226,125,24,5,64,10,0,0 ; vbroadcastss 0xa40(%rip),%ymm0 # 4dc8 <_sk_callback_hsw+0x45c>
DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0
- DB 196,226,125,24,13,44,10,0,0 ; vbroadcastss 0xa2c(%rip),%ymm1 # 4dd0 <_sk_callback_hsw+0x456>
+ DB 196,226,125,24,13,54,10,0,0 ; vbroadcastss 0xa36(%rip),%ymm1 # 4dcc <_sk_callback_hsw+0x460>
DB 196,226,101,184,200 ; vfmadd231ps %ymm0,%ymm3,%ymm1
- DB 196,226,125,24,5,34,10,0,0 ; vbroadcastss 0xa22(%rip),%ymm0 # 4dd4 <_sk_callback_hsw+0x45a>
+ DB 196,226,125,24,5,44,10,0,0 ; vbroadcastss 0xa2c(%rip),%ymm0 # 4dd0 <_sk_callback_hsw+0x464>
DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
@@ -4114,63 +4114,63 @@ _sk_gauss_a_to_rgba_hsw LABEL PROC
PUBLIC _sk_gradient_hsw
_sk_gradient_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 73,131,248,1 ; cmp $0x1,%r8
- DB 15,134,180,0,0,0 ; jbe 448a <_sk_gradient_hsw+0xc3>
- DB 76,139,72,72 ; mov 0x48(%rax),%r9
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 73,131,249,1 ; cmp $0x1,%r9
+ DB 15,134,180,0,0,0 ; jbe 447c <_sk_gradient_hsw+0xc3>
+ DB 76,139,80,72 ; mov 0x48(%rax),%r10
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
- DB 65,186,1,0,0,0 ; mov $0x1,%r10d
- DB 196,226,125,24,21,235,9,0,0 ; vbroadcastss 0x9eb(%rip),%ymm2 # 4dd8 <_sk_callback_hsw+0x45e>
+ DB 65,187,1,0,0,0 ; mov $0x1,%r11d
+ DB 196,226,125,24,21,245,9,0,0 ; vbroadcastss 0x9f5(%rip),%ymm2 # 4dd4 <_sk_callback_hsw+0x468>
DB 196,65,53,239,201 ; vpxor %ymm9,%ymm9,%ymm9
- DB 196,130,125,24,28,145 ; vbroadcastss (%r9,%r10,4),%ymm3
+ DB 196,130,125,24,28,154 ; vbroadcastss (%r10,%r11,4),%ymm3
DB 197,228,194,216,2 ; vcmpleps %ymm0,%ymm3,%ymm3
DB 196,227,117,74,218,48 ; vblendvps %ymm3,%ymm2,%ymm1,%ymm3
DB 196,65,101,254,201 ; vpaddd %ymm9,%ymm3,%ymm9
- DB 73,255,194 ; inc %r10
- DB 77,57,208 ; cmp %r10,%r8
- DB 117,226 ; jne 43f2 <_sk_gradient_hsw+0x2b>
- DB 76,139,72,8 ; mov 0x8(%rax),%r9
- DB 73,131,248,8 ; cmp $0x8,%r8
- DB 118,121 ; jbe 4493 <_sk_gradient_hsw+0xcc>
+ DB 73,255,195 ; inc %r11
+ DB 77,57,217 ; cmp %r11,%r9
+ DB 117,226 ; jne 43e4 <_sk_gradient_hsw+0x2b>
+ DB 76,139,80,8 ; mov 0x8(%rax),%r10
+ DB 73,131,249,8 ; cmp $0x8,%r9
+ DB 118,121 ; jbe 4485 <_sk_gradient_hsw+0xcc>
DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,2,117,146,4,137 ; vgatherdps %ymm1,(%r9,%ymm9,4),%ymm8
- DB 76,139,64,40 ; mov 0x28(%rax),%r8
+ DB 196,2,117,146,4,138 ; vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8
+ DB 76,139,72,40 ; mov 0x28(%rax),%r9
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,2,117,146,20,136 ; vgatherdps %ymm1,(%r8,%ymm9,4),%ymm10
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 76,139,72,24 ; mov 0x18(%rax),%r9
+ DB 196,2,117,146,20,137 ; vgatherdps %ymm1,(%r9,%ymm9,4),%ymm10
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
- DB 196,130,109,146,12,136 ; vgatherdps %ymm2,(%r8,%ymm9,4),%ymm1
- DB 76,139,64,48 ; mov 0x30(%rax),%r8
+ DB 196,130,109,146,12,137 ; vgatherdps %ymm2,(%r9,%ymm9,4),%ymm1
+ DB 76,139,72,48 ; mov 0x30(%rax),%r9
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
- DB 196,2,109,146,28,136 ; vgatherdps %ymm2,(%r8,%ymm9,4),%ymm11
+ DB 196,2,109,146,28,137 ; vgatherdps %ymm2,(%r9,%ymm9,4),%ymm11
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
- DB 196,130,101,146,20,137 ; vgatherdps %ymm3,(%r9,%ymm9,4),%ymm2
- DB 76,139,64,56 ; mov 0x38(%rax),%r8
+ DB 196,130,101,146,20,138 ; vgatherdps %ymm3,(%r10,%ymm9,4),%ymm2
+ DB 76,139,72,56 ; mov 0x38(%rax),%r9
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
- DB 196,2,101,146,36,136 ; vgatherdps %ymm3,(%r8,%ymm9,4),%ymm12
- DB 76,139,64,32 ; mov 0x20(%rax),%r8
+ DB 196,2,101,146,36,137 ; vgatherdps %ymm3,(%r9,%ymm9,4),%ymm12
+ DB 76,139,72,32 ; mov 0x20(%rax),%r9
DB 196,65,21,118,237 ; vpcmpeqd %ymm13,%ymm13,%ymm13
- DB 196,130,21,146,28,136 ; vgatherdps %ymm13,(%r8,%ymm9,4),%ymm3
+ DB 196,130,21,146,28,137 ; vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,34,13,146,44,136 ; vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13
- DB 235,77 ; jmp 44d7 <_sk_gradient_hsw+0x110>
- DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 235,77 ; jmp 44c9 <_sk_gradient_hsw+0x110>
+ DB 76,139,80,8 ; mov 0x8(%rax),%r10
DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9
- DB 196,66,53,22,1 ; vpermps (%r9),%ymm9,%ymm8
- DB 76,139,64,40 ; mov 0x28(%rax),%r8
- DB 196,66,53,22,16 ; vpermps (%r8),%ymm9,%ymm10
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 76,139,72,24 ; mov 0x18(%rax),%r9
- DB 196,194,53,22,8 ; vpermps (%r8),%ymm9,%ymm1
- DB 76,139,64,48 ; mov 0x30(%rax),%r8
- DB 196,66,53,22,24 ; vpermps (%r8),%ymm9,%ymm11
- DB 196,194,53,22,17 ; vpermps (%r9),%ymm9,%ymm2
- DB 76,139,64,56 ; mov 0x38(%rax),%r8
- DB 196,66,53,22,32 ; vpermps (%r8),%ymm9,%ymm12
- DB 76,139,64,32 ; mov 0x20(%rax),%r8
- DB 196,194,53,22,24 ; vpermps (%r8),%ymm9,%ymm3
+ DB 196,66,53,22,2 ; vpermps (%r10),%ymm9,%ymm8
+ DB 76,139,72,40 ; mov 0x28(%rax),%r9
+ DB 196,66,53,22,17 ; vpermps (%r9),%ymm9,%ymm10
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
+ DB 196,194,53,22,9 ; vpermps (%r9),%ymm9,%ymm1
+ DB 76,139,72,48 ; mov 0x30(%rax),%r9
+ DB 196,66,53,22,25 ; vpermps (%r9),%ymm9,%ymm11
+ DB 196,194,53,22,18 ; vpermps (%r10),%ymm9,%ymm2
+ DB 76,139,72,56 ; mov 0x38(%rax),%r9
+ DB 196,66,53,22,33 ; vpermps (%r9),%ymm9,%ymm12
+ DB 76,139,72,32 ; mov 0x20(%rax),%r9
+ DB 196,194,53,22,25 ; vpermps (%r9),%ymm9,%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,98,53,22,40 ; vpermps (%rax),%ymm9,%ymm13
DB 196,66,125,168,194 ; vfmadd213ps %ymm10,%ymm0,%ymm8
@@ -4211,24 +4211,24 @@ _sk_xy_to_unit_angle_hsw LABEL PROC
DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12
DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11
DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12
- DB 196,98,125,24,45,106,8,0,0 ; vbroadcastss 0x86a(%rip),%ymm13 # 4ddc <_sk_callback_hsw+0x462>
- DB 196,98,125,24,53,101,8,0,0 ; vbroadcastss 0x865(%rip),%ymm14 # 4de0 <_sk_callback_hsw+0x466>
+ DB 196,98,125,24,45,116,8,0,0 ; vbroadcastss 0x874(%rip),%ymm13 # 4dd8 <_sk_callback_hsw+0x46c>
+ DB 196,98,125,24,53,111,8,0,0 ; vbroadcastss 0x86f(%rip),%ymm14 # 4ddc <_sk_callback_hsw+0x470>
DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14
- DB 196,98,125,24,45,91,8,0,0 ; vbroadcastss 0x85b(%rip),%ymm13 # 4de4 <_sk_callback_hsw+0x46a>
+ DB 196,98,125,24,45,101,8,0,0 ; vbroadcastss 0x865(%rip),%ymm13 # 4de0 <_sk_callback_hsw+0x474>
DB 196,66,29,184,238 ; vfmadd231ps %ymm14,%ymm12,%ymm13
- DB 196,98,125,24,53,81,8,0,0 ; vbroadcastss 0x851(%rip),%ymm14 # 4de8 <_sk_callback_hsw+0x46e>
+ DB 196,98,125,24,53,91,8,0,0 ; vbroadcastss 0x85b(%rip),%ymm14 # 4de4 <_sk_callback_hsw+0x478>
DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14
DB 196,65,36,89,222 ; vmulps %ymm14,%ymm11,%ymm11
DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,60,8,0,0 ; vbroadcastss 0x83c(%rip),%ymm10 # 4dec <_sk_callback_hsw+0x472>
+ DB 196,98,125,24,21,70,8,0,0 ; vbroadcastss 0x846(%rip),%ymm10 # 4de8 <_sk_callback_hsw+0x47c>
DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10
DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9
DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,21,38,8,0,0 ; vbroadcastss 0x826(%rip),%ymm10 # 4df0 <_sk_callback_hsw+0x476>
+ DB 196,98,125,24,21,48,8,0,0 ; vbroadcastss 0x830(%rip),%ymm10 # 4dec <_sk_callback_hsw+0x480>
DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9
- DB 196,98,125,24,21,16,8,0,0 ; vbroadcastss 0x810(%rip),%ymm10 # 4df4 <_sk_callback_hsw+0x47a>
+ DB 196,98,125,24,21,26,8,0,0 ; vbroadcastss 0x81a(%rip),%ymm10 # 4df0 <_sk_callback_hsw+0x484>
DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10
DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0
DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9
@@ -4247,7 +4247,7 @@ _sk_xy_to_radius_hsw LABEL PROC
PUBLIC _sk_save_xy_hsw
_sk_save_xy_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,221,7,0,0 ; vbroadcastss 0x7dd(%rip),%ymm8 # 4df8 <_sk_callback_hsw+0x47e>
+ DB 196,98,125,24,5,231,7,0,0 ; vbroadcastss 0x7e7(%rip),%ymm8 # 4df4 <_sk_callback_hsw+0x488>
DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9
DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
@@ -4277,9 +4277,9 @@ _sk_accumulate_hsw LABEL PROC
PUBLIC _sk_bilinear_nx_hsw
_sk_bilinear_nx_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,113,7,0,0 ; vbroadcastss 0x771(%rip),%ymm0 # 4dfc <_sk_callback_hsw+0x482>
+ DB 196,226,125,24,5,123,7,0,0 ; vbroadcastss 0x77b(%rip),%ymm0 # 4df8 <_sk_callback_hsw+0x48c>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,104,7,0,0 ; vbroadcastss 0x768(%rip),%ymm8 # 4e00 <_sk_callback_hsw+0x486>
+ DB 196,98,125,24,5,114,7,0,0 ; vbroadcastss 0x772(%rip),%ymm8 # 4dfc <_sk_callback_hsw+0x490>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4288,7 +4288,7 @@ _sk_bilinear_nx_hsw LABEL PROC
PUBLIC _sk_bilinear_px_hsw
_sk_bilinear_px_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,80,7,0,0 ; vbroadcastss 0x750(%rip),%ymm0 # 4e04 <_sk_callback_hsw+0x48a>
+ DB 196,226,125,24,5,90,7,0,0 ; vbroadcastss 0x75a(%rip),%ymm0 # 4e00 <_sk_callback_hsw+0x494>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -4298,9 +4298,9 @@ _sk_bilinear_px_hsw LABEL PROC
PUBLIC _sk_bilinear_ny_hsw
_sk_bilinear_ny_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,52,7,0,0 ; vbroadcastss 0x734(%rip),%ymm1 # 4e08 <_sk_callback_hsw+0x48e>
+ DB 196,226,125,24,13,62,7,0,0 ; vbroadcastss 0x73e(%rip),%ymm1 # 4e04 <_sk_callback_hsw+0x498>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,42,7,0,0 ; vbroadcastss 0x72a(%rip),%ymm8 # 4e0c <_sk_callback_hsw+0x492>
+ DB 196,98,125,24,5,52,7,0,0 ; vbroadcastss 0x734(%rip),%ymm8 # 4e08 <_sk_callback_hsw+0x49c>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4309,7 +4309,7 @@ _sk_bilinear_ny_hsw LABEL PROC
PUBLIC _sk_bilinear_py_hsw
_sk_bilinear_py_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,18,7,0,0 ; vbroadcastss 0x712(%rip),%ymm1 # 4e10 <_sk_callback_hsw+0x496>
+ DB 196,226,125,24,13,28,7,0,0 ; vbroadcastss 0x71c(%rip),%ymm1 # 4e0c <_sk_callback_hsw+0x4a0>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -4319,13 +4319,13 @@ _sk_bilinear_py_hsw LABEL PROC
PUBLIC _sk_bicubic_n3x_hsw
_sk_bicubic_n3x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,245,6,0,0 ; vbroadcastss 0x6f5(%rip),%ymm0 # 4e14 <_sk_callback_hsw+0x49a>
+ DB 196,226,125,24,5,255,6,0,0 ; vbroadcastss 0x6ff(%rip),%ymm0 # 4e10 <_sk_callback_hsw+0x4a4>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,236,6,0,0 ; vbroadcastss 0x6ec(%rip),%ymm8 # 4e18 <_sk_callback_hsw+0x49e>
+ DB 196,98,125,24,5,246,6,0,0 ; vbroadcastss 0x6f6(%rip),%ymm8 # 4e14 <_sk_callback_hsw+0x4a8>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,221,6,0,0 ; vbroadcastss 0x6dd(%rip),%ymm10 # 4e1c <_sk_callback_hsw+0x4a2>
- DB 196,98,125,24,29,216,6,0,0 ; vbroadcastss 0x6d8(%rip),%ymm11 # 4e20 <_sk_callback_hsw+0x4a6>
+ DB 196,98,125,24,21,231,6,0,0 ; vbroadcastss 0x6e7(%rip),%ymm10 # 4e18 <_sk_callback_hsw+0x4ac>
+ DB 196,98,125,24,29,226,6,0,0 ; vbroadcastss 0x6e2(%rip),%ymm11 # 4e1c <_sk_callback_hsw+0x4b0>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -4335,16 +4335,16 @@ _sk_bicubic_n3x_hsw LABEL PROC
PUBLIC _sk_bicubic_n1x_hsw
_sk_bicubic_n1x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,187,6,0,0 ; vbroadcastss 0x6bb(%rip),%ymm0 # 4e24 <_sk_callback_hsw+0x4aa>
+ DB 196,226,125,24,5,197,6,0,0 ; vbroadcastss 0x6c5(%rip),%ymm0 # 4e20 <_sk_callback_hsw+0x4b4>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,178,6,0,0 ; vbroadcastss 0x6b2(%rip),%ymm8 # 4e28 <_sk_callback_hsw+0x4ae>
+ DB 196,98,125,24,5,188,6,0,0 ; vbroadcastss 0x6bc(%rip),%ymm8 # 4e24 <_sk_callback_hsw+0x4b8>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,168,6,0,0 ; vbroadcastss 0x6a8(%rip),%ymm9 # 4e2c <_sk_callback_hsw+0x4b2>
- DB 196,98,125,24,21,163,6,0,0 ; vbroadcastss 0x6a3(%rip),%ymm10 # 4e30 <_sk_callback_hsw+0x4b6>
+ DB 196,98,125,24,13,178,6,0,0 ; vbroadcastss 0x6b2(%rip),%ymm9 # 4e28 <_sk_callback_hsw+0x4bc>
+ DB 196,98,125,24,21,173,6,0,0 ; vbroadcastss 0x6ad(%rip),%ymm10 # 4e2c <_sk_callback_hsw+0x4c0>
DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,13,153,6,0,0 ; vbroadcastss 0x699(%rip),%ymm9 # 4e34 <_sk_callback_hsw+0x4ba>
+ DB 196,98,125,24,13,163,6,0,0 ; vbroadcastss 0x6a3(%rip),%ymm9 # 4e30 <_sk_callback_hsw+0x4c4>
DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9
- DB 196,98,125,24,21,143,6,0,0 ; vbroadcastss 0x68f(%rip),%ymm10 # 4e38 <_sk_callback_hsw+0x4be>
+ DB 196,98,125,24,21,153,6,0,0 ; vbroadcastss 0x699(%rip),%ymm10 # 4e34 <_sk_callback_hsw+0x4c8>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
DB 197,124,17,144,128,0,0,0 ; vmovups %ymm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4353,14 +4353,14 @@ _sk_bicubic_n1x_hsw LABEL PROC
PUBLIC _sk_bicubic_p1x_hsw
_sk_bicubic_p1x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,119,6,0,0 ; vbroadcastss 0x677(%rip),%ymm8 # 4e3c <_sk_callback_hsw+0x4c2>
+ DB 196,98,125,24,5,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm8 # 4e38 <_sk_callback_hsw+0x4cc>
DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0
DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9
- DB 196,98,125,24,21,105,6,0,0 ; vbroadcastss 0x669(%rip),%ymm10 # 4e40 <_sk_callback_hsw+0x4c6>
- DB 196,98,125,24,29,100,6,0,0 ; vbroadcastss 0x664(%rip),%ymm11 # 4e44 <_sk_callback_hsw+0x4ca>
+ DB 196,98,125,24,21,115,6,0,0 ; vbroadcastss 0x673(%rip),%ymm10 # 4e3c <_sk_callback_hsw+0x4d0>
+ DB 196,98,125,24,29,110,6,0,0 ; vbroadcastss 0x66e(%rip),%ymm11 # 4e40 <_sk_callback_hsw+0x4d4>
DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11
DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11
- DB 196,98,125,24,5,85,6,0,0 ; vbroadcastss 0x655(%rip),%ymm8 # 4e48 <_sk_callback_hsw+0x4ce>
+ DB 196,98,125,24,5,95,6,0,0 ; vbroadcastss 0x65f(%rip),%ymm8 # 4e44 <_sk_callback_hsw+0x4d8>
DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4369,12 +4369,12 @@ _sk_bicubic_p1x_hsw LABEL PROC
PUBLIC _sk_bicubic_p3x_hsw
_sk_bicubic_p3x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,61,6,0,0 ; vbroadcastss 0x63d(%rip),%ymm0 # 4e4c <_sk_callback_hsw+0x4d2>
+ DB 196,226,125,24,5,71,6,0,0 ; vbroadcastss 0x647(%rip),%ymm0 # 4e48 <_sk_callback_hsw+0x4dc>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,42,6,0,0 ; vbroadcastss 0x62a(%rip),%ymm10 # 4e50 <_sk_callback_hsw+0x4d6>
- DB 196,98,125,24,29,37,6,0,0 ; vbroadcastss 0x625(%rip),%ymm11 # 4e54 <_sk_callback_hsw+0x4da>
+ DB 196,98,125,24,21,52,6,0,0 ; vbroadcastss 0x634(%rip),%ymm10 # 4e4c <_sk_callback_hsw+0x4e0>
+ DB 196,98,125,24,29,47,6,0,0 ; vbroadcastss 0x62f(%rip),%ymm11 # 4e50 <_sk_callback_hsw+0x4e4>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -4384,13 +4384,13 @@ _sk_bicubic_p3x_hsw LABEL PROC
PUBLIC _sk_bicubic_n3y_hsw
_sk_bicubic_n3y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,8,6,0,0 ; vbroadcastss 0x608(%rip),%ymm1 # 4e58 <_sk_callback_hsw+0x4de>
+ DB 196,226,125,24,13,18,6,0,0 ; vbroadcastss 0x612(%rip),%ymm1 # 4e54 <_sk_callback_hsw+0x4e8>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,254,5,0,0 ; vbroadcastss 0x5fe(%rip),%ymm8 # 4e5c <_sk_callback_hsw+0x4e2>
+ DB 196,98,125,24,5,8,6,0,0 ; vbroadcastss 0x608(%rip),%ymm8 # 4e58 <_sk_callback_hsw+0x4ec>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,239,5,0,0 ; vbroadcastss 0x5ef(%rip),%ymm10 # 4e60 <_sk_callback_hsw+0x4e6>
- DB 196,98,125,24,29,234,5,0,0 ; vbroadcastss 0x5ea(%rip),%ymm11 # 4e64 <_sk_callback_hsw+0x4ea>
+ DB 196,98,125,24,21,249,5,0,0 ; vbroadcastss 0x5f9(%rip),%ymm10 # 4e5c <_sk_callback_hsw+0x4f0>
+ DB 196,98,125,24,29,244,5,0,0 ; vbroadcastss 0x5f4(%rip),%ymm11 # 4e60 <_sk_callback_hsw+0x4f4>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -4400,16 +4400,16 @@ _sk_bicubic_n3y_hsw LABEL PROC
PUBLIC _sk_bicubic_n1y_hsw
_sk_bicubic_n1y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,205,5,0,0 ; vbroadcastss 0x5cd(%rip),%ymm1 # 4e68 <_sk_callback_hsw+0x4ee>
+ DB 196,226,125,24,13,215,5,0,0 ; vbroadcastss 0x5d7(%rip),%ymm1 # 4e64 <_sk_callback_hsw+0x4f8>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,195,5,0,0 ; vbroadcastss 0x5c3(%rip),%ymm8 # 4e6c <_sk_callback_hsw+0x4f2>
+ DB 196,98,125,24,5,205,5,0,0 ; vbroadcastss 0x5cd(%rip),%ymm8 # 4e68 <_sk_callback_hsw+0x4fc>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,185,5,0,0 ; vbroadcastss 0x5b9(%rip),%ymm9 # 4e70 <_sk_callback_hsw+0x4f6>
- DB 196,98,125,24,21,180,5,0,0 ; vbroadcastss 0x5b4(%rip),%ymm10 # 4e74 <_sk_callback_hsw+0x4fa>
+ DB 196,98,125,24,13,195,5,0,0 ; vbroadcastss 0x5c3(%rip),%ymm9 # 4e6c <_sk_callback_hsw+0x500>
+ DB 196,98,125,24,21,190,5,0,0 ; vbroadcastss 0x5be(%rip),%ymm10 # 4e70 <_sk_callback_hsw+0x504>
DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,13,170,5,0,0 ; vbroadcastss 0x5aa(%rip),%ymm9 # 4e78 <_sk_callback_hsw+0x4fe>
+ DB 196,98,125,24,13,180,5,0,0 ; vbroadcastss 0x5b4(%rip),%ymm9 # 4e74 <_sk_callback_hsw+0x508>
DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9
- DB 196,98,125,24,21,160,5,0,0 ; vbroadcastss 0x5a0(%rip),%ymm10 # 4e7c <_sk_callback_hsw+0x502>
+ DB 196,98,125,24,21,170,5,0,0 ; vbroadcastss 0x5aa(%rip),%ymm10 # 4e78 <_sk_callback_hsw+0x50c>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
DB 197,124,17,144,160,0,0,0 ; vmovups %ymm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4418,14 +4418,14 @@ _sk_bicubic_n1y_hsw LABEL PROC
PUBLIC _sk_bicubic_p1y_hsw
_sk_bicubic_p1y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,136,5,0,0 ; vbroadcastss 0x588(%rip),%ymm8 # 4e80 <_sk_callback_hsw+0x506>
+ DB 196,98,125,24,5,146,5,0,0 ; vbroadcastss 0x592(%rip),%ymm8 # 4e7c <_sk_callback_hsw+0x510>
DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1
DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9
- DB 196,98,125,24,21,121,5,0,0 ; vbroadcastss 0x579(%rip),%ymm10 # 4e84 <_sk_callback_hsw+0x50a>
- DB 196,98,125,24,29,116,5,0,0 ; vbroadcastss 0x574(%rip),%ymm11 # 4e88 <_sk_callback_hsw+0x50e>
+ DB 196,98,125,24,21,131,5,0,0 ; vbroadcastss 0x583(%rip),%ymm10 # 4e80 <_sk_callback_hsw+0x514>
+ DB 196,98,125,24,29,126,5,0,0 ; vbroadcastss 0x57e(%rip),%ymm11 # 4e84 <_sk_callback_hsw+0x518>
DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11
DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11
- DB 196,98,125,24,5,101,5,0,0 ; vbroadcastss 0x565(%rip),%ymm8 # 4e8c <_sk_callback_hsw+0x512>
+ DB 196,98,125,24,5,111,5,0,0 ; vbroadcastss 0x56f(%rip),%ymm8 # 4e88 <_sk_callback_hsw+0x51c>
DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -4434,12 +4434,12 @@ _sk_bicubic_p1y_hsw LABEL PROC
PUBLIC _sk_bicubic_p3y_hsw
_sk_bicubic_p3y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,77,5,0,0 ; vbroadcastss 0x54d(%rip),%ymm1 # 4e90 <_sk_callback_hsw+0x516>
+ DB 196,226,125,24,13,87,5,0,0 ; vbroadcastss 0x557(%rip),%ymm1 # 4e8c <_sk_callback_hsw+0x520>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,57,5,0,0 ; vbroadcastss 0x539(%rip),%ymm10 # 4e94 <_sk_callback_hsw+0x51a>
- DB 196,98,125,24,29,52,5,0,0 ; vbroadcastss 0x534(%rip),%ymm11 # 4e98 <_sk_callback_hsw+0x51e>
+ DB 196,98,125,24,21,67,5,0,0 ; vbroadcastss 0x543(%rip),%ymm10 # 4e90 <_sk_callback_hsw+0x524>
+ DB 196,98,125,24,29,62,5,0,0 ; vbroadcastss 0x53e(%rip),%ymm11 # 4e94 <_sk_callback_hsw+0x528>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -4450,14 +4450,16 @@ PUBLIC _sk_callback_hsw
_sk_callback_hsw LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp
DB 197,252,17,188,36,128,0,0,0 ; vmovups %ymm7,0x80(%rsp)
DB 197,252,17,116,36,96 ; vmovups %ymm6,0x60(%rsp)
DB 197,252,17,108,36,64 ; vmovups %ymm5,0x40(%rsp)
DB 197,252,17,100,36,32 ; vmovups %ymm4,0x20(%rsp)
- DB 73,137,207 ; mov %rcx,%r15
- DB 73,137,214 ; mov %rdx,%r14
+ DB 77,137,196 ; mov %r8,%r12
+ DB 73,137,206 ; mov %rcx,%r14
+ DB 73,137,215 ; mov %rdx,%r15
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,137,195 ; mov %rax,%rbx
DB 197,252,20,225 ; vunpcklps %ymm1,%ymm0,%ymm4
@@ -4476,9 +4478,9 @@ _sk_callback_hsw LABEL PROC
DB 197,253,17,107,40 ; vmovupd %ymm5,0x28(%rbx)
DB 197,253,17,75,72 ; vmovupd %ymm1,0x48(%rbx)
DB 197,253,17,67,104 ; vmovupd %ymm0,0x68(%rbx)
- DB 77,133,255 ; test %r15,%r15
+ DB 77,133,228 ; test %r12,%r12
DB 186,8,0,0,0 ; mov $0x8,%edx
- DB 65,15,69,215 ; cmovne %r15d,%edx
+ DB 65,15,69,212 ; cmovne %r12d,%edx
DB 72,137,217 ; mov %rbx,%rcx
DB 197,248,119 ; vzeroupper
DB 255,19 ; callq *(%rbx)
@@ -4500,14 +4502,16 @@ _sk_callback_hsw LABEL PROC
DB 197,213,20,211 ; vunpcklpd %ymm3,%ymm5,%ymm2
DB 197,213,21,219 ; vunpckhpd %ymm3,%ymm5,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,249 ; mov %r15,%rcx
+ DB 76,137,250 ; mov %r15,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 77,137,224 ; mov %r12,%r8
DB 197,252,16,100,36,32 ; vmovups 0x20(%rsp),%ymm4
DB 197,252,16,108,36,64 ; vmovups 0x40(%rsp),%ymm5
DB 197,252,16,116,36,96 ; vmovups 0x60(%rsp),%ymm6
DB 197,252,16,188,36,128,0,0,0 ; vmovups 0x80(%rsp),%ymm7
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -4553,25 +4557,25 @@ ALIGN 4
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 4b45 <.literal4+0xb1>
+ DB 71,225,61 ; rex.RXB loope 4b41 <.literal4+0xb1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 4b55 <.literal4+0xc1>
+ DB 71,225,61 ; rex.RXB loope 4b51 <.literal4+0xc1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 4b65 <.literal4+0xd1>
+ DB 71,225,61 ; rex.RXB loope 4b61 <.literal4+0xd1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 4b75 <.literal4+0xe1>
+ DB 71,225,61 ; rex.RXB loope 4b71 <.literal4+0xe1>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
@@ -4621,7 +4625,7 @@ ALIGN 4
DB 190,129,128,128,59 ; mov $0x3b808081,%esi
DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 4bcd <.literal4+0x139>
+ DB 224,7 ; loopne 4bc9 <.literal4+0x139>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -4637,10 +4641,10 @@ ALIGN 4
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
DB 0,52,255 ; add %dh,(%rdi,%rdi,8)
DB 255 ; (bad)
- DB 127,0 ; jg 4bf4 <.literal4+0x160>
+ DB 127,0 ; jg 4bf0 <.literal4+0x160>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 4c6d <.literal4+0x1d9>
+ DB 119,115 ; ja 4c69 <.literal4+0x1d9>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -4654,10 +4658,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 4c28 <.literal4+0x194>
+ DB 127,0 ; jg 4c24 <.literal4+0x194>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 4ca1 <.literal4+0x20d>
+ DB 119,115 ; ja 4c9d <.literal4+0x20d>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -4671,10 +4675,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 4c5c <.literal4+0x1c8>
+ DB 127,0 ; jg 4c58 <.literal4+0x1c8>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 4cd5 <.literal4+0x241>
+ DB 119,115 ; ja 4cd1 <.literal4+0x241>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -4688,10 +4692,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 4c90 <.literal4+0x1fc>
+ DB 127,0 ; jg 4c8c <.literal4+0x1fc>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 4d09 <.literal4+0x275>
+ DB 119,115 ; ja 4d05 <.literal4+0x275>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -4704,7 +4708,7 @@ ALIGN 4
DB 0,75,0 ; add %cl,0x0(%rbx)
DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax)
DB 66,0,0 ; rex.X add %al,(%rax)
- DB 127,67 ; jg 4d07 <.literal4+0x273>
+ DB 127,67 ; jg 4d03 <.literal4+0x273>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -4716,10 +4720,10 @@ ALIGN 4
DB 190,80,128,3,62 ; mov $0x3e038050,%esi
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 4d27 <.literal4+0x293>
+ DB 118,63 ; jbe 4d23 <.literal4+0x293>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
- DB 127,67 ; jg 4d3b <.literal4+0x2a7>
+ DB 127,67 ; jg 4d37 <.literal4+0x2a7>
DB 129,128,128,59,0,0,128,63,129,128 ; addl $0x80813f80,0x3b80(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
@@ -4728,7 +4732,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 4d1d <.literal4+0x289>
+ DB 224,7 ; loopne 4d19 <.literal4+0x289>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -4740,7 +4744,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 4d39 <.literal4+0x2a5>
+ DB 224,7 ; loopne 4d35 <.literal4+0x2a5>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -4751,7 +4755,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 4d8e <.literal4+0x2fa>
+ DB 124,66 ; jl 4d8a <.literal4+0x2fa>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax)
@@ -4769,9 +4773,9 @@ ALIGN 4
DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax)
DB 0,0 ; add %al,(%rax)
DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax)
- DB 112,65 ; jo 4dd1 <.literal4+0x33d>
+ DB 112,65 ; jo 4dcd <.literal4+0x33d>
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
- DB 127,67 ; jg 4ddf <.literal4+0x34b>
+ DB 127,67 ; jg 4ddb <.literal4+0x34b>
DB 128,0,128 ; addb $0x80,(%rax)
DB 55 ; (bad)
DB 128,0,128 ; addb $0x80,(%rax)
@@ -4779,7 +4783,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 4df3 <.literal4+0x35f>
+ DB 127,71 ; jg 4def <.literal4+0x35f>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,191,0,0,0 ; add %al,0xbf(%rax)
@@ -4887,16 +4891,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004ec8 <_sk_callback_hsw+0xa00054e>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004ec8 <_sk_callback_hsw+0xa00055c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ed0 <_sk_callback_hsw+0x12000556>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ed0 <_sk_callback_hsw+0x12000564>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ed8 <_sk_callback_hsw+0x1a00055e>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ed8 <_sk_callback_hsw+0x1a00056c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004ee0 <_sk_callback_hsw+0x3000566>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004ee0 <_sk_callback_hsw+0x3000574>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -4939,16 +4943,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f28 <_sk_callback_hsw+0xa0005ae>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f28 <_sk_callback_hsw+0xa0005bc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f30 <_sk_callback_hsw+0x120005b6>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f30 <_sk_callback_hsw+0x120005c4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f38 <_sk_callback_hsw+0x1a0005be>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f38 <_sk_callback_hsw+0x1a0005cc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004f40 <_sk_callback_hsw+0x30005c6>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004f40 <_sk_callback_hsw+0x30005d4>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -4991,16 +4995,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f88 <_sk_callback_hsw+0xa00060e>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f88 <_sk_callback_hsw+0xa00061c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f90 <_sk_callback_hsw+0x12000616>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f90 <_sk_callback_hsw+0x12000624>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f98 <_sk_callback_hsw+0x1a00061e>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f98 <_sk_callback_hsw+0x1a00062c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004fa0 <_sk_callback_hsw+0x3000626>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004fa0 <_sk_callback_hsw+0x3000634>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -5043,16 +5047,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004fe8 <_sk_callback_hsw+0xa00066e>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004fe8 <_sk_callback_hsw+0xa00067c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ff0 <_sk_callback_hsw+0x12000676>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ff0 <_sk_callback_hsw+0x12000684>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ff8 <_sk_callback_hsw+0x1a00067e>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ff8 <_sk_callback_hsw+0x1a00068c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005000 <_sk_callback_hsw+0x3000686>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005000 <_sk_callback_hsw+0x3000694>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -5095,16 +5099,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005048 <_sk_callback_hsw+0xa0006ce>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005048 <_sk_callback_hsw+0xa0006dc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005050 <_sk_callback_hsw+0x120006d6>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005050 <_sk_callback_hsw+0x120006e4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005058 <_sk_callback_hsw+0x1a0006de>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005058 <_sk_callback_hsw+0x1a0006ec>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005060 <_sk_callback_hsw+0x30006e6>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005060 <_sk_callback_hsw+0x30006f4>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -5157,8 +5161,9 @@ _sk_start_pipeline_avx LABEL PROC
DB 65,84 ; push %r12
DB 86 ; push %rsi
DB 87 ; push %rdi
+ DB 85 ; push %rbp
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp
DB 197,120,41,188,36,144,0,0,0 ; vmovaps %xmm15,0x90(%rsp)
DB 197,120,41,180,36,128,0,0,0 ; vmovaps %xmm14,0x80(%rsp)
DB 197,120,41,108,36,112 ; vmovaps %xmm13,0x70(%rsp)
@@ -5169,19 +5174,20 @@ _sk_start_pipeline_avx LABEL PROC
DB 197,120,41,68,36,32 ; vmovaps %xmm8,0x20(%rsp)
DB 197,248,41,124,36,16 ; vmovaps %xmm7,0x10(%rsp)
DB 197,248,41,52,36 ; vmovaps %xmm6,(%rsp)
- DB 77,137,205 ; mov %r9,%r13
- DB 77,137,198 ; mov %r8,%r14
- DB 72,137,203 ; mov %rcx,%rbx
- DB 72,137,214 ; mov %rdx,%rsi
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,199 ; mov %rax,%r15
- DB 73,137,244 ; mov %rsi,%r12
- DB 72,141,67,8 ; lea 0x8(%rbx),%rax
- DB 76,57,232 ; cmp %r13,%rax
- DB 118,5 ; jbe 75 <_sk_start_pipeline_avx+0x75>
- DB 72,137,223 ; mov %rbx,%rdi
- DB 235,65 ; jmp b6 <_sk_start_pipeline_avx+0xb6>
- DB 185,0,0,0,0 ; mov $0x0,%ecx
+ DB 76,137,195 ; mov %r8,%rbx
+ DB 73,137,214 ; mov %rdx,%r14
+ DB 72,137,205 ; mov %rcx,%rbp
+ DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15
+ DB 76,137,206 ; mov %r9,%rsi
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 73,137,196 ; mov %rax,%r12
+ DB 73,137,245 ; mov %rsi,%r13
+ DB 72,141,69,8 ; lea 0x8(%rbp),%rax
+ DB 72,57,216 ; cmp %rbx,%rax
+ DB 118,5 ; jbe 7e <_sk_start_pipeline_avx+0x7e>
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 235,69 ; jmp c3 <_sk_start_pipeline_avx+0xc3>
+ DB 65,184,0,0,0,0 ; mov $0x0,%r8d
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -5190,17 +5196,18 @@ _sk_start_pipeline_avx LABEL PROC
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6
DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7
- DB 72,137,223 ; mov %rbx,%rdi
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 65,255,215 ; callq *%r15
- DB 72,141,123,8 ; lea 0x8(%rbx),%rdi
- DB 72,131,195,16 ; add $0x10,%rbx
- DB 76,57,235 ; cmp %r13,%rbx
- DB 72,137,251 ; mov %rdi,%rbx
- DB 118,191 ; jbe 75 <_sk_start_pipeline_avx+0x75>
- DB 73,41,253 ; sub %rdi,%r13
- DB 116,44 ; je e7 <_sk_start_pipeline_avx+0xe7>
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 65,255,212 ; callq *%r12
+ DB 72,141,85,8 ; lea 0x8(%rbp),%rdx
+ DB 72,131,197,16 ; add $0x10,%rbp
+ DB 72,57,221 ; cmp %rbx,%rbp
+ DB 72,137,213 ; mov %rdx,%rbp
+ DB 118,187 ; jbe 7e <_sk_start_pipeline_avx+0x7e>
+ DB 72,41,211 ; sub %rdx,%rbx
+ DB 116,47 ; je f7 <_sk_start_pipeline_avx+0xf7>
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -5209,10 +5216,11 @@ _sk_start_pipeline_avx LABEL PROC
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6
DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,233 ; mov %r13,%rcx
- DB 65,255,215 ; callq *%r15
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 73,137,216 ; mov %rbx,%r8
+ DB 65,255,212 ; callq *%r12
DB 197,248,40,52,36 ; vmovaps (%rsp),%xmm6
DB 197,248,40,124,36,16 ; vmovaps 0x10(%rsp),%xmm7
DB 197,120,40,68,36,32 ; vmovaps 0x20(%rsp),%xmm8
@@ -5223,8 +5231,9 @@ _sk_start_pipeline_avx LABEL PROC
DB 197,120,40,108,36,112 ; vmovaps 0x70(%rsp),%xmm13
DB 197,120,40,180,36,128,0,0,0 ; vmovaps 0x80(%rsp),%xmm14
DB 197,120,40,188,36,144,0,0,0 ; vmovaps 0x90(%rsp),%xmm15
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp
DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 95 ; pop %rdi
DB 94 ; pop %rsi
DB 65,92 ; pop %r12
@@ -5240,19 +5249,20 @@ _sk_just_return_avx LABEL PROC
PUBLIC _sk_seed_shader_avx
_sk_seed_shader_avx LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 197,249,110,199 ; vmovd %edi,%xmm0
+ DB 197,249,110,194 ; vmovd %edx,%xmm0
DB 197,249,112,192,0 ; vpshufd $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,31,101,0,0 ; vbroadcastss 0x651f(%rip),%ymm1 # 667c <_sk_callback_avx+0x11c>
+ DB 196,226,125,24,13,112,101,0,0 ; vbroadcastss 0x6570(%rip),%ymm1 # 66dc <_sk_callback_avx+0x126>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
- DB 197,252,88,2 ; vaddps (%rdx),%ymm0,%ymm0
- DB 196,226,125,24,16 ; vbroadcastss (%rax),%ymm2
+ DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0
+ DB 197,249,110,209 ; vmovd %ecx,%xmm2
+ DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
+ DB 196,227,109,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,21,3,101,0,0 ; vbroadcastss 0x6503(%rip),%ymm2 # 6680 <_sk_callback_avx+0x120>
+ DB 196,226,125,24,21,74,101,0,0 ; vbroadcastss 0x654a(%rip),%ymm2 # 66e0 <_sk_callback_avx+0x12a>
DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
@@ -5263,17 +5273,18 @@ _sk_seed_shader_avx LABEL PROC
PUBLIC _sk_dither_avx
_sk_dither_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 197,124,16,66,32 ; vmovups 0x20(%rdx),%ymm8
+ DB 197,124,16,71,32 ; vmovups 0x20(%rdi),%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
- DB 197,121,110,215 ; vmovd %edi,%xmm10
+ DB 197,121,110,210 ; vmovd %edx,%xmm10
DB 196,65,121,112,210,0 ; vpshufd $0x0,%xmm10,%xmm10
DB 196,65,49,254,202 ; vpaddd %xmm10,%xmm9,%xmm9
DB 196,65,57,254,194 ; vpaddd %xmm10,%xmm8,%xmm8
DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- DB 76,139,0 ; mov (%rax),%r8
- DB 196,66,125,24,8 ; vbroadcastss (%r8),%ymm9
- DB 196,65,60,87,209 ; vxorps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,29,180,100,0,0 ; vbroadcastss 0x64b4(%rip),%ymm11 # 6684 <_sk_callback_avx+0x124>
+ DB 197,121,110,201 ; vmovd %ecx,%xmm9
+ DB 196,65,121,112,201,0 ; vpshufd $0x0,%xmm9,%xmm9
+ DB 196,67,53,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
+ DB 196,65,52,87,208 ; vxorps %ymm8,%ymm9,%ymm10
+ DB 196,98,125,24,29,243,100,0,0 ; vbroadcastss 0x64f3(%rip),%ymm11 # 66e4 <_sk_callback_avx+0x12e>
DB 196,65,44,84,203 ; vandps %ymm11,%ymm10,%ymm9
DB 196,193,25,114,241,5 ; vpslld $0x5,%xmm9,%xmm12
DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9
@@ -5284,8 +5295,8 @@ _sk_dither_avx LABEL PROC
DB 196,67,125,25,219,1 ; vextractf128 $0x1,%ymm11,%xmm11
DB 196,193,33,114,243,4 ; vpslld $0x4,%xmm11,%xmm11
DB 196,67,29,24,219,1 ; vinsertf128 $0x1,%xmm11,%ymm12,%ymm11
- DB 196,98,125,24,37,117,100,0,0 ; vbroadcastss 0x6475(%rip),%ymm12 # 6688 <_sk_callback_avx+0x128>
- DB 196,98,125,24,45,112,100,0,0 ; vbroadcastss 0x6470(%rip),%ymm13 # 668c <_sk_callback_avx+0x12c>
+ DB 196,98,125,24,37,180,100,0,0 ; vbroadcastss 0x64b4(%rip),%ymm12 # 66e8 <_sk_callback_avx+0x132>
+ DB 196,98,125,24,45,175,100,0,0 ; vbroadcastss 0x64af(%rip),%ymm13 # 66ec <_sk_callback_avx+0x136>
DB 196,65,44,84,245 ; vandps %ymm13,%ymm10,%ymm14
DB 196,193,1,114,246,2 ; vpslld $0x2,%xmm14,%xmm15
DB 196,67,125,25,246,1 ; vextractf128 $0x1,%ymm14,%xmm14
@@ -5308,15 +5319,15 @@ _sk_dither_avx LABEL PROC
DB 196,67,29,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm12,%ymm8
DB 196,65,20,86,219 ; vorps %ymm11,%ymm13,%ymm11
DB 196,65,36,86,192 ; vorps %ymm8,%ymm11,%ymm8
+ DB 196,65,52,86,206 ; vorps %ymm14,%ymm9,%ymm9
DB 196,65,60,86,193 ; vorps %ymm9,%ymm8,%ymm8
- DB 196,65,12,86,202 ; vorps %ymm10,%ymm14,%ymm9
- DB 196,65,60,86,193 ; vorps %ymm9,%ymm8,%ymm8
+ DB 196,65,60,86,194 ; vorps %ymm10,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,219,99,0,0 ; vbroadcastss 0x63db(%rip),%ymm9 # 6690 <_sk_callback_avx+0x130>
+ DB 196,98,125,24,13,26,100,0,0 ; vbroadcastss 0x641a(%rip),%ymm9 # 66f0 <_sk_callback_avx+0x13a>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,209,99,0,0 ; vbroadcastss 0x63d1(%rip),%ymm9 # 6694 <_sk_callback_avx+0x134>
+ DB 196,98,125,24,13,16,100,0,0 ; vbroadcastss 0x6410(%rip),%ymm9 # 66f4 <_sk_callback_avx+0x13e>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,72,8 ; vbroadcastss 0x8(%rax),%ymm9
+ DB 196,98,125,24,8 ; vbroadcastss (%rax),%ymm9
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,188,88,192 ; vaddps %ymm0,%ymm8,%ymm0
DB 197,188,88,201 ; vaddps %ymm1,%ymm8,%ymm1
@@ -5373,7 +5384,7 @@ _sk_clear_avx LABEL PROC
PUBLIC _sk_srcatop_avx
_sk_srcatop_avx LABEL PROC
DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0
- DB 196,98,125,24,5,40,99,0,0 ; vbroadcastss 0x6328(%rip),%ymm8 # 6698 <_sk_callback_avx+0x138>
+ DB 196,98,125,24,5,104,99,0,0 ; vbroadcastss 0x6368(%rip),%ymm8 # 66f8 <_sk_callback_avx+0x142>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -5392,7 +5403,7 @@ _sk_srcatop_avx LABEL PROC
PUBLIC _sk_dstatop_avx
_sk_dstatop_avx LABEL PROC
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
- DB 196,98,125,24,13,234,98,0,0 ; vbroadcastss 0x62ea(%rip),%ymm9 # 669c <_sk_callback_avx+0x13c>
+ DB 196,98,125,24,13,42,99,0,0 ; vbroadcastss 0x632a(%rip),%ymm9 # 66fc <_sk_callback_avx+0x146>
DB 197,52,92,207 ; vsubps %ymm7,%ymm9,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,188,88,192 ; vaddps %ymm0,%ymm8,%ymm0
@@ -5428,7 +5439,7 @@ _sk_dstin_avx LABEL PROC
PUBLIC _sk_srcout_avx
_sk_srcout_avx LABEL PROC
- DB 196,98,125,24,5,137,98,0,0 ; vbroadcastss 0x6289(%rip),%ymm8 # 66a0 <_sk_callback_avx+0x140>
+ DB 196,98,125,24,5,201,98,0,0 ; vbroadcastss 0x62c9(%rip),%ymm8 # 6700 <_sk_callback_avx+0x14a>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -5439,7 +5450,7 @@ _sk_srcout_avx LABEL PROC
PUBLIC _sk_dstout_avx
_sk_dstout_avx LABEL PROC
- DB 196,226,125,24,5,108,98,0,0 ; vbroadcastss 0x626c(%rip),%ymm0 # 66a4 <_sk_callback_avx+0x144>
+ DB 196,226,125,24,5,172,98,0,0 ; vbroadcastss 0x62ac(%rip),%ymm0 # 6704 <_sk_callback_avx+0x14e>
DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3
DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0
DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1
@@ -5450,7 +5461,7 @@ _sk_dstout_avx LABEL PROC
PUBLIC _sk_srcover_avx
_sk_srcover_avx LABEL PROC
- DB 196,98,125,24,5,79,98,0,0 ; vbroadcastss 0x624f(%rip),%ymm8 # 66a8 <_sk_callback_avx+0x148>
+ DB 196,98,125,24,5,143,98,0,0 ; vbroadcastss 0x628f(%rip),%ymm8 # 6708 <_sk_callback_avx+0x152>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -5465,7 +5476,7 @@ _sk_srcover_avx LABEL PROC
PUBLIC _sk_dstover_avx
_sk_dstover_avx LABEL PROC
- DB 196,98,125,24,5,34,98,0,0 ; vbroadcastss 0x6222(%rip),%ymm8 # 66ac <_sk_callback_avx+0x14c>
+ DB 196,98,125,24,5,98,98,0,0 ; vbroadcastss 0x6262(%rip),%ymm8 # 670c <_sk_callback_avx+0x156>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,252,88,196 ; vaddps %ymm4,%ymm0,%ymm0
@@ -5489,7 +5500,7 @@ _sk_modulate_avx LABEL PROC
PUBLIC _sk_multiply_avx
_sk_multiply_avx LABEL PROC
- DB 196,98,125,24,5,225,97,0,0 ; vbroadcastss 0x61e1(%rip),%ymm8 # 66b0 <_sk_callback_avx+0x150>
+ DB 196,98,125,24,5,33,98,0,0 ; vbroadcastss 0x6221(%rip),%ymm8 # 6710 <_sk_callback_avx+0x15a>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -5543,7 +5554,7 @@ _sk_screen_avx LABEL PROC
PUBLIC _sk_xor__avx
_sk_xor__avx LABEL PROC
- DB 196,98,125,24,5,48,97,0,0 ; vbroadcastss 0x6130(%rip),%ymm8 # 66b4 <_sk_callback_avx+0x154>
+ DB 196,98,125,24,5,112,97,0,0 ; vbroadcastss 0x6170(%rip),%ymm8 # 6714 <_sk_callback_avx+0x15e>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -5578,7 +5589,7 @@ _sk_darken_avx LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,176,96,0,0 ; vbroadcastss 0x60b0(%rip),%ymm8 # 66b8 <_sk_callback_avx+0x158>
+ DB 196,98,125,24,5,240,96,0,0 ; vbroadcastss 0x60f0(%rip),%ymm8 # 6718 <_sk_callback_avx+0x162>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -5602,7 +5613,7 @@ _sk_lighten_avx LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,92,96,0,0 ; vbroadcastss 0x605c(%rip),%ymm8 # 66bc <_sk_callback_avx+0x15c>
+ DB 196,98,125,24,5,156,96,0,0 ; vbroadcastss 0x609c(%rip),%ymm8 # 671c <_sk_callback_avx+0x166>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -5629,7 +5640,7 @@ _sk_difference_avx LABEL PROC
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,252,95,0,0 ; vbroadcastss 0x5ffc(%rip),%ymm8 # 66c0 <_sk_callback_avx+0x160>
+ DB 196,98,125,24,5,60,96,0,0 ; vbroadcastss 0x603c(%rip),%ymm8 # 6720 <_sk_callback_avx+0x16a>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -5650,7 +5661,7 @@ _sk_exclusion_avx LABEL PROC
DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,183,95,0,0 ; vbroadcastss 0x5fb7(%rip),%ymm8 # 66c4 <_sk_callback_avx+0x164>
+ DB 196,98,125,24,5,247,95,0,0 ; vbroadcastss 0x5ff7(%rip),%ymm8 # 6724 <_sk_callback_avx+0x16e>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -5659,7 +5670,7 @@ _sk_exclusion_avx LABEL PROC
PUBLIC _sk_colorburn_avx
_sk_colorburn_avx LABEL PROC
- DB 196,98,125,24,5,162,95,0,0 ; vbroadcastss 0x5fa2(%rip),%ymm8 # 66c8 <_sk_callback_avx+0x168>
+ DB 196,98,125,24,5,226,95,0,0 ; vbroadcastss 0x5fe2(%rip),%ymm8 # 6728 <_sk_callback_avx+0x172>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11
DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10
@@ -5719,7 +5730,7 @@ _sk_colorburn_avx LABEL PROC
PUBLIC _sk_colordodge_avx
_sk_colordodge_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,13,158,94,0,0 ; vbroadcastss 0x5e9e(%rip),%ymm9 # 66cc <_sk_callback_avx+0x16c>
+ DB 196,98,125,24,13,222,94,0,0 ; vbroadcastss 0x5ede(%rip),%ymm9 # 672c <_sk_callback_avx+0x176>
DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9
@@ -5774,7 +5785,7 @@ _sk_colordodge_avx LABEL PROC
PUBLIC _sk_hardlight_avx
_sk_hardlight_avx LABEL PROC
- DB 196,98,125,24,5,176,93,0,0 ; vbroadcastss 0x5db0(%rip),%ymm8 # 66d0 <_sk_callback_avx+0x170>
+ DB 196,98,125,24,5,240,93,0,0 ; vbroadcastss 0x5df0(%rip),%ymm8 # 6730 <_sk_callback_avx+0x17a>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -5827,7 +5838,7 @@ _sk_hardlight_avx LABEL PROC
PUBLIC _sk_overlay_avx
_sk_overlay_avx LABEL PROC
- DB 196,98,125,24,5,217,92,0,0 ; vbroadcastss 0x5cd9(%rip),%ymm8 # 66d4 <_sk_callback_avx+0x174>
+ DB 196,98,125,24,5,25,93,0,0 ; vbroadcastss 0x5d19(%rip),%ymm8 # 6734 <_sk_callback_avx+0x17e>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -5892,10 +5903,10 @@ _sk_softlight_avx LABEL PROC
DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8
DB 196,65,60,89,216 ; vmulps %ymm8,%ymm8,%ymm11
DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8
- DB 196,98,125,24,29,204,91,0,0 ; vbroadcastss 0x5bcc(%rip),%ymm11 # 66dc <_sk_callback_avx+0x17c>
+ DB 196,98,125,24,29,12,92,0,0 ; vbroadcastss 0x5c0c(%rip),%ymm11 # 673c <_sk_callback_avx+0x186>
DB 196,65,28,88,235 ; vaddps %ymm11,%ymm12,%ymm13
DB 196,65,20,89,192 ; vmulps %ymm8,%ymm13,%ymm8
- DB 196,98,125,24,45,189,91,0,0 ; vbroadcastss 0x5bbd(%rip),%ymm13 # 66e0 <_sk_callback_avx+0x180>
+ DB 196,98,125,24,45,253,91,0,0 ; vbroadcastss 0x5bfd(%rip),%ymm13 # 6740 <_sk_callback_avx+0x18a>
DB 196,65,28,89,245 ; vmulps %ymm13,%ymm12,%ymm14
DB 196,65,12,88,192 ; vaddps %ymm8,%ymm14,%ymm8
DB 196,65,124,82,244 ; vrsqrtps %ymm12,%ymm14
@@ -5906,7 +5917,7 @@ _sk_softlight_avx LABEL PROC
DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15
DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14
DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15
- DB 196,98,125,24,5,123,91,0,0 ; vbroadcastss 0x5b7b(%rip),%ymm8 # 66d8 <_sk_callback_avx+0x178>
+ DB 196,98,125,24,5,187,91,0,0 ; vbroadcastss 0x5bbb(%rip),%ymm8 # 6738 <_sk_callback_avx+0x182>
DB 196,65,60,92,228 ; vsubps %ymm12,%ymm8,%ymm12
DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0
DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12
@@ -6033,12 +6044,12 @@ _sk_hue_avx LABEL PROC
DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11
DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11
DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- DB 196,98,125,24,53,69,89,0,0 ; vbroadcastss 0x5945(%rip),%ymm14 # 66e4 <_sk_callback_avx+0x184>
+ DB 196,98,125,24,53,133,89,0,0 ; vbroadcastss 0x5985(%rip),%ymm14 # 6744 <_sk_callback_avx+0x18e>
DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11
- DB 196,98,125,24,61,59,89,0,0 ; vbroadcastss 0x593b(%rip),%ymm15 # 66e8 <_sk_callback_avx+0x188>
+ DB 196,98,125,24,61,123,89,0,0 ; vbroadcastss 0x597b(%rip),%ymm15 # 6748 <_sk_callback_avx+0x192>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
- DB 196,226,125,24,5,44,89,0,0 ; vbroadcastss 0x592c(%rip),%ymm0 # 66ec <_sk_callback_avx+0x18c>
+ DB 196,226,125,24,5,108,89,0,0 ; vbroadcastss 0x596c(%rip),%ymm0 # 674c <_sk_callback_avx+0x196>
DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13
@@ -6099,7 +6110,7 @@ _sk_hue_avx LABEL PROC
DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10
DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,5,88,0,0 ; vbroadcastss 0x5805(%rip),%ymm8 # 66f0 <_sk_callback_avx+0x190>
+ DB 196,98,125,24,5,69,88,0,0 ; vbroadcastss 0x5845(%rip),%ymm8 # 6750 <_sk_callback_avx+0x19a>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -6156,12 +6167,12 @@ _sk_saturation_avx LABEL PROC
DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11
DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11
DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- DB 196,98,125,24,53,13,87,0,0 ; vbroadcastss 0x570d(%rip),%ymm14 # 66f4 <_sk_callback_avx+0x194>
+ DB 196,98,125,24,53,77,87,0,0 ; vbroadcastss 0x574d(%rip),%ymm14 # 6754 <_sk_callback_avx+0x19e>
DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11
- DB 196,98,125,24,61,3,87,0,0 ; vbroadcastss 0x5703(%rip),%ymm15 # 66f8 <_sk_callback_avx+0x198>
+ DB 196,98,125,24,61,67,87,0,0 ; vbroadcastss 0x5743(%rip),%ymm15 # 6758 <_sk_callback_avx+0x1a2>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
- DB 196,226,125,24,5,244,86,0,0 ; vbroadcastss 0x56f4(%rip),%ymm0 # 66fc <_sk_callback_avx+0x19c>
+ DB 196,226,125,24,5,52,87,0,0 ; vbroadcastss 0x5734(%rip),%ymm0 # 675c <_sk_callback_avx+0x1a6>
DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13
@@ -6222,7 +6233,7 @@ _sk_saturation_avx LABEL PROC
DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10
DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,205,85,0,0 ; vbroadcastss 0x55cd(%rip),%ymm8 # 6700 <_sk_callback_avx+0x1a0>
+ DB 196,98,125,24,5,13,86,0,0 ; vbroadcastss 0x560d(%rip),%ymm8 # 6760 <_sk_callback_avx+0x1aa>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -6251,12 +6262,12 @@ _sk_color_avx LABEL PROC
DB 197,252,17,68,36,32 ; vmovups %ymm0,0x20(%rsp)
DB 197,124,89,199 ; vmulps %ymm7,%ymm0,%ymm8
DB 197,116,89,207 ; vmulps %ymm7,%ymm1,%ymm9
- DB 196,98,125,24,45,93,85,0,0 ; vbroadcastss 0x555d(%rip),%ymm13 # 6704 <_sk_callback_avx+0x1a4>
+ DB 196,98,125,24,45,157,85,0,0 ; vbroadcastss 0x559d(%rip),%ymm13 # 6764 <_sk_callback_avx+0x1ae>
DB 196,65,92,89,213 ; vmulps %ymm13,%ymm4,%ymm10
- DB 196,98,125,24,53,83,85,0,0 ; vbroadcastss 0x5553(%rip),%ymm14 # 6708 <_sk_callback_avx+0x1a8>
+ DB 196,98,125,24,53,147,85,0,0 ; vbroadcastss 0x5593(%rip),%ymm14 # 6768 <_sk_callback_avx+0x1b2>
DB 196,65,84,89,222 ; vmulps %ymm14,%ymm5,%ymm11
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,61,68,85,0,0 ; vbroadcastss 0x5544(%rip),%ymm15 # 670c <_sk_callback_avx+0x1ac>
+ DB 196,98,125,24,61,132,85,0,0 ; vbroadcastss 0x5584(%rip),%ymm15 # 676c <_sk_callback_avx+0x1b6>
DB 196,65,76,89,223 ; vmulps %ymm15,%ymm6,%ymm11
DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0
DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11
@@ -6319,7 +6330,7 @@ _sk_color_avx LABEL PROC
DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9
DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0
DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8
- DB 196,226,125,24,5,11,84,0,0 ; vbroadcastss 0x540b(%rip),%ymm0 # 6710 <_sk_callback_avx+0x1b0>
+ DB 196,226,125,24,5,75,84,0,0 ; vbroadcastss 0x544b(%rip),%ymm0 # 6770 <_sk_callback_avx+0x1ba>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,84,36,32 ; vmulps 0x20(%rsp),%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -6349,12 +6360,12 @@ _sk_luminosity_avx LABEL PROC
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
DB 197,100,89,205 ; vmulps %ymm5,%ymm3,%ymm9
- DB 196,98,125,24,45,151,83,0,0 ; vbroadcastss 0x5397(%rip),%ymm13 # 6714 <_sk_callback_avx+0x1b4>
+ DB 196,98,125,24,45,215,83,0,0 ; vbroadcastss 0x53d7(%rip),%ymm13 # 6774 <_sk_callback_avx+0x1be>
DB 196,65,108,89,213 ; vmulps %ymm13,%ymm2,%ymm10
- DB 196,98,125,24,53,141,83,0,0 ; vbroadcastss 0x538d(%rip),%ymm14 # 6718 <_sk_callback_avx+0x1b8>
+ DB 196,98,125,24,53,205,83,0,0 ; vbroadcastss 0x53cd(%rip),%ymm14 # 6778 <_sk_callback_avx+0x1c2>
DB 196,65,116,89,222 ; vmulps %ymm14,%ymm1,%ymm11
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,61,126,83,0,0 ; vbroadcastss 0x537e(%rip),%ymm15 # 671c <_sk_callback_avx+0x1bc>
+ DB 196,98,125,24,61,190,83,0,0 ; vbroadcastss 0x53be(%rip),%ymm15 # 677c <_sk_callback_avx+0x1c6>
DB 196,65,28,89,223 ; vmulps %ymm15,%ymm12,%ymm11
DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0
DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11
@@ -6417,7 +6428,7 @@ _sk_luminosity_avx LABEL PROC
DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9
DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0
DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8
- DB 196,226,125,24,5,69,82,0,0 ; vbroadcastss 0x5245(%rip),%ymm0 # 6720 <_sk_callback_avx+0x1c0>
+ DB 196,226,125,24,5,133,82,0,0 ; vbroadcastss 0x5285(%rip),%ymm0 # 6780 <_sk_callback_avx+0x1ca>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -6441,14 +6452,14 @@ _sk_luminosity_avx LABEL PROC
PUBLIC _sk_srcover_rgba_8888_avx
_sk_srcover_rgba_8888_avx LABEL PROC
DB 72,131,236,16 ; sub $0x10,%rsp
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,47,1,0,0 ; jne 1675 <_sk_srcover_rgba_8888_avx+0x14c>
- DB 196,193,124,16,57 ; vmovups (%r9),%ymm7
- DB 197,124,40,13,13,86,0,0 ; vmovaps 0x560d(%rip),%ymm9 # 6b60 <_sk_callback_avx+0x600>
+ DB 15,133,47,1,0,0 ; jne 1695 <_sk_srcover_rgba_8888_avx+0x14c>
+ DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
+ DB 197,124,40,13,77,86,0,0 ; vmovaps 0x564d(%rip),%ymm9 # 6bc0 <_sk_callback_avx+0x60a>
DB 196,193,68,84,225 ; vandps %ymm9,%ymm7,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
DB 197,209,114,215,8 ; vpsrld $0x8,%xmm7,%xmm5
@@ -6466,9 +6477,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7
DB 196,227,53,24,255,1 ; vinsertf128 $0x1,%xmm7,%ymm9,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,112,81,0,0 ; vbroadcastss 0x5170(%rip),%ymm8 # 6724 <_sk_callback_avx+0x1c4>
+ DB 196,98,125,24,5,176,81,0,0 ; vbroadcastss 0x51b0(%rip),%ymm8 # 6784 <_sk_callback_avx+0x1ce>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
- DB 196,98,125,24,13,103,81,0,0 ; vbroadcastss 0x5167(%rip),%ymm9 # 6728 <_sk_callback_avx+0x1c8>
+ DB 196,98,125,24,13,167,81,0,0 ; vbroadcastss 0x51a7(%rip),%ymm9 # 6788 <_sk_callback_avx+0x1d2>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 197,60,89,212 ; vmulps %ymm4,%ymm8,%ymm10
DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0
@@ -6501,10 +6512,10 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 196,65,53,86,202 ; vorpd %ymm10,%ymm9,%ymm9
DB 196,65,61,86,193 ; vorpd %ymm9,%ymm8,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,91 ; jne 16c0 <_sk_srcover_rgba_8888_avx+0x197>
- DB 196,65,124,17,1 ; vmovups %ymm8,(%r9)
+ DB 117,91 ; jne 16e0 <_sk_srcover_rgba_8888_avx+0x197>
+ DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 72,131,196,16 ; add $0x10,%rsp
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
@@ -6514,13 +6525,13 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,121,48,228 ; vpmovzxbw %xmm4,%xmm4
- DB 196,226,89,0,45,19,84,0,0 ; vpshufb 0x5413(%rip),%xmm4,%xmm5 # 6ab0 <_sk_callback_avx+0x550>
+ DB 196,226,89,0,45,83,84,0,0 ; vpshufb 0x5453(%rip),%xmm4,%xmm5 # 6b10 <_sk_callback_avx+0x55a>
DB 196,226,121,33,237 ; vpmovsxbd %xmm5,%xmm5
- DB 196,226,89,0,37,21,84,0,0 ; vpshufb 0x5415(%rip),%xmm4,%xmm4 # 6ac0 <_sk_callback_avx+0x560>
+ DB 196,226,89,0,37,85,84,0,0 ; vpshufb 0x5455(%rip),%xmm4,%xmm4 # 6b20 <_sk_callback_avx+0x56a>
DB 196,226,121,33,228 ; vpmovsxbd %xmm4,%xmm4
DB 196,227,85,24,228,1 ; vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
- DB 196,194,93,44,57 ; vmaskmovps (%r9),%ymm4,%ymm7
- DB 233,139,254,255,255 ; jmpq 154b <_sk_srcover_rgba_8888_avx+0x22>
+ DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
+ DB 233,139,254,255,255 ; jmpq 156b <_sk_srcover_rgba_8888_avx+0x22>
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
DB 192,225,3 ; shl $0x3,%cl
@@ -6528,13 +6539,13 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,200,83,0,0 ; vpshufb 0x53c8(%rip),%xmm9,%xmm10 # 6ab0 <_sk_callback_avx+0x550>
+ DB 196,98,49,0,21,8,84,0,0 ; vpshufb 0x5408(%rip),%xmm9,%xmm10 # 6b10 <_sk_callback_avx+0x55a>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,202,83,0,0 ; vpshufb 0x53ca(%rip),%xmm9,%xmm9 # 6ac0 <_sk_callback_avx+0x560>
+ DB 196,98,49,0,13,10,84,0,0 ; vpshufb 0x540a(%rip),%xmm9,%xmm9 # 6b20 <_sk_callback_avx+0x56a>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- DB 196,66,53,46,1 ; vmaskmovps %ymm8,%ymm9,(%r9)
- DB 233,95,255,255,255 ; jmpq 166a <_sk_srcover_rgba_8888_avx+0x141>
+ DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
+ DB 233,95,255,255,255 ; jmpq 168a <_sk_srcover_rgba_8888_avx+0x141>
PUBLIC _sk_clamp_0_avx
_sk_clamp_0_avx LABEL PROC
@@ -6548,7 +6559,7 @@ _sk_clamp_0_avx LABEL PROC
PUBLIC _sk_clamp_1_avx
_sk_clamp_1_avx LABEL PROC
- DB 196,98,125,24,5,251,79,0,0 ; vbroadcastss 0x4ffb(%rip),%ymm8 # 672c <_sk_callback_avx+0x1cc>
+ DB 196,98,125,24,5,59,80,0,0 ; vbroadcastss 0x503b(%rip),%ymm8 # 678c <_sk_callback_avx+0x1d6>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
@@ -6558,7 +6569,7 @@ _sk_clamp_1_avx LABEL PROC
PUBLIC _sk_clamp_a_avx
_sk_clamp_a_avx LABEL PROC
- DB 196,98,125,24,5,222,79,0,0 ; vbroadcastss 0x4fde(%rip),%ymm8 # 6730 <_sk_callback_avx+0x1d0>
+ DB 196,98,125,24,5,30,80,0,0 ; vbroadcastss 0x501e(%rip),%ymm8 # 6790 <_sk_callback_avx+0x1da>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0
DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1
@@ -6630,7 +6641,7 @@ PUBLIC _sk_unpremul_avx
_sk_unpremul_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9
- DB 196,98,125,24,21,38,79,0,0 ; vbroadcastss 0x4f26(%rip),%ymm10 # 6734 <_sk_callback_avx+0x1d4>
+ DB 196,98,125,24,21,102,79,0,0 ; vbroadcastss 0x4f66(%rip),%ymm10 # 6794 <_sk_callback_avx+0x1de>
DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10
DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
@@ -6641,17 +6652,17 @@ _sk_unpremul_avx LABEL PROC
PUBLIC _sk_from_srgb_avx
_sk_from_srgb_avx LABEL PROC
- DB 196,98,125,24,5,7,79,0,0 ; vbroadcastss 0x4f07(%rip),%ymm8 # 6738 <_sk_callback_avx+0x1d8>
+ DB 196,98,125,24,5,71,79,0,0 ; vbroadcastss 0x4f47(%rip),%ymm8 # 6798 <_sk_callback_avx+0x1e2>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10
- DB 196,98,125,24,29,249,78,0,0 ; vbroadcastss 0x4ef9(%rip),%ymm11 # 673c <_sk_callback_avx+0x1dc>
+ DB 196,98,125,24,29,57,79,0,0 ; vbroadcastss 0x4f39(%rip),%ymm11 # 679c <_sk_callback_avx+0x1e6>
DB 196,65,124,89,227 ; vmulps %ymm11,%ymm0,%ymm12
- DB 196,98,125,24,45,239,78,0,0 ; vbroadcastss 0x4eef(%rip),%ymm13 # 6740 <_sk_callback_avx+0x1e0>
+ DB 196,98,125,24,45,47,79,0,0 ; vbroadcastss 0x4f2f(%rip),%ymm13 # 67a0 <_sk_callback_avx+0x1ea>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,44,89,212 ; vmulps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,224,78,0,0 ; vbroadcastss 0x4ee0(%rip),%ymm12 # 6744 <_sk_callback_avx+0x1e4>
+ DB 196,98,125,24,37,32,79,0,0 ; vbroadcastss 0x4f20(%rip),%ymm12 # 67a4 <_sk_callback_avx+0x1ee>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,53,214,78,0,0 ; vbroadcastss 0x4ed6(%rip),%ymm14 # 6748 <_sk_callback_avx+0x1e8>
+ DB 196,98,125,24,53,22,79,0,0 ; vbroadcastss 0x4f16(%rip),%ymm14 # 67a8 <_sk_callback_avx+0x1f2>
DB 196,193,124,194,198,1 ; vcmpltps %ymm14,%ymm0,%ymm0
DB 196,195,45,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm10,%ymm0
DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9
@@ -6676,20 +6687,20 @@ _sk_from_srgb_avx LABEL PROC
PUBLIC _sk_to_srgb_avx
_sk_to_srgb_avx LABEL PROC
DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9
- DB 196,98,125,24,5,107,78,0,0 ; vbroadcastss 0x4e6b(%rip),%ymm8 # 674c <_sk_callback_avx+0x1ec>
+ DB 196,98,125,24,5,171,78,0,0 ; vbroadcastss 0x4eab(%rip),%ymm8 # 67ac <_sk_callback_avx+0x1f6>
DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10
- DB 196,98,125,24,29,97,78,0,0 ; vbroadcastss 0x4e61(%rip),%ymm11 # 6750 <_sk_callback_avx+0x1f0>
+ DB 196,98,125,24,29,161,78,0,0 ; vbroadcastss 0x4ea1(%rip),%ymm11 # 67b0 <_sk_callback_avx+0x1fa>
DB 196,65,52,89,227 ; vmulps %ymm11,%ymm9,%ymm12
- DB 196,98,125,24,45,87,78,0,0 ; vbroadcastss 0x4e57(%rip),%ymm13 # 6754 <_sk_callback_avx+0x1f4>
+ DB 196,98,125,24,45,151,78,0,0 ; vbroadcastss 0x4e97(%rip),%ymm13 # 67b4 <_sk_callback_avx+0x1fe>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,52,89,228 ; vmulps %ymm12,%ymm9,%ymm12
- DB 196,98,125,24,53,72,78,0,0 ; vbroadcastss 0x4e48(%rip),%ymm14 # 6758 <_sk_callback_avx+0x1f8>
+ DB 196,98,125,24,53,136,78,0,0 ; vbroadcastss 0x4e88(%rip),%ymm14 # 67b8 <_sk_callback_avx+0x202>
DB 196,65,28,88,230 ; vaddps %ymm14,%ymm12,%ymm12
- DB 196,98,125,24,61,62,78,0,0 ; vbroadcastss 0x4e3e(%rip),%ymm15 # 675c <_sk_callback_avx+0x1fc>
+ DB 196,98,125,24,61,126,78,0,0 ; vbroadcastss 0x4e7e(%rip),%ymm15 # 67bc <_sk_callback_avx+0x206>
DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9
DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9
DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9
- DB 196,98,125,24,37,42,78,0,0 ; vbroadcastss 0x4e2a(%rip),%ymm12 # 6760 <_sk_callback_avx+0x200>
+ DB 196,98,125,24,37,106,78,0,0 ; vbroadcastss 0x4e6a(%rip),%ymm12 # 67c0 <_sk_callback_avx+0x20a>
DB 196,193,124,194,196,1 ; vcmpltps %ymm12,%ymm0,%ymm0
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9
@@ -6724,7 +6735,7 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9
DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9
DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,29,144,77,0,0 ; vbroadcastss 0x4d90(%rip),%ymm11 # 6764 <_sk_callback_avx+0x204>
+ DB 196,98,125,24,29,208,77,0,0 ; vbroadcastss 0x4dd0(%rip),%ymm11 # 67c4 <_sk_callback_avx+0x20e>
DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11
DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12
DB 196,65,28,89,227 ; vmulps %ymm11,%ymm12,%ymm12
@@ -6734,19 +6745,19 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2
DB 197,252,92,201 ; vsubps %ymm1,%ymm0,%ymm1
DB 196,193,116,89,203 ; vmulps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,105,77,0,0 ; vbroadcastss 0x4d69(%rip),%ymm11 # 6770 <_sk_callback_avx+0x210>
+ DB 196,98,125,24,29,169,77,0,0 ; vbroadcastss 0x4da9(%rip),%ymm11 # 67d0 <_sk_callback_avx+0x21a>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,87,77,0,0 ; vbroadcastss 0x4d57(%rip),%ymm11 # 676c <_sk_callback_avx+0x20c>
+ DB 196,98,125,24,29,151,77,0,0 ; vbroadcastss 0x4d97(%rip),%ymm11 # 67cc <_sk_callback_avx+0x216>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,227,117,74,202,224 ; vblendvps %ymm14,%ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,63,77,0,0 ; vbroadcastss 0x4d3f(%rip),%ymm2 # 6768 <_sk_callback_avx+0x208>
+ DB 196,226,125,24,21,127,77,0,0 ; vbroadcastss 0x4d7f(%rip),%ymm2 # 67c8 <_sk_callback_avx+0x212>
DB 196,65,12,87,246 ; vxorps %ymm14,%ymm14,%ymm14
DB 196,227,13,74,210,208 ; vblendvps %ymm13,%ymm2,%ymm14,%ymm2
DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0
DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2
DB 196,227,117,74,194,0 ; vblendvps %ymm0,%ymm2,%ymm1,%ymm0
DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1
- DB 196,98,125,24,37,38,77,0,0 ; vbroadcastss 0x4d26(%rip),%ymm12 # 6778 <_sk_callback_avx+0x218>
+ DB 196,98,125,24,37,102,77,0,0 ; vbroadcastss 0x4d66(%rip),%ymm12 # 67d8 <_sk_callback_avx+0x222>
DB 196,193,116,89,212 ; vmulps %ymm12,%ymm1,%ymm2
DB 197,28,194,226,1 ; vcmpltps %ymm2,%ymm12,%ymm12
DB 196,65,36,92,216 ; vsubps %ymm8,%ymm11,%ymm11
@@ -6756,7 +6767,7 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 196,195,125,74,198,128 ; vblendvps %ymm8,%ymm14,%ymm0,%ymm0
DB 196,195,117,74,206,128 ; vblendvps %ymm8,%ymm14,%ymm1,%ymm1
- DB 196,98,125,24,5,233,76,0,0 ; vbroadcastss 0x4ce9(%rip),%ymm8 # 6774 <_sk_callback_avx+0x214>
+ DB 196,98,125,24,5,41,77,0,0 ; vbroadcastss 0x4d29(%rip),%ymm8 # 67d4 <_sk_callback_avx+0x21e>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -6771,7 +6782,7 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp)
DB 197,252,40,225 ; vmovaps %ymm1,%ymm4
DB 197,252,40,216 ; vmovaps %ymm0,%ymm3
- DB 196,98,125,24,5,176,76,0,0 ; vbroadcastss 0x4cb0(%rip),%ymm8 # 677c <_sk_callback_avx+0x21c>
+ DB 196,98,125,24,5,240,76,0,0 ; vbroadcastss 0x4cf0(%rip),%ymm8 # 67dc <_sk_callback_avx+0x226>
DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9
DB 197,92,89,210 ; vmulps %ymm2,%ymm4,%ymm10
DB 196,65,92,92,218 ; vsubps %ymm10,%ymm4,%ymm11
@@ -6779,23 +6790,23 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10
DB 197,108,88,202 ; vaddps %ymm2,%ymm2,%ymm9
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,29,138,76,0,0 ; vbroadcastss 0x4c8a(%rip),%ymm11 # 6780 <_sk_callback_avx+0x220>
+ DB 196,98,125,24,29,202,76,0,0 ; vbroadcastss 0x4cca(%rip),%ymm11 # 67e0 <_sk_callback_avx+0x22a>
DB 196,65,100,88,219 ; vaddps %ymm11,%ymm3,%ymm11
DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12
DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15
DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11
- DB 196,98,125,24,37,116,76,0,0 ; vbroadcastss 0x4c74(%rip),%ymm12 # 6788 <_sk_callback_avx+0x228>
+ DB 196,98,125,24,37,180,76,0,0 ; vbroadcastss 0x4cb4(%rip),%ymm12 # 67e8 <_sk_callback_avx+0x232>
DB 196,193,4,89,196 ; vmulps %ymm12,%ymm15,%ymm0
- DB 196,98,125,24,45,106,76,0,0 ; vbroadcastss 0x4c6a(%rip),%ymm13 # 678c <_sk_callback_avx+0x22c>
+ DB 196,98,125,24,45,170,76,0,0 ; vbroadcastss 0x4caa(%rip),%ymm13 # 67ec <_sk_callback_avx+0x236>
DB 197,20,92,240 ; vsubps %ymm0,%ymm13,%ymm14
DB 196,65,36,89,246 ; vmulps %ymm14,%ymm11,%ymm14
DB 196,65,52,88,246 ; vaddps %ymm14,%ymm9,%ymm14
- DB 196,226,125,24,13,75,76,0,0 ; vbroadcastss 0x4c4b(%rip),%ymm1 # 6784 <_sk_callback_avx+0x224>
+ DB 196,226,125,24,13,139,76,0,0 ; vbroadcastss 0x4c8b(%rip),%ymm1 # 67e4 <_sk_callback_avx+0x22e>
DB 196,193,116,194,255,2 ; vcmpleps %ymm15,%ymm1,%ymm7
DB 196,195,13,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm14,%ymm7
DB 196,65,60,194,247,2 ; vcmpleps %ymm15,%ymm8,%ymm14
DB 196,227,45,74,255,224 ; vblendvps %ymm14,%ymm7,%ymm10,%ymm7
- DB 196,98,125,24,53,54,76,0,0 ; vbroadcastss 0x4c36(%rip),%ymm14 # 6790 <_sk_callback_avx+0x230>
+ DB 196,98,125,24,53,118,76,0,0 ; vbroadcastss 0x4c76(%rip),%ymm14 # 67f0 <_sk_callback_avx+0x23a>
DB 196,65,12,194,255,2 ; vcmpleps %ymm15,%ymm14,%ymm15
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -6814,7 +6825,7 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,164,89,247 ; vmulps %ymm7,%ymm11,%ymm6
DB 197,180,88,246 ; vaddps %ymm6,%ymm9,%ymm6
DB 196,227,77,74,237,0 ; vblendvps %ymm0,%ymm5,%ymm6,%ymm5
- DB 196,226,125,24,5,216,75,0,0 ; vbroadcastss 0x4bd8(%rip),%ymm0 # 6794 <_sk_callback_avx+0x234>
+ DB 196,226,125,24,5,24,76,0,0 ; vbroadcastss 0x4c18(%rip),%ymm0 # 67f4 <_sk_callback_avx+0x23e>
DB 197,228,88,192 ; vaddps %ymm0,%ymm3,%ymm0
DB 196,227,125,8,216,1 ; vroundps $0x1,%ymm0,%ymm3
DB 197,252,92,195 ; vsubps %ymm3,%ymm0,%ymm0
@@ -6857,39 +6868,41 @@ _sk_scale_1_float_avx LABEL PROC
PUBLIC _sk_scale_u8_avx
_sk_scale_u8_avx LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,68 ; jne 1cb9 <_sk_scale_u8_avx+0x54>
+ DB 117,68 ; jne 1cd9 <_sk_scale_u8_avx+0x54>
DB 197,122,126,0 ; vmovq (%rax),%xmm8
DB 196,66,121,49,200 ; vpmovzxbd %xmm8,%xmm9
DB 196,67,121,4,192,229 ; vpermilps $0xe5,%xmm8,%xmm8
DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8
DB 196,67,53,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm9,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,251,74,0,0 ; vbroadcastss 0x4afb(%rip),%ymm9 # 6798 <_sk_callback_avx+0x238>
+ DB 196,98,125,24,13,59,75,0,0 ; vbroadcastss 0x4b3b(%rip),%ymm9 # 67f8 <_sk_callback_avx+0x242>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
DB 197,188,89,219 ; vmulps %ymm3,%ymm8,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 1cc1 <_sk_scale_u8_avx+0x5c>
- DB 196,65,249,110,193 ; vmovq %r9,%xmm8
- DB 235,155 ; jmp 1c79 <_sk_scale_u8_avx+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 1ce2 <_sk_scale_u8_avx+0x5d>
+ DB 196,65,249,110,194 ; vmovq %r10,%xmm8
+ DB 91 ; pop %rbx
+ DB 235,154 ; jmp 1c99 <_sk_scale_u8_avx+0x14>
PUBLIC _sk_lerp_1_float_avx
_sk_lerp_1_float_avx LABEL PROC
@@ -6912,19 +6925,19 @@ _sk_lerp_1_float_avx LABEL PROC
PUBLIC _sk_lerp_u8_avx
_sk_lerp_u8_avx LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,104 ; jne 1d95 <_sk_lerp_u8_avx+0x78>
+ DB 117,104 ; jne 1db6 <_sk_lerp_u8_avx+0x78>
DB 197,122,126,0 ; vmovq (%rax),%xmm8
DB 196,66,121,49,200 ; vpmovzxbd %xmm8,%xmm9
DB 196,67,121,4,192,229 ; vpermilps $0xe5,%xmm8,%xmm8
DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8
DB 196,67,53,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm9,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,71,74,0,0 ; vbroadcastss 0x4a47(%rip),%ymm9 # 679c <_sk_callback_avx+0x23c>
+ DB 196,98,125,24,13,134,74,0,0 ; vbroadcastss 0x4a86(%rip),%ymm9 # 67fc <_sk_callback_avx+0x246>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
@@ -6939,46 +6952,48 @@ _sk_lerp_u8_avx LABEL PROC
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 197,228,88,223 ; vaddps %ymm7,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 1d9d <_sk_lerp_u8_avx+0x80>
- DB 196,65,249,110,193 ; vmovq %r9,%xmm8
- DB 233,116,255,255,255 ; jmpq 1d31 <_sk_lerp_u8_avx+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 1dbf <_sk_lerp_u8_avx+0x81>
+ DB 196,65,249,110,194 ; vmovq %r10,%xmm8
+ DB 91 ; pop %rbx
+ DB 233,115,255,255,255 ; jmpq 1d52 <_sk_lerp_u8_avx+0x14>
PUBLIC _sk_lerp_565_avx
_sk_lerp_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,208,0,0,0 ; jne 1e9b <_sk_lerp_565_avx+0xde>
- DB 196,65,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm8
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,208,0,0,0 ; jne 1ebd <_sk_lerp_565_avx+0xde>
+ DB 196,65,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 196,65,57,105,201 ; vpunpckhwd %xmm9,%xmm8,%xmm9
DB 196,66,121,51,192 ; vpmovzxwd %xmm8,%xmm8
DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- DB 196,98,125,24,13,177,73,0,0 ; vbroadcastss 0x49b1(%rip),%ymm9 # 67a0 <_sk_callback_avx+0x240>
+ DB 196,98,125,24,13,239,73,0,0 ; vbroadcastss 0x49ef(%rip),%ymm9 # 6800 <_sk_callback_avx+0x24a>
DB 196,65,60,84,201 ; vandps %ymm9,%ymm8,%ymm9
DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9
- DB 196,98,125,24,21,162,73,0,0 ; vbroadcastss 0x49a2(%rip),%ymm10 # 67a4 <_sk_callback_avx+0x244>
+ DB 196,98,125,24,21,224,73,0,0 ; vbroadcastss 0x49e0(%rip),%ymm10 # 6804 <_sk_callback_avx+0x24e>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,152,73,0,0 ; vbroadcastss 0x4998(%rip),%ymm10 # 67a8 <_sk_callback_avx+0x248>
+ DB 196,98,125,24,21,214,73,0,0 ; vbroadcastss 0x49d6(%rip),%ymm10 # 6808 <_sk_callback_avx+0x252>
DB 196,65,60,84,210 ; vandps %ymm10,%ymm8,%ymm10
DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10
- DB 196,98,125,24,29,137,73,0,0 ; vbroadcastss 0x4989(%rip),%ymm11 # 67ac <_sk_callback_avx+0x24c>
+ DB 196,98,125,24,29,199,73,0,0 ; vbroadcastss 0x49c7(%rip),%ymm11 # 680c <_sk_callback_avx+0x256>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,29,127,73,0,0 ; vbroadcastss 0x497f(%rip),%ymm11 # 67b0 <_sk_callback_avx+0x250>
+ DB 196,98,125,24,29,189,73,0,0 ; vbroadcastss 0x49bd(%rip),%ymm11 # 6810 <_sk_callback_avx+0x25a>
DB 196,65,60,84,195 ; vandps %ymm11,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,29,112,73,0,0 ; vbroadcastss 0x4970(%rip),%ymm11 # 67b4 <_sk_callback_avx+0x254>
+ DB 196,98,125,24,29,174,73,0,0 ; vbroadcastss 0x49ae(%rip),%ymm11 # 6814 <_sk_callback_avx+0x25e>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
@@ -7000,201 +7015,190 @@ _sk_lerp_565_avx LABEL PROC
DB 197,180,95,219 ; vmaxps %ymm3,%ymm9,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 15,135,29,255,255,255 ; ja 1dd1 <_sk_lerp_565_avx+0x14>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,77,0,0,0 ; lea 0x4d(%rip),%r9 # 1f0c <_sk_lerp_565_avx+0x14f>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 15,135,29,255,255,255 ; ja 1df3 <_sk_lerp_565_avx+0x14>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 1f2c <_sk_lerp_565_avx+0x14d>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8
- DB 196,65,57,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm8,%xmm8
- DB 196,65,57,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm8,%xmm8
- DB 233,200,254,255,255 ; jmpq 1dd1 <_sk_lerp_565_avx+0x14>
- DB 15,31,0 ; nopl (%rax)
- DB 241 ; icebp
+ DB 196,65,57,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8
+ DB 196,65,57,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8
+ DB 233,200,254,255,255 ; jmpq 1df3 <_sk_lerp_565_avx+0x14>
+ DB 144 ; nop
+ DB 243,255 ; repz (bad)
DB 255 ; (bad)
DB 255 ; (bad)
+ DB 235,255 ; jmp 1f31 <_sk_lerp_565_avx+0x152>
DB 255 ; (bad)
- DB 233,255,255,255,225 ; jmpq ffffffffe2001f14 <_sk_callback_avx+0xffffffffe1ffb9b4>
+ DB 255,227 ; jmpq *%rbx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 217,255 ; fcos
+ DB 219,255 ; (bad)
DB 255 ; (bad)
- DB 255,209 ; callq *%rcx
+ DB 255,211 ; callq *%rbx
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,201 ; dec %ecx
+ DB 255,203 ; dec %ebx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 188 ; .byte 0xbc
+ DB 190 ; .byte 0xbe
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
PUBLIC _sk_load_tables_avx
_sk_load_tables_avx LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 83 ; push %rbx
+ DB 72,131,236,48 ; sub $0x30,%rsp
+ DB 197,252,17,60,36 ; vmovups %ymm7,(%rsp)
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,31,2,0,0 ; jne 2160 <_sk_load_tables_avx+0x238>
- DB 196,65,124,16,17 ; vmovups (%r9),%ymm10
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
- DB 80 ; push %rax
- DB 197,124,40,13,39,76,0,0 ; vmovaps 0x4c27(%rip),%ymm9 # 6b80 <_sk_callback_avx+0x620>
- DB 196,193,44,84,193 ; vandps %ymm9,%ymm10,%ymm0
- DB 196,193,249,126,193 ; vmovq %xmm0,%r9
- DB 69,137,203 ; mov %r9d,%r11d
+ DB 15,133,251,1,0,0 ; jne 2166 <_sk_load_tables_avx+0x21e>
+ DB 196,65,124,16,18 ; vmovups (%r10),%ymm10
+ DB 197,124,40,13,104,76,0,0 ; vmovaps 0x4c68(%rip),%ymm9 # 6be0 <_sk_callback_avx+0x62a>
+ DB 196,193,44,84,201 ; vandps %ymm9,%ymm10,%ymm1
+ DB 196,227,125,25,200,1 ; vextractf128 $0x1,%ymm1,%xmm0
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 72,139,88,8 ; mov 0x8(%rax),%rbx
+ DB 196,161,122,16,20,147 ; vmovss (%rbx,%r10,4),%xmm2
DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
- DB 69,137,214 ; mov %r10d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 196,163,105,33,4,155,16 ; vinsertps $0x10,(%rbx,%r11,4),%xmm2,%xmm0
+ DB 68,137,209 ; mov %r10d,%ecx
+ DB 196,227,121,33,4,139,32 ; vinsertps $0x20,(%rbx,%rcx,4),%xmm0,%xmm0
+ DB 196,193,249,126,203 ; vmovq %xmm1,%r11
DB 73,193,234,32 ; shr $0x20,%r10
- DB 73,193,233,32 ; shr $0x20,%r9
- DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
- DB 196,227,249,22,193,1 ; vpextrq $0x1,%xmm0,%rcx
- DB 65,137,205 ; mov %ecx,%r13d
+ DB 196,35,121,33,44,147,48 ; vinsertps $0x30,(%rbx,%r10,4),%xmm0,%xmm13
+ DB 68,137,217 ; mov %r11d,%ecx
+ DB 197,250,16,20,139 ; vmovss (%rbx,%rcx,4),%xmm2
+ DB 196,227,249,22,201,1 ; vpextrq $0x1,%xmm1,%rcx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 196,163,105,33,12,155,16 ; vinsertps $0x10,(%rbx,%r11,4),%xmm2,%xmm1
+ DB 65,137,202 ; mov %ecx,%r10d
DB 72,193,233,32 ; shr $0x20,%rcx
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 72,139,104,8 ; mov 0x8(%rax),%rbp
- DB 76,139,96,16 ; mov 0x10(%rax),%r12
- DB 196,161,122,16,68,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm0
- DB 196,227,121,33,68,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm0,%xmm0
- DB 196,163,121,33,68,173,0,32 ; vinsertps $0x20,0x0(%rbp,%r13,4),%xmm0,%xmm0
- DB 196,227,121,33,68,141,0,48 ; vinsertps $0x30,0x0(%rbp,%rcx,4),%xmm0,%xmm0
- DB 196,161,122,16,76,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm1
- DB 196,163,113,33,76,141,0,16 ; vinsertps $0x10,0x0(%rbp,%r9,4),%xmm1,%xmm1
- DB 196,163,113,33,76,181,0,32 ; vinsertps $0x20,0x0(%rbp,%r14,4),%xmm1,%xmm1
- DB 196,163,113,33,76,149,0,48 ; vinsertps $0x30,0x0(%rbp,%r10,4),%xmm1,%xmm1
- DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- DB 196,193,113,114,210,8 ; vpsrld $0x8,%xmm10,%xmm1
+ DB 196,163,113,33,12,147,32 ; vinsertps $0x20,(%rbx,%r10,4),%xmm1,%xmm1
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
+ DB 196,99,113,33,36,139,48 ; vinsertps $0x30,(%rbx,%rcx,4),%xmm1,%xmm12
+ DB 196,193,105,114,210,8 ; vpsrld $0x8,%xmm10,%xmm2
DB 196,67,125,25,208,1 ; vextractf128 $0x1,%ymm10,%xmm8
- DB 196,193,105,114,208,8 ; vpsrld $0x8,%xmm8,%xmm2
- DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- DB 196,193,116,84,201 ; vandps %ymm9,%ymm1,%ymm1
- DB 196,193,249,126,201 ; vmovq %xmm1,%r9
- DB 69,137,203 ; mov %r9d,%r11d
- DB 196,195,249,22,202,1 ; vpextrq $0x1,%xmm1,%r10
- DB 69,137,214 ; mov %r10d,%r14d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 73,193,233,32 ; shr $0x20,%r9
- DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
- DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
- DB 196,227,249,22,205,1 ; vpextrq $0x1,%xmm1,%rbp
- DB 137,233 ; mov %ebp,%ecx
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,129,122,16,12,188 ; vmovss (%r12,%r15,4),%xmm1
- DB 196,195,113,33,12,156,16 ; vinsertps $0x10,(%r12,%rbx,4),%xmm1,%xmm1
- DB 196,193,122,16,20,140 ; vmovss (%r12,%rcx,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,193,122,16,20,172 ; vmovss (%r12,%rbp,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,129,122,16,20,156 ; vmovss (%r12,%r11,4),%xmm2
- DB 196,131,105,33,20,140,16 ; vinsertps $0x10,(%r12,%r9,4),%xmm2,%xmm2
- DB 196,129,122,16,28,180 ; vmovss (%r12,%r14,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,129,122,16,28,148 ; vmovss (%r12,%r10,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,227,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
- DB 72,139,64,24 ; mov 0x18(%rax),%rax
- DB 196,193,105,114,210,16 ; vpsrld $0x10,%xmm10,%xmm2
- DB 196,193,97,114,208,16 ; vpsrld $0x10,%xmm8,%xmm3
- DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
- DB 196,193,108,84,209 ; vandps %ymm9,%ymm2,%ymm2
- DB 196,193,249,126,209 ; vmovq %xmm2,%r9
- DB 69,137,202 ; mov %r9d,%r10d
- DB 196,227,249,22,209,1 ; vpextrq $0x1,%xmm2,%rcx
- DB 65,137,203 ; mov %ecx,%r11d
+ DB 196,193,121,114,208,8 ; vpsrld $0x8,%xmm8,%xmm0
+ DB 196,227,109,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm2,%ymm0
+ DB 196,193,124,84,209 ; vandps %ymm9,%ymm0,%ymm2
+ DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0
+ DB 196,225,249,126,193 ; vmovq %xmm0,%rcx
+ DB 137,203 ; mov %ecx,%ebx
+ DB 196,193,122,16,12,154 ; vmovss (%r10,%rbx,4),%xmm1
+ DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
DB 72,193,233,32 ; shr $0x20,%rcx
- DB 73,193,233,32 ; shr $0x20,%r9
- DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2
- DB 196,225,249,126,213 ; vmovq %xmm2,%rbp
- DB 65,137,238 ; mov %ebp,%r14d
+ DB 196,67,113,33,52,138,16 ; vinsertps $0x10,(%r10,%rcx,4),%xmm1,%xmm14
+ DB 137,217 ; mov %ebx,%ecx
+ DB 196,193,122,16,28,138 ; vmovss (%r10,%rcx,4),%xmm3
+ DB 196,225,249,126,209 ; vmovq %xmm2,%rcx
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,122,16,12,154 ; vmovss (%r10,%rbx,4),%xmm1
+ DB 137,203 ; mov %ecx,%ebx
+ DB 196,193,122,16,4,154 ; vmovss (%r10,%rbx,4),%xmm0
DB 196,227,249,22,211,1 ; vpextrq $0x1,%xmm2,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
+ DB 72,193,233,32 ; shr $0x20,%rcx
+ DB 196,67,121,33,28,138,16 ; vinsertps $0x10,(%r10,%rcx,4),%xmm0,%xmm11
+ DB 137,217 ; mov %ebx,%ecx
+ DB 196,65,122,16,60,138 ; vmovss (%r10,%rcx,4),%xmm15
+ DB 196,195,29,24,197,1 ; vinsertf128 $0x1,%xmm13,%ymm12,%ymm0
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,161,122,16,20,176 ; vmovss (%rax,%r14,4),%xmm2
- DB 196,227,105,33,20,168,16 ; vinsertps $0x10,(%rax,%rbp,4),%xmm2,%xmm2
- DB 196,161,122,16,28,184 ; vmovss (%rax,%r15,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
+ DB 196,227,9,33,219,32 ; vinsertps $0x20,%xmm3,%xmm14,%xmm3
+ DB 196,227,97,33,249,48 ; vinsertps $0x30,%xmm1,%xmm3,%xmm7
+ DB 196,65,122,16,52,154 ; vmovss (%r10,%rbx,4),%xmm14
+ DB 72,139,64,24 ; mov 0x18(%rax),%rax
+ DB 196,193,97,114,210,16 ; vpsrld $0x10,%xmm10,%xmm3
+ DB 196,193,105,114,208,16 ; vpsrld $0x10,%xmm8,%xmm2
+ DB 196,227,101,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm3,%ymm2
+ DB 196,65,108,84,201 ; vandps %ymm9,%ymm2,%ymm9
+ DB 196,99,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm2
+ DB 196,225,249,126,209 ; vmovq %xmm2,%rcx
+ DB 137,203 ; mov %ecx,%ebx
DB 197,250,16,28,152 ; vmovss (%rax,%rbx,4),%xmm3
- DB 196,99,105,33,203,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm9
- DB 196,161,122,16,28,144 ; vmovss (%rax,%r10,4),%xmm3
- DB 196,163,97,33,28,136,16 ; vinsertps $0x10,(%rax,%r9,4),%xmm3,%xmm3
- DB 196,161,122,16,20,152 ; vmovss (%rax,%r11,4),%xmm2
- DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
+ DB 196,227,249,22,211,1 ; vpextrq $0x1,%xmm2,%rbx
+ DB 72,193,233,32 ; shr $0x20,%rcx
+ DB 196,99,97,33,36,136,16 ; vinsertps $0x10,(%rax,%rcx,4),%xmm3,%xmm12
+ DB 137,217 ; mov %ebx,%ecx
DB 197,250,16,28,136 ; vmovss (%rax,%rcx,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,195,109,24,209,1 ; vinsertf128 $0x1,%xmm9,%ymm2,%ymm2
- DB 196,193,49,114,210,24 ; vpsrld $0x18,%xmm10,%xmm9
- DB 196,193,97,114,208,24 ; vpsrld $0x18,%xmm8,%xmm3
- DB 196,227,53,24,219,1 ; vinsertf128 $0x1,%xmm3,%ymm9,%ymm3
+ DB 196,97,249,126,201 ; vmovq %xmm9,%rcx
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 197,250,16,20,152 ; vmovss (%rax,%rbx,4),%xmm2
+ DB 137,203 ; mov %ecx,%ebx
+ DB 197,250,16,12,152 ; vmovss (%rax,%rbx,4),%xmm1
+ DB 196,99,249,22,203,1 ; vpextrq $0x1,%xmm9,%rbx
+ DB 72,193,233,32 ; shr $0x20,%rcx
+ DB 196,99,113,33,12,136,16 ; vinsertps $0x10,(%rax,%rcx,4),%xmm1,%xmm9
+ DB 137,217 ; mov %ebx,%ecx
+ DB 197,122,16,44,136 ; vmovss (%rax,%rcx,4),%xmm13
+ DB 196,195,33,33,207,32 ; vinsertps $0x20,%xmm15,%xmm11,%xmm1
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 197,122,16,28,152 ; vmovss (%rax,%rbx,4),%xmm11
+ DB 196,195,113,33,206,48 ; vinsertps $0x30,%xmm14,%xmm1,%xmm1
+ DB 196,227,117,24,207,1 ; vinsertf128 $0x1,%xmm7,%ymm1,%ymm1
+ DB 196,227,25,33,219,32 ; vinsertps $0x20,%xmm3,%xmm12,%xmm3
+ DB 196,227,97,33,210,48 ; vinsertps $0x30,%xmm2,%xmm3,%xmm2
+ DB 196,195,49,33,221,32 ; vinsertps $0x20,%xmm13,%xmm9,%xmm3
+ DB 196,195,97,33,219,48 ; vinsertps $0x30,%xmm11,%xmm3,%xmm3
+ DB 196,227,101,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm3,%ymm2
+ DB 196,193,97,114,210,24 ; vpsrld $0x18,%xmm10,%xmm3
+ DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7
+ DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,114,70,0,0 ; vbroadcastss 0x4672(%rip),%ymm8 # 67b8 <_sk_callback_avx+0x258>
- DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
+ DB 196,226,125,24,61,199,70,0,0 ; vbroadcastss 0x46c7(%rip),%ymm7 # 6818 <_sk_callback_avx+0x262>
+ DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
- DB 72,131,196,8 ; add $0x8,%rsp
+ DB 76,137,201 ; mov %r9,%rcx
+ DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7
+ DB 72,131,196,48 ; add $0x30,%rsp
DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
DB 192,225,3 ; shl $0x3,%cl
- DB 73,199,194,255,255,255,255 ; mov $0xffffffffffffffff,%r10
- DB 73,211,234 ; shr %cl,%r10
- DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 73,199,195,255,255,255,255 ; mov $0xffffffffffffffff,%r11
+ DB 73,211,235 ; shr %cl,%r11
+ DB 196,193,249,110,195 ; vmovq %r11,%xmm0
DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0
- DB 196,226,121,0,13,72,73,0,0 ; vpshufb 0x4948(%rip),%xmm0,%xmm1 # 6ad0 <_sk_callback_avx+0x570>
+ DB 196,226,121,0,13,162,73,0,0 ; vpshufb 0x49a2(%rip),%xmm0,%xmm1 # 6b30 <_sk_callback_avx+0x57a>
DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1
- DB 196,226,121,0,5,74,73,0,0 ; vpshufb 0x494a(%rip),%xmm0,%xmm0 # 6ae0 <_sk_callback_avx+0x580>
+ DB 196,226,121,0,5,164,73,0,0 ; vpshufb 0x49a4(%rip),%xmm0,%xmm0 # 6b40 <_sk_callback_avx+0x58a>
DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- DB 196,66,125,44,17 ; vmaskmovps (%r9),%ymm0,%ymm10
- DB 233,155,253,255,255 ; jmpq 1f46 <_sk_load_tables_avx+0x1e>
+ DB 196,66,125,44,18 ; vmaskmovps (%r10),%ymm0,%ymm10
+ DB 233,191,253,255,255 ; jmpq 1f70 <_sk_load_tables_avx+0x28>
PUBLIC _sk_load_tables_u16_be_avx
_sk_load_tables_u16_be_avx LABEL PROC
+ DB 72,131,236,56 ; sub $0x38,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,113,2,0,0 ; jne 2432 <_sk_load_tables_u16_be_avx+0x287>
- DB 196,1,121,16,4,72 ; vmovupd (%r8,%r9,2),%xmm8
- DB 196,129,121,16,84,72,16 ; vmovupd 0x10(%r8,%r9,2),%xmm2
- DB 196,129,121,16,92,72,32 ; vmovupd 0x20(%r8,%r9,2),%xmm3
- DB 196,1,122,111,76,72,48 ; vmovdqu 0x30(%r8,%r9,2),%xmm9
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 197,252,17,60,36 ; vmovups %ymm7,(%rsp)
+ DB 15,133,87,2,0,0 ; jne 2427 <_sk_load_tables_u16_be_avx+0x276>
+ DB 196,1,121,16,4,81 ; vmovupd (%r9,%r10,2),%xmm8
+ DB 196,129,121,16,84,81,16 ; vmovupd 0x10(%r9,%r10,2),%xmm2
+ DB 196,129,121,16,92,81,32 ; vmovupd 0x20(%r9,%r10,2),%xmm3
+ DB 196,1,122,111,76,81,48 ; vmovdqu 0x30(%r9,%r10,2),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,97,97,201 ; vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -7202,168 +7206,159 @@ _sk_load_tables_u16_be_avx LABEL PROC
DB 197,121,97,202 ; vpunpcklwd %xmm2,%xmm0,%xmm9
DB 197,121,105,194 ; vpunpckhwd %xmm2,%xmm0,%xmm8
DB 197,241,97,195 ; vpunpcklwd %xmm3,%xmm1,%xmm0
- DB 197,113,105,227 ; vpunpckhwd %xmm3,%xmm1,%xmm12
- DB 197,177,108,208 ; vpunpcklqdq %xmm0,%xmm9,%xmm2
- DB 197,177,109,200 ; vpunpckhqdq %xmm0,%xmm9,%xmm1
- DB 196,65,57,108,212 ; vpunpcklqdq %xmm12,%xmm8,%xmm10
- DB 197,121,111,29,211,72,0,0 ; vmovdqa 0x48d3(%rip),%xmm11 # 6af0 <_sk_callback_avx+0x590>
- DB 196,193,105,219,195 ; vpand %xmm11,%xmm2,%xmm0
+ DB 197,113,105,219 ; vpunpckhwd %xmm3,%xmm1,%xmm11
+ DB 197,177,108,200 ; vpunpcklqdq %xmm0,%xmm9,%xmm1
+ DB 197,49,109,224 ; vpunpckhqdq %xmm0,%xmm9,%xmm12
+ DB 197,121,111,21,51,73,0,0 ; vmovdqa 0x4933(%rip),%xmm10 # 6b50 <_sk_callback_avx+0x59a>
+ DB 196,193,113,219,202 ; vpand %xmm10,%xmm1,%xmm1
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 196,193,121,105,209 ; vpunpckhwd %xmm9,%xmm0,%xmm2
- DB 196,195,249,22,208,1 ; vpextrq $0x1,%xmm2,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 77,137,194 ; mov %r8,%r10
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,208 ; vmovq %xmm2,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,198 ; mov %r8,%r14
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
- DB 69,137,229 ; mov %r12d,%r13d
- DB 73,193,236,30 ; shr $0x1e,%r12
- DB 72,139,104,8 ; mov 0x8(%rax),%rbp
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 196,161,122,16,68,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm0
- DB 196,163,121,33,68,181,0,16 ; vinsertps $0x10,0x0(%rbp,%r14,4),%xmm0,%xmm0
- DB 196,161,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm2
- DB 196,227,121,33,194,32 ; vinsertps $0x20,%xmm2,%xmm0,%xmm0
- DB 196,161,122,16,84,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm2
- DB 196,227,121,33,194,48 ; vinsertps $0x30,%xmm2,%xmm0,%xmm0
- DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
- DB 196,227,105,33,84,29,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,1),%xmm2,%xmm2
- DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,92,37,0 ; vmovss 0x0(%rbp,%r12,1),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,227,109,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm2,%ymm0
- DB 196,193,113,219,203 ; vpand %xmm11,%xmm1,%xmm1
DB 196,193,113,105,209 ; vpunpckhwd %xmm9,%xmm1,%xmm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,249,126,209 ; vmovq %xmm2,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,88,8 ; mov 0x8(%rax),%r11
+ DB 196,129,122,16,28,147 ; vmovss (%r11,%r10,4),%xmm3
+ DB 196,195,249,22,210,1 ; vpextrq $0x1,%xmm2,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,97,33,44,139,16 ; vinsertps $0x10,(%r11,%r9,4),%xmm3,%xmm13
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
DB 196,226,121,51,201 ; vpmovzxwd %xmm1,%xmm1
- DB 196,193,249,126,203 ; vmovq %xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 196,129,122,16,28,139 ; vmovss (%r11,%r9,4),%xmm3
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 196,129,122,16,4,147 ; vmovss (%r11,%r10,4),%xmm0
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 196,129,122,16,20,147 ; vmovss (%r11,%r10,4),%xmm2
+ DB 196,195,249,22,202,1 ; vpextrq $0x1,%xmm1,%r10
+ DB 196,131,105,33,12,11,16 ; vinsertps $0x10,(%r11,%r9,1),%xmm2,%xmm1
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 196,129,122,16,20,139 ; vmovss (%r11,%r9,4),%xmm2
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 196,227,17,33,219,32 ; vinsertps $0x20,%xmm3,%xmm13,%xmm3
+ DB 196,99,97,33,232,48 ; vinsertps $0x30,%xmm0,%xmm3,%xmm13
+ DB 196,99,113,33,242,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm14
+ DB 196,1,122,16,60,19 ; vmovss (%r11,%r10,1),%xmm15
+ DB 196,193,25,219,210 ; vpand %xmm10,%xmm12,%xmm2
+ DB 196,193,105,105,193 ; vpunpckhwd %xmm9,%xmm2,%xmm0
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,129,122,16,12,153 ; vmovss (%r9,%r11,4),%xmm1
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,3,113,33,36,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm1,%xmm12
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 196,226,121,51,194 ; vpmovzxwd %xmm2,%xmm0
+ DB 196,129,122,16,20,145 ; vmovss (%r9,%r10,4),%xmm2
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 196,129,122,16,28,153 ; vmovss (%r9,%r11,4),%xmm3
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 196,129,122,16,12,153 ; vmovss (%r9,%r11,4),%xmm1
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 196,131,113,33,12,17,16 ; vinsertps $0x10,(%r9,%r10,1),%xmm1,%xmm1
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 196,129,122,16,60,145 ; vmovss (%r9,%r10,4),%xmm7
+ DB 196,195,9,33,199,48 ; vinsertps $0x30,%xmm15,%xmm14,%xmm0
+ DB 196,65,57,108,243 ; vpunpcklqdq %xmm11,%xmm8,%xmm14
+ DB 196,195,125,24,197,1 ; vinsertf128 $0x1,%xmm13,%ymm0,%ymm0
DB 73,193,235,30 ; shr $0x1e,%r11
- DB 196,195,249,22,207,1 ; vpextrq $0x1,%xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,30 ; shr $0x1e,%r15
- DB 196,129,122,16,12,144 ; vmovss (%r8,%r10,4),%xmm1
- DB 196,195,113,33,12,152,16 ; vinsertps $0x10,(%r8,%rbx,4),%xmm1,%xmm1
- DB 196,129,122,16,20,136 ; vmovss (%r8,%r9,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,193,122,16,20,168 ; vmovss (%r8,%rbp,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,129,122,16,20,176 ; vmovss (%r8,%r14,4),%xmm2
- DB 196,131,105,33,20,24,16 ; vinsertps $0x10,(%r8,%r11,1),%xmm2,%xmm2
- DB 196,129,122,16,28,160 ; vmovss (%r8,%r12,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,129,122,16,28,56 ; vmovss (%r8,%r15,1),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,227,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
+ DB 196,227,25,33,210,32 ; vinsertps $0x20,%xmm2,%xmm12,%xmm2
+ DB 196,227,105,33,219,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm3
+ DB 196,99,113,33,239,32 ; vinsertps $0x20,%xmm7,%xmm1,%xmm13
+ DB 196,1,122,16,60,25 ; vmovss (%r9,%r11,1),%xmm15
DB 76,139,80,24 ; mov 0x18(%rax),%r10
- DB 196,193,41,219,211 ; vpand %xmm11,%xmm10,%xmm2
- DB 196,193,105,105,217 ; vpunpckhwd %xmm9,%xmm2,%xmm3
- DB 196,227,249,22,221,1 ; vpextrq $0x1,%xmm3,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,219 ; vmovq %xmm3,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,226,121,51,210 ; vpmovzxwd %xmm2,%xmm2
- DB 196,225,249,126,208 ; vmovq %xmm2,%rax
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,30 ; shr $0x1e,%rax
- DB 196,195,249,22,214,1 ; vpextrq $0x1,%xmm2,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,30 ; shr $0x1e,%r14
- DB 196,129,122,16,20,138 ; vmovss (%r10,%r9,4),%xmm2
- DB 196,195,105,33,20,154,16 ; vinsertps $0x10,(%r10,%rbx,4),%xmm2,%xmm2
- DB 196,129,122,16,28,130 ; vmovss (%r10,%r8,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,193,122,16,28,170 ; vmovss (%r10,%rbp,4),%xmm3
- DB 196,99,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm10
- DB 196,129,122,16,28,154 ; vmovss (%r10,%r11,4),%xmm3
- DB 196,195,97,33,28,2,16 ; vinsertps $0x10,(%r10,%rax,1),%xmm3,%xmm3
- DB 196,129,122,16,20,186 ; vmovss (%r10,%r15,4),%xmm2
- DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
- DB 196,129,122,16,28,50 ; vmovss (%r10,%r14,1),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,195,109,24,210,1 ; vinsertf128 $0x1,%xmm10,%ymm2,%ymm2
- DB 196,193,57,109,220 ; vpunpckhqdq %xmm12,%xmm8,%xmm3
- DB 197,185,113,243,8 ; vpsllw $0x8,%xmm3,%xmm8
+ DB 196,193,9,219,250 ; vpand %xmm10,%xmm14,%xmm7
+ DB 196,193,65,105,209 ; vpunpckhwd %xmm9,%xmm7,%xmm2
+ DB 196,193,249,126,209 ; vmovq %xmm2,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,193,122,16,12,130 ; vmovss (%r10,%rax,4),%xmm1
+ DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,113,33,20,138,16 ; vinsertps $0x10,(%r10,%r9,4),%xmm1,%xmm10
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,226,121,51,207 ; vpmovzxwd %xmm7,%xmm1
+ DB 196,1,122,16,52,138 ; vmovss (%r10,%r9,4),%xmm14
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 196,65,122,16,36,130 ; vmovss (%r10,%rax,4),%xmm12
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 196,193,122,16,20,130 ; vmovss (%r10,%rax,4),%xmm2
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 196,131,105,33,20,10,16 ; vinsertps $0x10,(%r10,%r9,1),%xmm2,%xmm2
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 196,193,122,16,60,130 ; vmovss (%r10,%rax,4),%xmm7
+ DB 196,195,17,33,207,48 ; vinsertps $0x30,%xmm15,%xmm13,%xmm1
+ DB 73,193,235,30 ; shr $0x1e,%r11
+ DB 196,1,122,16,44,26 ; vmovss (%r10,%r11,1),%xmm13
+ DB 196,227,117,24,203,1 ; vinsertf128 $0x1,%xmm3,%ymm1,%ymm1
+ DB 196,195,41,33,222,32 ; vinsertps $0x20,%xmm14,%xmm10,%xmm3
+ DB 196,195,97,33,220,48 ; vinsertps $0x30,%xmm12,%xmm3,%xmm3
+ DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ DB 196,195,105,33,213,48 ; vinsertps $0x30,%xmm13,%xmm2,%xmm2
+ DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
+ DB 196,193,57,109,219 ; vpunpckhqdq %xmm11,%xmm8,%xmm3
+ DB 197,193,113,243,8 ; vpsllw $0x8,%xmm3,%xmm7
DB 197,225,113,211,8 ; vpsrlw $0x8,%xmm3,%xmm3
- DB 197,185,235,219 ; vpor %xmm3,%xmm8,%xmm3
- DB 196,65,97,105,193 ; vpunpckhwd %xmm9,%xmm3,%xmm8
+ DB 197,193,235,219 ; vpor %xmm3,%xmm7,%xmm3
+ DB 196,193,97,105,249 ; vpunpckhwd %xmm9,%xmm3,%xmm7
DB 196,226,121,51,219 ; vpmovzxwd %xmm3,%xmm3
- DB 196,195,101,24,216,1 ; vinsertf128 $0x1,%xmm8,%ymm3,%ymm3
+ DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,157,67,0,0 ; vbroadcastss 0x439d(%rip),%ymm8 # 67bc <_sk_callback_avx+0x25c>
- DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
+ DB 196,226,125,24,61,6,68,0,0 ; vbroadcastss 0x4406(%rip),%ymm7 # 681c <_sk_callback_avx+0x266>
+ DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
+ DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7
+ DB 72,131,196,56 ; add $0x38,%rsp
DB 255,224 ; jmpq *%rax
- DB 196,1,123,16,4,72 ; vmovsd (%r8,%r9,2),%xmm8
+ DB 196,1,123,16,4,81 ; vmovsd (%r9,%r10,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,85 ; je 2498 <_sk_load_tables_u16_be_avx+0x2ed>
- DB 196,1,57,22,68,72,8 ; vmovhpd 0x8(%r8,%r9,2),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,72 ; jb 2498 <_sk_load_tables_u16_be_avx+0x2ed>
- DB 196,129,123,16,84,72,16 ; vmovsd 0x10(%r8,%r9,2),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,72 ; je 24a5 <_sk_load_tables_u16_be_avx+0x2fa>
- DB 196,129,105,22,84,72,24 ; vmovhpd 0x18(%r8,%r9,2),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,59 ; jb 24a5 <_sk_load_tables_u16_be_avx+0x2fa>
- DB 196,129,123,16,92,72,32 ; vmovsd 0x20(%r8,%r9,2),%xmm3
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,97,253,255,255 ; je 21dc <_sk_load_tables_u16_be_avx+0x31>
- DB 196,129,97,22,92,72,40 ; vmovhpd 0x28(%r8,%r9,2),%xmm3,%xmm3
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,80,253,255,255 ; jb 21dc <_sk_load_tables_u16_be_avx+0x31>
- DB 196,1,122,126,76,72,48 ; vmovq 0x30(%r8,%r9,2),%xmm9
- DB 233,68,253,255,255 ; jmpq 21dc <_sk_load_tables_u16_be_avx+0x31>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,85 ; je 248d <_sk_load_tables_u16_be_avx+0x2dc>
+ DB 196,1,57,22,68,81,8 ; vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,72 ; jb 248d <_sk_load_tables_u16_be_avx+0x2dc>
+ DB 196,129,123,16,84,81,16 ; vmovsd 0x10(%r9,%r10,2),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,72 ; je 249a <_sk_load_tables_u16_be_avx+0x2e9>
+ DB 196,129,105,22,84,81,24 ; vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,59 ; jb 249a <_sk_load_tables_u16_be_avx+0x2e9>
+ DB 196,129,123,16,92,81,32 ; vmovsd 0x20(%r9,%r10,2),%xmm3
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,123,253,255,255 ; je 21eb <_sk_load_tables_u16_be_avx+0x3a>
+ DB 196,129,97,22,92,81,40 ; vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,106,253,255,255 ; jb 21eb <_sk_load_tables_u16_be_avx+0x3a>
+ DB 196,1,122,126,76,81,48 ; vmovq 0x30(%r9,%r10,2),%xmm9
+ DB 233,94,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,55,253,255,255 ; jmpq 21dc <_sk_load_tables_u16_be_avx+0x31>
+ DB 233,81,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,46,253,255,255 ; jmpq 21dc <_sk_load_tables_u16_be_avx+0x31>
+ DB 233,72,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a>
PUBLIC _sk_load_tables_rgb_u16_be_avx
_sk_load_tables_rgb_u16_be_avx LABEL PROC
+ DB 72,131,236,88 ; sub $0x58,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,127 ; lea (%rdi,%rdi,2),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,93,2,0,0 ; jne 271d <_sk_load_tables_rgb_u16_be_avx+0x26f>
- DB 196,129,122,111,4,72 ; vmovdqu (%r8,%r9,2),%xmm0
- DB 196,129,122,111,84,72,12 ; vmovdqu 0xc(%r8,%r9,2),%xmm2
- DB 196,129,122,111,76,72,24 ; vmovdqu 0x18(%r8,%r9,2),%xmm1
- DB 196,129,122,111,92,72,32 ; vmovdqu 0x20(%r8,%r9,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 197,252,17,124,36,32 ; vmovups %ymm7,0x20(%rsp)
+ DB 197,252,17,52,36 ; vmovups %ymm6,(%rsp)
+ DB 15,133,74,2,0,0 ; jne 270e <_sk_load_tables_rgb_u16_be_avx+0x26b>
+ DB 196,129,122,111,4,81 ; vmovdqu (%r9,%r10,2),%xmm0
+ DB 196,129,122,111,84,81,12 ; vmovdqu 0xc(%r9,%r10,2),%xmm2
+ DB 196,129,122,111,76,81,24 ; vmovdqu 0x18(%r9,%r10,2),%xmm1
+ DB 196,129,122,111,92,81,32 ; vmovdqu 0x20(%r9,%r10,2),%xmm3
DB 197,225,115,219,4 ; vpsrldq $0x4,%xmm3,%xmm3
DB 197,185,115,216,6 ; vpsrldq $0x6,%xmm0,%xmm8
DB 197,177,115,218,6 ; vpsrldq $0x6,%xmm2,%xmm9
DB 197,161,115,217,6 ; vpsrldq $0x6,%xmm1,%xmm11
DB 197,169,115,219,6 ; vpsrldq $0x6,%xmm3,%xmm10
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
DB 197,249,97,194 ; vpunpcklwd %xmm2,%xmm0,%xmm0
DB 196,193,57,97,209 ; vpunpcklwd %xmm9,%xmm8,%xmm2
DB 197,241,97,203 ; vpunpcklwd %xmm3,%xmm1,%xmm1
@@ -7371,434 +7366,400 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC
DB 197,121,97,194 ; vpunpcklwd %xmm2,%xmm0,%xmm8
DB 197,249,105,194 ; vpunpckhwd %xmm2,%xmm0,%xmm0
DB 197,241,97,211 ; vpunpcklwd %xmm3,%xmm1,%xmm2
- DB 197,241,105,219 ; vpunpckhwd %xmm3,%xmm1,%xmm3
- DB 197,185,108,202 ; vpunpcklqdq %xmm2,%xmm8,%xmm1
- DB 197,185,109,210 ; vpunpckhqdq %xmm2,%xmm8,%xmm2
- DB 197,121,108,195 ; vpunpcklqdq %xmm3,%xmm0,%xmm8
- DB 197,121,111,13,204,69,0,0 ; vmovdqa 0x45cc(%rip),%xmm9 # 6b00 <_sk_callback_avx+0x5a0>
- DB 196,193,113,219,193 ; vpand %xmm9,%xmm1,%xmm0
+ DB 197,241,105,203 ; vpunpckhwd %xmm3,%xmm1,%xmm1
+ DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3
+ DB 197,57,109,218 ; vpunpckhqdq %xmm2,%xmm8,%xmm11
+ DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8
+ DB 197,121,111,13,50,70,0,0 ; vmovdqa 0x4632(%rip),%xmm9 # 6b60 <_sk_callback_avx+0x5aa>
+ DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0
DB 196,65,41,239,210 ; vpxor %xmm10,%xmm10,%xmm10
DB 196,193,121,105,202 ; vpunpckhwd %xmm10,%xmm0,%xmm1
- DB 196,195,249,22,200,1 ; vpextrq $0x1,%xmm1,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 77,137,194 ; mov %r8,%r10
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,88,8 ; mov 0x8(%rax),%r11
+ DB 196,129,122,16,20,147 ; vmovss (%r11,%r10,4),%xmm2
+ DB 196,195,249,22,202,1 ; vpextrq $0x1,%xmm1,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,105,33,36,139,16 ; vinsertps $0x10,(%r11,%r9,4),%xmm2,%xmm12
+ DB 69,137,209 ; mov %r10d,%r9d
DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,200 ; vmovq %xmm1,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,198 ; mov %r8,%r14
- DB 73,193,238,32 ; shr $0x20,%r14
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
- DB 69,137,229 ; mov %r12d,%r13d
- DB 73,193,236,30 ; shr $0x1e,%r12
- DB 72,139,104,8 ; mov 0x8(%rax),%rbp
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 196,161,122,16,68,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm0
- DB 196,163,121,33,68,181,0,16 ; vinsertps $0x10,0x0(%rbp,%r14,4),%xmm0,%xmm0
- DB 196,161,122,16,76,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm1
- DB 196,227,121,33,193,32 ; vinsertps $0x20,%xmm1,%xmm0,%xmm0
- DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1
- DB 196,227,121,33,193,48 ; vinsertps $0x30,%xmm1,%xmm0,%xmm0
- DB 196,161,122,16,76,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm1
- DB 196,227,113,33,76,29,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,1),%xmm1,%xmm1
- DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3
- DB 196,227,113,33,203,32 ; vinsertps $0x20,%xmm3,%xmm1,%xmm1
- DB 196,161,122,16,92,37,0 ; vmovss 0x0(%rbp,%r12,1),%xmm3
- DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1
- DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- DB 196,193,105,219,201 ; vpand %xmm9,%xmm2,%xmm1
- DB 196,193,113,105,210 ; vpunpckhwd %xmm10,%xmm1,%xmm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,226,121,51,201 ; vpmovzxwd %xmm1,%xmm1
- DB 196,193,249,126,203 ; vmovq %xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 196,129,122,16,20,139 ; vmovss (%r11,%r9,4),%xmm2
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 196,129,122,16,12,147 ; vmovss (%r11,%r10,4),%xmm1
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 196,129,122,16,28,147 ; vmovss (%r11,%r10,4),%xmm3
+ DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
+ DB 196,131,97,33,28,11,16 ; vinsertps $0x10,(%r11,%r9,1),%xmm3,%xmm3
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 196,129,122,16,4,139 ; vmovss (%r11,%r9,4),%xmm0
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 196,227,25,33,210,32 ; vinsertps $0x20,%xmm2,%xmm12,%xmm2
+ DB 196,227,105,33,201,48 ; vinsertps $0x30,%xmm1,%xmm2,%xmm1
+ DB 196,129,122,16,20,19 ; vmovss (%r11,%r10,1),%xmm2
+ DB 196,65,33,219,225 ; vpand %xmm9,%xmm11,%xmm12
+ DB 196,65,25,105,218 ; vpunpckhwd %xmm10,%xmm12,%xmm11
+ DB 196,65,249,126,218 ; vmovq %xmm11,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,1,122,16,44,153 ; vmovss (%r9,%r11,4),%xmm13
+ DB 196,67,249,22,219,1 ; vpextrq $0x1,%xmm11,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,3,17,33,28,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm13,%xmm11
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 196,66,121,51,244 ; vpmovzxwd %xmm12,%xmm14
+ DB 196,1,122,16,44,145 ; vmovss (%r9,%r10,4),%xmm13
+ DB 196,65,249,126,242 ; vmovq %xmm14,%r10
+ DB 196,1,122,16,36,153 ; vmovss (%r9,%r11,4),%xmm12
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 196,1,122,16,60,153 ; vmovss (%r9,%r11,4),%xmm15
+ DB 196,67,249,22,243,1 ; vpextrq $0x1,%xmm14,%r11
+ DB 196,3,1,33,52,17,16 ; vinsertps $0x10,(%r9,%r10,1),%xmm15,%xmm14
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 196,1,122,16,60,145 ; vmovss (%r9,%r10,4),%xmm15
+ DB 196,227,97,33,192,32 ; vinsertps $0x20,%xmm0,%xmm3,%xmm0
+ DB 196,227,121,33,194,48 ; vinsertps $0x30,%xmm2,%xmm0,%xmm0
+ DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 73,193,235,30 ; shr $0x1e,%r11
- DB 196,195,249,22,207,1 ; vpextrq $0x1,%xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,30 ; shr $0x1e,%r15
- DB 196,129,122,16,12,144 ; vmovss (%r8,%r10,4),%xmm1
- DB 196,195,113,33,12,152,16 ; vinsertps $0x10,(%r8,%rbx,4),%xmm1,%xmm1
- DB 196,129,122,16,20,136 ; vmovss (%r8,%r9,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,193,122,16,20,168 ; vmovss (%r8,%rbp,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,129,122,16,20,176 ; vmovss (%r8,%r14,4),%xmm2
- DB 196,131,105,33,20,24,16 ; vinsertps $0x10,(%r8,%r11,1),%xmm2,%xmm2
- DB 196,129,122,16,28,160 ; vmovss (%r8,%r12,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,129,122,16,28,56 ; vmovss (%r8,%r15,1),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,227,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm1
+ DB 196,129,122,16,52,25 ; vmovss (%r9,%r11,1),%xmm6
DB 76,139,80,24 ; mov 0x18(%rax),%r10
- DB 196,193,57,219,209 ; vpand %xmm9,%xmm8,%xmm2
- DB 196,193,105,105,218 ; vpunpckhwd %xmm10,%xmm2,%xmm3
- DB 196,227,249,22,221,1 ; vpextrq $0x1,%xmm3,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,219 ; vmovq %xmm3,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,226,121,51,210 ; vpmovzxwd %xmm2,%xmm2
- DB 196,225,249,126,208 ; vmovq %xmm2,%rax
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,30 ; shr $0x1e,%rax
- DB 196,195,249,22,214,1 ; vpextrq $0x1,%xmm2,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,30 ; shr $0x1e,%r14
- DB 196,129,122,16,20,138 ; vmovss (%r10,%r9,4),%xmm2
- DB 196,195,105,33,20,154,16 ; vinsertps $0x10,(%r10,%rbx,4),%xmm2,%xmm2
- DB 196,129,122,16,28,130 ; vmovss (%r10,%r8,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,193,122,16,28,170 ; vmovss (%r10,%rbp,4),%xmm3
- DB 196,99,105,33,195,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm8
- DB 196,129,122,16,28,154 ; vmovss (%r10,%r11,4),%xmm3
- DB 196,195,97,33,28,2,16 ; vinsertps $0x10,(%r10,%rax,1),%xmm3,%xmm3
- DB 196,129,122,16,20,186 ; vmovss (%r10,%r15,4),%xmm2
- DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
- DB 196,129,122,16,28,50 ; vmovss (%r10,%r14,1),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,195,109,24,208,1 ; vinsertf128 $0x1,%xmm8,%ymm2,%ymm2
+ DB 196,65,57,219,193 ; vpand %xmm9,%xmm8,%xmm8
+ DB 196,193,57,105,210 ; vpunpckhwd %xmm10,%xmm8,%xmm2
+ DB 196,193,249,126,209 ; vmovq %xmm2,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,193,122,16,12,130 ; vmovss (%r10,%rax,4),%xmm1
+ DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,113,33,12,138,16 ; vinsertps $0x10,(%r10,%r9,4),%xmm1,%xmm9
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,194,121,51,200 ; vpmovzxwd %xmm8,%xmm1
+ DB 196,1,122,16,4,138 ; vmovss (%r10,%r9,4),%xmm8
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 196,65,122,16,20,130 ; vmovss (%r10,%rax,4),%xmm10
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 196,193,122,16,20,130 ; vmovss (%r10,%rax,4),%xmm2
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 196,131,105,33,20,10,16 ; vinsertps $0x10,(%r10,%r9,1),%xmm2,%xmm2
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 196,193,122,16,60,130 ; vmovss (%r10,%rax,4),%xmm7
+ DB 196,195,33,33,205,32 ; vinsertps $0x20,%xmm13,%xmm11,%xmm1
+ DB 73,193,235,30 ; shr $0x1e,%r11
+ DB 196,1,122,16,28,26 ; vmovss (%r10,%r11,1),%xmm11
+ DB 196,195,113,33,204,48 ; vinsertps $0x30,%xmm12,%xmm1,%xmm1
+ DB 196,195,9,33,223,32 ; vinsertps $0x20,%xmm15,%xmm14,%xmm3
+ DB 196,227,97,33,222,48 ; vinsertps $0x30,%xmm6,%xmm3,%xmm3
+ DB 196,227,101,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm3,%ymm1
+ DB 196,195,49,33,216,32 ; vinsertps $0x20,%xmm8,%xmm9,%xmm3
+ DB 196,195,97,33,218,48 ; vinsertps $0x30,%xmm10,%xmm3,%xmm3
+ DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ DB 196,195,105,33,211,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm2
+ DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,175,64,0,0 ; vbroadcastss 0x40af(%rip),%ymm3 # 67c0 <_sk_callback_avx+0x260>
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
+ DB 196,226,125,24,29,35,65,0,0 ; vbroadcastss 0x4123(%rip),%ymm3 # 6820 <_sk_callback_avx+0x26a>
+ DB 197,252,16,52,36 ; vmovups (%rsp),%ymm6
+ DB 197,252,16,124,36,32 ; vmovups 0x20(%rsp),%ymm7
+ DB 72,131,196,88 ; add $0x58,%rsp
DB 255,224 ; jmpq *%rax
- DB 196,129,121,110,4,72 ; vmovd (%r8,%r9,2),%xmm0
- DB 196,129,121,196,68,72,4,2 ; vpinsrw $0x2,0x4(%r8,%r9,2),%xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,5 ; jne 2736 <_sk_load_tables_rgb_u16_be_avx+0x288>
- DB 233,190,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 196,129,121,110,76,72,6 ; vmovd 0x6(%r8,%r9,2),%xmm1
- DB 196,1,113,196,68,72,10,2 ; vpinsrw $0x2,0xa(%r8,%r9,2),%xmm1,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,26 ; jb 2765 <_sk_load_tables_rgb_u16_be_avx+0x2b7>
- DB 196,129,121,110,76,72,12 ; vmovd 0xc(%r8,%r9,2),%xmm1
- DB 196,129,113,196,84,72,16,2 ; vpinsrw $0x2,0x10(%r8,%r9,2),%xmm1,%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 117,10 ; jne 276a <_sk_load_tables_rgb_u16_be_avx+0x2bc>
- DB 233,143,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 233,138,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 196,129,121,110,76,72,18 ; vmovd 0x12(%r8,%r9,2),%xmm1
- DB 196,1,113,196,76,72,22,2 ; vpinsrw $0x2,0x16(%r8,%r9,2),%xmm1,%xmm9
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,26 ; jb 2799 <_sk_load_tables_rgb_u16_be_avx+0x2eb>
- DB 196,129,121,110,76,72,24 ; vmovd 0x18(%r8,%r9,2),%xmm1
- DB 196,129,113,196,76,72,28,2 ; vpinsrw $0x2,0x1c(%r8,%r9,2),%xmm1,%xmm1
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 117,10 ; jne 279e <_sk_load_tables_rgb_u16_be_avx+0x2f0>
- DB 233,91,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 233,86,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 196,129,121,110,92,72,30 ; vmovd 0x1e(%r8,%r9,2),%xmm3
- DB 196,1,97,196,92,72,34,2 ; vpinsrw $0x2,0x22(%r8,%r9,2),%xmm3,%xmm11
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,20 ; jb 27c7 <_sk_load_tables_rgb_u16_be_avx+0x319>
- DB 196,129,121,110,92,72,36 ; vmovd 0x24(%r8,%r9,2),%xmm3
- DB 196,129,97,196,92,72,40,2 ; vpinsrw $0x2,0x28(%r8,%r9,2),%xmm3,%xmm3
- DB 233,45,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
- DB 233,40,253,255,255 ; jmpq 24f4 <_sk_load_tables_rgb_u16_be_avx+0x46>
+ DB 196,129,121,110,4,81 ; vmovd (%r9,%r10,2),%xmm0
+ DB 196,129,121,196,68,81,4,2 ; vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,5 ; jne 2727 <_sk_load_tables_rgb_u16_be_avx+0x284>
+ DB 233,209,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 196,129,121,110,76,81,6 ; vmovd 0x6(%r9,%r10,2),%xmm1
+ DB 196,1,113,196,68,81,10,2 ; vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,26 ; jb 2756 <_sk_load_tables_rgb_u16_be_avx+0x2b3>
+ DB 196,129,121,110,76,81,12 ; vmovd 0xc(%r9,%r10,2),%xmm1
+ DB 196,129,113,196,84,81,16,2 ; vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 117,10 ; jne 275b <_sk_load_tables_rgb_u16_be_avx+0x2b8>
+ DB 233,162,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 233,157,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 196,129,121,110,76,81,18 ; vmovd 0x12(%r9,%r10,2),%xmm1
+ DB 196,1,113,196,76,81,22,2 ; vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,26 ; jb 278a <_sk_load_tables_rgb_u16_be_avx+0x2e7>
+ DB 196,129,121,110,76,81,24 ; vmovd 0x18(%r9,%r10,2),%xmm1
+ DB 196,129,113,196,76,81,28,2 ; vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 117,10 ; jne 278f <_sk_load_tables_rgb_u16_be_avx+0x2ec>
+ DB 233,110,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 233,105,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 196,129,121,110,92,81,30 ; vmovd 0x1e(%r9,%r10,2),%xmm3
+ DB 196,1,97,196,92,81,34,2 ; vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,20 ; jb 27b8 <_sk_load_tables_rgb_u16_be_avx+0x315>
+ DB 196,129,121,110,92,81,36 ; vmovd 0x24(%r9,%r10,2),%xmm3
+ DB 196,129,97,196,92,81,40,2 ; vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3
+ DB 233,64,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
+ DB 233,59,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55>
PUBLIC _sk_byte_tables_avx
_sk_byte_tables_avx LABEL PROC
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,227,63,0,0 ; vbroadcastss 0x3fe3(%rip),%ymm8 # 67c4 <_sk_callback_avx+0x264>
+ DB 196,98,125,24,5,92,64,0,0 ; vbroadcastss 0x405c(%rip),%ymm8 # 6824 <_sk_callback_avx+0x26e>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
+ DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
+ DB 196,65,249,126,201 ; vmovq %xmm9,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,131,121,32,4,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ DB 196,67,249,22,202,1 ; vpextrq $0x1,%xmm9,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,121,32,20,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,99,125,25,200,1 ; vextractf128 $0x1,%ymm9,%xmm0
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,67,41,32,201,2 ; vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,3 ; vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 196,3,121,32,20,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm10
+ DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,41,32,4,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm10,%xmm0
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,121,32,193,2 ; vpinsrb $0x2,%r9d,%xmm0,%xmm0
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,121,32,210,3 ; vpinsrb $0x3,%r10d,%xmm0,%xmm10
+ DB 196,193,116,89,192 ; vmulps %ymm8,%ymm1,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 68,137,197 ; mov %r8d,%ebp
- DB 77,137,194 ; mov %r8,%r10
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,12,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm1
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,192 ; vmovq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,199 ; mov %r8,%r15
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 196,131,113,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 69,137,198 ; mov %r8d,%r14d
- DB 77,137,196 ; mov %r8,%r12
- DB 73,193,236,32 ; shr $0x20,%r12
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,221 ; mov %ebx,%r13d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,57,1 ; vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 196,98,121,49,200 ; vpmovzxbd %xmm0,%xmm9
- DB 196,131,121,32,4,41,0 ; vpinsrb $0x0,(%r9,%r13,1),%xmm0,%xmm0
- DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- DB 67,15,182,44,49 ; movzbl (%r9,%r14,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,33 ; movzbl (%r9,%r12,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 196,227,53,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm9,%ymm0
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,49,63,0,0 ; vbroadcastss 0x3f31(%rip),%ymm9 # 67c8 <_sk_callback_avx+0x268>
- DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
- DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,113,32,202,2 ; vpinsrb $0x2,%r10d,%xmm1,%xmm1
+ DB 196,193,249,126,194 ; vmovq %xmm0,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,67,113,32,227,3 ; vpinsrb $0x3,%r11d,%xmm1,%xmm12
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,12,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm1
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,113,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,67,121,32,233,3 ; vpinsrb $0x3,%r9d,%xmm0,%xmm13
+ DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 196,193,108,89,200 ; vmulps %ymm8,%ymm2,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
- DB 196,227,249,22,205,1 ; vpextrq $0x1,%xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,20,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,105,32,20,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm2
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,105,32,210,2 ; vpinsrb $0x2,%r10d,%xmm2,%xmm2
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,67,105,32,219,3 ; vpinsrb $0x3,%r11d,%xmm2,%xmm11
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,20,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm2
DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,105,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,113,32,202,2 ; vpinsrb $0x2,%r10d,%xmm1,%xmm1
DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,207 ; vmovq %xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,12,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- DB 196,195,113,32,12,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 196,98,121,49,209 ; vpmovzxbd %xmm1,%xmm10
- DB 196,131,121,32,12,32,0 ; vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm1
- DB 196,131,113,32,12,56,1 ; vpinsrb $0x1,(%r8,%r15,1),%xmm1,%xmm1
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,113,32,205,2 ; vpinsrb $0x2,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1
- DB 196,227,45,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm10,%ymm1
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,67,113,32,241,3 ; vpinsrb $0x3,%r9d,%xmm1,%xmm14
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
+ DB 196,193,100,89,200 ; vmulps %ymm8,%ymm3,%ymm1
+ DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,28,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
+ DB 196,227,249,22,200,1 ; vpextrq $0x1,%xmm1,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,97,32,28,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm3,%xmm3
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
+ DB 71,15,182,12,10 ; movzbl (%r10,%r9,1),%r9d
+ DB 196,195,97,32,217,2 ; vpinsrb $0x2,%r9d,%xmm3,%xmm3
+ DB 196,193,249,126,201 ; vmovq %xmm1,%r9
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,99,97,32,192,3 ; vpinsrb $0x3,%eax,%xmm3,%xmm8
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,4,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm0
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,121,32,4,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm0,%xmm0
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,99,121,32,248,2 ; vpinsrb $0x2,%eax,%xmm0,%xmm15
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
+ DB 196,194,121,49,193 ; vpmovzxbd %xmm9,%xmm0
+ DB 196,194,121,49,202 ; vpmovzxbd %xmm10,%xmm1
+ DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
+ DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
+ DB 196,194,121,49,204 ; vpmovzxbd %xmm12,%xmm1
+ DB 196,194,121,49,213 ; vpmovzxbd %xmm13,%xmm2
+ DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
+ DB 196,98,125,24,13,6,62,0,0 ; vbroadcastss 0x3e06(%rip),%ymm9 # 6828 <_sk_callback_avx+0x272>
+ DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
- DB 76,139,64,16 ; mov 0x10(%rax),%r8
- DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2
- DB 196,195,249,22,211,1 ; vpextrq $0x1,%xmm2,%r11
- DB 69,137,222 ; mov %r11d,%r14d
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,215 ; vmovq %xmm2,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,20,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm2
- DB 196,195,105,32,20,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm2,%xmm2
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,105,32,211,2 ; vpinsrb $0x2,%ebx,%xmm2,%xmm2
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,105,32,213,3 ; vpinsrb $0x3,%ebp,%xmm2,%xmm2
- DB 196,98,121,49,210 ; vpmovzxbd %xmm2,%xmm10
- DB 196,131,121,32,20,32,0 ; vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm2
- DB 196,131,105,32,20,56,1 ; vpinsrb $0x1,(%r8,%r15,1),%xmm2,%xmm2
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,105,32,213,2 ; vpinsrb $0x2,%ebp,%xmm2,%xmm2
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,105,32,213,3 ; vpinsrb $0x3,%ebp,%xmm2,%xmm2
- DB 196,226,121,49,210 ; vpmovzxbd %xmm2,%xmm2
- DB 196,227,45,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm10,%ymm2
+ DB 196,194,121,49,211 ; vpmovzxbd %xmm11,%xmm2
+ DB 196,194,121,49,222 ; vpmovzxbd %xmm14,%xmm3
+ DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,209 ; vmulps %ymm9,%ymm2,%ymm2
- DB 72,139,64,24 ; mov 0x18(%rax),%rax
- DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
- DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
- DB 196,227,249,22,221,1 ; vpextrq $0x1,%xmm3,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,219 ; vmovq %xmm3,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,25,219,1 ; vextractf128 $0x1,%ymm3,%xmm3
- DB 196,195,249,22,218,1 ; vpextrq $0x1,%xmm3,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,222 ; vmovq %xmm3,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 196,163,121,32,28,8,0 ; vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm3
- DB 196,227,97,32,28,24,1 ; vpinsrb $0x1,(%rax,%rbx,1),%xmm3,%xmm3
- DB 66,15,182,28,0 ; movzbl (%rax,%r8,1),%ebx
- DB 196,227,97,32,219,2 ; vpinsrb $0x2,%ebx,%xmm3,%xmm3
- DB 15,182,44,40 ; movzbl (%rax,%rbp,1),%ebp
- DB 196,227,97,32,221,3 ; vpinsrb $0x3,%ebp,%xmm3,%xmm3
- DB 196,98,121,49,195 ; vpmovzxbd %xmm3,%xmm8
- DB 196,163,121,32,28,56,0 ; vpinsrb $0x0,(%rax,%r15,1),%xmm0,%xmm3
- DB 196,163,97,32,28,48,1 ; vpinsrb $0x1,(%rax,%r14,1),%xmm3,%xmm3
- DB 66,15,182,44,24 ; movzbl (%rax,%r11,1),%ebp
- DB 196,227,97,32,221,2 ; vpinsrb $0x2,%ebp,%xmm3,%xmm3
- DB 66,15,182,4,16 ; movzbl (%rax,%r10,1),%eax
- DB 196,227,97,32,216,3 ; vpinsrb $0x3,%eax,%xmm3,%xmm3
+ DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8
+ DB 196,227,1,32,216,3 ; vpinsrb $0x3,%eax,%xmm15,%xmm3
DB 196,226,121,49,219 ; vpmovzxbd %xmm3,%xmm3
DB 196,227,61,24,219,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
DB 196,193,100,89,217 ; vmulps %ymm9,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_byte_tables_rgb_avx
_sk_byte_tables_rgb_avx LABEL PROC
- DB 85 ; push %rbp
- DB 65,87 ; push %r15
- DB 65,86 ; push %r14
- DB 65,85 ; push %r13
- DB 65,84 ; push %r12
- DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,139,64,24 ; mov 0x18(%rax),%r8d
- DB 65,255,200 ; dec %r8d
- DB 196,65,121,110,192 ; vmovd %r8d,%xmm8
+ DB 68,139,72,24 ; mov 0x18(%rax),%r9d
+ DB 65,255,201 ; dec %r9d
+ DB 196,65,121,110,193 ; vmovd %r9d,%xmm8
DB 196,65,121,112,192,0 ; vpshufd $0x0,%xmm8,%xmm8
DB 196,67,61,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 68,137,197 ; mov %r8d,%ebp
- DB 77,137,194 ; mov %r8,%r10
+ DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
+ DB 196,65,249,126,201 ; vmovq %xmm9,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,131,121,32,4,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm0
+ DB 196,67,249,22,202,1 ; vpextrq $0x1,%xmm9,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,3,121,32,20,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm0,%xmm10
+ DB 69,137,209 ; mov %r10d,%r9d
DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,192 ; vmovq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,199 ; mov %r8,%r15
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0
- DB 196,195,249,22,192,1 ; vpextrq $0x1,%xmm0,%r8
- DB 69,137,198 ; mov %r8d,%r14d
- DB 77,137,196 ; mov %r8,%r12
- DB 73,193,236,32 ; shr $0x20,%r12
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,221 ; mov %ebx,%r13d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,57,1 ; vpinsrb $0x1,(%r9,%r15,1),%xmm0,%xmm0
- DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 196,98,121,49,200 ; vpmovzxbd %xmm0,%xmm9
- DB 196,131,121,32,4,41,0 ; vpinsrb $0x0,(%r9,%r13,1),%xmm0,%xmm0
- DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- DB 67,15,182,44,49 ; movzbl (%r9,%r14,1),%ebp
- DB 196,227,121,32,197,2 ; vpinsrb $0x2,%ebp,%xmm0,%xmm0
- DB 67,15,182,44,33 ; movzbl (%r9,%r12,1),%ebp
- DB 196,227,121,32,197,3 ; vpinsrb $0x3,%ebp,%xmm0,%xmm0
- DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 196,227,53,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm9,%ymm0
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,87,60,0,0 ; vbroadcastss 0x3c57(%rip),%ymm9 # 67cc <_sk_callback_avx+0x26c>
- DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
+ DB 196,99,125,25,200,1 ; vextractf128 $0x1,%ymm9,%xmm0
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,67,41,32,201,2 ; vpinsrb $0x2,%r9d,%xmm10,%xmm9
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,49,32,202,3 ; vpinsrb $0x3,%r10d,%xmm9,%xmm9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 196,3,121,32,20,19,0 ; vpinsrb $0x0,(%r11,%r10,1),%xmm0,%xmm10
+ DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,41,32,4,11,1 ; vpinsrb $0x1,(%r11,%r9,1),%xmm10,%xmm0
+ DB 69,137,209 ; mov %r10d,%r9d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 71,15,182,12,11 ; movzbl (%r11,%r9,1),%r9d
+ DB 196,195,121,32,193,2 ; vpinsrb $0x2,%r9d,%xmm0,%xmm0
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 71,15,182,20,19 ; movzbl (%r11,%r10,1),%r10d
+ DB 196,67,121,32,218,3 ; vpinsrb $0x3,%r10d,%xmm0,%xmm11
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
- DB 196,227,249,22,205,1 ; vpextrq $0x1,%xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
- DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,121,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
+ DB 196,193,249,126,202 ; vmovq %xmm1,%r10
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 196,67,121,32,211,3 ; vpinsrb $0x3,%r11d,%xmm0,%xmm10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 196,131,121,32,4,25,0 ; vpinsrb $0x0,(%r9,%r11,1),%xmm0,%xmm0
DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
- DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,131,121,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm0,%xmm0
+ DB 69,137,218 ; mov %r11d,%r10d
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0
DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,193,249,126,207 ; vmovq %xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,131,121,32,12,16,0 ; vpinsrb $0x0,(%r8,%r10,1),%xmm0,%xmm1
- DB 196,195,113,32,12,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
- DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 196,98,121,49,209 ; vpmovzxbd %xmm1,%xmm10
- DB 196,131,121,32,12,32,0 ; vpinsrb $0x0,(%r8,%r12,1),%xmm0,%xmm1
- DB 196,131,113,32,12,56,1 ; vpinsrb $0x1,(%r8,%r15,1),%xmm1,%xmm1
- DB 67,15,182,44,48 ; movzbl (%r8,%r14,1),%ebp
- DB 196,227,113,32,205,2 ; vpinsrb $0x2,%ebp,%xmm1,%xmm1
- DB 67,15,182,44,24 ; movzbl (%r8,%r11,1),%ebp
- DB 196,227,113,32,205,3 ; vpinsrb $0x3,%ebp,%xmm1,%xmm1
- DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1
- DB 196,227,45,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm10,%ymm1
+ DB 71,15,182,12,25 ; movzbl (%r9,%r11,1),%r9d
+ DB 196,67,121,32,225,3 ; vpinsrb $0x3,%r9d,%xmm0,%xmm12
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
+ DB 197,188,89,194 ; vmulps %ymm2,%ymm8,%ymm0
+ DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,20,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
+ DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,105,32,20,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm2,%xmm2
+ DB 65,137,193 ; mov %eax,%r9d
+ DB 72,193,232,32 ; shr $0x20,%rax
+ DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0
+ DB 71,15,182,12,10 ; movzbl (%r10,%r9,1),%r9d
+ DB 196,195,105,32,209,2 ; vpinsrb $0x2,%r9d,%xmm2,%xmm2
+ DB 196,193,249,126,193 ; vmovq %xmm0,%r9
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,99,105,32,192,3 ; vpinsrb $0x3,%eax,%xmm2,%xmm8
+ DB 68,137,200 ; mov %r9d,%eax
+ DB 196,195,121,32,12,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,131,113,32,4,10,1 ; vpinsrb $0x1,(%r10,%r9,1),%xmm1,%xmm0
+ DB 68,137,216 ; mov %r11d,%eax
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
+ DB 196,99,121,32,232,2 ; vpinsrb $0x2,%eax,%xmm0,%xmm13
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
+ DB 196,194,121,49,193 ; vpmovzxbd %xmm9,%xmm0
+ DB 196,194,121,49,203 ; vpmovzxbd %xmm11,%xmm1
+ DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
+ DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
+ DB 196,98,125,24,13,231,59,0,0 ; vbroadcastss 0x3be7(%rip),%ymm9 # 682c <_sk_callback_avx+0x276>
+ DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
+ DB 196,194,121,49,202 ; vpmovzxbd %xmm10,%xmm1
+ DB 196,194,121,49,212 ; vpmovzxbd %xmm12,%xmm2
+ DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
- DB 72,139,64,16 ; mov 0x10(%rax),%rax
- DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
- DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
- DB 196,227,249,22,213,1 ; vpextrq $0x1,%xmm2,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
- DB 72,193,237,32 ; shr $0x20,%rbp
- DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2
- DB 196,195,249,22,210,1 ; vpextrq $0x1,%xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 196,193,249,126,214 ; vmovq %xmm2,%r14
- DB 69,137,247 ; mov %r14d,%r15d
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 196,163,121,32,20,8,0 ; vpinsrb $0x0,(%rax,%r9,1),%xmm0,%xmm2
- DB 196,227,105,32,20,24,1 ; vpinsrb $0x1,(%rax,%rbx,1),%xmm2,%xmm2
- DB 66,15,182,28,0 ; movzbl (%rax,%r8,1),%ebx
- DB 196,227,105,32,211,2 ; vpinsrb $0x2,%ebx,%xmm2,%xmm2
- DB 15,182,44,40 ; movzbl (%rax,%rbp,1),%ebp
- DB 196,227,105,32,213,3 ; vpinsrb $0x3,%ebp,%xmm2,%xmm2
- DB 196,98,121,49,194 ; vpmovzxbd %xmm2,%xmm8
- DB 196,163,121,32,20,56,0 ; vpinsrb $0x0,(%rax,%r15,1),%xmm0,%xmm2
- DB 196,163,105,32,20,48,1 ; vpinsrb $0x1,(%rax,%r14,1),%xmm2,%xmm2
- DB 66,15,182,44,24 ; movzbl (%rax,%r11,1),%ebp
- DB 196,227,105,32,213,2 ; vpinsrb $0x2,%ebp,%xmm2,%xmm2
- DB 66,15,182,4,16 ; movzbl (%rax,%r10,1),%eax
- DB 196,227,105,32,208,3 ; vpinsrb $0x3,%eax,%xmm2,%xmm2
+ DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8
+ DB 196,227,17,32,208,3 ; vpinsrb $0x3,%eax,%xmm13,%xmm2
DB 196,226,121,49,210 ; vpmovzxbd %xmm2,%xmm2
DB 196,227,61,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm8,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,209 ; vmulps %ymm9,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,92 ; pop %r12
- DB 65,93 ; pop %r13
- DB 65,94 ; pop %r14
- DB 65,95 ; pop %r15
- DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_r_avx
_sk_table_r_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -7808,34 +7769,35 @@ _sk_table_r_avx LABEL PROC
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,195 ; vmovq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0
DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,199 ; vmovq %xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,129,122,16,4,160 ; vmovss (%r8,%r12,4),%xmm0
- DB 196,3,121,33,4,184,16 ; vinsertps $0x10,(%r8,%r15,4),%xmm0,%xmm8
- DB 196,129,122,16,4,176 ; vmovss (%r8,%r14,4),%xmm0
+ DB 196,193,249,126,196 ; vmovq %xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,129,122,16,4,169 ; vmovss (%r9,%r13,4),%xmm0
+ DB 196,3,121,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm0,%xmm8
+ DB 196,129,122,16,4,185 ; vmovss (%r9,%r15,4),%xmm0
DB 196,99,57,33,192,32 ; vinsertps $0x20,%xmm0,%xmm8,%xmm8
- DB 196,193,122,16,4,152 ; vmovss (%r8,%rbx,4),%xmm0
+ DB 196,193,122,16,4,153 ; vmovss (%r9,%rbx,4),%xmm0
DB 196,99,57,33,192,48 ; vinsertps $0x30,%xmm0,%xmm8,%xmm8
- DB 196,129,122,16,4,152 ; vmovss (%r8,%r11,4),%xmm0
- DB 196,3,121,33,12,144,16 ; vinsertps $0x10,(%r8,%r10,4),%xmm0,%xmm9
- DB 196,129,122,16,4,136 ; vmovss (%r8,%r9,4),%xmm0
+ DB 196,129,122,16,4,177 ; vmovss (%r9,%r14,4),%xmm0
+ DB 196,3,121,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm0,%xmm9
+ DB 196,129,122,16,4,145 ; vmovss (%r9,%r10,4),%xmm0
DB 196,99,49,33,200,32 ; vinsertps $0x20,%xmm0,%xmm9,%xmm9
- DB 196,193,122,16,4,128 ; vmovss (%r8,%rax,4),%xmm0
+ DB 196,193,122,16,4,129 ; vmovss (%r9,%rax,4),%xmm0
DB 196,227,49,33,192,48 ; vinsertps $0x30,%xmm0,%xmm9,%xmm0
DB 196,195,125,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -7844,10 +7806,11 @@ PUBLIC _sk_table_g_avx
_sk_table_g_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -7857,34 +7820,35 @@ _sk_table_g_avx LABEL PROC
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
DB 196,227,249,22,200,1 ; vpextrq $0x1,%xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,202 ; vmovq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,203 ; vmovq %xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
DB 196,227,249,22,203,1 ; vpextrq $0x1,%xmm1,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,207 ; vmovq %xmm1,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,129,122,16,12,160 ; vmovss (%r8,%r12,4),%xmm1
- DB 196,3,113,33,4,184,16 ; vinsertps $0x10,(%r8,%r15,4),%xmm1,%xmm8
- DB 196,129,122,16,12,176 ; vmovss (%r8,%r14,4),%xmm1
+ DB 196,193,249,126,204 ; vmovq %xmm1,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,129,122,16,12,169 ; vmovss (%r9,%r13,4),%xmm1
+ DB 196,3,113,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm1,%xmm8
+ DB 196,129,122,16,12,185 ; vmovss (%r9,%r15,4),%xmm1
DB 196,99,57,33,193,32 ; vinsertps $0x20,%xmm1,%xmm8,%xmm8
- DB 196,193,122,16,12,152 ; vmovss (%r8,%rbx,4),%xmm1
+ DB 196,193,122,16,12,153 ; vmovss (%r9,%rbx,4),%xmm1
DB 196,99,57,33,193,48 ; vinsertps $0x30,%xmm1,%xmm8,%xmm8
- DB 196,129,122,16,12,152 ; vmovss (%r8,%r11,4),%xmm1
- DB 196,3,113,33,12,144,16 ; vinsertps $0x10,(%r8,%r10,4),%xmm1,%xmm9
- DB 196,129,122,16,12,136 ; vmovss (%r8,%r9,4),%xmm1
+ DB 196,129,122,16,12,177 ; vmovss (%r9,%r14,4),%xmm1
+ DB 196,3,113,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm1,%xmm9
+ DB 196,129,122,16,12,145 ; vmovss (%r9,%r10,4),%xmm1
DB 196,99,49,33,201,32 ; vinsertps $0x20,%xmm1,%xmm9,%xmm9
- DB 196,193,122,16,12,128 ; vmovss (%r8,%rax,4),%xmm1
+ DB 196,193,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm1
DB 196,227,49,33,201,48 ; vinsertps $0x30,%xmm1,%xmm9,%xmm1
DB 196,195,117,24,200,1 ; vinsertf128 $0x1,%xmm8,%ymm1,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -7893,10 +7857,11 @@ PUBLIC _sk_table_b_avx
_sk_table_b_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -7906,34 +7871,35 @@ _sk_table_b_avx LABEL PROC
DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2
DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2
DB 196,227,249,22,211,1 ; vpextrq $0x1,%xmm2,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,215 ; vmovq %xmm2,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,129,122,16,20,160 ; vmovss (%r8,%r12,4),%xmm2
- DB 196,3,105,33,4,184,16 ; vinsertps $0x10,(%r8,%r15,4),%xmm2,%xmm8
- DB 196,129,122,16,20,176 ; vmovss (%r8,%r14,4),%xmm2
+ DB 196,193,249,126,212 ; vmovq %xmm2,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,129,122,16,20,169 ; vmovss (%r9,%r13,4),%xmm2
+ DB 196,3,105,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm2,%xmm8
+ DB 196,129,122,16,20,185 ; vmovss (%r9,%r15,4),%xmm2
DB 196,99,57,33,194,32 ; vinsertps $0x20,%xmm2,%xmm8,%xmm8
- DB 196,193,122,16,20,152 ; vmovss (%r8,%rbx,4),%xmm2
+ DB 196,193,122,16,20,153 ; vmovss (%r9,%rbx,4),%xmm2
DB 196,99,57,33,194,48 ; vinsertps $0x30,%xmm2,%xmm8,%xmm8
- DB 196,129,122,16,20,152 ; vmovss (%r8,%r11,4),%xmm2
- DB 196,3,105,33,12,144,16 ; vinsertps $0x10,(%r8,%r10,4),%xmm2,%xmm9
- DB 196,129,122,16,20,136 ; vmovss (%r8,%r9,4),%xmm2
+ DB 196,129,122,16,20,177 ; vmovss (%r9,%r14,4),%xmm2
+ DB 196,3,105,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm2,%xmm9
+ DB 196,129,122,16,20,145 ; vmovss (%r9,%r10,4),%xmm2
DB 196,99,49,33,202,32 ; vinsertps $0x20,%xmm2,%xmm9,%xmm9
- DB 196,193,122,16,20,128 ; vmovss (%r8,%rax,4),%xmm2
+ DB 196,193,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm2
DB 196,227,49,33,210,48 ; vinsertps $0x30,%xmm2,%xmm9,%xmm2
DB 196,195,109,24,208,1 ; vinsertf128 $0x1,%xmm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -7942,10 +7908,11 @@ PUBLIC _sk_table_a_avx
_sk_table_a_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 197,121,110,192 ; vmovd %eax,%xmm8
@@ -7955,34 +7922,35 @@ _sk_table_a_avx LABEL PROC
DB 197,188,89,219 ; vmulps %ymm3,%ymm8,%ymm3
DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
DB 196,227,249,22,216,1 ; vpextrq $0x1,%xmm3,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,218 ; vmovq %xmm3,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,219 ; vmovq %xmm3,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,219,1 ; vextractf128 $0x1,%ymm3,%xmm3
DB 196,227,249,22,219,1 ; vpextrq $0x1,%xmm3,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
+ DB 65,137,223 ; mov %ebx,%r15d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,249,126,223 ; vmovq %xmm3,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,129,122,16,28,160 ; vmovss (%r8,%r12,4),%xmm3
- DB 196,3,97,33,4,184,16 ; vinsertps $0x10,(%r8,%r15,4),%xmm3,%xmm8
- DB 196,129,122,16,28,176 ; vmovss (%r8,%r14,4),%xmm3
+ DB 196,193,249,126,220 ; vmovq %xmm3,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,129,122,16,28,169 ; vmovss (%r9,%r13,4),%xmm3
+ DB 196,3,97,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm3,%xmm8
+ DB 196,129,122,16,28,185 ; vmovss (%r9,%r15,4),%xmm3
DB 196,99,57,33,195,32 ; vinsertps $0x20,%xmm3,%xmm8,%xmm8
- DB 196,193,122,16,28,152 ; vmovss (%r8,%rbx,4),%xmm3
+ DB 196,193,122,16,28,153 ; vmovss (%r9,%rbx,4),%xmm3
DB 196,99,57,33,195,48 ; vinsertps $0x30,%xmm3,%xmm8,%xmm8
- DB 196,129,122,16,28,152 ; vmovss (%r8,%r11,4),%xmm3
- DB 196,3,97,33,12,144,16 ; vinsertps $0x10,(%r8,%r10,4),%xmm3,%xmm9
- DB 196,129,122,16,28,136 ; vmovss (%r8,%r9,4),%xmm3
+ DB 196,129,122,16,28,177 ; vmovss (%r9,%r14,4),%xmm3
+ DB 196,3,97,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm3,%xmm9
+ DB 196,129,122,16,28,145 ; vmovss (%r9,%r10,4),%xmm3
DB 196,99,49,33,203,32 ; vinsertps $0x20,%xmm3,%xmm9,%xmm9
- DB 196,193,122,16,28,128 ; vmovss (%r8,%rax,4),%xmm3
+ DB 196,193,122,16,28,129 ; vmovss (%r9,%rax,4),%xmm3
DB 196,227,49,33,219,48 ; vinsertps $0x30,%xmm3,%xmm9,%xmm3
DB 196,195,101,24,216,1 ; vinsertf128 $0x1,%xmm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -8002,36 +7970,36 @@ _sk_parametric_r_avx LABEL PROC
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,216 ; vcvtdq2ps %ymm0,%ymm11
- DB 196,98,125,24,37,181,55,0,0 ; vbroadcastss 0x37b5(%rip),%ymm12 # 67d0 <_sk_callback_avx+0x270>
+ DB 196,98,125,24,37,76,56,0,0 ; vbroadcastss 0x384c(%rip),%ymm12 # 6830 <_sk_callback_avx+0x27a>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,171,55,0,0 ; vbroadcastss 0x37ab(%rip),%ymm12 # 67d4 <_sk_callback_avx+0x274>
+ DB 196,98,125,24,37,66,56,0,0 ; vbroadcastss 0x3842(%rip),%ymm12 # 6834 <_sk_callback_avx+0x27e>
DB 196,193,124,84,196 ; vandps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,161,55,0,0 ; vbroadcastss 0x37a1(%rip),%ymm12 # 67d8 <_sk_callback_avx+0x278>
+ DB 196,98,125,24,37,56,56,0,0 ; vbroadcastss 0x3838(%rip),%ymm12 # 6838 <_sk_callback_avx+0x282>
DB 196,193,124,86,196 ; vorps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,151,55,0,0 ; vbroadcastss 0x3797(%rip),%ymm12 # 67dc <_sk_callback_avx+0x27c>
+ DB 196,98,125,24,37,46,56,0,0 ; vbroadcastss 0x382e(%rip),%ymm12 # 683c <_sk_callback_avx+0x286>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,141,55,0,0 ; vbroadcastss 0x378d(%rip),%ymm12 # 67e0 <_sk_callback_avx+0x280>
+ DB 196,98,125,24,37,36,56,0,0 ; vbroadcastss 0x3824(%rip),%ymm12 # 6840 <_sk_callback_avx+0x28a>
DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,126,55,0,0 ; vbroadcastss 0x377e(%rip),%ymm12 # 67e4 <_sk_callback_avx+0x284>
+ DB 196,98,125,24,37,21,56,0,0 ; vbroadcastss 0x3815(%rip),%ymm12 # 6844 <_sk_callback_avx+0x28e>
DB 196,193,124,88,196 ; vaddps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,116,55,0,0 ; vbroadcastss 0x3774(%rip),%ymm12 # 67e8 <_sk_callback_avx+0x288>
+ DB 196,98,125,24,37,11,56,0,0 ; vbroadcastss 0x380b(%rip),%ymm12 # 6848 <_sk_callback_avx+0x292>
DB 197,156,94,192 ; vdivps %ymm0,%ymm12,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
DB 197,172,89,192 ; vmulps %ymm0,%ymm10,%ymm0
DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,88,55,0,0 ; vbroadcastss 0x3758(%rip),%ymm11 # 67ec <_sk_callback_avx+0x28c>
+ DB 196,98,125,24,29,239,55,0,0 ; vbroadcastss 0x37ef(%rip),%ymm11 # 684c <_sk_callback_avx+0x296>
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,78,55,0,0 ; vbroadcastss 0x374e(%rip),%ymm11 # 67f0 <_sk_callback_avx+0x290>
+ DB 196,98,125,24,29,229,55,0,0 ; vbroadcastss 0x37e5(%rip),%ymm11 # 6850 <_sk_callback_avx+0x29a>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,124,92,195 ; vsubps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,63,55,0,0 ; vbroadcastss 0x373f(%rip),%ymm11 # 67f4 <_sk_callback_avx+0x294>
+ DB 196,98,125,24,29,214,55,0,0 ; vbroadcastss 0x37d6(%rip),%ymm11 # 6854 <_sk_callback_avx+0x29e>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,53,55,0,0 ; vbroadcastss 0x3735(%rip),%ymm11 # 67f8 <_sk_callback_avx+0x298>
+ DB 196,98,125,24,29,204,55,0,0 ; vbroadcastss 0x37cc(%rip),%ymm11 # 6858 <_sk_callback_avx+0x2a2>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0
- DB 196,98,125,24,21,38,55,0,0 ; vbroadcastss 0x3726(%rip),%ymm10 # 67fc <_sk_callback_avx+0x29c>
+ DB 196,98,125,24,21,189,55,0,0 ; vbroadcastss 0x37bd(%rip),%ymm10 # 685c <_sk_callback_avx+0x2a6>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -8039,7 +8007,7 @@ _sk_parametric_r_avx LABEL PROC
DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,253,54,0,0 ; vbroadcastss 0x36fd(%rip),%ymm8 # 6800 <_sk_callback_avx+0x2a0>
+ DB 196,98,125,24,5,148,55,0,0 ; vbroadcastss 0x3794(%rip),%ymm8 # 6860 <_sk_callback_avx+0x2aa>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -8059,36 +8027,36 @@ _sk_parametric_g_avx LABEL PROC
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,217 ; vcvtdq2ps %ymm1,%ymm11
- DB 196,98,125,24,37,174,54,0,0 ; vbroadcastss 0x36ae(%rip),%ymm12 # 6804 <_sk_callback_avx+0x2a4>
+ DB 196,98,125,24,37,69,55,0,0 ; vbroadcastss 0x3745(%rip),%ymm12 # 6864 <_sk_callback_avx+0x2ae>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,164,54,0,0 ; vbroadcastss 0x36a4(%rip),%ymm12 # 6808 <_sk_callback_avx+0x2a8>
+ DB 196,98,125,24,37,59,55,0,0 ; vbroadcastss 0x373b(%rip),%ymm12 # 6868 <_sk_callback_avx+0x2b2>
DB 196,193,116,84,204 ; vandps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,154,54,0,0 ; vbroadcastss 0x369a(%rip),%ymm12 # 680c <_sk_callback_avx+0x2ac>
+ DB 196,98,125,24,37,49,55,0,0 ; vbroadcastss 0x3731(%rip),%ymm12 # 686c <_sk_callback_avx+0x2b6>
DB 196,193,116,86,204 ; vorps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,144,54,0,0 ; vbroadcastss 0x3690(%rip),%ymm12 # 6810 <_sk_callback_avx+0x2b0>
+ DB 196,98,125,24,37,39,55,0,0 ; vbroadcastss 0x3727(%rip),%ymm12 # 6870 <_sk_callback_avx+0x2ba>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,134,54,0,0 ; vbroadcastss 0x3686(%rip),%ymm12 # 6814 <_sk_callback_avx+0x2b4>
+ DB 196,98,125,24,37,29,55,0,0 ; vbroadcastss 0x371d(%rip),%ymm12 # 6874 <_sk_callback_avx+0x2be>
DB 196,65,116,89,228 ; vmulps %ymm12,%ymm1,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,119,54,0,0 ; vbroadcastss 0x3677(%rip),%ymm12 # 6818 <_sk_callback_avx+0x2b8>
+ DB 196,98,125,24,37,14,55,0,0 ; vbroadcastss 0x370e(%rip),%ymm12 # 6878 <_sk_callback_avx+0x2c2>
DB 196,193,116,88,204 ; vaddps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,109,54,0,0 ; vbroadcastss 0x366d(%rip),%ymm12 # 681c <_sk_callback_avx+0x2bc>
+ DB 196,98,125,24,37,4,55,0,0 ; vbroadcastss 0x3704(%rip),%ymm12 # 687c <_sk_callback_avx+0x2c6>
DB 197,156,94,201 ; vdivps %ymm1,%ymm12,%ymm1
DB 197,164,92,201 ; vsubps %ymm1,%ymm11,%ymm1
DB 197,172,89,201 ; vmulps %ymm1,%ymm10,%ymm1
DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10
DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10
- DB 196,98,125,24,29,81,54,0,0 ; vbroadcastss 0x3651(%rip),%ymm11 # 6820 <_sk_callback_avx+0x2c0>
+ DB 196,98,125,24,29,232,54,0,0 ; vbroadcastss 0x36e8(%rip),%ymm11 # 6880 <_sk_callback_avx+0x2ca>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,71,54,0,0 ; vbroadcastss 0x3647(%rip),%ymm11 # 6824 <_sk_callback_avx+0x2c4>
+ DB 196,98,125,24,29,222,54,0,0 ; vbroadcastss 0x36de(%rip),%ymm11 # 6884 <_sk_callback_avx+0x2ce>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,116,92,203 ; vsubps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,56,54,0,0 ; vbroadcastss 0x3638(%rip),%ymm11 # 6828 <_sk_callback_avx+0x2c8>
+ DB 196,98,125,24,29,207,54,0,0 ; vbroadcastss 0x36cf(%rip),%ymm11 # 6888 <_sk_callback_avx+0x2d2>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,46,54,0,0 ; vbroadcastss 0x362e(%rip),%ymm11 # 682c <_sk_callback_avx+0x2cc>
+ DB 196,98,125,24,29,197,54,0,0 ; vbroadcastss 0x36c5(%rip),%ymm11 # 688c <_sk_callback_avx+0x2d6>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,116,88,202 ; vaddps %ymm10,%ymm1,%ymm1
- DB 196,98,125,24,21,31,54,0,0 ; vbroadcastss 0x361f(%rip),%ymm10 # 6830 <_sk_callback_avx+0x2d0>
+ DB 196,98,125,24,21,182,54,0,0 ; vbroadcastss 0x36b6(%rip),%ymm10 # 6890 <_sk_callback_avx+0x2da>
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -8096,7 +8064,7 @@ _sk_parametric_g_avx LABEL PROC
DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,5,246,53,0,0 ; vbroadcastss 0x35f6(%rip),%ymm8 # 6834 <_sk_callback_avx+0x2d4>
+ DB 196,98,125,24,5,141,54,0,0 ; vbroadcastss 0x368d(%rip),%ymm8 # 6894 <_sk_callback_avx+0x2de>
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -8116,36 +8084,36 @@ _sk_parametric_b_avx LABEL PROC
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,218 ; vcvtdq2ps %ymm2,%ymm11
- DB 196,98,125,24,37,167,53,0,0 ; vbroadcastss 0x35a7(%rip),%ymm12 # 6838 <_sk_callback_avx+0x2d8>
+ DB 196,98,125,24,37,62,54,0,0 ; vbroadcastss 0x363e(%rip),%ymm12 # 6898 <_sk_callback_avx+0x2e2>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,157,53,0,0 ; vbroadcastss 0x359d(%rip),%ymm12 # 683c <_sk_callback_avx+0x2dc>
+ DB 196,98,125,24,37,52,54,0,0 ; vbroadcastss 0x3634(%rip),%ymm12 # 689c <_sk_callback_avx+0x2e6>
DB 196,193,108,84,212 ; vandps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,147,53,0,0 ; vbroadcastss 0x3593(%rip),%ymm12 # 6840 <_sk_callback_avx+0x2e0>
+ DB 196,98,125,24,37,42,54,0,0 ; vbroadcastss 0x362a(%rip),%ymm12 # 68a0 <_sk_callback_avx+0x2ea>
DB 196,193,108,86,212 ; vorps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,137,53,0,0 ; vbroadcastss 0x3589(%rip),%ymm12 # 6844 <_sk_callback_avx+0x2e4>
+ DB 196,98,125,24,37,32,54,0,0 ; vbroadcastss 0x3620(%rip),%ymm12 # 68a4 <_sk_callback_avx+0x2ee>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,127,53,0,0 ; vbroadcastss 0x357f(%rip),%ymm12 # 6848 <_sk_callback_avx+0x2e8>
+ DB 196,98,125,24,37,22,54,0,0 ; vbroadcastss 0x3616(%rip),%ymm12 # 68a8 <_sk_callback_avx+0x2f2>
DB 196,65,108,89,228 ; vmulps %ymm12,%ymm2,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,112,53,0,0 ; vbroadcastss 0x3570(%rip),%ymm12 # 684c <_sk_callback_avx+0x2ec>
+ DB 196,98,125,24,37,7,54,0,0 ; vbroadcastss 0x3607(%rip),%ymm12 # 68ac <_sk_callback_avx+0x2f6>
DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,102,53,0,0 ; vbroadcastss 0x3566(%rip),%ymm12 # 6850 <_sk_callback_avx+0x2f0>
+ DB 196,98,125,24,37,253,53,0,0 ; vbroadcastss 0x35fd(%rip),%ymm12 # 68b0 <_sk_callback_avx+0x2fa>
DB 197,156,94,210 ; vdivps %ymm2,%ymm12,%ymm2
DB 197,164,92,210 ; vsubps %ymm2,%ymm11,%ymm2
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10
DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10
- DB 196,98,125,24,29,74,53,0,0 ; vbroadcastss 0x354a(%rip),%ymm11 # 6854 <_sk_callback_avx+0x2f4>
+ DB 196,98,125,24,29,225,53,0,0 ; vbroadcastss 0x35e1(%rip),%ymm11 # 68b4 <_sk_callback_avx+0x2fe>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,64,53,0,0 ; vbroadcastss 0x3540(%rip),%ymm11 # 6858 <_sk_callback_avx+0x2f8>
+ DB 196,98,125,24,29,215,53,0,0 ; vbroadcastss 0x35d7(%rip),%ymm11 # 68b8 <_sk_callback_avx+0x302>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,108,92,211 ; vsubps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,49,53,0,0 ; vbroadcastss 0x3531(%rip),%ymm11 # 685c <_sk_callback_avx+0x2fc>
+ DB 196,98,125,24,29,200,53,0,0 ; vbroadcastss 0x35c8(%rip),%ymm11 # 68bc <_sk_callback_avx+0x306>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,39,53,0,0 ; vbroadcastss 0x3527(%rip),%ymm11 # 6860 <_sk_callback_avx+0x300>
+ DB 196,98,125,24,29,190,53,0,0 ; vbroadcastss 0x35be(%rip),%ymm11 # 68c0 <_sk_callback_avx+0x30a>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,108,88,210 ; vaddps %ymm10,%ymm2,%ymm2
- DB 196,98,125,24,21,24,53,0,0 ; vbroadcastss 0x3518(%rip),%ymm10 # 6864 <_sk_callback_avx+0x304>
+ DB 196,98,125,24,21,175,53,0,0 ; vbroadcastss 0x35af(%rip),%ymm10 # 68c4 <_sk_callback_avx+0x30e>
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -8153,7 +8121,7 @@ _sk_parametric_b_avx LABEL PROC
DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,239,52,0,0 ; vbroadcastss 0x34ef(%rip),%ymm8 # 6868 <_sk_callback_avx+0x308>
+ DB 196,98,125,24,5,134,53,0,0 ; vbroadcastss 0x3586(%rip),%ymm8 # 68c8 <_sk_callback_avx+0x312>
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -8173,36 +8141,36 @@ _sk_parametric_a_avx LABEL PROC
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,219 ; vcvtdq2ps %ymm3,%ymm11
- DB 196,98,125,24,37,160,52,0,0 ; vbroadcastss 0x34a0(%rip),%ymm12 # 686c <_sk_callback_avx+0x30c>
+ DB 196,98,125,24,37,55,53,0,0 ; vbroadcastss 0x3537(%rip),%ymm12 # 68cc <_sk_callback_avx+0x316>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,150,52,0,0 ; vbroadcastss 0x3496(%rip),%ymm12 # 6870 <_sk_callback_avx+0x310>
+ DB 196,98,125,24,37,45,53,0,0 ; vbroadcastss 0x352d(%rip),%ymm12 # 68d0 <_sk_callback_avx+0x31a>
DB 196,193,100,84,220 ; vandps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,140,52,0,0 ; vbroadcastss 0x348c(%rip),%ymm12 # 6874 <_sk_callback_avx+0x314>
+ DB 196,98,125,24,37,35,53,0,0 ; vbroadcastss 0x3523(%rip),%ymm12 # 68d4 <_sk_callback_avx+0x31e>
DB 196,193,100,86,220 ; vorps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,130,52,0,0 ; vbroadcastss 0x3482(%rip),%ymm12 # 6878 <_sk_callback_avx+0x318>
+ DB 196,98,125,24,37,25,53,0,0 ; vbroadcastss 0x3519(%rip),%ymm12 # 68d8 <_sk_callback_avx+0x322>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,120,52,0,0 ; vbroadcastss 0x3478(%rip),%ymm12 # 687c <_sk_callback_avx+0x31c>
+ DB 196,98,125,24,37,15,53,0,0 ; vbroadcastss 0x350f(%rip),%ymm12 # 68dc <_sk_callback_avx+0x326>
DB 196,65,100,89,228 ; vmulps %ymm12,%ymm3,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,105,52,0,0 ; vbroadcastss 0x3469(%rip),%ymm12 # 6880 <_sk_callback_avx+0x320>
+ DB 196,98,125,24,37,0,53,0,0 ; vbroadcastss 0x3500(%rip),%ymm12 # 68e0 <_sk_callback_avx+0x32a>
DB 196,193,100,88,220 ; vaddps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,95,52,0,0 ; vbroadcastss 0x345f(%rip),%ymm12 # 6884 <_sk_callback_avx+0x324>
+ DB 196,98,125,24,37,246,52,0,0 ; vbroadcastss 0x34f6(%rip),%ymm12 # 68e4 <_sk_callback_avx+0x32e>
DB 197,156,94,219 ; vdivps %ymm3,%ymm12,%ymm3
DB 197,164,92,219 ; vsubps %ymm3,%ymm11,%ymm3
DB 197,172,89,219 ; vmulps %ymm3,%ymm10,%ymm3
DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10
DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10
- DB 196,98,125,24,29,67,52,0,0 ; vbroadcastss 0x3443(%rip),%ymm11 # 6888 <_sk_callback_avx+0x328>
+ DB 196,98,125,24,29,218,52,0,0 ; vbroadcastss 0x34da(%rip),%ymm11 # 68e8 <_sk_callback_avx+0x332>
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,57,52,0,0 ; vbroadcastss 0x3439(%rip),%ymm11 # 688c <_sk_callback_avx+0x32c>
+ DB 196,98,125,24,29,208,52,0,0 ; vbroadcastss 0x34d0(%rip),%ymm11 # 68ec <_sk_callback_avx+0x336>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,100,92,219 ; vsubps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,42,52,0,0 ; vbroadcastss 0x342a(%rip),%ymm11 # 6890 <_sk_callback_avx+0x330>
+ DB 196,98,125,24,29,193,52,0,0 ; vbroadcastss 0x34c1(%rip),%ymm11 # 68f0 <_sk_callback_avx+0x33a>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,32,52,0,0 ; vbroadcastss 0x3420(%rip),%ymm11 # 6894 <_sk_callback_avx+0x334>
+ DB 196,98,125,24,29,183,52,0,0 ; vbroadcastss 0x34b7(%rip),%ymm11 # 68f4 <_sk_callback_avx+0x33e>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,100,88,218 ; vaddps %ymm10,%ymm3,%ymm3
- DB 196,98,125,24,21,17,52,0,0 ; vbroadcastss 0x3411(%rip),%ymm10 # 6898 <_sk_callback_avx+0x338>
+ DB 196,98,125,24,21,168,52,0,0 ; vbroadcastss 0x34a8(%rip),%ymm10 # 68f8 <_sk_callback_avx+0x342>
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -8210,38 +8178,38 @@ _sk_parametric_a_avx LABEL PROC
DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3
- DB 196,98,125,24,5,232,51,0,0 ; vbroadcastss 0x33e8(%rip),%ymm8 # 689c <_sk_callback_avx+0x33c>
+ DB 196,98,125,24,5,127,52,0,0 ; vbroadcastss 0x347f(%rip),%ymm8 # 68fc <_sk_callback_avx+0x346>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_lab_to_xyz_avx
_sk_lab_to_xyz_avx LABEL PROC
- DB 196,98,125,24,5,218,51,0,0 ; vbroadcastss 0x33da(%rip),%ymm8 # 68a0 <_sk_callback_avx+0x340>
+ DB 196,98,125,24,5,113,52,0,0 ; vbroadcastss 0x3471(%rip),%ymm8 # 6900 <_sk_callback_avx+0x34a>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,208,51,0,0 ; vbroadcastss 0x33d0(%rip),%ymm8 # 68a4 <_sk_callback_avx+0x344>
+ DB 196,98,125,24,5,103,52,0,0 ; vbroadcastss 0x3467(%rip),%ymm8 # 6904 <_sk_callback_avx+0x34e>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,13,198,51,0,0 ; vbroadcastss 0x33c6(%rip),%ymm9 # 68a8 <_sk_callback_avx+0x348>
+ DB 196,98,125,24,13,93,52,0,0 ; vbroadcastss 0x345d(%rip),%ymm9 # 6908 <_sk_callback_avx+0x352>
DB 196,193,116,88,201 ; vaddps %ymm9,%ymm1,%ymm1
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 196,193,108,88,209 ; vaddps %ymm9,%ymm2,%ymm2
- DB 196,98,125,24,5,178,51,0,0 ; vbroadcastss 0x33b2(%rip),%ymm8 # 68ac <_sk_callback_avx+0x34c>
+ DB 196,98,125,24,5,73,52,0,0 ; vbroadcastss 0x3449(%rip),%ymm8 # 690c <_sk_callback_avx+0x356>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,168,51,0,0 ; vbroadcastss 0x33a8(%rip),%ymm8 # 68b0 <_sk_callback_avx+0x350>
+ DB 196,98,125,24,5,63,52,0,0 ; vbroadcastss 0x343f(%rip),%ymm8 # 6910 <_sk_callback_avx+0x35a>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,158,51,0,0 ; vbroadcastss 0x339e(%rip),%ymm8 # 68b4 <_sk_callback_avx+0x354>
+ DB 196,98,125,24,5,53,52,0,0 ; vbroadcastss 0x3435(%rip),%ymm8 # 6914 <_sk_callback_avx+0x35e>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 197,252,88,201 ; vaddps %ymm1,%ymm0,%ymm1
- DB 196,98,125,24,5,144,51,0,0 ; vbroadcastss 0x3390(%rip),%ymm8 # 68b8 <_sk_callback_avx+0x358>
+ DB 196,98,125,24,5,39,52,0,0 ; vbroadcastss 0x3427(%rip),%ymm8 # 6918 <_sk_callback_avx+0x362>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,252,92,210 ; vsubps %ymm2,%ymm0,%ymm2
DB 197,116,89,193 ; vmulps %ymm1,%ymm1,%ymm8
DB 196,65,116,89,192 ; vmulps %ymm8,%ymm1,%ymm8
- DB 196,98,125,24,13,121,51,0,0 ; vbroadcastss 0x3379(%rip),%ymm9 # 68bc <_sk_callback_avx+0x35c>
+ DB 196,98,125,24,13,16,52,0,0 ; vbroadcastss 0x3410(%rip),%ymm9 # 691c <_sk_callback_avx+0x366>
DB 196,65,52,194,208,1 ; vcmpltps %ymm8,%ymm9,%ymm10
- DB 196,98,125,24,29,110,51,0,0 ; vbroadcastss 0x336e(%rip),%ymm11 # 68c0 <_sk_callback_avx+0x360>
+ DB 196,98,125,24,29,5,52,0,0 ; vbroadcastss 0x3405(%rip),%ymm11 # 6920 <_sk_callback_avx+0x36a>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,37,100,51,0,0 ; vbroadcastss 0x3364(%rip),%ymm12 # 68c4 <_sk_callback_avx+0x364>
+ DB 196,98,125,24,37,251,51,0,0 ; vbroadcastss 0x33fb(%rip),%ymm12 # 6924 <_sk_callback_avx+0x36e>
DB 196,193,116,89,204 ; vmulps %ymm12,%ymm1,%ymm1
DB 196,67,117,74,192,160 ; vblendvps %ymm10,%ymm8,%ymm1,%ymm8
DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1
@@ -8256,56 +8224,59 @@ _sk_lab_to_xyz_avx LABEL PROC
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,193,108,89,212 ; vmulps %ymm12,%ymm2,%ymm2
DB 196,227,109,74,208,144 ; vblendvps %ymm9,%ymm0,%ymm2,%ymm2
- DB 196,226,125,24,5,26,51,0,0 ; vbroadcastss 0x331a(%rip),%ymm0 # 68c8 <_sk_callback_avx+0x368>
+ DB 196,226,125,24,5,177,51,0,0 ; vbroadcastss 0x33b1(%rip),%ymm0 # 6928 <_sk_callback_avx+0x372>
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,17,51,0,0 ; vbroadcastss 0x3311(%rip),%ymm8 # 68cc <_sk_callback_avx+0x36c>
+ DB 196,98,125,24,5,168,51,0,0 ; vbroadcastss 0x33a8(%rip),%ymm8 # 692c <_sk_callback_avx+0x376>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_a8_avx
_sk_load_a8_avx LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,62 ; jne 3612 <_sk_load_a8_avx+0x4e>
+ DB 117,62 ; jne 35db <_sk_load_a8_avx+0x4e>
DB 197,250,126,0 ; vmovq (%rax),%xmm0
DB 196,226,121,49,200 ; vpmovzxbd %xmm0,%xmm1
DB 196,227,121,4,192,229 ; vpermilps $0xe5,%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,213,50,0,0 ; vbroadcastss 0x32d5(%rip),%ymm1 # 68d0 <_sk_callback_avx+0x370>
+ DB 196,226,125,24,13,108,51,0,0 ; vbroadcastss 0x336c(%rip),%ymm1 # 6930 <_sk_callback_avx+0x37a>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
- DB 76,137,193 ; mov %r8,%rcx
+ DB 76,137,201 ; mov %r9,%rcx
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 361a <_sk_load_a8_avx+0x56>
- DB 196,193,249,110,193 ; vmovq %r9,%xmm0
- DB 235,161 ; jmp 35d8 <_sk_load_a8_avx+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 35e4 <_sk_load_a8_avx+0x57>
+ DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 91 ; pop %rbx
+ DB 235,160 ; jmp 35a1 <_sk_load_a8_avx+0x14>
PUBLIC _sk_gather_a8_avx
_sk_gather_a8_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -8316,35 +8287,35 @@ _sk_gather_a8_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,131,121,32,4,48,0 ; vpinsrb $0x0,(%r8,%r14,1),%xmm0,%xmm0
- DB 196,195,121,32,4,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm0,%xmm0
- DB 67,15,182,28,32 ; movzbl (%r8,%r12,1),%ebx
+ DB 196,131,121,32,4,57,0 ; vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
+ DB 67,15,182,28,41 ; movzbl (%r9,%r13,1),%ebx
DB 196,227,121,32,195,2 ; vpinsrb $0x2,%ebx,%xmm0,%xmm0
- DB 67,15,182,28,56 ; movzbl (%r8,%r15,1),%ebx
+ DB 67,15,182,28,33 ; movzbl (%r9,%r12,1),%ebx
DB 196,227,121,32,195,3 ; vpinsrb $0x3,%ebx,%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 196,131,121,32,12,24,0 ; vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm1
- DB 196,131,113,32,12,16,1 ; vpinsrb $0x1,(%r8,%r10,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
+ DB 196,131,121,32,12,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1
+ DB 196,131,113,32,12,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1
+ DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx
DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1
DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,202,49,0,0 ; vbroadcastss 0x31ca(%rip),%ymm1 # 68d4 <_sk_callback_avx+0x374>
+ DB 196,226,125,24,13,94,50,0,0 ; vbroadcastss 0x325e(%rip),%ymm1 # 6934 <_sk_callback_avx+0x37e>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -8352,6 +8323,7 @@ _sk_gather_a8_avx LABEL PROC
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -8359,105 +8331,106 @@ _sk_gather_a8_avx LABEL PROC
PUBLIC _sk_store_a8_avx
_sk_store_a8_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,165,49,0,0 ; vbroadcastss 0x31a5(%rip),%ymm8 # 68d8 <_sk_callback_avx+0x378>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,55,50,0,0 ; vbroadcastss 0x3237(%rip),%ymm8 # 6938 <_sk_callback_avx+0x382>
DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8
DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 196,65,57,103,192 ; vpackuswb %xmm8,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 375c <_sk_store_a8_avx+0x37>
- DB 196,65,123,17,4,58 ; vmovsd %xmm8,(%r10,%rdi,1)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 372a <_sk_store_a8_avx+0x37>
+ DB 196,65,123,17,4,19 ; vmovsd %xmm8,(%r11,%rdx,1)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 3758 <_sk_store_a8_avx+0x33>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 3726 <_sk_store_a8_avx+0x33>
DB 196,66,121,48,192 ; vpmovzxbw %xmm8,%xmm8
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,68,0,0,0 ; lea 0x44(%rip),%r9 # 37c0 <_sk_store_a8_avx+0x9b>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,20,68,58,6,12 ; vpextrb $0xc,%xmm8,0x6(%r10,%rdi,1)
- DB 196,67,121,20,68,58,5,10 ; vpextrb $0xa,%xmm8,0x5(%r10,%rdi,1)
- DB 196,67,121,20,68,58,4,8 ; vpextrb $0x8,%xmm8,0x4(%r10,%rdi,1)
- DB 196,67,121,20,68,58,3,6 ; vpextrb $0x6,%xmm8,0x3(%r10,%rdi,1)
- DB 196,67,121,20,68,58,2,4 ; vpextrb $0x4,%xmm8,0x2(%r10,%rdi,1)
- DB 196,67,121,20,68,58,1,2 ; vpextrb $0x2,%xmm8,0x1(%r10,%rdi,1)
- DB 196,67,121,20,4,58,0 ; vpextrb $0x0,%xmm8,(%r10,%rdi,1)
- DB 235,154 ; jmp 3758 <_sk_store_a8_avx+0x33>
- DB 102,144 ; xchg %ax,%ax
- DB 245 ; cmc
- DB 255 ; (bad)
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 378c <_sk_store_a8_avx+0x99>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,20,68,19,6,12 ; vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,5,10 ; vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,4,8 ; vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,3,6 ; vpextrb $0x6,%xmm8,0x3(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
+ DB 196,67,121,20,68,19,1,2 ; vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1)
+ DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1)
+ DB 235,154 ; jmp 3726 <_sk_store_a8_avx+0x33>
+ DB 247,255 ; idiv %edi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 237 ; in (%dx),%eax
+ DB 239 ; out %eax,(%dx)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,229 ; jmpq *%rbp
+ DB 255,231 ; jmpq *%rdi
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 221,255 ; (bad)
+ DB 223,255 ; (bad)
DB 255 ; (bad)
- DB 255,213 ; callq *%rbp
+ DB 255,215 ; callq *%rdi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,205 ; dec %ebp
+ DB 255,207 ; dec %edi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,197 ; inc %ebp
+ DB 255,199 ; inc %edi
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
PUBLIC _sk_load_g8_avx
_sk_load_g8_avx LABEL PROC
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,1,248 ; add %rdi,%rax
+ DB 72,1,208 ; add %rdx,%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,67 ; jne 382f <_sk_load_g8_avx+0x53>
+ DB 117,67 ; jne 37fb <_sk_load_g8_avx+0x53>
DB 197,250,126,0 ; vmovq (%rax),%xmm0
DB 196,226,121,49,200 ; vpmovzxbd %xmm0,%xmm1
DB 196,227,121,4,192,229 ; vpermilps $0xe5,%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,201,48,0,0 ; vbroadcastss 0x30c9(%rip),%ymm1 # 68dc <_sk_callback_avx+0x37c>
+ DB 196,226,125,24,13,93,49,0,0 ; vbroadcastss 0x315d(%rip),%ymm1 # 693c <_sk_callback_avx+0x386>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,190,48,0,0 ; vbroadcastss 0x30be(%rip),%ymm3 # 68e0 <_sk_callback_avx+0x380>
- DB 76,137,193 ; mov %r8,%rcx
+ DB 196,226,125,24,29,82,49,0,0 ; vbroadcastss 0x3152(%rip),%ymm3 # 6940 <_sk_callback_avx+0x38a>
+ DB 76,137,201 ; mov %r9,%rcx
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
+ DB 83 ; push %rbx
DB 49,201 ; xor %ecx,%ecx
- DB 77,137,194 ; mov %r8,%r10
- DB 69,49,201 ; xor %r9d,%r9d
- DB 68,15,182,24 ; movzbl (%rax),%r11d
+ DB 77,137,195 ; mov %r8,%r11
+ DB 69,49,210 ; xor %r10d,%r10d
+ DB 15,182,24 ; movzbl (%rax),%ebx
DB 72,255,192 ; inc %rax
- DB 73,211,227 ; shl %cl,%r11
- DB 77,9,217 ; or %r11,%r9
+ DB 72,211,227 ; shl %cl,%rbx
+ DB 73,9,218 ; or %rbx,%r10
DB 72,131,193,8 ; add $0x8,%rcx
- DB 73,255,202 ; dec %r10
- DB 117,234 ; jne 3837 <_sk_load_g8_avx+0x5b>
- DB 196,193,249,110,193 ; vmovq %r9,%xmm0
- DB 235,156 ; jmp 37f0 <_sk_load_g8_avx+0x14>
+ DB 73,255,203 ; dec %r11
+ DB 117,235 ; jne 3804 <_sk_load_g8_avx+0x5c>
+ DB 196,193,249,110,194 ; vmovq %r10,%xmm0
+ DB 91 ; pop %rbx
+ DB 235,155 ; jmp 37bc <_sk_load_g8_avx+0x14>
PUBLIC _sk_gather_g8_avx
_sk_gather_g8_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -8468,42 +8441,43 @@ _sk_gather_g8_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,131,121,32,4,48,0 ; vpinsrb $0x0,(%r8,%r14,1),%xmm0,%xmm0
- DB 196,195,121,32,4,24,1 ; vpinsrb $0x1,(%r8,%rbx,1),%xmm0,%xmm0
- DB 67,15,182,28,32 ; movzbl (%r8,%r12,1),%ebx
+ DB 196,131,121,32,4,57,0 ; vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
+ DB 67,15,182,28,41 ; movzbl (%r9,%r13,1),%ebx
DB 196,227,121,32,195,2 ; vpinsrb $0x2,%ebx,%xmm0,%xmm0
- DB 67,15,182,28,56 ; movzbl (%r8,%r15,1),%ebx
+ DB 67,15,182,28,33 ; movzbl (%r9,%r12,1),%ebx
DB 196,227,121,32,195,3 ; vpinsrb $0x3,%ebx,%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 196,131,121,32,12,24,0 ; vpinsrb $0x0,(%r8,%r11,1),%xmm0,%xmm1
- DB 196,131,113,32,12,16,1 ; vpinsrb $0x1,(%r8,%r10,1),%xmm1,%xmm1
- DB 67,15,182,28,8 ; movzbl (%r8,%r9,1),%ebx
+ DB 196,131,121,32,12,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1
+ DB 196,131,113,32,12,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1
+ DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx
DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1
DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,189,47,0,0 ; vbroadcastss 0x2fbd(%rip),%ymm1 # 68e4 <_sk_callback_avx+0x384>
+ DB 196,226,125,24,13,78,48,0,0 ; vbroadcastss 0x304e(%rip),%ymm1 # 6944 <_sk_callback_avx+0x38e>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,178,47,0,0 ; vbroadcastss 0x2fb2(%rip),%ymm3 # 68e8 <_sk_callback_avx+0x388>
+ DB 196,226,125,24,29,67,48,0,0 ; vbroadcastss 0x3043(%rip),%ymm3 # 6948 <_sk_callback_avx+0x392>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -8511,18 +8485,19 @@ _sk_gather_g8_avx LABEL PROC
PUBLIC _sk_gather_i8_avx
_sk_gather_i8_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,192 ; mov %rax,%r8
- DB 77,133,192 ; test %r8,%r8
- DB 116,5 ; je 3956 <_sk_gather_i8_avx+0xf>
- DB 76,137,192 ; mov %r8,%rax
- DB 235,2 ; jmp 3958 <_sk_gather_i8_avx+0x11>
+ DB 73,137,193 ; mov %rax,%r9
+ DB 77,133,201 ; test %r9,%r9
+ DB 116,5 ; je 3927 <_sk_gather_i8_avx+0xf>
+ DB 76,137,200 ; mov %r9,%rax
+ DB 235,2 ; jmp 3929 <_sk_gather_i8_avx+0x11>
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 76,139,8 ; mov (%rax),%r9
+ DB 76,139,16 ; mov (%rax),%r10
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -8533,54 +8508,54 @@ _sk_gather_i8_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,211 ; vmovq %xmm2,%r11
- DB 69,137,222 ; mov %r11d,%r14d
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
- DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,223 ; mov %ebx,%r15d
- DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
- DB 69,137,229 ; mov %r12d,%r13d
- DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,225,249,126,211 ; vmovq %xmm2,%rbx
+ DB 65,137,222 ; mov %ebx,%r14d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0
- DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0
- DB 196,131,121,32,4,17,2 ; vpinsrb $0x2,(%r9,%r10,1),%xmm0,%xmm0
- DB 196,195,121,32,4,1,3 ; vpinsrb $0x3,(%r9,%rax,1),%xmm0,%xmm0
+ DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
+ DB 196,193,249,126,199 ; vmovq %xmm0,%r15
+ DB 69,137,252 ; mov %r15d,%r12d
+ DB 196,195,249,22,197,1 ; vpextrq $0x1,%xmm0,%r13
+ DB 68,137,237 ; mov %r13d,%ebp
+ DB 73,193,237,32 ; shr $0x20,%r13
+ DB 73,193,239,32 ; shr $0x20,%r15
+ DB 196,131,121,32,4,50,0 ; vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,26,1 ; vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10
- DB 196,193,249,126,195 ; vmovq %xmm0,%r11
- DB 196,131,121,32,4,57,0 ; vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0
- DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0
- DB 196,131,121,32,4,41,2 ; vpinsrb $0x2,(%r9,%r13,1),%xmm0,%xmm0
- DB 196,131,121,32,4,33,3 ; vpinsrb $0x3,(%r9,%r12,1),%xmm0,%xmm0
+ DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11
+ DB 196,193,249,126,198 ; vmovq %xmm0,%r14
+ DB 196,131,121,32,4,34,0 ; vpinsrb $0x0,(%r10,%r12,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,58,1 ; vpinsrb $0x1,(%r10,%r15,1),%xmm0,%xmm0
+ DB 196,195,121,32,4,42,2 ; vpinsrb $0x2,(%r10,%rbp,1),%xmm0,%xmm0
+ DB 196,131,121,32,4,42,3 ; vpinsrb $0x3,(%r10,%r13,1),%xmm0,%xmm0
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 73,139,88,8 ; mov 0x8(%r8),%rbx
- DB 196,193,249,126,193 ; vmovq %xmm0,%r9
- DB 69,137,200 ; mov %r9d,%r8d
- DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 73,139,105,8 ; mov 0x8(%r9),%rbp
+ DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
+ DB 65,137,217 ; mov %ebx,%r9d
+ DB 72,193,235,30 ; shr $0x1e,%rbx
DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 65,137,198 ; mov %eax,%r14d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 69,137,223 ; mov %r11d,%r15d
+ DB 69,137,247 ; mov %r14d,%r15d
+ DB 73,193,238,30 ; shr $0x1e,%r14
+ DB 69,137,220 ; mov %r11d,%r12d
DB 73,193,235,30 ; shr $0x1e,%r11
- DB 69,137,212 ; mov %r10d,%r12d
- DB 73,193,234,30 ; shr $0x1e,%r10
- DB 196,161,121,110,4,131 ; vmovd (%rbx,%r8,4),%xmm0
- DB 196,163,121,34,4,11,1 ; vpinsrd $0x1,(%rbx,%r9,1),%xmm0,%xmm0
- DB 196,163,121,34,4,179,2 ; vpinsrd $0x2,(%rbx,%r14,4),%xmm0,%xmm0
- DB 196,99,121,34,4,3,3 ; vpinsrd $0x3,(%rbx,%rax,1),%xmm0,%xmm8
- DB 196,161,121,110,4,187 ; vmovd (%rbx,%r15,4),%xmm0
- DB 196,163,121,34,4,27,1 ; vpinsrd $0x1,(%rbx,%r11,1),%xmm0,%xmm0
- DB 196,163,121,34,4,163,2 ; vpinsrd $0x2,(%rbx,%r12,4),%xmm0,%xmm0
- DB 196,163,121,34,28,19,3 ; vpinsrd $0x3,(%rbx,%r10,1),%xmm0,%xmm3
+ DB 196,161,121,110,68,141,0 ; vmovd 0x0(%rbp,%r9,4),%xmm0
+ DB 196,227,121,34,68,29,0,1 ; vpinsrd $0x1,0x0(%rbp,%rbx,1),%xmm0,%xmm0
+ DB 196,163,121,34,68,149,0,2 ; vpinsrd $0x2,0x0(%rbp,%r10,4),%xmm0,%xmm0
+ DB 196,99,121,34,68,5,0,3 ; vpinsrd $0x3,0x0(%rbp,%rax,1),%xmm0,%xmm8
+ DB 196,161,121,110,68,189,0 ; vmovd 0x0(%rbp,%r15,4),%xmm0
+ DB 196,163,121,34,68,53,0,1 ; vpinsrd $0x1,0x0(%rbp,%r14,1),%xmm0,%xmm0
+ DB 196,163,121,34,68,165,0,2 ; vpinsrd $0x2,0x0(%rbp,%r12,4),%xmm0,%xmm0
+ DB 196,163,121,34,92,29,0,3 ; vpinsrd $0x3,0x0(%rbp,%r11,1),%xmm0,%xmm3
DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- DB 197,124,40,21,30,49,0,0 ; vmovaps 0x311e(%rip),%ymm10 # 6ba0 <_sk_callback_avx+0x640>
+ DB 197,124,40,21,164,49,0,0 ; vmovaps 0x31a4(%rip),%ymm10 # 6c00 <_sk_callback_avx+0x64a>
DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,88,46,0,0 ; vbroadcastss 0x2e58(%rip),%ymm9 # 68ec <_sk_callback_avx+0x38c>
+ DB 196,98,125,24,13,222,46,0,0 ; vbroadcastss 0x2ede(%rip),%ymm9 # 694c <_sk_callback_avx+0x396>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1
DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2
@@ -8605,77 +8580,78 @@ _sk_gather_i8_avx LABEL PROC
DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_565_avx
_sk_load_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,128,0,0,0 ; jne 3b8c <_sk_load_565_avx+0x8e>
- DB 196,193,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm0
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,128,0,0,0 ; jne 3b67 <_sk_load_565_avx+0x8e>
+ DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- DB 196,226,125,24,5,194,45,0,0 ; vbroadcastss 0x2dc2(%rip),%ymm0 # 68f0 <_sk_callback_avx+0x390>
+ DB 196,226,125,24,5,71,46,0,0 ; vbroadcastss 0x2e47(%rip),%ymm0 # 6950 <_sk_callback_avx+0x39a>
DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,181,45,0,0 ; vbroadcastss 0x2db5(%rip),%ymm1 # 68f4 <_sk_callback_avx+0x394>
+ DB 196,226,125,24,13,58,46,0,0 ; vbroadcastss 0x2e3a(%rip),%ymm1 # 6954 <_sk_callback_avx+0x39e>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,172,45,0,0 ; vbroadcastss 0x2dac(%rip),%ymm1 # 68f8 <_sk_callback_avx+0x398>
+ DB 196,226,125,24,13,49,46,0,0 ; vbroadcastss 0x2e31(%rip),%ymm1 # 6958 <_sk_callback_avx+0x3a2>
DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,159,45,0,0 ; vbroadcastss 0x2d9f(%rip),%ymm3 # 68fc <_sk_callback_avx+0x39c>
+ DB 196,226,125,24,29,36,46,0,0 ; vbroadcastss 0x2e24(%rip),%ymm3 # 695c <_sk_callback_avx+0x3a6>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,24,29,150,45,0,0 ; vbroadcastss 0x2d96(%rip),%ymm3 # 6900 <_sk_callback_avx+0x3a0>
+ DB 196,226,125,24,29,27,46,0,0 ; vbroadcastss 0x2e1b(%rip),%ymm3 # 6960 <_sk_callback_avx+0x3aa>
DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,137,45,0,0 ; vbroadcastss 0x2d89(%rip),%ymm3 # 6904 <_sk_callback_avx+0x3a4>
+ DB 196,226,125,24,29,14,46,0,0 ; vbroadcastss 0x2e0e(%rip),%ymm3 # 6964 <_sk_callback_avx+0x3ae>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,126,45,0,0 ; vbroadcastss 0x2d7e(%rip),%ymm3 # 6908 <_sk_callback_avx+0x3a8>
+ DB 196,226,125,24,29,3,46,0,0 ; vbroadcastss 0x2e03(%rip),%ymm3 # 6968 <_sk_callback_avx+0x3b2>
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 15,135,110,255,255,255 ; ja 3b12 <_sk_load_565_avx+0x14>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,73,0,0,0 ; lea 0x49(%rip),%r9 # 3bf8 <_sk_load_565_avx+0xfa>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 15,135,110,255,255,255 ; ja 3aed <_sk_load_565_avx+0x14>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 3bd4 <_sk_load_565_avx+0xfb>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 196,193,121,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- DB 233,26,255,255,255 ; jmpq 3b12 <_sk_load_565_avx+0x14>
- DB 244 ; hlt
+ DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ DB 233,26,255,255,255 ; jmpq 3aed <_sk_load_565_avx+0x14>
+ DB 144 ; nop
+ DB 243,255 ; repz (bad)
DB 255 ; (bad)
DB 255 ; (bad)
+ DB 235,255 ; jmp 3bd9 <_sk_load_565_avx+0x100>
DB 255 ; (bad)
- DB 236 ; in (%dx),%al
+ DB 255,227 ; jmpq *%rbx
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,228 ; jmpq *%rsp
- DB 255 ; (bad)
DB 255 ; (bad)
+ DB 219,255 ; (bad)
DB 255 ; (bad)
- DB 220,255 ; fdivr %st,%st(7)
+ DB 255,211 ; callq *%rbx
DB 255 ; (bad)
- DB 255,212 ; callq *%rsp
DB 255 ; (bad)
+ DB 255,203 ; dec %ebx
DB 255 ; (bad)
- DB 255,204 ; dec %esp
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,192 ; inc %eax
+ DB 191 ; .byte 0xbf
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
@@ -8685,10 +8661,11 @@ _sk_gather_565_avx LABEL PROC
DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -8699,57 +8676,58 @@ _sk_gather_565_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 65,15,183,28,88 ; movzwl (%r8,%rbx,2),%ebx
- DB 67,15,183,44,112 ; movzwl (%r8,%r14,2),%ebp
+ DB 65,15,183,28,89 ; movzwl (%r9,%rbx,2),%ebx
+ DB 67,15,183,44,121 ; movzwl (%r9,%r15,2),%ebp
DB 197,249,110,197 ; vmovd %ebp,%xmm0
DB 197,249,196,195,1 ; vpinsrw $0x1,%ebx,%xmm0,%xmm0
- DB 67,15,183,28,96 ; movzwl (%r8,%r12,2),%ebx
+ DB 67,15,183,28,105 ; movzwl (%r9,%r13,2),%ebx
DB 197,249,196,195,2 ; vpinsrw $0x2,%ebx,%xmm0,%xmm0
- DB 67,15,183,28,120 ; movzwl (%r8,%r15,2),%ebx
+ DB 67,15,183,28,97 ; movzwl (%r9,%r12,2),%ebx
DB 197,249,196,195,3 ; vpinsrw $0x3,%ebx,%xmm0,%xmm0
- DB 67,15,183,44,88 ; movzwl (%r8,%r11,2),%ebp
- DB 197,249,196,197,4 ; vpinsrw $0x4,%ebp,%xmm0,%xmm0
- DB 67,15,183,44,80 ; movzwl (%r8,%r10,2),%ebp
+ DB 67,15,183,28,113 ; movzwl (%r9,%r14,2),%ebx
+ DB 197,249,196,195,4 ; vpinsrw $0x4,%ebx,%xmm0,%xmm0
+ DB 67,15,183,44,89 ; movzwl (%r9,%r11,2),%ebp
DB 197,249,196,197,5 ; vpinsrw $0x5,%ebp,%xmm0,%xmm0
- DB 67,15,183,44,72 ; movzwl (%r8,%r9,2),%ebp
+ DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp
DB 197,249,196,197,6 ; vpinsrw $0x6,%ebp,%xmm0,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- DB 196,226,125,24,5,30,44,0,0 ; vbroadcastss 0x2c1e(%rip),%ymm0 # 690c <_sk_callback_avx+0x3ac>
+ DB 196,226,125,24,5,160,44,0,0 ; vbroadcastss 0x2ca0(%rip),%ymm0 # 696c <_sk_callback_avx+0x3b6>
DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,17,44,0,0 ; vbroadcastss 0x2c11(%rip),%ymm1 # 6910 <_sk_callback_avx+0x3b0>
+ DB 196,226,125,24,13,147,44,0,0 ; vbroadcastss 0x2c93(%rip),%ymm1 # 6970 <_sk_callback_avx+0x3ba>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,8,44,0,0 ; vbroadcastss 0x2c08(%rip),%ymm1 # 6914 <_sk_callback_avx+0x3b4>
+ DB 196,226,125,24,13,138,44,0,0 ; vbroadcastss 0x2c8a(%rip),%ymm1 # 6974 <_sk_callback_avx+0x3be>
DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,251,43,0,0 ; vbroadcastss 0x2bfb(%rip),%ymm3 # 6918 <_sk_callback_avx+0x3b8>
+ DB 196,226,125,24,29,125,44,0,0 ; vbroadcastss 0x2c7d(%rip),%ymm3 # 6978 <_sk_callback_avx+0x3c2>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,24,29,242,43,0,0 ; vbroadcastss 0x2bf2(%rip),%ymm3 # 691c <_sk_callback_avx+0x3bc>
+ DB 196,226,125,24,29,116,44,0,0 ; vbroadcastss 0x2c74(%rip),%ymm3 # 697c <_sk_callback_avx+0x3c6>
DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,229,43,0,0 ; vbroadcastss 0x2be5(%rip),%ymm3 # 6920 <_sk_callback_avx+0x3c0>
+ DB 196,226,125,24,29,103,44,0,0 ; vbroadcastss 0x2c67(%rip),%ymm3 # 6980 <_sk_callback_avx+0x3ca>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,218,43,0,0 ; vbroadcastss 0x2bda(%rip),%ymm3 # 6924 <_sk_callback_avx+0x3c4>
+ DB 196,226,125,24,29,92,44,0,0 ; vbroadcastss 0x2c5c(%rip),%ymm3 # 6984 <_sk_callback_avx+0x3ce>
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 93 ; pop %rbp
@@ -8758,15 +8736,15 @@ _sk_gather_565_avx LABEL PROC
PUBLIC _sk_store_565_avx
_sk_store_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,198,43,0,0 ; vbroadcastss 0x2bc6(%rip),%ymm8 # 6928 <_sk_callback_avx+0x3c8>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,70,44,0,0 ; vbroadcastss 0x2c46(%rip),%ymm8 # 6988 <_sk_callback_avx+0x3d2>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,41,114,241,11 ; vpslld $0xb,%xmm9,%xmm10
DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9
DB 196,193,49,114,241,11 ; vpslld $0xb,%xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- DB 196,98,125,24,21,159,43,0,0 ; vbroadcastss 0x2b9f(%rip),%ymm10 # 692c <_sk_callback_avx+0x3cc>
+ DB 196,98,125,24,21,31,44,0,0 ; vbroadcastss 0x2c1f(%rip),%ymm10 # 698c <_sk_callback_avx+0x3d6>
DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10
DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10
DB 196,193,33,114,242,5 ; vpslld $0x5,%xmm10,%xmm11
@@ -8779,29 +8757,29 @@ _sk_store_565_avx LABEL PROC
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3ddd <_sk_store_565_avx+0x89>
- DB 196,65,122,127,4,122 ; vmovdqu %xmm8,(%r10,%rdi,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 3dd9 <_sk_store_565_avx+0x85>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,68,0,0,0 ; lea 0x44(%rip),%r9 # 3e3c <_sk_store_565_avx+0xe8>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,21,68,122,12,6 ; vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- DB 196,67,121,21,68,122,10,5 ; vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- DB 196,67,121,21,68,122,8,4 ; vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- DB 196,67,121,21,68,122,6,3 ; vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- DB 196,67,121,21,68,122,4,2 ; vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- DB 196,67,121,21,68,122,2,1 ; vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- DB 196,67,121,21,4,122,0 ; vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- DB 235,159 ; jmp 3dd9 <_sk_store_565_avx+0x85>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3dbd <_sk_store_565_avx+0x89>
+ DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 3db9 <_sk_store_565_avx+0x85>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3e1c <_sk_store_565_avx+0xe8>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,6,3 ; vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ DB 235,159 ; jmp 3db9 <_sk_store_565_avx+0x85>
DB 102,144 ; xchg %ax,%ax
DB 245 ; cmc
DB 255 ; (bad)
@@ -8830,56 +8808,56 @@ _sk_store_565_avx LABEL PROC
PUBLIC _sk_load_4444_avx
_sk_load_4444_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,152,0,0,0 ; jne 3efe <_sk_load_4444_avx+0xa6>
- DB 196,193,122,111,4,122 ; vmovdqu (%r10,%rdi,2),%xmm0
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,152,0,0,0 ; jne 3ede <_sk_load_4444_avx+0xa6>
+ DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- DB 196,226,125,24,5,168,42,0,0 ; vbroadcastss 0x2aa8(%rip),%ymm0 # 6930 <_sk_callback_avx+0x3d0>
+ DB 196,226,125,24,5,40,43,0,0 ; vbroadcastss 0x2b28(%rip),%ymm0 # 6990 <_sk_callback_avx+0x3da>
DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,155,42,0,0 ; vbroadcastss 0x2a9b(%rip),%ymm1 # 6934 <_sk_callback_avx+0x3d4>
+ DB 196,226,125,24,13,27,43,0,0 ; vbroadcastss 0x2b1b(%rip),%ymm1 # 6994 <_sk_callback_avx+0x3de>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,146,42,0,0 ; vbroadcastss 0x2a92(%rip),%ymm1 # 6938 <_sk_callback_avx+0x3d8>
+ DB 196,226,125,24,13,18,43,0,0 ; vbroadcastss 0x2b12(%rip),%ymm1 # 6998 <_sk_callback_avx+0x3e2>
DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,133,42,0,0 ; vbroadcastss 0x2a85(%rip),%ymm2 # 693c <_sk_callback_avx+0x3dc>
+ DB 196,226,125,24,21,5,43,0,0 ; vbroadcastss 0x2b05(%rip),%ymm2 # 699c <_sk_callback_avx+0x3e6>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,124,42,0,0 ; vbroadcastss 0x2a7c(%rip),%ymm2 # 6940 <_sk_callback_avx+0x3e0>
+ DB 196,226,125,24,21,252,42,0,0 ; vbroadcastss 0x2afc(%rip),%ymm2 # 69a0 <_sk_callback_avx+0x3ea>
DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,111,42,0,0 ; vbroadcastss 0x2a6f(%rip),%ymm8 # 6944 <_sk_callback_avx+0x3e4>
+ DB 196,98,125,24,5,239,42,0,0 ; vbroadcastss 0x2aef(%rip),%ymm8 # 69a4 <_sk_callback_avx+0x3ee>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,101,42,0,0 ; vbroadcastss 0x2a65(%rip),%ymm8 # 6948 <_sk_callback_avx+0x3e8>
+ DB 196,98,125,24,5,229,42,0,0 ; vbroadcastss 0x2ae5(%rip),%ymm8 # 69a8 <_sk_callback_avx+0x3f2>
DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,87,42,0,0 ; vbroadcastss 0x2a57(%rip),%ymm8 # 694c <_sk_callback_avx+0x3ec>
+ DB 196,98,125,24,5,215,42,0,0 ; vbroadcastss 0x2ad7(%rip),%ymm8 # 69ac <_sk_callback_avx+0x3f6>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 15,135,86,255,255,255 ; ja 3e6c <_sk_load_4444_avx+0x14>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,75,0,0,0 ; lea 0x4b(%rip),%r9 # 3f6c <_sk_load_4444_avx+0x114>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 15,135,86,255,255,255 ; ja 3e4c <_sk_load_4444_avx+0x14>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 3f4c <_sk_load_4444_avx+0x114>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
- DB 196,193,121,196,68,122,12,6 ; vpinsrw $0x6,0xc(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,10,5 ; vpinsrw $0x5,0xa(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,8,4 ; vpinsrw $0x4,0x8(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,6,3 ; vpinsrw $0x3,0x6(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,4,2 ; vpinsrw $0x2,0x4(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,68,122,2,1 ; vpinsrw $0x1,0x2(%r10,%rdi,2),%xmm0,%xmm0
- DB 196,193,121,196,4,122,0 ; vpinsrw $0x0,(%r10,%rdi,2),%xmm0,%xmm0
- DB 233,2,255,255,255 ; jmpq 3e6c <_sk_load_4444_avx+0x14>
+ DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,6,3 ; vpinsrw $0x3,0x6(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0
+ DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0
+ DB 233,2,255,255,255 ; jmpq 3e4c <_sk_load_4444_avx+0x14>
DB 102,144 ; xchg %ax,%ax
DB 242,255 ; repnz (bad)
DB 255 ; (bad)
@@ -8910,10 +8888,11 @@ _sk_gather_4444_avx LABEL PROC
DB 85 ; push %rbp
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -8924,61 +8903,62 @@ _sk_gather_4444_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 65,15,183,28,88 ; movzwl (%r8,%rbx,2),%ebx
- DB 67,15,183,44,112 ; movzwl (%r8,%r14,2),%ebp
+ DB 65,15,183,28,89 ; movzwl (%r9,%rbx,2),%ebx
+ DB 67,15,183,44,121 ; movzwl (%r9,%r15,2),%ebp
DB 197,249,110,197 ; vmovd %ebp,%xmm0
DB 197,249,196,195,1 ; vpinsrw $0x1,%ebx,%xmm0,%xmm0
- DB 67,15,183,28,96 ; movzwl (%r8,%r12,2),%ebx
+ DB 67,15,183,28,105 ; movzwl (%r9,%r13,2),%ebx
DB 197,249,196,195,2 ; vpinsrw $0x2,%ebx,%xmm0,%xmm0
- DB 67,15,183,28,120 ; movzwl (%r8,%r15,2),%ebx
+ DB 67,15,183,28,97 ; movzwl (%r9,%r12,2),%ebx
DB 197,249,196,195,3 ; vpinsrw $0x3,%ebx,%xmm0,%xmm0
- DB 67,15,183,44,88 ; movzwl (%r8,%r11,2),%ebp
- DB 197,249,196,197,4 ; vpinsrw $0x4,%ebp,%xmm0,%xmm0
- DB 67,15,183,44,80 ; movzwl (%r8,%r10,2),%ebp
+ DB 67,15,183,28,113 ; movzwl (%r9,%r14,2),%ebx
+ DB 197,249,196,195,4 ; vpinsrw $0x4,%ebx,%xmm0,%xmm0
+ DB 67,15,183,44,89 ; movzwl (%r9,%r11,2),%ebp
DB 197,249,196,197,5 ; vpinsrw $0x5,%ebp,%xmm0,%xmm0
- DB 67,15,183,44,72 ; movzwl (%r8,%r9,2),%ebp
+ DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp
DB 197,249,196,197,6 ; vpinsrw $0x6,%ebp,%xmm0,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- DB 196,226,125,24,5,238,40,0,0 ; vbroadcastss 0x28ee(%rip),%ymm0 # 6950 <_sk_callback_avx+0x3f0>
+ DB 196,226,125,24,5,108,41,0,0 ; vbroadcastss 0x296c(%rip),%ymm0 # 69b0 <_sk_callback_avx+0x3fa>
DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,225,40,0,0 ; vbroadcastss 0x28e1(%rip),%ymm1 # 6954 <_sk_callback_avx+0x3f4>
+ DB 196,226,125,24,13,95,41,0,0 ; vbroadcastss 0x295f(%rip),%ymm1 # 69b4 <_sk_callback_avx+0x3fe>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,216,40,0,0 ; vbroadcastss 0x28d8(%rip),%ymm1 # 6958 <_sk_callback_avx+0x3f8>
+ DB 196,226,125,24,13,86,41,0,0 ; vbroadcastss 0x2956(%rip),%ymm1 # 69b8 <_sk_callback_avx+0x402>
DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,203,40,0,0 ; vbroadcastss 0x28cb(%rip),%ymm2 # 695c <_sk_callback_avx+0x3fc>
+ DB 196,226,125,24,21,73,41,0,0 ; vbroadcastss 0x2949(%rip),%ymm2 # 69bc <_sk_callback_avx+0x406>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,194,40,0,0 ; vbroadcastss 0x28c2(%rip),%ymm2 # 6960 <_sk_callback_avx+0x400>
+ DB 196,226,125,24,21,64,41,0,0 ; vbroadcastss 0x2940(%rip),%ymm2 # 69c0 <_sk_callback_avx+0x40a>
DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,181,40,0,0 ; vbroadcastss 0x28b5(%rip),%ymm8 # 6964 <_sk_callback_avx+0x404>
+ DB 196,98,125,24,5,51,41,0,0 ; vbroadcastss 0x2933(%rip),%ymm8 # 69c4 <_sk_callback_avx+0x40e>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,171,40,0,0 ; vbroadcastss 0x28ab(%rip),%ymm8 # 6968 <_sk_callback_avx+0x408>
+ DB 196,98,125,24,5,41,41,0,0 ; vbroadcastss 0x2929(%rip),%ymm8 # 69c8 <_sk_callback_avx+0x412>
DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,157,40,0,0 ; vbroadcastss 0x289d(%rip),%ymm8 # 696c <_sk_callback_avx+0x40c>
+ DB 196,98,125,24,5,27,41,0,0 ; vbroadcastss 0x291b(%rip),%ymm8 # 69cc <_sk_callback_avx+0x416>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 93 ; pop %rbp
@@ -8987,8 +8967,8 @@ _sk_gather_4444_avx LABEL PROC
PUBLIC _sk_store_4444_avx
_sk_store_4444_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,16 ; mov (%rax),%r10
- DB 196,98,125,24,5,130,40,0,0 ; vbroadcastss 0x2882(%rip),%ymm8 # 6970 <_sk_callback_avx+0x410>
+ DB 76,139,24 ; mov (%rax),%r11
+ DB 196,98,125,24,5,254,40,0,0 ; vbroadcastss 0x28fe(%rip),%ymm8 # 69d0 <_sk_callback_avx+0x41a>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,41,114,241,12 ; vpslld $0xc,%xmm9,%xmm10
@@ -9014,29 +8994,29 @@ _sk_store_4444_avx LABEL PROC
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 4187 <_sk_store_4444_avx+0xa7>
- DB 196,65,122,127,4,122 ; vmovdqu %xmm8,(%r10,%rdi,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,7 ; and $0x7,%r8b
- DB 65,254,200 ; dec %r8b
- DB 65,128,248,6 ; cmp $0x6,%r8b
- DB 119,236 ; ja 4183 <_sk_store_4444_avx+0xa3>
- DB 69,15,182,192 ; movzbl %r8b,%r8d
- DB 76,141,13,66,0,0,0 ; lea 0x42(%rip),%r9 # 41e4 <_sk_store_4444_avx+0x104>
- DB 75,99,4,129 ; movslq (%r9,%r8,4),%rax
- DB 76,1,200 ; add %r9,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,67,121,21,68,122,12,6 ; vpextrw $0x6,%xmm8,0xc(%r10,%rdi,2)
- DB 196,67,121,21,68,122,10,5 ; vpextrw $0x5,%xmm8,0xa(%r10,%rdi,2)
- DB 196,67,121,21,68,122,8,4 ; vpextrw $0x4,%xmm8,0x8(%r10,%rdi,2)
- DB 196,67,121,21,68,122,6,3 ; vpextrw $0x3,%xmm8,0x6(%r10,%rdi,2)
- DB 196,67,121,21,68,122,4,2 ; vpextrw $0x2,%xmm8,0x4(%r10,%rdi,2)
- DB 196,67,121,21,68,122,2,1 ; vpextrw $0x1,%xmm8,0x2(%r10,%rdi,2)
- DB 196,67,121,21,4,122,0 ; vpextrw $0x0,%xmm8,(%r10,%rdi,2)
- DB 235,159 ; jmp 4183 <_sk_store_4444_avx+0xa3>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 416b <_sk_store_4444_avx+0xa7>
+ DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,7 ; and $0x7,%r9b
+ DB 65,254,201 ; dec %r9b
+ DB 65,128,249,6 ; cmp $0x6,%r9b
+ DB 119,236 ; ja 4167 <_sk_store_4444_avx+0xa3>
+ DB 69,15,182,201 ; movzbl %r9b,%r9d
+ DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 41c8 <_sk_store_4444_avx+0x104>
+ DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
+ DB 76,1,208 ; add %r10,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,6,3 ; vpextrw $0x3,%xmm8,0x6(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
+ DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2)
+ DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
+ DB 235,159 ; jmp 4167 <_sk_store_4444_avx+0xa3>
DB 247,255 ; idiv %edi
DB 255 ; (bad)
DB 255 ; (bad)
@@ -9063,17 +9043,17 @@ _sk_store_4444_avx LABEL PROC
PUBLIC _sk_load_8888_avx
_sk_load_8888_avx LABEL PROC
DB 80 ; push %rax
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,139,0,0,0 ; jne 42a5 <_sk_load_8888_avx+0xa5>
- DB 196,193,124,16,25 ; vmovups (%r9),%ymm3
- DB 197,124,40,21,153,41,0,0 ; vmovaps 0x2999(%rip),%ymm10 # 6bc0 <_sk_callback_avx+0x660>
+ DB 15,133,139,0,0,0 ; jne 4289 <_sk_load_8888_avx+0xa5>
+ DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
+ DB 197,124,40,21,21,42,0,0 ; vmovaps 0x2a15(%rip),%ymm10 # 6c20 <_sk_callback_avx+0x66a>
DB 196,193,100,84,194 ; vandps %ymm10,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,59,39,0,0 ; vbroadcastss 0x273b(%rip),%ymm8 # 6974 <_sk_callback_avx+0x414>
+ DB 196,98,125,24,5,183,39,0,0 ; vbroadcastss 0x27b7(%rip),%ymm8 # 69d4 <_sk_callback_avx+0x41e>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,241,114,211,8 ; vpsrld $0x8,%xmm3,%xmm1
DB 196,195,125,25,217,1 ; vextractf128 $0x1,%ymm3,%xmm9
@@ -9094,8 +9074,8 @@ _sk_load_8888_avx LABEL PROC
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
- DB 65,88 ; pop %r8
+ DB 76,137,201 ; mov %r9,%rcx
+ DB 65,89 ; pop %r9
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
@@ -9104,22 +9084,23 @@ _sk_load_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0
- DB 196,226,121,0,13,67,40,0,0 ; vpshufb 0x2843(%rip),%xmm0,%xmm1 # 6b10 <_sk_callback_avx+0x5b0>
+ DB 196,226,121,0,13,191,40,0,0 ; vpshufb 0x28bf(%rip),%xmm0,%xmm1 # 6b70 <_sk_callback_avx+0x5ba>
DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1
- DB 196,226,121,0,5,69,40,0,0 ; vpshufb 0x2845(%rip),%xmm0,%xmm0 # 6b20 <_sk_callback_avx+0x5c0>
+ DB 196,226,121,0,5,193,40,0,0 ; vpshufb 0x28c1(%rip),%xmm0,%xmm0 # 6b80 <_sk_callback_avx+0x5ca>
DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
- DB 196,194,125,44,25 ; vmaskmovps (%r9),%ymm0,%ymm3
- DB 233,47,255,255,255 ; jmpq 421f <_sk_load_8888_avx+0x1f>
+ DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
+ DB 233,47,255,255,255 ; jmpq 4203 <_sk_load_8888_avx+0x1f>
PUBLIC _sk_gather_8888_avx
_sk_gather_8888_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
@@ -9130,31 +9111,31 @@ _sk_gather_8888_avx LABEL PROC
DB 196,227,125,25,194,1 ; vextractf128 $0x1,%ymm0,%xmm2
DB 197,241,254,202 ; vpaddd %xmm2,%xmm1,%xmm1
DB 196,225,249,126,200 ; vmovq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,195,249,22,202,1 ; vpextrq $0x1,%xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,225,254,192 ; vpaddd %xmm0,%xmm3,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,129,121,110,4,176 ; vmovd (%r8,%r14,4),%xmm0
- DB 196,195,121,34,4,152,1 ; vpinsrd $0x1,(%r8,%rbx,4),%xmm0,%xmm0
- DB 196,131,121,34,4,160,2 ; vpinsrd $0x2,(%r8,%r12,4),%xmm0,%xmm0
- DB 196,3,121,34,4,184,3 ; vpinsrd $0x3,(%r8,%r15,4),%xmm0,%xmm8
- DB 196,129,121,110,4,136 ; vmovd (%r8,%r9,4),%xmm0
- DB 196,195,121,34,4,128,1 ; vpinsrd $0x1,(%r8,%rax,4),%xmm0,%xmm0
- DB 196,131,121,34,4,152,2 ; vpinsrd $0x2,(%r8,%r11,4),%xmm0,%xmm0
- DB 196,131,121,34,28,144,3 ; vpinsrd $0x3,(%r8,%r10,4),%xmm0,%xmm3
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,129,121,110,4,185 ; vmovd (%r9,%r15,4),%xmm0
+ DB 196,195,121,34,4,153,1 ; vpinsrd $0x1,(%r9,%rbx,4),%xmm0,%xmm0
+ DB 196,131,121,34,4,169,2 ; vpinsrd $0x2,(%r9,%r13,4),%xmm0,%xmm0
+ DB 196,3,121,34,4,161,3 ; vpinsrd $0x3,(%r9,%r12,4),%xmm0,%xmm8
+ DB 196,129,121,110,4,145 ; vmovd (%r9,%r10,4),%xmm0
+ DB 196,195,121,34,4,129,1 ; vpinsrd $0x1,(%r9,%rax,4),%xmm0,%xmm0
+ DB 196,131,121,34,4,177,2 ; vpinsrd $0x2,(%r9,%r14,4),%xmm0,%xmm0
+ DB 196,131,121,34,28,153,3 ; vpinsrd $0x3,(%r9,%r11,4),%xmm0,%xmm3
DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- DB 197,124,40,21,62,40,0,0 ; vmovaps 0x283e(%rip),%ymm10 # 6be0 <_sk_callback_avx+0x680>
+ DB 197,124,40,21,184,40,0,0 ; vmovaps 0x28b8(%rip),%ymm10 # 6c40 <_sk_callback_avx+0x68a>
DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,196,37,0,0 ; vbroadcastss 0x25c4(%rip),%ymm9 # 6978 <_sk_callback_avx+0x418>
+ DB 196,98,125,24,13,62,38,0,0 ; vbroadcastss 0x263e(%rip),%ymm9 # 69d8 <_sk_callback_avx+0x422>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1
DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2
@@ -9176,6 +9157,7 @@ _sk_gather_8888_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -9183,11 +9165,11 @@ _sk_gather_8888_avx LABEL PROC
PUBLIC _sk_store_8888_avx
_sk_store_8888_avx LABEL PROC
DB 80 ; push %rax
- DB 73,137,200 ; mov %rcx,%r8
+ DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,3,8 ; add (%rax),%r9
- DB 196,98,125,24,5,70,37,0,0 ; vbroadcastss 0x2546(%rip),%ymm8 # 697c <_sk_callback_avx+0x41c>
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,3,16 ; add (%rax),%r10
+ DB 196,98,125,24,5,190,37,0,0 ; vbroadcastss 0x25be(%rip),%ymm8 # 69dc <_sk_callback_avx+0x426>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -9212,11 +9194,11 @@ _sk_store_8888_avx LABEL PROC
DB 196,65,45,86,192 ; vorpd %ymm8,%ymm10,%ymm8
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,14 ; jne 44c8 <_sk_store_8888_avx+0xac>
- DB 196,65,124,17,1 ; vmovups %ymm8,(%r9)
+ DB 117,14 ; jne 44b0 <_sk_store_8888_avx+0xac>
+ DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,193 ; mov %r8,%rcx
- DB 65,88 ; pop %r8
+ DB 76,137,201 ; mov %r9,%rcx
+ DB 65,89 ; pop %r9
DB 255,224 ; jmpq *%rax
DB 185,8,0,0,0 ; mov $0x8,%ecx
DB 68,41,193 ; sub %r8d,%ecx
@@ -9225,29 +9207,29 @@ _sk_store_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,64,38,0,0 ; vpshufb 0x2640(%rip),%xmm9,%xmm10 # 6b30 <_sk_callback_avx+0x5d0>
+ DB 196,98,49,0,21,184,38,0,0 ; vpshufb 0x26b8(%rip),%xmm9,%xmm10 # 6b90 <_sk_callback_avx+0x5da>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,66,38,0,0 ; vpshufb 0x2642(%rip),%xmm9,%xmm9 # 6b40 <_sk_callback_avx+0x5e0>
+ DB 196,98,49,0,13,186,38,0,0 ; vpshufb 0x26ba(%rip),%xmm9,%xmm9 # 6ba0 <_sk_callback_avx+0x5ea>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- DB 196,66,53,46,1 ; vmaskmovps %ymm8,%ymm9,(%r9)
- DB 235,175 ; jmp 44bf <_sk_store_8888_avx+0xa3>
+ DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
+ DB 235,175 ; jmp 44a7 <_sk_store_8888_avx+0xa3>
PUBLIC _sk_load_f16_avx
_sk_load_f16_avx LABEL PROC
DB 72,129,236,152,0,0,0 ; sub $0x98,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
+ DB 77,133,192 ; test %r8,%r8
DB 197,252,17,124,36,96 ; vmovups %ymm7,0x60(%rsp)
DB 197,252,17,116,36,64 ; vmovups %ymm6,0x40(%rsp)
DB 197,252,17,108,36,32 ; vmovups %ymm5,0x20(%rsp)
DB 197,254,127,36,36 ; vmovdqu %ymm4,(%rsp)
- DB 15,133,143,2,0,0 ; jne 47cb <_sk_load_f16_avx+0x2bb>
- DB 197,121,16,4,248 ; vmovupd (%rax,%rdi,8),%xmm8
- DB 197,249,16,84,248,16 ; vmovupd 0x10(%rax,%rdi,8),%xmm2
- DB 197,249,16,76,248,32 ; vmovupd 0x20(%rax,%rdi,8),%xmm1
- DB 197,122,111,76,248,48 ; vmovdqu 0x30(%rax,%rdi,8),%xmm9
+ DB 15,133,143,2,0,0 ; jne 47b3 <_sk_load_f16_avx+0x2bb>
+ DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
+ DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2
+ DB 197,249,16,76,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm1
+ DB 197,122,111,76,208,48 ; vmovdqu 0x30(%rax,%rdx,8),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,113,97,217 ; vpunpcklwd %xmm9,%xmm1,%xmm3
@@ -9261,13 +9243,13 @@ _sk_load_f16_avx LABEL PROC
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- DB 196,98,125,24,37,235,35,0,0 ; vbroadcastss 0x23eb(%rip),%ymm12 # 6980 <_sk_callback_avx+0x420>
+ DB 196,98,125,24,37,99,36,0,0 ; vbroadcastss 0x2463(%rip),%ymm12 # 69e0 <_sk_callback_avx+0x42a>
DB 196,193,124,84,204 ; vandps %ymm12,%ymm0,%ymm1
DB 197,252,87,193 ; vxorps %ymm1,%ymm0,%ymm0
DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14
- DB 196,98,121,24,29,215,35,0,0 ; vbroadcastss 0x23d7(%rip),%xmm11 # 6984 <_sk_callback_avx+0x424>
+ DB 196,98,121,24,29,79,36,0,0 ; vbroadcastss 0x244f(%rip),%xmm11 # 69e4 <_sk_callback_avx+0x42e>
DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3
- DB 196,98,121,24,45,205,35,0,0 ; vbroadcastss 0x23cd(%rip),%xmm13 # 6988 <_sk_callback_avx+0x428>
+ DB 196,98,121,24,45,69,36,0,0 ; vbroadcastss 0x2445(%rip),%xmm13 # 69e8 <_sk_callback_avx+0x432>
DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3
DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10
DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -9281,7 +9263,7 @@ _sk_load_f16_avx LABEL PROC
DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
DB 197,252,86,193 ; vorps %ymm1,%ymm0,%ymm0
DB 196,227,125,25,193,1 ; vextractf128 $0x1,%ymm0,%xmm1
- DB 196,226,121,24,29,131,35,0,0 ; vbroadcastss 0x2383(%rip),%xmm3 # 698c <_sk_callback_avx+0x42c>
+ DB 196,226,121,24,29,251,35,0,0 ; vbroadcastss 0x23fb(%rip),%xmm3 # 69ec <_sk_callback_avx+0x436>
DB 197,241,254,203 ; vpaddd %xmm3,%xmm1,%xmm1
DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -9371,46 +9353,47 @@ _sk_load_f16_avx LABEL PROC
DB 197,252,16,124,36,96 ; vmovups 0x60(%rsp),%ymm7
DB 72,129,196,152,0,0,0 ; add $0x98,%rsp
DB 255,224 ; jmpq *%rax
- DB 197,123,16,4,248 ; vmovsd (%rax,%rdi,8),%xmm8
+ DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,79 ; je 482a <_sk_load_f16_avx+0x31a>
- DB 197,57,22,68,248,8 ; vmovhpd 0x8(%rax,%rdi,8),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,67 ; jb 482a <_sk_load_f16_avx+0x31a>
- DB 197,251,16,84,248,16 ; vmovsd 0x10(%rax,%rdi,8),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,68 ; je 4837 <_sk_load_f16_avx+0x327>
- DB 197,233,22,84,248,24 ; vmovhpd 0x18(%rax,%rdi,8),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,56 ; jb 4837 <_sk_load_f16_avx+0x327>
- DB 197,251,16,76,248,32 ; vmovsd 0x20(%rax,%rdi,8),%xmm1
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,68,253,255,255 ; je 4553 <_sk_load_f16_avx+0x43>
- DB 197,241,22,76,248,40 ; vmovhpd 0x28(%rax,%rdi,8),%xmm1,%xmm1
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,52,253,255,255 ; jb 4553 <_sk_load_f16_avx+0x43>
- DB 197,122,126,76,248,48 ; vmovq 0x30(%rax,%rdi,8),%xmm9
- DB 233,41,253,255,255 ; jmpq 4553 <_sk_load_f16_avx+0x43>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,79 ; je 4812 <_sk_load_f16_avx+0x31a>
+ DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,67 ; jb 4812 <_sk_load_f16_avx+0x31a>
+ DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,68 ; je 481f <_sk_load_f16_avx+0x327>
+ DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,56 ; jb 481f <_sk_load_f16_avx+0x327>
+ DB 197,251,16,76,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm1
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,68,253,255,255 ; je 453b <_sk_load_f16_avx+0x43>
+ DB 197,241,22,76,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,52,253,255,255 ; jb 453b <_sk_load_f16_avx+0x43>
+ DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
+ DB 233,41,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43>
DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,28,253,255,255 ; jmpq 4553 <_sk_load_f16_avx+0x43>
+ DB 233,28,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43>
DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1
- DB 233,19,253,255,255 ; jmpq 4553 <_sk_load_f16_avx+0x43>
+ DB 233,19,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43>
PUBLIC _sk_gather_f16_avx
_sk_gather_f16_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 72,129,236,152,0,0,0 ; sub $0x98,%rsp
+ DB 72,129,236,144,0,0,0 ; sub $0x90,%rsp
DB 197,252,17,124,36,96 ; vmovups %ymm7,0x60(%rsp)
DB 197,252,17,116,36,64 ; vmovups %ymm6,0x40(%rsp)
DB 197,252,17,108,36,32 ; vmovups %ymm5,0x20(%rsp)
DB 197,254,127,36,36 ; vmovdqu %ymm4,(%rsp)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
@@ -9421,29 +9404,29 @@ _sk_gather_f16_avx LABEL PROC
DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,193,249,126,210 ; vmovq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,193,249,126,211 ; vmovq %xmm2,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
DB 196,225,249,126,195 ; vmovq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15
- DB 69,137,252 ; mov %r15d,%r12d
- DB 73,193,239,32 ; shr $0x20,%r15
+ DB 65,137,223 ; mov %ebx,%r15d
+ DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12
+ DB 69,137,229 ; mov %r12d,%r13d
+ DB 73,193,236,32 ; shr $0x20,%r12
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,193,122,126,4,216 ; vmovq (%r8,%rbx,8),%xmm0
- DB 196,129,122,126,12,240 ; vmovq (%r8,%r14,8),%xmm1
+ DB 196,193,122,126,4,217 ; vmovq (%r9,%rbx,8),%xmm0
+ DB 196,129,122,126,12,249 ; vmovq (%r9,%r15,8),%xmm1
DB 197,113,108,200 ; vpunpcklqdq %xmm0,%xmm1,%xmm9
- DB 196,129,122,126,12,248 ; vmovq (%r8,%r15,8),%xmm1
- DB 196,129,122,126,20,224 ; vmovq (%r8,%r12,8),%xmm2
+ DB 196,129,122,126,12,225 ; vmovq (%r9,%r12,8),%xmm1
+ DB 196,129,122,126,20,233 ; vmovq (%r9,%r13,8),%xmm2
DB 197,233,108,201 ; vpunpcklqdq %xmm1,%xmm2,%xmm1
- DB 196,129,122,126,20,208 ; vmovq (%r8,%r10,8),%xmm2
- DB 196,129,122,126,28,216 ; vmovq (%r8,%r11,8),%xmm3
+ DB 196,129,122,126,20,217 ; vmovq (%r9,%r11,8),%xmm2
+ DB 196,129,122,126,28,241 ; vmovq (%r9,%r14,8),%xmm3
DB 197,97,108,210 ; vpunpcklqdq %xmm2,%xmm3,%xmm10
- DB 196,65,122,126,4,192 ; vmovq (%r8,%rax,8),%xmm8
- DB 196,129,122,126,28,200 ; vmovq (%r8,%r9,8),%xmm3
+ DB 196,65,122,126,4,193 ; vmovq (%r9,%rax,8),%xmm8
+ DB 196,129,122,126,28,209 ; vmovq (%r9,%r10,8),%xmm3
DB 196,193,97,108,216 ; vpunpcklqdq %xmm8,%xmm3,%xmm3
DB 197,177,97,193 ; vpunpcklwd %xmm1,%xmm9,%xmm0
DB 197,177,105,201 ; vpunpckhwd %xmm1,%xmm9,%xmm1
@@ -9458,13 +9441,13 @@ _sk_gather_f16_avx LABEL PROC
DB 197,249,105,210 ; vpunpckhwd %xmm2,%xmm0,%xmm2
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,194,1 ; vinsertf128 $0x1,%xmm2,%ymm0,%ymm0
- DB 196,98,125,24,37,67,32,0,0 ; vbroadcastss 0x2043(%rip),%ymm12 # 6990 <_sk_callback_avx+0x430>
+ DB 196,98,125,24,37,185,32,0,0 ; vbroadcastss 0x20b9(%rip),%ymm12 # 69f0 <_sk_callback_avx+0x43a>
DB 196,193,124,84,212 ; vandps %ymm12,%ymm0,%ymm2
DB 197,252,87,194 ; vxorps %ymm2,%ymm0,%ymm0
DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14
- DB 196,98,121,24,29,47,32,0,0 ; vbroadcastss 0x202f(%rip),%xmm11 # 6994 <_sk_callback_avx+0x434>
+ DB 196,98,121,24,29,165,32,0,0 ; vbroadcastss 0x20a5(%rip),%xmm11 # 69f4 <_sk_callback_avx+0x43e>
DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3
- DB 196,98,121,24,45,37,32,0,0 ; vbroadcastss 0x2025(%rip),%xmm13 # 6998 <_sk_callback_avx+0x438>
+ DB 196,98,121,24,45,155,32,0,0 ; vbroadcastss 0x209b(%rip),%xmm13 # 69f8 <_sk_callback_avx+0x442>
DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3
DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10
DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -9478,7 +9461,7 @@ _sk_gather_f16_avx LABEL PROC
DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
DB 197,252,86,194 ; vorps %ymm2,%ymm0,%ymm0
DB 196,227,125,25,194,1 ; vextractf128 $0x1,%ymm0,%xmm2
- DB 196,226,121,24,29,219,31,0,0 ; vbroadcastss 0x1fdb(%rip),%xmm3 # 699c <_sk_callback_avx+0x43c>
+ DB 196,226,121,24,29,81,32,0,0 ; vbroadcastss 0x2051(%rip),%xmm3 # 69fc <_sk_callback_avx+0x446>
DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0
DB 196,227,125,24,194,1 ; vinsertf128 $0x1,%xmm2,%ymm0,%ymm0
@@ -9566,9 +9549,10 @@ _sk_gather_f16_avx LABEL PROC
DB 197,252,16,108,36,32 ; vmovups 0x20(%rsp),%ymm5
DB 197,252,16,116,36,64 ; vmovups 0x40(%rsp),%ymm6
DB 197,252,16,124,36,96 ; vmovups 0x60(%rsp),%ymm7
- DB 72,129,196,152,0,0,0 ; add $0x98,%rsp
+ DB 72,129,196,144,0,0,0 ; add $0x90,%rsp
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
+ DB 65,93 ; pop %r13
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -9580,12 +9564,12 @@ _sk_store_f16_avx LABEL PROC
DB 197,252,17,180,36,128,0,0,0 ; vmovups %ymm6,0x80(%rsp)
DB 197,252,17,108,36,96 ; vmovups %ymm5,0x60(%rsp)
DB 197,252,17,100,36,64 ; vmovups %ymm4,0x40(%rsp)
- DB 196,98,125,24,13,232,29,0,0 ; vbroadcastss 0x1de8(%rip),%ymm9 # 69a0 <_sk_callback_avx+0x440>
+ DB 196,98,125,24,13,92,30,0,0 ; vbroadcastss 0x1e5c(%rip),%ymm9 # 6a00 <_sk_callback_avx+0x44a>
DB 196,65,124,84,209 ; vandps %ymm9,%ymm0,%ymm10
DB 197,252,17,4,36 ; vmovups %ymm0,(%rsp)
DB 196,65,124,87,218 ; vxorps %ymm10,%ymm0,%ymm11
DB 196,67,125,25,220,1 ; vextractf128 $0x1,%ymm11,%xmm12
- DB 196,98,121,24,5,206,29,0,0 ; vbroadcastss 0x1dce(%rip),%xmm8 # 69a4 <_sk_callback_avx+0x444>
+ DB 196,98,121,24,5,66,30,0,0 ; vbroadcastss 0x1e42(%rip),%xmm8 # 6a04 <_sk_callback_avx+0x44e>
DB 196,65,57,102,236 ; vpcmpgtd %xmm12,%xmm8,%xmm13
DB 196,65,57,102,243 ; vpcmpgtd %xmm11,%xmm8,%xmm14
DB 196,67,13,24,237,1 ; vinsertf128 $0x1,%xmm13,%ymm14,%ymm13
@@ -9595,7 +9579,7 @@ _sk_store_f16_avx LABEL PROC
DB 196,67,13,24,242,1 ; vinsertf128 $0x1,%xmm10,%ymm14,%ymm14
DB 196,193,33,114,211,13 ; vpsrld $0xd,%xmm11,%xmm11
DB 196,193,25,114,212,13 ; vpsrld $0xd,%xmm12,%xmm12
- DB 196,98,125,24,21,149,29,0,0 ; vbroadcastss 0x1d95(%rip),%ymm10 # 69a8 <_sk_callback_avx+0x448>
+ DB 196,98,125,24,21,9,30,0,0 ; vbroadcastss 0x1e09(%rip),%ymm10 # 6a08 <_sk_callback_avx+0x452>
DB 196,65,12,86,242 ; vorps %ymm10,%ymm14,%ymm14
DB 196,67,125,25,247,1 ; vextractf128 $0x1,%ymm14,%xmm15
DB 196,65,1,254,228 ; vpaddd %xmm12,%xmm15,%xmm12
@@ -9676,12 +9660,12 @@ _sk_store_f16_avx LABEL PROC
DB 197,121,106,193 ; vpunpckhdq %xmm1,%xmm0,%xmm8
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,75 ; jne 4dfa <_sk_store_f16_avx+0x270>
- DB 197,120,17,28,248 ; vmovups %xmm11,(%rax,%rdi,8)
- DB 197,120,17,84,248,16 ; vmovups %xmm10,0x10(%rax,%rdi,8)
- DB 197,120,17,76,248,32 ; vmovups %xmm9,0x20(%rax,%rdi,8)
- DB 197,122,127,68,248,48 ; vmovdqu %xmm8,0x30(%rax,%rdi,8)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,75 ; jne 4de6 <_sk_store_f16_avx+0x270>
+ DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8)
+ DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8)
+ DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8)
+ DB 197,122,127,68,208,48 ; vmovdqu %xmm8,0x30(%rax,%rdx,8)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,16,4,36 ; vmovups (%rsp),%ymm0
DB 197,252,16,76,36,32 ; vmovups 0x20(%rsp),%ymm1
@@ -9691,36 +9675,36 @@ _sk_store_f16_avx LABEL PROC
DB 197,252,16,188,36,160,0,0,0 ; vmovups 0xa0(%rsp),%ymm7
DB 72,129,196,216,0,0,0 ; add $0xd8,%rsp
DB 255,224 ; jmpq *%rax
- DB 197,121,214,28,248 ; vmovq %xmm11,(%rax,%rdi,8)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,193 ; je 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,23,92,248,8 ; vmovhpd %xmm11,0x8(%rax,%rdi,8)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,181 ; jb 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,214,84,248,16 ; vmovq %xmm10,0x10(%rax,%rdi,8)
- DB 116,173 ; je 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,23,84,248,24 ; vmovhpd %xmm10,0x18(%rax,%rdi,8)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,161 ; jb 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,214,76,248,32 ; vmovq %xmm9,0x20(%rax,%rdi,8)
- DB 116,153 ; je 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,23,76,248,40 ; vmovhpd %xmm9,0x28(%rax,%rdi,8)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,141 ; jb 4dc6 <_sk_store_f16_avx+0x23c>
- DB 197,121,214,68,248,48 ; vmovq %xmm8,0x30(%rax,%rdi,8)
- DB 235,133 ; jmp 4dc6 <_sk_store_f16_avx+0x23c>
+ DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,193 ; je 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,181 ; jb 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8)
+ DB 116,173 ; je 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,161 ; jb 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8)
+ DB 116,153 ; je 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,141 ; jb 4db2 <_sk_store_f16_avx+0x23c>
+ DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8)
+ DB 235,133 ; jmp 4db2 <_sk_store_f16_avx+0x23c>
PUBLIC _sk_load_u16_be_avx
_sk_load_u16_be_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,253,0,0,0 ; jne 4f54 <_sk_load_u16_be_avx+0x113>
- DB 196,65,121,16,4,64 ; vmovupd (%r8,%rax,2),%xmm8
- DB 196,193,121,16,84,64,16 ; vmovupd 0x10(%r8,%rax,2),%xmm2
- DB 196,193,121,16,92,64,32 ; vmovupd 0x20(%r8,%rax,2),%xmm3
- DB 196,65,122,111,76,64,48 ; vmovdqu 0x30(%r8,%rax,2),%xmm9
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,253,0,0,0 ; jne 4f40 <_sk_load_u16_be_avx+0x113>
+ DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8
+ DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2
+ DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3
+ DB 196,65,122,111,76,65,48 ; vmovdqu 0x30(%r9,%rax,2),%xmm9
DB 197,185,97,194 ; vpunpcklwd %xmm2,%xmm8,%xmm0
DB 197,185,105,210 ; vpunpckhwd %xmm2,%xmm8,%xmm2
DB 196,193,97,97,201 ; vpunpcklwd %xmm9,%xmm3,%xmm1
@@ -9738,7 +9722,7 @@ _sk_load_u16_be_avx LABEL PROC
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,29,228,26,0,0 ; vbroadcastss 0x1ae4(%rip),%ymm11 # 69ac <_sk_callback_avx+0x44c>
+ DB 196,98,125,24,29,88,27,0,0 ; vbroadcastss 0x1b58(%rip),%ymm11 # 6a0c <_sk_callback_avx+0x456>
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,177,109,202 ; vpunpckhqdq %xmm2,%xmm9,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -9769,44 +9753,44 @@ _sk_load_u16_be_avx LABEL PROC
DB 196,193,100,89,219 ; vmulps %ymm11,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 196,65,123,16,4,64 ; vmovsd (%r8,%rax,2),%xmm8
+ DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,85 ; je 4fba <_sk_load_u16_be_avx+0x179>
- DB 196,65,57,22,68,64,8 ; vmovhpd 0x8(%r8,%rax,2),%xmm8,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,72 ; jb 4fba <_sk_load_u16_be_avx+0x179>
- DB 196,193,123,16,84,64,16 ; vmovsd 0x10(%r8,%rax,2),%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 116,72 ; je 4fc7 <_sk_load_u16_be_avx+0x186>
- DB 196,193,105,22,84,64,24 ; vmovhpd 0x18(%r8,%rax,2),%xmm2,%xmm2
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,59 ; jb 4fc7 <_sk_load_u16_be_avx+0x186>
- DB 196,193,123,16,92,64,32 ; vmovsd 0x20(%r8,%rax,2),%xmm3
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 15,132,213,254,255,255 ; je 4e72 <_sk_load_u16_be_avx+0x31>
- DB 196,193,97,22,92,64,40 ; vmovhpd 0x28(%r8,%rax,2),%xmm3,%xmm3
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 15,130,196,254,255,255 ; jb 4e72 <_sk_load_u16_be_avx+0x31>
- DB 196,65,122,126,76,64,48 ; vmovq 0x30(%r8,%rax,2),%xmm9
- DB 233,184,254,255,255 ; jmpq 4e72 <_sk_load_u16_be_avx+0x31>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,85 ; je 4fa6 <_sk_load_u16_be_avx+0x179>
+ DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,72 ; jb 4fa6 <_sk_load_u16_be_avx+0x179>
+ DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 116,72 ; je 4fb3 <_sk_load_u16_be_avx+0x186>
+ DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,59 ; jb 4fb3 <_sk_load_u16_be_avx+0x186>
+ DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 15,132,213,254,255,255 ; je 4e5e <_sk_load_u16_be_avx+0x31>
+ DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 15,130,196,254,255,255 ; jb 4e5e <_sk_load_u16_be_avx+0x31>
+ DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9
+ DB 233,184,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,171,254,255,255 ; jmpq 4e72 <_sk_load_u16_be_avx+0x31>
+ DB 233,171,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,162,254,255,255 ; jmpq 4e72 <_sk_load_u16_be_avx+0x31>
+ DB 233,162,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31>
PUBLIC _sk_load_rgb_u16_be_avx
_sk_load_rgb_u16_be_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,127 ; lea (%rdi,%rdi,2),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,243,0,0,0 ; jne 50d5 <_sk_load_rgb_u16_be_avx+0x105>
- DB 196,193,122,111,4,64 ; vmovdqu (%r8,%rax,2),%xmm0
- DB 196,193,122,111,84,64,12 ; vmovdqu 0xc(%r8,%rax,2),%xmm2
- DB 196,193,122,111,76,64,24 ; vmovdqu 0x18(%r8,%rax,2),%xmm1
- DB 196,193,122,111,92,64,32 ; vmovdqu 0x20(%r8,%rax,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,243,0,0,0 ; jne 50c1 <_sk_load_rgb_u16_be_avx+0x105>
+ DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0
+ DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2
+ DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1
+ DB 196,193,122,111,92,65,32 ; vmovdqu 0x20(%r9,%rax,2),%xmm3
DB 197,225,115,219,4 ; vpsrldq $0x4,%xmm3,%xmm3
DB 197,185,115,216,6 ; vpsrldq $0x6,%xmm0,%xmm8
DB 197,177,115,218,6 ; vpsrldq $0x6,%xmm2,%xmm9
@@ -9829,7 +9813,7 @@ _sk_load_rgb_u16_be_avx LABEL PROC
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,29,68,25,0,0 ; vbroadcastss 0x1944(%rip),%ymm11 # 69b0 <_sk_callback_avx+0x450>
+ DB 196,98,125,24,29,184,25,0,0 ; vbroadcastss 0x19b8(%rip),%ymm11 # 6a10 <_sk_callback_avx+0x45a>
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -9850,48 +9834,48 @@ _sk_load_rgb_u16_be_avx LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,225,24,0,0 ; vbroadcastss 0x18e1(%rip),%ymm3 # 69b4 <_sk_callback_avx+0x454>
- DB 255,224 ; jmpq *%rax
- DB 196,193,121,110,4,64 ; vmovd (%r8,%rax,2),%xmm0
- DB 196,193,121,196,68,64,4,2 ; vpinsrw $0x2,0x4(%r8,%rax,2),%xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,5 ; jne 50ee <_sk_load_rgb_u16_be_avx+0x11e>
- DB 233,40,255,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 196,193,121,110,76,64,6 ; vmovd 0x6(%r8,%rax,2),%xmm1
- DB 196,65,113,196,68,64,10,2 ; vpinsrw $0x2,0xa(%r8,%rax,2),%xmm1,%xmm8
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,26 ; jb 511d <_sk_load_rgb_u16_be_avx+0x14d>
- DB 196,193,121,110,76,64,12 ; vmovd 0xc(%r8,%rax,2),%xmm1
- DB 196,193,113,196,84,64,16,2 ; vpinsrw $0x2,0x10(%r8,%rax,2),%xmm1,%xmm2
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 117,10 ; jne 5122 <_sk_load_rgb_u16_be_avx+0x152>
- DB 233,249,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,244,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 196,193,121,110,76,64,18 ; vmovd 0x12(%r8,%rax,2),%xmm1
- DB 196,65,113,196,76,64,22,2 ; vpinsrw $0x2,0x16(%r8,%rax,2),%xmm1,%xmm9
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,26 ; jb 5151 <_sk_load_rgb_u16_be_avx+0x181>
- DB 196,193,121,110,76,64,24 ; vmovd 0x18(%r8,%rax,2),%xmm1
- DB 196,193,113,196,76,64,28,2 ; vpinsrw $0x2,0x1c(%r8,%rax,2),%xmm1,%xmm1
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 117,10 ; jne 5156 <_sk_load_rgb_u16_be_avx+0x186>
- DB 233,197,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,192,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 196,193,121,110,92,64,30 ; vmovd 0x1e(%r8,%rax,2),%xmm3
- DB 196,65,97,196,92,64,34,2 ; vpinsrw $0x2,0x22(%r8,%rax,2),%xmm3,%xmm11
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,20 ; jb 517f <_sk_load_rgb_u16_be_avx+0x1af>
- DB 196,193,121,110,92,64,36 ; vmovd 0x24(%r8,%rax,2),%xmm3
- DB 196,193,97,196,92,64,40,2 ; vpinsrw $0x2,0x28(%r8,%rax,2),%xmm3,%xmm3
- DB 233,151,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,146,254,255,255 ; jmpq 5016 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 196,226,125,24,29,85,25,0,0 ; vbroadcastss 0x1955(%rip),%ymm3 # 6a14 <_sk_callback_avx+0x45e>
+ DB 255,224 ; jmpq *%rax
+ DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0
+ DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,5 ; jne 50da <_sk_load_rgb_u16_be_avx+0x11e>
+ DB 233,40,255,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1
+ DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,26 ; jb 5109 <_sk_load_rgb_u16_be_avx+0x14d>
+ DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1
+ DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 117,10 ; jne 510e <_sk_load_rgb_u16_be_avx+0x152>
+ DB 233,249,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,244,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1
+ DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,26 ; jb 513d <_sk_load_rgb_u16_be_avx+0x181>
+ DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1
+ DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 117,10 ; jne 5142 <_sk_load_rgb_u16_be_avx+0x186>
+ DB 233,197,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,192,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3
+ DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,20 ; jb 516b <_sk_load_rgb_u16_be_avx+0x1af>
+ DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3
+ DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
+ DB 233,151,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,146,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46>
PUBLIC _sk_store_u16_be_avx
_sk_store_u16_be_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 196,98,125,24,5,30,24,0,0 ; vbroadcastss 0x181e(%rip),%ymm8 # 69b8 <_sk_callback_avx+0x458>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 196,98,125,24,5,146,24,0,0 ; vbroadcastss 0x1892(%rip),%ymm8 # 6a18 <_sk_callback_avx+0x462>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10
@@ -9928,55 +9912,55 @@ _sk_store_u16_be_avx LABEL PROC
DB 196,65,25,106,209 ; vpunpckhdq %xmm9,%xmm12,%xmm10
DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9
DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,31 ; jne 527e <_sk_store_u16_be_avx+0xfa>
- DB 196,65,120,17,28,64 ; vmovups %xmm11,(%r8,%rax,2)
- DB 196,65,120,17,84,64,16 ; vmovups %xmm10,0x10(%r8,%rax,2)
- DB 196,65,120,17,76,64,32 ; vmovups %xmm9,0x20(%r8,%rax,2)
- DB 196,65,122,127,68,64,48 ; vmovdqu %xmm8,0x30(%r8,%rax,2)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 196,65,121,214,28,64 ; vmovq %xmm11,(%r8,%rax,2)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,23,92,64,8 ; vmovhpd %xmm11,0x8(%r8,%rax,2)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,214,84,64,16 ; vmovq %xmm10,0x10(%r8,%rax,2)
- DB 116,218 ; je 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,23,84,64,24 ; vmovhpd %xmm10,0x18(%r8,%rax,2)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,205 ; jb 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,214,76,64,32 ; vmovq %xmm9,0x20(%r8,%rax,2)
- DB 116,196 ; je 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,23,76,64,40 ; vmovhpd %xmm9,0x28(%r8,%rax,2)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,183 ; jb 527a <_sk_store_u16_be_avx+0xf6>
- DB 196,65,121,214,68,64,48 ; vmovq %xmm8,0x30(%r8,%rax,2)
- DB 235,174 ; jmp 527a <_sk_store_u16_be_avx+0xf6>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,31 ; jne 526a <_sk_store_u16_be_avx+0xfa>
+ DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2)
+ DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2)
+ DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2)
+ DB 196,65,122,127,68,65,48 ; vmovdqu %xmm8,0x30(%r9,%rax,2)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2)
+ DB 116,218 ; je 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,205 ; jb 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2)
+ DB 116,196 ; je 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,183 ; jb 5266 <_sk_store_u16_be_avx+0xf6>
+ DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2)
+ DB 235,174 ; jmp 5266 <_sk_store_u16_be_avx+0xf6>
PUBLIC _sk_load_f32_avx
_sk_load_f32_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 119,110 ; ja 5342 <_sk_load_f32_avx+0x76>
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 76,141,21,134,0,0,0 ; lea 0x86(%rip),%r10 # 536c <_sk_load_f32_avx+0xa0>
- DB 73,99,4,138 ; movslq (%r10,%rcx,4),%rax
- DB 76,1,208 ; add %r10,%rax
- DB 255,224 ; jmpq *%rax
- DB 196,3,125,24,68,136,112,1 ; vinsertf128 $0x1,0x70(%r8,%r9,4),%ymm0,%ymm8
- DB 196,131,125,24,92,136,96,1 ; vinsertf128 $0x1,0x60(%r8,%r9,4),%ymm0,%ymm3
- DB 196,131,125,24,76,136,80,1 ; vinsertf128 $0x1,0x50(%r8,%r9,4),%ymm0,%ymm1
- DB 196,131,125,24,84,136,64,1 ; vinsertf128 $0x1,0x40(%r8,%r9,4),%ymm0,%ymm2
- DB 196,129,121,16,68,136,48 ; vmovupd 0x30(%r8,%r9,4),%xmm0
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 119,110 ; ja 532e <_sk_load_f32_avx+0x76>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 5358 <_sk_load_f32_avx+0xa0>
+ DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
+ DB 76,1,216 ; add %r11,%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,3,125,24,68,145,112,1 ; vinsertf128 $0x1,0x70(%r9,%r10,4),%ymm0,%ymm8
+ DB 196,131,125,24,92,145,96,1 ; vinsertf128 $0x1,0x60(%r9,%r10,4),%ymm0,%ymm3
+ DB 196,131,125,24,76,145,80,1 ; vinsertf128 $0x1,0x50(%r9,%r10,4),%ymm0,%ymm1
+ DB 196,131,125,24,84,145,64,1 ; vinsertf128 $0x1,0x40(%r9,%r10,4),%ymm0,%ymm2
+ DB 196,129,121,16,68,145,48 ; vmovupd 0x30(%r9,%r10,4),%xmm0
DB 196,195,125,13,192,12 ; vblendpd $0xc,%ymm8,%ymm0,%ymm0
- DB 196,1,121,16,68,136,32 ; vmovupd 0x20(%r8,%r9,4),%xmm8
+ DB 196,1,121,16,68,145,32 ; vmovupd 0x20(%r9,%r10,4),%xmm8
DB 196,99,61,13,203,12 ; vblendpd $0xc,%ymm3,%ymm8,%ymm9
- DB 196,129,121,16,92,136,16 ; vmovupd 0x10(%r8,%r9,4),%xmm3
+ DB 196,129,121,16,92,145,16 ; vmovupd 0x10(%r9,%r10,4),%xmm3
DB 196,99,101,13,209,12 ; vblendpd $0xc,%ymm1,%ymm3,%ymm10
- DB 196,129,121,16,12,136 ; vmovupd (%r8,%r9,4),%xmm1
+ DB 196,129,121,16,12,145 ; vmovupd (%r9,%r10,4),%xmm1
DB 196,227,117,13,202,12 ; vblendpd $0xc,%ymm2,%ymm1,%ymm1
DB 196,193,116,20,210 ; vunpcklps %ymm10,%ymm1,%ymm2
DB 196,193,116,21,218 ; vunpckhps %ymm10,%ymm1,%ymm3
@@ -10008,8 +9992,8 @@ _sk_load_f32_avx LABEL PROC
PUBLIC _sk_store_f32_avx
_sk_store_f32_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 197,124,20,193 ; vunpcklps %ymm1,%ymm0,%ymm8
DB 197,124,21,217 ; vunpckhps %ymm1,%ymm0,%ymm11
DB 197,108,20,203 ; vunpcklps %ymm3,%ymm2,%ymm9
@@ -10018,36 +10002,36 @@ _sk_store_f32_avx LABEL PROC
DB 196,65,61,21,201 ; vunpckhpd %ymm9,%ymm8,%ymm9
DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8
DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,55 ; jne 53f9 <_sk_store_f32_avx+0x6d>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,55 ; jne 53e5 <_sk_store_f32_avx+0x6d>
DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
DB 196,67,61,6,195,49 ; vperm2f128 $0x31,%ymm11,%ymm8,%ymm8
- DB 196,65,125,17,36,128 ; vmovupd %ymm12,(%r8,%rax,4)
- DB 196,65,125,17,108,128,32 ; vmovupd %ymm13,0x20(%r8,%rax,4)
- DB 196,65,125,17,76,128,64 ; vmovupd %ymm9,0x40(%r8,%rax,4)
- DB 196,65,125,17,68,128,96 ; vmovupd %ymm8,0x60(%r8,%rax,4)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 196,65,121,17,20,128 ; vmovupd %xmm10,(%r8,%rax,4)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 53f5 <_sk_store_f32_avx+0x69>
- DB 196,65,121,17,76,128,16 ; vmovupd %xmm9,0x10(%r8,%rax,4)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 53f5 <_sk_store_f32_avx+0x69>
- DB 196,65,121,17,68,128,32 ; vmovupd %xmm8,0x20(%r8,%rax,4)
- DB 116,218 ; je 53f5 <_sk_store_f32_avx+0x69>
- DB 196,65,121,17,92,128,48 ; vmovupd %xmm11,0x30(%r8,%rax,4)
- DB 72,131,249,5 ; cmp $0x5,%rcx
- DB 114,205 ; jb 53f5 <_sk_store_f32_avx+0x69>
- DB 196,67,125,25,84,128,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r8,%rax,4)
- DB 116,195 ; je 53f5 <_sk_store_f32_avx+0x69>
- DB 196,67,125,25,76,128,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r8,%rax,4)
- DB 72,131,249,7 ; cmp $0x7,%rcx
- DB 114,181 ; jb 53f5 <_sk_store_f32_avx+0x69>
- DB 196,67,125,25,68,128,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r8,%rax,4)
- DB 235,171 ; jmp 53f5 <_sk_store_f32_avx+0x69>
+ DB 196,65,125,17,36,129 ; vmovupd %ymm12,(%r9,%rax,4)
+ DB 196,65,125,17,108,129,32 ; vmovupd %ymm13,0x20(%r9,%rax,4)
+ DB 196,65,125,17,76,129,64 ; vmovupd %ymm9,0x40(%r9,%rax,4)
+ DB 196,65,125,17,68,129,96 ; vmovupd %ymm8,0x60(%r9,%rax,4)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4)
+ DB 116,218 ; je 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4)
+ DB 73,131,248,5 ; cmp $0x5,%r8
+ DB 114,205 ; jb 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
+ DB 116,195 ; je 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
+ DB 73,131,248,7 ; cmp $0x7,%r8
+ DB 114,181 ; jb 53e1 <_sk_store_f32_avx+0x69>
+ DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
+ DB 235,171 ; jmp 53e1 <_sk_store_f32_avx+0x69>
PUBLIC _sk_clamp_x_avx
_sk_clamp_x_avx LABEL PROC
@@ -10137,7 +10121,7 @@ PUBLIC _sk_clamp_x_1_avx
_sk_clamp_x_1_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,78,20,0,0 ; vbroadcastss 0x144e(%rip),%ymm8 # 69bc <_sk_callback_avx+0x45c>
+ DB 196,98,125,24,5,194,20,0,0 ; vbroadcastss 0x14c2(%rip),%ymm8 # 6a1c <_sk_callback_avx+0x466>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10151,9 +10135,9 @@ _sk_repeat_x_1_avx LABEL PROC
PUBLIC _sk_mirror_x_1_avx
_sk_mirror_x_1_avx LABEL PROC
- DB 196,98,125,24,5,49,20,0,0 ; vbroadcastss 0x1431(%rip),%ymm8 # 69c0 <_sk_callback_avx+0x460>
+ DB 196,98,125,24,5,165,20,0,0 ; vbroadcastss 0x14a5(%rip),%ymm8 # 6a20 <_sk_callback_avx+0x46a>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,13,39,20,0,0 ; vbroadcastss 0x1427(%rip),%ymm9 # 69c4 <_sk_callback_avx+0x464>
+ DB 196,98,125,24,13,155,20,0,0 ; vbroadcastss 0x149b(%rip),%ymm9 # 6a24 <_sk_callback_avx+0x46e>
DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9
DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9
DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9
@@ -10167,12 +10151,12 @@ _sk_mirror_x_1_avx LABEL PROC
PUBLIC _sk_luminance_to_alpha_avx
_sk_luminance_to_alpha_avx LABEL PROC
- DB 196,226,125,24,29,247,19,0,0 ; vbroadcastss 0x13f7(%rip),%ymm3 # 69c8 <_sk_callback_avx+0x468>
+ DB 196,226,125,24,29,107,20,0,0 ; vbroadcastss 0x146b(%rip),%ymm3 # 6a28 <_sk_callback_avx+0x472>
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,29,238,19,0,0 ; vbroadcastss 0x13ee(%rip),%ymm3 # 69cc <_sk_callback_avx+0x46c>
+ DB 196,226,125,24,29,98,20,0,0 ; vbroadcastss 0x1462(%rip),%ymm3 # 6a2c <_sk_callback_avx+0x476>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,225,19,0,0 ; vbroadcastss 0x13e1(%rip),%ymm1 # 69d0 <_sk_callback_avx+0x470>
+ DB 196,226,125,24,13,85,20,0,0 ; vbroadcastss 0x1455(%rip),%ymm1 # 6a30 <_sk_callback_avx+0x47a>
DB 197,236,89,201 ; vmulps %ymm1,%ymm2,%ymm1
DB 197,252,88,217 ; vaddps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10379,141 +10363,141 @@ _sk_evenly_spaced_gradient_avx LABEL PROC
DB 72,139,24 ; mov (%rax),%rbx
DB 72,139,104,8 ; mov 0x8(%rax),%rbp
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 5945 <_sk_evenly_spaced_gradient_avx+0x1f>
+ DB 120,7 ; js 5931 <_sk_evenly_spaced_gradient_avx+0x1f>
DB 196,225,242,42,203 ; vcvtsi2ss %rbx,%xmm1,%xmm1
- DB 235,21 ; jmp 595a <_sk_evenly_spaced_gradient_avx+0x34>
- DB 73,137,216 ; mov %rbx,%r8
- DB 73,209,232 ; shr %r8
+ DB 235,21 ; jmp 5946 <_sk_evenly_spaced_gradient_avx+0x34>
+ DB 73,137,217 ; mov %rbx,%r9
+ DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
- DB 76,9,195 ; or %r8,%rbx
+ DB 76,9,203 ; or %r9,%rbx
DB 196,225,242,42,203 ; vcvtsi2ss %rbx,%xmm1,%xmm1
DB 197,242,88,201 ; vaddss %xmm1,%xmm1,%xmm1
DB 196,227,121,4,201,0 ; vpermilps $0x0,%xmm1,%xmm1
DB 196,227,117,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm1,%ymm1
DB 197,244,89,200 ; vmulps %ymm0,%ymm1,%ymm1
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,195,249,22,200,1 ; vpextrq $0x1,%xmm1,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 196,193,249,126,202 ; vmovq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 196,195,249,22,201,1 ; vpextrq $0x1,%xmm1,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,193,249,126,203 ; vmovq %xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
- DB 196,195,249,22,207,1 ; vpextrq $0x1,%xmm1,%r15
- DB 69,137,254 ; mov %r15d,%r14d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,193,249,126,205 ; vmovq %xmm1,%r13
- DB 69,137,236 ; mov %r13d,%r12d
- DB 73,193,237,32 ; shr $0x20,%r13
- DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1
- DB 196,163,113,33,76,173,0,16 ; vinsertps $0x10,0x0(%rbp,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ DB 196,195,249,22,204,1 ; vpextrq $0x1,%xmm1,%r12
+ DB 69,137,231 ; mov %r12d,%r15d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
+ DB 65,137,221 ; mov %ebx,%r13d
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
+ DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,84,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm2
- DB 196,163,105,33,84,149,0,16 ; vinsertps $0x10,0x0(%rbp,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,92,133,0 ; vmovss 0x0(%rbp,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm8
- DB 72,139,88,40 ; mov 0x28(%rax),%rbx
- DB 196,161,122,16,20,163 ; vmovss (%rbx,%r12,4),%xmm2
- DB 196,163,105,33,20,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm2,%xmm2
- DB 196,161,122,16,28,179 ; vmovss (%rbx,%r14,4),%xmm3
+ DB 72,139,104,40 ; mov 0x28(%rax),%rbp
+ DB 196,161,122,16,84,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm2
+ DB 196,227,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,187 ; vmovss (%rbx,%r15,4),%xmm3
+ DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,155 ; vmovss (%rbx,%r11,4),%xmm3
- DB 196,163,97,33,28,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- DB 196,161,122,16,12,139 ; vmovss (%rbx,%r9,4),%xmm1
+ DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3
+ DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1
DB 196,227,97,33,201,32 ; vinsertps $0x20,%xmm1,%xmm3,%xmm1
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1
DB 196,99,117,24,226,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm12
- DB 72,139,88,16 ; mov 0x10(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,28,179 ; vmovss (%rbx,%r14,4),%xmm3
+ DB 72,139,104,16 ; mov 0x10(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3
DB 196,227,113,33,203,32 ; vinsertps $0x20,%xmm3,%xmm1,%xmm1
- DB 196,161,122,16,28,187 ; vmovss (%rbx,%r15,4),%xmm3
+ DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3
DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1
- DB 196,161,122,16,28,155 ; vmovss (%rbx,%r11,4),%xmm3
- DB 196,163,97,33,28,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- DB 196,161,122,16,20,139 ; vmovss (%rbx,%r9,4),%xmm2
+ DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3
+ DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ DB 196,161,122,16,84,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm2
DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,233,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm13
- DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,48 ; mov 0x30(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm9
- DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,24 ; mov 0x18(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm10
- DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,56 ; mov 0x38(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm11
- DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,32 ; mov 0x20(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
+ DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,99,109,24,241,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm14
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 196,161,122,16,12,160 ; vmovss (%rax,%r12,4),%xmm1
- DB 196,163,113,33,12,168,16 ; vinsertps $0x10,(%rax,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,176 ; vmovss (%rax,%r14,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ DB 196,161,122,16,12,168 ; vmovss (%rax,%r13,4),%xmm1
+ DB 196,227,113,33,12,152,16 ; vinsertps $0x10,(%rax,%rbx,4),%xmm1,%xmm1
DB 196,161,122,16,20,184 ; vmovss (%rax,%r15,4),%xmm2
+ DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ DB 196,161,122,16,20,160 ; vmovss (%rax,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,152 ; vmovss (%rax,%r11,4),%xmm2
- DB 196,163,105,33,20,144,16 ; vinsertps $0x10,(%rax,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,136 ; vmovss (%rax,%r9,4),%xmm3
+ DB 196,161,122,16,20,176 ; vmovss (%rax,%r14,4),%xmm2
+ DB 196,163,105,33,20,152,16 ; vinsertps $0x10,(%rax,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,28,144 ; vmovss (%rax,%r10,4),%xmm3
DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,128 ; vmovss (%rax,%r8,4),%xmm3
+ DB 196,161,122,16,28,136 ; vmovss (%rax,%r9,4),%xmm3
DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
DB 196,227,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm3
DB 197,188,89,200 ; vmulps %ymm0,%ymm8,%ymm1
@@ -10536,18 +10520,18 @@ _sk_evenly_spaced_gradient_avx LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_avx
_sk_gauss_a_to_rgba_avx LABEL PROC
- DB 196,226,125,24,5,76,13,0,0 ; vbroadcastss 0xd4c(%rip),%ymm0 # 69d4 <_sk_callback_avx+0x474>
+ DB 196,226,125,24,5,144,13,0,0 ; vbroadcastss 0xd90(%rip),%ymm0 # 6a34 <_sk_callback_avx+0x47e>
DB 197,228,89,192 ; vmulps %ymm0,%ymm3,%ymm0
- DB 196,226,125,24,13,67,13,0,0 ; vbroadcastss 0xd43(%rip),%ymm1 # 69d8 <_sk_callback_avx+0x478>
+ DB 196,226,125,24,13,135,13,0,0 ; vbroadcastss 0xd87(%rip),%ymm1 # 6a38 <_sk_callback_avx+0x482>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,54,13,0,0 ; vbroadcastss 0xd36(%rip),%ymm1 # 69dc <_sk_callback_avx+0x47c>
+ DB 196,226,125,24,13,122,13,0,0 ; vbroadcastss 0xd7a(%rip),%ymm1 # 6a3c <_sk_callback_avx+0x486>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,41,13,0,0 ; vbroadcastss 0xd29(%rip),%ymm1 # 69e0 <_sk_callback_avx+0x480>
+ DB 196,226,125,24,13,109,13,0,0 ; vbroadcastss 0xd6d(%rip),%ymm1 # 6a40 <_sk_callback_avx+0x48a>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,28,13,0,0 ; vbroadcastss 0xd1c(%rip),%ymm1 # 69e4 <_sk_callback_avx+0x484>
+ DB 196,226,125,24,13,96,13,0,0 ; vbroadcastss 0xd60(%rip),%ymm1 # 6a44 <_sk_callback_avx+0x48e>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
@@ -10563,16 +10547,18 @@ _sk_gradient_avx LABEL PROC
DB 65,85 ; push %r13
DB 65,84 ; push %r12
DB 83 ; push %rbx
+ DB 72,131,236,40 ; sub $0x28,%rsp
+ DB 197,252,17,60,36 ; vmovups %ymm7,(%rsp)
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
- DB 73,131,248,2 ; cmp $0x2,%r8
- DB 114,80 ; jb 5d45 <_sk_gradient_avx+0x69>
+ DB 73,131,249,2 ; cmp $0x2,%r9
+ DB 114,80 ; jb 5d6a <_sk_gradient_avx+0x72>
DB 72,139,88,72 ; mov 0x48(%rax),%rbx
- DB 73,255,200 ; dec %r8
+ DB 73,255,201 ; dec %r9
DB 72,131,195,4 ; add $0x4,%rbx
DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9
- DB 196,98,125,24,21,218,12,0,0 ; vbroadcastss 0xcda(%rip),%ymm10 # 69e8 <_sk_callback_avx+0x488>
+ DB 196,98,125,24,21,21,13,0,0 ; vbroadcastss 0xd15(%rip),%ymm10 # 6a48 <_sk_callback_avx+0x492>
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 196,98,125,24,3 ; vbroadcastss (%rbx),%ymm8
DB 197,60,194,192,2 ; vcmpleps %ymm0,%ymm8,%ymm8
@@ -10583,132 +10569,132 @@ _sk_gradient_avx LABEL PROC
DB 197,185,254,201 ; vpaddd %xmm1,%xmm8,%xmm1
DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
DB 72,131,195,4 ; add $0x4,%rbx
- DB 73,255,200 ; dec %r8
- DB 117,205 ; jne 5d12 <_sk_gradient_avx+0x36>
- DB 196,195,249,22,200,1 ; vpextrq $0x1,%xmm1,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 196,193,249,126,202 ; vmovq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 73,255,201 ; dec %r9
+ DB 117,205 ; jne 5d37 <_sk_gradient_avx+0x3f>
+ DB 196,195,249,22,201,1 ; vpextrq $0x1,%xmm1,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 196,193,249,126,203 ; vmovq %xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
- DB 196,195,249,22,207,1 ; vpextrq $0x1,%xmm1,%r15
- DB 69,137,254 ; mov %r15d,%r14d
- DB 73,193,239,32 ; shr $0x20,%r15
- DB 196,193,249,126,205 ; vmovq %xmm1,%r13
- DB 69,137,236 ; mov %r13d,%r12d
- DB 73,193,237,32 ; shr $0x20,%r13
+ DB 196,195,249,22,204,1 ; vpextrq $0x1,%xmm1,%r12
+ DB 69,137,231 ; mov %r12d,%r15d
+ DB 73,193,236,32 ; shr $0x20,%r12
+ DB 196,225,249,126,203 ; vmovq %xmm1,%rbx
+ DB 65,137,221 ; mov %ebx,%r13d
+ DB 72,193,235,32 ; shr $0x20,%rbx
DB 72,139,104,8 ; mov 0x8(%rax),%rbp
- DB 72,139,88,16 ; mov 0x10(%rax),%rbx
- DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1
- DB 196,163,113,33,76,173,0,16 ; vinsertps $0x10,0x0(%rbp,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,84,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm2
- DB 196,163,105,33,84,149,0,16 ; vinsertps $0x10,0x0(%rbp,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,92,133,0 ; vmovss 0x0(%rbp,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,99,109,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm8
+ DB 196,99,113,33,194,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm8
+ DB 196,33,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm9
+ DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3
+ DB 196,35,97,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm10
+ DB 196,33,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm11
+ DB 196,33,122,16,100,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm12
DB 72,139,104,40 ; mov 0x28(%rax),%rbp
- DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
- DB 196,163,105,33,84,173,0,16 ; vinsertps $0x10,0x0(%rbp,%r13,4),%xmm2,%xmm2
+ DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3
+ DB 196,99,97,33,108,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm13
+ DB 196,33,122,16,116,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm14
+ DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15
DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
+ DB 196,163,97,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm7
+ DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1
+ DB 196,161,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm2
+ DB 72,139,104,16 ; mov 0x10(%rax),%rbp
+ DB 196,67,57,33,193,48 ; vinsertps $0x30,%xmm9,%xmm8,%xmm8
+ DB 196,195,41,33,219,32 ; vinsertps $0x20,%xmm11,%xmm10,%xmm3
+ DB 196,195,97,33,220,48 ; vinsertps $0x30,%xmm12,%xmm3,%xmm3
+ DB 196,67,101,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm3,%ymm8
+ DB 196,195,17,33,222,32 ; vinsertps $0x20,%xmm14,%xmm13,%xmm3
+ DB 196,195,97,33,223,48 ; vinsertps $0x30,%xmm15,%xmm3,%xmm3
+ DB 196,227,65,33,201,32 ; vinsertps $0x20,%xmm1,%xmm7,%xmm1
+ DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
+ DB 196,99,117,24,227,1 ; vinsertf128 $0x1,%xmm3,%ymm1,%ymm12
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,92,157,0 ; vmovss 0x0(%rbp,%r11,4),%xmm3
- DB 196,163,97,33,92,149,0,16 ; vinsertps $0x10,0x0(%rbp,%r10,4),%xmm3,%xmm3
- DB 196,161,122,16,76,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm1
- DB 196,227,97,33,201,32 ; vinsertps $0x20,%xmm1,%xmm3,%xmm1
- DB 196,161,122,16,92,133,0 ; vmovss 0x0(%rbp,%r8,4),%xmm3
- DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1
- DB 196,99,117,24,226,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm12
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,28,179 ; vmovss (%rbx,%r14,4),%xmm3
DB 196,227,113,33,203,32 ; vinsertps $0x20,%xmm3,%xmm1,%xmm1
- DB 196,161,122,16,28,187 ; vmovss (%rbx,%r15,4),%xmm3
+ DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3
DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1
- DB 196,161,122,16,28,155 ; vmovss (%rbx,%r11,4),%xmm3
- DB 196,163,97,33,28,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm3,%xmm3
- DB 196,161,122,16,20,139 ; vmovss (%rbx,%r9,4),%xmm2
- DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,99,109,24,233,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm13
- DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3
+ DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3
+ DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7
+ DB 196,227,97,33,223,32 ; vinsertps $0x20,%xmm7,%xmm3,%xmm3
+ DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7
+ DB 196,227,97,33,223,48 ; vinsertps $0x30,%xmm7,%xmm3,%xmm3
+ DB 196,99,101,24,233,1 ; vinsertf128 $0x1,%xmm1,%ymm3,%ymm13
+ DB 72,139,104,48 ; mov 0x30(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,124,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm7
+ DB 196,227,113,33,207,32 ; vinsertps $0x20,%xmm7,%xmm1,%xmm1
+ DB 196,161,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm7
+ DB 196,227,113,33,207,48 ; vinsertps $0x30,%xmm7,%xmm1,%xmm1
+ DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7
+ DB 196,163,65,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7
+ DB 196,161,122,16,84,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm2
+ DB 196,227,65,33,210,32 ; vinsertps $0x20,%xmm2,%xmm7,%xmm2
+ DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7
+ DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2
DB 196,99,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm9
- DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,24 ; mov 0x18(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7
+ DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7
+ DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2
DB 196,99,109,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm10
- DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,56 ; mov 0x38(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2
+ DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2
+ DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7
+ DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2
+ DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7
+ DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2
DB 196,99,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm11
- DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 196,161,122,16,12,163 ; vmovss (%rbx,%r12,4),%xmm1
- DB 196,163,113,33,12,171,16 ; vinsertps $0x10,(%rbx,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,179 ; vmovss (%rbx,%r14,4),%xmm2
+ DB 72,139,104,32 ; mov 0x20(%rax),%rbp
+ DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1
+ DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1
+ DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2
DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,187 ; vmovss (%rbx,%r15,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,155 ; vmovss (%rbx,%r11,4),%xmm2
- DB 196,163,105,33,20,147,16 ; vinsertps $0x10,(%rbx,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,139 ; vmovss (%rbx,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,131 ; vmovss (%rbx,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
- DB 196,99,109,24,241,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm14
+ DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2
+ DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7
+ DB 196,35,65,33,116,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm14
+ DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3
+ DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7
+ DB 196,99,113,33,250,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm15
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 196,161,122,16,12,160 ; vmovss (%rax,%r12,4),%xmm1
- DB 196,163,113,33,12,168,16 ; vinsertps $0x10,(%rax,%r13,4),%xmm1,%xmm1
- DB 196,161,122,16,20,176 ; vmovss (%rax,%r14,4),%xmm2
- DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,184 ; vmovss (%rax,%r15,4),%xmm2
- DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1
- DB 196,161,122,16,20,152 ; vmovss (%rax,%r11,4),%xmm2
- DB 196,163,105,33,20,144,16 ; vinsertps $0x10,(%rax,%r10,4),%xmm2,%xmm2
- DB 196,161,122,16,28,136 ; vmovss (%rax,%r9,4),%xmm3
- DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2
- DB 196,161,122,16,28,128 ; vmovss (%rax,%r8,4),%xmm3
- DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2
+ DB 196,161,122,16,20,168 ; vmovss (%rax,%r13,4),%xmm2
+ DB 196,227,105,33,20,152,16 ; vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2
+ DB 196,227,9,33,219,32 ; vinsertps $0x20,%xmm3,%xmm14,%xmm3
+ DB 196,161,122,16,12,184 ; vmovss (%rax,%r15,4),%xmm1
+ DB 196,227,97,33,223,48 ; vinsertps $0x30,%xmm7,%xmm3,%xmm3
+ DB 196,161,122,16,60,160 ; vmovss (%rax,%r12,4),%xmm7
+ DB 196,67,101,24,247,1 ; vinsertf128 $0x1,%xmm15,%ymm3,%ymm14
+ DB 196,161,122,16,28,176 ; vmovss (%rax,%r14,4),%xmm3
+ DB 196,163,97,33,28,152,16 ; vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3
+ DB 196,227,105,33,201,32 ; vinsertps $0x20,%xmm1,%xmm2,%xmm1
+ DB 196,161,122,16,20,144 ; vmovss (%rax,%r10,4),%xmm2
+ DB 196,227,113,33,207,48 ; vinsertps $0x30,%xmm7,%xmm1,%xmm1
+ DB 196,161,122,16,60,136 ; vmovss (%rax,%r9,4),%xmm7
+ DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2
+ DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2
DB 196,227,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm3
DB 197,188,89,200 ; vmulps %ymm0,%ymm8,%ymm1
DB 196,65,116,88,196 ; vaddps %ymm12,%ymm1,%ymm8
@@ -10720,6 +10706,8 @@ _sk_gradient_avx LABEL PROC
DB 197,252,88,219 ; vaddps %ymm3,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,124,41,192 ; vmovaps %ymm8,%ymm0
+ DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7
+ DB 72,131,196,40 ; add $0x28,%rsp
DB 91 ; pop %rbx
DB 65,92 ; pop %r12
DB 65,93 ; pop %r13
@@ -10762,27 +10750,27 @@ _sk_xy_to_unit_angle_avx LABEL PROC
DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12
DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11
DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12
- DB 196,98,125,24,45,254,8,0,0 ; vbroadcastss 0x8fe(%rip),%ymm13 # 69ec <_sk_callback_avx+0x48c>
+ DB 196,98,125,24,45,8,9,0,0 ; vbroadcastss 0x908(%rip),%ymm13 # 6a4c <_sk_callback_avx+0x496>
DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13
- DB 196,98,125,24,53,244,8,0,0 ; vbroadcastss 0x8f4(%rip),%ymm14 # 69f0 <_sk_callback_avx+0x490>
+ DB 196,98,125,24,53,254,8,0,0 ; vbroadcastss 0x8fe(%rip),%ymm14 # 6a50 <_sk_callback_avx+0x49a>
DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13
DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13
- DB 196,98,125,24,53,229,8,0,0 ; vbroadcastss 0x8e5(%rip),%ymm14 # 69f4 <_sk_callback_avx+0x494>
+ DB 196,98,125,24,53,239,8,0,0 ; vbroadcastss 0x8ef(%rip),%ymm14 # 6a54 <_sk_callback_avx+0x49e>
DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13
DB 196,65,28,89,229 ; vmulps %ymm13,%ymm12,%ymm12
- DB 196,98,125,24,45,214,8,0,0 ; vbroadcastss 0x8d6(%rip),%ymm13 # 69f8 <_sk_callback_avx+0x498>
+ DB 196,98,125,24,45,224,8,0,0 ; vbroadcastss 0x8e0(%rip),%ymm13 # 6a58 <_sk_callback_avx+0x4a2>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,193,8,0,0 ; vbroadcastss 0x8c1(%rip),%ymm10 # 69fc <_sk_callback_avx+0x49c>
+ DB 196,98,125,24,21,203,8,0,0 ; vbroadcastss 0x8cb(%rip),%ymm10 # 6a5c <_sk_callback_avx+0x4a6>
DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10
DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9
DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,21,171,8,0,0 ; vbroadcastss 0x8ab(%rip),%ymm10 # 6a00 <_sk_callback_avx+0x4a0>
+ DB 196,98,125,24,21,181,8,0,0 ; vbroadcastss 0x8b5(%rip),%ymm10 # 6a60 <_sk_callback_avx+0x4aa>
DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9
- DB 196,98,125,24,21,149,8,0,0 ; vbroadcastss 0x895(%rip),%ymm10 # 6a04 <_sk_callback_avx+0x4a4>
+ DB 196,98,125,24,21,159,8,0,0 ; vbroadcastss 0x89f(%rip),%ymm10 # 6a64 <_sk_callback_avx+0x4ae>
DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10
DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0
DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9
@@ -10802,7 +10790,7 @@ _sk_xy_to_radius_avx LABEL PROC
PUBLIC _sk_save_xy_avx
_sk_save_xy_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,95,8,0,0 ; vbroadcastss 0x85f(%rip),%ymm8 # 6a08 <_sk_callback_avx+0x4a8>
+ DB 196,98,125,24,5,105,8,0,0 ; vbroadcastss 0x869(%rip),%ymm8 # 6a68 <_sk_callback_avx+0x4b2>
DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9
DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
@@ -10835,9 +10823,9 @@ _sk_accumulate_avx LABEL PROC
PUBLIC _sk_bilinear_nx_avx
_sk_bilinear_nx_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,235,7,0,0 ; vbroadcastss 0x7eb(%rip),%ymm0 # 6a0c <_sk_callback_avx+0x4ac>
+ DB 196,226,125,24,5,245,7,0,0 ; vbroadcastss 0x7f5(%rip),%ymm0 # 6a6c <_sk_callback_avx+0x4b6>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,226,7,0,0 ; vbroadcastss 0x7e2(%rip),%ymm8 # 6a10 <_sk_callback_avx+0x4b0>
+ DB 196,98,125,24,5,236,7,0,0 ; vbroadcastss 0x7ec(%rip),%ymm8 # 6a70 <_sk_callback_avx+0x4ba>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10846,7 +10834,7 @@ _sk_bilinear_nx_avx LABEL PROC
PUBLIC _sk_bilinear_px_avx
_sk_bilinear_px_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,202,7,0,0 ; vbroadcastss 0x7ca(%rip),%ymm0 # 6a14 <_sk_callback_avx+0x4b4>
+ DB 196,226,125,24,5,212,7,0,0 ; vbroadcastss 0x7d4(%rip),%ymm0 # 6a74 <_sk_callback_avx+0x4be>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -10856,9 +10844,9 @@ _sk_bilinear_px_avx LABEL PROC
PUBLIC _sk_bilinear_ny_avx
_sk_bilinear_ny_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,174,7,0,0 ; vbroadcastss 0x7ae(%rip),%ymm1 # 6a18 <_sk_callback_avx+0x4b8>
+ DB 196,226,125,24,13,184,7,0,0 ; vbroadcastss 0x7b8(%rip),%ymm1 # 6a78 <_sk_callback_avx+0x4c2>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,164,7,0,0 ; vbroadcastss 0x7a4(%rip),%ymm8 # 6a1c <_sk_callback_avx+0x4bc>
+ DB 196,98,125,24,5,174,7,0,0 ; vbroadcastss 0x7ae(%rip),%ymm8 # 6a7c <_sk_callback_avx+0x4c6>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10867,7 +10855,7 @@ _sk_bilinear_ny_avx LABEL PROC
PUBLIC _sk_bilinear_py_avx
_sk_bilinear_py_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,140,7,0,0 ; vbroadcastss 0x78c(%rip),%ymm1 # 6a20 <_sk_callback_avx+0x4c0>
+ DB 196,226,125,24,13,150,7,0,0 ; vbroadcastss 0x796(%rip),%ymm1 # 6a80 <_sk_callback_avx+0x4ca>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -10877,14 +10865,14 @@ _sk_bilinear_py_avx LABEL PROC
PUBLIC _sk_bicubic_n3x_avx
_sk_bicubic_n3x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,111,7,0,0 ; vbroadcastss 0x76f(%rip),%ymm0 # 6a24 <_sk_callback_avx+0x4c4>
+ DB 196,226,125,24,5,121,7,0,0 ; vbroadcastss 0x779(%rip),%ymm0 # 6a84 <_sk_callback_avx+0x4ce>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,102,7,0,0 ; vbroadcastss 0x766(%rip),%ymm8 # 6a28 <_sk_callback_avx+0x4c8>
+ DB 196,98,125,24,5,112,7,0,0 ; vbroadcastss 0x770(%rip),%ymm8 # 6a88 <_sk_callback_avx+0x4d2>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,87,7,0,0 ; vbroadcastss 0x757(%rip),%ymm10 # 6a2c <_sk_callback_avx+0x4cc>
+ DB 196,98,125,24,21,97,7,0,0 ; vbroadcastss 0x761(%rip),%ymm10 # 6a8c <_sk_callback_avx+0x4d6>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,77,7,0,0 ; vbroadcastss 0x74d(%rip),%ymm10 # 6a30 <_sk_callback_avx+0x4d0>
+ DB 196,98,125,24,21,87,7,0,0 ; vbroadcastss 0x757(%rip),%ymm10 # 6a90 <_sk_callback_avx+0x4da>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -10894,19 +10882,19 @@ _sk_bicubic_n3x_avx LABEL PROC
PUBLIC _sk_bicubic_n1x_avx
_sk_bicubic_n1x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,48,7,0,0 ; vbroadcastss 0x730(%rip),%ymm0 # 6a34 <_sk_callback_avx+0x4d4>
+ DB 196,226,125,24,5,58,7,0,0 ; vbroadcastss 0x73a(%rip),%ymm0 # 6a94 <_sk_callback_avx+0x4de>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,39,7,0,0 ; vbroadcastss 0x727(%rip),%ymm8 # 6a38 <_sk_callback_avx+0x4d8>
+ DB 196,98,125,24,5,49,7,0,0 ; vbroadcastss 0x731(%rip),%ymm8 # 6a98 <_sk_callback_avx+0x4e2>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,29,7,0,0 ; vbroadcastss 0x71d(%rip),%ymm9 # 6a3c <_sk_callback_avx+0x4dc>
+ DB 196,98,125,24,13,39,7,0,0 ; vbroadcastss 0x727(%rip),%ymm9 # 6a9c <_sk_callback_avx+0x4e6>
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,19,7,0,0 ; vbroadcastss 0x713(%rip),%ymm10 # 6a40 <_sk_callback_avx+0x4e0>
+ DB 196,98,125,24,21,29,7,0,0 ; vbroadcastss 0x71d(%rip),%ymm10 # 6aa0 <_sk_callback_avx+0x4ea>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,4,7,0,0 ; vbroadcastss 0x704(%rip),%ymm10 # 6a44 <_sk_callback_avx+0x4e4>
+ DB 196,98,125,24,21,14,7,0,0 ; vbroadcastss 0x70e(%rip),%ymm10 # 6aa4 <_sk_callback_avx+0x4ee>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,245,6,0,0 ; vbroadcastss 0x6f5(%rip),%ymm9 # 6a48 <_sk_callback_avx+0x4e8>
+ DB 196,98,125,24,13,255,6,0,0 ; vbroadcastss 0x6ff(%rip),%ymm9 # 6aa8 <_sk_callback_avx+0x4f2>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10915,17 +10903,17 @@ _sk_bicubic_n1x_avx LABEL PROC
PUBLIC _sk_bicubic_p1x_avx
_sk_bicubic_p1x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,221,6,0,0 ; vbroadcastss 0x6dd(%rip),%ymm8 # 6a4c <_sk_callback_avx+0x4ec>
+ DB 196,98,125,24,5,231,6,0,0 ; vbroadcastss 0x6e7(%rip),%ymm8 # 6aac <_sk_callback_avx+0x4f6>
DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0
DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9
- DB 196,98,125,24,21,207,6,0,0 ; vbroadcastss 0x6cf(%rip),%ymm10 # 6a50 <_sk_callback_avx+0x4f0>
+ DB 196,98,125,24,21,217,6,0,0 ; vbroadcastss 0x6d9(%rip),%ymm10 # 6ab0 <_sk_callback_avx+0x4fa>
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
- DB 196,98,125,24,29,197,6,0,0 ; vbroadcastss 0x6c5(%rip),%ymm11 # 6a54 <_sk_callback_avx+0x4f4>
+ DB 196,98,125,24,29,207,6,0,0 ; vbroadcastss 0x6cf(%rip),%ymm11 # 6ab4 <_sk_callback_avx+0x4fe>
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
- DB 196,98,125,24,13,172,6,0,0 ; vbroadcastss 0x6ac(%rip),%ymm9 # 6a58 <_sk_callback_avx+0x4f8>
+ DB 196,98,125,24,13,182,6,0,0 ; vbroadcastss 0x6b6(%rip),%ymm9 # 6ab8 <_sk_callback_avx+0x502>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10934,13 +10922,13 @@ _sk_bicubic_p1x_avx LABEL PROC
PUBLIC _sk_bicubic_p3x_avx
_sk_bicubic_p3x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,148,6,0,0 ; vbroadcastss 0x694(%rip),%ymm0 # 6a5c <_sk_callback_avx+0x4fc>
+ DB 196,226,125,24,5,158,6,0,0 ; vbroadcastss 0x69e(%rip),%ymm0 # 6abc <_sk_callback_avx+0x506>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm10 # 6a60 <_sk_callback_avx+0x500>
+ DB 196,98,125,24,21,139,6,0,0 ; vbroadcastss 0x68b(%rip),%ymm10 # 6ac0 <_sk_callback_avx+0x50a>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,119,6,0,0 ; vbroadcastss 0x677(%rip),%ymm10 # 6a64 <_sk_callback_avx+0x504>
+ DB 196,98,125,24,21,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm10 # 6ac4 <_sk_callback_avx+0x50e>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -10950,14 +10938,14 @@ _sk_bicubic_p3x_avx LABEL PROC
PUBLIC _sk_bicubic_n3y_avx
_sk_bicubic_n3y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,90,6,0,0 ; vbroadcastss 0x65a(%rip),%ymm1 # 6a68 <_sk_callback_avx+0x508>
+ DB 196,226,125,24,13,100,6,0,0 ; vbroadcastss 0x664(%rip),%ymm1 # 6ac8 <_sk_callback_avx+0x512>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,80,6,0,0 ; vbroadcastss 0x650(%rip),%ymm8 # 6a6c <_sk_callback_avx+0x50c>
+ DB 196,98,125,24,5,90,6,0,0 ; vbroadcastss 0x65a(%rip),%ymm8 # 6acc <_sk_callback_avx+0x516>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,65,6,0,0 ; vbroadcastss 0x641(%rip),%ymm10 # 6a70 <_sk_callback_avx+0x510>
+ DB 196,98,125,24,21,75,6,0,0 ; vbroadcastss 0x64b(%rip),%ymm10 # 6ad0 <_sk_callback_avx+0x51a>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,55,6,0,0 ; vbroadcastss 0x637(%rip),%ymm10 # 6a74 <_sk_callback_avx+0x514>
+ DB 196,98,125,24,21,65,6,0,0 ; vbroadcastss 0x641(%rip),%ymm10 # 6ad4 <_sk_callback_avx+0x51e>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -10967,19 +10955,19 @@ _sk_bicubic_n3y_avx LABEL PROC
PUBLIC _sk_bicubic_n1y_avx
_sk_bicubic_n1y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,26,6,0,0 ; vbroadcastss 0x61a(%rip),%ymm1 # 6a78 <_sk_callback_avx+0x518>
+ DB 196,226,125,24,13,36,6,0,0 ; vbroadcastss 0x624(%rip),%ymm1 # 6ad8 <_sk_callback_avx+0x522>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,16,6,0,0 ; vbroadcastss 0x610(%rip),%ymm8 # 6a7c <_sk_callback_avx+0x51c>
+ DB 196,98,125,24,5,26,6,0,0 ; vbroadcastss 0x61a(%rip),%ymm8 # 6adc <_sk_callback_avx+0x526>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,6,6,0,0 ; vbroadcastss 0x606(%rip),%ymm9 # 6a80 <_sk_callback_avx+0x520>
+ DB 196,98,125,24,13,16,6,0,0 ; vbroadcastss 0x610(%rip),%ymm9 # 6ae0 <_sk_callback_avx+0x52a>
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,252,5,0,0 ; vbroadcastss 0x5fc(%rip),%ymm10 # 6a84 <_sk_callback_avx+0x524>
+ DB 196,98,125,24,21,6,6,0,0 ; vbroadcastss 0x606(%rip),%ymm10 # 6ae4 <_sk_callback_avx+0x52e>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,237,5,0,0 ; vbroadcastss 0x5ed(%rip),%ymm10 # 6a88 <_sk_callback_avx+0x528>
+ DB 196,98,125,24,21,247,5,0,0 ; vbroadcastss 0x5f7(%rip),%ymm10 # 6ae8 <_sk_callback_avx+0x532>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,222,5,0,0 ; vbroadcastss 0x5de(%rip),%ymm9 # 6a8c <_sk_callback_avx+0x52c>
+ DB 196,98,125,24,13,232,5,0,0 ; vbroadcastss 0x5e8(%rip),%ymm9 # 6aec <_sk_callback_avx+0x536>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -10988,17 +10976,17 @@ _sk_bicubic_n1y_avx LABEL PROC
PUBLIC _sk_bicubic_p1y_avx
_sk_bicubic_p1y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,198,5,0,0 ; vbroadcastss 0x5c6(%rip),%ymm8 # 6a90 <_sk_callback_avx+0x530>
+ DB 196,98,125,24,5,208,5,0,0 ; vbroadcastss 0x5d0(%rip),%ymm8 # 6af0 <_sk_callback_avx+0x53a>
DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1
DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9
- DB 196,98,125,24,21,183,5,0,0 ; vbroadcastss 0x5b7(%rip),%ymm10 # 6a94 <_sk_callback_avx+0x534>
+ DB 196,98,125,24,21,193,5,0,0 ; vbroadcastss 0x5c1(%rip),%ymm10 # 6af4 <_sk_callback_avx+0x53e>
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
- DB 196,98,125,24,29,173,5,0,0 ; vbroadcastss 0x5ad(%rip),%ymm11 # 6a98 <_sk_callback_avx+0x538>
+ DB 196,98,125,24,29,183,5,0,0 ; vbroadcastss 0x5b7(%rip),%ymm11 # 6af8 <_sk_callback_avx+0x542>
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
- DB 196,98,125,24,13,148,5,0,0 ; vbroadcastss 0x594(%rip),%ymm9 # 6a9c <_sk_callback_avx+0x53c>
+ DB 196,98,125,24,13,158,5,0,0 ; vbroadcastss 0x59e(%rip),%ymm9 # 6afc <_sk_callback_avx+0x546>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -11007,13 +10995,13 @@ _sk_bicubic_p1y_avx LABEL PROC
PUBLIC _sk_bicubic_p3y_avx
_sk_bicubic_p3y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,124,5,0,0 ; vbroadcastss 0x57c(%rip),%ymm1 # 6aa0 <_sk_callback_avx+0x540>
+ DB 196,226,125,24,13,134,5,0,0 ; vbroadcastss 0x586(%rip),%ymm1 # 6b00 <_sk_callback_avx+0x54a>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,104,5,0,0 ; vbroadcastss 0x568(%rip),%ymm10 # 6aa4 <_sk_callback_avx+0x544>
+ DB 196,98,125,24,21,114,5,0,0 ; vbroadcastss 0x572(%rip),%ymm10 # 6b04 <_sk_callback_avx+0x54e>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,94,5,0,0 ; vbroadcastss 0x55e(%rip),%ymm10 # 6aa8 <_sk_callback_avx+0x548>
+ DB 196,98,125,24,21,104,5,0,0 ; vbroadcastss 0x568(%rip),%ymm10 # 6b08 <_sk_callback_avx+0x552>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -11024,14 +11012,16 @@ PUBLIC _sk_callback_avx
_sk_callback_avx LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp
DB 197,252,17,188,36,128,0,0,0 ; vmovups %ymm7,0x80(%rsp)
DB 197,252,17,116,36,96 ; vmovups %ymm6,0x60(%rsp)
DB 197,252,17,108,36,64 ; vmovups %ymm5,0x40(%rsp)
DB 197,252,17,100,36,32 ; vmovups %ymm4,0x20(%rsp)
- DB 73,137,207 ; mov %rcx,%r15
- DB 73,137,214 ; mov %rdx,%r14
+ DB 77,137,196 ; mov %r8,%r12
+ DB 73,137,206 ; mov %rcx,%r14
+ DB 73,137,215 ; mov %rdx,%r15
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,137,195 ; mov %rax,%rbx
DB 197,252,20,225 ; vunpcklps %ymm1,%ymm0,%ymm4
@@ -11050,9 +11040,9 @@ _sk_callback_avx LABEL PROC
DB 197,253,17,107,40 ; vmovupd %ymm5,0x28(%rbx)
DB 197,253,17,75,72 ; vmovupd %ymm1,0x48(%rbx)
DB 197,253,17,67,104 ; vmovupd %ymm0,0x68(%rbx)
- DB 77,133,255 ; test %r15,%r15
+ DB 77,133,228 ; test %r12,%r12
DB 186,8,0,0,0 ; mov $0x8,%edx
- DB 65,15,69,215 ; cmovne %r15d,%edx
+ DB 65,15,69,212 ; cmovne %r12d,%edx
DB 72,137,217 ; mov %rbx,%rcx
DB 197,248,119 ; vzeroupper
DB 255,19 ; callq *(%rbx)
@@ -11074,14 +11064,16 @@ _sk_callback_avx LABEL PROC
DB 197,213,20,211 ; vunpcklpd %ymm3,%ymm5,%ymm2
DB 197,213,21,219 ; vunpckhpd %ymm3,%ymm5,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,249 ; mov %r15,%rcx
+ DB 76,137,250 ; mov %r15,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 77,137,224 ; mov %r12,%r8
DB 197,252,16,100,36,32 ; vmovups 0x20(%rsp),%ymm4
DB 197,252,16,108,36,64 ; vmovups 0x40(%rsp),%ymm5
DB 197,252,16,116,36,96 ; vmovups 0x60(%rsp),%ymm6
DB 197,252,16,188,36,128,0,0,0 ; vmovups 0x80(%rsp),%ymm7
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -11127,25 +11119,25 @@ ALIGN 4
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 672d <.literal4+0xb1>
+ DB 71,225,61 ; rex.RXB loope 678d <.literal4+0xb1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 673d <.literal4+0xc1>
+ DB 71,225,61 ; rex.RXB loope 679d <.literal4+0xc1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 674d <.literal4+0xd1>
+ DB 71,225,61 ; rex.RXB loope 67ad <.literal4+0xd1>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 675d <.literal4+0xe1>
+ DB 71,225,61 ; rex.RXB loope 67bd <.literal4+0xe1>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
@@ -11197,7 +11189,7 @@ ALIGN 4
DB 190,129,128,128,59 ; mov $0x3b808081,%esi
DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 67b1 <.literal4+0x135>
+ DB 224,7 ; loopne 6811 <.literal4+0x135>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -11213,10 +11205,10 @@ ALIGN 4
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
DB 0,52,255 ; add %dh,(%rdi,%rdi,8)
DB 255 ; (bad)
- DB 127,0 ; jg 67d8 <.literal4+0x15c>
+ DB 127,0 ; jg 6838 <.literal4+0x15c>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6851 <.literal4+0x1d5>
+ DB 119,115 ; ja 68b1 <.literal4+0x1d5>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -11230,10 +11222,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 680c <.literal4+0x190>
+ DB 127,0 ; jg 686c <.literal4+0x190>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6885 <.literal4+0x209>
+ DB 119,115 ; ja 68e5 <.literal4+0x209>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -11247,10 +11239,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6840 <.literal4+0x1c4>
+ DB 127,0 ; jg 68a0 <.literal4+0x1c4>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 68b9 <.literal4+0x23d>
+ DB 119,115 ; ja 6919 <.literal4+0x23d>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -11264,10 +11256,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6874 <.literal4+0x1f8>
+ DB 127,0 ; jg 68d4 <.literal4+0x1f8>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 68ed <.literal4+0x271>
+ DB 119,115 ; ja 694d <.literal4+0x271>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -11280,7 +11272,7 @@ ALIGN 4
DB 0,75,0 ; add %cl,0x0(%rbx)
DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax)
DB 66,0,0 ; rex.X add %al,(%rax)
- DB 127,67 ; jg 68eb <.literal4+0x26f>
+ DB 127,67 ; jg 694b <.literal4+0x26f>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -11292,10 +11284,10 @@ ALIGN 4
DB 190,80,128,3,62 ; mov $0x3e038050,%esi
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 690b <.literal4+0x28f>
+ DB 118,63 ; jbe 696b <.literal4+0x28f>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
- DB 127,67 ; jg 691f <.literal4+0x2a3>
+ DB 127,67 ; jg 697f <.literal4+0x2a3>
DB 129,128,128,59,0,0,128,63,129,128 ; addl $0x80813f80,0x3b80(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
@@ -11304,7 +11296,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6901 <.literal4+0x285>
+ DB 224,7 ; loopne 6961 <.literal4+0x285>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -11316,7 +11308,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 691d <.literal4+0x2a1>
+ DB 224,7 ; loopne 697d <.literal4+0x2a1>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -11327,7 +11319,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 6972 <.literal4+0x2f6>
+ DB 124,66 ; jl 69d2 <.literal4+0x2f6>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax)
@@ -11345,9 +11337,9 @@ ALIGN 4
DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax)
DB 0,0 ; add %al,(%rax)
DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax)
- DB 112,65 ; jo 69b5 <.literal4+0x339>
+ DB 112,65 ; jo 6a15 <.literal4+0x339>
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
- DB 127,67 ; jg 69c3 <.literal4+0x347>
+ DB 127,67 ; jg 6a23 <.literal4+0x347>
DB 0,128,0,0,0,0 ; add %al,0x0(%rax)
DB 0,128,0,4,0,128 ; add %al,-0x7ffffc00(%rax)
DB 0,0 ; add %al,(%rax)
@@ -11363,7 +11355,7 @@ ALIGN 4
DB 0,128,55,0,0,128 ; add %al,-0x7fffffc9(%rax)
DB 63 ; (bad)
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 6a03 <.literal4+0x387>
+ DB 127,71 ; jg 6a63 <.literal4+0x387>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,191,0,0,0 ; add %al,0xbf(%rax)
@@ -11632,8 +11624,9 @@ _sk_start_pipeline_sse41 LABEL PROC
DB 65,84 ; push %r12
DB 86 ; push %rsi
DB 87 ; push %rdi
+ DB 85 ; push %rbp
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp
DB 68,15,41,188,36,144,0,0,0 ; movaps %xmm15,0x90(%rsp)
DB 68,15,41,180,36,128,0,0,0 ; movaps %xmm14,0x80(%rsp)
DB 68,15,41,108,36,112 ; movaps %xmm13,0x70(%rsp)
@@ -11644,19 +11637,20 @@ _sk_start_pipeline_sse41 LABEL PROC
DB 68,15,41,68,36,32 ; movaps %xmm8,0x20(%rsp)
DB 15,41,124,36,16 ; movaps %xmm7,0x10(%rsp)
DB 15,41,52,36 ; movaps %xmm6,(%rsp)
- DB 77,137,205 ; mov %r9,%r13
- DB 77,137,198 ; mov %r8,%r14
- DB 72,137,203 ; mov %rcx,%rbx
- DB 72,137,214 ; mov %rdx,%rsi
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,199 ; mov %rax,%r15
- DB 73,137,244 ; mov %rsi,%r12
- DB 72,141,67,4 ; lea 0x4(%rbx),%rax
- DB 76,57,232 ; cmp %r13,%rax
- DB 118,5 ; jbe 73 <_sk_start_pipeline_sse41+0x73>
- DB 72,137,223 ; mov %rbx,%rdi
- DB 235,57 ; jmp ac <_sk_start_pipeline_sse41+0xac>
- DB 185,0,0,0,0 ; mov $0x0,%ecx
+ DB 76,137,195 ; mov %r8,%rbx
+ DB 73,137,214 ; mov %rdx,%r14
+ DB 72,137,205 ; mov %rcx,%rbp
+ DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15
+ DB 76,137,206 ; mov %r9,%rsi
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 73,137,196 ; mov %rax,%r12
+ DB 73,137,245 ; mov %rsi,%r13
+ DB 72,141,69,4 ; lea 0x4(%rbp),%rax
+ DB 72,57,216 ; cmp %rbx,%rax
+ DB 118,5 ; jbe 7c <_sk_start_pipeline_sse41+0x7c>
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 235,61 ; jmp b9 <_sk_start_pipeline_sse41+0xb9>
+ DB 65,184,0,0,0,0 ; mov $0x0,%r8d
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -11665,17 +11659,18 @@ _sk_start_pipeline_sse41 LABEL PROC
DB 15,87,237 ; xorps %xmm5,%xmm5
DB 15,87,246 ; xorps %xmm6,%xmm6
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 72,137,223 ; mov %rbx,%rdi
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 65,255,215 ; callq *%r15
- DB 72,141,123,4 ; lea 0x4(%rbx),%rdi
- DB 72,131,195,8 ; add $0x8,%rbx
- DB 76,57,235 ; cmp %r13,%rbx
- DB 72,137,251 ; mov %rdi,%rbx
- DB 118,199 ; jbe 73 <_sk_start_pipeline_sse41+0x73>
- DB 73,41,253 ; sub %rdi,%r13
- DB 116,36 ; je d5 <_sk_start_pipeline_sse41+0xd5>
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 65,255,212 ; callq *%r12
+ DB 72,141,85,4 ; lea 0x4(%rbp),%rdx
+ DB 72,131,197,8 ; add $0x8,%rbp
+ DB 72,57,221 ; cmp %rbx,%rbp
+ DB 72,137,213 ; mov %rdx,%rbp
+ DB 118,195 ; jbe 7c <_sk_start_pipeline_sse41+0x7c>
+ DB 72,41,211 ; sub %rdx,%rbx
+ DB 116,39 ; je e5 <_sk_start_pipeline_sse41+0xe5>
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -11684,10 +11679,11 @@ _sk_start_pipeline_sse41 LABEL PROC
DB 15,87,237 ; xorps %xmm5,%xmm5
DB 15,87,246 ; xorps %xmm6,%xmm6
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,233 ; mov %r13,%rcx
- DB 65,255,215 ; callq *%r15
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 73,137,216 ; mov %rbx,%r8
+ DB 65,255,212 ; callq *%r12
DB 15,40,52,36 ; movaps (%rsp),%xmm6
DB 15,40,124,36,16 ; movaps 0x10(%rsp),%xmm7
DB 68,15,40,68,36,32 ; movaps 0x20(%rsp),%xmm8
@@ -11698,8 +11694,9 @@ _sk_start_pipeline_sse41 LABEL PROC
DB 68,15,40,108,36,112 ; movaps 0x70(%rsp),%xmm13
DB 68,15,40,180,36,128,0,0,0 ; movaps 0x80(%rsp),%xmm14
DB 68,15,40,188,36,144,0,0,0 ; movaps 0x90(%rsp),%xmm15
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp
DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 95 ; pop %rdi
DB 94 ; pop %rsi
DB 65,92 ; pop %r12
@@ -11714,20 +11711,19 @@ _sk_just_return_sse41 LABEL PROC
PUBLIC _sk_seed_shader_sse41
_sk_seed_shader_sse41 LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 102,15,110,199 ; movd %edi,%xmm0
+ DB 102,15,110,194 ; movd %edx,%xmm0
DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
- DB 15,40,21,211,79,0,0 ; movaps 0x4fd3(%rip),%xmm2 # 5110 <_sk_callback_sse41+0xbd>
+ DB 15,40,21,20,80,0,0 ; movaps 0x5014(%rip),%xmm2 # 5160 <_sk_callback_sse41+0xd3>
DB 15,88,202 ; addps %xmm2,%xmm1
- DB 15,16,2 ; movups (%rdx),%xmm0
+ DB 15,16,7 ; movups (%rdi),%xmm0
DB 15,88,193 ; addps %xmm1,%xmm0
- DB 102,15,110,8 ; movd (%rax),%xmm1
+ DB 102,15,110,201 ; movd %ecx,%xmm1
DB 102,15,112,201,0 ; pshufd $0x0,%xmm1,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,21,194,79,0,0 ; movaps 0x4fc2(%rip),%xmm2 # 5120 <_sk_callback_sse41+0xcd>
+ DB 15,40,21,3,80,0,0 ; movaps 0x5003(%rip),%xmm2 # 5170 <_sk_callback_sse41+0xe3>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,87,237 ; xorps %xmm5,%xmm5
@@ -11738,22 +11734,21 @@ _sk_seed_shader_sse41 LABEL PROC
PUBLIC _sk_dither_sse41
_sk_dither_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 102,68,15,110,199 ; movd %edi,%xmm8
+ DB 102,68,15,110,194 ; movd %edx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
- DB 243,68,15,111,74,32 ; movdqu 0x20(%rdx),%xmm9
+ DB 243,68,15,111,79,32 ; movdqu 0x20(%rdi),%xmm9
DB 102,69,15,254,200 ; paddd %xmm8,%xmm9
- DB 76,139,0 ; mov (%rax),%r8
- DB 102,69,15,110,0 ; movd (%r8),%xmm8
+ DB 102,68,15,110,193 ; movd %ecx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 102,69,15,239,193 ; pxor %xmm9,%xmm8
- DB 102,68,15,111,21,141,79,0,0 ; movdqa 0x4f8d(%rip),%xmm10 # 5130 <_sk_callback_sse41+0xdd>
+ DB 102,68,15,111,21,209,79,0,0 ; movdqa 0x4fd1(%rip),%xmm10 # 5180 <_sk_callback_sse41+0xf3>
DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10
- DB 102,68,15,111,37,121,79,0,0 ; movdqa 0x4f79(%rip),%xmm12 # 5140 <_sk_callback_sse41+0xed>
- DB 102,68,15,111,45,128,79,0,0 ; movdqa 0x4f80(%rip),%xmm13 # 5150 <_sk_callback_sse41+0xfd>
+ DB 102,68,15,111,37,189,79,0,0 ; movdqa 0x4fbd(%rip),%xmm12 # 5190 <_sk_callback_sse41+0x103>
+ DB 102,68,15,111,45,196,79,0,0 ; movdqa 0x4fc4(%rip),%xmm13 # 51a0 <_sk_callback_sse41+0x113>
DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14
DB 102,69,15,219,245 ; pand %xmm13,%xmm14
DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14
@@ -11765,13 +11760,13 @@ _sk_dither_sse41 LABEL PROC
DB 102,65,15,114,209,2 ; psrld $0x2,%xmm9
DB 102,69,15,235,234 ; por %xmm10,%xmm13
DB 102,69,15,235,233 ; por %xmm9,%xmm13
- DB 102,69,15,235,235 ; por %xmm11,%xmm13
- DB 102,69,15,235,198 ; por %xmm14,%xmm8
- DB 102,69,15,235,197 ; por %xmm13,%xmm8
- DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,59,79,0,0 ; mulps 0x4f3b(%rip),%xmm8 # 5160 <_sk_callback_sse41+0x10d>
- DB 68,15,88,5,67,79,0,0 ; addps 0x4f43(%rip),%xmm8 # 5170 <_sk_callback_sse41+0x11d>
- DB 243,68,15,16,80,8 ; movss 0x8(%rax),%xmm10
+ DB 102,69,15,235,243 ; por %xmm11,%xmm14
+ DB 102,69,15,235,245 ; por %xmm13,%xmm14
+ DB 102,69,15,235,240 ; por %xmm8,%xmm14
+ DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8
+ DB 68,15,89,5,127,79,0,0 ; mulps 0x4f7f(%rip),%xmm8 # 51b0 <_sk_callback_sse41+0x123>
+ DB 68,15,88,5,135,79,0,0 ; addps 0x4f87(%rip),%xmm8 # 51c0 <_sk_callback_sse41+0x133>
+ DB 243,68,15,16,16 ; movss (%rax),%xmm10
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,88,194 ; addps %xmm10,%xmm0
@@ -11837,7 +11832,7 @@ _sk_clear_sse41 LABEL PROC
PUBLIC _sk_srcatop_sse41
_sk_srcatop_sse41 LABEL PROC
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 68,15,40,5,156,78,0,0 ; movaps 0x4e9c(%rip),%xmm8 # 5180 <_sk_callback_sse41+0x12d>
+ DB 68,15,40,5,225,78,0,0 ; movaps 0x4ee1(%rip),%xmm8 # 51d0 <_sk_callback_sse41+0x143>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -11860,7 +11855,7 @@ PUBLIC _sk_dstatop_sse41
_sk_dstatop_sse41 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
DB 68,15,89,196 ; mulps %xmm4,%xmm8
- DB 68,15,40,13,95,78,0,0 ; movaps 0x4e5f(%rip),%xmm9 # 5190 <_sk_callback_sse41+0x13d>
+ DB 68,15,40,13,164,78,0,0 ; movaps 0x4ea4(%rip),%xmm9 # 51e0 <_sk_callback_sse41+0x153>
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
@@ -11901,7 +11896,7 @@ _sk_dstin_sse41 LABEL PROC
PUBLIC _sk_srcout_sse41
_sk_srcout_sse41 LABEL PROC
- DB 68,15,40,5,3,78,0,0 ; movaps 0x4e03(%rip),%xmm8 # 51a0 <_sk_callback_sse41+0x14d>
+ DB 68,15,40,5,72,78,0,0 ; movaps 0x4e48(%rip),%xmm8 # 51f0 <_sk_callback_sse41+0x163>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
@@ -11912,7 +11907,7 @@ _sk_srcout_sse41 LABEL PROC
PUBLIC _sk_dstout_sse41
_sk_dstout_sse41 LABEL PROC
- DB 68,15,40,5,243,77,0,0 ; movaps 0x4df3(%rip),%xmm8 # 51b0 <_sk_callback_sse41+0x15d>
+ DB 68,15,40,5,56,78,0,0 ; movaps 0x4e38(%rip),%xmm8 # 5200 <_sk_callback_sse41+0x173>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
@@ -11927,7 +11922,7 @@ _sk_dstout_sse41 LABEL PROC
PUBLIC _sk_srcover_sse41
_sk_srcover_sse41 LABEL PROC
- DB 68,15,40,5,214,77,0,0 ; movaps 0x4dd6(%rip),%xmm8 # 51c0 <_sk_callback_sse41+0x16d>
+ DB 68,15,40,5,27,78,0,0 ; movaps 0x4e1b(%rip),%xmm8 # 5210 <_sk_callback_sse41+0x183>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -11945,7 +11940,7 @@ _sk_srcover_sse41 LABEL PROC
PUBLIC _sk_dstover_sse41
_sk_dstover_sse41 LABEL PROC
- DB 68,15,40,5,170,77,0,0 ; movaps 0x4daa(%rip),%xmm8 # 51d0 <_sk_callback_sse41+0x17d>
+ DB 68,15,40,5,239,77,0,0 ; movaps 0x4def(%rip),%xmm8 # 5220 <_sk_callback_sse41+0x193>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -11969,7 +11964,7 @@ _sk_modulate_sse41 LABEL PROC
PUBLIC _sk_multiply_sse41
_sk_multiply_sse41 LABEL PROC
- DB 68,15,40,5,126,77,0,0 ; movaps 0x4d7e(%rip),%xmm8 # 51e0 <_sk_callback_sse41+0x18d>
+ DB 68,15,40,5,195,77,0,0 ; movaps 0x4dc3(%rip),%xmm8 # 5230 <_sk_callback_sse41+0x1a3>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,209 ; movaps %xmm9,%xmm10
@@ -12038,7 +12033,7 @@ _sk_screen_sse41 LABEL PROC
PUBLIC _sk_xor__sse41
_sk_xor__sse41 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
- DB 15,40,29,179,76,0,0 ; movaps 0x4cb3(%rip),%xmm3 # 51f0 <_sk_callback_sse41+0x19d>
+ DB 15,40,29,248,76,0,0 ; movaps 0x4cf8(%rip),%xmm3 # 5240 <_sk_callback_sse41+0x1b3>
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
@@ -12084,7 +12079,7 @@ _sk_darken_sse41 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,95,209 ; maxps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,30,76,0,0 ; movaps 0x4c1e(%rip),%xmm2 # 5200 <_sk_callback_sse41+0x1ad>
+ DB 15,40,21,99,76,0,0 ; movaps 0x4c63(%rip),%xmm2 # 5250 <_sk_callback_sse41+0x1c3>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -12116,7 +12111,7 @@ _sk_lighten_sse41 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,195,75,0,0 ; movaps 0x4bc3(%rip),%xmm2 # 5210 <_sk_callback_sse41+0x1bd>
+ DB 15,40,21,8,76,0,0 ; movaps 0x4c08(%rip),%xmm2 # 5260 <_sk_callback_sse41+0x1d3>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -12151,7 +12146,7 @@ _sk_difference_sse41 LABEL PROC
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,93,75,0,0 ; movaps 0x4b5d(%rip),%xmm2 # 5220 <_sk_callback_sse41+0x1cd>
+ DB 15,40,21,162,75,0,0 ; movaps 0x4ba2(%rip),%xmm2 # 5270 <_sk_callback_sse41+0x1e3>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -12177,7 +12172,7 @@ _sk_exclusion_sse41 LABEL PROC
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,29,75,0,0 ; movaps 0x4b1d(%rip),%xmm2 # 5230 <_sk_callback_sse41+0x1dd>
+ DB 15,40,21,98,75,0,0 ; movaps 0x4b62(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x1f3>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -12188,7 +12183,7 @@ _sk_exclusion_sse41 LABEL PROC
PUBLIC _sk_colorburn_sse41
_sk_colorburn_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,16,75,0,0 ; movaps 0x4b10(%rip),%xmm10 # 5240 <_sk_callback_sse41+0x1ed>
+ DB 68,15,40,21,85,75,0,0 ; movaps 0x4b55(%rip),%xmm10 # 5290 <_sk_callback_sse41+0x203>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,203 ; movaps %xmm11,%xmm9
@@ -12268,7 +12263,7 @@ _sk_colorburn_sse41 LABEL PROC
PUBLIC _sk_colordodge_sse41
_sk_colordodge_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,238,73,0,0 ; movaps 0x49ee(%rip),%xmm10 # 5250 <_sk_callback_sse41+0x1fd>
+ DB 68,15,40,21,51,74,0,0 ; movaps 0x4a33(%rip),%xmm10 # 52a0 <_sk_callback_sse41+0x213>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
@@ -12349,7 +12344,7 @@ _sk_hardlight_sse41 LABEL PROC
DB 15,40,244 ; movaps %xmm4,%xmm6
DB 15,40,227 ; movaps %xmm3,%xmm4
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 68,15,40,21,196,72,0,0 ; movaps 0x48c4(%rip),%xmm10 # 5260 <_sk_callback_sse41+0x20d>
+ DB 68,15,40,21,9,73,0,0 ; movaps 0x4909(%rip),%xmm10 # 52b0 <_sk_callback_sse41+0x223>
DB 65,15,40,234 ; movaps %xmm10,%xmm5
DB 15,92,239 ; subps %xmm7,%xmm5
DB 15,40,197 ; movaps %xmm5,%xmm0
@@ -12431,7 +12426,7 @@ PUBLIC _sk_overlay_sse41
_sk_overlay_sse41 LABEL PROC
DB 68,15,40,201 ; movaps %xmm1,%xmm9
DB 68,15,40,240 ; movaps %xmm0,%xmm14
- DB 68,15,40,21,166,71,0,0 ; movaps 0x47a6(%rip),%xmm10 # 5270 <_sk_callback_sse41+0x21d>
+ DB 68,15,40,21,235,71,0,0 ; movaps 0x47eb(%rip),%xmm10 # 52c0 <_sk_callback_sse41+0x233>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 65,15,40,195 ; movaps %xmm11,%xmm0
@@ -12515,7 +12510,7 @@ _sk_softlight_sse41 LABEL PROC
DB 15,40,198 ; movaps %xmm6,%xmm0
DB 15,94,199 ; divps %xmm7,%xmm0
DB 65,15,84,193 ; andps %xmm9,%xmm0
- DB 15,40,13,121,70,0,0 ; movaps 0x4679(%rip),%xmm1 # 5280 <_sk_callback_sse41+0x22d>
+ DB 15,40,13,190,70,0,0 ; movaps 0x46be(%rip),%xmm1 # 52d0 <_sk_callback_sse41+0x243>
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 68,15,92,208 ; subps %xmm0,%xmm10
DB 68,15,40,240 ; movaps %xmm0,%xmm14
@@ -12528,10 +12523,10 @@ _sk_softlight_sse41 LABEL PROC
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,89,210 ; mulps %xmm2,%xmm2
DB 15,88,208 ; addps %xmm0,%xmm2
- DB 68,15,40,45,87,70,0,0 ; movaps 0x4657(%rip),%xmm13 # 5290 <_sk_callback_sse41+0x23d>
+ DB 68,15,40,45,156,70,0,0 ; movaps 0x469c(%rip),%xmm13 # 52e0 <_sk_callback_sse41+0x253>
DB 69,15,88,245 ; addps %xmm13,%xmm14
DB 68,15,89,242 ; mulps %xmm2,%xmm14
- DB 68,15,40,37,87,70,0,0 ; movaps 0x4657(%rip),%xmm12 # 52a0 <_sk_callback_sse41+0x24d>
+ DB 68,15,40,37,156,70,0,0 ; movaps 0x469c(%rip),%xmm12 # 52f0 <_sk_callback_sse41+0x263>
DB 69,15,89,252 ; mulps %xmm12,%xmm15
DB 69,15,88,254 ; addps %xmm14,%xmm15
DB 15,40,198 ; movaps %xmm6,%xmm0
@@ -12717,12 +12712,12 @@ _sk_hue_sse41 LABEL PROC
DB 68,15,84,208 ; andps %xmm0,%xmm10
DB 15,84,200 ; andps %xmm0,%xmm1
DB 68,15,84,232 ; andps %xmm0,%xmm13
- DB 15,40,5,189,67,0,0 ; movaps 0x43bd(%rip),%xmm0 # 52b0 <_sk_callback_sse41+0x25d>
+ DB 15,40,5,2,68,0,0 ; movaps 0x4402(%rip),%xmm0 # 5300 <_sk_callback_sse41+0x273>
DB 68,15,89,224 ; mulps %xmm0,%xmm12
- DB 15,40,21,194,67,0,0 ; movaps 0x43c2(%rip),%xmm2 # 52c0 <_sk_callback_sse41+0x26d>
+ DB 15,40,21,7,68,0,0 ; movaps 0x4407(%rip),%xmm2 # 5310 <_sk_callback_sse41+0x283>
DB 15,89,250 ; mulps %xmm2,%xmm7
DB 65,15,88,252 ; addps %xmm12,%xmm7
- DB 68,15,40,53,195,67,0,0 ; movaps 0x43c3(%rip),%xmm14 # 52d0 <_sk_callback_sse41+0x27d>
+ DB 68,15,40,53,8,68,0,0 ; movaps 0x4408(%rip),%xmm14 # 5320 <_sk_callback_sse41+0x293>
DB 68,15,40,252 ; movaps %xmm4,%xmm15
DB 69,15,89,254 ; mulps %xmm14,%xmm15
DB 68,15,88,255 ; addps %xmm7,%xmm15
@@ -12805,7 +12800,7 @@ _sk_hue_sse41 LABEL PROC
DB 65,15,88,214 ; addps %xmm14,%xmm2
DB 15,40,196 ; movaps %xmm4,%xmm0
DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1
- DB 68,15,40,13,136,66,0,0 ; movaps 0x4288(%rip),%xmm9 # 52e0 <_sk_callback_sse41+0x28d>
+ DB 68,15,40,13,205,66,0,0 ; movaps 0x42cd(%rip),%xmm9 # 5330 <_sk_callback_sse41+0x2a3>
DB 65,15,40,225 ; movaps %xmm9,%xmm4
DB 15,92,229 ; subps %xmm5,%xmm4
DB 15,40,68,36,48 ; movaps 0x30(%rsp),%xmm0
@@ -12899,14 +12894,14 @@ _sk_saturation_sse41 LABEL PROC
DB 68,15,84,215 ; andps %xmm7,%xmm10
DB 68,15,84,223 ; andps %xmm7,%xmm11
DB 68,15,84,199 ; andps %xmm7,%xmm8
- DB 15,40,21,59,65,0,0 ; movaps 0x413b(%rip),%xmm2 # 52f0 <_sk_callback_sse41+0x29d>
+ DB 15,40,21,128,65,0,0 ; movaps 0x4180(%rip),%xmm2 # 5340 <_sk_callback_sse41+0x2b3>
DB 15,40,221 ; movaps %xmm5,%xmm3
DB 15,89,218 ; mulps %xmm2,%xmm3
- DB 15,40,13,62,65,0,0 ; movaps 0x413e(%rip),%xmm1 # 5300 <_sk_callback_sse41+0x2ad>
+ DB 15,40,13,131,65,0,0 ; movaps 0x4183(%rip),%xmm1 # 5350 <_sk_callback_sse41+0x2c3>
DB 15,40,254 ; movaps %xmm6,%xmm7
DB 15,89,249 ; mulps %xmm1,%xmm7
DB 15,88,251 ; addps %xmm3,%xmm7
- DB 68,15,40,45,61,65,0,0 ; movaps 0x413d(%rip),%xmm13 # 5310 <_sk_callback_sse41+0x2bd>
+ DB 68,15,40,45,130,65,0,0 ; movaps 0x4182(%rip),%xmm13 # 5360 <_sk_callback_sse41+0x2d3>
DB 69,15,89,245 ; mulps %xmm13,%xmm14
DB 68,15,88,247 ; addps %xmm7,%xmm14
DB 65,15,40,218 ; movaps %xmm10,%xmm3
@@ -12987,7 +12982,7 @@ _sk_saturation_sse41 LABEL PROC
DB 65,15,88,253 ; addps %xmm13,%xmm7
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 102,68,15,56,20,223 ; blendvps %xmm0,%xmm7,%xmm11
- DB 68,15,40,13,3,64,0,0 ; movaps 0x4003(%rip),%xmm9 # 5320 <_sk_callback_sse41+0x2cd>
+ DB 68,15,40,13,72,64,0,0 ; movaps 0x4048(%rip),%xmm9 # 5370 <_sk_callback_sse41+0x2e3>
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 68,15,92,204 ; subps %xmm4,%xmm9
DB 15,40,60,36 ; movaps (%rsp),%xmm7
@@ -13042,14 +13037,14 @@ _sk_color_sse41 LABEL PROC
DB 15,40,231 ; movaps %xmm7,%xmm4
DB 68,15,89,244 ; mulps %xmm4,%xmm14
DB 15,89,204 ; mulps %xmm4,%xmm1
- DB 68,15,40,13,72,63,0,0 ; movaps 0x3f48(%rip),%xmm9 # 5330 <_sk_callback_sse41+0x2dd>
+ DB 68,15,40,13,141,63,0,0 ; movaps 0x3f8d(%rip),%xmm9 # 5380 <_sk_callback_sse41+0x2f3>
DB 65,15,40,250 ; movaps %xmm10,%xmm7
DB 65,15,89,249 ; mulps %xmm9,%xmm7
- DB 68,15,40,21,72,63,0,0 ; movaps 0x3f48(%rip),%xmm10 # 5340 <_sk_callback_sse41+0x2ed>
+ DB 68,15,40,21,141,63,0,0 ; movaps 0x3f8d(%rip),%xmm10 # 5390 <_sk_callback_sse41+0x303>
DB 65,15,40,219 ; movaps %xmm11,%xmm3
DB 65,15,89,218 ; mulps %xmm10,%xmm3
DB 15,88,223 ; addps %xmm7,%xmm3
- DB 68,15,40,29,69,63,0,0 ; movaps 0x3f45(%rip),%xmm11 # 5350 <_sk_callback_sse41+0x2fd>
+ DB 68,15,40,29,138,63,0,0 ; movaps 0x3f8a(%rip),%xmm11 # 53a0 <_sk_callback_sse41+0x313>
DB 69,15,40,236 ; movaps %xmm12,%xmm13
DB 69,15,89,235 ; mulps %xmm11,%xmm13
DB 68,15,88,235 ; addps %xmm3,%xmm13
@@ -13134,7 +13129,7 @@ _sk_color_sse41 LABEL PROC
DB 65,15,88,251 ; addps %xmm11,%xmm7
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 102,15,56,20,207 ; blendvps %xmm0,%xmm7,%xmm1
- DB 68,15,40,13,1,62,0,0 ; movaps 0x3e01(%rip),%xmm9 # 5360 <_sk_callback_sse41+0x30d>
+ DB 68,15,40,13,70,62,0,0 ; movaps 0x3e46(%rip),%xmm9 # 53b0 <_sk_callback_sse41+0x323>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,92,196 ; subps %xmm4,%xmm0
DB 68,15,89,192 ; mulps %xmm0,%xmm8
@@ -13186,13 +13181,13 @@ _sk_luminosity_sse41 LABEL PROC
DB 69,15,89,216 ; mulps %xmm8,%xmm11
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,89,205 ; mulps %xmm5,%xmm9
- DB 68,15,40,5,83,61,0,0 ; movaps 0x3d53(%rip),%xmm8 # 5370 <_sk_callback_sse41+0x31d>
+ DB 68,15,40,5,152,61,0,0 ; movaps 0x3d98(%rip),%xmm8 # 53c0 <_sk_callback_sse41+0x333>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
- DB 68,15,40,21,87,61,0,0 ; movaps 0x3d57(%rip),%xmm10 # 5380 <_sk_callback_sse41+0x32d>
+ DB 68,15,40,21,156,61,0,0 ; movaps 0x3d9c(%rip),%xmm10 # 53d0 <_sk_callback_sse41+0x343>
DB 15,40,233 ; movaps %xmm1,%xmm5
DB 65,15,89,234 ; mulps %xmm10,%xmm5
DB 15,88,232 ; addps %xmm0,%xmm5
- DB 68,15,40,37,85,61,0,0 ; movaps 0x3d55(%rip),%xmm12 # 5390 <_sk_callback_sse41+0x33d>
+ DB 68,15,40,37,154,61,0,0 ; movaps 0x3d9a(%rip),%xmm12 # 53e0 <_sk_callback_sse41+0x353>
DB 68,15,40,242 ; movaps %xmm2,%xmm14
DB 69,15,89,244 ; mulps %xmm12,%xmm14
DB 68,15,88,245 ; addps %xmm5,%xmm14
@@ -13277,7 +13272,7 @@ _sk_luminosity_sse41 LABEL PROC
DB 65,15,88,244 ; addps %xmm12,%xmm6
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 102,68,15,56,20,206 ; blendvps %xmm0,%xmm6,%xmm9
- DB 15,40,5,11,60,0,0 ; movaps 0x3c0b(%rip),%xmm0 # 53a0 <_sk_callback_sse41+0x34d>
+ DB 15,40,5,80,60,0,0 ; movaps 0x3c50(%rip),%xmm0 # 53f0 <_sk_callback_sse41+0x363>
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,92,215 ; subps %xmm7,%xmm2
DB 15,89,226 ; mulps %xmm2,%xmm4
@@ -13315,24 +13310,24 @@ PUBLIC _sk_srcover_rgba_8888_sse41
_sk_srcover_rgba_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,217,0,0,0 ; jne 18ec <_sk_srcover_rgba_8888_sse41+0xe7>
- DB 243,15,111,60,184 ; movdqu (%rax,%rdi,4),%xmm7
- DB 72,133,201 ; test %rcx,%rcx
- DB 102,15,111,37,141,59,0,0 ; movdqa 0x3b8d(%rip),%xmm4 # 53b0 <_sk_callback_sse41+0x35d>
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,217,0,0,0 ; jne 18f7 <_sk_srcover_rgba_8888_sse41+0xe7>
+ DB 243,15,111,60,144 ; movdqu (%rax,%rdx,4),%xmm7
+ DB 77,133,192 ; test %r8,%r8
+ DB 102,15,111,37,210,59,0,0 ; movdqa 0x3bd2(%rip),%xmm4 # 5400 <_sk_callback_sse41+0x373>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
DB 102,15,111,239 ; movdqa %xmm7,%xmm5
- DB 102,15,56,0,45,137,59,0,0 ; pshufb 0x3b89(%rip),%xmm5 # 53c0 <_sk_callback_sse41+0x36d>
+ DB 102,15,56,0,45,206,59,0,0 ; pshufb 0x3bce(%rip),%xmm5 # 5410 <_sk_callback_sse41+0x383>
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
DB 102,15,111,247 ; movdqa %xmm7,%xmm6
- DB 102,15,56,0,53,137,59,0,0 ; pshufb 0x3b89(%rip),%xmm6 # 53d0 <_sk_callback_sse41+0x37d>
+ DB 102,15,56,0,53,206,59,0,0 ; pshufb 0x3bce(%rip),%xmm6 # 5420 <_sk_callback_sse41+0x393>
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 102,15,114,215,24 ; psrld $0x18,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 68,15,40,5,134,59,0,0 ; movaps 0x3b86(%rip),%xmm8 # 53e0 <_sk_callback_sse41+0x38d>
+ DB 68,15,40,5,203,59,0,0 ; movaps 0x3bcb(%rip),%xmm8 # 5430 <_sk_callback_sse41+0x3a3>
DB 68,15,92,195 ; subps %xmm3,%xmm8
- DB 68,15,40,37,138,59,0,0 ; movaps 0x3b8a(%rip),%xmm12 # 53f0 <_sk_callback_sse41+0x39d>
+ DB 68,15,40,37,207,59,0,0 ; movaps 0x3bcf(%rip),%xmm12 # 5440 <_sk_callback_sse41+0x3b3>
DB 65,15,89,196 ; mulps %xmm12,%xmm0
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -13358,40 +13353,40 @@ _sk_srcover_rgba_8888_sse41 LABEL PROC
DB 102,15,114,240,24 ; pslld $0x18,%xmm0
DB 102,15,235,194 ; por %xmm2,%xmm0
DB 102,15,235,193 ; por %xmm1,%xmm0
- DB 117,89 ; jne 192c <_sk_srcover_rgba_8888_sse41+0x127>
- DB 243,15,127,4,184 ; movdqu %xmm0,(%rax,%rdi,4)
+ DB 117,89 ; jne 1937 <_sk_srcover_rgba_8888_sse41+0x127>
+ DB 243,15,127,4,144 ; movdqu %xmm0,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 65,15,40,202 ; movaps %xmm10,%xmm1
DB 65,15,40,211 ; movaps %xmm11,%xmm2
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,255 ; pxor %xmm7,%xmm7
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,35 ; je 1920 <_sk_srcover_rgba_8888_sse41+0x11b>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 1918 <_sk_srcover_rgba_8888_sse41+0x113>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 15,133,11,255,255,255 ; jne 1818 <_sk_srcover_rgba_8888_sse41+0x13>
- DB 102,15,110,100,184,8 ; movd 0x8(%rax,%rdi,4),%xmm4
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,35 ; je 192b <_sk_srcover_rgba_8888_sse41+0x11b>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 1923 <_sk_srcover_rgba_8888_sse41+0x113>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 15,133,11,255,255,255 ; jne 1823 <_sk_srcover_rgba_8888_sse41+0x13>
+ DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7
- DB 102,15,58,34,124,184,4,1 ; pinsrd $0x1,0x4(%rax,%rdi,4),%xmm7
- DB 102,15,58,34,60,184,0 ; pinsrd $0x0,(%rax,%rdi,4),%xmm7
- DB 233,236,254,255,255 ; jmpq 1818 <_sk_srcover_rgba_8888_sse41+0x13>
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,28 ; je 1955 <_sk_srcover_rgba_8888_sse41+0x150>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,14 ; je 194d <_sk_srcover_rgba_8888_sse41+0x148>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,147 ; jne 18d8 <_sk_srcover_rgba_8888_sse41+0xd3>
- DB 102,15,58,22,68,184,8,2 ; pextrd $0x2,%xmm0,0x8(%rax,%rdi,4)
- DB 102,15,58,22,68,184,4,1 ; pextrd $0x1,%xmm0,0x4(%rax,%rdi,4)
- DB 102,15,126,4,184 ; movd %xmm0,(%rax,%rdi,4)
- DB 233,121,255,255,255 ; jmpq 18d8 <_sk_srcover_rgba_8888_sse41+0xd3>
+ DB 102,15,58,34,124,144,4,1 ; pinsrd $0x1,0x4(%rax,%rdx,4),%xmm7
+ DB 102,15,58,34,60,144,0 ; pinsrd $0x0,(%rax,%rdx,4),%xmm7
+ DB 233,236,254,255,255 ; jmpq 1823 <_sk_srcover_rgba_8888_sse41+0x13>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,28 ; je 1960 <_sk_srcover_rgba_8888_sse41+0x150>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,14 ; je 1958 <_sk_srcover_rgba_8888_sse41+0x148>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,147 ; jne 18e3 <_sk_srcover_rgba_8888_sse41+0xd3>
+ DB 102,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm0,0x8(%rax,%rdx,4)
+ DB 102,15,58,22,68,144,4,1 ; pextrd $0x1,%xmm0,0x4(%rax,%rdx,4)
+ DB 102,15,126,4,144 ; movd %xmm0,(%rax,%rdx,4)
+ DB 233,121,255,255,255 ; jmpq 18e3 <_sk_srcover_rgba_8888_sse41+0xd3>
PUBLIC _sk_clamp_0_sse41
_sk_clamp_0_sse41 LABEL PROC
@@ -13405,7 +13400,7 @@ _sk_clamp_0_sse41 LABEL PROC
PUBLIC _sk_clamp_1_sse41
_sk_clamp_1_sse41 LABEL PROC
- DB 68,15,40,5,129,58,0,0 ; movaps 0x3a81(%rip),%xmm8 # 5400 <_sk_callback_sse41+0x3ad>
+ DB 68,15,40,5,198,58,0,0 ; movaps 0x3ac6(%rip),%xmm8 # 5450 <_sk_callback_sse41+0x3c3>
DB 65,15,93,192 ; minps %xmm8,%xmm0
DB 65,15,93,200 ; minps %xmm8,%xmm1
DB 65,15,93,208 ; minps %xmm8,%xmm2
@@ -13415,7 +13410,7 @@ _sk_clamp_1_sse41 LABEL PROC
PUBLIC _sk_clamp_a_sse41
_sk_clamp_a_sse41 LABEL PROC
- DB 15,93,29,118,58,0,0 ; minps 0x3a76(%rip),%xmm3 # 5410 <_sk_callback_sse41+0x3bd>
+ DB 15,93,29,187,58,0,0 ; minps 0x3abb(%rip),%xmm3 # 5460 <_sk_callback_sse41+0x3d3>
DB 15,93,195 ; minps %xmm3,%xmm0
DB 15,93,203 ; minps %xmm3,%xmm1
DB 15,93,211 ; minps %xmm3,%xmm2
@@ -13488,7 +13483,7 @@ _sk_premul_sse41 LABEL PROC
PUBLIC _sk_unpremul_sse41
_sk_unpremul_sse41 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
- DB 68,15,40,13,225,57,0,0 ; movaps 0x39e1(%rip),%xmm9 # 5420 <_sk_callback_sse41+0x3cd>
+ DB 68,15,40,13,38,58,0,0 ; movaps 0x3a26(%rip),%xmm9 # 5470 <_sk_callback_sse41+0x3e3>
DB 68,15,94,203 ; divps %xmm3,%xmm9
DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8
DB 69,15,84,193 ; andps %xmm9,%xmm8
@@ -13500,20 +13495,20 @@ _sk_unpremul_sse41 LABEL PROC
PUBLIC _sk_from_srgb_sse41
_sk_from_srgb_sse41 LABEL PROC
- DB 68,15,40,29,204,57,0,0 ; movaps 0x39cc(%rip),%xmm11 # 5430 <_sk_callback_sse41+0x3dd>
+ DB 68,15,40,29,17,58,0,0 ; movaps 0x3a11(%rip),%xmm11 # 5480 <_sk_callback_sse41+0x3f3>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
DB 68,15,40,208 ; movaps %xmm0,%xmm10
DB 69,15,89,210 ; mulps %xmm10,%xmm10
- DB 68,15,40,37,196,57,0,0 ; movaps 0x39c4(%rip),%xmm12 # 5440 <_sk_callback_sse41+0x3ed>
+ DB 68,15,40,37,9,58,0,0 ; movaps 0x3a09(%rip),%xmm12 # 5490 <_sk_callback_sse41+0x403>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,196 ; mulps %xmm12,%xmm8
- DB 68,15,40,45,196,57,0,0 ; movaps 0x39c4(%rip),%xmm13 # 5450 <_sk_callback_sse41+0x3fd>
+ DB 68,15,40,45,9,58,0,0 ; movaps 0x3a09(%rip),%xmm13 # 54a0 <_sk_callback_sse41+0x413>
DB 69,15,88,197 ; addps %xmm13,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
- DB 68,15,40,53,196,57,0,0 ; movaps 0x39c4(%rip),%xmm14 # 5460 <_sk_callback_sse41+0x40d>
+ DB 68,15,40,53,9,58,0,0 ; movaps 0x3a09(%rip),%xmm14 # 54b0 <_sk_callback_sse41+0x423>
DB 69,15,88,198 ; addps %xmm14,%xmm8
- DB 68,15,40,61,200,57,0,0 ; movaps 0x39c8(%rip),%xmm15 # 5470 <_sk_callback_sse41+0x41d>
+ DB 68,15,40,61,13,58,0,0 ; movaps 0x3a0d(%rip),%xmm15 # 54c0 <_sk_callback_sse41+0x433>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 68,15,40,209 ; movaps %xmm1,%xmm10
@@ -13555,22 +13550,22 @@ _sk_to_srgb_sse41 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 68,15,82,192 ; rsqrtps %xmm0,%xmm8
- DB 68,15,40,29,61,57,0,0 ; movaps 0x393d(%rip),%xmm11 # 5480 <_sk_callback_sse41+0x42d>
+ DB 68,15,40,29,130,57,0,0 ; movaps 0x3982(%rip),%xmm11 # 54d0 <_sk_callback_sse41+0x443>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
- DB 68,15,40,37,61,57,0,0 ; movaps 0x393d(%rip),%xmm12 # 5490 <_sk_callback_sse41+0x43d>
+ DB 68,15,40,37,130,57,0,0 ; movaps 0x3982(%rip),%xmm12 # 54e0 <_sk_callback_sse41+0x453>
DB 69,15,40,248 ; movaps %xmm8,%xmm15
DB 69,15,89,252 ; mulps %xmm12,%xmm15
- DB 68,15,40,21,61,57,0,0 ; movaps 0x393d(%rip),%xmm10 # 54a0 <_sk_callback_sse41+0x44d>
+ DB 68,15,40,21,130,57,0,0 ; movaps 0x3982(%rip),%xmm10 # 54f0 <_sk_callback_sse41+0x463>
DB 69,15,88,250 ; addps %xmm10,%xmm15
DB 69,15,89,248 ; mulps %xmm8,%xmm15
- DB 68,15,40,45,61,57,0,0 ; movaps 0x393d(%rip),%xmm13 # 54b0 <_sk_callback_sse41+0x45d>
+ DB 68,15,40,45,130,57,0,0 ; movaps 0x3982(%rip),%xmm13 # 5500 <_sk_callback_sse41+0x473>
DB 69,15,88,253 ; addps %xmm13,%xmm15
- DB 68,15,40,53,65,57,0,0 ; movaps 0x3941(%rip),%xmm14 # 54c0 <_sk_callback_sse41+0x46d>
+ DB 68,15,40,53,134,57,0,0 ; movaps 0x3986(%rip),%xmm14 # 5510 <_sk_callback_sse41+0x483>
DB 69,15,88,198 ; addps %xmm14,%xmm8
DB 69,15,83,192 ; rcpps %xmm8,%xmm8
DB 69,15,89,199 ; mulps %xmm15,%xmm8
- DB 68,15,40,61,61,57,0,0 ; movaps 0x393d(%rip),%xmm15 # 54d0 <_sk_callback_sse41+0x47d>
+ DB 68,15,40,61,130,57,0,0 ; movaps 0x3982(%rip),%xmm15 # 5520 <_sk_callback_sse41+0x493>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 68,15,82,202 ; rsqrtps %xmm2,%xmm9
@@ -13622,7 +13617,7 @@ _sk_rgb_to_hsl_sse41 LABEL PROC
DB 68,15,93,226 ; minps %xmm2,%xmm12
DB 65,15,40,203 ; movaps %xmm11,%xmm1
DB 65,15,92,204 ; subps %xmm12,%xmm1
- DB 68,15,40,53,135,56,0,0 ; movaps 0x3887(%rip),%xmm14 # 54e0 <_sk_callback_sse41+0x48d>
+ DB 68,15,40,53,204,56,0,0 ; movaps 0x38cc(%rip),%xmm14 # 5530 <_sk_callback_sse41+0x4a3>
DB 68,15,94,241 ; divps %xmm1,%xmm14
DB 69,15,40,211 ; movaps %xmm11,%xmm10
DB 69,15,194,208,0 ; cmpeqps %xmm8,%xmm10
@@ -13631,27 +13626,27 @@ _sk_rgb_to_hsl_sse41 LABEL PROC
DB 65,15,89,198 ; mulps %xmm14,%xmm0
DB 69,15,40,249 ; movaps %xmm9,%xmm15
DB 68,15,194,250,1 ; cmpltps %xmm2,%xmm15
- DB 68,15,84,61,110,56,0,0 ; andps 0x386e(%rip),%xmm15 # 54f0 <_sk_callback_sse41+0x49d>
+ DB 68,15,84,61,179,56,0,0 ; andps 0x38b3(%rip),%xmm15 # 5540 <_sk_callback_sse41+0x4b3>
DB 68,15,88,248 ; addps %xmm0,%xmm15
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,194,193,0 ; cmpeqps %xmm9,%xmm0
DB 65,15,92,208 ; subps %xmm8,%xmm2
DB 65,15,89,214 ; mulps %xmm14,%xmm2
- DB 68,15,40,45,97,56,0,0 ; movaps 0x3861(%rip),%xmm13 # 5500 <_sk_callback_sse41+0x4ad>
+ DB 68,15,40,45,166,56,0,0 ; movaps 0x38a6(%rip),%xmm13 # 5550 <_sk_callback_sse41+0x4c3>
DB 65,15,88,213 ; addps %xmm13,%xmm2
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 69,15,89,198 ; mulps %xmm14,%xmm8
- DB 68,15,88,5,93,56,0,0 ; addps 0x385d(%rip),%xmm8 # 5510 <_sk_callback_sse41+0x4bd>
+ DB 68,15,88,5,162,56,0,0 ; addps 0x38a2(%rip),%xmm8 # 5560 <_sk_callback_sse41+0x4d3>
DB 102,68,15,56,20,194 ; blendvps %xmm0,%xmm2,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 102,69,15,56,20,199 ; blendvps %xmm0,%xmm15,%xmm8
- DB 68,15,89,5,85,56,0,0 ; mulps 0x3855(%rip),%xmm8 # 5520 <_sk_callback_sse41+0x4cd>
+ DB 68,15,89,5,154,56,0,0 ; mulps 0x389a(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x4e3>
DB 69,15,40,203 ; movaps %xmm11,%xmm9
DB 69,15,194,204,4 ; cmpneqps %xmm12,%xmm9
DB 69,15,84,193 ; andps %xmm9,%xmm8
DB 69,15,92,235 ; subps %xmm11,%xmm13
DB 69,15,88,220 ; addps %xmm12,%xmm11
- DB 15,40,5,73,56,0,0 ; movaps 0x3849(%rip),%xmm0 # 5530 <_sk_callback_sse41+0x4dd>
+ DB 15,40,5,142,56,0,0 ; movaps 0x388e(%rip),%xmm0 # 5580 <_sk_callback_sse41+0x4f3>
DB 65,15,40,211 ; movaps %xmm11,%xmm2
DB 15,89,208 ; mulps %xmm0,%xmm2
DB 15,194,194,1 ; cmpltps %xmm2,%xmm0
@@ -13672,7 +13667,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 15,41,100,36,32 ; movaps %xmm4,0x20(%rsp)
DB 15,41,92,36,16 ; movaps %xmm3,0x10(%rsp)
DB 68,15,40,208 ; movaps %xmm0,%xmm10
- DB 68,15,40,13,11,56,0,0 ; movaps 0x380b(%rip),%xmm9 # 5540 <_sk_callback_sse41+0x4ed>
+ DB 68,15,40,13,80,56,0,0 ; movaps 0x3850(%rip),%xmm9 # 5590 <_sk_callback_sse41+0x503>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,194,194,2 ; cmpleps %xmm2,%xmm0
DB 15,40,217 ; movaps %xmm1,%xmm3
@@ -13685,19 +13680,19 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 15,41,20,36 ; movaps %xmm2,(%rsp)
DB 69,15,88,192 ; addps %xmm8,%xmm8
DB 68,15,92,197 ; subps %xmm5,%xmm8
- DB 68,15,40,53,231,55,0,0 ; movaps 0x37e7(%rip),%xmm14 # 5550 <_sk_callback_sse41+0x4fd>
+ DB 68,15,40,53,44,56,0,0 ; movaps 0x382c(%rip),%xmm14 # 55a0 <_sk_callback_sse41+0x513>
DB 69,15,88,242 ; addps %xmm10,%xmm14
DB 102,65,15,58,8,198,1 ; roundps $0x1,%xmm14,%xmm0
DB 68,15,92,240 ; subps %xmm0,%xmm14
- DB 68,15,40,29,224,55,0,0 ; movaps 0x37e0(%rip),%xmm11 # 5560 <_sk_callback_sse41+0x50d>
+ DB 68,15,40,29,37,56,0,0 ; movaps 0x3825(%rip),%xmm11 # 55b0 <_sk_callback_sse41+0x523>
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 15,40,245 ; movaps %xmm5,%xmm6
DB 65,15,92,240 ; subps %xmm8,%xmm6
- DB 15,40,61,217,55,0,0 ; movaps 0x37d9(%rip),%xmm7 # 5570 <_sk_callback_sse41+0x51d>
+ DB 15,40,61,30,56,0,0 ; movaps 0x381e(%rip),%xmm7 # 55c0 <_sk_callback_sse41+0x533>
DB 69,15,40,238 ; movaps %xmm14,%xmm13
DB 68,15,89,239 ; mulps %xmm7,%xmm13
- DB 15,40,29,218,55,0,0 ; movaps 0x37da(%rip),%xmm3 # 5580 <_sk_callback_sse41+0x52d>
+ DB 15,40,29,31,56,0,0 ; movaps 0x381f(%rip),%xmm3 # 55d0 <_sk_callback_sse41+0x543>
DB 68,15,40,227 ; movaps %xmm3,%xmm12
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 68,15,89,230 ; mulps %xmm6,%xmm12
@@ -13707,7 +13702,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 68,15,40,253 ; movaps %xmm5,%xmm15
DB 102,69,15,56,20,252 ; blendvps %xmm0,%xmm12,%xmm15
- DB 68,15,40,37,185,55,0,0 ; movaps 0x37b9(%rip),%xmm12 # 5590 <_sk_callback_sse41+0x53d>
+ DB 68,15,40,37,254,55,0,0 ; movaps 0x37fe(%rip),%xmm12 # 55e0 <_sk_callback_sse41+0x553>
DB 65,15,40,196 ; movaps %xmm12,%xmm0
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 68,15,89,238 ; mulps %xmm6,%xmm13
@@ -13741,7 +13736,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 65,15,40,198 ; movaps %xmm14,%xmm0
DB 15,40,20,36 ; movaps (%rsp),%xmm2
DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1
- DB 68,15,88,21,50,55,0,0 ; addps 0x3732(%rip),%xmm10 # 55a0 <_sk_callback_sse41+0x54d>
+ DB 68,15,88,21,119,55,0,0 ; addps 0x3777(%rip),%xmm10 # 55f0 <_sk_callback_sse41+0x563>
DB 102,65,15,58,8,194,1 ; roundps $0x1,%xmm10,%xmm0
DB 68,15,92,208 ; subps %xmm0,%xmm10
DB 69,15,194,218,2 ; cmpleps %xmm10,%xmm11
@@ -13787,13 +13782,13 @@ _sk_scale_1_float_sse41 LABEL PROC
PUBLIC _sk_scale_u8_sse41
_sk_scale_u8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,52 ; jne 1f4b <_sk_scale_u8_sse41+0x3e>
- DB 102,69,15,56,49,4,57 ; pmovzxbd (%r9,%rdi,1),%xmm8
- DB 102,68,15,219,5,137,54,0,0 ; pand 0x3689(%rip),%xmm8 # 55b0 <_sk_callback_sse41+0x55d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,52 ; jne 1f56 <_sk_scale_u8_sse41+0x3e>
+ DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8
+ DB 102,68,15,219,5,206,54,0,0 ; pand 0x36ce(%rip),%xmm8 # 5600 <_sk_callback_sse41+0x573>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,141,54,0,0 ; mulps 0x368d(%rip),%xmm8 # 55c0 <_sk_callback_sse41+0x56d>
+ DB 68,15,89,5,210,54,0,0 ; mulps 0x36d2(%rip),%xmm8 # 5610 <_sk_callback_sse41+0x583>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
@@ -13801,23 +13796,23 @@ _sk_scale_u8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,42 ; je 1f87 <_sk_scale_u8_sse41+0x7a>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,23 ; je 1f7a <_sk_scale_u8_sse41+0x6d>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,181 ; jne 1f1e <_sk_scale_u8_sse41+0x11>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,42 ; je 1f92 <_sk_scale_u8_sse41+0x7a>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,23 ; je 1f85 <_sk_scale_u8_sse41+0x6d>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,181 ; jne 1f29 <_sk_scale_u8_sse41+0x11>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,68,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm8
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,68,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm8
- DB 235,137 ; jmp 1f1e <_sk_scale_u8_sse41+0x11>
+ DB 235,137 ; jmp 1f29 <_sk_scale_u8_sse41+0x11>
PUBLIC _sk_lerp_1_float_sse41
_sk_lerp_1_float_sse41 LABEL PROC
@@ -13842,13 +13837,13 @@ _sk_lerp_1_float_sse41 LABEL PROC
PUBLIC _sk_lerp_u8_sse41
_sk_lerp_u8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,72 ; jne 201f <_sk_lerp_u8_sse41+0x52>
- DB 102,69,15,56,49,4,57 ; pmovzxbd (%r9,%rdi,1),%xmm8
- DB 102,68,15,219,5,233,53,0,0 ; pand 0x35e9(%rip),%xmm8 # 55d0 <_sk_callback_sse41+0x57d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,72 ; jne 202a <_sk_lerp_u8_sse41+0x52>
+ DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8
+ DB 102,68,15,219,5,46,54,0,0 ; pand 0x362e(%rip),%xmm8 # 5620 <_sk_callback_sse41+0x593>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,237,53,0,0 ; mulps 0x35ed(%rip),%xmm8 # 55e0 <_sk_callback_sse41+0x58d>
+ DB 68,15,89,5,50,54,0,0 ; mulps 0x3632(%rip),%xmm8 # 5630 <_sk_callback_sse41+0x5a3>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -13863,42 +13858,42 @@ _sk_lerp_u8_sse41 LABEL PROC
DB 15,88,223 ; addps %xmm7,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,42 ; je 205b <_sk_lerp_u8_sse41+0x8e>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,23 ; je 204e <_sk_lerp_u8_sse41+0x81>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,161 ; jne 1fde <_sk_lerp_u8_sse41+0x11>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,42 ; je 2066 <_sk_lerp_u8_sse41+0x8e>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,23 ; je 2059 <_sk_lerp_u8_sse41+0x81>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,161 ; jne 1fe9 <_sk_lerp_u8_sse41+0x11>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,68,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm8
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,68,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm8
- DB 233,114,255,255,255 ; jmpq 1fde <_sk_lerp_u8_sse41+0x11>
+ DB 233,114,255,255,255 ; jmpq 1fe9 <_sk_lerp_u8_sse41+0x11>
PUBLIC _sk_lerp_565_sse41
_sk_lerp_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,152,0,0,0 ; jne 2112 <_sk_lerp_565_sse41+0xa6>
- DB 102,69,15,56,51,12,121 ; pmovzxwd (%r9,%rdi,2),%xmm9
- DB 102,68,15,111,5,102,53,0,0 ; movdqa 0x3566(%rip),%xmm8 # 55f0 <_sk_callback_sse41+0x59d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,152,0,0,0 ; jne 211d <_sk_lerp_565_sse41+0xa6>
+ DB 102,69,15,56,51,12,82 ; pmovzxwd (%r10,%rdx,2),%xmm9
+ DB 102,68,15,111,5,171,53,0,0 ; movdqa 0x35ab(%rip),%xmm8 # 5640 <_sk_callback_sse41+0x5b3>
DB 102,69,15,219,193 ; pand %xmm9,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,101,53,0,0 ; mulps 0x3565(%rip),%xmm8 # 5600 <_sk_callback_sse41+0x5ad>
- DB 102,68,15,111,21,108,53,0,0 ; movdqa 0x356c(%rip),%xmm10 # 5610 <_sk_callback_sse41+0x5bd>
+ DB 68,15,89,5,170,53,0,0 ; mulps 0x35aa(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x5c3>
+ DB 102,68,15,111,21,177,53,0,0 ; movdqa 0x35b1(%rip),%xmm10 # 5660 <_sk_callback_sse41+0x5d3>
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
- DB 68,15,89,21,107,53,0,0 ; mulps 0x356b(%rip),%xmm10 # 5620 <_sk_callback_sse41+0x5cd>
- DB 102,68,15,219,13,114,53,0,0 ; pand 0x3572(%rip),%xmm9 # 5630 <_sk_callback_sse41+0x5dd>
+ DB 68,15,89,21,176,53,0,0 ; mulps 0x35b0(%rip),%xmm10 # 5670 <_sk_callback_sse41+0x5e3>
+ DB 102,68,15,219,13,183,53,0,0 ; pand 0x35b7(%rip),%xmm9 # 5680 <_sk_callback_sse41+0x5f3>
DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9
- DB 68,15,89,13,118,53,0,0 ; mulps 0x3576(%rip),%xmm9 # 5640 <_sk_callback_sse41+0x5ed>
+ DB 68,15,89,13,187,53,0,0 ; mulps 0x35bb(%rip),%xmm9 # 5690 <_sk_callback_sse41+0x603>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -13920,107 +13915,110 @@ _sk_lerp_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,46 ; je 2152 <_sk_lerp_565_sse41+0xe6>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,27 ; je 2145 <_sk_lerp_565_sse41+0xd9>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 15,133,77,255,255,255 ; jne 2081 <_sk_lerp_565_sse41+0x15>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,46 ; je 215d <_sk_lerp_565_sse41+0xe6>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,27 ; je 2150 <_sk_lerp_565_sse41+0xd9>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 15,133,77,255,255,255 ; jne 208c <_sk_lerp_565_sse41+0x15>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,200,69 ; pshufd $0x45,%xmm8,%xmm9
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,68,15,58,34,200,1 ; pinsrd $0x1,%eax,%xmm9
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,68,15,58,34,200,0 ; pinsrd $0x0,%eax,%xmm9
- DB 233,30,255,255,255 ; jmpq 2081 <_sk_lerp_565_sse41+0x15>
+ DB 233,30,255,255,255 ; jmpq 208c <_sk_lerp_565_sse41+0x15>
PUBLIC _sk_load_tables_sse41
_sk_load_tables_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,20,1,0,0 ; jne 2285 <_sk_load_tables_sse41+0x122>
- DB 243,69,15,111,4,184 ; movdqu (%r8,%rdi,4),%xmm8
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,24,1,0,0 ; jne 2294 <_sk_load_tables_sse41+0x126>
+ DB 243,69,15,111,4,145 ; movdqu (%r9,%rdx,4),%xmm8
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 102,15,111,5,206,52,0,0 ; movdqa 0x34ce(%rip),%xmm0 # 5650 <_sk_callback_sse41+0x5fd>
+ DB 102,15,111,5,17,53,0,0 ; movdqa 0x3511(%rip),%xmm0 # 56a0 <_sk_callback_sse41+0x613>
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
- DB 102,73,15,58,22,192,1 ; pextrq $0x1,%xmm0,%r8
- DB 102,73,15,126,193 ; movq %xmm0,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 102,73,15,126,194 ; movq %xmm0,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 69,15,182,241 ; movzbl %r9b,%r14d
DB 73,193,233,30 ; shr $0x1e,%r9
- DB 69,15,182,216 ; movzbl %r8b,%r11d
- DB 73,193,232,30 ; shr $0x1e,%r8
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,4,147 ; movss (%rbx,%r10,4),%xmm0
- DB 102,66,15,58,33,4,11,16 ; insertps $0x10,(%rbx,%r9,1),%xmm0
- DB 102,66,15,58,33,4,155,32 ; insertps $0x20,(%rbx,%r11,4),%xmm0
- DB 102,66,15,58,33,4,3,48 ; insertps $0x30,(%rbx,%r8,1),%xmm0
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
+ DB 102,66,15,58,33,4,19,16 ; insertps $0x10,(%rbx,%r10,1),%xmm0
+ DB 102,66,15,58,33,4,179,32 ; insertps $0x20,(%rbx,%r14,4),%xmm0
+ DB 102,66,15,58,33,4,11,48 ; insertps $0x30,(%rbx,%r9,1),%xmm0
DB 102,65,15,111,200 ; movdqa %xmm8,%xmm1
- DB 102,15,56,0,13,137,52,0,0 ; pshufb 0x3489(%rip),%xmm1 # 5660 <_sk_callback_sse41+0x60d>
- DB 102,73,15,58,22,200,1 ; pextrq $0x1,%xmm1,%r8
+ DB 102,15,56,0,13,204,52,0,0 ; pshufb 0x34cc(%rip),%xmm1 # 56b0 <_sk_callback_sse41+0x623>
+ DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 68,15,182,203 ; movzbl %bl,%r9d
+ DB 68,15,182,211 ; movzbl %bl,%r10d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,15,182,208 ; movzbl %r8b,%r10d
- DB 73,193,232,30 ; shr $0x1e,%r8
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
- DB 102,65,15,58,33,12,30,16 ; insertps $0x10,(%r14,%rbx,1),%xmm1
- DB 243,67,15,16,20,150 ; movss (%r14,%r10,4),%xmm2
+ DB 69,15,182,217 ; movzbl %r9b,%r11d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 243,67,15,16,12,151 ; movss (%r15,%r10,4),%xmm1
+ DB 102,65,15,58,33,12,31,16 ; insertps $0x10,(%r15,%rbx,1),%xmm1
+ DB 243,67,15,16,20,159 ; movss (%r15,%r11,4),%xmm2
DB 102,15,58,33,202,32 ; insertps $0x20,%xmm2,%xmm1
- DB 243,67,15,16,20,6 ; movss (%r14,%r8,1),%xmm2
+ DB 243,67,15,16,20,15 ; movss (%r15,%r9,1),%xmm2
DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1
- DB 76,139,64,24 ; mov 0x18(%rax),%r8
+ DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 102,65,15,111,208 ; movdqa %xmm8,%xmm2
- DB 102,15,56,0,21,69,52,0,0 ; pshufb 0x3445(%rip),%xmm2 # 5670 <_sk_callback_sse41+0x61d>
+ DB 102,15,56,0,21,136,52,0,0 ; pshufb 0x3488(%rip),%xmm2 # 56c0 <_sk_callback_sse41+0x633>
DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 68,15,182,200 ; movzbl %al,%r9d
+ DB 68,15,182,208 ; movzbl %al,%r10d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 68,15,182,211 ; movzbl %bl,%r10d
+ DB 68,15,182,219 ; movzbl %bl,%r11d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 243,67,15,16,20,136 ; movss (%r8,%r9,4),%xmm2
- DB 102,65,15,58,33,20,0,16 ; insertps $0x10,(%r8,%rax,1),%xmm2
- DB 243,67,15,16,28,144 ; movss (%r8,%r10,4),%xmm3
+ DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
+ DB 102,65,15,58,33,20,1,16 ; insertps $0x10,(%r9,%rax,1),%xmm2
+ DB 243,67,15,16,28,153 ; movss (%r9,%r11,4),%xmm3
DB 102,15,58,33,211,32 ; insertps $0x20,%xmm3,%xmm2
- DB 243,65,15,16,28,24 ; movss (%r8,%rbx,1),%xmm3
+ DB 243,65,15,16,28,25 ; movss (%r9,%rbx,1),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8
DB 65,15,91,216 ; cvtdq2ps %xmm8,%xmm3
- DB 15,89,29,2,52,0,0 ; mulps 0x3402(%rip),%xmm3 # 5680 <_sk_callback_sse41+0x62d>
+ DB 15,89,29,69,52,0,0 ; mulps 0x3445(%rip),%xmm3 # 56d0 <_sk_callback_sse41+0x643>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 65,137,201 ; mov %ecx,%r9d
- DB 65,128,225,3 ; and $0x3,%r9b
+ DB 69,137,194 ; mov %r8d,%r10d
+ DB 65,128,226,3 ; and $0x3,%r10b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,38 ; je 22bd <_sk_load_tables_sse41+0x15a>
- DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,23 ; je 22b4 <_sk_load_tables_sse41+0x151>
- DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 15,133,208,254,255,255 ; jne 2177 <_sk_load_tables_sse41+0x14>
- DB 102,65,15,110,68,184,8 ; movd 0x8(%r8,%rdi,4),%xmm0
+ DB 65,128,250,1 ; cmp $0x1,%r10b
+ DB 116,38 ; je 22cc <_sk_load_tables_sse41+0x15e>
+ DB 65,128,250,2 ; cmp $0x2,%r10b
+ DB 116,23 ; je 22c3 <_sk_load_tables_sse41+0x155>
+ DB 65,128,250,3 ; cmp $0x3,%r10b
+ DB 15,133,204,254,255,255 ; jne 2182 <_sk_load_tables_sse41+0x14>
+ DB 102,65,15,110,68,145,8 ; movd 0x8(%r9,%rdx,4),%xmm0
DB 102,68,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm8
- DB 102,69,15,58,34,68,184,4,1 ; pinsrd $0x1,0x4(%r8,%rdi,4),%xmm8
- DB 102,69,15,58,34,4,184,0 ; pinsrd $0x0,(%r8,%rdi,4),%xmm8
- DB 233,173,254,255,255 ; jmpq 2177 <_sk_load_tables_sse41+0x14>
+ DB 102,69,15,58,34,68,145,4,1 ; pinsrd $0x1,0x4(%r9,%rdx,4),%xmm8
+ DB 102,69,15,58,34,4,145,0 ; pinsrd $0x0,(%r9,%rdx,4),%xmm8
+ DB 233,169,254,255,255 ; jmpq 2182 <_sk_load_tables_sse41+0x14>
PUBLIC _sk_load_tables_u16_be_sse41
_sk_load_tables_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,95,1,0,0 ; jne 243f <_sk_load_tables_u16_be_sse41+0x175>
- DB 102,67,15,16,4,72 ; movupd (%r8,%r9,2),%xmm0
- DB 243,67,15,111,76,72,16 ; movdqu 0x10(%r8,%r9,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,99,1,0,0 ; jne 2452 <_sk_load_tables_u16_be_sse41+0x179>
+ DB 102,67,15,16,4,81 ; movupd (%r9,%r10,2),%xmm0
+ DB 243,67,15,111,76,81,16 ; movdqu 0x10(%r9,%r10,2),%xmm1
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 102,68,15,40,200 ; movapd %xmm0,%xmm9
@@ -14029,52 +14027,52 @@ _sk_load_tables_u16_be_sse41 LABEL PROC
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
- DB 102,68,15,111,5,123,51,0,0 ; movdqa 0x337b(%rip),%xmm8 # 5690 <_sk_callback_sse41+0x63d>
+ DB 102,68,15,111,5,186,51,0,0 ; movdqa 0x33ba(%rip),%xmm8 # 56e0 <_sk_callback_sse41+0x653>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
- DB 102,73,15,58,22,192,1 ; pextrq $0x1,%xmm0,%r8
- DB 102,73,15,126,193 ; movq %xmm0,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 102,73,15,126,194 ; movq %xmm0,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 69,15,182,241 ; movzbl %r9b,%r14d
DB 73,193,233,30 ; shr $0x1e,%r9
- DB 69,15,182,216 ; movzbl %r8b,%r11d
- DB 73,193,232,30 ; shr $0x1e,%r8
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,4,147 ; movss (%rbx,%r10,4),%xmm0
- DB 102,66,15,58,33,4,11,16 ; insertps $0x10,(%rbx,%r9,1),%xmm0
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
+ DB 102,66,15,58,33,4,19,16 ; insertps $0x10,(%rbx,%r10,1),%xmm0
+ DB 243,66,15,16,20,179 ; movss (%rbx,%r14,4),%xmm2
DB 102,15,58,33,194,32 ; insertps $0x20,%xmm2,%xmm0
- DB 243,66,15,16,20,3 ; movss (%rbx,%r8,1),%xmm2
+ DB 243,66,15,16,20,11 ; movss (%rbx,%r9,1),%xmm2
DB 102,15,58,33,194,48 ; insertps $0x30,%xmm2,%xmm0
- DB 102,15,56,0,13,42,51,0,0 ; pshufb 0x332a(%rip),%xmm1 # 56a0 <_sk_callback_sse41+0x64d>
+ DB 102,15,56,0,13,105,51,0,0 ; pshufb 0x3369(%rip),%xmm1 # 56f0 <_sk_callback_sse41+0x663>
DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1
- DB 102,73,15,58,22,200,1 ; pextrq $0x1,%xmm1,%r8
+ DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 68,15,182,203 ; movzbl %bl,%r9d
+ DB 68,15,182,211 ; movzbl %bl,%r10d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,15,182,208 ; movzbl %r8b,%r10d
- DB 73,193,232,30 ; shr $0x1e,%r8
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
- DB 102,65,15,58,33,12,30,16 ; insertps $0x10,(%r14,%rbx,1),%xmm1
- DB 243,67,15,16,20,150 ; movss (%r14,%r10,4),%xmm2
+ DB 69,15,182,217 ; movzbl %r9b,%r11d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 243,67,15,16,12,151 ; movss (%r15,%r10,4),%xmm1
+ DB 102,65,15,58,33,12,31,16 ; insertps $0x10,(%r15,%rbx,1),%xmm1
+ DB 243,67,15,16,20,159 ; movss (%r15,%r11,4),%xmm2
DB 102,15,58,33,202,32 ; insertps $0x20,%xmm2,%xmm1
- DB 243,67,15,16,20,6 ; movss (%r14,%r8,1),%xmm2
+ DB 243,67,15,16,20,15 ; movss (%r15,%r9,1),%xmm2
DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1
- DB 76,139,64,24 ; mov 0x18(%rax),%r8
+ DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 102,69,15,219,193 ; pand %xmm9,%xmm8
DB 102,65,15,56,51,208 ; pmovzxwd %xmm8,%xmm2
DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 68,15,182,200 ; movzbl %al,%r9d
+ DB 68,15,182,208 ; movzbl %al,%r10d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 68,15,182,211 ; movzbl %bl,%r10d
+ DB 68,15,182,219 ; movzbl %bl,%r11d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 243,67,15,16,20,136 ; movss (%r8,%r9,4),%xmm2
- DB 102,65,15,58,33,20,0,16 ; insertps $0x10,(%r8,%rax,1),%xmm2
- DB 243,67,15,16,28,144 ; movss (%r8,%r10,4),%xmm3
+ DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
+ DB 102,65,15,58,33,20,1,16 ; insertps $0x10,(%r9,%rax,1),%xmm2
+ DB 243,67,15,16,28,153 ; movss (%r9,%r11,4),%xmm3
DB 102,15,58,33,211,32 ; insertps $0x20,%xmm3,%xmm2
- DB 243,65,15,16,28,24 ; movss (%r8,%rbx,1),%xmm3
+ DB 243,65,15,16,28,25 ; movss (%r9,%rbx,1),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 102,65,15,112,217,78 ; pshufd $0x4e,%xmm9,%xmm3
DB 102,68,15,111,195 ; movdqa %xmm3,%xmm8
@@ -14083,199 +14081,204 @@ _sk_load_tables_u16_be_sse41 LABEL PROC
DB 102,65,15,235,216 ; por %xmm8,%xmm3
DB 102,15,56,51,219 ; pmovzxwd %xmm3,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,120,50,0,0 ; mulps 0x3278(%rip),%xmm3 # 56b0 <_sk_callback_sse41+0x65d>
+ DB 15,89,29,183,50,0,0 ; mulps 0x32b7(%rip),%xmm3 # 5700 <_sk_callback_sse41+0x673>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 242,67,15,16,4,72 ; movsd (%r8,%r9,2),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,13 ; jne 2458 <_sk_load_tables_u16_be_sse41+0x18e>
+ DB 242,67,15,16,4,81 ; movsd (%r9,%r10,2),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,13 ; jne 246b <_sk_load_tables_u16_be_sse41+0x192>
DB 243,15,126,192 ; movq %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,149,254,255,255 ; jmpq 22ed <_sk_load_tables_u16_be_sse41+0x23>
- DB 102,67,15,22,68,72,8 ; movhpd 0x8(%r8,%r9,2),%xmm0
+ DB 233,145,254,255,255 ; jmpq 22fc <_sk_load_tables_u16_be_sse41+0x23>
+ DB 102,67,15,22,68,81,8 ; movhpd 0x8(%r9,%r10,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,128,254,255,255 ; jb 22ed <_sk_load_tables_u16_be_sse41+0x23>
- DB 243,67,15,126,76,72,16 ; movq 0x10(%r8,%r9,2),%xmm1
- DB 233,116,254,255,255 ; jmpq 22ed <_sk_load_tables_u16_be_sse41+0x23>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,124,254,255,255 ; jb 22fc <_sk_load_tables_u16_be_sse41+0x23>
+ DB 243,67,15,126,76,81,16 ; movq 0x10(%r9,%r10,2),%xmm1
+ DB 233,112,254,255,255 ; jmpq 22fc <_sk_load_tables_u16_be_sse41+0x23>
PUBLIC _sk_load_tables_rgb_u16_be_sse41
_sk_load_tables_rgb_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,127 ; lea (%rdi,%rdi,2),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,79,1,0,0 ; jne 25da <_sk_load_tables_rgb_u16_be_sse41+0x161>
- DB 243,67,15,111,20,72 ; movdqu (%r8,%r9,2),%xmm2
- DB 243,67,15,111,76,72,8 ; movdqu 0x8(%r8,%r9,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,83,1,0,0 ; jne 25f1 <_sk_load_tables_rgb_u16_be_sse41+0x165>
+ DB 243,67,15,111,20,81 ; movdqu (%r9,%r10,2),%xmm2
+ DB 243,67,15,111,76,81,8 ; movdqu 0x8(%r9,%r10,2),%xmm1
DB 102,15,115,217,4 ; psrldq $0x4,%xmm1
DB 102,68,15,111,202 ; movdqa %xmm2,%xmm9
DB 102,65,15,115,217,6 ; psrldq $0x6,%xmm9
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,115,216,6 ; psrldq $0x6,%xmm0
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 102,15,97,209 ; punpcklwd %xmm1,%xmm2
DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9
DB 102,15,111,202 ; movdqa %xmm2,%xmm1
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
- DB 102,68,15,111,5,241,49,0,0 ; movdqa 0x31f1(%rip),%xmm8 # 56c0 <_sk_callback_sse41+0x66d>
+ DB 102,68,15,111,5,44,50,0,0 ; movdqa 0x322c(%rip),%xmm8 # 5710 <_sk_callback_sse41+0x683>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
- DB 102,73,15,58,22,192,1 ; pextrq $0x1,%xmm0,%r8
- DB 102,73,15,126,193 ; movq %xmm0,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 102,73,15,126,194 ; movq %xmm0,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 69,15,182,241 ; movzbl %r9b,%r14d
DB 73,193,233,30 ; shr $0x1e,%r9
- DB 69,15,182,216 ; movzbl %r8b,%r11d
- DB 73,193,232,30 ; shr $0x1e,%r8
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,4,147 ; movss (%rbx,%r10,4),%xmm0
- DB 102,66,15,58,33,4,11,16 ; insertps $0x10,(%rbx,%r9,1),%xmm0
- DB 243,66,15,16,28,155 ; movss (%rbx,%r11,4),%xmm3
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
+ DB 102,66,15,58,33,4,19,16 ; insertps $0x10,(%rbx,%r10,1),%xmm0
+ DB 243,66,15,16,28,179 ; movss (%rbx,%r14,4),%xmm3
DB 102,15,58,33,195,32 ; insertps $0x20,%xmm3,%xmm0
- DB 243,66,15,16,28,3 ; movss (%rbx,%r8,1),%xmm3
+ DB 243,66,15,16,28,11 ; movss (%rbx,%r9,1),%xmm3
DB 102,15,58,33,195,48 ; insertps $0x30,%xmm3,%xmm0
- DB 102,15,56,0,13,160,49,0,0 ; pshufb 0x31a0(%rip),%xmm1 # 56d0 <_sk_callback_sse41+0x67d>
+ DB 102,15,56,0,13,219,49,0,0 ; pshufb 0x31db(%rip),%xmm1 # 5720 <_sk_callback_sse41+0x693>
DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1
- DB 102,73,15,58,22,200,1 ; pextrq $0x1,%xmm1,%r8
+ DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 68,15,182,203 ; movzbl %bl,%r9d
+ DB 68,15,182,211 ; movzbl %bl,%r10d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,15,182,208 ; movzbl %r8b,%r10d
- DB 73,193,232,30 ; shr $0x1e,%r8
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
- DB 102,65,15,58,33,12,30,16 ; insertps $0x10,(%r14,%rbx,1),%xmm1
- DB 243,67,15,16,28,150 ; movss (%r14,%r10,4),%xmm3
+ DB 69,15,182,217 ; movzbl %r9b,%r11d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 243,67,15,16,12,151 ; movss (%r15,%r10,4),%xmm1
+ DB 102,65,15,58,33,12,31,16 ; insertps $0x10,(%r15,%rbx,1),%xmm1
+ DB 243,67,15,16,28,159 ; movss (%r15,%r11,4),%xmm3
DB 102,15,58,33,203,32 ; insertps $0x20,%xmm3,%xmm1
- DB 243,67,15,16,28,6 ; movss (%r14,%r8,1),%xmm3
+ DB 243,67,15,16,28,15 ; movss (%r15,%r9,1),%xmm3
DB 102,15,58,33,203,48 ; insertps $0x30,%xmm3,%xmm1
- DB 76,139,64,24 ; mov 0x18(%rax),%r8
+ DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 102,65,15,105,209 ; punpckhwd %xmm9,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,56,51,210 ; pmovzxwd %xmm2,%xmm2
DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 68,15,182,200 ; movzbl %al,%r9d
+ DB 68,15,182,208 ; movzbl %al,%r10d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 68,15,182,211 ; movzbl %bl,%r10d
+ DB 68,15,182,219 ; movzbl %bl,%r11d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 243,67,15,16,20,136 ; movss (%r8,%r9,4),%xmm2
- DB 102,65,15,58,33,20,0,16 ; insertps $0x10,(%r8,%rax,1),%xmm2
- DB 243,67,15,16,28,144 ; movss (%r8,%r10,4),%xmm3
+ DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
+ DB 102,65,15,58,33,20,1,16 ; insertps $0x10,(%r9,%rax,1),%xmm2
+ DB 243,67,15,16,28,153 ; movss (%r9,%r11,4),%xmm3
DB 102,15,58,33,211,32 ; insertps $0x20,%xmm3,%xmm2
- DB 243,65,15,16,28,24 ; movss (%r8,%rbx,1),%xmm3
+ DB 243,65,15,16,28,25 ; movss (%r9,%rbx,1),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,11,49,0,0 ; movaps 0x310b(%rip),%xmm3 # 56e0 <_sk_callback_sse41+0x68d>
+ DB 15,40,29,70,49,0,0 ; movaps 0x3146(%rip),%xmm3 # 5730 <_sk_callback_sse41+0x6a3>
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 102,67,15,110,20,72 ; movd (%r8,%r9,2),%xmm2
- DB 102,67,15,196,84,72,4,2 ; pinsrw $0x2,0x4(%r8,%r9,2),%xmm2
+ DB 102,67,15,110,20,81 ; movd (%r9,%r10,2),%xmm2
+ DB 102,67,15,196,84,81,4,2 ; pinsrw $0x2,0x4(%r9,%r10,2),%xmm2
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,14 ; jne 2600 <_sk_load_tables_rgb_u16_be_sse41+0x187>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,14 ; jne 2617 <_sk_load_tables_rgb_u16_be_sse41+0x18b>
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
- DB 233,177,254,255,255 ; jmpq 24b1 <_sk_load_tables_rgb_u16_be_sse41+0x38>
- DB 102,71,15,110,76,72,6 ; movd 0x6(%r8,%r9,2),%xmm9
- DB 102,71,15,196,76,72,10,2 ; pinsrw $0x2,0xa(%r8,%r9,2),%xmm9
+ DB 233,173,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ DB 102,71,15,110,76,81,6 ; movd 0x6(%r9,%r10,2),%xmm9
+ DB 102,71,15,196,76,81,10,2 ; pinsrw $0x2,0xa(%r9,%r10,2),%xmm9
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,24 ; jb 2631 <_sk_load_tables_rgb_u16_be_sse41+0x1b8>
- DB 102,67,15,110,76,72,12 ; movd 0xc(%r8,%r9,2),%xmm1
- DB 102,67,15,196,76,72,16,2 ; pinsrw $0x2,0x10(%r8,%r9,2),%xmm1
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,24 ; jb 2648 <_sk_load_tables_rgb_u16_be_sse41+0x1bc>
+ DB 102,67,15,110,76,81,12 ; movd 0xc(%r9,%r10,2),%xmm1
+ DB 102,67,15,196,76,81,16,2 ; pinsrw $0x2,0x10(%r9,%r10,2),%xmm1
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,128,254,255,255 ; jmpq 24b1 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ DB 233,124,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38>
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,119,254,255,255 ; jmpq 24b1 <_sk_load_tables_rgb_u16_be_sse41+0x38>
+ DB 233,115,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38>
PUBLIC _sk_byte_tables_sse41
_sk_byte_tables_sse41 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,167,48,0,0 ; movaps 0x30a7(%rip),%xmm8 # 56f0 <_sk_callback_sse41+0x69d>
+ DB 68,15,40,5,222,48,0,0 ; movaps 0x30de(%rip),%xmm8 # 5740 <_sk_callback_sse41+0x6b3>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
- DB 102,73,15,58,22,192,1 ; pextrq $0x1,%xmm0,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 76,139,56 ; mov (%rax),%r15
- DB 76,139,112,8 ; mov 0x8(%rax),%r14
- DB 102,67,15,58,32,4,31,0 ; pinsrb $0x0,(%r15,%r11,1),%xmm0
- DB 102,67,15,58,32,4,23,1 ; pinsrb $0x1,(%r15,%r10,1),%xmm0
- DB 67,15,182,28,15 ; movzbl (%r15,%r9,1),%ebx
+ DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 76,139,32 ; mov (%rax),%r12
+ DB 76,139,120,8 ; mov 0x8(%rax),%r15
+ DB 102,67,15,58,32,4,52,0 ; pinsrb $0x0,(%r12,%r14,1),%xmm0
+ DB 102,67,15,58,32,4,28,1 ; pinsrb $0x1,(%r12,%r11,1),%xmm0
+ DB 67,15,182,28,20 ; movzbl (%r12,%r10,1),%ebx
DB 102,15,58,32,195,2 ; pinsrb $0x2,%ebx,%xmm0
- DB 67,15,182,28,7 ; movzbl (%r15,%r8,1),%ebx
+ DB 67,15,182,28,12 ; movzbl (%r12,%r9,1),%ebx
DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,13,88,48,0,0 ; movaps 0x3058(%rip),%xmm9 # 5700 <_sk_callback_sse41+0x6ad>
+ DB 68,15,40,13,143,48,0,0 ; movaps 0x308f(%rip),%xmm9 # 5750 <_sk_callback_sse41+0x6c3>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,72,15,58,22,203,1 ; pextrq $0x1,%xmm1,%rbx
- DB 65,137,216 ; mov %ebx,%r8d
+ DB 65,137,217 ; mov %ebx,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,73,15,126,201 ; movq %xmm1,%r9
- DB 69,137,202 ; mov %r9d,%r10d
- DB 73,193,233,32 ; shr $0x20,%r9
- DB 102,67,15,58,32,12,22,0 ; pinsrb $0x0,(%r14,%r10,1),%xmm1
- DB 102,67,15,58,32,12,14,1 ; pinsrb $0x1,(%r14,%r9,1),%xmm1
- DB 71,15,182,4,6 ; movzbl (%r14,%r8,1),%r8d
- DB 102,65,15,58,32,200,2 ; pinsrb $0x2,%r8d,%xmm1
- DB 65,15,182,28,30 ; movzbl (%r14,%rbx,1),%ebx
+ DB 102,73,15,126,202 ; movq %xmm1,%r10
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 73,193,234,32 ; shr $0x20,%r10
+ DB 102,67,15,58,32,12,31,0 ; pinsrb $0x0,(%r15,%r11,1),%xmm1
+ DB 102,67,15,58,32,12,23,1 ; pinsrb $0x1,(%r15,%r10,1),%xmm1
+ DB 71,15,182,12,15 ; movzbl (%r15,%r9,1),%r9d
+ DB 102,65,15,58,32,201,2 ; pinsrb $0x2,%r9d,%xmm1
+ DB 65,15,182,28,31 ; movzbl (%r15,%rbx,1),%ebx
DB 102,15,58,32,203,3 ; pinsrb $0x3,%ebx,%xmm1
DB 102,15,56,49,201 ; pmovzxbd %xmm1,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,201 ; mulps %xmm9,%xmm1
- DB 76,139,80,16 ; mov 0x10(%rax),%r10
+ DB 76,139,88,16 ; mov 0x10(%rax),%r11
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,91,210 ; cvtps2dq %xmm2,%xmm2
- DB 102,73,15,58,22,208,1 ; pextrq $0x1,%xmm2,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
+ DB 102,73,15,58,22,209,1 ; pextrq $0x1,%xmm2,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 65,137,219 ; mov %ebx,%r11d
+ DB 65,137,222 ; mov %ebx,%r14d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,67,15,58,32,20,26,0 ; pinsrb $0x0,(%r10,%r11,1),%xmm2
- DB 102,65,15,58,32,20,26,1 ; pinsrb $0x1,(%r10,%rbx,1),%xmm2
- DB 67,15,182,28,10 ; movzbl (%r10,%r9,1),%ebx
+ DB 102,67,15,58,32,20,51,0 ; pinsrb $0x0,(%r11,%r14,1),%xmm2
+ DB 102,65,15,58,32,20,27,1 ; pinsrb $0x1,(%r11,%rbx,1),%xmm2
+ DB 67,15,182,28,19 ; movzbl (%r11,%r10,1),%ebx
DB 102,15,58,32,211,2 ; pinsrb $0x2,%ebx,%xmm2
- DB 67,15,182,28,2 ; movzbl (%r10,%r8,1),%ebx
+ DB 67,15,182,28,11 ; movzbl (%r11,%r9,1),%ebx
DB 102,15,58,32,211,3 ; pinsrb $0x3,%ebx,%xmm2
DB 102,15,56,49,210 ; pmovzxbd %xmm2,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
- DB 76,139,72,24 ; mov 0x18(%rax),%r9
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 102,15,91,219 ; cvtps2dq %xmm3,%xmm3
DB 102,72,15,58,22,219,1 ; pextrq $0x1,%xmm3,%rbx
- DB 65,137,216 ; mov %ebx,%r8d
+ DB 65,137,217 ; mov %ebx,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
DB 102,72,15,126,216 ; movq %xmm3,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,67,15,58,32,28,17,0 ; pinsrb $0x0,(%r9,%r10,1),%xmm3
- DB 102,65,15,58,32,28,1,1 ; pinsrb $0x1,(%r9,%rax,1),%xmm3
- DB 67,15,182,4,1 ; movzbl (%r9,%r8,1),%eax
+ DB 102,67,15,58,32,28,26,0 ; pinsrb $0x0,(%r10,%r11,1),%xmm3
+ DB 102,65,15,58,32,28,2,1 ; pinsrb $0x1,(%r10,%rax,1),%xmm3
+ DB 67,15,182,4,10 ; movzbl (%r10,%r9,1),%eax
DB 102,15,58,32,216,2 ; pinsrb $0x2,%eax,%xmm3
- DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax
+ DB 65,15,182,4,26 ; movzbl (%r10,%rbx,1),%eax
DB 102,15,58,32,216,3 ; pinsrb $0x3,%eax,%xmm3
DB 102,15,56,49,219 ; pmovzxbd %xmm3,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
DB 65,15,89,217 ; mulps %xmm9,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -14284,80 +14287,83 @@ PUBLIC _sk_byte_tables_rgb_sse41
_sk_byte_tables_rgb_sse41 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,139,64,24 ; mov 0x18(%rax),%r8d
- DB 65,255,200 ; dec %r8d
- DB 102,69,15,110,192 ; movd %r8d,%xmm8
+ DB 68,139,72,24 ; mov 0x18(%rax),%r9d
+ DB 65,255,201 ; dec %r9d
+ DB 102,69,15,110,193 ; movd %r9d,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
- DB 102,73,15,58,22,192,1 ; pextrq $0x1,%xmm0,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 77,137,194 ; mov %r8,%r10
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,73,15,126,192 ; movq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,198 ; mov %r8,%r14
- DB 73,193,238,32 ; shr $0x20,%r14
- DB 76,139,56 ; mov (%rax),%r15
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 102,67,15,58,32,4,31,0 ; pinsrb $0x0,(%r15,%r11,1),%xmm0
- DB 102,67,15,58,32,4,55,1 ; pinsrb $0x1,(%r15,%r14,1),%xmm0
- DB 67,15,182,28,15 ; movzbl (%r15,%r9,1),%ebx
+ DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 77,137,203 ; mov %r9,%r11
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,73,15,126,193 ; movq %xmm0,%r9
+ DB 69,137,206 ; mov %r9d,%r14d
+ DB 77,137,207 ; mov %r9,%r15
+ DB 73,193,239,32 ; shr $0x20,%r15
+ DB 76,139,32 ; mov (%rax),%r12
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 102,67,15,58,32,4,52,0 ; pinsrb $0x0,(%r12,%r14,1),%xmm0
+ DB 102,67,15,58,32,4,60,1 ; pinsrb $0x1,(%r12,%r15,1),%xmm0
+ DB 67,15,182,28,20 ; movzbl (%r12,%r10,1),%ebx
DB 102,15,58,32,195,2 ; pinsrb $0x2,%ebx,%xmm0
- DB 67,15,182,28,23 ; movzbl (%r15,%r10,1),%ebx
+ DB 67,15,182,28,28 ; movzbl (%r12,%r11,1),%ebx
DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,13,212,46,0,0 ; movaps 0x2ed4(%rip),%xmm9 # 5710 <_sk_callback_sse41+0x6bd>
+ DB 68,15,40,13,7,47,0,0 ; movaps 0x2f07(%rip),%xmm9 # 5760 <_sk_callback_sse41+0x6d3>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,72,15,58,22,203,1 ; pextrq $0x1,%xmm1,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
+ DB 65,137,218 ; mov %ebx,%r10d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,73,15,126,202 ; movq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,58,32,12,24,0 ; pinsrb $0x0,(%r8,%r11,1),%xmm1
- DB 102,67,15,58,32,12,16,1 ; pinsrb $0x1,(%r8,%r10,1),%xmm1
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 102,65,15,58,32,201,2 ; pinsrb $0x2,%r9d,%xmm1
- DB 65,15,182,28,24 ; movzbl (%r8,%rbx,1),%ebx
+ DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,67,15,58,32,12,49,0 ; pinsrb $0x0,(%r9,%r14,1),%xmm1
+ DB 102,67,15,58,32,12,25,1 ; pinsrb $0x1,(%r9,%r11,1),%xmm1
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 102,65,15,58,32,202,2 ; pinsrb $0x2,%r10d,%xmm1
+ DB 65,15,182,28,25 ; movzbl (%r9,%rbx,1),%ebx
DB 102,15,58,32,203,3 ; pinsrb $0x3,%ebx,%xmm1
DB 102,15,56,49,201 ; pmovzxbd %xmm1,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,201 ; mulps %xmm9,%xmm1
- DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,91,210 ; cvtps2dq %xmm2,%xmm2
DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx
- DB 65,137,216 ; mov %ebx,%r8d
+ DB 65,137,217 ; mov %ebx,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,67,15,58,32,20,17,0 ; pinsrb $0x0,(%r9,%r10,1),%xmm2
- DB 102,65,15,58,32,20,1,1 ; pinsrb $0x1,(%r9,%rax,1),%xmm2
- DB 67,15,182,4,1 ; movzbl (%r9,%r8,1),%eax
+ DB 102,67,15,58,32,20,26,0 ; pinsrb $0x0,(%r10,%r11,1),%xmm2
+ DB 102,65,15,58,32,20,2,1 ; pinsrb $0x1,(%r10,%rax,1),%xmm2
+ DB 67,15,182,4,10 ; movzbl (%r10,%r9,1),%eax
DB 102,15,58,32,208,2 ; pinsrb $0x2,%eax,%xmm2
- DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax
+ DB 65,15,182,4,26 ; movzbl (%r10,%rbx,1),%eax
DB 102,15,58,32,208,3 ; pinsrb $0x3,%eax,%xmm2
DB 102,15,56,49,210 ; pmovzxbd %xmm2,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_r_sse41
_sk_table_r_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -14366,24 +14372,26 @@ _sk_table_r_sse41 LABEL PROC
DB 68,15,89,192 ; mulps %xmm0,%xmm8
DB 102,65,15,91,192 ; cvtps2dq %xmm8,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,16,4,152 ; movss (%r8,%r11,4),%xmm0
- DB 102,67,15,58,33,4,144,16 ; insertps $0x10,(%r8,%r10,4),%xmm0
- DB 243,71,15,16,4,136 ; movss (%r8,%r9,4),%xmm8
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,65,15,16,4,153 ; movss (%r9,%rbx,4),%xmm0
+ DB 102,67,15,58,33,4,153,16 ; insertps $0x10,(%r9,%r11,4),%xmm0
+ DB 243,71,15,16,4,145 ; movss (%r9,%r10,4),%xmm8
DB 102,65,15,58,33,192,32 ; insertps $0x20,%xmm8,%xmm0
- DB 243,69,15,16,4,128 ; movss (%r8,%rax,4),%xmm8
+ DB 243,69,15,16,4,129 ; movss (%r9,%rax,4),%xmm8
DB 102,65,15,58,33,192,48 ; insertps $0x30,%xmm8,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_g_sse41
_sk_table_g_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -14392,24 +14400,26 @@ _sk_table_g_sse41 LABEL PROC
DB 68,15,89,193 ; mulps %xmm1,%xmm8
DB 102,65,15,91,200 ; cvtps2dq %xmm8,%xmm1
DB 102,72,15,58,22,200,1 ; pextrq $0x1,%xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,202 ; movq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,16,12,152 ; movss (%r8,%r11,4),%xmm1
- DB 102,67,15,58,33,12,144,16 ; insertps $0x10,(%r8,%r10,4),%xmm1
- DB 243,71,15,16,4,136 ; movss (%r8,%r9,4),%xmm8
+ DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,65,15,16,12,153 ; movss (%r9,%rbx,4),%xmm1
+ DB 102,67,15,58,33,12,153,16 ; insertps $0x10,(%r9,%r11,4),%xmm1
+ DB 243,71,15,16,4,145 ; movss (%r9,%r10,4),%xmm8
DB 102,65,15,58,33,200,32 ; insertps $0x20,%xmm8,%xmm1
- DB 243,69,15,16,4,128 ; movss (%r8,%rax,4),%xmm8
+ DB 243,69,15,16,4,129 ; movss (%r9,%rax,4),%xmm8
DB 102,65,15,58,33,200,48 ; insertps $0x30,%xmm8,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_b_sse41
_sk_table_b_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -14418,24 +14428,26 @@ _sk_table_b_sse41 LABEL PROC
DB 68,15,89,194 ; mulps %xmm2,%xmm8
DB 102,65,15,91,208 ; cvtps2dq %xmm8,%xmm2
DB 102,72,15,58,22,208,1 ; pextrq $0x1,%xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,210 ; movq %xmm2,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,16,20,152 ; movss (%r8,%r11,4),%xmm2
- DB 102,67,15,58,33,20,144,16 ; insertps $0x10,(%r8,%r10,4),%xmm2
- DB 243,71,15,16,4,136 ; movss (%r8,%r9,4),%xmm8
+ DB 102,73,15,126,211 ; movq %xmm2,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,65,15,16,20,153 ; movss (%r9,%rbx,4),%xmm2
+ DB 102,67,15,58,33,20,153,16 ; insertps $0x10,(%r9,%r11,4),%xmm2
+ DB 243,71,15,16,4,145 ; movss (%r9,%r10,4),%xmm8
DB 102,65,15,58,33,208,32 ; insertps $0x20,%xmm8,%xmm2
- DB 243,69,15,16,4,128 ; movss (%r8,%rax,4),%xmm8
+ DB 243,69,15,16,4,129 ; movss (%r9,%rax,4),%xmm8
DB 102,65,15,58,33,208,48 ; insertps $0x30,%xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_a_sse41
_sk_table_a_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -14444,18 +14456,19 @@ _sk_table_a_sse41 LABEL PROC
DB 68,15,89,195 ; mulps %xmm3,%xmm8
DB 102,65,15,91,216 ; cvtps2dq %xmm8,%xmm3
DB 102,72,15,58,22,216,1 ; pextrq $0x1,%xmm3,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,218 ; movq %xmm3,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,16,28,152 ; movss (%r8,%r11,4),%xmm3
- DB 102,67,15,58,33,28,144,16 ; insertps $0x10,(%r8,%r10,4),%xmm3
- DB 243,71,15,16,4,136 ; movss (%r8,%r9,4),%xmm8
+ DB 102,73,15,126,219 ; movq %xmm3,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,65,15,16,28,153 ; movss (%r9,%rbx,4),%xmm3
+ DB 102,67,15,58,33,28,153,16 ; insertps $0x10,(%r9,%r11,4),%xmm3
+ DB 243,71,15,16,4,145 ; movss (%r9,%r10,4),%xmm8
DB 102,65,15,58,33,216,32 ; insertps $0x20,%xmm8,%xmm3
- DB 243,69,15,16,4,128 ; movss (%r8,%rax,4),%xmm8
+ DB 243,69,15,16,4,129 ; movss (%r9,%rax,4),%xmm8
DB 102,65,15,58,33,216,48 ; insertps $0x30,%xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_parametric_r_sse41
@@ -14479,31 +14492,31 @@ _sk_parametric_r_sse41 LABEL PROC
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,194 ; cvtdq2ps %xmm10,%xmm8
- DB 68,15,89,5,38,44,0,0 ; mulps 0x2c26(%rip),%xmm8 # 5720 <_sk_callback_sse41+0x6cd>
- DB 68,15,84,21,46,44,0,0 ; andps 0x2c2e(%rip),%xmm10 # 5730 <_sk_callback_sse41+0x6dd>
- DB 68,15,86,21,54,44,0,0 ; orps 0x2c36(%rip),%xmm10 # 5740 <_sk_callback_sse41+0x6ed>
- DB 68,15,88,5,62,44,0,0 ; addps 0x2c3e(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x6fd>
- DB 68,15,40,37,70,44,0,0 ; movaps 0x2c46(%rip),%xmm12 # 5760 <_sk_callback_sse41+0x70d>
+ DB 68,15,89,5,79,44,0,0 ; mulps 0x2c4f(%rip),%xmm8 # 5770 <_sk_callback_sse41+0x6e3>
+ DB 68,15,84,21,87,44,0,0 ; andps 0x2c57(%rip),%xmm10 # 5780 <_sk_callback_sse41+0x6f3>
+ DB 68,15,86,21,95,44,0,0 ; orps 0x2c5f(%rip),%xmm10 # 5790 <_sk_callback_sse41+0x703>
+ DB 68,15,88,5,103,44,0,0 ; addps 0x2c67(%rip),%xmm8 # 57a0 <_sk_callback_sse41+0x713>
+ DB 68,15,40,37,111,44,0,0 ; movaps 0x2c6f(%rip),%xmm12 # 57b0 <_sk_callback_sse41+0x723>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,196 ; subps %xmm12,%xmm8
- DB 68,15,88,21,70,44,0,0 ; addps 0x2c46(%rip),%xmm10 # 5770 <_sk_callback_sse41+0x71d>
- DB 68,15,40,37,78,44,0,0 ; movaps 0x2c4e(%rip),%xmm12 # 5780 <_sk_callback_sse41+0x72d>
+ DB 68,15,88,21,111,44,0,0 ; addps 0x2c6f(%rip),%xmm10 # 57c0 <_sk_callback_sse41+0x733>
+ DB 68,15,40,37,119,44,0,0 ; movaps 0x2c77(%rip),%xmm12 # 57d0 <_sk_callback_sse41+0x743>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,196 ; subps %xmm12,%xmm8
DB 69,15,89,195 ; mulps %xmm11,%xmm8
DB 102,69,15,58,8,208,1 ; roundps $0x1,%xmm8,%xmm10
DB 69,15,40,216 ; movaps %xmm8,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,5,59,44,0,0 ; addps 0x2c3b(%rip),%xmm8 # 5790 <_sk_callback_sse41+0x73d>
- DB 68,15,40,21,67,44,0,0 ; movaps 0x2c43(%rip),%xmm10 # 57a0 <_sk_callback_sse41+0x74d>
+ DB 68,15,88,5,100,44,0,0 ; addps 0x2c64(%rip),%xmm8 # 57e0 <_sk_callback_sse41+0x753>
+ DB 68,15,40,21,108,44,0,0 ; movaps 0x2c6c(%rip),%xmm10 # 57f0 <_sk_callback_sse41+0x763>
DB 69,15,89,211 ; mulps %xmm11,%xmm10
DB 69,15,92,194 ; subps %xmm10,%xmm8
- DB 68,15,40,21,67,44,0,0 ; movaps 0x2c43(%rip),%xmm10 # 57b0 <_sk_callback_sse41+0x75d>
+ DB 68,15,40,21,108,44,0,0 ; movaps 0x2c6c(%rip),%xmm10 # 5800 <_sk_callback_sse41+0x773>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 68,15,40,29,71,44,0,0 ; movaps 0x2c47(%rip),%xmm11 # 57c0 <_sk_callback_sse41+0x76d>
+ DB 68,15,40,29,112,44,0,0 ; movaps 0x2c70(%rip),%xmm11 # 5810 <_sk_callback_sse41+0x783>
DB 69,15,94,218 ; divps %xmm10,%xmm11
DB 69,15,88,216 ; addps %xmm8,%xmm11
- DB 68,15,89,29,71,44,0,0 ; mulps 0x2c47(%rip),%xmm11 # 57d0 <_sk_callback_sse41+0x77d>
+ DB 68,15,89,29,112,44,0,0 ; mulps 0x2c70(%rip),%xmm11 # 5820 <_sk_callback_sse41+0x793>
DB 102,69,15,91,211 ; cvtps2dq %xmm11,%xmm10
DB 243,68,15,16,64,20 ; movss 0x14(%rax),%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
@@ -14511,7 +14524,7 @@ _sk_parametric_r_sse41 LABEL PROC
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,46,44,0,0 ; minps 0x2c2e(%rip),%xmm8 # 57e0 <_sk_callback_sse41+0x78d>
+ DB 68,15,93,5,87,44,0,0 ; minps 0x2c57(%rip),%xmm8 # 5830 <_sk_callback_sse41+0x7a3>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -14539,31 +14552,31 @@ _sk_parametric_g_sse41 LABEL PROC
DB 68,15,88,217 ; addps %xmm1,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,207,43,0,0 ; mulps 0x2bcf(%rip),%xmm12 # 57f0 <_sk_callback_sse41+0x79d>
- DB 68,15,84,29,215,43,0,0 ; andps 0x2bd7(%rip),%xmm11 # 5800 <_sk_callback_sse41+0x7ad>
- DB 68,15,86,29,223,43,0,0 ; orps 0x2bdf(%rip),%xmm11 # 5810 <_sk_callback_sse41+0x7bd>
- DB 68,15,88,37,231,43,0,0 ; addps 0x2be7(%rip),%xmm12 # 5820 <_sk_callback_sse41+0x7cd>
- DB 15,40,13,240,43,0,0 ; movaps 0x2bf0(%rip),%xmm1 # 5830 <_sk_callback_sse41+0x7dd>
+ DB 68,15,89,37,248,43,0,0 ; mulps 0x2bf8(%rip),%xmm12 # 5840 <_sk_callback_sse41+0x7b3>
+ DB 68,15,84,29,0,44,0,0 ; andps 0x2c00(%rip),%xmm11 # 5850 <_sk_callback_sse41+0x7c3>
+ DB 68,15,86,29,8,44,0,0 ; orps 0x2c08(%rip),%xmm11 # 5860 <_sk_callback_sse41+0x7d3>
+ DB 68,15,88,37,16,44,0,0 ; addps 0x2c10(%rip),%xmm12 # 5870 <_sk_callback_sse41+0x7e3>
+ DB 15,40,13,25,44,0,0 ; movaps 0x2c19(%rip),%xmm1 # 5880 <_sk_callback_sse41+0x7f3>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
- DB 68,15,88,29,240,43,0,0 ; addps 0x2bf0(%rip),%xmm11 # 5840 <_sk_callback_sse41+0x7ed>
- DB 15,40,13,249,43,0,0 ; movaps 0x2bf9(%rip),%xmm1 # 5850 <_sk_callback_sse41+0x7fd>
+ DB 68,15,88,29,25,44,0,0 ; addps 0x2c19(%rip),%xmm11 # 5890 <_sk_callback_sse41+0x803>
+ DB 15,40,13,34,44,0,0 ; movaps 0x2c22(%rip),%xmm1 # 58a0 <_sk_callback_sse41+0x813>
DB 65,15,94,203 ; divps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,230,43,0,0 ; addps 0x2be6(%rip),%xmm12 # 5860 <_sk_callback_sse41+0x80d>
- DB 15,40,13,239,43,0,0 ; movaps 0x2bef(%rip),%xmm1 # 5870 <_sk_callback_sse41+0x81d>
+ DB 68,15,88,37,15,44,0,0 ; addps 0x2c0f(%rip),%xmm12 # 58b0 <_sk_callback_sse41+0x823>
+ DB 15,40,13,24,44,0,0 ; movaps 0x2c18(%rip),%xmm1 # 58c0 <_sk_callback_sse41+0x833>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
- DB 68,15,40,21,239,43,0,0 ; movaps 0x2bef(%rip),%xmm10 # 5880 <_sk_callback_sse41+0x82d>
+ DB 68,15,40,21,24,44,0,0 ; movaps 0x2c18(%rip),%xmm10 # 58d0 <_sk_callback_sse41+0x843>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,13,244,43,0,0 ; movaps 0x2bf4(%rip),%xmm1 # 5890 <_sk_callback_sse41+0x83d>
+ DB 15,40,13,29,44,0,0 ; movaps 0x2c1d(%rip),%xmm1 # 58e0 <_sk_callback_sse41+0x853>
DB 65,15,94,202 ; divps %xmm10,%xmm1
DB 65,15,88,204 ; addps %xmm12,%xmm1
- DB 15,89,13,245,43,0,0 ; mulps 0x2bf5(%rip),%xmm1 # 58a0 <_sk_callback_sse41+0x84d>
+ DB 15,89,13,30,44,0,0 ; mulps 0x2c1e(%rip),%xmm1 # 58f0 <_sk_callback_sse41+0x863>
DB 102,68,15,91,209 ; cvtps2dq %xmm1,%xmm10
DB 243,15,16,72,20 ; movss 0x14(%rax),%xmm1
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
@@ -14571,7 +14584,7 @@ _sk_parametric_g_sse41 LABEL PROC
DB 102,65,15,56,20,201 ; blendvps %xmm0,%xmm9,%xmm1
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,200 ; maxps %xmm0,%xmm1
- DB 15,93,13,224,43,0,0 ; minps 0x2be0(%rip),%xmm1 # 58b0 <_sk_callback_sse41+0x85d>
+ DB 15,93,13,9,44,0,0 ; minps 0x2c09(%rip),%xmm1 # 5900 <_sk_callback_sse41+0x873>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -14599,31 +14612,31 @@ _sk_parametric_b_sse41 LABEL PROC
DB 68,15,88,218 ; addps %xmm2,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,129,43,0,0 ; mulps 0x2b81(%rip),%xmm12 # 58c0 <_sk_callback_sse41+0x86d>
- DB 68,15,84,29,137,43,0,0 ; andps 0x2b89(%rip),%xmm11 # 58d0 <_sk_callback_sse41+0x87d>
- DB 68,15,86,29,145,43,0,0 ; orps 0x2b91(%rip),%xmm11 # 58e0 <_sk_callback_sse41+0x88d>
- DB 68,15,88,37,153,43,0,0 ; addps 0x2b99(%rip),%xmm12 # 58f0 <_sk_callback_sse41+0x89d>
- DB 15,40,21,162,43,0,0 ; movaps 0x2ba2(%rip),%xmm2 # 5900 <_sk_callback_sse41+0x8ad>
+ DB 68,15,89,37,170,43,0,0 ; mulps 0x2baa(%rip),%xmm12 # 5910 <_sk_callback_sse41+0x883>
+ DB 68,15,84,29,178,43,0,0 ; andps 0x2bb2(%rip),%xmm11 # 5920 <_sk_callback_sse41+0x893>
+ DB 68,15,86,29,186,43,0,0 ; orps 0x2bba(%rip),%xmm11 # 5930 <_sk_callback_sse41+0x8a3>
+ DB 68,15,88,37,194,43,0,0 ; addps 0x2bc2(%rip),%xmm12 # 5940 <_sk_callback_sse41+0x8b3>
+ DB 15,40,21,203,43,0,0 ; movaps 0x2bcb(%rip),%xmm2 # 5950 <_sk_callback_sse41+0x8c3>
DB 65,15,89,211 ; mulps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
- DB 68,15,88,29,162,43,0,0 ; addps 0x2ba2(%rip),%xmm11 # 5910 <_sk_callback_sse41+0x8bd>
- DB 15,40,21,171,43,0,0 ; movaps 0x2bab(%rip),%xmm2 # 5920 <_sk_callback_sse41+0x8cd>
+ DB 68,15,88,29,203,43,0,0 ; addps 0x2bcb(%rip),%xmm11 # 5960 <_sk_callback_sse41+0x8d3>
+ DB 15,40,21,212,43,0,0 ; movaps 0x2bd4(%rip),%xmm2 # 5970 <_sk_callback_sse41+0x8e3>
DB 65,15,94,211 ; divps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,152,43,0,0 ; addps 0x2b98(%rip),%xmm12 # 5930 <_sk_callback_sse41+0x8dd>
- DB 15,40,21,161,43,0,0 ; movaps 0x2ba1(%rip),%xmm2 # 5940 <_sk_callback_sse41+0x8ed>
+ DB 68,15,88,37,193,43,0,0 ; addps 0x2bc1(%rip),%xmm12 # 5980 <_sk_callback_sse41+0x8f3>
+ DB 15,40,21,202,43,0,0 ; movaps 0x2bca(%rip),%xmm2 # 5990 <_sk_callback_sse41+0x903>
DB 65,15,89,211 ; mulps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
- DB 68,15,40,21,161,43,0,0 ; movaps 0x2ba1(%rip),%xmm10 # 5950 <_sk_callback_sse41+0x8fd>
+ DB 68,15,40,21,202,43,0,0 ; movaps 0x2bca(%rip),%xmm10 # 59a0 <_sk_callback_sse41+0x913>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,21,166,43,0,0 ; movaps 0x2ba6(%rip),%xmm2 # 5960 <_sk_callback_sse41+0x90d>
+ DB 15,40,21,207,43,0,0 ; movaps 0x2bcf(%rip),%xmm2 # 59b0 <_sk_callback_sse41+0x923>
DB 65,15,94,210 ; divps %xmm10,%xmm2
DB 65,15,88,212 ; addps %xmm12,%xmm2
- DB 15,89,21,167,43,0,0 ; mulps 0x2ba7(%rip),%xmm2 # 5970 <_sk_callback_sse41+0x91d>
+ DB 15,89,21,208,43,0,0 ; mulps 0x2bd0(%rip),%xmm2 # 59c0 <_sk_callback_sse41+0x933>
DB 102,68,15,91,210 ; cvtps2dq %xmm2,%xmm10
DB 243,15,16,80,20 ; movss 0x14(%rax),%xmm2
DB 15,198,210,0 ; shufps $0x0,%xmm2,%xmm2
@@ -14631,7 +14644,7 @@ _sk_parametric_b_sse41 LABEL PROC
DB 102,65,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm2
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,208 ; maxps %xmm0,%xmm2
- DB 15,93,21,146,43,0,0 ; minps 0x2b92(%rip),%xmm2 # 5980 <_sk_callback_sse41+0x92d>
+ DB 15,93,21,187,43,0,0 ; minps 0x2bbb(%rip),%xmm2 # 59d0 <_sk_callback_sse41+0x943>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -14659,31 +14672,31 @@ _sk_parametric_a_sse41 LABEL PROC
DB 68,15,88,219 ; addps %xmm3,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,51,43,0,0 ; mulps 0x2b33(%rip),%xmm12 # 5990 <_sk_callback_sse41+0x93d>
- DB 68,15,84,29,59,43,0,0 ; andps 0x2b3b(%rip),%xmm11 # 59a0 <_sk_callback_sse41+0x94d>
- DB 68,15,86,29,67,43,0,0 ; orps 0x2b43(%rip),%xmm11 # 59b0 <_sk_callback_sse41+0x95d>
- DB 68,15,88,37,75,43,0,0 ; addps 0x2b4b(%rip),%xmm12 # 59c0 <_sk_callback_sse41+0x96d>
- DB 15,40,29,84,43,0,0 ; movaps 0x2b54(%rip),%xmm3 # 59d0 <_sk_callback_sse41+0x97d>
+ DB 68,15,89,37,92,43,0,0 ; mulps 0x2b5c(%rip),%xmm12 # 59e0 <_sk_callback_sse41+0x953>
+ DB 68,15,84,29,100,43,0,0 ; andps 0x2b64(%rip),%xmm11 # 59f0 <_sk_callback_sse41+0x963>
+ DB 68,15,86,29,108,43,0,0 ; orps 0x2b6c(%rip),%xmm11 # 5a00 <_sk_callback_sse41+0x973>
+ DB 68,15,88,37,116,43,0,0 ; addps 0x2b74(%rip),%xmm12 # 5a10 <_sk_callback_sse41+0x983>
+ DB 15,40,29,125,43,0,0 ; movaps 0x2b7d(%rip),%xmm3 # 5a20 <_sk_callback_sse41+0x993>
DB 65,15,89,219 ; mulps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
- DB 68,15,88,29,84,43,0,0 ; addps 0x2b54(%rip),%xmm11 # 59e0 <_sk_callback_sse41+0x98d>
- DB 15,40,29,93,43,0,0 ; movaps 0x2b5d(%rip),%xmm3 # 59f0 <_sk_callback_sse41+0x99d>
+ DB 68,15,88,29,125,43,0,0 ; addps 0x2b7d(%rip),%xmm11 # 5a30 <_sk_callback_sse41+0x9a3>
+ DB 15,40,29,134,43,0,0 ; movaps 0x2b86(%rip),%xmm3 # 5a40 <_sk_callback_sse41+0x9b3>
DB 65,15,94,219 ; divps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,74,43,0,0 ; addps 0x2b4a(%rip),%xmm12 # 5a00 <_sk_callback_sse41+0x9ad>
- DB 15,40,29,83,43,0,0 ; movaps 0x2b53(%rip),%xmm3 # 5a10 <_sk_callback_sse41+0x9bd>
+ DB 68,15,88,37,115,43,0,0 ; addps 0x2b73(%rip),%xmm12 # 5a50 <_sk_callback_sse41+0x9c3>
+ DB 15,40,29,124,43,0,0 ; movaps 0x2b7c(%rip),%xmm3 # 5a60 <_sk_callback_sse41+0x9d3>
DB 65,15,89,219 ; mulps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
- DB 68,15,40,21,83,43,0,0 ; movaps 0x2b53(%rip),%xmm10 # 5a20 <_sk_callback_sse41+0x9cd>
+ DB 68,15,40,21,124,43,0,0 ; movaps 0x2b7c(%rip),%xmm10 # 5a70 <_sk_callback_sse41+0x9e3>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,29,88,43,0,0 ; movaps 0x2b58(%rip),%xmm3 # 5a30 <_sk_callback_sse41+0x9dd>
+ DB 15,40,29,129,43,0,0 ; movaps 0x2b81(%rip),%xmm3 # 5a80 <_sk_callback_sse41+0x9f3>
DB 65,15,94,218 ; divps %xmm10,%xmm3
DB 65,15,88,220 ; addps %xmm12,%xmm3
- DB 15,89,29,89,43,0,0 ; mulps 0x2b59(%rip),%xmm3 # 5a40 <_sk_callback_sse41+0x9ed>
+ DB 15,89,29,130,43,0,0 ; mulps 0x2b82(%rip),%xmm3 # 5a90 <_sk_callback_sse41+0xa03>
DB 102,68,15,91,211 ; cvtps2dq %xmm3,%xmm10
DB 243,15,16,88,20 ; movss 0x14(%rax),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
@@ -14691,7 +14704,7 @@ _sk_parametric_a_sse41 LABEL PROC
DB 102,65,15,56,20,217 ; blendvps %xmm0,%xmm9,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,216 ; maxps %xmm0,%xmm3
- DB 15,93,29,68,43,0,0 ; minps 0x2b44(%rip),%xmm3 # 5a50 <_sk_callback_sse41+0x9fd>
+ DB 15,93,29,109,43,0,0 ; minps 0x2b6d(%rip),%xmm3 # 5aa0 <_sk_callback_sse41+0xa13>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -14699,29 +14712,29 @@ _sk_parametric_a_sse41 LABEL PROC
PUBLIC _sk_lab_to_xyz_sse41
_sk_lab_to_xyz_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,89,5,64,43,0,0 ; mulps 0x2b40(%rip),%xmm8 # 5a60 <_sk_callback_sse41+0xa0d>
- DB 68,15,40,13,72,43,0,0 ; movaps 0x2b48(%rip),%xmm9 # 5a70 <_sk_callback_sse41+0xa1d>
+ DB 68,15,89,5,105,43,0,0 ; mulps 0x2b69(%rip),%xmm8 # 5ab0 <_sk_callback_sse41+0xa23>
+ DB 68,15,40,13,113,43,0,0 ; movaps 0x2b71(%rip),%xmm9 # 5ac0 <_sk_callback_sse41+0xa33>
DB 65,15,89,201 ; mulps %xmm9,%xmm1
- DB 15,40,5,77,43,0,0 ; movaps 0x2b4d(%rip),%xmm0 # 5a80 <_sk_callback_sse41+0xa2d>
+ DB 15,40,5,118,43,0,0 ; movaps 0x2b76(%rip),%xmm0 # 5ad0 <_sk_callback_sse41+0xa43>
DB 15,88,200 ; addps %xmm0,%xmm1
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 15,88,208 ; addps %xmm0,%xmm2
- DB 68,15,88,5,75,43,0,0 ; addps 0x2b4b(%rip),%xmm8 # 5a90 <_sk_callback_sse41+0xa3d>
- DB 68,15,89,5,83,43,0,0 ; mulps 0x2b53(%rip),%xmm8 # 5aa0 <_sk_callback_sse41+0xa4d>
- DB 15,89,13,92,43,0,0 ; mulps 0x2b5c(%rip),%xmm1 # 5ab0 <_sk_callback_sse41+0xa5d>
+ DB 68,15,88,5,116,43,0,0 ; addps 0x2b74(%rip),%xmm8 # 5ae0 <_sk_callback_sse41+0xa53>
+ DB 68,15,89,5,124,43,0,0 ; mulps 0x2b7c(%rip),%xmm8 # 5af0 <_sk_callback_sse41+0xa63>
+ DB 15,89,13,133,43,0,0 ; mulps 0x2b85(%rip),%xmm1 # 5b00 <_sk_callback_sse41+0xa73>
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 15,89,21,97,43,0,0 ; mulps 0x2b61(%rip),%xmm2 # 5ac0 <_sk_callback_sse41+0xa6d>
+ DB 15,89,21,138,43,0,0 ; mulps 0x2b8a(%rip),%xmm2 # 5b10 <_sk_callback_sse41+0xa83>
DB 69,15,40,208 ; movaps %xmm8,%xmm10
DB 68,15,92,210 ; subps %xmm2,%xmm10
DB 68,15,40,217 ; movaps %xmm1,%xmm11
DB 69,15,89,219 ; mulps %xmm11,%xmm11
DB 68,15,89,217 ; mulps %xmm1,%xmm11
- DB 68,15,40,13,85,43,0,0 ; movaps 0x2b55(%rip),%xmm9 # 5ad0 <_sk_callback_sse41+0xa7d>
+ DB 68,15,40,13,126,43,0,0 ; movaps 0x2b7e(%rip),%xmm9 # 5b20 <_sk_callback_sse41+0xa93>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0
- DB 15,40,21,85,43,0,0 ; movaps 0x2b55(%rip),%xmm2 # 5ae0 <_sk_callback_sse41+0xa8d>
+ DB 15,40,21,126,43,0,0 ; movaps 0x2b7e(%rip),%xmm2 # 5b30 <_sk_callback_sse41+0xaa3>
DB 15,88,202 ; addps %xmm2,%xmm1
- DB 68,15,40,37,90,43,0,0 ; movaps 0x2b5a(%rip),%xmm12 # 5af0 <_sk_callback_sse41+0xa9d>
+ DB 68,15,40,37,131,43,0,0 ; movaps 0x2b83(%rip),%xmm12 # 5b40 <_sk_callback_sse41+0xab3>
DB 65,15,89,204 ; mulps %xmm12,%xmm1
DB 102,65,15,56,20,203 ; blendvps %xmm0,%xmm11,%xmm1
DB 69,15,40,216 ; movaps %xmm8,%xmm11
@@ -14740,8 +14753,8 @@ _sk_lab_to_xyz_sse41 LABEL PROC
DB 65,15,89,212 ; mulps %xmm12,%xmm2
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 102,65,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm2
- DB 15,89,13,19,43,0,0 ; mulps 0x2b13(%rip),%xmm1 # 5b00 <_sk_callback_sse41+0xaad>
- DB 15,89,21,28,43,0,0 ; mulps 0x2b1c(%rip),%xmm2 # 5b10 <_sk_callback_sse41+0xabd>
+ DB 15,89,13,60,43,0,0 ; mulps 0x2b3c(%rip),%xmm1 # 5b50 <_sk_callback_sse41+0xac3>
+ DB 15,89,21,69,43,0,0 ; mulps 0x2b45(%rip),%xmm2 # 5b60 <_sk_callback_sse41+0xad3>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 65,15,40,200 ; movaps %xmm8,%xmm1
@@ -14750,40 +14763,41 @@ _sk_lab_to_xyz_sse41 LABEL PROC
PUBLIC _sk_load_a8_sse41
_sk_load_a8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,38 ; jne 302f <_sk_load_a8_sse41+0x30>
- DB 102,65,15,56,49,4,57 ; pmovzxbd (%r9,%rdi,1),%xmm0
- DB 102,15,219,5,8,43,0,0 ; pand 0x2b08(%rip),%xmm0 # 5b20 <_sk_callback_sse41+0xacd>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,38 ; jne 3056 <_sk_load_a8_sse41+0x30>
+ DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0
+ DB 102,15,219,5,49,43,0,0 ; pand 0x2b31(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xae3>
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,14,43,0,0 ; mulps 0x2b0e(%rip),%xmm3 # 5b30 <_sk_callback_sse41+0xadd>
+ DB 15,89,29,55,43,0,0 ; mulps 0x2b37(%rip),%xmm3 # 5b80 <_sk_callback_sse41+0xaf3>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,39 ; je 3067 <_sk_load_a8_sse41+0x68>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 305b <_sk_load_a8_sse41+0x5c>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,196 ; jne 3010 <_sk_load_a8_sse41+0x11>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,39 ; je 308e <_sk_load_a8_sse41+0x68>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 3082 <_sk_load_a8_sse41+0x5c>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,196 ; jne 3037 <_sk_load_a8_sse41+0x11>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm0
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm0
- DB 235,156 ; jmp 3010 <_sk_load_a8_sse41+0x11>
+ DB 235,156 ; jmp 3037 <_sk_load_a8_sse41+0x11>
PUBLIC _sk_gather_a8_sse41
_sk_gather_a8_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -14791,94 +14805,96 @@ _sk_gather_a8_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,58,32,4,24,0 ; pinsrb $0x0,(%r8,%r11,1),%xmm0
- DB 102,67,15,58,32,4,16,1 ; pinsrb $0x1,(%r8,%r10,1),%xmm0
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 102,65,15,58,32,193,2 ; pinsrb $0x2,%r9d,%xmm0
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,58,32,4,25,0 ; pinsrb $0x0,(%r9,%rbx,1),%xmm0
+ DB 102,67,15,58,32,4,25,1 ; pinsrb $0x1,(%r9,%r11,1),%xmm0
+ DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx
+ DB 102,15,58,32,195,2 ; pinsrb $0x2,%ebx,%xmm0
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,92,42,0,0 ; mulps 0x2a5c(%rip),%xmm3 # 5b40 <_sk_callback_sse41+0xaed>
+ DB 15,89,29,133,42,0,0 ; mulps 0x2a85(%rip),%xmm3 # 5b90 <_sk_callback_sse41+0xb03>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,15,239,210 ; pxor %xmm2,%xmm2
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_a8_sse41
_sk_store_a8_sse41 LABEL PROC
DB 72,131,236,4 ; sub $0x4,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 68,15,40,5,76,42,0,0 ; movaps 0x2a4c(%rip),%xmm8 # 5b50 <_sk_callback_sse41+0xafd>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 68,15,40,5,116,42,0,0 ; movaps 0x2a74(%rip),%xmm8 # 5ba0 <_sk_callback_sse41+0xb13>
DB 68,15,89,195 ; mulps %xmm3,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,17 ; jne 312e <_sk_store_a8_sse41+0x3b>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,17 ; jne 3156 <_sk_store_a8_sse41+0x3b>
DB 102,68,15,126,192 ; movd %xmm8,%eax
- DB 65,137,4,57 ; mov %eax,(%r9,%rdi,1)
+ DB 65,137,4,18 ; mov %eax,(%r10,%rdx,1)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,131,196,4 ; add $0x4,%rsp
DB 255,224 ; jmpq *%rax
DB 102,69,15,56,49,192 ; pmovzxbd %xmm8,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,30 ; je 315f <_sk_store_a8_sse41+0x6c>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,15 ; je 3156 <_sk_store_a8_sse41+0x63>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,217 ; jne 3126 <_sk_store_a8_sse41+0x33>
- DB 102,69,15,58,20,68,57,2,8 ; pextrb $0x8,%xmm8,0x2(%r9,%rdi,1)
- DB 102,69,15,58,20,68,57,1,4 ; pextrb $0x4,%xmm8,0x1(%r9,%rdi,1)
- DB 102,69,15,58,20,4,57,0 ; pextrb $0x0,%xmm8,(%r9,%rdi,1)
- DB 235,189 ; jmp 3126 <_sk_store_a8_sse41+0x33>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,30 ; je 3187 <_sk_store_a8_sse41+0x6c>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,15 ; je 317e <_sk_store_a8_sse41+0x63>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,217 ; jne 314e <_sk_store_a8_sse41+0x33>
+ DB 102,69,15,58,20,68,18,2,8 ; pextrb $0x8,%xmm8,0x2(%r10,%rdx,1)
+ DB 102,69,15,58,20,68,18,1,4 ; pextrb $0x4,%xmm8,0x1(%r10,%rdx,1)
+ DB 102,69,15,58,20,4,18,0 ; pextrb $0x0,%xmm8,(%r10,%rdx,1)
+ DB 235,189 ; jmp 314e <_sk_store_a8_sse41+0x33>
PUBLIC _sk_load_g8_sse41
_sk_load_g8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,42 ; jne 319d <_sk_load_g8_sse41+0x34>
- DB 102,65,15,56,49,4,57 ; pmovzxbd (%r9,%rdi,1),%xmm0
- DB 102,15,219,5,222,41,0,0 ; pand 0x29de(%rip),%xmm0 # 5b60 <_sk_callback_sse41+0xb0d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,42 ; jne 31c5 <_sk_load_g8_sse41+0x34>
+ DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0
+ DB 102,15,219,5,6,42,0,0 ; pand 0x2a06(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xb23>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,228,41,0,0 ; mulps 0x29e4(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xb1d>
+ DB 15,89,5,12,42,0,0 ; mulps 0x2a0c(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xb33>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,235,41,0,0 ; movaps 0x29eb(%rip),%xmm3 # 5b80 <_sk_callback_sse41+0xb2d>
+ DB 15,40,29,19,42,0,0 ; movaps 0x2a13(%rip),%xmm3 # 5bd0 <_sk_callback_sse41+0xb43>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,39 ; je 31d5 <_sk_load_g8_sse41+0x6c>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 31c9 <_sk_load_g8_sse41+0x60>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,192 ; jne 317a <_sk_load_g8_sse41+0x11>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,39 ; je 31fd <_sk_load_g8_sse41+0x6c>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 31f1 <_sk_load_g8_sse41+0x60>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,192 ; jne 31a2 <_sk_load_g8_sse41+0x11>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm0
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm0
- DB 235,152 ; jmp 317a <_sk_load_g8_sse41+0x11>
+ DB 235,152 ; jmp 31a2 <_sk_load_g8_sse41+0x11>
PUBLIC _sk_gather_g8_sse41
_sk_gather_g8_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -14886,37 +14902,39 @@ _sk_gather_g8_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,58,32,4,24,0 ; pinsrb $0x0,(%r8,%r11,1),%xmm0
- DB 102,67,15,58,32,4,16,1 ; pinsrb $0x1,(%r8,%r10,1),%xmm0
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 102,65,15,58,32,193,2 ; pinsrb $0x2,%r9d,%xmm0
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,58,32,4,25,0 ; pinsrb $0x0,(%r9,%rbx,1),%xmm0
+ DB 102,67,15,58,32,4,25,1 ; pinsrb $0x1,(%r9,%r11,1),%xmm0
+ DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx
+ DB 102,15,58,32,195,2 ; pinsrb $0x2,%ebx,%xmm0
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,62,41,0,0 ; mulps 0x293e(%rip),%xmm0 # 5b90 <_sk_callback_sse41+0xb3d>
+ DB 15,89,5,102,41,0,0 ; mulps 0x2966(%rip),%xmm0 # 5be0 <_sk_callback_sse41+0xb53>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,69,41,0,0 ; movaps 0x2945(%rip),%xmm3 # 5ba0 <_sk_callback_sse41+0xb4d>
+ DB 15,40,29,109,41,0,0 ; movaps 0x296d(%rip),%xmm3 # 5bf0 <_sk_callback_sse41+0xb63>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_gather_i8_sse41
_sk_gather_i8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,192 ; mov %rax,%r8
- DB 77,133,192 ; test %r8,%r8
- DB 116,5 ; je 3272 <_sk_gather_i8_sse41+0xf>
- DB 76,137,192 ; mov %r8,%rax
- DB 235,2 ; jmp 3274 <_sk_gather_i8_sse41+0x11>
+ DB 73,137,193 ; mov %rax,%r9
+ DB 77,133,201 ; test %r9,%r9
+ DB 116,5 ; je 329b <_sk_gather_i8_sse41+0xf>
+ DB 76,137,200 ; mov %r9,%rax
+ DB 235,2 ; jmp 329d <_sk_gather_i8_sse41+0x11>
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 76,139,8 ; mov (%rax),%r9
+ DB 76,139,16 ; mov (%rax),%r10
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -14924,38 +14942,38 @@ _sk_gather_i8_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,195 ; movq %xmm0,%r11
- DB 68,137,219 ; mov %r11d,%ebx
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 102,65,15,58,32,4,25,0 ; pinsrb $0x0,(%r9,%rbx,1),%xmm0
- DB 102,67,15,58,32,4,25,1 ; pinsrb $0x1,(%r9,%r11,1),%xmm0
- DB 102,67,15,58,32,4,17,2 ; pinsrb $0x2,(%r9,%r10,1),%xmm0
- DB 102,65,15,58,32,4,1,3 ; pinsrb $0x3,(%r9,%rax,1),%xmm0
+ DB 102,72,15,126,195 ; movq %xmm0,%rbx
+ DB 65,137,222 ; mov %ebx,%r14d
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 102,67,15,58,32,4,50,0 ; pinsrb $0x0,(%r10,%r14,1),%xmm0
+ DB 102,65,15,58,32,4,26,1 ; pinsrb $0x1,(%r10,%rbx,1),%xmm0
+ DB 102,67,15,58,32,4,26,2 ; pinsrb $0x2,(%r10,%r11,1),%xmm0
+ DB 102,65,15,58,32,4,2,3 ; pinsrb $0x3,(%r10,%rax,1),%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
- DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
+ DB 102,73,15,58,22,194,1 ; pextrq $0x1,%xmm0,%r10
DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 73,139,64,8 ; mov 0x8(%r8),%rax
- DB 65,137,216 ; mov %ebx,%r8d
+ DB 73,139,65,8 ; mov 0x8(%r9),%rax
+ DB 65,137,217 ; mov %ebx,%r9d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,137,202 ; mov %r9d,%r10d
- DB 73,193,233,30 ; shr $0x1e,%r9
- DB 102,66,15,110,28,128 ; movd (%rax,%r8,4),%xmm3
+ DB 69,137,211 ; mov %r10d,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 102,66,15,110,28,136 ; movd (%rax,%r9,4),%xmm3
DB 102,15,58,34,28,24,1 ; pinsrd $0x1,(%rax,%rbx,1),%xmm3
- DB 102,66,15,58,34,28,144,2 ; pinsrd $0x2,(%rax,%r10,4),%xmm3
- DB 102,66,15,58,34,28,8,3 ; pinsrd $0x3,(%rax,%r9,1),%xmm3
- DB 102,15,111,5,155,40,0,0 ; movdqa 0x289b(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xb5d>
+ DB 102,66,15,58,34,28,152,2 ; pinsrd $0x2,(%rax,%r11,4),%xmm3
+ DB 102,66,15,58,34,28,16,3 ; pinsrd $0x3,(%rax,%r10,1),%xmm3
+ DB 102,15,111,5,192,40,0,0 ; movdqa 0x28c0(%rip),%xmm0 # 5c00 <_sk_callback_sse41+0xb73>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,156,40,0,0 ; movaps 0x289c(%rip),%xmm8 # 5bc0 <_sk_callback_sse41+0xb6d>
+ DB 68,15,40,5,193,40,0,0 ; movaps 0x28c1(%rip),%xmm8 # 5c10 <_sk_callback_sse41+0xb83>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,155,40,0,0 ; pshufb 0x289b(%rip),%xmm1 # 5bd0 <_sk_callback_sse41+0xb7d>
+ DB 102,15,56,0,13,192,40,0,0 ; pshufb 0x28c0(%rip),%xmm1 # 5c20 <_sk_callback_sse41+0xb93>
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,151,40,0,0 ; pshufb 0x2897(%rip),%xmm2 # 5be0 <_sk_callback_sse41+0xb8d>
+ DB 102,15,56,0,21,188,40,0,0 ; pshufb 0x28bc(%rip),%xmm2 # 5c30 <_sk_callback_sse41+0xba3>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -14963,51 +14981,53 @@ _sk_gather_i8_sse41 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
+ DB 65,94 ; pop %r14
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_565_sse41
_sk_load_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,80 ; jne 33bb <_sk_load_565_sse41+0x5a>
- DB 102,65,15,56,51,20,121 ; pmovzxwd (%r9,%rdi,2),%xmm2
- DB 102,15,111,5,118,40,0,0 ; movdqa 0x2876(%rip),%xmm0 # 5bf0 <_sk_callback_sse41+0xb9d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,80 ; jne 33e8 <_sk_load_565_sse41+0x5a>
+ DB 102,65,15,56,51,20,82 ; pmovzxwd (%r10,%rdx,2),%xmm2
+ DB 102,15,111,5,153,40,0,0 ; movdqa 0x2899(%rip),%xmm0 # 5c40 <_sk_callback_sse41+0xbb3>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,120,40,0,0 ; mulps 0x2878(%rip),%xmm0 # 5c00 <_sk_callback_sse41+0xbad>
- DB 102,15,111,13,128,40,0,0 ; movdqa 0x2880(%rip),%xmm1 # 5c10 <_sk_callback_sse41+0xbbd>
+ DB 15,89,5,155,40,0,0 ; mulps 0x289b(%rip),%xmm0 # 5c50 <_sk_callback_sse41+0xbc3>
+ DB 102,15,111,13,163,40,0,0 ; movdqa 0x28a3(%rip),%xmm1 # 5c60 <_sk_callback_sse41+0xbd3>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,130,40,0,0 ; mulps 0x2882(%rip),%xmm1 # 5c20 <_sk_callback_sse41+0xbcd>
- DB 102,15,219,21,138,40,0,0 ; pand 0x288a(%rip),%xmm2 # 5c30 <_sk_callback_sse41+0xbdd>
+ DB 15,89,13,165,40,0,0 ; mulps 0x28a5(%rip),%xmm1 # 5c70 <_sk_callback_sse41+0xbe3>
+ DB 102,15,219,21,173,40,0,0 ; pand 0x28ad(%rip),%xmm2 # 5c80 <_sk_callback_sse41+0xbf3>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,144,40,0,0 ; mulps 0x2890(%rip),%xmm2 # 5c40 <_sk_callback_sse41+0xbed>
+ DB 15,89,21,179,40,0,0 ; mulps 0x28b3(%rip),%xmm2 # 5c90 <_sk_callback_sse41+0xc03>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,151,40,0,0 ; movaps 0x2897(%rip),%xmm3 # 5c50 <_sk_callback_sse41+0xbfd>
+ DB 15,40,29,186,40,0,0 ; movaps 0x28ba(%rip),%xmm3 # 5ca0 <_sk_callback_sse41+0xc13>
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,210 ; pxor %xmm2,%xmm2
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,39 ; je 33f3 <_sk_load_565_sse41+0x92>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 33e7 <_sk_load_565_sse41+0x86>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,154 ; jne 3372 <_sk_load_565_sse41+0x11>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,39 ; je 3420 <_sk_load_565_sse41+0x92>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 3414 <_sk_load_565_sse41+0x86>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,154 ; jne 339f <_sk_load_565_sse41+0x11>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,15,58,34,208,1 ; pinsrd $0x1,%eax,%xmm2
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,58,34,208,0 ; pinsrd $0x0,%eax,%xmm2
- DB 233,111,255,255,255 ; jmpq 3372 <_sk_load_565_sse41+0x11>
+ DB 233,111,255,255,255 ; jmpq 339f <_sk_load_565_sse41+0x11>
PUBLIC _sk_gather_565_sse41
_sk_gather_565_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -15015,43 +15035,44 @@ _sk_gather_565_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,196,4,88,0 ; pinsrw $0x0,(%r8,%r11,2),%xmm0
- DB 102,67,15,196,4,80,1 ; pinsrw $0x1,(%r8,%r10,2),%xmm0
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 102,65,15,196,193,2 ; pinsrw $0x2,%r9d,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,196,4,89,0 ; pinsrw $0x0,(%r9,%rbx,2),%xmm0
+ DB 102,67,15,196,4,89,1 ; pinsrw $0x1,(%r9,%r11,2),%xmm0
+ DB 67,15,183,28,81 ; movzwl (%r9,%r10,2),%ebx
+ DB 102,15,196,195,2 ; pinsrw $0x2,%ebx,%xmm0
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0
DB 102,15,56,51,208 ; pmovzxwd %xmm0,%xmm2
- DB 102,15,111,5,243,39,0,0 ; movdqa 0x27f3(%rip),%xmm0 # 5c60 <_sk_callback_sse41+0xc0d>
+ DB 102,15,111,5,22,40,0,0 ; movdqa 0x2816(%rip),%xmm0 # 5cb0 <_sk_callback_sse41+0xc23>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,245,39,0,0 ; mulps 0x27f5(%rip),%xmm0 # 5c70 <_sk_callback_sse41+0xc1d>
- DB 102,15,111,13,253,39,0,0 ; movdqa 0x27fd(%rip),%xmm1 # 5c80 <_sk_callback_sse41+0xc2d>
+ DB 15,89,5,24,40,0,0 ; mulps 0x2818(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xc33>
+ DB 102,15,111,13,32,40,0,0 ; movdqa 0x2820(%rip),%xmm1 # 5cd0 <_sk_callback_sse41+0xc43>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,255,39,0,0 ; mulps 0x27ff(%rip),%xmm1 # 5c90 <_sk_callback_sse41+0xc3d>
- DB 102,15,219,21,7,40,0,0 ; pand 0x2807(%rip),%xmm2 # 5ca0 <_sk_callback_sse41+0xc4d>
+ DB 15,89,13,34,40,0,0 ; mulps 0x2822(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xc53>
+ DB 102,15,219,21,42,40,0,0 ; pand 0x282a(%rip),%xmm2 # 5cf0 <_sk_callback_sse41+0xc63>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,13,40,0,0 ; mulps 0x280d(%rip),%xmm2 # 5cb0 <_sk_callback_sse41+0xc5d>
+ DB 15,89,21,48,40,0,0 ; mulps 0x2830(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xc73>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,20,40,0,0 ; movaps 0x2814(%rip),%xmm3 # 5cc0 <_sk_callback_sse41+0xc6d>
+ DB 15,40,29,55,40,0,0 ; movaps 0x2837(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0xc83>
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_565_sse41
_sk_store_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,21,40,0,0 ; movaps 0x2815(%rip),%xmm8 # 5cd0 <_sk_callback_sse41+0xc7d>
+ DB 68,15,40,5,55,40,0,0 ; movaps 0x2837(%rip),%xmm8 # 5d20 <_sk_callback_sse41+0xc93>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9
- DB 68,15,40,21,10,40,0,0 ; movaps 0x280a(%rip),%xmm10 # 5ce0 <_sk_callback_sse41+0xc8d>
+ DB 68,15,40,21,44,40,0,0 ; movaps 0x282c(%rip),%xmm10 # 5d30 <_sk_callback_sse41+0xca3>
DB 68,15,89,209 ; mulps %xmm1,%xmm10
DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10
DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10
@@ -15060,71 +15081,72 @@ _sk_store_565_sse41 LABEL PROC
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,69,15,86,194 ; orpd %xmm10,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 350d <_sk_store_565_sse41+0x5f>
- DB 242,68,15,17,4,120 ; movsd %xmm8,(%rax,%rdi,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 353b <_sk_store_565_sse41+0x5f>
+ DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 102,69,15,56,51,192 ; pmovzxwd %xmm8,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,30 ; je 353e <_sk_store_565_sse41+0x90>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,15 ; je 3535 <_sk_store_565_sse41+0x87>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,221 ; jne 3509 <_sk_store_565_sse41+0x5b>
- DB 102,68,15,58,21,68,120,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdi,2)
- DB 102,68,15,58,21,68,120,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdi,2)
- DB 102,68,15,58,21,4,120,0 ; pextrw $0x0,%xmm8,(%rax,%rdi,2)
- DB 235,193 ; jmp 3509 <_sk_store_565_sse41+0x5b>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,30 ; je 356c <_sk_store_565_sse41+0x90>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,15 ; je 3563 <_sk_store_565_sse41+0x87>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,221 ; jne 3537 <_sk_store_565_sse41+0x5b>
+ DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
+ DB 102,68,15,58,21,68,80,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdx,2)
+ DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2)
+ DB 235,193 ; jmp 3537 <_sk_store_565_sse41+0x5b>
PUBLIC _sk_load_4444_sse41
_sk_load_4444_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,95 ; jne 35b1 <_sk_load_4444_sse41+0x69>
- DB 102,65,15,56,51,28,121 ; pmovzxwd (%r9,%rdi,2),%xmm3
- DB 102,15,111,5,143,39,0,0 ; movdqa 0x278f(%rip),%xmm0 # 5cf0 <_sk_callback_sse41+0xc9d>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,95 ; jne 35df <_sk_load_4444_sse41+0x69>
+ DB 102,65,15,56,51,28,82 ; pmovzxwd (%r10,%rdx,2),%xmm3
+ DB 102,15,111,5,177,39,0,0 ; movdqa 0x27b1(%rip),%xmm0 # 5d40 <_sk_callback_sse41+0xcb3>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,145,39,0,0 ; mulps 0x2791(%rip),%xmm0 # 5d00 <_sk_callback_sse41+0xcad>
- DB 102,15,111,13,153,39,0,0 ; movdqa 0x2799(%rip),%xmm1 # 5d10 <_sk_callback_sse41+0xcbd>
+ DB 15,89,5,179,39,0,0 ; mulps 0x27b3(%rip),%xmm0 # 5d50 <_sk_callback_sse41+0xcc3>
+ DB 102,15,111,13,187,39,0,0 ; movdqa 0x27bb(%rip),%xmm1 # 5d60 <_sk_callback_sse41+0xcd3>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,155,39,0,0 ; mulps 0x279b(%rip),%xmm1 # 5d20 <_sk_callback_sse41+0xccd>
- DB 102,15,111,21,163,39,0,0 ; movdqa 0x27a3(%rip),%xmm2 # 5d30 <_sk_callback_sse41+0xcdd>
+ DB 15,89,13,189,39,0,0 ; mulps 0x27bd(%rip),%xmm1 # 5d70 <_sk_callback_sse41+0xce3>
+ DB 102,15,111,21,197,39,0,0 ; movdqa 0x27c5(%rip),%xmm2 # 5d80 <_sk_callback_sse41+0xcf3>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,165,39,0,0 ; mulps 0x27a5(%rip),%xmm2 # 5d40 <_sk_callback_sse41+0xced>
- DB 102,15,219,29,173,39,0,0 ; pand 0x27ad(%rip),%xmm3 # 5d50 <_sk_callback_sse41+0xcfd>
+ DB 15,89,21,199,39,0,0 ; mulps 0x27c7(%rip),%xmm2 # 5d90 <_sk_callback_sse41+0xd03>
+ DB 102,15,219,29,207,39,0,0 ; pand 0x27cf(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0xd13>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,179,39,0,0 ; mulps 0x27b3(%rip),%xmm3 # 5d60 <_sk_callback_sse41+0xd0d>
+ DB 15,89,29,213,39,0,0 ; mulps 0x27d5(%rip),%xmm3 # 5db0 <_sk_callback_sse41+0xd23>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,39 ; je 35e9 <_sk_load_4444_sse41+0xa1>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 35dd <_sk_load_4444_sse41+0x95>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,139 ; jne 3559 <_sk_load_4444_sse41+0x11>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,39 ; je 3617 <_sk_load_4444_sse41+0xa1>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 360b <_sk_load_4444_sse41+0x95>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,139 ; jne 3587 <_sk_load_4444_sse41+0x11>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,15,58,34,216,1 ; pinsrd $0x1,%eax,%xmm3
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,58,34,216,0 ; pinsrd $0x0,%eax,%xmm3
- DB 233,96,255,255,255 ; jmpq 3559 <_sk_load_4444_sse41+0x11>
+ DB 233,96,255,255,255 ; jmpq 3587 <_sk_load_4444_sse41+0x11>
PUBLIC _sk_gather_4444_sse41
_sk_gather_4444_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -15132,41 +15154,42 @@ _sk_gather_4444_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,196,4,88,0 ; pinsrw $0x0,(%r8,%r11,2),%xmm0
- DB 102,67,15,196,4,80,1 ; pinsrw $0x1,(%r8,%r10,2),%xmm0
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 102,65,15,196,193,2 ; pinsrw $0x2,%r9d,%xmm0
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,196,4,89,0 ; pinsrw $0x0,(%r9,%rbx,2),%xmm0
+ DB 102,67,15,196,4,89,1 ; pinsrw $0x1,(%r9,%r11,2),%xmm0
+ DB 67,15,183,28,81 ; movzwl (%r9,%r10,2),%ebx
+ DB 102,15,196,195,2 ; pinsrw $0x2,%ebx,%xmm0
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0
DB 102,15,56,51,216 ; pmovzxwd %xmm0,%xmm3
- DB 102,15,111,5,13,39,0,0 ; movdqa 0x270d(%rip),%xmm0 # 5d70 <_sk_callback_sse41+0xd1d>
+ DB 102,15,111,5,47,39,0,0 ; movdqa 0x272f(%rip),%xmm0 # 5dc0 <_sk_callback_sse41+0xd33>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,15,39,0,0 ; mulps 0x270f(%rip),%xmm0 # 5d80 <_sk_callback_sse41+0xd2d>
- DB 102,15,111,13,23,39,0,0 ; movdqa 0x2717(%rip),%xmm1 # 5d90 <_sk_callback_sse41+0xd3d>
+ DB 15,89,5,49,39,0,0 ; mulps 0x2731(%rip),%xmm0 # 5dd0 <_sk_callback_sse41+0xd43>
+ DB 102,15,111,13,57,39,0,0 ; movdqa 0x2739(%rip),%xmm1 # 5de0 <_sk_callback_sse41+0xd53>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,25,39,0,0 ; mulps 0x2719(%rip),%xmm1 # 5da0 <_sk_callback_sse41+0xd4d>
- DB 102,15,111,21,33,39,0,0 ; movdqa 0x2721(%rip),%xmm2 # 5db0 <_sk_callback_sse41+0xd5d>
+ DB 15,89,13,59,39,0,0 ; mulps 0x273b(%rip),%xmm1 # 5df0 <_sk_callback_sse41+0xd63>
+ DB 102,15,111,21,67,39,0,0 ; movdqa 0x2743(%rip),%xmm2 # 5e00 <_sk_callback_sse41+0xd73>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,35,39,0,0 ; mulps 0x2723(%rip),%xmm2 # 5dc0 <_sk_callback_sse41+0xd6d>
- DB 102,15,219,29,43,39,0,0 ; pand 0x272b(%rip),%xmm3 # 5dd0 <_sk_callback_sse41+0xd7d>
+ DB 15,89,21,69,39,0,0 ; mulps 0x2745(%rip),%xmm2 # 5e10 <_sk_callback_sse41+0xd83>
+ DB 102,15,219,29,77,39,0,0 ; pand 0x274d(%rip),%xmm3 # 5e20 <_sk_callback_sse41+0xd93>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,49,39,0,0 ; mulps 0x2731(%rip),%xmm3 # 5de0 <_sk_callback_sse41+0xd8d>
+ DB 15,89,29,83,39,0,0 ; mulps 0x2753(%rip),%xmm3 # 5e30 <_sk_callback_sse41+0xda3>
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_4444_sse41
_sk_store_4444_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,48,39,0,0 ; movaps 0x2730(%rip),%xmm8 # 5df0 <_sk_callback_sse41+0xd9d>
+ DB 68,15,40,5,81,39,0,0 ; movaps 0x2751(%rip),%xmm8 # 5e40 <_sk_callback_sse41+0xdb3>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -15185,43 +15208,43 @@ _sk_store_4444_sse41 LABEL PROC
DB 102,69,15,86,193 ; orpd %xmm9,%xmm8
DB 102,69,15,86,194 ; orpd %xmm10,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3726 <_sk_store_4444_sse41+0x73>
- DB 242,68,15,17,4,120 ; movsd %xmm8,(%rax,%rdi,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3755 <_sk_store_4444_sse41+0x73>
+ DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 102,69,15,56,51,192 ; pmovzxwd %xmm8,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,30 ; je 3757 <_sk_store_4444_sse41+0xa4>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,15 ; je 374e <_sk_store_4444_sse41+0x9b>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,221 ; jne 3722 <_sk_store_4444_sse41+0x6f>
- DB 102,68,15,58,21,68,120,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdi,2)
- DB 102,68,15,58,21,68,120,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdi,2)
- DB 102,68,15,58,21,4,120,0 ; pextrw $0x0,%xmm8,(%rax,%rdi,2)
- DB 235,193 ; jmp 3722 <_sk_store_4444_sse41+0x6f>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,30 ; je 3786 <_sk_store_4444_sse41+0xa4>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,15 ; je 377d <_sk_store_4444_sse41+0x9b>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,221 ; jne 3751 <_sk_store_4444_sse41+0x6f>
+ DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
+ DB 102,68,15,58,21,68,80,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdx,2)
+ DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2)
+ DB 235,193 ; jmp 3751 <_sk_store_4444_sse41+0x6f>
PUBLIC _sk_load_8888_sse41
_sk_load_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,88 ; jne 37c3 <_sk_load_8888_sse41+0x62>
- DB 243,15,111,28,184 ; movdqu (%rax,%rdi,4),%xmm3
- DB 102,15,111,5,136,38,0,0 ; movdqa 0x2688(%rip),%xmm0 # 5e00 <_sk_callback_sse41+0xdad>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,88 ; jne 37f2 <_sk_load_8888_sse41+0x62>
+ DB 243,15,111,28,144 ; movdqu (%rax,%rdx,4),%xmm3
+ DB 102,15,111,5,169,38,0,0 ; movdqa 0x26a9(%rip),%xmm0 # 5e50 <_sk_callback_sse41+0xdc3>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,137,38,0,0 ; movaps 0x2689(%rip),%xmm8 # 5e10 <_sk_callback_sse41+0xdbd>
+ DB 68,15,40,5,170,38,0,0 ; movaps 0x26aa(%rip),%xmm8 # 5e60 <_sk_callback_sse41+0xdd3>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,136,38,0,0 ; pshufb 0x2688(%rip),%xmm1 # 5e20 <_sk_callback_sse41+0xdcd>
+ DB 102,15,56,0,13,169,38,0,0 ; pshufb 0x26a9(%rip),%xmm1 # 5e70 <_sk_callback_sse41+0xde3>
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,132,38,0,0 ; pshufb 0x2684(%rip),%xmm2 # 5e30 <_sk_callback_sse41+0xddd>
+ DB 102,15,56,0,21,165,38,0,0 ; pshufb 0x26a5(%rip),%xmm2 # 5e80 <_sk_callback_sse41+0xdf3>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -15229,25 +15252,26 @@ _sk_load_8888_sse41 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,31 ; je 37f3 <_sk_load_8888_sse41+0x92>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,17 ; je 37eb <_sk_load_8888_sse41+0x8a>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,144 ; jne 3770 <_sk_load_8888_sse41+0xf>
- DB 102,15,110,68,184,8 ; movd 0x8(%rax,%rdi,4),%xmm0
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,31 ; je 3822 <_sk_load_8888_sse41+0x92>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,17 ; je 381a <_sk_load_8888_sse41+0x8a>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,144 ; jne 379f <_sk_load_8888_sse41+0xf>
+ DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
- DB 102,15,58,34,92,184,4,1 ; pinsrd $0x1,0x4(%rax,%rdi,4),%xmm3
- DB 102,15,58,34,28,184,0 ; pinsrd $0x0,(%rax,%rdi,4),%xmm3
- DB 233,113,255,255,255 ; jmpq 3770 <_sk_load_8888_sse41+0xf>
+ DB 102,15,58,34,92,144,4,1 ; pinsrd $0x1,0x4(%rax,%rdx,4),%xmm3
+ DB 102,15,58,34,28,144,0 ; pinsrd $0x0,(%rax,%rdx,4),%xmm3
+ DB 233,113,255,255,255 ; jmpq 379f <_sk_load_8888_sse41+0xf>
PUBLIC _sk_gather_8888_sse41
_sk_gather_8888_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -15255,39 +15279,40 @@ _sk_gather_8888_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,58,22,194,1 ; pextrq $0x1,%xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,110,28,136 ; movd (%r8,%r9,4),%xmm3
- DB 102,65,15,58,34,28,128,1 ; pinsrd $0x1,(%r8,%rax,4),%xmm3
- DB 102,67,15,58,34,28,152,2 ; pinsrd $0x2,(%r8,%r11,4),%xmm3
- DB 102,67,15,58,34,28,144,3 ; pinsrd $0x3,(%r8,%r10,4),%xmm3
- DB 102,15,111,5,225,37,0,0 ; movdqa 0x25e1(%rip),%xmm0 # 5e40 <_sk_callback_sse41+0xded>
+ DB 102,73,15,58,22,195,1 ; pextrq $0x1,%xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,67,15,110,28,145 ; movd (%r9,%r10,4),%xmm3
+ DB 102,65,15,58,34,28,129,1 ; pinsrd $0x1,(%r9,%rax,4),%xmm3
+ DB 102,65,15,58,34,28,153,2 ; pinsrd $0x2,(%r9,%rbx,4),%xmm3
+ DB 102,67,15,58,34,28,153,3 ; pinsrd $0x3,(%r9,%r11,4),%xmm3
+ DB 102,15,111,5,1,38,0,0 ; movdqa 0x2601(%rip),%xmm0 # 5e90 <_sk_callback_sse41+0xe03>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,226,37,0,0 ; movaps 0x25e2(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0xdfd>
+ DB 68,15,40,5,2,38,0,0 ; movaps 0x2602(%rip),%xmm8 # 5ea0 <_sk_callback_sse41+0xe13>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,225,37,0,0 ; pshufb 0x25e1(%rip),%xmm1 # 5e60 <_sk_callback_sse41+0xe0d>
+ DB 102,15,56,0,13,1,38,0,0 ; pshufb 0x2601(%rip),%xmm1 # 5eb0 <_sk_callback_sse41+0xe23>
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,221,37,0,0 ; pshufb 0x25dd(%rip),%xmm2 # 5e70 <_sk_callback_sse41+0xe1d>
+ DB 102,15,56,0,21,253,37,0,0 ; pshufb 0x25fd(%rip),%xmm2 # 5ec0 <_sk_callback_sse41+0xe33>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_8888_sse41
_sk_store_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,201,37,0,0 ; movaps 0x25c9(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0xe2d>
+ DB 68,15,40,5,232,37,0,0 ; movaps 0x25e8(%rip),%xmm8 # 5ed0 <_sk_callback_sse41+0xe43>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -15305,32 +15330,32 @@ _sk_store_8888_sse41 LABEL PROC
DB 102,65,15,114,240,24 ; pslld $0x18,%xmm8
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3917 <_sk_store_8888_sse41+0x6d>
- DB 243,68,15,127,4,184 ; movdqu %xmm8,(%rax,%rdi,4)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,30 ; je 3942 <_sk_store_8888_sse41+0x98>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,15 ; je 3939 <_sk_store_8888_sse41+0x8f>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,227 ; jne 3913 <_sk_store_8888_sse41+0x69>
- DB 102,68,15,58,22,68,184,8,2 ; pextrd $0x2,%xmm8,0x8(%rax,%rdi,4)
- DB 102,68,15,58,22,68,184,4,1 ; pextrd $0x1,%xmm8,0x4(%rax,%rdi,4)
- DB 102,68,15,126,4,184 ; movd %xmm8,(%rax,%rdi,4)
- DB 235,201 ; jmp 3913 <_sk_store_8888_sse41+0x69>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3948 <_sk_store_8888_sse41+0x6d>
+ DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,30 ; je 3973 <_sk_store_8888_sse41+0x98>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,15 ; je 396a <_sk_store_8888_sse41+0x8f>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,227 ; jne 3944 <_sk_store_8888_sse41+0x69>
+ DB 102,68,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
+ DB 102,68,15,58,22,68,144,4,1 ; pextrd $0x1,%xmm8,0x4(%rax,%rdx,4)
+ DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
+ DB 235,201 ; jmp 3944 <_sk_store_8888_sse41+0x69>
PUBLIC _sk_load_f16_sse41
_sk_load_f16_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,60,1,0,0 ; jne 3a94 <_sk_load_f16_sse41+0x14a>
- DB 102,15,16,4,248 ; movupd (%rax,%rdi,8),%xmm0
- DB 243,15,111,76,248,16 ; movdqu 0x10(%rax,%rdi,8),%xmm1
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,60,1,0,0 ; jne 3ac5 <_sk_load_f16_sse41+0x14a>
+ DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0
+ DB 243,15,111,76,208,16 ; movdqu 0x10(%rax,%rdx,8),%xmm1
DB 102,68,15,40,200 ; movapd %xmm0,%xmm9
DB 102,68,15,97,201 ; punpcklwd %xmm1,%xmm9
DB 102,15,105,193 ; punpckhwd %xmm1,%xmm0
@@ -15338,18 +15363,18 @@ _sk_load_f16_sse41 LABEL PROC
DB 102,68,15,97,216 ; punpcklwd %xmm0,%xmm11
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1
- DB 102,68,15,111,5,1,37,0,0 ; movdqa 0x2501(%rip),%xmm8 # 5e90 <_sk_callback_sse41+0xe3d>
+ DB 102,68,15,111,5,32,37,0,0 ; movdqa 0x2520(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xe53>
DB 102,15,111,209 ; movdqa %xmm1,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,239,202 ; pxor %xmm2,%xmm1
- DB 102,15,111,29,252,36,0,0 ; movdqa 0x24fc(%rip),%xmm3 # 5ea0 <_sk_callback_sse41+0xe4d>
+ DB 102,15,111,29,27,37,0,0 ; movdqa 0x251b(%rip),%xmm3 # 5ef0 <_sk_callback_sse41+0xe63>
DB 102,15,114,242,16 ; pslld $0x10,%xmm2
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0
DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0
DB 102,15,114,241,13 ; pslld $0xd,%xmm1
DB 102,15,235,202 ; por %xmm2,%xmm1
- DB 102,68,15,111,21,232,36,0,0 ; movdqa 0x24e8(%rip),%xmm10 # 5eb0 <_sk_callback_sse41+0xe5d>
+ DB 102,68,15,111,21,7,37,0,0 ; movdqa 0x2507(%rip),%xmm10 # 5f00 <_sk_callback_sse41+0xe73>
DB 102,65,15,254,202 ; paddd %xmm10,%xmm1
DB 102,15,219,193 ; pand %xmm1,%xmm0
DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11
@@ -15390,23 +15415,24 @@ _sk_load_f16_sse41 LABEL PROC
DB 102,65,15,219,217 ; pand %xmm9,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 242,15,16,4,248 ; movsd (%rax,%rdi,8),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,13 ; jne 3aac <_sk_load_f16_sse41+0x162>
+ DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,13 ; jne 3add <_sk_load_f16_sse41+0x162>
DB 243,15,126,192 ; movq %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,183,254,255,255 ; jmpq 3963 <_sk_load_f16_sse41+0x19>
- DB 102,15,22,68,248,8 ; movhpd 0x8(%rax,%rdi,8),%xmm0
+ DB 233,183,254,255,255 ; jmpq 3994 <_sk_load_f16_sse41+0x19>
+ DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,163,254,255,255 ; jb 3963 <_sk_load_f16_sse41+0x19>
- DB 243,15,126,76,248,16 ; movq 0x10(%rax,%rdi,8),%xmm1
- DB 233,152,254,255,255 ; jmpq 3963 <_sk_load_f16_sse41+0x19>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,163,254,255,255 ; jb 3994 <_sk_load_f16_sse41+0x19>
+ DB 243,15,126,76,208,16 ; movq 0x10(%rax,%rdx,8),%xmm1
+ DB 233,152,254,255,255 ; jmpq 3994 <_sk_load_f16_sse41+0x19>
PUBLIC _sk_gather_f16_sse41
_sk_gather_f16_sse41 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -15414,16 +15440,16 @@ _sk_gather_f16_sse41 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,194 ; paddd %xmm2,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,58,22,194,1 ; pextrq $0x1,%xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,126,4,208 ; movq (%r8,%r10,8),%xmm0
- DB 243,67,15,126,12,216 ; movq (%r8,%r11,8),%xmm1
+ DB 102,73,15,58,22,195,1 ; pextrq $0x1,%xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,67,15,126,4,217 ; movq (%r9,%r11,8),%xmm0
+ DB 243,65,15,126,12,217 ; movq (%r9,%rbx,8),%xmm1
DB 102,15,108,200 ; punpcklqdq %xmm0,%xmm1
- DB 243,65,15,126,4,192 ; movq (%r8,%rax,8),%xmm0
- DB 243,67,15,126,20,200 ; movq (%r8,%r9,8),%xmm2
+ DB 243,65,15,126,4,193 ; movq (%r9,%rax,8),%xmm0
+ DB 243,67,15,126,20,209 ; movq (%r9,%r10,8),%xmm2
DB 102,15,108,208 ; punpcklqdq %xmm0,%xmm2
DB 102,68,15,111,202 ; movdqa %xmm2,%xmm9
DB 102,68,15,97,201 ; punpcklwd %xmm1,%xmm9
@@ -15432,18 +15458,18 @@ _sk_gather_f16_sse41 LABEL PROC
DB 102,68,15,97,218 ; punpcklwd %xmm2,%xmm11
DB 102,68,15,105,202 ; punpckhwd %xmm2,%xmm9
DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1
- DB 102,68,15,111,5,111,35,0,0 ; movdqa 0x236f(%rip),%xmm8 # 5ec0 <_sk_callback_sse41+0xe6d>
+ DB 102,68,15,111,5,141,35,0,0 ; movdqa 0x238d(%rip),%xmm8 # 5f10 <_sk_callback_sse41+0xe83>
DB 102,15,111,209 ; movdqa %xmm1,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,239,202 ; pxor %xmm2,%xmm1
- DB 102,15,111,29,106,35,0,0 ; movdqa 0x236a(%rip),%xmm3 # 5ed0 <_sk_callback_sse41+0xe7d>
+ DB 102,15,111,29,136,35,0,0 ; movdqa 0x2388(%rip),%xmm3 # 5f20 <_sk_callback_sse41+0xe93>
DB 102,15,114,242,16 ; pslld $0x10,%xmm2
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0
DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0
DB 102,15,114,241,13 ; pslld $0xd,%xmm1
DB 102,15,235,202 ; por %xmm2,%xmm1
- DB 102,68,15,111,21,86,35,0,0 ; movdqa 0x2356(%rip),%xmm10 # 5ee0 <_sk_callback_sse41+0xe8d>
+ DB 102,68,15,111,21,116,35,0,0 ; movdqa 0x2374(%rip),%xmm10 # 5f30 <_sk_callback_sse41+0xea3>
DB 102,65,15,254,202 ; paddd %xmm10,%xmm1
DB 102,15,219,193 ; pand %xmm1,%xmm0
DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11
@@ -15483,23 +15509,24 @@ _sk_gather_f16_sse41 LABEL PROC
DB 102,69,15,254,202 ; paddd %xmm10,%xmm9
DB 102,65,15,219,217 ; pand %xmm9,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_f16_sse41
_sk_store_f16_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 102,68,15,111,21,140,34,0,0 ; movdqa 0x228c(%rip),%xmm10 # 5ef0 <_sk_callback_sse41+0xe9d>
+ DB 102,68,15,111,21,169,34,0,0 ; movdqa 0x22a9(%rip),%xmm10 # 5f40 <_sk_callback_sse41+0xeb3>
DB 102,68,15,111,216 ; movdqa %xmm0,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13
DB 102,69,15,239,235 ; pxor %xmm11,%xmm13
- DB 102,68,15,111,13,127,34,0,0 ; movdqa 0x227f(%rip),%xmm9 # 5f00 <_sk_callback_sse41+0xead>
+ DB 102,68,15,111,13,156,34,0,0 ; movdqa 0x229c(%rip),%xmm9 # 5f50 <_sk_callback_sse41+0xec3>
DB 102,65,15,114,211,16 ; psrld $0x10,%xmm11
DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8
DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8
DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13
- DB 102,68,15,111,37,112,34,0,0 ; movdqa 0x2270(%rip),%xmm12 # 5f10 <_sk_callback_sse41+0xebd>
+ DB 102,68,15,111,37,141,34,0,0 ; movdqa 0x228d(%rip),%xmm12 # 5f60 <_sk_callback_sse41+0xed3>
DB 102,69,15,235,220 ; por %xmm12,%xmm11
DB 102,69,15,254,221 ; paddd %xmm13,%xmm11
DB 102,69,15,223,195 ; pandn %xmm11,%xmm8
@@ -15542,32 +15569,32 @@ _sk_store_f16_sse41 LABEL PROC
DB 102,69,15,97,217 ; punpcklwd %xmm9,%xmm11
DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9
DB 102,69,15,98,203 ; punpckldq %xmm11,%xmm9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,21 ; jne 3d96 <_sk_store_f16_sse41+0x140>
- DB 68,15,17,12,248 ; movups %xmm9,(%rax,%rdi,8)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,21 ; jne 3dc9 <_sk_store_f16_sse41+0x140>
+ DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8)
DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8
- DB 243,68,15,127,68,248,16 ; movdqu %xmm8,0x10(%rax,%rdi,8)
+ DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 102,68,15,214,12,248 ; movq %xmm9,(%rax,%rdi,8)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 3d92 <_sk_store_f16_sse41+0x13c>
- DB 102,68,15,23,76,248,8 ; movhpd %xmm9,0x8(%rax,%rdi,8)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 3d92 <_sk_store_f16_sse41+0x13c>
+ DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 3dc5 <_sk_store_f16_sse41+0x13c>
+ DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 3dc5 <_sk_store_f16_sse41+0x13c>
DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8
- DB 102,68,15,214,68,248,16 ; movq %xmm8,0x10(%rax,%rdi,8)
- DB 235,213 ; jmp 3d92 <_sk_store_f16_sse41+0x13c>
+ DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8)
+ DB 235,213 ; jmp 3dc5 <_sk_store_f16_sse41+0x13c>
PUBLIC _sk_load_u16_be_sse41
_sk_load_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,185,0,0,0 ; jne 3e8c <_sk_load_u16_be_sse41+0xcf>
- DB 102,65,15,16,4,64 ; movupd (%r8,%rax,2),%xmm0
- DB 243,65,15,111,76,64,16 ; movdqu 0x10(%r8,%rax,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,185,0,0,0 ; jne 3ebf <_sk_load_u16_be_sse41+0xcf>
+ DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0
+ DB 243,65,15,111,76,65,16 ; movdqu 0x10(%r9,%rax,2),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
DB 102,15,97,209 ; punpcklwd %xmm1,%xmm2
DB 102,15,105,193 ; punpckhwd %xmm1,%xmm0
@@ -15581,7 +15608,7 @@ _sk_load_u16_be_sse41 LABEL PROC
DB 102,15,235,200 ; por %xmm0,%xmm1
DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,1,33,0,0 ; movaps 0x2101(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0xecd>
+ DB 68,15,40,5,30,33,0,0 ; movaps 0x211e(%rip),%xmm8 # 5f70 <_sk_callback_sse41+0xee3>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -15607,28 +15634,28 @@ _sk_load_u16_be_sse41 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 242,65,15,16,4,64 ; movsd (%r8,%rax,2),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,13 ; jne 3ea5 <_sk_load_u16_be_sse41+0xe8>
+ DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,13 ; jne 3ed8 <_sk_load_u16_be_sse41+0xe8>
DB 243,15,126,192 ; movq %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,59,255,255,255 ; jmpq 3de0 <_sk_load_u16_be_sse41+0x23>
- DB 102,65,15,22,68,64,8 ; movhpd 0x8(%r8,%rax,2),%xmm0
+ DB 233,59,255,255,255 ; jmpq 3e13 <_sk_load_u16_be_sse41+0x23>
+ DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,38,255,255,255 ; jb 3de0 <_sk_load_u16_be_sse41+0x23>
- DB 243,65,15,126,76,64,16 ; movq 0x10(%r8,%rax,2),%xmm1
- DB 233,26,255,255,255 ; jmpq 3de0 <_sk_load_u16_be_sse41+0x23>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,38,255,255,255 ; jb 3e13 <_sk_load_u16_be_sse41+0x23>
+ DB 243,65,15,126,76,65,16 ; movq 0x10(%r9,%rax,2),%xmm1
+ DB 233,26,255,255,255 ; jmpq 3e13 <_sk_load_u16_be_sse41+0x23>
PUBLIC _sk_load_rgb_u16_be_sse41
_sk_load_rgb_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,127 ; lea (%rdi,%rdi,2),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,170,0,0,0 ; jne 3f82 <_sk_load_rgb_u16_be_sse41+0xbc>
- DB 243,65,15,111,20,64 ; movdqu (%r8,%rax,2),%xmm2
- DB 243,65,15,111,92,64,8 ; movdqu 0x8(%r8,%rax,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,170,0,0,0 ; jne 3fb5 <_sk_load_rgb_u16_be_sse41+0xbc>
+ DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2
+ DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3
DB 102,15,115,219,4 ; psrldq $0x4,%xmm3
DB 102,15,111,194 ; movdqa %xmm2,%xmm0
DB 102,15,115,216,6 ; psrldq $0x6,%xmm0
@@ -15646,7 +15673,7 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC
DB 102,15,235,200 ; por %xmm0,%xmm1
DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,249,31,0,0 ; movaps 0x1ff9(%rip),%xmm8 # 5f30 <_sk_callback_sse41+0xedd>
+ DB 68,15,40,5,22,32,0,0 ; movaps 0x2016(%rip),%xmm8 # 5f80 <_sk_callback_sse41+0xef3>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -15663,34 +15690,34 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,192,31,0,0 ; movaps 0x1fc0(%rip),%xmm3 # 5f40 <_sk_callback_sse41+0xeed>
+ DB 15,40,29,221,31,0,0 ; movaps 0x1fdd(%rip),%xmm3 # 5f90 <_sk_callback_sse41+0xf03>
DB 255,224 ; jmpq *%rax
- DB 102,65,15,110,20,64 ; movd (%r8,%rax,2),%xmm2
- DB 102,65,15,196,84,64,4,2 ; pinsrw $0x2,0x4(%r8,%rax,2),%xmm2
+ DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2
+ DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,13 ; jne 3fa7 <_sk_load_rgb_u16_be_sse41+0xe1>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,13 ; jne 3fda <_sk_load_rgb_u16_be_sse41+0xe1>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,85,255,255,255 ; jmpq 3efc <_sk_load_rgb_u16_be_sse41+0x36>
- DB 102,65,15,110,68,64,6 ; movd 0x6(%r8,%rax,2),%xmm0
- DB 102,65,15,196,68,64,10,2 ; pinsrw $0x2,0xa(%r8,%rax,2),%xmm0
+ DB 233,85,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0
+ DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,24 ; jb 3fd8 <_sk_load_rgb_u16_be_sse41+0x112>
- DB 102,65,15,110,92,64,12 ; movd 0xc(%r8,%rax,2),%xmm3
- DB 102,65,15,196,92,64,16,2 ; pinsrw $0x2,0x10(%r8,%rax,2),%xmm3
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,24 ; jb 400b <_sk_load_rgb_u16_be_sse41+0x112>
+ DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3
+ DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,36,255,255,255 ; jmpq 3efc <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 233,36,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 233,27,255,255,255 ; jmpq 3efc <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 233,27,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36>
PUBLIC _sk_store_u16_be_sse41
_sk_store_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 68,15,40,21,90,31,0,0 ; movaps 0x1f5a(%rip),%xmm10 # 5f50 <_sk_callback_sse41+0xefd>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 68,15,40,21,119,31,0,0 ; movaps 0x1f77(%rip),%xmm10 # 5fa0 <_sk_callback_sse41+0xf13>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
@@ -15726,36 +15753,36 @@ _sk_store_u16_be_sse41 LABEL PROC
DB 102,69,15,97,202 ; punpcklwd %xmm10,%xmm9
DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10
DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,21 ; jne 40c4 <_sk_store_u16_be_sse41+0xe3>
- DB 69,15,17,20,64 ; movups %xmm10,(%r8,%rax,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,21 ; jne 40f7 <_sk_store_u16_be_sse41+0xe3>
+ DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2)
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
- DB 243,69,15,127,68,64,16 ; movdqu %xmm8,0x10(%r8,%rax,2)
+ DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 102,69,15,214,20,64 ; movq %xmm10,(%r8,%rax,2)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 40c0 <_sk_store_u16_be_sse41+0xdf>
- DB 102,69,15,23,84,64,8 ; movhpd %xmm10,0x8(%r8,%rax,2)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 40c0 <_sk_store_u16_be_sse41+0xdf>
+ DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 40f3 <_sk_store_u16_be_sse41+0xdf>
+ DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 40f3 <_sk_store_u16_be_sse41+0xdf>
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
- DB 102,69,15,214,68,64,16 ; movq %xmm8,0x10(%r8,%rax,2)
- DB 235,213 ; jmp 40c0 <_sk_store_u16_be_sse41+0xdf>
+ DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2)
+ DB 235,213 ; jmp 40f3 <_sk_store_u16_be_sse41+0xdf>
PUBLIC _sk_load_f32_sse41
_sk_load_f32_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r8
- DB 72,137,248 ; mov %rdi,%rax
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 76,141,12,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r9
+ DB 72,137,208 ; mov %rdx,%rax
DB 72,193,224,4 ; shl $0x4,%rax
- DB 69,15,16,4,1 ; movups (%r9,%rax,1),%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,66 ; jne 414b <_sk_load_f32_sse41+0x60>
- DB 67,15,16,68,129,16 ; movups 0x10(%r9,%r8,4),%xmm0
- DB 67,15,16,92,129,32 ; movups 0x20(%r9,%r8,4),%xmm3
- DB 71,15,16,76,129,48 ; movups 0x30(%r9,%r8,4),%xmm9
+ DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,66 ; jne 417e <_sk_load_f32_sse41+0x60>
+ DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
+ DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
+ DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
DB 65,15,40,208 ; movaps %xmm8,%xmm2
DB 15,20,208 ; unpcklps %xmm0,%xmm2
DB 15,40,203 ; movaps %xmm3,%xmm1
@@ -15771,25 +15798,25 @@ _sk_load_f32_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,8 ; jne 415d <_sk_load_f32_sse41+0x72>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,8 ; jne 4190 <_sk_load_f32_sse41+0x72>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
- DB 235,190 ; jmp 411b <_sk_load_f32_sse41+0x30>
- DB 67,15,16,68,129,16 ; movups 0x10(%r9,%r8,4),%xmm0
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,8 ; jb 4171 <_sk_load_f32_sse41+0x86>
- DB 67,15,16,92,129,32 ; movups 0x20(%r9,%r8,4),%xmm3
- DB 235,170 ; jmp 411b <_sk_load_f32_sse41+0x30>
+ DB 235,190 ; jmp 414e <_sk_load_f32_sse41+0x30>
+ DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,8 ; jb 41a4 <_sk_load_f32_sse41+0x86>
+ DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
+ DB 235,170 ; jmp 414e <_sk_load_f32_sse41+0x30>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 235,165 ; jmp 411b <_sk_load_f32_sse41+0x30>
+ DB 235,165 ; jmp 414e <_sk_load_f32_sse41+0x30>
PUBLIC _sk_store_f32_sse41
_sk_store_f32_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r8
- DB 72,137,248 ; mov %rdi,%rax
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 76,141,12,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r9
+ DB 72,137,208 ; mov %rdx,%rax
DB 72,193,224,4 ; shl $0x4,%rax
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 68,15,20,201 ; unpcklps %xmm1,%xmm9
@@ -15804,22 +15831,22 @@ _sk_store_f32_sse41 LABEL PROC
DB 69,15,18,193 ; movhlps %xmm9,%xmm8
DB 69,15,40,202 ; movaps %xmm10,%xmm9
DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9
- DB 102,69,15,17,36,1 ; movupd %xmm12,(%r9,%rax,1)
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,29 ; jne 41e8 <_sk_store_f32_sse41+0x72>
+ DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,29 ; jne 421b <_sk_store_f32_sse41+0x72>
DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10
- DB 71,15,17,68,129,16 ; movups %xmm8,0x10(%r9,%r8,4)
- DB 102,71,15,17,76,129,32 ; movupd %xmm9,0x20(%r9,%r8,4)
- DB 102,71,15,17,84,129,48 ; movupd %xmm10,0x30(%r9,%r8,4)
+ DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
+ DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
+ DB 102,71,15,17,84,138,48 ; movupd %xmm10,0x30(%r10,%r9,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,246 ; je 41e4 <_sk_store_f32_sse41+0x6e>
- DB 71,15,17,68,129,16 ; movups %xmm8,0x10(%r9,%r8,4)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,234 ; jb 41e4 <_sk_store_f32_sse41+0x6e>
- DB 102,71,15,17,76,129,32 ; movupd %xmm9,0x20(%r9,%r8,4)
- DB 235,225 ; jmp 41e4 <_sk_store_f32_sse41+0x6e>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,246 ; je 4217 <_sk_store_f32_sse41+0x6e>
+ DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,234 ; jb 4217 <_sk_store_f32_sse41+0x6e>
+ DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
+ DB 235,225 ; jmp 4217 <_sk_store_f32_sse41+0x6e>
PUBLIC _sk_clamp_x_sse41
_sk_clamp_x_sse41 LABEL PROC
@@ -15917,7 +15944,7 @@ PUBLIC _sk_clamp_x_1_sse41
_sk_clamp_x_1_sse41 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,49,28,0,0 ; minps 0x1c31(%rip),%xmm8 # 5f60 <_sk_callback_sse41+0xf0d>
+ DB 68,15,93,5,78,28,0,0 ; minps 0x1c4e(%rip),%xmm8 # 5fb0 <_sk_callback_sse41+0xf23>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -15931,9 +15958,9 @@ _sk_repeat_x_1_sse41 LABEL PROC
PUBLIC _sk_mirror_x_1_sse41
_sk_mirror_x_1_sse41 LABEL PROC
- DB 68,15,40,5,34,28,0,0 ; movaps 0x1c22(%rip),%xmm8 # 5f70 <_sk_callback_sse41+0xf1d>
+ DB 68,15,40,5,63,28,0,0 ; movaps 0x1c3f(%rip),%xmm8 # 5fc0 <_sk_callback_sse41+0xf33>
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,13,38,28,0,0 ; movaps 0x1c26(%rip),%xmm9 # 5f80 <_sk_callback_sse41+0xf2d>
+ DB 68,15,40,13,67,28,0,0 ; movaps 0x1c43(%rip),%xmm9 # 5fd0 <_sk_callback_sse41+0xf43>
DB 68,15,89,200 ; mulps %xmm0,%xmm9
DB 102,69,15,58,8,201,1 ; roundps $0x1,%xmm9,%xmm9
DB 69,15,88,201 ; addps %xmm9,%xmm9
@@ -15948,10 +15975,10 @@ _sk_mirror_x_1_sse41 LABEL PROC
PUBLIC _sk_luminance_to_alpha_sse41
_sk_luminance_to_alpha_sse41 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 15,89,5,5,28,0,0 ; mulps 0x1c05(%rip),%xmm0 # 5f90 <_sk_callback_sse41+0xf3d>
- DB 15,89,13,14,28,0,0 ; mulps 0x1c0e(%rip),%xmm1 # 5fa0 <_sk_callback_sse41+0xf4d>
+ DB 15,89,5,34,28,0,0 ; mulps 0x1c22(%rip),%xmm0 # 5fe0 <_sk_callback_sse41+0xf53>
+ DB 15,89,13,43,28,0,0 ; mulps 0x1c2b(%rip),%xmm1 # 5ff0 <_sk_callback_sse41+0xf63>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,29,20,28,0,0 ; mulps 0x1c14(%rip),%xmm3 # 5fb0 <_sk_callback_sse41+0xf5d>
+ DB 15,89,29,49,28,0,0 ; mulps 0x1c31(%rip),%xmm3 # 6000 <_sk_callback_sse41+0xf73>
DB 15,88,217 ; addps %xmm1,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
@@ -16211,84 +16238,85 @@ _sk_matrix_perspective_sse41 LABEL PROC
PUBLIC _sk_evenly_spaced_gradient_sse41
_sk_evenly_spaced_gradient_sse41 LABEL PROC
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,24 ; mov (%rax),%rbx
DB 76,139,112,8 ; mov 0x8(%rax),%r14
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 47d8 <_sk_evenly_spaced_gradient_sse41+0x18>
+ DB 120,7 ; js 480d <_sk_evenly_spaced_gradient_sse41+0x1a>
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
- DB 235,21 ; jmp 47ed <_sk_evenly_spaced_gradient_sse41+0x2d>
- DB 73,137,216 ; mov %rbx,%r8
- DB 73,209,232 ; shr %r8
+ DB 235,21 ; jmp 4822 <_sk_evenly_spaced_gradient_sse41+0x2f>
+ DB 73,137,217 ; mov %rbx,%r9
+ DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
- DB 76,9,195 ; or %r8,%rbx
+ DB 76,9,203 ; or %r9,%rbx
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
DB 243,15,88,201 ; addss %xmm1,%xmm1
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
DB 15,89,200 ; mulps %xmm0,%xmm1
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,73,15,58,22,200,1 ; pextrq $0x1,%xmm1,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 102,73,15,126,202 ; movq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,71,15,16,4,158 ; movss (%r14,%r11,4),%xmm8
- DB 102,71,15,58,33,4,150,16 ; insertps $0x10,(%r14,%r10,4),%xmm8
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
+ DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 69,137,223 ; mov %r11d,%r15d
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,71,15,16,4,190 ; movss (%r14,%r15,4),%xmm8
+ DB 102,71,15,58,33,4,158,16 ; insertps $0x10,(%r14,%r11,4),%xmm8
+ DB 243,67,15,16,12,150 ; movss (%r14,%r10,4),%xmm1
DB 102,68,15,58,33,193,32 ; insertps $0x20,%xmm1,%xmm8
- DB 243,67,15,16,12,134 ; movss (%r14,%r8,4),%xmm1
+ DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
DB 102,68,15,58,33,193,48 ; insertps $0x30,%xmm1,%xmm8
DB 72,139,88,40 ; mov 0x28(%rax),%rbx
- DB 243,70,15,16,12,155 ; movss (%rbx,%r11,4),%xmm9
- DB 102,70,15,58,33,12,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm9
- DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
+ DB 243,70,15,16,12,187 ; movss (%rbx,%r15,4),%xmm9
+ DB 102,70,15,58,33,12,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm9
+ DB 243,66,15,16,12,147 ; movss (%rbx,%r10,4),%xmm1
DB 102,68,15,58,33,201,32 ; insertps $0x20,%xmm1,%xmm9
- DB 243,66,15,16,12,131 ; movss (%rbx,%r8,4),%xmm1
+ DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
DB 102,68,15,58,33,201,48 ; insertps $0x30,%xmm1,%xmm9
DB 72,139,88,16 ; mov 0x10(%rax),%rbx
- DB 243,66,15,16,12,155 ; movss (%rbx,%r11,4),%xmm1
- DB 102,66,15,58,33,12,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm1
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
+ DB 243,66,15,16,12,187 ; movss (%rbx,%r15,4),%xmm1
+ DB 102,66,15,58,33,12,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm1
+ DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
DB 102,15,58,33,202,32 ; insertps $0x20,%xmm2,%xmm1
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1
DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 243,70,15,16,20,155 ; movss (%rbx,%r11,4),%xmm10
- DB 102,70,15,58,33,20,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm10
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
+ DB 243,70,15,16,20,187 ; movss (%rbx,%r15,4),%xmm10
+ DB 102,70,15,58,33,20,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm10
+ DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
DB 102,68,15,58,33,210,32 ; insertps $0x20,%xmm2,%xmm10
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
DB 102,68,15,58,33,210,48 ; insertps $0x30,%xmm2,%xmm10
DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
- DB 102,66,15,58,33,20,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm2
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
+ DB 243,66,15,16,20,187 ; movss (%rbx,%r15,4),%xmm2
+ DB 102,66,15,58,33,20,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm2
+ DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
DB 102,15,58,33,211,32 ; insertps $0x20,%xmm3,%xmm2
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 243,70,15,16,28,155 ; movss (%rbx,%r11,4),%xmm11
- DB 102,70,15,58,33,28,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm11
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
+ DB 243,70,15,16,28,187 ; movss (%rbx,%r15,4),%xmm11
+ DB 102,70,15,58,33,28,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm11
+ DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
DB 102,68,15,58,33,219,32 ; insertps $0x20,%xmm3,%xmm11
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
DB 102,68,15,58,33,219,48 ; insertps $0x30,%xmm3,%xmm11
DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 243,66,15,16,28,155 ; movss (%rbx,%r11,4),%xmm3
- DB 102,66,15,58,33,28,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm3
- DB 243,70,15,16,36,139 ; movss (%rbx,%r9,4),%xmm12
+ DB 243,66,15,16,28,187 ; movss (%rbx,%r15,4),%xmm3
+ DB 102,66,15,58,33,28,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm3
+ DB 243,70,15,16,36,147 ; movss (%rbx,%r10,4),%xmm12
DB 102,65,15,58,33,220,32 ; insertps $0x20,%xmm12,%xmm3
- DB 243,70,15,16,36,131 ; movss (%rbx,%r8,4),%xmm12
+ DB 243,70,15,16,36,139 ; movss (%rbx,%r9,4),%xmm12
DB 102,65,15,58,33,220,48 ; insertps $0x30,%xmm12,%xmm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 243,70,15,16,36,152 ; movss (%rax,%r11,4),%xmm12
- DB 102,70,15,58,33,36,144,16 ; insertps $0x10,(%rax,%r10,4),%xmm12
- DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
+ DB 243,70,15,16,36,184 ; movss (%rax,%r15,4),%xmm12
+ DB 102,70,15,58,33,36,152,16 ; insertps $0x10,(%rax,%r11,4),%xmm12
+ DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
DB 102,69,15,58,33,229,32 ; insertps $0x20,%xmm13,%xmm12
- DB 243,70,15,16,44,128 ; movss (%rax,%r8,4),%xmm13
+ DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
DB 102,69,15,58,33,229,48 ; insertps $0x30,%xmm13,%xmm12
DB 68,15,89,192 ; mulps %xmm0,%xmm8
DB 69,15,88,193 ; addps %xmm9,%xmm8
@@ -16302,19 +16330,20 @@ _sk_evenly_spaced_gradient_sse41 LABEL PROC
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
PUBLIC _sk_gauss_a_to_rgba_sse41
_sk_gauss_a_to_rgba_sse41 LABEL PROC
- DB 15,40,5,39,22,0,0 ; movaps 0x1627(%rip),%xmm0 # 5fc0 <_sk_callback_sse41+0xf6d>
+ DB 15,40,5,64,22,0,0 ; movaps 0x1640(%rip),%xmm0 # 6010 <_sk_callback_sse41+0xf83>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,45,22,0,0 ; addps 0x162d(%rip),%xmm0 # 5fd0 <_sk_callback_sse41+0xf7d>
+ DB 15,88,5,70,22,0,0 ; addps 0x1646(%rip),%xmm0 # 6020 <_sk_callback_sse41+0xf93>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,51,22,0,0 ; addps 0x1633(%rip),%xmm0 # 5fe0 <_sk_callback_sse41+0xf8d>
+ DB 15,88,5,76,22,0,0 ; addps 0x164c(%rip),%xmm0 # 6030 <_sk_callback_sse41+0xfa3>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,57,22,0,0 ; addps 0x1639(%rip),%xmm0 # 5ff0 <_sk_callback_sse41+0xf9d>
+ DB 15,88,5,82,22,0,0 ; addps 0x1652(%rip),%xmm0 # 6040 <_sk_callback_sse41+0xfb3>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,63,22,0,0 ; addps 0x163f(%rip),%xmm0 # 6000 <_sk_callback_sse41+0xfad>
+ DB 15,88,5,88,22,0,0 ; addps 0x1658(%rip),%xmm0 # 6050 <_sk_callback_sse41+0xfc3>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
@@ -16323,87 +16352,88 @@ _sk_gauss_a_to_rgba_sse41 LABEL PROC
PUBLIC _sk_gradient_sse41
_sk_gradient_sse41 LABEL PROC
+ DB 65,87 ; push %r15
+ DB 65,86 ; push %r14
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 73,131,248,2 ; cmp $0x2,%r8
- DB 114,51 ; jb 4a10 <_sk_gradient_sse41+0x42>
- DB 76,139,72,72 ; mov 0x48(%rax),%r9
- DB 73,255,200 ; dec %r8
- DB 73,131,193,4 ; add $0x4,%r9
+ DB 73,131,249,2 ; cmp $0x2,%r9
+ DB 114,50 ; jb 4a4b <_sk_gradient_sse41+0x46>
+ DB 72,139,88,72 ; mov 0x48(%rax),%rbx
+ DB 73,255,201 ; dec %r9
+ DB 72,131,195,4 ; add $0x4,%rbx
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 15,40,21,29,22,0,0 ; movaps 0x161d(%rip),%xmm2 # 6010 <_sk_callback_sse41+0xfbd>
- DB 243,65,15,16,25 ; movss (%r9),%xmm3
+ DB 15,40,21,49,22,0,0 ; movaps 0x1631(%rip),%xmm2 # 6060 <_sk_callback_sse41+0xfd3>
+ DB 243,15,16,27 ; movss (%rbx),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
DB 15,84,218 ; andps %xmm2,%xmm3
DB 102,15,254,203 ; paddd %xmm3,%xmm1
- DB 73,131,193,4 ; add $0x4,%r9
- DB 73,255,200 ; dec %r8
- DB 117,227 ; jne 49f3 <_sk_gradient_sse41+0x25>
- DB 65,86 ; push %r14
- DB 83 ; push %rbx
- DB 102,73,15,58,22,200,1 ; pextrq $0x1,%xmm1,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 102,73,15,126,202 ; movq %xmm1,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 72,131,195,4 ; add $0x4,%rbx
+ DB 73,255,201 ; dec %r9
+ DB 117,228 ; jne 4a2f <_sk_gradient_sse41+0x2a>
+ DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 69,137,222 ; mov %r11d,%r14d
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,70,15,16,4,155 ; movss (%rbx,%r11,4),%xmm8
- DB 102,70,15,58,33,4,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm8
- DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,70,15,16,4,179 ; movss (%rbx,%r14,4),%xmm8
+ DB 102,70,15,58,33,4,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm8
+ DB 243,66,15,16,12,147 ; movss (%rbx,%r10,4),%xmm1
DB 102,68,15,58,33,193,32 ; insertps $0x20,%xmm1,%xmm8
- DB 243,66,15,16,12,131 ; movss (%rbx,%r8,4),%xmm1
+ DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
DB 102,68,15,58,33,193,48 ; insertps $0x30,%xmm1,%xmm8
DB 72,139,88,40 ; mov 0x28(%rax),%rbx
- DB 243,70,15,16,12,155 ; movss (%rbx,%r11,4),%xmm9
- DB 102,70,15,58,33,12,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm9
- DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
+ DB 243,70,15,16,12,179 ; movss (%rbx,%r14,4),%xmm9
+ DB 102,70,15,58,33,12,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm9
+ DB 243,66,15,16,12,147 ; movss (%rbx,%r10,4),%xmm1
DB 102,68,15,58,33,201,32 ; insertps $0x20,%xmm1,%xmm9
- DB 243,66,15,16,12,131 ; movss (%rbx,%r8,4),%xmm1
+ DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
DB 102,68,15,58,33,201,48 ; insertps $0x30,%xmm1,%xmm9
- DB 243,67,15,16,12,158 ; movss (%r14,%r11,4),%xmm1
- DB 102,67,15,58,33,12,150,16 ; insertps $0x10,(%r14,%r10,4),%xmm1
- DB 243,67,15,16,20,142 ; movss (%r14,%r9,4),%xmm2
+ DB 243,67,15,16,12,183 ; movss (%r15,%r14,4),%xmm1
+ DB 102,67,15,58,33,12,159,16 ; insertps $0x10,(%r15,%r11,4),%xmm1
+ DB 243,67,15,16,20,151 ; movss (%r15,%r10,4),%xmm2
DB 102,15,58,33,202,32 ; insertps $0x20,%xmm2,%xmm1
- DB 243,67,15,16,20,134 ; movss (%r14,%r8,4),%xmm2
+ DB 243,67,15,16,20,143 ; movss (%r15,%r9,4),%xmm2
DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1
DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 243,70,15,16,20,155 ; movss (%rbx,%r11,4),%xmm10
- DB 102,70,15,58,33,20,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm10
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
+ DB 243,70,15,16,20,179 ; movss (%rbx,%r14,4),%xmm10
+ DB 102,70,15,58,33,20,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm10
+ DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
DB 102,68,15,58,33,210,32 ; insertps $0x20,%xmm2,%xmm10
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
DB 102,68,15,58,33,210,48 ; insertps $0x30,%xmm2,%xmm10
DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
- DB 102,66,15,58,33,20,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm2
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
+ DB 243,66,15,16,20,179 ; movss (%rbx,%r14,4),%xmm2
+ DB 102,66,15,58,33,20,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm2
+ DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
DB 102,15,58,33,211,32 ; insertps $0x20,%xmm3,%xmm2
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 243,70,15,16,28,155 ; movss (%rbx,%r11,4),%xmm11
- DB 102,70,15,58,33,28,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm11
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
+ DB 243,70,15,16,28,179 ; movss (%rbx,%r14,4),%xmm11
+ DB 102,70,15,58,33,28,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm11
+ DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
DB 102,68,15,58,33,219,32 ; insertps $0x20,%xmm3,%xmm11
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
DB 102,68,15,58,33,219,48 ; insertps $0x30,%xmm3,%xmm11
DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 243,66,15,16,28,155 ; movss (%rbx,%r11,4),%xmm3
- DB 102,66,15,58,33,28,147,16 ; insertps $0x10,(%rbx,%r10,4),%xmm3
- DB 243,70,15,16,36,139 ; movss (%rbx,%r9,4),%xmm12
+ DB 243,66,15,16,28,179 ; movss (%rbx,%r14,4),%xmm3
+ DB 102,66,15,58,33,28,155,16 ; insertps $0x10,(%rbx,%r11,4),%xmm3
+ DB 243,70,15,16,36,147 ; movss (%rbx,%r10,4),%xmm12
DB 102,65,15,58,33,220,32 ; insertps $0x20,%xmm12,%xmm3
- DB 243,70,15,16,36,131 ; movss (%rbx,%r8,4),%xmm12
+ DB 243,70,15,16,36,139 ; movss (%rbx,%r9,4),%xmm12
DB 102,65,15,58,33,220,48 ; insertps $0x30,%xmm12,%xmm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 243,70,15,16,36,152 ; movss (%rax,%r11,4),%xmm12
- DB 102,70,15,58,33,36,144,16 ; insertps $0x10,(%rax,%r10,4),%xmm12
- DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
+ DB 243,70,15,16,36,176 ; movss (%rax,%r14,4),%xmm12
+ DB 102,70,15,58,33,36,152,16 ; insertps $0x10,(%rax,%r11,4),%xmm12
+ DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
DB 102,69,15,58,33,229,32 ; insertps $0x20,%xmm13,%xmm12
- DB 243,70,15,16,44,128 ; movss (%rax,%r8,4),%xmm13
+ DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
DB 102,69,15,58,33,229,48 ; insertps $0x30,%xmm13,%xmm12
DB 68,15,89,192 ; mulps %xmm0,%xmm8
DB 69,15,88,193 ; addps %xmm9,%xmm8
@@ -16417,6 +16447,7 @@ _sk_gradient_sse41 LABEL PROC
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
PUBLIC _sk_evenly_spaced_2_stop_gradient_sse41
@@ -16467,26 +16498,26 @@ _sk_xy_to_unit_angle_sse41 LABEL PROC
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,40,236 ; movaps %xmm12,%xmm13
DB 69,15,89,237 ; mulps %xmm13,%xmm13
- DB 68,15,40,21,188,19,0,0 ; movaps 0x13bc(%rip),%xmm10 # 6020 <_sk_callback_sse41+0xfcd>
+ DB 68,15,40,21,210,19,0,0 ; movaps 0x13d2(%rip),%xmm10 # 6070 <_sk_callback_sse41+0xfe3>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,192,19,0,0 ; addps 0x13c0(%rip),%xmm10 # 6030 <_sk_callback_sse41+0xfdd>
+ DB 68,15,88,21,214,19,0,0 ; addps 0x13d6(%rip),%xmm10 # 6080 <_sk_callback_sse41+0xff3>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,196,19,0,0 ; addps 0x13c4(%rip),%xmm10 # 6040 <_sk_callback_sse41+0xfed>
+ DB 68,15,88,21,218,19,0,0 ; addps 0x13da(%rip),%xmm10 # 6090 <_sk_callback_sse41+0x1003>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,200,19,0,0 ; addps 0x13c8(%rip),%xmm10 # 6050 <_sk_callback_sse41+0xffd>
+ DB 68,15,88,21,222,19,0,0 ; addps 0x13de(%rip),%xmm10 # 60a0 <_sk_callback_sse41+0x1013>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0
- DB 68,15,40,29,199,19,0,0 ; movaps 0x13c7(%rip),%xmm11 # 6060 <_sk_callback_sse41+0x100d>
+ DB 68,15,40,29,221,19,0,0 ; movaps 0x13dd(%rip),%xmm11 # 60b0 <_sk_callback_sse41+0x1023>
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10
DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9
- DB 68,15,40,29,192,19,0,0 ; movaps 0x13c0(%rip),%xmm11 # 6070 <_sk_callback_sse41+0x101d>
+ DB 68,15,40,29,214,19,0,0 ; movaps 0x13d6(%rip),%xmm11 # 60c0 <_sk_callback_sse41+0x1033>
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 65,15,194,192,1 ; cmpltps %xmm8,%xmm0
- DB 68,15,40,13,178,19,0,0 ; movaps 0x13b2(%rip),%xmm9 # 6080 <_sk_callback_sse41+0x102d>
+ DB 68,15,40,13,200,19,0,0 ; movaps 0x13c8(%rip),%xmm9 # 60d0 <_sk_callback_sse41+0x1043>
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 102,69,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm10
DB 69,15,194,194,7 ; cmpordps %xmm10,%xmm8
@@ -16508,7 +16539,7 @@ _sk_xy_to_radius_sse41 LABEL PROC
PUBLIC _sk_save_xy_sse41
_sk_save_xy_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,134,19,0,0 ; movaps 0x1386(%rip),%xmm8 # 6090 <_sk_callback_sse41+0x103d>
+ DB 68,15,40,5,156,19,0,0 ; movaps 0x139c(%rip),%xmm8 # 60e0 <_sk_callback_sse41+0x1053>
DB 15,17,0 ; movups %xmm0,(%rax)
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,88,200 ; addps %xmm8,%xmm9
@@ -16548,8 +16579,8 @@ _sk_bilinear_nx_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,8,19,0,0 ; addps 0x1308(%rip),%xmm0 # 60a0 <_sk_callback_sse41+0x104d>
- DB 68,15,40,13,16,19,0,0 ; movaps 0x1310(%rip),%xmm9 # 60b0 <_sk_callback_sse41+0x105d>
+ DB 15,88,5,30,19,0,0 ; addps 0x131e(%rip),%xmm0 # 60f0 <_sk_callback_sse41+0x1063>
+ DB 68,15,40,13,38,19,0,0 ; movaps 0x1326(%rip),%xmm9 # 6100 <_sk_callback_sse41+0x1073>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16560,7 +16591,7 @@ _sk_bilinear_px_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,255,18,0,0 ; addps 0x12ff(%rip),%xmm0 # 60c0 <_sk_callback_sse41+0x106d>
+ DB 15,88,5,21,19,0,0 ; addps 0x1315(%rip),%xmm0 # 6110 <_sk_callback_sse41+0x1083>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16570,8 +16601,8 @@ _sk_bilinear_ny_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,241,18,0,0 ; addps 0x12f1(%rip),%xmm1 # 60d0 <_sk_callback_sse41+0x107d>
- DB 68,15,40,13,249,18,0,0 ; movaps 0x12f9(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x108d>
+ DB 15,88,13,7,19,0,0 ; addps 0x1307(%rip),%xmm1 # 6120 <_sk_callback_sse41+0x1093>
+ DB 68,15,40,13,15,19,0,0 ; movaps 0x130f(%rip),%xmm9 # 6130 <_sk_callback_sse41+0x10a3>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16582,7 +16613,7 @@ _sk_bilinear_py_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,231,18,0,0 ; addps 0x12e7(%rip),%xmm1 # 60f0 <_sk_callback_sse41+0x109d>
+ DB 15,88,13,253,18,0,0 ; addps 0x12fd(%rip),%xmm1 # 6140 <_sk_callback_sse41+0x10b3>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16592,13 +16623,13 @@ _sk_bicubic_n3x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,218,18,0,0 ; addps 0x12da(%rip),%xmm0 # 6100 <_sk_callback_sse41+0x10ad>
- DB 68,15,40,13,226,18,0,0 ; movaps 0x12e2(%rip),%xmm9 # 6110 <_sk_callback_sse41+0x10bd>
+ DB 15,88,5,240,18,0,0 ; addps 0x12f0(%rip),%xmm0 # 6150 <_sk_callback_sse41+0x10c3>
+ DB 68,15,40,13,248,18,0,0 ; movaps 0x12f8(%rip),%xmm9 # 6160 <_sk_callback_sse41+0x10d3>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,222,18,0,0 ; mulps 0x12de(%rip),%xmm9 # 6120 <_sk_callback_sse41+0x10cd>
- DB 68,15,88,13,230,18,0,0 ; addps 0x12e6(%rip),%xmm9 # 6130 <_sk_callback_sse41+0x10dd>
+ DB 68,15,89,13,244,18,0,0 ; mulps 0x12f4(%rip),%xmm9 # 6170 <_sk_callback_sse41+0x10e3>
+ DB 68,15,88,13,252,18,0,0 ; addps 0x12fc(%rip),%xmm9 # 6180 <_sk_callback_sse41+0x10f3>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16609,16 +16640,16 @@ _sk_bicubic_n1x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,213,18,0,0 ; addps 0x12d5(%rip),%xmm0 # 6140 <_sk_callback_sse41+0x10ed>
- DB 68,15,40,13,221,18,0,0 ; movaps 0x12dd(%rip),%xmm9 # 6150 <_sk_callback_sse41+0x10fd>
+ DB 15,88,5,235,18,0,0 ; addps 0x12eb(%rip),%xmm0 # 6190 <_sk_callback_sse41+0x1103>
+ DB 68,15,40,13,243,18,0,0 ; movaps 0x12f3(%rip),%xmm9 # 61a0 <_sk_callback_sse41+0x1113>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,225,18,0,0 ; movaps 0x12e1(%rip),%xmm8 # 6160 <_sk_callback_sse41+0x110d>
+ DB 68,15,40,5,247,18,0,0 ; movaps 0x12f7(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x1123>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,229,18,0,0 ; addps 0x12e5(%rip),%xmm8 # 6170 <_sk_callback_sse41+0x111d>
+ DB 68,15,88,5,251,18,0,0 ; addps 0x12fb(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x1133>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,233,18,0,0 ; addps 0x12e9(%rip),%xmm8 # 6180 <_sk_callback_sse41+0x112d>
+ DB 68,15,88,5,255,18,0,0 ; addps 0x12ff(%rip),%xmm8 # 61d0 <_sk_callback_sse41+0x1143>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,237,18,0,0 ; addps 0x12ed(%rip),%xmm8 # 6190 <_sk_callback_sse41+0x113d>
+ DB 68,15,88,5,3,19,0,0 ; addps 0x1303(%rip),%xmm8 # 61e0 <_sk_callback_sse41+0x1153>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16626,17 +16657,17 @@ _sk_bicubic_n1x_sse41 LABEL PROC
PUBLIC _sk_bicubic_p1x_sse41
_sk_bicubic_p1x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,231,18,0,0 ; movaps 0x12e7(%rip),%xmm8 # 61a0 <_sk_callback_sse41+0x114d>
+ DB 68,15,40,5,253,18,0,0 ; movaps 0x12fd(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x1163>
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,21,227,18,0,0 ; movaps 0x12e3(%rip),%xmm10 # 61b0 <_sk_callback_sse41+0x115d>
+ DB 68,15,40,21,249,18,0,0 ; movaps 0x12f9(%rip),%xmm10 # 6200 <_sk_callback_sse41+0x1173>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,231,18,0,0 ; addps 0x12e7(%rip),%xmm10 # 61c0 <_sk_callback_sse41+0x116d>
+ DB 68,15,88,21,253,18,0,0 ; addps 0x12fd(%rip),%xmm10 # 6210 <_sk_callback_sse41+0x1183>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,227,18,0,0 ; addps 0x12e3(%rip),%xmm10 # 61d0 <_sk_callback_sse41+0x117d>
+ DB 68,15,88,21,249,18,0,0 ; addps 0x12f9(%rip),%xmm10 # 6220 <_sk_callback_sse41+0x1193>
DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16646,11 +16677,11 @@ _sk_bicubic_p3x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm0 # 61e0 <_sk_callback_sse41+0x118d>
+ DB 15,88,5,236,18,0,0 ; addps 0x12ec(%rip),%xmm0 # 6230 <_sk_callback_sse41+0x11a3>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,214,18,0,0 ; mulps 0x12d6(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x119d>
- DB 68,15,88,5,222,18,0,0 ; addps 0x12de(%rip),%xmm8 # 6200 <_sk_callback_sse41+0x11ad>
+ DB 68,15,89,5,236,18,0,0 ; mulps 0x12ec(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x11b3>
+ DB 68,15,88,5,244,18,0,0 ; addps 0x12f4(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x11c3>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16661,13 +16692,13 @@ _sk_bicubic_n3y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,204,18,0,0 ; addps 0x12cc(%rip),%xmm1 # 6210 <_sk_callback_sse41+0x11bd>
- DB 68,15,40,13,212,18,0,0 ; movaps 0x12d4(%rip),%xmm9 # 6220 <_sk_callback_sse41+0x11cd>
+ DB 15,88,13,226,18,0,0 ; addps 0x12e2(%rip),%xmm1 # 6260 <_sk_callback_sse41+0x11d3>
+ DB 68,15,40,13,234,18,0,0 ; movaps 0x12ea(%rip),%xmm9 # 6270 <_sk_callback_sse41+0x11e3>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,208,18,0,0 ; mulps 0x12d0(%rip),%xmm9 # 6230 <_sk_callback_sse41+0x11dd>
- DB 68,15,88,13,216,18,0,0 ; addps 0x12d8(%rip),%xmm9 # 6240 <_sk_callback_sse41+0x11ed>
+ DB 68,15,89,13,230,18,0,0 ; mulps 0x12e6(%rip),%xmm9 # 6280 <_sk_callback_sse41+0x11f3>
+ DB 68,15,88,13,238,18,0,0 ; addps 0x12ee(%rip),%xmm9 # 6290 <_sk_callback_sse41+0x1203>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16678,16 +16709,16 @@ _sk_bicubic_n1y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,198,18,0,0 ; addps 0x12c6(%rip),%xmm1 # 6250 <_sk_callback_sse41+0x11fd>
- DB 68,15,40,13,206,18,0,0 ; movaps 0x12ce(%rip),%xmm9 # 6260 <_sk_callback_sse41+0x120d>
+ DB 15,88,13,220,18,0,0 ; addps 0x12dc(%rip),%xmm1 # 62a0 <_sk_callback_sse41+0x1213>
+ DB 68,15,40,13,228,18,0,0 ; movaps 0x12e4(%rip),%xmm9 # 62b0 <_sk_callback_sse41+0x1223>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,210,18,0,0 ; movaps 0x12d2(%rip),%xmm8 # 6270 <_sk_callback_sse41+0x121d>
+ DB 68,15,40,5,232,18,0,0 ; movaps 0x12e8(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x1233>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm8 # 6280 <_sk_callback_sse41+0x122d>
+ DB 68,15,88,5,236,18,0,0 ; addps 0x12ec(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x1243>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,218,18,0,0 ; addps 0x12da(%rip),%xmm8 # 6290 <_sk_callback_sse41+0x123d>
+ DB 68,15,88,5,240,18,0,0 ; addps 0x12f0(%rip),%xmm8 # 62e0 <_sk_callback_sse41+0x1253>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,222,18,0,0 ; addps 0x12de(%rip),%xmm8 # 62a0 <_sk_callback_sse41+0x124d>
+ DB 68,15,88,5,244,18,0,0 ; addps 0x12f4(%rip),%xmm8 # 62f0 <_sk_callback_sse41+0x1263>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16695,17 +16726,17 @@ _sk_bicubic_n1y_sse41 LABEL PROC
PUBLIC _sk_bicubic_p1y_sse41
_sk_bicubic_p1y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,216,18,0,0 ; movaps 0x12d8(%rip),%xmm8 # 62b0 <_sk_callback_sse41+0x125d>
+ DB 68,15,40,5,238,18,0,0 ; movaps 0x12ee(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x1273>
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 68,15,40,21,211,18,0,0 ; movaps 0x12d3(%rip),%xmm10 # 62c0 <_sk_callback_sse41+0x126d>
+ DB 68,15,40,21,233,18,0,0 ; movaps 0x12e9(%rip),%xmm10 # 6310 <_sk_callback_sse41+0x1283>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,215,18,0,0 ; addps 0x12d7(%rip),%xmm10 # 62d0 <_sk_callback_sse41+0x127d>
+ DB 68,15,88,21,237,18,0,0 ; addps 0x12ed(%rip),%xmm10 # 6320 <_sk_callback_sse41+0x1293>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,211,18,0,0 ; addps 0x12d3(%rip),%xmm10 # 62e0 <_sk_callback_sse41+0x128d>
+ DB 68,15,88,21,233,18,0,0 ; addps 0x12e9(%rip),%xmm10 # 6330 <_sk_callback_sse41+0x12a3>
DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -16715,11 +16746,11 @@ _sk_bicubic_p3y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,197,18,0,0 ; addps 0x12c5(%rip),%xmm1 # 62f0 <_sk_callback_sse41+0x129d>
+ DB 15,88,13,219,18,0,0 ; addps 0x12db(%rip),%xmm1 # 6340 <_sk_callback_sse41+0x12b3>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,197,18,0,0 ; mulps 0x12c5(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x12ad>
- DB 68,15,88,5,205,18,0,0 ; addps 0x12cd(%rip),%xmm8 # 6310 <_sk_callback_sse41+0x12bd>
+ DB 68,15,89,5,219,18,0,0 ; mulps 0x12db(%rip),%xmm8 # 6350 <_sk_callback_sse41+0x12c3>
+ DB 68,15,88,5,227,18,0,0 ; addps 0x12e3(%rip),%xmm8 # 6360 <_sk_callback_sse41+0x12d3>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -16729,12 +16760,14 @@ PUBLIC _sk_callback_sse41
_sk_callback_sse41 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 72,131,236,32 ; sub $0x20,%rsp
+ DB 72,131,236,40 ; sub $0x28,%rsp
DB 68,15,40,197 ; movaps %xmm5,%xmm8
DB 68,15,40,204 ; movaps %xmm4,%xmm9
- DB 73,137,207 ; mov %rcx,%r15
- DB 73,137,214 ; mov %rdx,%r14
+ DB 77,137,196 ; mov %r8,%r12
+ DB 73,137,206 ; mov %rcx,%r14
+ DB 73,137,215 ; mov %rdx,%r15
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,137,195 ; mov %rax,%rbx
DB 15,40,224 ; movaps %xmm0,%xmm4
@@ -16753,9 +16786,9 @@ _sk_callback_sse41 LABEL PROC
DB 15,17,107,24 ; movups %xmm5,0x18(%rbx)
DB 102,15,17,91,40 ; movupd %xmm3,0x28(%rbx)
DB 15,17,83,56 ; movups %xmm2,0x38(%rbx)
- DB 77,133,255 ; test %r15,%r15
+ DB 77,133,228 ; test %r12,%r12
DB 186,4,0,0,0 ; mov $0x4,%edx
- DB 65,15,69,215 ; cmovne %r15d,%edx
+ DB 65,15,69,212 ; cmovne %r12d,%edx
DB 72,137,217 ; mov %rbx,%rcx
DB 255,19 ; callq *(%rbx)
DB 72,139,131,136,0,0,0 ; mov 0x88(%rbx),%rax
@@ -16776,12 +16809,14 @@ _sk_callback_sse41 LABEL PROC
DB 102,15,20,211 ; unpcklpd %xmm3,%xmm2
DB 15,18,220 ; movhlps %xmm4,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,249 ; mov %r15,%rcx
+ DB 76,137,250 ; mov %r15,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 77,137,224 ; mov %r12,%r8
DB 65,15,40,225 ; movaps %xmm9,%xmm4
DB 65,15,40,232 ; movaps %xmm8,%xmm5
- DB 72,131,196,32 ; add $0x20,%rsp
+ DB 72,131,196,40 ; add $0x28,%rsp
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -16930,11 +16965,11 @@ ALIGN 16
DB 128,191,0,0,128,191,0 ; cmpb $0x0,-0x40800000(%rdi)
DB 0,224 ; add %ah,%al
DB 64,0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 52e8 <.literal16+0x1d8>
+ DB 224,64 ; loopne 5338 <.literal16+0x1d8>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 52ec <.literal16+0x1dc>
+ DB 224,64 ; loopne 533c <.literal16+0x1dc>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 52f0 <.literal16+0x1e0>
+ DB 224,64 ; loopne 5340 <.literal16+0x1e0>
DB 154 ; (bad)
DB 153 ; cltd
DB 153 ; cltd
@@ -16954,13 +16989,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5311 <.literal16+0x201>
+ DB 71,225,61 ; rex.RXB loope 5361 <.literal16+0x201>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5315 <.literal16+0x205>
+ DB 71,225,61 ; rex.RXB loope 5365 <.literal16+0x205>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5319 <.literal16+0x209>
+ DB 71,225,61 ; rex.RXB loope 5369 <.literal16+0x209>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 531d <.literal16+0x20d>
+ DB 71,225,61 ; rex.RXB loope 536d <.literal16+0x20d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -16985,13 +17020,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5351 <.literal16+0x241>
+ DB 71,225,61 ; rex.RXB loope 53a1 <.literal16+0x241>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5355 <.literal16+0x245>
+ DB 71,225,61 ; rex.RXB loope 53a5 <.literal16+0x245>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5359 <.literal16+0x249>
+ DB 71,225,61 ; rex.RXB loope 53a9 <.literal16+0x249>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 535d <.literal16+0x24d>
+ DB 71,225,61 ; rex.RXB loope 53ad <.literal16+0x24d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -17016,13 +17051,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5391 <.literal16+0x281>
+ DB 71,225,61 ; rex.RXB loope 53e1 <.literal16+0x281>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5395 <.literal16+0x285>
+ DB 71,225,61 ; rex.RXB loope 53e5 <.literal16+0x285>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5399 <.literal16+0x289>
+ DB 71,225,61 ; rex.RXB loope 53e9 <.literal16+0x289>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 539d <.literal16+0x28d>
+ DB 71,225,61 ; rex.RXB loope 53ed <.literal16+0x28d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -17047,13 +17082,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 53d1 <.literal16+0x2c1>
+ DB 71,225,61 ; rex.RXB loope 5421 <.literal16+0x2c1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 53d5 <.literal16+0x2c5>
+ DB 71,225,61 ; rex.RXB loope 5425 <.literal16+0x2c5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 53d9 <.literal16+0x2c9>
+ DB 71,225,61 ; rex.RXB loope 5429 <.literal16+0x2c9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 53dd <.literal16+0x2cd>
+ DB 71,225,61 ; rex.RXB loope 542d <.literal16+0x2cd>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -17070,10 +17105,10 @@ ALIGN 16
DB 0,1 ; add %al,(%rcx)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0053c8 <_sk_callback_sse41+0xa000375>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005418 <_sk_callback_sse41+0xa00038b>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30053d0 <_sk_callback_sse41+0x300037d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005420 <_sk_callback_sse41+0x3000393>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -17092,11 +17127,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
DB 67,0,0 ; rex.XB add %al,(%r8)
- DB 127,67 ; jg 543b <.literal16+0x32b>
+ DB 127,67 ; jg 548b <.literal16+0x32b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 543f <.literal16+0x32f>
+ DB 127,67 ; jg 548f <.literal16+0x32f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5443 <.literal16+0x333>
+ DB 127,67 ; jg 5493 <.literal16+0x333>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -17331,13 +17366,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5619 <.literal16+0x509>
+ DB 224,7 ; loopne 5669 <.literal16+0x509>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 561d <.literal16+0x50d>
+ DB 224,7 ; loopne 566d <.literal16+0x50d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5621 <.literal16+0x511>
+ DB 224,7 ; loopne 5671 <.literal16+0x511>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5625 <.literal16+0x515>
+ DB 224,7 ; loopne 5675 <.literal16+0x515>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -17371,10 +17406,10 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005668 <_sk_callback_sse41+0xa000615>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0056b8 <_sk_callback_sse41+0xa00062b>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005670 <_sk_callback_sse41+0x300061d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30056c0 <_sk_callback_sse41+0x3000633>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -17429,11 +17464,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 573b <.literal16+0x62b>
+ DB 127,67 ; jg 578b <.literal16+0x62b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 573f <.literal16+0x62f>
+ DB 127,67 ; jg 578f <.literal16+0x62f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5743 <.literal16+0x633>
+ DB 127,67 ; jg 5793 <.literal16+0x633>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax)
@@ -17448,16 +17483,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5734 <.literal16+0x624>
+ DB 127,0 ; jg 5784 <.literal16+0x624>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5738 <.literal16+0x628>
+ DB 127,0 ; jg 5788 <.literal16+0x628>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 573c <.literal16+0x62c>
+ DB 127,0 ; jg 578c <.literal16+0x62c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5740 <.literal16+0x630>
+ DB 127,0 ; jg 5790 <.literal16+0x630>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -17466,7 +17501,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 57c5 <.literal16+0x6b5>
+ DB 119,115 ; ja 5815 <.literal16+0x6b5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -17477,7 +17512,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5729 <.literal16+0x619>
+ DB 117,191 ; jne 5779 <.literal16+0x619>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -17489,7 +17524,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3976a <_sk_callback_sse41+0xffffffffe9a34717>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a397ba <_sk_callback_sse41+0xffffffffe9a3472d>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -17544,16 +17579,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5804 <.literal16+0x6f4>
+ DB 127,0 ; jg 5854 <.literal16+0x6f4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5808 <.literal16+0x6f8>
+ DB 127,0 ; jg 5858 <.literal16+0x6f8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 580c <.literal16+0x6fc>
+ DB 127,0 ; jg 585c <.literal16+0x6fc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5810 <.literal16+0x700>
+ DB 127,0 ; jg 5860 <.literal16+0x700>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -17562,7 +17597,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5895 <.literal16+0x785>
+ DB 119,115 ; ja 58e5 <.literal16+0x785>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -17573,7 +17608,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 57f9 <.literal16+0x6e9>
+ DB 117,191 ; jne 5849 <.literal16+0x6e9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -17585,7 +17620,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3983a <_sk_callback_sse41+0xffffffffe9a347e7>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3988a <_sk_callback_sse41+0xffffffffe9a347fd>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -17640,16 +17675,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 58d4 <.literal16+0x7c4>
+ DB 127,0 ; jg 5924 <.literal16+0x7c4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 58d8 <.literal16+0x7c8>
+ DB 127,0 ; jg 5928 <.literal16+0x7c8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 58dc <.literal16+0x7cc>
+ DB 127,0 ; jg 592c <.literal16+0x7cc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 58e0 <.literal16+0x7d0>
+ DB 127,0 ; jg 5930 <.literal16+0x7d0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -17658,7 +17693,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5965 <.literal16+0x855>
+ DB 119,115 ; ja 59b5 <.literal16+0x855>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -17669,7 +17704,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 58c9 <.literal16+0x7b9>
+ DB 117,191 ; jne 5919 <.literal16+0x7b9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -17681,7 +17716,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3990a <_sk_callback_sse41+0xffffffffe9a348b7>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3995a <_sk_callback_sse41+0xffffffffe9a348cd>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -17736,16 +17771,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 59a4 <.literal16+0x894>
+ DB 127,0 ; jg 59f4 <.literal16+0x894>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 59a8 <.literal16+0x898>
+ DB 127,0 ; jg 59f8 <.literal16+0x898>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 59ac <.literal16+0x89c>
+ DB 127,0 ; jg 59fc <.literal16+0x89c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 59b0 <.literal16+0x8a0>
+ DB 127,0 ; jg 5a00 <.literal16+0x8a0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -17754,7 +17789,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5a35 <.literal16+0x925>
+ DB 119,115 ; ja 5a85 <.literal16+0x925>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -17765,7 +17800,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5999 <.literal16+0x889>
+ DB 117,191 ; jne 59e9 <.literal16+0x889>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -17777,7 +17812,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a399da <_sk_callback_sse41+0xffffffffe9a34987>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a39a2a <_sk_callback_sse41+0xffffffffe9a3499d>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -17828,13 +17863,13 @@ ALIGN 16
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
- DB 127,67 ; jg 5ab7 <.literal16+0x9a7>
+ DB 127,67 ; jg 5b07 <.literal16+0x9a7>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5abb <.literal16+0x9ab>
+ DB 127,67 ; jg 5b0b <.literal16+0x9ab>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5abf <.literal16+0x9af>
+ DB 127,67 ; jg 5b0f <.literal16+0x9af>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5ac3 <.literal16+0x9b3>
+ DB 127,67 ; jg 5b13 <.literal16+0x9b3>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -17881,16 +17916,16 @@ ALIGN 16
DB 128,3,62 ; addb $0x3e,(%rbx)
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 5b43 <.literal16+0xa33>
+ DB 118,63 ; jbe 5b93 <.literal16+0xa33>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 5b47 <.literal16+0xa37>
+ DB 118,63 ; jbe 5b97 <.literal16+0xa37>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 5b4b <.literal16+0xa3b>
+ DB 118,63 ; jbe 5b9b <.literal16+0xa3b>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 5b4f <.literal16+0xa3f>
+ DB 118,63 ; jbe 5b9f <.literal16+0xa3f>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
@@ -17910,11 +17945,11 @@ ALIGN 16
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5b9b <.literal16+0xa8b>
+ DB 127,67 ; jg 5beb <.literal16+0xa8b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5b9f <.literal16+0xa8f>
+ DB 127,67 ; jg 5bef <.literal16+0xa8f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5ba3 <.literal16+0xa93>
+ DB 127,67 ; jg 5bf3 <.literal16+0xa93>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -17951,7 +17986,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005be0 <_sk_callback_sse41+0x3000b8d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005c30 <_sk_callback_sse41+0x3000ba3>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -17980,13 +18015,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5c19 <.literal16+0xb09>
+ DB 224,7 ; loopne 5c69 <.literal16+0xb09>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c1d <.literal16+0xb0d>
+ DB 224,7 ; loopne 5c6d <.literal16+0xb0d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c21 <.literal16+0xb11>
+ DB 224,7 ; loopne 5c71 <.literal16+0xb11>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c25 <.literal16+0xb15>
+ DB 224,7 ; loopne 5c75 <.literal16+0xb15>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -18032,13 +18067,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5c89 <.literal16+0xb79>
+ DB 224,7 ; loopne 5cd9 <.literal16+0xb79>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c8d <.literal16+0xb7d>
+ DB 224,7 ; loopne 5cdd <.literal16+0xb7d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c91 <.literal16+0xb81>
+ DB 224,7 ; loopne 5ce1 <.literal16+0xb81>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5c95 <.literal16+0xb85>
+ DB 224,7 ; loopne 5ce5 <.literal16+0xb85>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -18076,13 +18111,13 @@ ALIGN 16
DB 65,0,0 ; add %al,(%r8)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 5d26 <.literal16+0xc16>
+ DB 124,66 ; jl 5d76 <.literal16+0xc16>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 5d2a <.literal16+0xc1a>
+ DB 124,66 ; jl 5d7a <.literal16+0xc1a>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 5d2e <.literal16+0xc1e>
+ DB 124,66 ; jl 5d7e <.literal16+0xc1e>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 5d32 <.literal16+0xc22>
+ DB 124,66 ; jl 5d82 <.literal16+0xc22>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 0,240 ; add %dh,%al
@@ -18172,13 +18207,13 @@ ALIGN 16
DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax)
DB 61,137,136,136,61 ; cmp $0x3d888889,%eax
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 5e35 <.literal16+0xd25>
+ DB 112,65 ; jo 5e85 <.literal16+0xd25>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 5e39 <.literal16+0xd29>
+ DB 112,65 ; jo 5e89 <.literal16+0xd29>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 5e3d <.literal16+0xd2d>
+ DB 112,65 ; jo 5e8d <.literal16+0xd2d>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 5e41 <.literal16+0xd31>
+ DB 112,65 ; jo 5e91 <.literal16+0xd31>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -18193,7 +18228,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005e30 <_sk_callback_sse41+0x3000ddd>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005e80 <_sk_callback_sse41+0x3000df3>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -18220,7 +18255,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005e70 <_sk_callback_sse41+0x3000e1d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005ec0 <_sk_callback_sse41+0x3000e33>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -18235,11 +18270,11 @@ ALIGN 16
DB 255,0 ; incl (%rax)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5ecb <.literal16+0xdbb>
+ DB 127,67 ; jg 5f1b <.literal16+0xdbb>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5ecf <.literal16+0xdbf>
+ DB 127,67 ; jg 5f1f <.literal16+0xdbf>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5ed3 <.literal16+0xdc3>
+ DB 127,67 ; jg 5f23 <.literal16+0xdc3>
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
DB 0,0 ; add %al,(%rax)
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
@@ -18315,13 +18350,13 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 5f9b <.literal16+0xe8b>
+ DB 127,71 ; jg 5feb <.literal16+0xe8b>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 5f9f <.literal16+0xe8f>
+ DB 127,71 ; jg 5fef <.literal16+0xe8f>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 5fa3 <.literal16+0xe93>
+ DB 127,71 ; jg 5ff3 <.literal16+0xe93>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 5fa7 <.literal16+0xe97>
+ DB 127,71 ; jg 5ff7 <.literal16+0xe97>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -18367,10 +18402,10 @@ ALIGN 16
DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax
DB 152 ; cwtl
DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx)
- DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc070da <_sk_callback_sse41+0x2dc02087>
+ DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0712a <_sk_callback_sse41+0x2dc0209d>
DB 17,192 ; adc %eax,%eax
DB 45,16,17,192,18 ; sub $0x12c01110,%eax
- DB 120,57 ; js 600c <.literal16+0xefc>
+ DB 120,57 ; js 605c <.literal16+0xefc>
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
@@ -18492,11 +18527,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 6142 <.literal16+0x1032>
+ DB 62,114,28 ; jb,pt 6192 <.literal16+0x1032>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6146 <.literal16+0x1036>
+ DB 62,114,28 ; jb,pt 6196 <.literal16+0x1036>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 614a <.literal16+0x103a>
+ DB 62,114,28 ; jb,pt 619a <.literal16+0x103a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -18540,7 +18575,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63efd5 <_sk_callback_sse41+0x3d639f82>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f025 <_sk_callback_sse41+0x3d639f98>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -18566,7 +18601,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f015 <_sk_callback_sse41+0x3d639fc2>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f065 <_sk_callback_sse41+0x3d639fd8>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -18575,13 +18610,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 620e <.literal16+0x10fe>
+ DB 114,28 ; jb 625e <.literal16+0x10fe>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6212 <.literal16+0x1102>
+ DB 62,114,28 ; jb,pt 6262 <.literal16+0x1102>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6216 <.literal16+0x1106>
+ DB 62,114,28 ; jb,pt 6266 <.literal16+0x1106>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 621a <.literal16+0x110a>
+ DB 62,114,28 ; jb,pt 626a <.literal16+0x110a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -18602,11 +18637,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 6252 <.literal16+0x1142>
+ DB 62,114,28 ; jb,pt 62a2 <.literal16+0x1142>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6256 <.literal16+0x1146>
+ DB 62,114,28 ; jb,pt 62a6 <.literal16+0x1146>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 625a <.literal16+0x114a>
+ DB 62,114,28 ; jb,pt 62aa <.literal16+0x114a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -18650,7 +18685,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f0e5 <_sk_callback_sse41+0x3d63a092>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f135 <_sk_callback_sse41+0x3d63a0a8>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -18676,7 +18711,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f125 <_sk_callback_sse41+0x3d63a0d2>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f175 <_sk_callback_sse41+0x3d63a0e8>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -18685,13 +18720,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 631e <.literal16+0x120e>
+ DB 114,28 ; jb 636e <.literal16+0x120e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6322 <_sk_callback_sse41+0x12cf>
+ DB 62,114,28 ; jb,pt 6372 <_sk_callback_sse41+0x12e5>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6326 <_sk_callback_sse41+0x12d3>
+ DB 62,114,28 ; jb,pt 6376 <_sk_callback_sse41+0x12e9>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 632a <_sk_callback_sse41+0x12d7>
+ DB 62,114,28 ; jb,pt 637a <_sk_callback_sse41+0x12ed>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -18711,8 +18746,9 @@ _sk_start_pipeline_sse2 LABEL PROC
DB 65,84 ; push %r12
DB 86 ; push %rsi
DB 87 ; push %rdi
+ DB 85 ; push %rbp
DB 83 ; push %rbx
- DB 72,129,236,160,0,0,0 ; sub $0xa0,%rsp
+ DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp
DB 68,15,41,188,36,144,0,0,0 ; movaps %xmm15,0x90(%rsp)
DB 68,15,41,180,36,128,0,0,0 ; movaps %xmm14,0x80(%rsp)
DB 68,15,41,108,36,112 ; movaps %xmm13,0x70(%rsp)
@@ -18723,19 +18759,20 @@ _sk_start_pipeline_sse2 LABEL PROC
DB 68,15,41,68,36,32 ; movaps %xmm8,0x20(%rsp)
DB 15,41,124,36,16 ; movaps %xmm7,0x10(%rsp)
DB 15,41,52,36 ; movaps %xmm6,(%rsp)
- DB 77,137,205 ; mov %r9,%r13
- DB 77,137,198 ; mov %r8,%r14
- DB 72,137,203 ; mov %rcx,%rbx
- DB 72,137,214 ; mov %rdx,%rsi
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,199 ; mov %rax,%r15
- DB 73,137,244 ; mov %rsi,%r12
- DB 72,141,67,4 ; lea 0x4(%rbx),%rax
- DB 76,57,232 ; cmp %r13,%rax
- DB 118,5 ; jbe 73 <_sk_start_pipeline_sse2+0x73>
- DB 72,137,223 ; mov %rbx,%rdi
- DB 235,57 ; jmp ac <_sk_start_pipeline_sse2+0xac>
- DB 185,0,0,0,0 ; mov $0x0,%ecx
+ DB 76,137,195 ; mov %r8,%rbx
+ DB 73,137,214 ; mov %rdx,%r14
+ DB 72,137,205 ; mov %rcx,%rbp
+ DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15
+ DB 76,137,206 ; mov %r9,%rsi
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 73,137,196 ; mov %rax,%r12
+ DB 73,137,245 ; mov %rsi,%r13
+ DB 72,141,69,4 ; lea 0x4(%rbp),%rax
+ DB 72,57,216 ; cmp %rbx,%rax
+ DB 118,5 ; jbe 7c <_sk_start_pipeline_sse2+0x7c>
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 235,61 ; jmp b9 <_sk_start_pipeline_sse2+0xb9>
+ DB 65,184,0,0,0,0 ; mov $0x0,%r8d
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -18744,17 +18781,18 @@ _sk_start_pipeline_sse2 LABEL PROC
DB 15,87,237 ; xorps %xmm5,%xmm5
DB 15,87,246 ; xorps %xmm6,%xmm6
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 72,137,223 ; mov %rbx,%rdi
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 65,255,215 ; callq *%r15
- DB 72,141,123,4 ; lea 0x4(%rbx),%rdi
- DB 72,131,195,8 ; add $0x8,%rbx
- DB 76,57,235 ; cmp %r13,%rbx
- DB 72,137,251 ; mov %rdi,%rbx
- DB 118,199 ; jbe 73 <_sk_start_pipeline_sse2+0x73>
- DB 73,41,253 ; sub %rdi,%r13
- DB 116,36 ; je d5 <_sk_start_pipeline_sse2+0xd5>
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 72,137,234 ; mov %rbp,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 65,255,212 ; callq *%r12
+ DB 72,141,85,4 ; lea 0x4(%rbp),%rdx
+ DB 72,131,197,8 ; add $0x8,%rbp
+ DB 72,57,221 ; cmp %rbx,%rbp
+ DB 72,137,213 ; mov %rdx,%rbp
+ DB 118,195 ; jbe 7c <_sk_start_pipeline_sse2+0x7c>
+ DB 72,41,211 ; sub %rdx,%rbx
+ DB 116,39 ; je e5 <_sk_start_pipeline_sse2+0xe5>
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -18763,10 +18801,11 @@ _sk_start_pipeline_sse2 LABEL PROC
DB 15,87,237 ; xorps %xmm5,%xmm5
DB 15,87,246 ; xorps %xmm6,%xmm6
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 76,137,230 ; mov %r12,%rsi
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,233 ; mov %r13,%rcx
- DB 65,255,215 ; callq *%r15
+ DB 76,137,255 ; mov %r15,%rdi
+ DB 76,137,238 ; mov %r13,%rsi
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 73,137,216 ; mov %rbx,%r8
+ DB 65,255,212 ; callq *%r12
DB 15,40,52,36 ; movaps (%rsp),%xmm6
DB 15,40,124,36,16 ; movaps 0x10(%rsp),%xmm7
DB 68,15,40,68,36,32 ; movaps 0x20(%rsp),%xmm8
@@ -18777,8 +18816,9 @@ _sk_start_pipeline_sse2 LABEL PROC
DB 68,15,40,108,36,112 ; movaps 0x70(%rsp),%xmm13
DB 68,15,40,180,36,128,0,0,0 ; movaps 0x80(%rsp),%xmm14
DB 68,15,40,188,36,144,0,0,0 ; movaps 0x90(%rsp),%xmm15
- DB 72,129,196,160,0,0,0 ; add $0xa0,%rsp
+ DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp
DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 95 ; pop %rdi
DB 94 ; pop %rsi
DB 65,92 ; pop %r12
@@ -18793,20 +18833,19 @@ _sk_just_return_sse2 LABEL PROC
PUBLIC _sk_seed_shader_sse2
_sk_seed_shader_sse2 LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 102,15,110,199 ; movd %edi,%xmm0
+ DB 102,15,110,194 ; movd %edx,%xmm0
DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
- DB 15,40,21,51,85,0,0 ; movaps 0x5533(%rip),%xmm2 # 5670 <_sk_callback_sse2+0xca>
+ DB 15,40,21,84,85,0,0 ; movaps 0x5554(%rip),%xmm2 # 56a0 <_sk_callback_sse2+0xc6>
DB 15,88,202 ; addps %xmm2,%xmm1
- DB 15,16,2 ; movups (%rdx),%xmm0
+ DB 15,16,7 ; movups (%rdi),%xmm0
DB 15,88,193 ; addps %xmm1,%xmm0
- DB 102,15,110,8 ; movd (%rax),%xmm1
+ DB 102,15,110,201 ; movd %ecx,%xmm1
DB 102,15,112,201,0 ; pshufd $0x0,%xmm1,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,21,34,85,0,0 ; movaps 0x5522(%rip),%xmm2 # 5680 <_sk_callback_sse2+0xda>
+ DB 15,40,21,67,85,0,0 ; movaps 0x5543(%rip),%xmm2 # 56b0 <_sk_callback_sse2+0xd6>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,87,237 ; xorps %xmm5,%xmm5
@@ -18817,22 +18856,21 @@ _sk_seed_shader_sse2 LABEL PROC
PUBLIC _sk_dither_sse2
_sk_dither_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 102,68,15,110,199 ; movd %edi,%xmm8
+ DB 102,68,15,110,194 ; movd %edx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
- DB 243,68,15,111,74,32 ; movdqu 0x20(%rdx),%xmm9
+ DB 243,68,15,111,79,32 ; movdqu 0x20(%rdi),%xmm9
DB 102,69,15,254,200 ; paddd %xmm8,%xmm9
- DB 76,139,0 ; mov (%rax),%r8
- DB 102,69,15,110,0 ; movd (%r8),%xmm8
+ DB 102,68,15,110,193 ; movd %ecx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 102,69,15,239,193 ; pxor %xmm9,%xmm8
- DB 102,68,15,111,21,237,84,0,0 ; movdqa 0x54ed(%rip),%xmm10 # 5690 <_sk_callback_sse2+0xea>
+ DB 102,68,15,111,21,17,85,0,0 ; movdqa 0x5511(%rip),%xmm10 # 56c0 <_sk_callback_sse2+0xe6>
DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10
- DB 102,68,15,111,37,217,84,0,0 ; movdqa 0x54d9(%rip),%xmm12 # 56a0 <_sk_callback_sse2+0xfa>
- DB 102,68,15,111,45,224,84,0,0 ; movdqa 0x54e0(%rip),%xmm13 # 56b0 <_sk_callback_sse2+0x10a>
+ DB 102,68,15,111,37,253,84,0,0 ; movdqa 0x54fd(%rip),%xmm12 # 56d0 <_sk_callback_sse2+0xf6>
+ DB 102,68,15,111,45,4,85,0,0 ; movdqa 0x5504(%rip),%xmm13 # 56e0 <_sk_callback_sse2+0x106>
DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14
DB 102,69,15,219,245 ; pand %xmm13,%xmm14
DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14
@@ -18844,13 +18882,13 @@ _sk_dither_sse2 LABEL PROC
DB 102,65,15,114,209,2 ; psrld $0x2,%xmm9
DB 102,69,15,235,234 ; por %xmm10,%xmm13
DB 102,69,15,235,233 ; por %xmm9,%xmm13
- DB 102,69,15,235,235 ; por %xmm11,%xmm13
- DB 102,69,15,235,198 ; por %xmm14,%xmm8
- DB 102,69,15,235,197 ; por %xmm13,%xmm8
- DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,155,84,0,0 ; mulps 0x549b(%rip),%xmm8 # 56c0 <_sk_callback_sse2+0x11a>
- DB 68,15,88,5,163,84,0,0 ; addps 0x54a3(%rip),%xmm8 # 56d0 <_sk_callback_sse2+0x12a>
- DB 243,68,15,16,80,8 ; movss 0x8(%rax),%xmm10
+ DB 102,69,15,235,243 ; por %xmm11,%xmm14
+ DB 102,69,15,235,245 ; por %xmm13,%xmm14
+ DB 102,69,15,235,240 ; por %xmm8,%xmm14
+ DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8
+ DB 68,15,89,5,191,84,0,0 ; mulps 0x54bf(%rip),%xmm8 # 56f0 <_sk_callback_sse2+0x116>
+ DB 68,15,88,5,199,84,0,0 ; addps 0x54c7(%rip),%xmm8 # 5700 <_sk_callback_sse2+0x126>
+ DB 243,68,15,16,16 ; movss (%rax),%xmm10
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,88,194 ; addps %xmm10,%xmm0
@@ -18916,7 +18954,7 @@ _sk_clear_sse2 LABEL PROC
PUBLIC _sk_srcatop_sse2
_sk_srcatop_sse2 LABEL PROC
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 68,15,40,5,252,83,0,0 ; movaps 0x53fc(%rip),%xmm8 # 56e0 <_sk_callback_sse2+0x13a>
+ DB 68,15,40,5,33,84,0,0 ; movaps 0x5421(%rip),%xmm8 # 5710 <_sk_callback_sse2+0x136>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -18939,7 +18977,7 @@ PUBLIC _sk_dstatop_sse2
_sk_dstatop_sse2 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
DB 68,15,89,196 ; mulps %xmm4,%xmm8
- DB 68,15,40,13,191,83,0,0 ; movaps 0x53bf(%rip),%xmm9 # 56f0 <_sk_callback_sse2+0x14a>
+ DB 68,15,40,13,228,83,0,0 ; movaps 0x53e4(%rip),%xmm9 # 5720 <_sk_callback_sse2+0x146>
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
@@ -18980,7 +19018,7 @@ _sk_dstin_sse2 LABEL PROC
PUBLIC _sk_srcout_sse2
_sk_srcout_sse2 LABEL PROC
- DB 68,15,40,5,99,83,0,0 ; movaps 0x5363(%rip),%xmm8 # 5700 <_sk_callback_sse2+0x15a>
+ DB 68,15,40,5,136,83,0,0 ; movaps 0x5388(%rip),%xmm8 # 5730 <_sk_callback_sse2+0x156>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
@@ -18991,7 +19029,7 @@ _sk_srcout_sse2 LABEL PROC
PUBLIC _sk_dstout_sse2
_sk_dstout_sse2 LABEL PROC
- DB 68,15,40,5,83,83,0,0 ; movaps 0x5353(%rip),%xmm8 # 5710 <_sk_callback_sse2+0x16a>
+ DB 68,15,40,5,120,83,0,0 ; movaps 0x5378(%rip),%xmm8 # 5740 <_sk_callback_sse2+0x166>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
@@ -19006,7 +19044,7 @@ _sk_dstout_sse2 LABEL PROC
PUBLIC _sk_srcover_sse2
_sk_srcover_sse2 LABEL PROC
- DB 68,15,40,5,54,83,0,0 ; movaps 0x5336(%rip),%xmm8 # 5720 <_sk_callback_sse2+0x17a>
+ DB 68,15,40,5,91,83,0,0 ; movaps 0x535b(%rip),%xmm8 # 5750 <_sk_callback_sse2+0x176>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -19024,7 +19062,7 @@ _sk_srcover_sse2 LABEL PROC
PUBLIC _sk_dstover_sse2
_sk_dstover_sse2 LABEL PROC
- DB 68,15,40,5,10,83,0,0 ; movaps 0x530a(%rip),%xmm8 # 5730 <_sk_callback_sse2+0x18a>
+ DB 68,15,40,5,47,83,0,0 ; movaps 0x532f(%rip),%xmm8 # 5760 <_sk_callback_sse2+0x186>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -19048,7 +19086,7 @@ _sk_modulate_sse2 LABEL PROC
PUBLIC _sk_multiply_sse2
_sk_multiply_sse2 LABEL PROC
- DB 68,15,40,5,222,82,0,0 ; movaps 0x52de(%rip),%xmm8 # 5740 <_sk_callback_sse2+0x19a>
+ DB 68,15,40,5,3,83,0,0 ; movaps 0x5303(%rip),%xmm8 # 5770 <_sk_callback_sse2+0x196>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,209 ; movaps %xmm9,%xmm10
@@ -19117,7 +19155,7 @@ _sk_screen_sse2 LABEL PROC
PUBLIC _sk_xor__sse2
_sk_xor__sse2 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
- DB 15,40,29,19,82,0,0 ; movaps 0x5213(%rip),%xmm3 # 5750 <_sk_callback_sse2+0x1aa>
+ DB 15,40,29,56,82,0,0 ; movaps 0x5238(%rip),%xmm3 # 5780 <_sk_callback_sse2+0x1a6>
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
@@ -19163,7 +19201,7 @@ _sk_darken_sse2 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,95,209 ; maxps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,126,81,0,0 ; movaps 0x517e(%rip),%xmm2 # 5760 <_sk_callback_sse2+0x1ba>
+ DB 15,40,21,163,81,0,0 ; movaps 0x51a3(%rip),%xmm2 # 5790 <_sk_callback_sse2+0x1b6>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -19195,7 +19233,7 @@ _sk_lighten_sse2 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,35,81,0,0 ; movaps 0x5123(%rip),%xmm2 # 5770 <_sk_callback_sse2+0x1ca>
+ DB 15,40,21,72,81,0,0 ; movaps 0x5148(%rip),%xmm2 # 57a0 <_sk_callback_sse2+0x1c6>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -19230,7 +19268,7 @@ _sk_difference_sse2 LABEL PROC
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,189,80,0,0 ; movaps 0x50bd(%rip),%xmm2 # 5780 <_sk_callback_sse2+0x1da>
+ DB 15,40,21,226,80,0,0 ; movaps 0x50e2(%rip),%xmm2 # 57b0 <_sk_callback_sse2+0x1d6>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -19256,7 +19294,7 @@ _sk_exclusion_sse2 LABEL PROC
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,125,80,0,0 ; movaps 0x507d(%rip),%xmm2 # 5790 <_sk_callback_sse2+0x1ea>
+ DB 15,40,21,162,80,0,0 ; movaps 0x50a2(%rip),%xmm2 # 57c0 <_sk_callback_sse2+0x1e6>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -19267,7 +19305,7 @@ _sk_exclusion_sse2 LABEL PROC
PUBLIC _sk_colorburn_sse2
_sk_colorburn_sse2 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,112,80,0,0 ; movaps 0x5070(%rip),%xmm10 # 57a0 <_sk_callback_sse2+0x1fa>
+ DB 68,15,40,21,149,80,0,0 ; movaps 0x5095(%rip),%xmm10 # 57d0 <_sk_callback_sse2+0x1f6>
DB 69,15,40,202 ; movaps %xmm10,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,217 ; movaps %xmm9,%xmm11
@@ -19359,7 +19397,7 @@ _sk_colorburn_sse2 LABEL PROC
PUBLIC _sk_colordodge_sse2
_sk_colordodge_sse2 LABEL PROC
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 68,15,40,21,38,79,0,0 ; movaps 0x4f26(%rip),%xmm10 # 57b0 <_sk_callback_sse2+0x20a>
+ DB 68,15,40,21,75,79,0,0 ; movaps 0x4f4b(%rip),%xmm10 # 57e0 <_sk_callback_sse2+0x206>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
@@ -19452,7 +19490,7 @@ _sk_hardlight_sse2 LABEL PROC
DB 15,41,52,36 ; movaps %xmm6,(%rsp)
DB 15,40,245 ; movaps %xmm5,%xmm6
DB 15,40,236 ; movaps %xmm4,%xmm5
- DB 68,15,40,29,216,77,0,0 ; movaps 0x4dd8(%rip),%xmm11 # 57c0 <_sk_callback_sse2+0x21a>
+ DB 68,15,40,29,253,77,0,0 ; movaps 0x4dfd(%rip),%xmm11 # 57f0 <_sk_callback_sse2+0x216>
DB 69,15,40,211 ; movaps %xmm11,%xmm10
DB 68,15,92,215 ; subps %xmm7,%xmm10
DB 69,15,40,194 ; movaps %xmm10,%xmm8
@@ -19539,7 +19577,7 @@ PUBLIC _sk_overlay_sse2
_sk_overlay_sse2 LABEL PROC
DB 68,15,40,193 ; movaps %xmm1,%xmm8
DB 68,15,40,232 ; movaps %xmm0,%xmm13
- DB 68,15,40,13,163,76,0,0 ; movaps 0x4ca3(%rip),%xmm9 # 57d0 <_sk_callback_sse2+0x22a>
+ DB 68,15,40,13,200,76,0,0 ; movaps 0x4cc8(%rip),%xmm9 # 5800 <_sk_callback_sse2+0x226>
DB 69,15,40,209 ; movaps %xmm9,%xmm10
DB 68,15,92,215 ; subps %xmm7,%xmm10
DB 69,15,40,218 ; movaps %xmm10,%xmm11
@@ -19629,7 +19667,7 @@ _sk_softlight_sse2 LABEL PROC
DB 68,15,40,213 ; movaps %xmm5,%xmm10
DB 68,15,94,215 ; divps %xmm7,%xmm10
DB 69,15,84,212 ; andps %xmm12,%xmm10
- DB 68,15,40,13,93,75,0,0 ; movaps 0x4b5d(%rip),%xmm9 # 57e0 <_sk_callback_sse2+0x23a>
+ DB 68,15,40,13,130,75,0,0 ; movaps 0x4b82(%rip),%xmm9 # 5810 <_sk_callback_sse2+0x236>
DB 69,15,40,249 ; movaps %xmm9,%xmm15
DB 69,15,92,250 ; subps %xmm10,%xmm15
DB 69,15,40,218 ; movaps %xmm10,%xmm11
@@ -19642,10 +19680,10 @@ _sk_softlight_sse2 LABEL PROC
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 65,15,88,194 ; addps %xmm10,%xmm0
- DB 68,15,40,53,55,75,0,0 ; movaps 0x4b37(%rip),%xmm14 # 57f0 <_sk_callback_sse2+0x24a>
+ DB 68,15,40,53,92,75,0,0 ; movaps 0x4b5c(%rip),%xmm14 # 5820 <_sk_callback_sse2+0x246>
DB 69,15,88,222 ; addps %xmm14,%xmm11
DB 68,15,89,216 ; mulps %xmm0,%xmm11
- DB 68,15,40,21,55,75,0,0 ; movaps 0x4b37(%rip),%xmm10 # 5800 <_sk_callback_sse2+0x25a>
+ DB 68,15,40,21,92,75,0,0 ; movaps 0x4b5c(%rip),%xmm10 # 5830 <_sk_callback_sse2+0x256>
DB 69,15,89,234 ; mulps %xmm10,%xmm13
DB 69,15,88,235 ; addps %xmm11,%xmm13
DB 15,88,228 ; addps %xmm4,%xmm4
@@ -19790,7 +19828,7 @@ _sk_hue_sse2 LABEL PROC
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 68,15,89,211 ; mulps %xmm3,%xmm10
- DB 68,15,40,5,115,73,0,0 ; movaps 0x4973(%rip),%xmm8 # 5840 <_sk_callback_sse2+0x29a>
+ DB 68,15,40,5,152,73,0,0 ; movaps 0x4998(%rip),%xmm8 # 5870 <_sk_callback_sse2+0x296>
DB 69,15,40,216 ; movaps %xmm8,%xmm11
DB 15,40,207 ; movaps %xmm7,%xmm1
DB 68,15,92,217 ; subps %xmm1,%xmm11
@@ -19838,12 +19876,12 @@ _sk_hue_sse2 LABEL PROC
DB 69,15,84,206 ; andps %xmm14,%xmm9
DB 69,15,84,214 ; andps %xmm14,%xmm10
DB 65,15,84,214 ; andps %xmm14,%xmm2
- DB 68,15,40,61,128,72,0,0 ; movaps 0x4880(%rip),%xmm15 # 5810 <_sk_callback_sse2+0x26a>
+ DB 68,15,40,61,165,72,0,0 ; movaps 0x48a5(%rip),%xmm15 # 5840 <_sk_callback_sse2+0x266>
DB 65,15,89,231 ; mulps %xmm15,%xmm4
- DB 15,40,5,133,72,0,0 ; movaps 0x4885(%rip),%xmm0 # 5820 <_sk_callback_sse2+0x27a>
+ DB 15,40,5,170,72,0,0 ; movaps 0x48aa(%rip),%xmm0 # 5850 <_sk_callback_sse2+0x276>
DB 15,89,240 ; mulps %xmm0,%xmm6
DB 15,88,244 ; addps %xmm4,%xmm6
- DB 68,15,40,53,135,72,0,0 ; movaps 0x4887(%rip),%xmm14 # 5830 <_sk_callback_sse2+0x28a>
+ DB 68,15,40,53,172,72,0,0 ; movaps 0x48ac(%rip),%xmm14 # 5860 <_sk_callback_sse2+0x286>
DB 68,15,40,239 ; movaps %xmm7,%xmm13
DB 69,15,89,238 ; mulps %xmm14,%xmm13
DB 68,15,88,238 ; addps %xmm6,%xmm13
@@ -20021,14 +20059,14 @@ _sk_saturation_sse2 LABEL PROC
DB 68,15,84,211 ; andps %xmm3,%xmm10
DB 68,15,84,203 ; andps %xmm3,%xmm9
DB 15,84,195 ; andps %xmm3,%xmm0
- DB 68,15,40,5,20,70,0,0 ; movaps 0x4614(%rip),%xmm8 # 5850 <_sk_callback_sse2+0x2aa>
+ DB 68,15,40,5,57,70,0,0 ; movaps 0x4639(%rip),%xmm8 # 5880 <_sk_callback_sse2+0x2a6>
DB 15,40,214 ; movaps %xmm6,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
- DB 15,40,13,22,70,0,0 ; movaps 0x4616(%rip),%xmm1 # 5860 <_sk_callback_sse2+0x2ba>
+ DB 15,40,13,59,70,0,0 ; movaps 0x463b(%rip),%xmm1 # 5890 <_sk_callback_sse2+0x2b6>
DB 15,40,221 ; movaps %xmm5,%xmm3
DB 15,89,217 ; mulps %xmm1,%xmm3
DB 15,88,218 ; addps %xmm2,%xmm3
- DB 68,15,40,37,21,70,0,0 ; movaps 0x4615(%rip),%xmm12 # 5870 <_sk_callback_sse2+0x2ca>
+ DB 68,15,40,37,58,70,0,0 ; movaps 0x463a(%rip),%xmm12 # 58a0 <_sk_callback_sse2+0x2c6>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
DB 68,15,88,235 ; addps %xmm3,%xmm13
DB 65,15,40,210 ; movaps %xmm10,%xmm2
@@ -20073,7 +20111,7 @@ _sk_saturation_sse2 LABEL PROC
DB 15,40,223 ; movaps %xmm7,%xmm3
DB 15,40,236 ; movaps %xmm4,%xmm5
DB 15,89,221 ; mulps %xmm5,%xmm3
- DB 68,15,40,5,122,69,0,0 ; movaps 0x457a(%rip),%xmm8 # 5880 <_sk_callback_sse2+0x2da>
+ DB 68,15,40,5,159,69,0,0 ; movaps 0x459f(%rip),%xmm8 # 58b0 <_sk_callback_sse2+0x2d6>
DB 65,15,40,224 ; movaps %xmm8,%xmm4
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 15,88,253 ; addps %xmm5,%xmm7
@@ -20174,14 +20212,14 @@ _sk_color_sse2 LABEL PROC
DB 68,15,40,213 ; movaps %xmm5,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,40,208 ; movaps %xmm8,%xmm2
- DB 68,15,40,45,18,68,0,0 ; movaps 0x4412(%rip),%xmm13 # 5890 <_sk_callback_sse2+0x2ea>
+ DB 68,15,40,45,55,68,0,0 ; movaps 0x4437(%rip),%xmm13 # 58c0 <_sk_callback_sse2+0x2e6>
DB 68,15,40,198 ; movaps %xmm6,%xmm8
DB 69,15,89,197 ; mulps %xmm13,%xmm8
- DB 68,15,40,53,18,68,0,0 ; movaps 0x4412(%rip),%xmm14 # 58a0 <_sk_callback_sse2+0x2fa>
+ DB 68,15,40,53,55,68,0,0 ; movaps 0x4437(%rip),%xmm14 # 58d0 <_sk_callback_sse2+0x2f6>
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,89,198 ; mulps %xmm14,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,29,14,68,0,0 ; movaps 0x440e(%rip),%xmm11 # 58b0 <_sk_callback_sse2+0x30a>
+ DB 68,15,40,29,51,68,0,0 ; movaps 0x4433(%rip),%xmm11 # 58e0 <_sk_callback_sse2+0x306>
DB 69,15,89,227 ; mulps %xmm11,%xmm12
DB 68,15,88,224 ; addps %xmm0,%xmm12
DB 65,15,40,193 ; movaps %xmm9,%xmm0
@@ -20189,7 +20227,7 @@ _sk_color_sse2 LABEL PROC
DB 69,15,40,250 ; movaps %xmm10,%xmm15
DB 69,15,89,254 ; mulps %xmm14,%xmm15
DB 68,15,88,248 ; addps %xmm0,%xmm15
- DB 68,15,40,5,250,67,0,0 ; movaps 0x43fa(%rip),%xmm8 # 58c0 <_sk_callback_sse2+0x31a>
+ DB 68,15,40,5,31,68,0,0 ; movaps 0x441f(%rip),%xmm8 # 58f0 <_sk_callback_sse2+0x316>
DB 65,15,40,224 ; movaps %xmm8,%xmm4
DB 15,92,226 ; subps %xmm2,%xmm4
DB 15,89,252 ; mulps %xmm4,%xmm7
@@ -20325,15 +20363,15 @@ _sk_luminosity_sse2 LABEL PROC
DB 68,15,40,205 ; movaps %xmm5,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
DB 15,89,222 ; mulps %xmm6,%xmm3
- DB 68,15,40,37,12,66,0,0 ; movaps 0x420c(%rip),%xmm12 # 58d0 <_sk_callback_sse2+0x32a>
+ DB 68,15,40,37,49,66,0,0 ; movaps 0x4231(%rip),%xmm12 # 5900 <_sk_callback_sse2+0x326>
DB 68,15,40,199 ; movaps %xmm7,%xmm8
DB 69,15,89,196 ; mulps %xmm12,%xmm8
- DB 68,15,40,45,12,66,0,0 ; movaps 0x420c(%rip),%xmm13 # 58e0 <_sk_callback_sse2+0x33a>
+ DB 68,15,40,45,49,66,0,0 ; movaps 0x4231(%rip),%xmm13 # 5910 <_sk_callback_sse2+0x336>
DB 68,15,40,241 ; movaps %xmm1,%xmm14
DB 69,15,89,245 ; mulps %xmm13,%xmm14
DB 69,15,88,240 ; addps %xmm8,%xmm14
- DB 68,15,40,29,8,66,0,0 ; movaps 0x4208(%rip),%xmm11 # 58f0 <_sk_callback_sse2+0x34a>
- DB 68,15,40,5,16,66,0,0 ; movaps 0x4210(%rip),%xmm8 # 5900 <_sk_callback_sse2+0x35a>
+ DB 68,15,40,29,45,66,0,0 ; movaps 0x422d(%rip),%xmm11 # 5920 <_sk_callback_sse2+0x346>
+ DB 68,15,40,5,53,66,0,0 ; movaps 0x4235(%rip),%xmm8 # 5930 <_sk_callback_sse2+0x356>
DB 69,15,40,248 ; movaps %xmm8,%xmm15
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 68,15,92,248 ; subps %xmm0,%xmm15
@@ -20467,11 +20505,11 @@ PUBLIC _sk_srcover_rgba_8888_sse2
_sk_srcover_rgba_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,227,0,0,0 ; jne 19ca <_sk_srcover_rgba_8888_sse2+0xf1>
- DB 243,68,15,111,4,184 ; movdqu (%rax,%rdi,4),%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 102,15,111,53,24,64,0,0 ; movdqa 0x4018(%rip),%xmm6 # 5910 <_sk_callback_sse2+0x36a>
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,227,0,0,0 ; jne 19d5 <_sk_srcover_rgba_8888_sse2+0xf1>
+ DB 243,68,15,111,4,144 ; movdqu (%rax,%rdx,4),%xmm8
+ DB 77,133,192 ; test %r8,%r8
+ DB 102,15,111,53,61,64,0,0 ; movdqa 0x403d(%rip),%xmm6 # 5940 <_sk_callback_sse2+0x366>
DB 102,65,15,111,224 ; movdqa %xmm8,%xmm4
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
@@ -20485,9 +20523,9 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 15,91,247 ; cvtdq2ps %xmm7,%xmm6
DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8
DB 65,15,91,248 ; cvtdq2ps %xmm8,%xmm7
- DB 68,15,40,5,232,63,0,0 ; movaps 0x3fe8(%rip),%xmm8 # 5920 <_sk_callback_sse2+0x37a>
+ DB 68,15,40,5,13,64,0,0 ; movaps 0x400d(%rip),%xmm8 # 5950 <_sk_callback_sse2+0x376>
DB 68,15,92,195 ; subps %xmm3,%xmm8
- DB 68,15,40,37,236,63,0,0 ; movaps 0x3fec(%rip),%xmm12 # 5930 <_sk_callback_sse2+0x38a>
+ DB 68,15,40,37,17,64,0,0 ; movaps 0x4011(%rip),%xmm12 # 5960 <_sk_callback_sse2+0x386>
DB 65,15,89,196 ; mulps %xmm12,%xmm0
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -20513,46 +20551,46 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 102,15,114,240,24 ; pslld $0x18,%xmm0
DB 102,15,235,194 ; por %xmm2,%xmm0
DB 102,15,235,193 ; por %xmm1,%xmm0
- DB 117,106 ; jne 1a1b <_sk_srcover_rgba_8888_sse2+0x142>
- DB 243,15,127,4,184 ; movdqu %xmm0,(%rax,%rdi,4)
+ DB 117,106 ; jne 1a26 <_sk_srcover_rgba_8888_sse2+0x142>
+ DB 243,15,127,4,144 ; movdqu %xmm0,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 65,15,40,202 ; movaps %xmm10,%xmm1
DB 65,15,40,211 ; movaps %xmm11,%xmm2
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,48 ; je 1a0c <_sk_srcover_rgba_8888_sse2+0x133>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,22 ; je 19f8 <_sk_srcover_rgba_8888_sse2+0x11f>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 15,133,1,255,255,255 ; jne 18ed <_sk_srcover_rgba_8888_sse2+0x14>
- DB 102,15,110,100,184,8 ; movd 0x8(%rax,%rdi,4),%xmm4
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,48 ; je 1a17 <_sk_srcover_rgba_8888_sse2+0x133>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,22 ; je 1a03 <_sk_srcover_rgba_8888_sse2+0x11f>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 15,133,1,255,255,255 ; jne 18f8 <_sk_srcover_rgba_8888_sse2+0x14>
+ DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,68,15,112,196,69 ; pshufd $0x45,%xmm4,%xmm8
- DB 243,15,16,100,184,4 ; movss 0x4(%rax,%rdi,4),%xmm4
+ DB 243,15,16,100,144,4 ; movss 0x4(%rax,%rdx,4),%xmm4
DB 65,15,198,224,0 ; shufps $0x0,%xmm8,%xmm4
DB 65,15,198,224,226 ; shufps $0xe2,%xmm8,%xmm4
DB 68,15,40,196 ; movaps %xmm4,%xmm8
- DB 243,15,16,36,184 ; movss (%rax,%rdi,4),%xmm4
+ DB 243,15,16,36,144 ; movss (%rax,%rdx,4),%xmm4
DB 243,68,15,16,196 ; movss %xmm4,%xmm8
- DB 233,210,254,255,255 ; jmpq 18ed <_sk_srcover_rgba_8888_sse2+0x14>
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,34 ; je 1a4a <_sk_srcover_rgba_8888_sse2+0x171>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,17 ; je 1a3f <_sk_srcover_rgba_8888_sse2+0x166>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,130 ; jne 19b6 <_sk_srcover_rgba_8888_sse2+0xdd>
+ DB 233,210,254,255,255 ; jmpq 18f8 <_sk_srcover_rgba_8888_sse2+0x14>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,34 ; je 1a55 <_sk_srcover_rgba_8888_sse2+0x171>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,17 ; je 1a4a <_sk_srcover_rgba_8888_sse2+0x166>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,130 ; jne 19c1 <_sk_srcover_rgba_8888_sse2+0xdd>
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
- DB 102,15,126,76,184,8 ; movd %xmm1,0x8(%rax,%rdi,4)
+ DB 102,15,126,76,144,8 ; movd %xmm1,0x8(%rax,%rdx,4)
DB 102,15,112,200,229 ; pshufd $0xe5,%xmm0,%xmm1
- DB 102,15,126,76,184,4 ; movd %xmm1,0x4(%rax,%rdi,4)
- DB 102,15,126,4,184 ; movd %xmm0,(%rax,%rdi,4)
- DB 233,98,255,255,255 ; jmpq 19b6 <_sk_srcover_rgba_8888_sse2+0xdd>
+ DB 102,15,126,76,144,4 ; movd %xmm1,0x4(%rax,%rdx,4)
+ DB 102,15,126,4,144 ; movd %xmm0,(%rax,%rdx,4)
+ DB 233,98,255,255,255 ; jmpq 19c1 <_sk_srcover_rgba_8888_sse2+0xdd>
PUBLIC _sk_clamp_0_sse2
_sk_clamp_0_sse2 LABEL PROC
@@ -20566,7 +20604,7 @@ _sk_clamp_0_sse2 LABEL PROC
PUBLIC _sk_clamp_1_sse2
_sk_clamp_1_sse2 LABEL PROC
- DB 68,15,40,5,204,62,0,0 ; movaps 0x3ecc(%rip),%xmm8 # 5940 <_sk_callback_sse2+0x39a>
+ DB 68,15,40,5,241,62,0,0 ; movaps 0x3ef1(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x396>
DB 65,15,93,192 ; minps %xmm8,%xmm0
DB 65,15,93,200 ; minps %xmm8,%xmm1
DB 65,15,93,208 ; minps %xmm8,%xmm2
@@ -20576,7 +20614,7 @@ _sk_clamp_1_sse2 LABEL PROC
PUBLIC _sk_clamp_a_sse2
_sk_clamp_a_sse2 LABEL PROC
- DB 15,93,29,193,62,0,0 ; minps 0x3ec1(%rip),%xmm3 # 5950 <_sk_callback_sse2+0x3aa>
+ DB 15,93,29,230,62,0,0 ; minps 0x3ee6(%rip),%xmm3 # 5980 <_sk_callback_sse2+0x3a6>
DB 15,93,195 ; minps %xmm3,%xmm0
DB 15,93,203 ; minps %xmm3,%xmm1
DB 15,93,211 ; minps %xmm3,%xmm2
@@ -20649,7 +20687,7 @@ _sk_premul_sse2 LABEL PROC
PUBLIC _sk_unpremul_sse2
_sk_unpremul_sse2 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
- DB 68,15,40,13,44,62,0,0 ; movaps 0x3e2c(%rip),%xmm9 # 5960 <_sk_callback_sse2+0x3ba>
+ DB 68,15,40,13,81,62,0,0 ; movaps 0x3e51(%rip),%xmm9 # 5990 <_sk_callback_sse2+0x3b6>
DB 68,15,94,203 ; divps %xmm3,%xmm9
DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8
DB 69,15,84,193 ; andps %xmm9,%xmm8
@@ -20661,20 +20699,20 @@ _sk_unpremul_sse2 LABEL PROC
PUBLIC _sk_from_srgb_sse2
_sk_from_srgb_sse2 LABEL PROC
- DB 68,15,40,5,23,62,0,0 ; movaps 0x3e17(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x3ca>
+ DB 68,15,40,5,60,62,0,0 ; movaps 0x3e3c(%rip),%xmm8 # 59a0 <_sk_callback_sse2+0x3c6>
DB 68,15,40,232 ; movaps %xmm0,%xmm13
DB 69,15,89,232 ; mulps %xmm8,%xmm13
DB 68,15,40,216 ; movaps %xmm0,%xmm11
DB 69,15,89,219 ; mulps %xmm11,%xmm11
- DB 68,15,40,13,15,62,0,0 ; movaps 0x3e0f(%rip),%xmm9 # 5980 <_sk_callback_sse2+0x3da>
+ DB 68,15,40,13,52,62,0,0 ; movaps 0x3e34(%rip),%xmm9 # 59b0 <_sk_callback_sse2+0x3d6>
DB 68,15,40,240 ; movaps %xmm0,%xmm14
DB 69,15,89,241 ; mulps %xmm9,%xmm14
- DB 68,15,40,21,15,62,0,0 ; movaps 0x3e0f(%rip),%xmm10 # 5990 <_sk_callback_sse2+0x3ea>
+ DB 68,15,40,21,52,62,0,0 ; movaps 0x3e34(%rip),%xmm10 # 59c0 <_sk_callback_sse2+0x3e6>
DB 69,15,88,242 ; addps %xmm10,%xmm14
DB 69,15,89,243 ; mulps %xmm11,%xmm14
- DB 68,15,40,29,15,62,0,0 ; movaps 0x3e0f(%rip),%xmm11 # 59a0 <_sk_callback_sse2+0x3fa>
+ DB 68,15,40,29,52,62,0,0 ; movaps 0x3e34(%rip),%xmm11 # 59d0 <_sk_callback_sse2+0x3f6>
DB 69,15,88,243 ; addps %xmm11,%xmm14
- DB 68,15,40,37,19,62,0,0 ; movaps 0x3e13(%rip),%xmm12 # 59b0 <_sk_callback_sse2+0x40a>
+ DB 68,15,40,37,56,62,0,0 ; movaps 0x3e38(%rip),%xmm12 # 59e0 <_sk_callback_sse2+0x406>
DB 65,15,194,196,1 ; cmpltps %xmm12,%xmm0
DB 68,15,84,232 ; andps %xmm0,%xmm13
DB 65,15,85,198 ; andnps %xmm14,%xmm0
@@ -20709,22 +20747,22 @@ _sk_from_srgb_sse2 LABEL PROC
PUBLIC _sk_to_srgb_sse2
_sk_to_srgb_sse2 LABEL PROC
DB 68,15,82,232 ; rsqrtps %xmm0,%xmm13
- DB 68,15,40,5,160,61,0,0 ; movaps 0x3da0(%rip),%xmm8 # 59c0 <_sk_callback_sse2+0x41a>
+ DB 68,15,40,5,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm8 # 59f0 <_sk_callback_sse2+0x416>
DB 68,15,40,240 ; movaps %xmm0,%xmm14
DB 69,15,89,240 ; mulps %xmm8,%xmm14
- DB 68,15,40,13,160,61,0,0 ; movaps 0x3da0(%rip),%xmm9 # 59d0 <_sk_callback_sse2+0x42a>
+ DB 68,15,40,13,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm9 # 5a00 <_sk_callback_sse2+0x426>
DB 69,15,40,253 ; movaps %xmm13,%xmm15
DB 69,15,89,249 ; mulps %xmm9,%xmm15
- DB 68,15,40,21,160,61,0,0 ; movaps 0x3da0(%rip),%xmm10 # 59e0 <_sk_callback_sse2+0x43a>
+ DB 68,15,40,21,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm10 # 5a10 <_sk_callback_sse2+0x436>
DB 69,15,88,250 ; addps %xmm10,%xmm15
DB 69,15,89,253 ; mulps %xmm13,%xmm15
- DB 68,15,40,29,160,61,0,0 ; movaps 0x3da0(%rip),%xmm11 # 59f0 <_sk_callback_sse2+0x44a>
+ DB 68,15,40,29,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm11 # 5a20 <_sk_callback_sse2+0x446>
DB 69,15,88,251 ; addps %xmm11,%xmm15
- DB 68,15,40,37,164,61,0,0 ; movaps 0x3da4(%rip),%xmm12 # 5a00 <_sk_callback_sse2+0x45a>
+ DB 68,15,40,37,201,61,0,0 ; movaps 0x3dc9(%rip),%xmm12 # 5a30 <_sk_callback_sse2+0x456>
DB 69,15,88,236 ; addps %xmm12,%xmm13
DB 69,15,83,237 ; rcpps %xmm13,%xmm13
DB 69,15,89,239 ; mulps %xmm15,%xmm13
- DB 68,15,40,61,160,61,0,0 ; movaps 0x3da0(%rip),%xmm15 # 5a10 <_sk_callback_sse2+0x46a>
+ DB 68,15,40,61,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm15 # 5a40 <_sk_callback_sse2+0x466>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 68,15,84,240 ; andps %xmm0,%xmm14
DB 65,15,85,197 ; andnps %xmm13,%xmm0
@@ -20772,7 +20810,7 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 68,15,93,218 ; minps %xmm2,%xmm11
DB 65,15,40,202 ; movaps %xmm10,%xmm1
DB 65,15,92,203 ; subps %xmm11,%xmm1
- DB 68,15,40,45,249,60,0,0 ; movaps 0x3cf9(%rip),%xmm13 # 5a20 <_sk_callback_sse2+0x47a>
+ DB 68,15,40,45,30,61,0,0 ; movaps 0x3d1e(%rip),%xmm13 # 5a50 <_sk_callback_sse2+0x476>
DB 68,15,94,233 ; divps %xmm1,%xmm13
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,194,192,0 ; cmpeqps %xmm8,%xmm0
@@ -20781,30 +20819,30 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,40,241 ; movaps %xmm9,%xmm14
DB 68,15,194,242,1 ; cmpltps %xmm2,%xmm14
- DB 68,15,84,53,223,60,0,0 ; andps 0x3cdf(%rip),%xmm14 # 5a30 <_sk_callback_sse2+0x48a>
+ DB 68,15,84,53,4,61,0,0 ; andps 0x3d04(%rip),%xmm14 # 5a60 <_sk_callback_sse2+0x486>
DB 69,15,88,244 ; addps %xmm12,%xmm14
DB 69,15,40,250 ; movaps %xmm10,%xmm15
DB 69,15,194,249,0 ; cmpeqps %xmm9,%xmm15
DB 65,15,92,208 ; subps %xmm8,%xmm2
DB 65,15,89,213 ; mulps %xmm13,%xmm2
- DB 68,15,40,37,210,60,0,0 ; movaps 0x3cd2(%rip),%xmm12 # 5a40 <_sk_callback_sse2+0x49a>
+ DB 68,15,40,37,247,60,0,0 ; movaps 0x3cf7(%rip),%xmm12 # 5a70 <_sk_callback_sse2+0x496>
DB 65,15,88,212 ; addps %xmm12,%xmm2
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 69,15,89,197 ; mulps %xmm13,%xmm8
- DB 68,15,88,5,206,60,0,0 ; addps 0x3cce(%rip),%xmm8 # 5a50 <_sk_callback_sse2+0x4aa>
+ DB 68,15,88,5,243,60,0,0 ; addps 0x3cf3(%rip),%xmm8 # 5a80 <_sk_callback_sse2+0x4a6>
DB 65,15,84,215 ; andps %xmm15,%xmm2
DB 69,15,85,248 ; andnps %xmm8,%xmm15
DB 68,15,86,250 ; orps %xmm2,%xmm15
DB 68,15,84,240 ; andps %xmm0,%xmm14
DB 65,15,85,199 ; andnps %xmm15,%xmm0
DB 65,15,86,198 ; orps %xmm14,%xmm0
- DB 15,89,5,191,60,0,0 ; mulps 0x3cbf(%rip),%xmm0 # 5a60 <_sk_callback_sse2+0x4ba>
+ DB 15,89,5,228,60,0,0 ; mulps 0x3ce4(%rip),%xmm0 # 5a90 <_sk_callback_sse2+0x4b6>
DB 69,15,40,194 ; movaps %xmm10,%xmm8
DB 69,15,194,195,4 ; cmpneqps %xmm11,%xmm8
DB 65,15,84,192 ; andps %xmm8,%xmm0
DB 69,15,92,226 ; subps %xmm10,%xmm12
DB 69,15,88,211 ; addps %xmm11,%xmm10
- DB 68,15,40,13,178,60,0,0 ; movaps 0x3cb2(%rip),%xmm9 # 5a70 <_sk_callback_sse2+0x4ca>
+ DB 68,15,40,13,215,60,0,0 ; movaps 0x3cd7(%rip),%xmm9 # 5aa0 <_sk_callback_sse2+0x4c6>
DB 65,15,40,210 ; movaps %xmm10,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 68,15,194,202,1 ; cmpltps %xmm2,%xmm9
@@ -20827,7 +20865,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,41,92,36,32 ; movaps %xmm3,0x20(%rsp)
DB 68,15,40,218 ; movaps %xmm2,%xmm11
DB 15,40,240 ; movaps %xmm0,%xmm6
- DB 68,15,40,13,109,60,0,0 ; movaps 0x3c6d(%rip),%xmm9 # 5a80 <_sk_callback_sse2+0x4da>
+ DB 68,15,40,13,146,60,0,0 ; movaps 0x3c92(%rip),%xmm9 # 5ab0 <_sk_callback_sse2+0x4d6>
DB 69,15,40,209 ; movaps %xmm9,%xmm10
DB 69,15,194,211,2 ; cmpleps %xmm11,%xmm10
DB 15,40,193 ; movaps %xmm1,%xmm0
@@ -20844,28 +20882,28 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 69,15,88,211 ; addps %xmm11,%xmm10
DB 69,15,88,219 ; addps %xmm11,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 15,40,5,55,60,0,0 ; movaps 0x3c37(%rip),%xmm0 # 5a90 <_sk_callback_sse2+0x4ea>
+ DB 15,40,5,92,60,0,0 ; movaps 0x3c5c(%rip),%xmm0 # 5ac0 <_sk_callback_sse2+0x4e6>
DB 15,88,198 ; addps %xmm6,%xmm0
DB 243,15,91,200 ; cvttps2dq %xmm0,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,40,216 ; movaps %xmm0,%xmm3
DB 15,194,217,1 ; cmpltps %xmm1,%xmm3
- DB 15,84,29,47,60,0,0 ; andps 0x3c2f(%rip),%xmm3 # 5aa0 <_sk_callback_sse2+0x4fa>
+ DB 15,84,29,84,60,0,0 ; andps 0x3c54(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6>
DB 15,92,203 ; subps %xmm3,%xmm1
DB 15,92,193 ; subps %xmm1,%xmm0
- DB 68,15,40,45,49,60,0,0 ; movaps 0x3c31(%rip),%xmm13 # 5ab0 <_sk_callback_sse2+0x50a>
+ DB 68,15,40,45,86,60,0,0 ; movaps 0x3c56(%rip),%xmm13 # 5ae0 <_sk_callback_sse2+0x506>
DB 69,15,40,197 ; movaps %xmm13,%xmm8
DB 68,15,194,192,2 ; cmpleps %xmm0,%xmm8
DB 69,15,40,242 ; movaps %xmm10,%xmm14
DB 69,15,92,243 ; subps %xmm11,%xmm14
DB 65,15,40,217 ; movaps %xmm9,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
- DB 15,40,21,65,60,0,0 ; movaps 0x3c41(%rip),%xmm2 # 5ae0 <_sk_callback_sse2+0x53a>
+ DB 15,40,21,102,60,0,0 ; movaps 0x3c66(%rip),%xmm2 # 5b10 <_sk_callback_sse2+0x536>
DB 68,15,40,250 ; movaps %xmm2,%xmm15
DB 68,15,194,248,2 ; cmpleps %xmm0,%xmm15
- DB 15,40,13,17,60,0,0 ; movaps 0x3c11(%rip),%xmm1 # 5ac0 <_sk_callback_sse2+0x51a>
+ DB 15,40,13,54,60,0,0 ; movaps 0x3c36(%rip),%xmm1 # 5af0 <_sk_callback_sse2+0x516>
DB 15,89,193 ; mulps %xmm1,%xmm0
- DB 15,40,45,23,60,0,0 ; movaps 0x3c17(%rip),%xmm5 # 5ad0 <_sk_callback_sse2+0x52a>
+ DB 15,40,45,60,60,0,0 ; movaps 0x3c3c(%rip),%xmm5 # 5b00 <_sk_callback_sse2+0x526>
DB 15,40,229 ; movaps %xmm5,%xmm4
DB 15,92,224 ; subps %xmm0,%xmm4
DB 65,15,89,230 ; mulps %xmm14,%xmm4
@@ -20888,7 +20926,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,222 ; movaps %xmm6,%xmm3
DB 15,194,216,1 ; cmpltps %xmm0,%xmm3
- DB 15,84,29,140,59,0,0 ; andps 0x3b8c(%rip),%xmm3 # 5aa0 <_sk_callback_sse2+0x4fa>
+ DB 15,84,29,177,59,0,0 ; andps 0x3bb1(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6>
DB 15,92,195 ; subps %xmm3,%xmm0
DB 68,15,40,230 ; movaps %xmm6,%xmm12
DB 68,15,92,224 ; subps %xmm0,%xmm12
@@ -20918,12 +20956,12 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,40,60,36 ; movaps (%rsp),%xmm7
DB 15,40,231 ; movaps %xmm7,%xmm4
DB 15,85,227 ; andnps %xmm3,%xmm4
- DB 15,88,53,101,59,0,0 ; addps 0x3b65(%rip),%xmm6 # 5af0 <_sk_callback_sse2+0x54a>
+ DB 15,88,53,138,59,0,0 ; addps 0x3b8a(%rip),%xmm6 # 5b20 <_sk_callback_sse2+0x546>
DB 243,15,91,198 ; cvttps2dq %xmm6,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,222 ; movaps %xmm6,%xmm3
DB 15,194,216,1 ; cmpltps %xmm0,%xmm3
- DB 15,84,29,0,59,0,0 ; andps 0x3b00(%rip),%xmm3 # 5aa0 <_sk_callback_sse2+0x4fa>
+ DB 15,84,29,37,59,0,0 ; andps 0x3b25(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6>
DB 15,92,195 ; subps %xmm3,%xmm0
DB 15,92,240 ; subps %xmm0,%xmm6
DB 15,89,206 ; mulps %xmm6,%xmm1
@@ -20978,15 +21016,15 @@ _sk_scale_1_float_sse2 LABEL PROC
PUBLIC _sk_scale_u8_sse2
_sk_scale_u8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,61 ; jne 2097 <_sk_scale_u8_sse2+0x47>
- DB 102,69,15,110,4,57 ; movd (%r9,%rdi,1),%xmm8
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,61 ; jne 20a2 <_sk_scale_u8_sse2+0x47>
+ DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8
DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 102,68,15,219,5,141,58,0,0 ; pand 0x3a8d(%rip),%xmm8 # 5b00 <_sk_callback_sse2+0x55a>
+ DB 102,68,15,219,5,178,58,0,0 ; pand 0x3ab2(%rip),%xmm8 # 5b30 <_sk_callback_sse2+0x556>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,145,58,0,0 ; mulps 0x3a91(%rip),%xmm8 # 5b10 <_sk_callback_sse2+0x56a>
+ DB 68,15,89,5,182,58,0,0 ; mulps 0x3ab6(%rip),%xmm8 # 5b40 <_sk_callback_sse2+0x566>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
@@ -20994,27 +21032,27 @@ _sk_scale_u8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,54 ; je 20df <_sk_scale_u8_sse2+0x8f>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,23 ; je 20c6 <_sk_scale_u8_sse2+0x76>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,181 ; jne 206a <_sk_scale_u8_sse2+0x1a>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,54 ; je 20ea <_sk_scale_u8_sse2+0x8f>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,23 ; je 20d1 <_sk_scale_u8_sse2+0x76>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,181 ; jne 2075 <_sk_scale_u8_sse2+0x1a>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,68,15,110,200 ; movd %eax,%xmm9
DB 69,15,198,200,0 ; shufps $0x0,%xmm8,%xmm9
DB 69,15,198,200,226 ; shufps $0xe2,%xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,68,15,110,200 ; movd %eax,%xmm9
DB 243,69,15,16,193 ; movss %xmm9,%xmm8
- DB 233,119,255,255,255 ; jmpq 206a <_sk_scale_u8_sse2+0x1a>
+ DB 233,119,255,255,255 ; jmpq 2075 <_sk_scale_u8_sse2+0x1a>
PUBLIC _sk_lerp_1_float_sse2
_sk_lerp_1_float_sse2 LABEL PROC
@@ -21039,15 +21077,15 @@ _sk_lerp_1_float_sse2 LABEL PROC
PUBLIC _sk_lerp_u8_sse2
_sk_lerp_u8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,81 ; jne 2186 <_sk_lerp_u8_sse2+0x5b>
- DB 102,69,15,110,4,57 ; movd (%r9,%rdi,1),%xmm8
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,81 ; jne 2191 <_sk_lerp_u8_sse2+0x5b>
+ DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8
DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 102,68,15,219,5,210,57,0,0 ; pand 0x39d2(%rip),%xmm8 # 5b20 <_sk_callback_sse2+0x57a>
+ DB 102,68,15,219,5,247,57,0,0 ; pand 0x39f7(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x576>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,214,57,0,0 ; mulps 0x39d6(%rip),%xmm8 # 5b30 <_sk_callback_sse2+0x58a>
+ DB 68,15,89,5,251,57,0,0 ; mulps 0x39fb(%rip),%xmm8 # 5b60 <_sk_callback_sse2+0x586>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -21062,47 +21100,47 @@ _sk_lerp_u8_sse2 LABEL PROC
DB 15,88,223 ; addps %xmm7,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,54 ; je 21ce <_sk_lerp_u8_sse2+0xa3>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,23 ; je 21b5 <_sk_lerp_u8_sse2+0x8a>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,161 ; jne 2145 <_sk_lerp_u8_sse2+0x1a>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,54 ; je 21d9 <_sk_lerp_u8_sse2+0xa3>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,23 ; je 21c0 <_sk_lerp_u8_sse2+0x8a>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,161 ; jne 2150 <_sk_lerp_u8_sse2+0x1a>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,68,15,110,200 ; movd %eax,%xmm9
DB 69,15,198,200,0 ; shufps $0x0,%xmm8,%xmm9
DB 69,15,198,200,226 ; shufps $0xe2,%xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,68,15,110,200 ; movd %eax,%xmm9
DB 243,69,15,16,193 ; movss %xmm9,%xmm8
- DB 233,99,255,255,255 ; jmpq 2145 <_sk_lerp_u8_sse2+0x1a>
+ DB 233,99,255,255,255 ; jmpq 2150 <_sk_lerp_u8_sse2+0x1a>
PUBLIC _sk_lerp_565_sse2
_sk_lerp_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,156,0,0,0 ; jne 228c <_sk_lerp_565_sse2+0xaa>
- DB 243,69,15,126,12,121 ; movq (%r9,%rdi,2),%xmm9
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,156,0,0,0 ; jne 2297 <_sk_lerp_565_sse2+0xaa>
+ DB 243,69,15,126,12,82 ; movq (%r10,%rdx,2),%xmm9
DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9
- DB 102,68,15,111,5,60,57,0,0 ; movdqa 0x393c(%rip),%xmm8 # 5b40 <_sk_callback_sse2+0x59a>
+ DB 102,68,15,111,5,97,57,0,0 ; movdqa 0x3961(%rip),%xmm8 # 5b70 <_sk_callback_sse2+0x596>
DB 102,69,15,219,193 ; pand %xmm9,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,59,57,0,0 ; mulps 0x393b(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x5aa>
- DB 102,68,15,111,21,66,57,0,0 ; movdqa 0x3942(%rip),%xmm10 # 5b60 <_sk_callback_sse2+0x5ba>
+ DB 68,15,89,5,96,57,0,0 ; mulps 0x3960(%rip),%xmm8 # 5b80 <_sk_callback_sse2+0x5a6>
+ DB 102,68,15,111,21,103,57,0,0 ; movdqa 0x3967(%rip),%xmm10 # 5b90 <_sk_callback_sse2+0x5b6>
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
- DB 68,15,89,21,65,57,0,0 ; mulps 0x3941(%rip),%xmm10 # 5b70 <_sk_callback_sse2+0x5ca>
- DB 102,68,15,219,13,72,57,0,0 ; pand 0x3948(%rip),%xmm9 # 5b80 <_sk_callback_sse2+0x5da>
+ DB 68,15,89,21,102,57,0,0 ; mulps 0x3966(%rip),%xmm10 # 5ba0 <_sk_callback_sse2+0x5c6>
+ DB 102,68,15,219,13,109,57,0,0 ; pand 0x396d(%rip),%xmm9 # 5bb0 <_sk_callback_sse2+0x5d6>
DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9
- DB 68,15,89,13,76,57,0,0 ; mulps 0x394c(%rip),%xmm9 # 5b90 <_sk_callback_sse2+0x5ea>
+ DB 68,15,89,13,113,57,0,0 ; mulps 0x3971(%rip),%xmm9 # 5bc0 <_sk_callback_sse2+0x5e6>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -21124,126 +21162,129 @@ _sk_lerp_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,216 ; movaps %xmm8,%xmm3
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,58 ; je 22d8 <_sk_lerp_565_sse2+0xf6>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,27 ; je 22bf <_sk_lerp_565_sse2+0xdd>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 15,133,77,255,255,255 ; jne 21fb <_sk_lerp_565_sse2+0x19>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,58 ; je 22e3 <_sk_lerp_565_sse2+0xf6>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,27 ; je 22ca <_sk_lerp_565_sse2+0xdd>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 15,133,77,255,255,255 ; jne 2206 <_sk_lerp_565_sse2+0x19>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 102,69,15,112,200,69 ; pshufd $0x45,%xmm8,%xmm9
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 69,15,198,193,0 ; shufps $0x0,%xmm9,%xmm8
DB 69,15,198,193,226 ; shufps $0xe2,%xmm9,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
DB 243,69,15,16,200 ; movss %xmm8,%xmm9
- DB 233,15,255,255,255 ; jmpq 21fb <_sk_lerp_565_sse2+0x19>
+ DB 233,15,255,255,255 ; jmpq 2206 <_sk_lerp_565_sse2+0x19>
PUBLIC _sk_load_tables_sse2
_sk_load_tables_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,32,1,0,0 ; jne 241a <_sk_load_tables_sse2+0x12e>
- DB 243,69,15,111,12,184 ; movdqu (%r8,%rdi,4),%xmm9
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,36,1,0,0 ; jne 2429 <_sk_load_tables_sse2+0x132>
+ DB 243,69,15,111,12,145 ; movdqu (%r9,%rdx,4),%xmm9
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 102,68,15,111,5,148,56,0,0 ; movdqa 0x3894(%rip),%xmm8 # 5ba0 <_sk_callback_sse2+0x5fa>
+ DB 102,68,15,111,5,183,56,0,0 ; movdqa 0x38b7(%rip),%xmm8 # 5bd0 <_sk_callback_sse2+0x5f6>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
- DB 102,73,15,126,200 ; movq %xmm1,%r8
- DB 102,73,15,126,193 ; movq %xmm0,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 102,73,15,126,201 ; movq %xmm1,%r9
+ DB 102,73,15,126,194 ; movq %xmm0,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 69,15,182,241 ; movzbl %r9b,%r14d
DB 73,193,233,30 ; shr $0x1e,%r9
- DB 69,15,182,216 ; movzbl %r8b,%r11d
- DB 73,193,232,30 ; shr $0x1e,%r8
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,12,11 ; movss (%rbx,%r9,1),%xmm1
- DB 243,66,15,16,4,3 ; movss (%rbx,%r8,1),%xmm0
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,12,19 ; movss (%rbx,%r10,1),%xmm1
+ DB 243,66,15,16,4,11 ; movss (%rbx,%r9,1),%xmm0
DB 15,20,200 ; unpcklps %xmm0,%xmm1
- DB 243,66,15,16,4,147 ; movss (%rbx,%r10,4),%xmm0
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
+ DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
+ DB 243,66,15,16,20,179 ; movss (%rbx,%r14,4),%xmm2
DB 15,20,194 ; unpcklps %xmm2,%xmm0
DB 15,20,193 ; unpcklps %xmm1,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
DB 102,65,15,219,200 ; pand %xmm8,%xmm1
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
- DB 102,73,15,126,208 ; movq %xmm2,%r8
+ DB 102,73,15,126,209 ; movq %xmm2,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 68,15,182,203 ; movzbl %bl,%r9d
+ DB 68,15,182,211 ; movzbl %bl,%r10d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,15,182,208 ; movzbl %r8b,%r10d
- DB 73,193,232,30 ; shr $0x1e,%r8
- DB 243,65,15,16,20,30 ; movss (%r14,%rbx,1),%xmm2
- DB 243,67,15,16,12,6 ; movss (%r14,%r8,1),%xmm1
+ DB 69,15,182,217 ; movzbl %r9b,%r11d
+ DB 73,193,233,30 ; shr $0x1e,%r9
+ DB 243,65,15,16,20,31 ; movss (%r15,%rbx,1),%xmm2
+ DB 243,67,15,16,12,15 ; movss (%r15,%r9,1),%xmm1
DB 15,20,209 ; unpcklps %xmm1,%xmm2
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
- DB 243,67,15,16,28,150 ; movss (%r14,%r10,4),%xmm3
+ DB 243,67,15,16,12,151 ; movss (%r15,%r10,4),%xmm1
+ DB 243,67,15,16,28,159 ; movss (%r15,%r11,4),%xmm3
DB 15,20,203 ; unpcklps %xmm3,%xmm1
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 76,139,64,24 ; mov 0x18(%rax),%r8
+ DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 102,65,15,111,209 ; movdqa %xmm9,%xmm2
DB 102,15,114,210,16 ; psrld $0x10,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,112,218,78 ; pshufd $0x4e,%xmm2,%xmm3
DB 102,72,15,126,219 ; movq %xmm3,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 68,15,182,200 ; movzbl %al,%r9d
+ DB 68,15,182,208 ; movzbl %al,%r10d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 68,15,182,211 ; movzbl %bl,%r10d
+ DB 68,15,182,219 ; movzbl %bl,%r11d
DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 243,69,15,16,4,0 ; movss (%r8,%rax,1),%xmm8
- DB 243,65,15,16,20,24 ; movss (%r8,%rbx,1),%xmm2
+ DB 243,69,15,16,4,1 ; movss (%r9,%rax,1),%xmm8
+ DB 243,65,15,16,20,25 ; movss (%r9,%rbx,1),%xmm2
DB 68,15,20,194 ; unpcklps %xmm2,%xmm8
- DB 243,67,15,16,20,136 ; movss (%r8,%r9,4),%xmm2
- DB 243,67,15,16,28,144 ; movss (%r8,%r10,4),%xmm3
+ DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
+ DB 243,67,15,16,28,153 ; movss (%r9,%r11,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,208 ; unpcklps %xmm8,%xmm2
DB 102,65,15,114,209,24 ; psrld $0x18,%xmm9
DB 65,15,91,217 ; cvtdq2ps %xmm9,%xmm3
- DB 15,89,29,157,55,0,0 ; mulps 0x379d(%rip),%xmm3 # 5bb0 <_sk_callback_sse2+0x60a>
+ DB 15,89,29,192,55,0,0 ; mulps 0x37c0(%rip),%xmm3 # 5be0 <_sk_callback_sse2+0x606>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 65,137,201 ; mov %ecx,%r9d
- DB 65,128,225,3 ; and $0x3,%r9b
+ DB 69,137,194 ; mov %r8d,%r10d
+ DB 65,128,226,3 ; and $0x3,%r10b
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
- DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,50 ; je 245e <_sk_load_tables_sse2+0x172>
- DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,23 ; je 2449 <_sk_load_tables_sse2+0x15d>
- DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 15,133,196,254,255,255 ; jne 2300 <_sk_load_tables_sse2+0x14>
- DB 102,65,15,110,68,184,8 ; movd 0x8(%r8,%rdi,4),%xmm0
+ DB 65,128,250,1 ; cmp $0x1,%r10b
+ DB 116,50 ; je 246d <_sk_load_tables_sse2+0x176>
+ DB 65,128,250,2 ; cmp $0x2,%r10b
+ DB 116,23 ; je 2458 <_sk_load_tables_sse2+0x161>
+ DB 65,128,250,3 ; cmp $0x3,%r10b
+ DB 15,133,192,254,255,255 ; jne 230b <_sk_load_tables_sse2+0x14>
+ DB 102,65,15,110,68,145,8 ; movd 0x8(%r9,%rdx,4),%xmm0
DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9
- DB 243,65,15,16,68,184,4 ; movss 0x4(%r8,%rdi,4),%xmm0
+ DB 243,65,15,16,68,145,4 ; movss 0x4(%r9,%rdx,4),%xmm0
DB 65,15,198,193,0 ; shufps $0x0,%xmm9,%xmm0
DB 65,15,198,193,226 ; shufps $0xe2,%xmm9,%xmm0
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 243,65,15,16,4,184 ; movss (%r8,%rdi,4),%xmm0
+ DB 243,65,15,16,4,145 ; movss (%r9,%rdx,4),%xmm0
DB 243,68,15,16,200 ; movss %xmm0,%xmm9
- DB 233,146,254,255,255 ; jmpq 2300 <_sk_load_tables_sse2+0x14>
+ DB 233,142,254,255,255 ; jmpq 230b <_sk_load_tables_sse2+0x14>
PUBLIC _sk_load_tables_u16_be_sse2
_sk_load_tables_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,97,1,0,0 ; jne 25e5 <_sk_load_tables_u16_be_sse2+0x177>
- DB 102,67,15,16,4,72 ; movupd (%r8,%r9,2),%xmm0
- DB 102,67,15,16,76,72,16 ; movupd 0x10(%r8,%r9,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,101,1,0,0 ; jne 25f8 <_sk_load_tables_u16_be_sse2+0x17b>
+ DB 102,67,15,16,4,81 ; movupd (%r9,%r10,2),%xmm0
+ DB 102,67,15,16,76,81,16 ; movupd 0x10(%r9,%r10,2),%xmm1
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 102,68,15,40,200 ; movapd %xmm0,%xmm9
@@ -21252,25 +21293,25 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
- DB 102,68,15,111,21,7,55,0,0 ; movdqa 0x3707(%rip),%xmm10 # 5bc0 <_sk_callback_sse2+0x61a>
+ DB 102,68,15,111,21,38,55,0,0 ; movdqa 0x3726(%rip),%xmm10 # 5bf0 <_sk_callback_sse2+0x616>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,194 ; pand %xmm10,%xmm0
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
DB 102,65,15,97,192 ; punpcklwd %xmm8,%xmm0
DB 102,15,112,216,78 ; pshufd $0x4e,%xmm0,%xmm3
- DB 102,73,15,126,216 ; movq %xmm3,%r8
- DB 69,15,182,200 ; movzbl %r8b,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,15,182,218 ; movzbl %r10b,%r11d
- DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 102,73,15,126,217 ; movq %xmm3,%r9
+ DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 69,15,182,243 ; movzbl %r11b,%r14d
+ DB 73,193,235,30 ; shr $0x1e,%r11
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,28,19 ; movss (%rbx,%r10,1),%xmm3
- DB 243,66,15,16,4,131 ; movss (%rbx,%r8,4),%xmm0
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,28,27 ; movss (%rbx,%r11,1),%xmm3
+ DB 243,66,15,16,4,139 ; movss (%rbx,%r9,4),%xmm0
DB 15,20,216 ; unpcklps %xmm0,%xmm3
- DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
+ DB 243,66,15,16,4,179 ; movss (%rbx,%r14,4),%xmm0
+ DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
DB 15,20,194 ; unpcklps %xmm2,%xmm0
DB 15,20,195 ; unpcklps %xmm3,%xmm0
DB 102,15,115,217,8 ; psrldq $0x8,%xmm1
@@ -21278,33 +21319,33 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 102,65,15,97,200 ; punpcklwd %xmm8,%xmm1
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 68,15,182,195 ; movzbl %bl,%r8d
+ DB 68,15,182,203 ; movzbl %bl,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,73,15,126,201 ; movq %xmm1,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
- DB 73,193,233,30 ; shr $0x1e,%r9
- DB 243,67,15,16,20,14 ; movss (%r14,%r9,1),%xmm2
- DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 102,73,15,126,202 ; movq %xmm1,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 243,67,15,16,20,23 ; movss (%r15,%r10,1),%xmm2
+ DB 243,65,15,16,12,159 ; movss (%r15,%rbx,4),%xmm1
DB 15,20,209 ; unpcklps %xmm1,%xmm2
- DB 243,67,15,16,12,150 ; movss (%r14,%r10,4),%xmm1
- DB 243,67,15,16,28,134 ; movss (%r14,%r8,4),%xmm3
+ DB 243,67,15,16,12,159 ; movss (%r15,%r11,4),%xmm1
+ DB 243,67,15,16,28,143 ; movss (%r15,%r9,4),%xmm3
DB 15,20,203 ; unpcklps %xmm3,%xmm1
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 76,139,72,24 ; mov 0x18(%rax),%r9
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 102,69,15,97,208 ; punpcklwd %xmm8,%xmm10
DB 102,65,15,112,210,78 ; pshufd $0x4e,%xmm10,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 68,15,182,195 ; movzbl %bl,%r8d
+ DB 68,15,182,203 ; movzbl %bl,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
DB 102,76,15,126,208 ; movq %xmm10,%rax
- DB 68,15,182,208 ; movzbl %al,%r10d
+ DB 68,15,182,216 ; movzbl %al,%r11d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 243,69,15,16,20,1 ; movss (%r9,%rax,1),%xmm10
- DB 243,65,15,16,20,153 ; movss (%r9,%rbx,4),%xmm2
+ DB 243,69,15,16,20,2 ; movss (%r10,%rax,1),%xmm10
+ DB 243,65,15,16,20,154 ; movss (%r10,%rbx,4),%xmm2
DB 68,15,20,210 ; unpcklps %xmm2,%xmm10
- DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
- DB 243,67,15,16,28,129 ; movss (%r9,%r8,4),%xmm3
+ DB 243,67,15,16,20,154 ; movss (%r10,%r11,4),%xmm2
+ DB 243,67,15,16,28,138 ; movss (%r10,%r9,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,210 ; unpcklps %xmm10,%xmm2
DB 102,65,15,112,217,78 ; pshufd $0x4e,%xmm9,%xmm3
@@ -21314,202 +21355,206 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 102,65,15,235,217 ; por %xmm9,%xmm3
DB 102,65,15,97,216 ; punpcklwd %xmm8,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,242,53,0,0 ; mulps 0x35f2(%rip),%xmm3 # 5bd0 <_sk_callback_sse2+0x62a>
+ DB 15,89,29,17,54,0,0 ; mulps 0x3611(%rip),%xmm3 # 5c00 <_sk_callback_sse2+0x626>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 242,67,15,16,4,72 ; movsd (%r8,%r9,2),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,17 ; jne 2602 <_sk_load_tables_u16_be_sse2+0x194>
+ DB 242,67,15,16,4,81 ; movsd (%r9,%r10,2),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,17 ; jne 2615 <_sk_load_tables_u16_be_sse2+0x198>
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 233,143,254,255,255 ; jmpq 2491 <_sk_load_tables_u16_be_sse2+0x23>
- DB 102,67,15,22,68,72,8 ; movhpd 0x8(%r8,%r9,2),%xmm0
+ DB 233,139,254,255,255 ; jmpq 24a0 <_sk_load_tables_u16_be_sse2+0x23>
+ DB 102,67,15,22,68,81,8 ; movhpd 0x8(%r9,%r10,2),%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,122,254,255,255 ; jb 2491 <_sk_load_tables_u16_be_sse2+0x23>
- DB 242,67,15,16,76,72,16 ; movsd 0x10(%r8,%r9,2),%xmm1
- DB 233,110,254,255,255 ; jmpq 2491 <_sk_load_tables_u16_be_sse2+0x23>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,118,254,255,255 ; jb 24a0 <_sk_load_tables_u16_be_sse2+0x23>
+ DB 242,67,15,16,76,81,16 ; movsd 0x10(%r9,%r10,2),%xmm1
+ DB 233,106,254,255,255 ; jmpq 24a0 <_sk_load_tables_u16_be_sse2+0x23>
PUBLIC _sk_load_tables_rgb_u16_be_sse2
_sk_load_tables_rgb_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 76,141,12,127 ; lea (%rdi,%rdi,2),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,80,1,0,0 ; jne 2785 <_sk_load_tables_rgb_u16_be_sse2+0x162>
- DB 243,71,15,111,28,72 ; movdqu (%r8,%r9,2),%xmm11
- DB 243,67,15,111,76,72,8 ; movdqu 0x8(%r8,%r9,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,84,1,0,0 ; jne 279c <_sk_load_tables_rgb_u16_be_sse2+0x166>
+ DB 243,71,15,111,28,81 ; movdqu (%r9,%r10,2),%xmm11
+ DB 243,67,15,111,76,81,8 ; movdqu 0x8(%r9,%r10,2),%xmm1
DB 102,15,115,217,4 ; psrldq $0x4,%xmm1
DB 102,69,15,111,211 ; movdqa %xmm11,%xmm10
DB 102,65,15,115,218,6 ; psrldq $0x6,%xmm10
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,115,216,6 ; psrldq $0x6,%xmm0
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 102,68,15,97,217 ; punpcklwd %xmm1,%xmm11
DB 102,68,15,97,208 ; punpcklwd %xmm0,%xmm10
DB 102,65,15,111,195 ; movdqa %xmm11,%xmm0
DB 102,65,15,97,194 ; punpcklwd %xmm10,%xmm0
- DB 102,68,15,111,5,101,53,0,0 ; movdqa 0x3565(%rip),%xmm8 # 5be0 <_sk_callback_sse2+0x63a>
+ DB 102,68,15,111,5,128,53,0,0 ; movdqa 0x3580(%rip),%xmm8 # 5c10 <_sk_callback_sse2+0x636>
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0
DB 102,15,112,216,78 ; pshufd $0x4e,%xmm0,%xmm3
- DB 102,73,15,126,216 ; movq %xmm3,%r8
- DB 69,15,182,200 ; movzbl %r8b,%r9d
- DB 73,193,232,32 ; shr $0x20,%r8
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,15,182,218 ; movzbl %r10b,%r11d
- DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 102,73,15,126,217 ; movq %xmm3,%r9
+ DB 69,15,182,209 ; movzbl %r9b,%r10d
+ DB 73,193,233,32 ; shr $0x20,%r9
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 69,15,182,243 ; movzbl %r11b,%r14d
+ DB 73,193,235,30 ; shr $0x1e,%r11
DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,28,19 ; movss (%rbx,%r10,1),%xmm3
- DB 243,66,15,16,4,131 ; movss (%rbx,%r8,4),%xmm0
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,66,15,16,28,27 ; movss (%rbx,%r11,1),%xmm3
+ DB 243,66,15,16,4,139 ; movss (%rbx,%r9,4),%xmm0
DB 15,20,216 ; unpcklps %xmm0,%xmm3
- DB 243,66,15,16,4,155 ; movss (%rbx,%r11,4),%xmm0
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
+ DB 243,66,15,16,4,179 ; movss (%rbx,%r14,4),%xmm0
+ DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
DB 15,20,194 ; unpcklps %xmm2,%xmm0
DB 15,20,195 ; unpcklps %xmm3,%xmm0
DB 102,65,15,219,200 ; pand %xmm8,%xmm1
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 68,15,182,195 ; movzbl %bl,%r8d
+ DB 68,15,182,203 ; movzbl %bl,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,73,15,126,201 ; movq %xmm1,%r9
- DB 69,15,182,209 ; movzbl %r9b,%r10d
- DB 73,193,233,30 ; shr $0x1e,%r9
- DB 243,67,15,16,20,14 ; movss (%r14,%r9,1),%xmm2
- DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 102,73,15,126,202 ; movq %xmm1,%r10
+ DB 69,15,182,218 ; movzbl %r10b,%r11d
+ DB 73,193,234,30 ; shr $0x1e,%r10
+ DB 243,67,15,16,20,23 ; movss (%r15,%r10,1),%xmm2
+ DB 243,65,15,16,12,159 ; movss (%r15,%rbx,4),%xmm1
DB 15,20,209 ; unpcklps %xmm1,%xmm2
- DB 243,67,15,16,12,150 ; movss (%r14,%r10,4),%xmm1
- DB 243,67,15,16,28,134 ; movss (%r14,%r8,4),%xmm3
+ DB 243,67,15,16,12,159 ; movss (%r15,%r11,4),%xmm1
+ DB 243,67,15,16,28,143 ; movss (%r15,%r9,4),%xmm3
DB 15,20,203 ; unpcklps %xmm3,%xmm1
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 76,139,72,24 ; mov 0x18(%rax),%r9
+ DB 76,139,80,24 ; mov 0x18(%rax),%r10
DB 102,69,15,105,218 ; punpckhwd %xmm10,%xmm11
DB 102,69,15,219,216 ; pand %xmm8,%xmm11
DB 102,69,15,97,217 ; punpcklwd %xmm9,%xmm11
DB 102,65,15,112,211,78 ; pshufd $0x4e,%xmm11,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 68,15,182,195 ; movzbl %bl,%r8d
+ DB 68,15,182,203 ; movzbl %bl,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
DB 102,76,15,126,216 ; movq %xmm11,%rax
- DB 68,15,182,208 ; movzbl %al,%r10d
+ DB 68,15,182,216 ; movzbl %al,%r11d
DB 72,193,232,30 ; shr $0x1e,%rax
- DB 243,69,15,16,4,1 ; movss (%r9,%rax,1),%xmm8
- DB 243,65,15,16,20,153 ; movss (%r9,%rbx,4),%xmm2
+ DB 243,69,15,16,4,2 ; movss (%r10,%rax,1),%xmm8
+ DB 243,65,15,16,20,154 ; movss (%r10,%rbx,4),%xmm2
DB 68,15,20,194 ; unpcklps %xmm2,%xmm8
- DB 243,67,15,16,20,145 ; movss (%r9,%r10,4),%xmm2
- DB 243,67,15,16,28,129 ; movss (%r9,%r8,4),%xmm3
+ DB 243,67,15,16,20,154 ; movss (%r10,%r11,4),%xmm2
+ DB 243,67,15,16,28,138 ; movss (%r10,%r9,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,208 ; unpcklps %xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,112,52,0,0 ; movaps 0x3470(%rip),%xmm3 # 5bf0 <_sk_callback_sse2+0x64a>
+ DB 15,40,29,139,52,0,0 ; movaps 0x348b(%rip),%xmm3 # 5c20 <_sk_callback_sse2+0x646>
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
- DB 102,71,15,110,28,72 ; movd (%r8,%r9,2),%xmm11
- DB 102,71,15,196,92,72,4,2 ; pinsrw $0x2,0x4(%r8,%r9,2),%xmm11
+ DB 102,71,15,110,28,81 ; movd (%r9,%r10,2),%xmm11
+ DB 102,71,15,196,92,81,4,2 ; pinsrw $0x2,0x4(%r9,%r10,2),%xmm11
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,14 ; jne 27ab <_sk_load_tables_rgb_u16_be_sse2+0x188>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,14 ; jne 27c2 <_sk_load_tables_rgb_u16_be_sse2+0x18c>
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
- DB 233,176,254,255,255 ; jmpq 265b <_sk_load_tables_rgb_u16_be_sse2+0x38>
- DB 102,71,15,110,84,72,6 ; movd 0x6(%r8,%r9,2),%xmm10
- DB 102,71,15,196,84,72,10,2 ; pinsrw $0x2,0xa(%r8,%r9,2),%xmm10
+ DB 233,172,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ DB 102,71,15,110,84,81,6 ; movd 0x6(%r9,%r10,2),%xmm10
+ DB 102,71,15,196,84,81,10,2 ; pinsrw $0x2,0xa(%r9,%r10,2),%xmm10
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,24 ; jb 27dc <_sk_load_tables_rgb_u16_be_sse2+0x1b9>
- DB 102,67,15,110,76,72,12 ; movd 0xc(%r8,%r9,2),%xmm1
- DB 102,67,15,196,76,72,16,2 ; pinsrw $0x2,0x10(%r8,%r9,2),%xmm1
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,24 ; jb 27f3 <_sk_load_tables_rgb_u16_be_sse2+0x1bd>
+ DB 102,67,15,110,76,81,12 ; movd 0xc(%r9,%r10,2),%xmm1
+ DB 102,67,15,196,76,81,16,2 ; pinsrw $0x2,0x10(%r9,%r10,2),%xmm1
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,127,254,255,255 ; jmpq 265b <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ DB 233,123,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38>
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,118,254,255,255 ; jmpq 265b <_sk_load_tables_rgb_u16_be_sse2+0x38>
+ DB 233,114,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38>
PUBLIC _sk_byte_tables_sse2
_sk_byte_tables_sse2 LABEL PROC
DB 85 ; push %rbp
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,13,52,0,0 ; movaps 0x340d(%rip),%xmm8 # 5c00 <_sk_callback_sse2+0x65a>
+ DB 68,15,40,5,36,52,0,0 ; movaps 0x3424(%rip),%xmm8 # 5c30 <_sk_callback_sse2+0x656>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
- DB 102,73,15,126,192 ; movq %xmm0,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 77,137,194 ; mov %r8,%r10
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 102,73,15,126,193 ; movq %xmm0,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 77,137,203 ; mov %r9,%r11
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,73,15,126,192 ; movq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,198 ; mov %r8,%r14
- DB 73,193,238,32 ; shr $0x20,%r14
+ DB 102,73,15,126,193 ; movq %xmm0,%r9
+ DB 69,137,206 ; mov %r9d,%r14d
+ DB 77,137,207 ; mov %r9,%r15
+ DB 73,193,239,32 ; shr $0x20,%r15
DB 72,139,24 ; mov (%rax),%rbx
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 70,15,182,28,27 ; movzbl (%rbx,%r11,1),%r11d
- DB 66,15,182,44,51 ; movzbl (%rbx,%r14,1),%ebp
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 70,15,182,52,51 ; movzbl (%rbx,%r14,1),%r14d
+ DB 66,15,182,44,59 ; movzbl (%rbx,%r15,1),%ebp
DB 193,229,8 ; shl $0x8,%ebp
- DB 68,9,221 ; or %r11d,%ebp
- DB 70,15,182,12,11 ; movzbl (%rbx,%r9,1),%r9d
- DB 66,15,182,28,19 ; movzbl (%rbx,%r10,1),%ebx
+ DB 68,9,245 ; or %r14d,%ebp
+ DB 70,15,182,20,19 ; movzbl (%rbx,%r10,1),%r10d
+ DB 66,15,182,28,27 ; movzbl (%rbx,%r11,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,203 ; or %r9d,%ebx
+ DB 68,9,211 ; or %r10d,%ebx
DB 102,15,196,195,0 ; pinsrw $0x0,%ebx,%xmm0
DB 102,15,196,197,1 ; pinsrw $0x1,%ebp,%xmm0
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0
DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,21,167,51,0,0 ; movaps 0x33a7(%rip),%xmm10 # 5c10 <_sk_callback_sse2+0x66a>
+ DB 68,15,40,21,190,51,0,0 ; movaps 0x33be(%rip),%xmm10 # 5c40 <_sk_callback_sse2+0x666>
DB 65,15,89,194 ; mulps %xmm10,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,72,15,126,205 ; movq %xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
+ DB 65,137,234 ; mov %ebp,%r10d
DB 72,193,237,32 ; shr $0x20,%rbp
DB 102,15,112,201,78 ; pshufd $0x4e,%xmm1,%xmm1
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
+ DB 65,137,219 ; mov %ebx,%r11d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 71,15,182,20,16 ; movzbl (%r8,%r10,1),%r10d
- DB 65,15,182,28,24 ; movzbl (%r8,%rbx,1),%ebx
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 65,15,182,28,25 ; movzbl (%r9,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,211 ; or %r10d,%ebx
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
+ DB 68,9,219 ; or %r11d,%ebx
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
DB 193,229,8 ; shl $0x8,%ebp
- DB 68,9,205 ; or %r9d,%ebp
+ DB 68,9,213 ; or %r10d,%ebp
DB 102,15,196,205,0 ; pinsrw $0x0,%ebp,%xmm1
DB 102,15,196,203,1 ; pinsrw $0x1,%ebx,%xmm1
DB 102,65,15,96,201 ; punpcklbw %xmm9,%xmm1
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,202 ; mulps %xmm10,%xmm1
- DB 76,139,72,16 ; mov 0x10(%rax),%r9
+ DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,91,210 ; cvtps2dq %xmm2,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 65,137,216 ; mov %ebx,%r8d
+ DB 65,137,217 ; mov %ebx,%r9d
DB 72,193,235,32 ; shr $0x20,%rbx
DB 102,15,112,210,78 ; pshufd $0x4e,%xmm2,%xmm2
DB 102,72,15,126,213 ; movq %xmm2,%rbp
- DB 65,137,234 ; mov %ebp,%r10d
+ DB 65,137,235 ; mov %ebp,%r11d
DB 72,193,237,32 ; shr $0x20,%rbp
- DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
- DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
+ DB 71,15,182,28,26 ; movzbl (%r10,%r11,1),%r11d
+ DB 65,15,182,44,42 ; movzbl (%r10,%rbp,1),%ebp
DB 193,229,8 ; shl $0x8,%ebp
- DB 68,9,213 ; or %r10d,%ebp
- DB 71,15,182,4,1 ; movzbl (%r9,%r8,1),%r8d
- DB 65,15,182,28,25 ; movzbl (%r9,%rbx,1),%ebx
+ DB 68,9,221 ; or %r11d,%ebp
+ DB 71,15,182,12,10 ; movzbl (%r10,%r9,1),%r9d
+ DB 65,15,182,28,26 ; movzbl (%r10,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,195 ; or %r8d,%ebx
+ DB 68,9,203 ; or %r9d,%ebx
DB 102,15,196,211,0 ; pinsrw $0x0,%ebx,%xmm2
DB 102,15,196,213,1 ; pinsrw $0x1,%ebp,%xmm2
DB 102,65,15,96,209 ; punpcklbw %xmm9,%xmm2
@@ -21520,20 +21565,20 @@ _sk_byte_tables_sse2 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 102,15,91,219 ; cvtps2dq %xmm3,%xmm3
DB 102,72,15,126,221 ; movq %xmm3,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
+ DB 65,137,233 ; mov %ebp,%r9d
DB 72,193,237,32 ; shr $0x20,%rbp
DB 102,15,112,219,78 ; pshufd $0x4e,%xmm3,%xmm3
DB 102,72,15,126,219 ; movq %xmm3,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
+ DB 65,137,218 ; mov %ebx,%r10d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 70,15,182,12,8 ; movzbl (%rax,%r9,1),%r9d
+ DB 70,15,182,20,16 ; movzbl (%rax,%r10,1),%r10d
DB 15,182,28,24 ; movzbl (%rax,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,203 ; or %r9d,%ebx
- DB 70,15,182,4,0 ; movzbl (%rax,%r8,1),%r8d
+ DB 68,9,211 ; or %r10d,%ebx
+ DB 70,15,182,12,8 ; movzbl (%rax,%r9,1),%r9d
DB 15,182,4,40 ; movzbl (%rax,%rbp,1),%eax
DB 193,224,8 ; shl $0x8,%eax
- DB 68,9,192 ; or %r8d,%eax
+ DB 68,9,200 ; or %r9d,%eax
DB 102,15,196,216,0 ; pinsrw $0x0,%eax,%xmm3
DB 102,15,196,219,1 ; pinsrw $0x1,%ebx,%xmm3
DB 102,65,15,96,217 ; punpcklbw %xmm9,%xmm3
@@ -21543,66 +21588,68 @@ _sk_byte_tables_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_byte_tables_rgb_sse2
_sk_byte_tables_rgb_sse2 LABEL PROC
DB 85 ; push %rbp
+ DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,139,64,24 ; mov 0x18(%rax),%r8d
- DB 65,255,200 ; dec %r8d
- DB 102,69,15,110,192 ; movd %r8d,%xmm8
+ DB 68,139,72,24 ; mov 0x18(%rax),%r9d
+ DB 65,255,201 ; dec %r9d
+ DB 102,69,15,110,193 ; movd %r9d,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
- DB 102,73,15,126,192 ; movq %xmm0,%r8
- DB 69,137,193 ; mov %r8d,%r9d
- DB 77,137,194 ; mov %r8,%r10
- DB 73,193,234,32 ; shr $0x20,%r10
+ DB 102,73,15,126,193 ; movq %xmm0,%r9
+ DB 69,137,202 ; mov %r9d,%r10d
+ DB 77,137,203 ; mov %r9,%r11
+ DB 73,193,235,32 ; shr $0x20,%r11
DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,73,15,126,192 ; movq %xmm0,%r8
- DB 69,137,195 ; mov %r8d,%r11d
- DB 77,137,198 ; mov %r8,%r14
- DB 73,193,238,32 ; shr $0x20,%r14
+ DB 102,73,15,126,193 ; movq %xmm0,%r9
+ DB 69,137,206 ; mov %r9d,%r14d
+ DB 77,137,207 ; mov %r9,%r15
+ DB 73,193,239,32 ; shr $0x20,%r15
DB 72,139,24 ; mov (%rax),%rbx
- DB 76,139,64,8 ; mov 0x8(%rax),%r8
- DB 70,15,182,28,27 ; movzbl (%rbx,%r11,1),%r11d
- DB 66,15,182,44,51 ; movzbl (%rbx,%r14,1),%ebp
+ DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 70,15,182,52,51 ; movzbl (%rbx,%r14,1),%r14d
+ DB 66,15,182,44,59 ; movzbl (%rbx,%r15,1),%ebp
DB 193,229,8 ; shl $0x8,%ebp
- DB 68,9,221 ; or %r11d,%ebp
- DB 70,15,182,12,11 ; movzbl (%rbx,%r9,1),%r9d
- DB 66,15,182,28,19 ; movzbl (%rbx,%r10,1),%ebx
+ DB 68,9,245 ; or %r14d,%ebp
+ DB 70,15,182,20,19 ; movzbl (%rbx,%r10,1),%r10d
+ DB 66,15,182,28,27 ; movzbl (%rbx,%r11,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,203 ; or %r9d,%ebx
+ DB 68,9,211 ; or %r10d,%ebx
DB 102,15,196,195,0 ; pinsrw $0x0,%ebx,%xmm0
DB 102,15,196,197,1 ; pinsrw $0x1,%ebp,%xmm0
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0
DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,21,243,49,0,0 ; movaps 0x31f3(%rip),%xmm10 # 5c20 <_sk_callback_sse2+0x67a>
+ DB 68,15,40,21,6,50,0,0 ; movaps 0x3206(%rip),%xmm10 # 5c50 <_sk_callback_sse2+0x676>
DB 65,15,89,194 ; mulps %xmm10,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,72,15,126,205 ; movq %xmm1,%rbp
- DB 65,137,233 ; mov %ebp,%r9d
+ DB 65,137,234 ; mov %ebp,%r10d
DB 72,193,237,32 ; shr $0x20,%rbp
DB 102,15,112,201,78 ; pshufd $0x4e,%xmm1,%xmm1
DB 102,72,15,126,203 ; movq %xmm1,%rbx
- DB 65,137,218 ; mov %ebx,%r10d
+ DB 65,137,219 ; mov %ebx,%r11d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 71,15,182,20,16 ; movzbl (%r8,%r10,1),%r10d
- DB 65,15,182,28,24 ; movzbl (%r8,%rbx,1),%ebx
+ DB 71,15,182,28,25 ; movzbl (%r9,%r11,1),%r11d
+ DB 65,15,182,28,25 ; movzbl (%r9,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,211 ; or %r10d,%ebx
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 65,15,182,44,40 ; movzbl (%r8,%rbp,1),%ebp
+ DB 68,9,219 ; or %r11d,%ebx
+ DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d
+ DB 65,15,182,44,41 ; movzbl (%r9,%rbp,1),%ebp
DB 193,229,8 ; shl $0x8,%ebp
- DB 68,9,205 ; or %r9d,%ebp
+ DB 68,9,213 ; or %r10d,%ebp
DB 102,15,196,205,0 ; pinsrw $0x0,%ebp,%xmm1
DB 102,15,196,203,1 ; pinsrw $0x1,%ebx,%xmm1
DB 102,65,15,96,201 ; punpcklbw %xmm9,%xmm1
@@ -21613,20 +21660,20 @@ _sk_byte_tables_rgb_sse2 LABEL PROC
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,91,210 ; cvtps2dq %xmm2,%xmm2
DB 102,72,15,126,213 ; movq %xmm2,%rbp
- DB 65,137,232 ; mov %ebp,%r8d
+ DB 65,137,233 ; mov %ebp,%r9d
DB 72,193,237,32 ; shr $0x20,%rbp
DB 102,15,112,210,78 ; pshufd $0x4e,%xmm2,%xmm2
DB 102,72,15,126,211 ; movq %xmm2,%rbx
- DB 65,137,217 ; mov %ebx,%r9d
+ DB 65,137,218 ; mov %ebx,%r10d
DB 72,193,235,32 ; shr $0x20,%rbx
- DB 70,15,182,12,8 ; movzbl (%rax,%r9,1),%r9d
+ DB 70,15,182,20,16 ; movzbl (%rax,%r10,1),%r10d
DB 15,182,28,24 ; movzbl (%rax,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
- DB 68,9,203 ; or %r9d,%ebx
- DB 70,15,182,4,0 ; movzbl (%rax,%r8,1),%r8d
+ DB 68,9,211 ; or %r10d,%ebx
+ DB 70,15,182,12,8 ; movzbl (%rax,%r9,1),%r9d
DB 15,182,4,40 ; movzbl (%rax,%rbp,1),%eax
DB 193,224,8 ; shl $0x8,%eax
- DB 68,9,192 ; or %r8d,%eax
+ DB 68,9,200 ; or %r9d,%eax
DB 102,15,196,208,0 ; pinsrw $0x0,%eax,%xmm2
DB 102,15,196,211,1 ; pinsrw $0x1,%ebx,%xmm2
DB 102,65,15,96,209 ; punpcklbw %xmm9,%xmm2
@@ -21636,13 +21683,15 @@ _sk_byte_tables_rgb_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_r_sse2
_sk_table_r_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -21652,25 +21701,27 @@ _sk_table_r_sse2 LABEL PROC
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,112,192,78 ; pshufd $0x4e,%xmm8,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,77,15,126,194 ; movq %xmm8,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,71,15,16,4,144 ; movss (%r8,%r10,4),%xmm8
- DB 243,65,15,16,4,128 ; movss (%r8,%rax,4),%xmm0
+ DB 102,77,15,126,195 ; movq %xmm8,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,71,15,16,4,153 ; movss (%r9,%r11,4),%xmm8
+ DB 243,65,15,16,4,129 ; movss (%r9,%rax,4),%xmm0
DB 68,15,20,192 ; unpcklps %xmm0,%xmm8
- DB 243,67,15,16,4,152 ; movss (%r8,%r11,4),%xmm0
- DB 243,71,15,16,12,136 ; movss (%r8,%r9,4),%xmm9
+ DB 243,65,15,16,4,153 ; movss (%r9,%rbx,4),%xmm0
+ DB 243,71,15,16,12,145 ; movss (%r9,%r10,4),%xmm9
DB 65,15,20,193 ; unpcklps %xmm9,%xmm0
DB 65,15,20,192 ; unpcklps %xmm8,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_g_sse2
_sk_table_g_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -21680,25 +21731,27 @@ _sk_table_g_sse2 LABEL PROC
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,77,15,126,194 ; movq %xmm8,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,71,15,16,4,144 ; movss (%r8,%r10,4),%xmm8
- DB 243,65,15,16,12,128 ; movss (%r8,%rax,4),%xmm1
+ DB 102,77,15,126,195 ; movq %xmm8,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,71,15,16,4,153 ; movss (%r9,%r11,4),%xmm8
+ DB 243,65,15,16,12,129 ; movss (%r9,%rax,4),%xmm1
DB 68,15,20,193 ; unpcklps %xmm1,%xmm8
- DB 243,67,15,16,12,152 ; movss (%r8,%r11,4),%xmm1
- DB 243,71,15,16,12,136 ; movss (%r8,%r9,4),%xmm9
+ DB 243,65,15,16,12,153 ; movss (%r9,%rbx,4),%xmm1
+ DB 243,71,15,16,12,145 ; movss (%r9,%r10,4),%xmm9
DB 65,15,20,201 ; unpcklps %xmm9,%xmm1
DB 65,15,20,200 ; unpcklps %xmm8,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_b_sse2
_sk_table_b_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -21708,25 +21761,27 @@ _sk_table_b_sse2 LABEL PROC
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,112,208,78 ; pshufd $0x4e,%xmm8,%xmm2
DB 102,72,15,126,208 ; movq %xmm2,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,77,15,126,194 ; movq %xmm8,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,71,15,16,4,144 ; movss (%r8,%r10,4),%xmm8
- DB 243,65,15,16,20,128 ; movss (%r8,%rax,4),%xmm2
+ DB 102,77,15,126,195 ; movq %xmm8,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,71,15,16,4,153 ; movss (%r9,%r11,4),%xmm8
+ DB 243,65,15,16,20,129 ; movss (%r9,%rax,4),%xmm2
DB 68,15,20,194 ; unpcklps %xmm2,%xmm8
- DB 243,67,15,16,20,152 ; movss (%r8,%r11,4),%xmm2
- DB 243,71,15,16,12,136 ; movss (%r8,%r9,4),%xmm9
+ DB 243,65,15,16,20,153 ; movss (%r9,%rbx,4),%xmm2
+ DB 243,71,15,16,12,145 ; movss (%r9,%r10,4),%xmm9
DB 65,15,20,209 ; unpcklps %xmm9,%xmm2
DB 65,15,20,208 ; unpcklps %xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_table_a_sse2
_sk_table_a_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 139,64,8 ; mov 0x8(%rax),%eax
DB 255,200 ; dec %eax
DB 102,68,15,110,192 ; movd %eax,%xmm8
@@ -21736,19 +21791,20 @@ _sk_table_a_sse2 LABEL PROC
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,112,216,78 ; pshufd $0x4e,%xmm8,%xmm3
DB 102,72,15,126,216 ; movq %xmm3,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,77,15,126,194 ; movq %xmm8,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,71,15,16,4,144 ; movss (%r8,%r10,4),%xmm8
- DB 243,65,15,16,28,128 ; movss (%r8,%rax,4),%xmm3
+ DB 102,77,15,126,195 ; movq %xmm8,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,71,15,16,4,153 ; movss (%r9,%r11,4),%xmm8
+ DB 243,65,15,16,28,129 ; movss (%r9,%rax,4),%xmm3
DB 68,15,20,195 ; unpcklps %xmm3,%xmm8
- DB 243,67,15,16,28,152 ; movss (%r8,%r11,4),%xmm3
- DB 243,71,15,16,12,136 ; movss (%r8,%r9,4),%xmm9
+ DB 243,65,15,16,28,153 ; movss (%r9,%rbx,4),%xmm3
+ DB 243,71,15,16,12,145 ; movss (%r9,%r10,4),%xmm9
DB 65,15,20,217 ; unpcklps %xmm9,%xmm3
DB 65,15,20,216 ; unpcklps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_parametric_r_sse2
@@ -21772,15 +21828,15 @@ _sk_parametric_r_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,49,47,0,0 ; mulps 0x2f31(%rip),%xmm9 # 5c30 <_sk_callback_sse2+0x68a>
- DB 68,15,84,21,57,47,0,0 ; andps 0x2f39(%rip),%xmm10 # 5c40 <_sk_callback_sse2+0x69a>
- DB 68,15,86,21,65,47,0,0 ; orps 0x2f41(%rip),%xmm10 # 5c50 <_sk_callback_sse2+0x6aa>
- DB 68,15,88,13,73,47,0,0 ; addps 0x2f49(%rip),%xmm9 # 5c60 <_sk_callback_sse2+0x6ba>
- DB 68,15,40,37,81,47,0,0 ; movaps 0x2f51(%rip),%xmm12 # 5c70 <_sk_callback_sse2+0x6ca>
+ DB 68,15,89,13,58,47,0,0 ; mulps 0x2f3a(%rip),%xmm9 # 5c60 <_sk_callback_sse2+0x686>
+ DB 68,15,84,21,66,47,0,0 ; andps 0x2f42(%rip),%xmm10 # 5c70 <_sk_callback_sse2+0x696>
+ DB 68,15,86,21,74,47,0,0 ; orps 0x2f4a(%rip),%xmm10 # 5c80 <_sk_callback_sse2+0x6a6>
+ DB 68,15,88,13,82,47,0,0 ; addps 0x2f52(%rip),%xmm9 # 5c90 <_sk_callback_sse2+0x6b6>
+ DB 68,15,40,37,90,47,0,0 ; movaps 0x2f5a(%rip),%xmm12 # 5ca0 <_sk_callback_sse2+0x6c6>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,81,47,0,0 ; addps 0x2f51(%rip),%xmm10 # 5c80 <_sk_callback_sse2+0x6da>
- DB 68,15,40,37,89,47,0,0 ; movaps 0x2f59(%rip),%xmm12 # 5c90 <_sk_callback_sse2+0x6ea>
+ DB 68,15,88,21,90,47,0,0 ; addps 0x2f5a(%rip),%xmm10 # 5cb0 <_sk_callback_sse2+0x6d6>
+ DB 68,15,40,37,98,47,0,0 ; movaps 0x2f62(%rip),%xmm12 # 5cc0 <_sk_callback_sse2+0x6e6>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -21788,22 +21844,22 @@ _sk_parametric_r_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,67,47,0,0 ; movaps 0x2f43(%rip),%xmm10 # 5ca0 <_sk_callback_sse2+0x6fa>
+ DB 68,15,40,21,76,47,0,0 ; movaps 0x2f4c(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x6f6>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,55,47,0,0 ; addps 0x2f37(%rip),%xmm9 # 5cb0 <_sk_callback_sse2+0x70a>
- DB 68,15,40,37,63,47,0,0 ; movaps 0x2f3f(%rip),%xmm12 # 5cc0 <_sk_callback_sse2+0x71a>
+ DB 68,15,88,13,64,47,0,0 ; addps 0x2f40(%rip),%xmm9 # 5ce0 <_sk_callback_sse2+0x706>
+ DB 68,15,40,37,72,47,0,0 ; movaps 0x2f48(%rip),%xmm12 # 5cf0 <_sk_callback_sse2+0x716>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,63,47,0,0 ; movaps 0x2f3f(%rip),%xmm12 # 5cd0 <_sk_callback_sse2+0x72a>
+ DB 68,15,40,37,72,47,0,0 ; movaps 0x2f48(%rip),%xmm12 # 5d00 <_sk_callback_sse2+0x726>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,67,47,0,0 ; movaps 0x2f43(%rip),%xmm13 # 5ce0 <_sk_callback_sse2+0x73a>
+ DB 68,15,40,45,76,47,0,0 ; movaps 0x2f4c(%rip),%xmm13 # 5d10 <_sk_callback_sse2+0x736>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,67,47,0,0 ; mulps 0x2f43(%rip),%xmm13 # 5cf0 <_sk_callback_sse2+0x74a>
+ DB 68,15,89,45,76,47,0,0 ; mulps 0x2f4c(%rip),%xmm13 # 5d20 <_sk_callback_sse2+0x746>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -21837,15 +21893,15 @@ _sk_parametric_g_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,195,46,0,0 ; mulps 0x2ec3(%rip),%xmm9 # 5d00 <_sk_callback_sse2+0x75a>
- DB 68,15,84,21,203,46,0,0 ; andps 0x2ecb(%rip),%xmm10 # 5d10 <_sk_callback_sse2+0x76a>
- DB 68,15,86,21,211,46,0,0 ; orps 0x2ed3(%rip),%xmm10 # 5d20 <_sk_callback_sse2+0x77a>
- DB 68,15,88,13,219,46,0,0 ; addps 0x2edb(%rip),%xmm9 # 5d30 <_sk_callback_sse2+0x78a>
- DB 68,15,40,37,227,46,0,0 ; movaps 0x2ee3(%rip),%xmm12 # 5d40 <_sk_callback_sse2+0x79a>
+ DB 68,15,89,13,204,46,0,0 ; mulps 0x2ecc(%rip),%xmm9 # 5d30 <_sk_callback_sse2+0x756>
+ DB 68,15,84,21,212,46,0,0 ; andps 0x2ed4(%rip),%xmm10 # 5d40 <_sk_callback_sse2+0x766>
+ DB 68,15,86,21,220,46,0,0 ; orps 0x2edc(%rip),%xmm10 # 5d50 <_sk_callback_sse2+0x776>
+ DB 68,15,88,13,228,46,0,0 ; addps 0x2ee4(%rip),%xmm9 # 5d60 <_sk_callback_sse2+0x786>
+ DB 68,15,40,37,236,46,0,0 ; movaps 0x2eec(%rip),%xmm12 # 5d70 <_sk_callback_sse2+0x796>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,227,46,0,0 ; addps 0x2ee3(%rip),%xmm10 # 5d50 <_sk_callback_sse2+0x7aa>
- DB 68,15,40,37,235,46,0,0 ; movaps 0x2eeb(%rip),%xmm12 # 5d60 <_sk_callback_sse2+0x7ba>
+ DB 68,15,88,21,236,46,0,0 ; addps 0x2eec(%rip),%xmm10 # 5d80 <_sk_callback_sse2+0x7a6>
+ DB 68,15,40,37,244,46,0,0 ; movaps 0x2ef4(%rip),%xmm12 # 5d90 <_sk_callback_sse2+0x7b6>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -21853,22 +21909,22 @@ _sk_parametric_g_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,213,46,0,0 ; movaps 0x2ed5(%rip),%xmm10 # 5d70 <_sk_callback_sse2+0x7ca>
+ DB 68,15,40,21,222,46,0,0 ; movaps 0x2ede(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x7c6>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,201,46,0,0 ; addps 0x2ec9(%rip),%xmm9 # 5d80 <_sk_callback_sse2+0x7da>
- DB 68,15,40,37,209,46,0,0 ; movaps 0x2ed1(%rip),%xmm12 # 5d90 <_sk_callback_sse2+0x7ea>
+ DB 68,15,88,13,210,46,0,0 ; addps 0x2ed2(%rip),%xmm9 # 5db0 <_sk_callback_sse2+0x7d6>
+ DB 68,15,40,37,218,46,0,0 ; movaps 0x2eda(%rip),%xmm12 # 5dc0 <_sk_callback_sse2+0x7e6>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,209,46,0,0 ; movaps 0x2ed1(%rip),%xmm12 # 5da0 <_sk_callback_sse2+0x7fa>
+ DB 68,15,40,37,218,46,0,0 ; movaps 0x2eda(%rip),%xmm12 # 5dd0 <_sk_callback_sse2+0x7f6>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,213,46,0,0 ; movaps 0x2ed5(%rip),%xmm13 # 5db0 <_sk_callback_sse2+0x80a>
+ DB 68,15,40,45,222,46,0,0 ; movaps 0x2ede(%rip),%xmm13 # 5de0 <_sk_callback_sse2+0x806>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,213,46,0,0 ; mulps 0x2ed5(%rip),%xmm13 # 5dc0 <_sk_callback_sse2+0x81a>
+ DB 68,15,89,45,222,46,0,0 ; mulps 0x2ede(%rip),%xmm13 # 5df0 <_sk_callback_sse2+0x816>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -21902,15 +21958,15 @@ _sk_parametric_b_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,85,46,0,0 ; mulps 0x2e55(%rip),%xmm9 # 5dd0 <_sk_callback_sse2+0x82a>
- DB 68,15,84,21,93,46,0,0 ; andps 0x2e5d(%rip),%xmm10 # 5de0 <_sk_callback_sse2+0x83a>
- DB 68,15,86,21,101,46,0,0 ; orps 0x2e65(%rip),%xmm10 # 5df0 <_sk_callback_sse2+0x84a>
- DB 68,15,88,13,109,46,0,0 ; addps 0x2e6d(%rip),%xmm9 # 5e00 <_sk_callback_sse2+0x85a>
- DB 68,15,40,37,117,46,0,0 ; movaps 0x2e75(%rip),%xmm12 # 5e10 <_sk_callback_sse2+0x86a>
+ DB 68,15,89,13,94,46,0,0 ; mulps 0x2e5e(%rip),%xmm9 # 5e00 <_sk_callback_sse2+0x826>
+ DB 68,15,84,21,102,46,0,0 ; andps 0x2e66(%rip),%xmm10 # 5e10 <_sk_callback_sse2+0x836>
+ DB 68,15,86,21,110,46,0,0 ; orps 0x2e6e(%rip),%xmm10 # 5e20 <_sk_callback_sse2+0x846>
+ DB 68,15,88,13,118,46,0,0 ; addps 0x2e76(%rip),%xmm9 # 5e30 <_sk_callback_sse2+0x856>
+ DB 68,15,40,37,126,46,0,0 ; movaps 0x2e7e(%rip),%xmm12 # 5e40 <_sk_callback_sse2+0x866>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,117,46,0,0 ; addps 0x2e75(%rip),%xmm10 # 5e20 <_sk_callback_sse2+0x87a>
- DB 68,15,40,37,125,46,0,0 ; movaps 0x2e7d(%rip),%xmm12 # 5e30 <_sk_callback_sse2+0x88a>
+ DB 68,15,88,21,126,46,0,0 ; addps 0x2e7e(%rip),%xmm10 # 5e50 <_sk_callback_sse2+0x876>
+ DB 68,15,40,37,134,46,0,0 ; movaps 0x2e86(%rip),%xmm12 # 5e60 <_sk_callback_sse2+0x886>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -21918,22 +21974,22 @@ _sk_parametric_b_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,103,46,0,0 ; movaps 0x2e67(%rip),%xmm10 # 5e40 <_sk_callback_sse2+0x89a>
+ DB 68,15,40,21,112,46,0,0 ; movaps 0x2e70(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x896>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,91,46,0,0 ; addps 0x2e5b(%rip),%xmm9 # 5e50 <_sk_callback_sse2+0x8aa>
- DB 68,15,40,37,99,46,0,0 ; movaps 0x2e63(%rip),%xmm12 # 5e60 <_sk_callback_sse2+0x8ba>
+ DB 68,15,88,13,100,46,0,0 ; addps 0x2e64(%rip),%xmm9 # 5e80 <_sk_callback_sse2+0x8a6>
+ DB 68,15,40,37,108,46,0,0 ; movaps 0x2e6c(%rip),%xmm12 # 5e90 <_sk_callback_sse2+0x8b6>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,99,46,0,0 ; movaps 0x2e63(%rip),%xmm12 # 5e70 <_sk_callback_sse2+0x8ca>
+ DB 68,15,40,37,108,46,0,0 ; movaps 0x2e6c(%rip),%xmm12 # 5ea0 <_sk_callback_sse2+0x8c6>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,103,46,0,0 ; movaps 0x2e67(%rip),%xmm13 # 5e80 <_sk_callback_sse2+0x8da>
+ DB 68,15,40,45,112,46,0,0 ; movaps 0x2e70(%rip),%xmm13 # 5eb0 <_sk_callback_sse2+0x8d6>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,103,46,0,0 ; mulps 0x2e67(%rip),%xmm13 # 5e90 <_sk_callback_sse2+0x8ea>
+ DB 68,15,89,45,112,46,0,0 ; mulps 0x2e70(%rip),%xmm13 # 5ec0 <_sk_callback_sse2+0x8e6>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -21967,15 +22023,15 @@ _sk_parametric_a_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,231,45,0,0 ; mulps 0x2de7(%rip),%xmm9 # 5ea0 <_sk_callback_sse2+0x8fa>
- DB 68,15,84,21,239,45,0,0 ; andps 0x2def(%rip),%xmm10 # 5eb0 <_sk_callback_sse2+0x90a>
- DB 68,15,86,21,247,45,0,0 ; orps 0x2df7(%rip),%xmm10 # 5ec0 <_sk_callback_sse2+0x91a>
- DB 68,15,88,13,255,45,0,0 ; addps 0x2dff(%rip),%xmm9 # 5ed0 <_sk_callback_sse2+0x92a>
- DB 68,15,40,37,7,46,0,0 ; movaps 0x2e07(%rip),%xmm12 # 5ee0 <_sk_callback_sse2+0x93a>
+ DB 68,15,89,13,240,45,0,0 ; mulps 0x2df0(%rip),%xmm9 # 5ed0 <_sk_callback_sse2+0x8f6>
+ DB 68,15,84,21,248,45,0,0 ; andps 0x2df8(%rip),%xmm10 # 5ee0 <_sk_callback_sse2+0x906>
+ DB 68,15,86,21,0,46,0,0 ; orps 0x2e00(%rip),%xmm10 # 5ef0 <_sk_callback_sse2+0x916>
+ DB 68,15,88,13,8,46,0,0 ; addps 0x2e08(%rip),%xmm9 # 5f00 <_sk_callback_sse2+0x926>
+ DB 68,15,40,37,16,46,0,0 ; movaps 0x2e10(%rip),%xmm12 # 5f10 <_sk_callback_sse2+0x936>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,7,46,0,0 ; addps 0x2e07(%rip),%xmm10 # 5ef0 <_sk_callback_sse2+0x94a>
- DB 68,15,40,37,15,46,0,0 ; movaps 0x2e0f(%rip),%xmm12 # 5f00 <_sk_callback_sse2+0x95a>
+ DB 68,15,88,21,16,46,0,0 ; addps 0x2e10(%rip),%xmm10 # 5f20 <_sk_callback_sse2+0x946>
+ DB 68,15,40,37,24,46,0,0 ; movaps 0x2e18(%rip),%xmm12 # 5f30 <_sk_callback_sse2+0x956>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -21983,22 +22039,22 @@ _sk_parametric_a_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,249,45,0,0 ; movaps 0x2df9(%rip),%xmm10 # 5f10 <_sk_callback_sse2+0x96a>
+ DB 68,15,40,21,2,46,0,0 ; movaps 0x2e02(%rip),%xmm10 # 5f40 <_sk_callback_sse2+0x966>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,237,45,0,0 ; addps 0x2ded(%rip),%xmm9 # 5f20 <_sk_callback_sse2+0x97a>
- DB 68,15,40,37,245,45,0,0 ; movaps 0x2df5(%rip),%xmm12 # 5f30 <_sk_callback_sse2+0x98a>
+ DB 68,15,88,13,246,45,0,0 ; addps 0x2df6(%rip),%xmm9 # 5f50 <_sk_callback_sse2+0x976>
+ DB 68,15,40,37,254,45,0,0 ; movaps 0x2dfe(%rip),%xmm12 # 5f60 <_sk_callback_sse2+0x986>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,245,45,0,0 ; movaps 0x2df5(%rip),%xmm12 # 5f40 <_sk_callback_sse2+0x99a>
+ DB 68,15,40,37,254,45,0,0 ; movaps 0x2dfe(%rip),%xmm12 # 5f70 <_sk_callback_sse2+0x996>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,249,45,0,0 ; movaps 0x2df9(%rip),%xmm13 # 5f50 <_sk_callback_sse2+0x9aa>
+ DB 68,15,40,45,2,46,0,0 ; movaps 0x2e02(%rip),%xmm13 # 5f80 <_sk_callback_sse2+0x9a6>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,249,45,0,0 ; mulps 0x2df9(%rip),%xmm13 # 5f60 <_sk_callback_sse2+0x9ba>
+ DB 68,15,89,45,2,46,0,0 ; mulps 0x2e02(%rip),%xmm13 # 5f90 <_sk_callback_sse2+0x9b6>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -22013,29 +22069,29 @@ _sk_parametric_a_sse2 LABEL PROC
PUBLIC _sk_lab_to_xyz_sse2
_sk_lab_to_xyz_sse2 LABEL PROC
- DB 15,89,5,214,45,0,0 ; mulps 0x2dd6(%rip),%xmm0 # 5f70 <_sk_callback_sse2+0x9ca>
- DB 68,15,40,5,222,45,0,0 ; movaps 0x2dde(%rip),%xmm8 # 5f80 <_sk_callback_sse2+0x9da>
+ DB 15,89,5,223,45,0,0 ; mulps 0x2ddf(%rip),%xmm0 # 5fa0 <_sk_callback_sse2+0x9c6>
+ DB 68,15,40,5,231,45,0,0 ; movaps 0x2de7(%rip),%xmm8 # 5fb0 <_sk_callback_sse2+0x9d6>
DB 65,15,89,200 ; mulps %xmm8,%xmm1
- DB 68,15,40,13,226,45,0,0 ; movaps 0x2de2(%rip),%xmm9 # 5f90 <_sk_callback_sse2+0x9ea>
+ DB 68,15,40,13,235,45,0,0 ; movaps 0x2deb(%rip),%xmm9 # 5fc0 <_sk_callback_sse2+0x9e6>
DB 65,15,88,201 ; addps %xmm9,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 65,15,88,209 ; addps %xmm9,%xmm2
- DB 15,88,5,223,45,0,0 ; addps 0x2ddf(%rip),%xmm0 # 5fa0 <_sk_callback_sse2+0x9fa>
- DB 15,89,5,232,45,0,0 ; mulps 0x2de8(%rip),%xmm0 # 5fb0 <_sk_callback_sse2+0xa0a>
- DB 15,89,13,241,45,0,0 ; mulps 0x2df1(%rip),%xmm1 # 5fc0 <_sk_callback_sse2+0xa1a>
+ DB 15,88,5,232,45,0,0 ; addps 0x2de8(%rip),%xmm0 # 5fd0 <_sk_callback_sse2+0x9f6>
+ DB 15,89,5,241,45,0,0 ; mulps 0x2df1(%rip),%xmm0 # 5fe0 <_sk_callback_sse2+0xa06>
+ DB 15,89,13,250,45,0,0 ; mulps 0x2dfa(%rip),%xmm1 # 5ff0 <_sk_callback_sse2+0xa16>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,21,247,45,0,0 ; mulps 0x2df7(%rip),%xmm2 # 5fd0 <_sk_callback_sse2+0xa2a>
+ DB 15,89,21,0,46,0,0 ; mulps 0x2e00(%rip),%xmm2 # 6000 <_sk_callback_sse2+0xa26>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 68,15,92,202 ; subps %xmm2,%xmm9
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
DB 68,15,89,225 ; mulps %xmm1,%xmm12
- DB 15,40,21,236,45,0,0 ; movaps 0x2dec(%rip),%xmm2 # 5fe0 <_sk_callback_sse2+0xa3a>
+ DB 15,40,21,245,45,0,0 ; movaps 0x2df5(%rip),%xmm2 # 6010 <_sk_callback_sse2+0xa36>
DB 68,15,40,194 ; movaps %xmm2,%xmm8
DB 69,15,194,196,1 ; cmpltps %xmm12,%xmm8
- DB 68,15,40,21,235,45,0,0 ; movaps 0x2deb(%rip),%xmm10 # 5ff0 <_sk_callback_sse2+0xa4a>
+ DB 68,15,40,21,244,45,0,0 ; movaps 0x2df4(%rip),%xmm10 # 6020 <_sk_callback_sse2+0xa46>
DB 65,15,88,202 ; addps %xmm10,%xmm1
- DB 68,15,40,29,239,45,0,0 ; movaps 0x2def(%rip),%xmm11 # 6000 <_sk_callback_sse2+0xa5a>
+ DB 68,15,40,29,248,45,0,0 ; movaps 0x2df8(%rip),%xmm11 # 6030 <_sk_callback_sse2+0xa56>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 69,15,84,224 ; andps %xmm8,%xmm12
DB 68,15,85,193 ; andnps %xmm1,%xmm8
@@ -22059,8 +22115,8 @@ _sk_lab_to_xyz_sse2 LABEL PROC
DB 15,84,194 ; andps %xmm2,%xmm0
DB 65,15,85,209 ; andnps %xmm9,%xmm2
DB 15,86,208 ; orps %xmm0,%xmm2
- DB 68,15,89,5,159,45,0,0 ; mulps 0x2d9f(%rip),%xmm8 # 6010 <_sk_callback_sse2+0xa6a>
- DB 15,89,21,168,45,0,0 ; mulps 0x2da8(%rip),%xmm2 # 6020 <_sk_callback_sse2+0xa7a>
+ DB 68,15,89,5,168,45,0,0 ; mulps 0x2da8(%rip),%xmm8 # 6040 <_sk_callback_sse2+0xa66>
+ DB 15,89,21,177,45,0,0 ; mulps 0x2db1(%rip),%xmm2 # 6050 <_sk_callback_sse2+0xa76>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -22068,46 +22124,48 @@ _sk_lab_to_xyz_sse2 LABEL PROC
PUBLIC _sk_load_a8_sse2
_sk_load_a8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,45 ; jne 32b7 <_sk_load_a8_sse2+0x37>
- DB 102,65,15,110,4,57 ; movd (%r9,%rdi,1),%xmm0
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,45 ; jne 32de <_sk_load_a8_sse2+0x37>
+ DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0
DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
- DB 102,15,219,5,144,45,0,0 ; pand 0x2d90(%rip),%xmm0 # 6030 <_sk_callback_sse2+0xa8a>
+ DB 102,15,219,5,153,45,0,0 ; pand 0x2d99(%rip),%xmm0 # 6060 <_sk_callback_sse2+0xa86>
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,150,45,0,0 ; mulps 0x2d96(%rip),%xmm3 # 6040 <_sk_callback_sse2+0xa9a>
+ DB 15,89,29,159,45,0,0 ; mulps 0x2d9f(%rip),%xmm3 # 6070 <_sk_callback_sse2+0xa96>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,48 ; je 32f8 <_sk_load_a8_sse2+0x78>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 32e3 <_sk_load_a8_sse2+0x63>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,196 ; jne 3298 <_sk_load_a8_sse2+0x18>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,48 ; je 331f <_sk_load_a8_sse2+0x78>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 330a <_sk_load_a8_sse2+0x63>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,196 ; jne 32bf <_sk_load_a8_sse2+0x18>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,15,110,200 ; movd %eax,%xmm1
DB 15,198,200,0 ; shufps $0x0,%xmm0,%xmm1
DB 15,198,200,226 ; shufps $0xe2,%xmm0,%xmm1
DB 15,40,193 ; movaps %xmm1,%xmm0
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,15,110,200 ; movd %eax,%xmm1
DB 243,15,16,193 ; movss %xmm1,%xmm0
- DB 235,145 ; jmp 3298 <_sk_load_a8_sse2+0x18>
+ DB 235,145 ; jmp 32bf <_sk_load_a8_sse2+0x18>
PUBLIC _sk_gather_a8_sse2
_sk_gather_a8_sse2 LABEL PROC
+ DB 85 ; push %rbp
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22120,116 +22178,120 @@ _sk_gather_a8_sse2 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 71,15,182,28,24 ; movzbl (%r8,%r11,1),%r11d
- DB 71,15,182,20,16 ; movzbl (%r8,%r10,1),%r10d
- DB 65,193,226,8 ; shl $0x8,%r10d
- DB 69,9,218 ; or %r11d,%r10d
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 65,15,182,44,25 ; movzbl (%r9,%rbx,1),%ebp
+ DB 67,15,182,28,25 ; movzbl (%r9,%r11,1),%ebx
+ DB 193,227,8 ; shl $0x8,%ebx
+ DB 9,235 ; or %ebp,%ebx
+ DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 193,224,8 ; shl $0x8,%eax
- DB 68,9,200 ; or %r9d,%eax
+ DB 9,232 ; or %ebp,%eax
DB 102,15,196,192,0 ; pinsrw $0x0,%eax,%xmm0
- DB 102,65,15,196,194,1 ; pinsrw $0x1,%r10d,%xmm0
+ DB 102,15,196,195,1 ; pinsrw $0x1,%ebx,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,180,44,0,0 ; mulps 0x2cb4(%rip),%xmm3 # 6050 <_sk_callback_sse2+0xaaa>
+ DB 15,89,29,191,44,0,0 ; mulps 0x2cbf(%rip),%xmm3 # 6080 <_sk_callback_sse2+0xaa6>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,15,239,210 ; pxor %xmm2,%xmm2
+ DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_a8_sse2
_sk_store_a8_sse2 LABEL PROC
DB 72,131,236,56 ; sub $0x38,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 68,15,40,5,164,44,0,0 ; movaps 0x2ca4(%rip),%xmm8 # 6060 <_sk_callback_sse2+0xaba>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 68,15,40,5,173,44,0,0 ; movaps 0x2cad(%rip),%xmm8 # 6090 <_sk_callback_sse2+0xab6>
DB 68,15,89,195 ; mulps %xmm3,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,114,240,16 ; pslld $0x10,%xmm8
DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8
DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8
DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,17 ; jne 33f1 <_sk_store_a8_sse2+0x46>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,17 ; jne 3418 <_sk_store_a8_sse2+0x46>
DB 102,68,15,126,192 ; movd %xmm8,%eax
- DB 65,137,4,57 ; mov %eax,(%r9,%rdi,1)
+ DB 65,137,4,18 ; mov %eax,(%r10,%rdx,1)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,131,196,56 ; add $0x38,%rsp
DB 255,224 ; jmpq *%rax
DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,44 ; je 3434 <_sk_store_a8_sse2+0x89>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,22 ; je 3424 <_sk_store_a8_sse2+0x79>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,213 ; jne 33e9 <_sk_store_a8_sse2+0x3e>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,44 ; je 345b <_sk_store_a8_sse2+0x89>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,22 ; je 344b <_sk_store_a8_sse2+0x79>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,213 ; jne 3410 <_sk_store_a8_sse2+0x3e>
DB 102,68,15,127,68,36,32 ; movdqa %xmm8,0x20(%rsp)
DB 138,68,36,40 ; mov 0x28(%rsp),%al
- DB 65,136,68,57,2 ; mov %al,0x2(%r9,%rdi,1)
+ DB 65,136,68,18,2 ; mov %al,0x2(%r10,%rdx,1)
DB 102,68,15,127,68,36,16 ; movdqa %xmm8,0x10(%rsp)
DB 138,68,36,20 ; mov 0x14(%rsp),%al
- DB 65,136,68,57,1 ; mov %al,0x1(%r9,%rdi,1)
+ DB 65,136,68,18,1 ; mov %al,0x1(%r10,%rdx,1)
DB 102,68,15,127,4,36 ; movdqa %xmm8,(%rsp)
DB 138,4,36 ; mov (%rsp),%al
- DB 65,136,4,57 ; mov %al,(%r9,%rdi,1)
- DB 235,166 ; jmp 33e9 <_sk_store_a8_sse2+0x3e>
+ DB 65,136,4,18 ; mov %al,(%r10,%rdx,1)
+ DB 235,166 ; jmp 3410 <_sk_store_a8_sse2+0x3e>
PUBLIC _sk_load_g8_sse2
_sk_load_g8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,49 ; jne 347e <_sk_load_g8_sse2+0x3b>
- DB 102,65,15,110,4,57 ; movd (%r9,%rdi,1),%xmm0
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,49 ; jne 34a5 <_sk_load_g8_sse2+0x3b>
+ DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0
DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
- DB 102,15,219,5,13,44,0,0 ; pand 0x2c0d(%rip),%xmm0 # 6070 <_sk_callback_sse2+0xaca>
+ DB 102,15,219,5,22,44,0,0 ; pand 0x2c16(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xac6>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,19,44,0,0 ; mulps 0x2c13(%rip),%xmm0 # 6080 <_sk_callback_sse2+0xada>
+ DB 15,89,5,28,44,0,0 ; mulps 0x2c1c(%rip),%xmm0 # 60b0 <_sk_callback_sse2+0xad6>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,26,44,0,0 ; movaps 0x2c1a(%rip),%xmm3 # 6090 <_sk_callback_sse2+0xaea>
+ DB 15,40,29,35,44,0,0 ; movaps 0x2c23(%rip),%xmm3 # 60c0 <_sk_callback_sse2+0xae6>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,48 ; je 34bf <_sk_load_g8_sse2+0x7c>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 34aa <_sk_load_g8_sse2+0x67>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,192 ; jne 345b <_sk_load_g8_sse2+0x18>
- DB 65,15,182,68,57,2 ; movzbl 0x2(%r9,%rdi,1),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,48 ; je 34e6 <_sk_load_g8_sse2+0x7c>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 34d1 <_sk_load_g8_sse2+0x67>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,192 ; jne 3482 <_sk_load_g8_sse2+0x18>
+ DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0
- DB 65,15,182,68,57,1 ; movzbl 0x1(%r9,%rdi,1),%eax
+ DB 65,15,182,68,18,1 ; movzbl 0x1(%r10,%rdx,1),%eax
DB 102,15,110,200 ; movd %eax,%xmm1
DB 15,198,200,0 ; shufps $0x0,%xmm0,%xmm1
DB 15,198,200,226 ; shufps $0xe2,%xmm0,%xmm1
DB 15,40,193 ; movaps %xmm1,%xmm0
- DB 65,15,182,4,57 ; movzbl (%r9,%rdi,1),%eax
+ DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax
DB 102,15,110,200 ; movd %eax,%xmm1
DB 243,15,16,193 ; movss %xmm1,%xmm0
- DB 235,141 ; jmp 345b <_sk_load_g8_sse2+0x18>
+ DB 235,141 ; jmp 3482 <_sk_load_g8_sse2+0x18>
PUBLIC _sk_gather_g8_sse2
_sk_gather_g8_sse2 LABEL PROC
+ DB 85 ; push %rbp
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22242,45 +22304,48 @@ _sk_gather_g8_sse2 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 71,15,182,28,24 ; movzbl (%r8,%r11,1),%r11d
- DB 71,15,182,20,16 ; movzbl (%r8,%r10,1),%r10d
- DB 65,193,226,8 ; shl $0x8,%r10d
- DB 69,9,218 ; or %r11d,%r10d
- DB 71,15,182,12,8 ; movzbl (%r8,%r9,1),%r9d
- DB 65,15,182,4,0 ; movzbl (%r8,%rax,1),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 65,15,182,44,25 ; movzbl (%r9,%rbx,1),%ebp
+ DB 67,15,182,28,25 ; movzbl (%r9,%r11,1),%ebx
+ DB 193,227,8 ; shl $0x8,%ebx
+ DB 9,235 ; or %ebp,%ebx
+ DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
+ DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
DB 193,224,8 ; shl $0x8,%eax
- DB 68,9,200 ; or %r9d,%eax
+ DB 9,232 ; or %ebp,%eax
DB 102,15,196,192,0 ; pinsrw $0x0,%eax,%xmm0
- DB 102,65,15,196,194,1 ; pinsrw $0x1,%r10d,%xmm0
+ DB 102,15,196,195,1 ; pinsrw $0x1,%ebx,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,61,43,0,0 ; mulps 0x2b3d(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xafa>
+ DB 15,89,5,72,43,0,0 ; mulps 0x2b48(%rip),%xmm0 # 60d0 <_sk_callback_sse2+0xaf6>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,68,43,0,0 ; movaps 0x2b44(%rip),%xmm3 # 60b0 <_sk_callback_sse2+0xb0a>
+ DB 15,40,29,79,43,0,0 ; movaps 0x2b4f(%rip),%xmm3 # 60e0 <_sk_callback_sse2+0xb06>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
+ DB 91 ; pop %rbx
+ DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_gather_i8_sse2
_sk_gather_i8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,192 ; mov %rax,%r8
- DB 77,133,192 ; test %r8,%r8
- DB 116,5 ; je 3583 <_sk_gather_i8_sse2+0xf>
- DB 76,137,192 ; mov %r8,%rax
- DB 235,2 ; jmp 3585 <_sk_gather_i8_sse2+0x11>
+ DB 73,137,193 ; mov %rax,%r9
+ DB 77,133,201 ; test %r9,%r9
+ DB 116,5 ; je 35aa <_sk_gather_i8_sse2+0xf>
+ DB 76,137,200 ; mov %r9,%rax
+ DB 235,2 ; jmp 35ac <_sk_gather_i8_sse2+0x11>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 85 ; push %rbp
+ DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 76,139,8 ; mov (%rax),%r9
+ DB 76,139,16 ; mov (%rax),%r10
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22293,18 +22358,18 @@ _sk_gather_i8_sse2 LABEL PROC
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,194 ; mov %eax,%r10d
+ DB 65,137,195 ; mov %eax,%r11d
DB 72,193,232,32 ; shr $0x20,%rax
DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,73,15,126,195 ; movq %xmm0,%r11
- DB 68,137,219 ; mov %r11d,%ebx
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 65,15,182,44,25 ; movzbl (%r9,%rbx,1),%ebp
- DB 67,15,182,28,25 ; movzbl (%r9,%r11,1),%ebx
+ DB 102,72,15,126,195 ; movq %xmm0,%rbx
+ DB 65,137,222 ; mov %ebx,%r14d
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 67,15,182,44,50 ; movzbl (%r10,%r14,1),%ebp
+ DB 65,15,182,28,26 ; movzbl (%r10,%rbx,1),%ebx
DB 193,227,8 ; shl $0x8,%ebx
DB 9,235 ; or %ebp,%ebx
- DB 67,15,182,44,17 ; movzbl (%r9,%r10,1),%ebp
- DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax
+ DB 67,15,182,44,26 ; movzbl (%r10,%r11,1),%ebp
+ DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
DB 193,224,8 ; shl $0x8,%eax
DB 9,232 ; or %ebp,%eax
DB 102,15,196,192,0 ; pinsrw $0x0,%eax,%xmm0
@@ -22314,24 +22379,24 @@ _sk_gather_i8_sse2 LABEL PROC
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 68,15,182,200 ; movzbl %al,%r9d
+ DB 68,15,182,208 ; movzbl %al,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 73,139,104,8 ; mov 0x8(%r8),%rbp
- DB 68,15,182,195 ; movzbl %bl,%r8d
+ DB 73,139,105,8 ; mov 0x8(%r9),%rbp
+ DB 68,15,182,203 ; movzbl %bl,%r9d
DB 72,193,235,30 ; shr $0x1e,%rbx
DB 102,15,110,68,29,0 ; movd 0x0(%rbp,%rbx,1),%xmm0
DB 102,15,110,76,133,0 ; movd 0x0(%rbp,%rax,4),%xmm1
DB 102,15,98,193 ; punpckldq %xmm1,%xmm0
- DB 102,70,15,110,76,133,0 ; movd 0x0(%rbp,%r8,4),%xmm9
- DB 102,66,15,110,76,141,0 ; movd 0x0(%rbp,%r9,4),%xmm1
+ DB 102,70,15,110,76,141,0 ; movd 0x0(%rbp,%r9,4),%xmm9
+ DB 102,66,15,110,76,149,0 ; movd 0x0(%rbp,%r10,4),%xmm1
DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9
DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9
- DB 102,15,111,21,97,42,0,0 ; movdqa 0x2a61(%rip),%xmm2 # 60c0 <_sk_callback_sse2+0xb1a>
+ DB 102,15,111,21,104,42,0,0 ; movdqa 0x2a68(%rip),%xmm2 # 60f0 <_sk_callback_sse2+0xb16>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,93,42,0,0 ; movaps 0x2a5d(%rip),%xmm8 # 60d0 <_sk_callback_sse2+0xb2a>
+ DB 68,15,40,5,100,42,0,0 ; movaps 0x2a64(%rip),%xmm8 # 6100 <_sk_callback_sse2+0xb26>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -22348,57 +22413,59 @@ _sk_gather_i8_sse2 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
+ DB 65,94 ; pop %r14
DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
PUBLIC _sk_load_565_sse2
_sk_load_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,83 ; jne 3712 <_sk_load_565_sse2+0x5d>
- DB 243,65,15,126,20,121 ; movq (%r9,%rdi,2),%xmm2
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,83 ; jne 373d <_sk_load_565_sse2+0x5d>
+ DB 243,65,15,126,20,82 ; movq (%r10,%rdx,2),%xmm2
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,5,15,42,0,0 ; movdqa 0x2a0f(%rip),%xmm0 # 60e0 <_sk_callback_sse2+0xb3a>
+ DB 102,15,111,5,20,42,0,0 ; movdqa 0x2a14(%rip),%xmm0 # 6110 <_sk_callback_sse2+0xb36>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,17,42,0,0 ; mulps 0x2a11(%rip),%xmm0 # 60f0 <_sk_callback_sse2+0xb4a>
- DB 102,15,111,13,25,42,0,0 ; movdqa 0x2a19(%rip),%xmm1 # 6100 <_sk_callback_sse2+0xb5a>
+ DB 15,89,5,22,42,0,0 ; mulps 0x2a16(%rip),%xmm0 # 6120 <_sk_callback_sse2+0xb46>
+ DB 102,15,111,13,30,42,0,0 ; movdqa 0x2a1e(%rip),%xmm1 # 6130 <_sk_callback_sse2+0xb56>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,27,42,0,0 ; mulps 0x2a1b(%rip),%xmm1 # 6110 <_sk_callback_sse2+0xb6a>
- DB 102,15,219,21,35,42,0,0 ; pand 0x2a23(%rip),%xmm2 # 6120 <_sk_callback_sse2+0xb7a>
+ DB 15,89,13,32,42,0,0 ; mulps 0x2a20(%rip),%xmm1 # 6140 <_sk_callback_sse2+0xb66>
+ DB 102,15,219,21,40,42,0,0 ; pand 0x2a28(%rip),%xmm2 # 6150 <_sk_callback_sse2+0xb76>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,41,42,0,0 ; mulps 0x2a29(%rip),%xmm2 # 6130 <_sk_callback_sse2+0xb8a>
+ DB 15,89,21,46,42,0,0 ; mulps 0x2a2e(%rip),%xmm2 # 6160 <_sk_callback_sse2+0xb86>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,48,42,0,0 ; movaps 0x2a30(%rip),%xmm3 # 6140 <_sk_callback_sse2+0xb9a>
+ DB 15,40,29,53,42,0,0 ; movaps 0x2a35(%rip),%xmm3 # 6170 <_sk_callback_sse2+0xb96>
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,210 ; pxor %xmm2,%xmm2
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,48 ; je 3753 <_sk_load_565_sse2+0x9e>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 373e <_sk_load_565_sse2+0x89>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,154 ; jne 36c9 <_sk_load_565_sse2+0x14>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,48 ; je 377e <_sk_load_565_sse2+0x9e>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 3769 <_sk_load_565_sse2+0x89>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,154 ; jne 36f4 <_sk_load_565_sse2+0x14>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 15,198,194,0 ; shufps $0x0,%xmm2,%xmm0
DB 15,198,194,226 ; shufps $0xe2,%xmm2,%xmm0
DB 15,40,208 ; movaps %xmm0,%xmm2
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 243,15,16,208 ; movss %xmm0,%xmm2
- DB 233,100,255,255,255 ; jmpq 36c9 <_sk_load_565_sse2+0x14>
+ DB 233,100,255,255,255 ; jmpq 36f4 <_sk_load_565_sse2+0x14>
PUBLIC _sk_gather_565_sse2
_sk_gather_565_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22412,44 +22479,45 @@ _sk_gather_565_sse2 LABEL PROC
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,196,20,88,0 ; pinsrw $0x0,(%r8,%r11,2),%xmm2
- DB 102,67,15,196,20,80,1 ; pinsrw $0x1,(%r8,%r10,2),%xmm2
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 102,65,15,196,209,2 ; pinsrw $0x2,%r9d,%xmm2
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,196,20,89,0 ; pinsrw $0x0,(%r9,%rbx,2),%xmm2
+ DB 102,67,15,196,20,89,1 ; pinsrw $0x1,(%r9,%r11,2),%xmm2
+ DB 67,15,183,28,81 ; movzwl (%r9,%r10,2),%ebx
+ DB 102,15,196,211,2 ; pinsrw $0x2,%ebx,%xmm2
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,208,3 ; pinsrw $0x3,%eax,%xmm2
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,5,101,41,0,0 ; movdqa 0x2965(%rip),%xmm0 # 6150 <_sk_callback_sse2+0xbaa>
+ DB 102,15,111,5,106,41,0,0 ; movdqa 0x296a(%rip),%xmm0 # 6180 <_sk_callback_sse2+0xba6>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,103,41,0,0 ; mulps 0x2967(%rip),%xmm0 # 6160 <_sk_callback_sse2+0xbba>
- DB 102,15,111,13,111,41,0,0 ; movdqa 0x296f(%rip),%xmm1 # 6170 <_sk_callback_sse2+0xbca>
+ DB 15,89,5,108,41,0,0 ; mulps 0x296c(%rip),%xmm0 # 6190 <_sk_callback_sse2+0xbb6>
+ DB 102,15,111,13,116,41,0,0 ; movdqa 0x2974(%rip),%xmm1 # 61a0 <_sk_callback_sse2+0xbc6>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,113,41,0,0 ; mulps 0x2971(%rip),%xmm1 # 6180 <_sk_callback_sse2+0xbda>
- DB 102,15,219,21,121,41,0,0 ; pand 0x2979(%rip),%xmm2 # 6190 <_sk_callback_sse2+0xbea>
+ DB 15,89,13,118,41,0,0 ; mulps 0x2976(%rip),%xmm1 # 61b0 <_sk_callback_sse2+0xbd6>
+ DB 102,15,219,21,126,41,0,0 ; pand 0x297e(%rip),%xmm2 # 61c0 <_sk_callback_sse2+0xbe6>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,127,41,0,0 ; mulps 0x297f(%rip),%xmm2 # 61a0 <_sk_callback_sse2+0xbfa>
+ DB 15,89,21,132,41,0,0 ; mulps 0x2984(%rip),%xmm2 # 61d0 <_sk_callback_sse2+0xbf6>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,134,41,0,0 ; movaps 0x2986(%rip),%xmm3 # 61b0 <_sk_callback_sse2+0xc0a>
+ DB 15,40,29,139,41,0,0 ; movaps 0x298b(%rip),%xmm3 # 61e0 <_sk_callback_sse2+0xc06>
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_565_sse2
_sk_store_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 68,15,40,5,135,41,0,0 ; movaps 0x2987(%rip),%xmm8 # 61c0 <_sk_callback_sse2+0xc1a>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 68,15,40,5,139,41,0,0 ; movaps 0x298b(%rip),%xmm8 # 61f0 <_sk_callback_sse2+0xc16>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9
- DB 68,15,40,21,124,41,0,0 ; movaps 0x297c(%rip),%xmm10 # 61d0 <_sk_callback_sse2+0xc2a>
+ DB 68,15,40,21,128,41,0,0 ; movaps 0x2980(%rip),%xmm10 # 6200 <_sk_callback_sse2+0xc26>
DB 68,15,89,209 ; mulps %xmm1,%xmm10
DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10
DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10
@@ -22460,79 +22528,80 @@ _sk_store_565_sse2 LABEL PROC
DB 102,65,15,114,240,16 ; pslld $0x10,%xmm8
DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8
DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3896 <_sk_store_565_sse2+0x6a>
- DB 242,69,15,17,4,121 ; movsd %xmm8,(%r9,%rdi,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 38c2 <_sk_store_565_sse2+0x6a>
+ DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,36 ; je 38cc <_sk_store_565_sse2+0xa0>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,18 ; je 38c0 <_sk_store_565_sse2+0x94>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,222 ; jne 3892 <_sk_store_565_sse2+0x66>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,36 ; je 38f8 <_sk_store_565_sse2+0xa0>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,18 ; je 38ec <_sk_store_565_sse2+0x94>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,222 ; jne 38be <_sk_store_565_sse2+0x66>
DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax
- DB 102,65,137,68,121,4 ; mov %ax,0x4(%r9,%rdi,2)
+ DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2)
DB 102,65,15,197,192,2 ; pextrw $0x2,%xmm8,%eax
- DB 102,65,137,68,121,2 ; mov %ax,0x2(%r9,%rdi,2)
+ DB 102,65,137,68,82,2 ; mov %ax,0x2(%r10,%rdx,2)
DB 102,68,15,126,192 ; movd %xmm8,%eax
- DB 102,65,137,4,121 ; mov %ax,(%r9,%rdi,2)
- DB 235,186 ; jmp 3892 <_sk_store_565_sse2+0x66>
+ DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2)
+ DB 235,186 ; jmp 38be <_sk_store_565_sse2+0x66>
PUBLIC _sk_load_4444_sse2
_sk_load_4444_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,98 ; jne 3944 <_sk_load_4444_sse2+0x6c>
- DB 243,65,15,126,28,121 ; movq (%r9,%rdi,2),%xmm3
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,98 ; jne 3970 <_sk_load_4444_sse2+0x6c>
+ DB 243,65,15,126,28,82 ; movq (%r10,%rdx,2),%xmm3
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,5,236,40,0,0 ; movdqa 0x28ec(%rip),%xmm0 # 61e0 <_sk_callback_sse2+0xc3a>
+ DB 102,15,111,5,240,40,0,0 ; movdqa 0x28f0(%rip),%xmm0 # 6210 <_sk_callback_sse2+0xc36>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,238,40,0,0 ; mulps 0x28ee(%rip),%xmm0 # 61f0 <_sk_callback_sse2+0xc4a>
- DB 102,15,111,13,246,40,0,0 ; movdqa 0x28f6(%rip),%xmm1 # 6200 <_sk_callback_sse2+0xc5a>
+ DB 15,89,5,242,40,0,0 ; mulps 0x28f2(%rip),%xmm0 # 6220 <_sk_callback_sse2+0xc46>
+ DB 102,15,111,13,250,40,0,0 ; movdqa 0x28fa(%rip),%xmm1 # 6230 <_sk_callback_sse2+0xc56>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,248,40,0,0 ; mulps 0x28f8(%rip),%xmm1 # 6210 <_sk_callback_sse2+0xc6a>
- DB 102,15,111,21,0,41,0,0 ; movdqa 0x2900(%rip),%xmm2 # 6220 <_sk_callback_sse2+0xc7a>
+ DB 15,89,13,252,40,0,0 ; mulps 0x28fc(%rip),%xmm1 # 6240 <_sk_callback_sse2+0xc66>
+ DB 102,15,111,21,4,41,0,0 ; movdqa 0x2904(%rip),%xmm2 # 6250 <_sk_callback_sse2+0xc76>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,2,41,0,0 ; mulps 0x2902(%rip),%xmm2 # 6230 <_sk_callback_sse2+0xc8a>
- DB 102,15,219,29,10,41,0,0 ; pand 0x290a(%rip),%xmm3 # 6240 <_sk_callback_sse2+0xc9a>
+ DB 15,89,21,6,41,0,0 ; mulps 0x2906(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xc86>
+ DB 102,15,219,29,14,41,0,0 ; pand 0x290e(%rip),%xmm3 # 6270 <_sk_callback_sse2+0xc96>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,16,41,0,0 ; mulps 0x2910(%rip),%xmm3 # 6250 <_sk_callback_sse2+0xcaa>
+ DB 15,89,29,20,41,0,0 ; mulps 0x2914(%rip),%xmm3 # 6280 <_sk_callback_sse2+0xca6>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,48 ; je 3985 <_sk_load_4444_sse2+0xad>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,21 ; je 3970 <_sk_load_4444_sse2+0x98>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,139 ; jne 38ec <_sk_load_4444_sse2+0x14>
- DB 65,15,183,68,121,4 ; movzwl 0x4(%r9,%rdi,2),%eax
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,48 ; je 39b1 <_sk_load_4444_sse2+0xad>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,21 ; je 399c <_sk_load_4444_sse2+0x98>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,139 ; jne 3918 <_sk_load_4444_sse2+0x14>
+ DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
- DB 65,15,183,68,121,2 ; movzwl 0x2(%r9,%rdi,2),%eax
+ DB 65,15,183,68,82,2 ; movzwl 0x2(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 15,198,195,0 ; shufps $0x0,%xmm3,%xmm0
DB 15,198,195,226 ; shufps $0xe2,%xmm3,%xmm0
DB 15,40,216 ; movaps %xmm0,%xmm3
- DB 65,15,183,4,121 ; movzwl (%r9,%rdi,2),%eax
+ DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 243,15,16,216 ; movss %xmm0,%xmm3
- DB 233,85,255,255,255 ; jmpq 38ec <_sk_load_4444_sse2+0x14>
+ DB 233,85,255,255,255 ; jmpq 3918 <_sk_load_4444_sse2+0x14>
PUBLIC _sk_gather_4444_sse2
_sk_gather_4444_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22546,42 +22615,43 @@ _sk_gather_4444_sse2 LABEL PROC
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,196,28,88,0 ; pinsrw $0x0,(%r8,%r11,2),%xmm3
- DB 102,67,15,196,28,80,1 ; pinsrw $0x1,(%r8,%r10,2),%xmm3
- DB 71,15,183,12,72 ; movzwl (%r8,%r9,2),%r9d
- DB 102,65,15,196,217,2 ; pinsrw $0x2,%r9d,%xmm3
- DB 65,15,183,4,64 ; movzwl (%r8,%rax,2),%eax
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,65,15,196,28,89,0 ; pinsrw $0x0,(%r9,%rbx,2),%xmm3
+ DB 102,67,15,196,28,89,1 ; pinsrw $0x1,(%r9,%r11,2),%xmm3
+ DB 67,15,183,28,81 ; movzwl (%r9,%r10,2),%ebx
+ DB 102,15,196,219,2 ; pinsrw $0x2,%ebx,%xmm3
+ DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,216,3 ; pinsrw $0x3,%eax,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,5,67,40,0,0 ; movdqa 0x2843(%rip),%xmm0 # 6260 <_sk_callback_sse2+0xcba>
+ DB 102,15,111,5,71,40,0,0 ; movdqa 0x2847(%rip),%xmm0 # 6290 <_sk_callback_sse2+0xcb6>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,69,40,0,0 ; mulps 0x2845(%rip),%xmm0 # 6270 <_sk_callback_sse2+0xcca>
- DB 102,15,111,13,77,40,0,0 ; movdqa 0x284d(%rip),%xmm1 # 6280 <_sk_callback_sse2+0xcda>
+ DB 15,89,5,73,40,0,0 ; mulps 0x2849(%rip),%xmm0 # 62a0 <_sk_callback_sse2+0xcc6>
+ DB 102,15,111,13,81,40,0,0 ; movdqa 0x2851(%rip),%xmm1 # 62b0 <_sk_callback_sse2+0xcd6>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,79,40,0,0 ; mulps 0x284f(%rip),%xmm1 # 6290 <_sk_callback_sse2+0xcea>
- DB 102,15,111,21,87,40,0,0 ; movdqa 0x2857(%rip),%xmm2 # 62a0 <_sk_callback_sse2+0xcfa>
+ DB 15,89,13,83,40,0,0 ; mulps 0x2853(%rip),%xmm1 # 62c0 <_sk_callback_sse2+0xce6>
+ DB 102,15,111,21,91,40,0,0 ; movdqa 0x285b(%rip),%xmm2 # 62d0 <_sk_callback_sse2+0xcf6>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,89,40,0,0 ; mulps 0x2859(%rip),%xmm2 # 62b0 <_sk_callback_sse2+0xd0a>
- DB 102,15,219,29,97,40,0,0 ; pand 0x2861(%rip),%xmm3 # 62c0 <_sk_callback_sse2+0xd1a>
+ DB 15,89,21,93,40,0,0 ; mulps 0x285d(%rip),%xmm2 # 62e0 <_sk_callback_sse2+0xd06>
+ DB 102,15,219,29,101,40,0,0 ; pand 0x2865(%rip),%xmm3 # 62f0 <_sk_callback_sse2+0xd16>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,103,40,0,0 ; mulps 0x2867(%rip),%xmm3 # 62d0 <_sk_callback_sse2+0xd2a>
+ DB 15,89,29,107,40,0,0 ; mulps 0x286b(%rip),%xmm3 # 6300 <_sk_callback_sse2+0xd26>
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_4444_sse2
_sk_store_4444_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 68,15,40,5,102,40,0,0 ; movaps 0x2866(%rip),%xmm8 # 62e0 <_sk_callback_sse2+0xd3a>
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 68,15,40,5,105,40,0,0 ; movaps 0x2869(%rip),%xmm8 # 6310 <_sk_callback_sse2+0xd36>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -22602,40 +22672,40 @@ _sk_store_4444_sse2 LABEL PROC
DB 102,65,15,114,240,16 ; pslld $0x10,%xmm8
DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8
DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3aeb <_sk_store_4444_sse2+0x7e>
- DB 242,69,15,17,4,121 ; movsd %xmm8,(%r9,%rdi,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3b18 <_sk_store_4444_sse2+0x7e>
+ DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,36 ; je 3b21 <_sk_store_4444_sse2+0xb4>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,18 ; je 3b15 <_sk_store_4444_sse2+0xa8>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,222 ; jne 3ae7 <_sk_store_4444_sse2+0x7a>
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,36 ; je 3b4e <_sk_store_4444_sse2+0xb4>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,18 ; je 3b42 <_sk_store_4444_sse2+0xa8>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,222 ; jne 3b14 <_sk_store_4444_sse2+0x7a>
DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax
- DB 102,65,137,68,121,4 ; mov %ax,0x4(%r9,%rdi,2)
+ DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2)
DB 102,65,15,197,192,2 ; pextrw $0x2,%xmm8,%eax
- DB 102,65,137,68,121,2 ; mov %ax,0x2(%r9,%rdi,2)
+ DB 102,65,137,68,82,2 ; mov %ax,0x2(%r10,%rdx,2)
DB 102,68,15,126,192 ; movd %xmm8,%eax
- DB 102,65,137,4,121 ; mov %ax,(%r9,%rdi,2)
- DB 235,186 ; jmp 3ae7 <_sk_store_4444_sse2+0x7a>
+ DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2)
+ DB 235,186 ; jmp 3b14 <_sk_store_4444_sse2+0x7a>
PUBLIC _sk_load_8888_sse2
_sk_load_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,98 ; jne 3b99 <_sk_load_8888_sse2+0x6c>
- DB 243,68,15,111,12,184 ; movdqu (%rax,%rdi,4),%xmm9
- DB 102,15,111,21,171,39,0,0 ; movdqa 0x27ab(%rip),%xmm2 # 62f0 <_sk_callback_sse2+0xd4a>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,98 ; jne 3bc6 <_sk_load_8888_sse2+0x6c>
+ DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9
+ DB 102,15,111,21,174,39,0,0 ; movdqa 0x27ae(%rip),%xmm2 # 6320 <_sk_callback_sse2+0xd46>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,167,39,0,0 ; movaps 0x27a7(%rip),%xmm8 # 6300 <_sk_callback_sse2+0xd5a>
+ DB 68,15,40,5,170,39,0,0 ; movaps 0x27aa(%rip),%xmm8 # 6330 <_sk_callback_sse2+0xd56>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -22652,29 +22722,30 @@ _sk_load_8888_sse2 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,44 ; je 3bd7 <_sk_load_8888_sse2+0xaa>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,18 ; je 3bc3 <_sk_load_8888_sse2+0x96>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,134 ; jne 3b3d <_sk_load_8888_sse2+0x10>
- DB 102,15,110,68,184,8 ; movd 0x8(%rax,%rdi,4),%xmm0
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,44 ; je 3c04 <_sk_load_8888_sse2+0xaa>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,18 ; je 3bf0 <_sk_load_8888_sse2+0x96>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,134 ; jne 3b6a <_sk_load_8888_sse2+0x10>
+ DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9
- DB 243,15,16,68,184,4 ; movss 0x4(%rax,%rdi,4),%xmm0
+ DB 243,15,16,68,144,4 ; movss 0x4(%rax,%rdx,4),%xmm0
DB 65,15,198,193,0 ; shufps $0x0,%xmm9,%xmm0
DB 65,15,198,193,226 ; shufps $0xe2,%xmm9,%xmm0
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 243,15,16,4,184 ; movss (%rax,%rdi,4),%xmm0
+ DB 243,15,16,4,144 ; movss (%rax,%rdx,4),%xmm0
DB 243,68,15,16,200 ; movss %xmm0,%xmm9
- DB 233,87,255,255,255 ; jmpq 3b3d <_sk_load_8888_sse2+0x10>
+ DB 233,87,255,255,255 ; jmpq 3b6a <_sk_load_8888_sse2+0x10>
PUBLIC _sk_gather_8888_sse2
_sk_gather_8888_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22688,23 +22759,23 @@ _sk_gather_8888_sse2 LABEL PROC
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,67,15,110,4,144 ; movd (%r8,%r10,4),%xmm0
- DB 102,65,15,110,12,128 ; movd (%r8,%rax,4),%xmm1
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 102,67,15,110,4,153 ; movd (%r9,%r11,4),%xmm0
+ DB 102,65,15,110,12,129 ; movd (%r9,%rax,4),%xmm1
DB 102,15,98,193 ; punpckldq %xmm1,%xmm0
- DB 102,71,15,110,12,152 ; movd (%r8,%r11,4),%xmm9
- DB 102,67,15,110,12,136 ; movd (%r8,%r9,4),%xmm1
+ DB 102,69,15,110,12,153 ; movd (%r9,%rbx,4),%xmm9
+ DB 102,67,15,110,12,145 ; movd (%r9,%r10,4),%xmm1
DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9
DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9
- DB 102,15,111,21,169,38,0,0 ; movdqa 0x26a9(%rip),%xmm2 # 6310 <_sk_callback_sse2+0xd6a>
+ DB 102,15,111,21,171,38,0,0 ; movdqa 0x26ab(%rip),%xmm2 # 6340 <_sk_callback_sse2+0xd66>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,165,38,0,0 ; movaps 0x26a5(%rip),%xmm8 # 6320 <_sk_callback_sse2+0xd7a>
+ DB 68,15,40,5,167,38,0,0 ; movaps 0x26a7(%rip),%xmm8 # 6350 <_sk_callback_sse2+0xd76>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -22720,13 +22791,14 @@ _sk_gather_8888_sse2 LABEL PROC
DB 65,15,91,217 ; cvtdq2ps %xmm9,%xmm3
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_8888_sse2
_sk_store_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,104,38,0,0 ; movaps 0x2668(%rip),%xmm8 # 6330 <_sk_callback_sse2+0xd8a>
+ DB 68,15,40,5,105,38,0,0 ; movaps 0x2669(%rip),%xmm8 # 6360 <_sk_callback_sse2+0xd86>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -22744,34 +22816,34 @@ _sk_store_8888_sse2 LABEL PROC
DB 102,65,15,114,240,24 ; pslld $0x18,%xmm8
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,10 ; jne 3d28 <_sk_store_8888_sse2+0x6d>
- DB 243,68,15,127,4,184 ; movdqu %xmm8,(%rax,%rdi,4)
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 255,224 ; jmpq *%rax
- DB 65,137,200 ; mov %ecx,%r8d
- DB 65,128,224,3 ; and $0x3,%r8b
- DB 65,128,248,1 ; cmp $0x1,%r8b
- DB 116,38 ; je 3d5b <_sk_store_8888_sse2+0xa0>
- DB 65,128,248,2 ; cmp $0x2,%r8b
- DB 116,19 ; je 3d4e <_sk_store_8888_sse2+0x93>
- DB 65,128,248,3 ; cmp $0x3,%r8b
- DB 117,227 ; jne 3d24 <_sk_store_8888_sse2+0x69>
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,10 ; jne 3d57 <_sk_store_8888_sse2+0x6d>
+ DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
+ DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 255,224 ; jmpq *%rax
+ DB 69,137,193 ; mov %r8d,%r9d
+ DB 65,128,225,3 ; and $0x3,%r9b
+ DB 65,128,249,1 ; cmp $0x1,%r9b
+ DB 116,38 ; je 3d8a <_sk_store_8888_sse2+0xa0>
+ DB 65,128,249,2 ; cmp $0x2,%r9b
+ DB 116,19 ; je 3d7d <_sk_store_8888_sse2+0x93>
+ DB 65,128,249,3 ; cmp $0x3,%r9b
+ DB 117,227 ; jne 3d53 <_sk_store_8888_sse2+0x69>
DB 102,69,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm9
- DB 102,68,15,126,76,184,8 ; movd %xmm9,0x8(%rax,%rdi,4)
+ DB 102,68,15,126,76,144,8 ; movd %xmm9,0x8(%rax,%rdx,4)
DB 102,69,15,112,200,229 ; pshufd $0xe5,%xmm8,%xmm9
- DB 102,68,15,126,76,184,4 ; movd %xmm9,0x4(%rax,%rdi,4)
- DB 102,68,15,126,4,184 ; movd %xmm8,(%rax,%rdi,4)
- DB 235,193 ; jmp 3d24 <_sk_store_8888_sse2+0x69>
+ DB 102,68,15,126,76,144,4 ; movd %xmm9,0x4(%rax,%rdx,4)
+ DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
+ DB 235,193 ; jmp 3d53 <_sk_store_8888_sse2+0x69>
PUBLIC _sk_load_f16_sse2
_sk_load_f16_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,96,1,0,0 ; jne 3ed1 <_sk_load_f16_sse2+0x16e>
- DB 102,15,16,4,248 ; movupd (%rax,%rdi,8),%xmm0
- DB 102,15,16,76,248,16 ; movupd 0x10(%rax,%rdi,8),%xmm1
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,96,1,0,0 ; jne 3f00 <_sk_load_f16_sse2+0x16e>
+ DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0
+ DB 102,15,16,76,208,16 ; movupd 0x10(%rax,%rdx,8),%xmm1
DB 102,68,15,40,192 ; movapd %xmm0,%xmm8
DB 102,68,15,97,193 ; punpcklwd %xmm1,%xmm8
DB 102,15,105,193 ; punpckhwd %xmm1,%xmm0
@@ -22781,7 +22853,7 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1
DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1
- DB 102,68,15,111,13,143,37,0,0 ; movdqa 0x258f(%rip),%xmm9 # 6340 <_sk_callback_sse2+0xd9a>
+ DB 102,68,15,111,13,144,37,0,0 ; movdqa 0x2590(%rip),%xmm9 # 6370 <_sk_callback_sse2+0xd96>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,193 ; pand %xmm9,%xmm0
DB 102,15,239,200 ; pxor %xmm0,%xmm1
@@ -22789,11 +22861,11 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13
DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13
DB 102,68,15,235,232 ; por %xmm0,%xmm13
- DB 102,68,15,111,29,116,37,0,0 ; movdqa 0x2574(%rip),%xmm11 # 6350 <_sk_callback_sse2+0xdaa>
+ DB 102,68,15,111,29,117,37,0,0 ; movdqa 0x2575(%rip),%xmm11 # 6380 <_sk_callback_sse2+0xda6>
DB 102,69,15,254,235 ; paddd %xmm11,%xmm13
- DB 102,68,15,111,37,118,37,0,0 ; movdqa 0x2576(%rip),%xmm12 # 6360 <_sk_callback_sse2+0xdba>
+ DB 102,68,15,111,37,119,37,0,0 ; movdqa 0x2577(%rip),%xmm12 # 6390 <_sk_callback_sse2+0xdb6>
DB 102,65,15,239,204 ; pxor %xmm12,%xmm1
- DB 102,15,111,29,121,37,0,0 ; movdqa 0x2579(%rip),%xmm3 # 6370 <_sk_callback_sse2+0xdca>
+ DB 102,15,111,29,122,37,0,0 ; movdqa 0x257a(%rip),%xmm3 # 63a0 <_sk_callback_sse2+0xdc6>
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0
DB 102,65,15,223,197 ; pandn %xmm13,%xmm0
@@ -22839,24 +22911,25 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,65,15,223,218 ; pandn %xmm10,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 242,15,16,4,248 ; movsd (%rax,%rdi,8),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,17 ; jne 3eed <_sk_load_f16_sse2+0x18a>
+ DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,17 ; jne 3f1c <_sk_load_f16_sse2+0x18a>
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 233,143,254,255,255 ; jmpq 3d7c <_sk_load_f16_sse2+0x19>
- DB 102,15,22,68,248,8 ; movhpd 0x8(%rax,%rdi,8),%xmm0
+ DB 233,143,254,255,255 ; jmpq 3dab <_sk_load_f16_sse2+0x19>
+ DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,123,254,255,255 ; jb 3d7c <_sk_load_f16_sse2+0x19>
- DB 242,15,16,76,248,16 ; movsd 0x10(%rax,%rdi,8),%xmm1
- DB 233,112,254,255,255 ; jmpq 3d7c <_sk_load_f16_sse2+0x19>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,123,254,255,255 ; jb 3dab <_sk_load_f16_sse2+0x19>
+ DB 242,15,16,76,208,16 ; movsd 0x10(%rax,%rdx,8),%xmm1
+ DB 233,112,254,255,255 ; jmpq 3dab <_sk_load_f16_sse2+0x19>
PUBLIC _sk_gather_f16_sse2
_sk_gather_f16_sse2 LABEL PROC
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
@@ -22870,16 +22943,16 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,15,254,193 ; paddd %xmm1,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 65,137,193 ; mov %eax,%r9d
+ DB 65,137,194 ; mov %eax,%r10d
DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,73,15,126,194 ; movq %xmm0,%r10
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 243,67,15,126,4,208 ; movq (%r8,%r10,8),%xmm0
- DB 243,67,15,126,12,216 ; movq (%r8,%r11,8),%xmm1
+ DB 102,73,15,126,195 ; movq %xmm0,%r11
+ DB 68,137,219 ; mov %r11d,%ebx
+ DB 73,193,235,32 ; shr $0x20,%r11
+ DB 243,67,15,126,4,217 ; movq (%r9,%r11,8),%xmm0
+ DB 243,65,15,126,12,217 ; movq (%r9,%rbx,8),%xmm1
DB 102,15,108,200 ; punpcklqdq %xmm0,%xmm1
- DB 243,65,15,126,4,192 ; movq (%r8,%rax,8),%xmm0
- DB 243,67,15,126,20,200 ; movq (%r8,%r9,8),%xmm2
+ DB 243,65,15,126,4,193 ; movq (%r9,%rax,8),%xmm0
+ DB 243,67,15,126,20,209 ; movq (%r9,%r10,8),%xmm2
DB 102,15,108,208 ; punpcklqdq %xmm0,%xmm2
DB 102,68,15,111,193 ; movdqa %xmm1,%xmm8
DB 102,68,15,97,194 ; punpcklwd %xmm2,%xmm8
@@ -22890,7 +22963,7 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1
DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1
- DB 102,68,15,111,13,204,35,0,0 ; movdqa 0x23cc(%rip),%xmm9 # 6380 <_sk_callback_sse2+0xdda>
+ DB 102,68,15,111,13,204,35,0,0 ; movdqa 0x23cc(%rip),%xmm9 # 63b0 <_sk_callback_sse2+0xdd6>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,193 ; pand %xmm9,%xmm0
DB 102,15,239,200 ; pxor %xmm0,%xmm1
@@ -22898,11 +22971,11 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13
DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13
DB 102,68,15,235,232 ; por %xmm0,%xmm13
- DB 102,68,15,111,29,177,35,0,0 ; movdqa 0x23b1(%rip),%xmm11 # 6390 <_sk_callback_sse2+0xdea>
+ DB 102,68,15,111,29,177,35,0,0 ; movdqa 0x23b1(%rip),%xmm11 # 63c0 <_sk_callback_sse2+0xde6>
DB 102,69,15,254,235 ; paddd %xmm11,%xmm13
- DB 102,68,15,111,37,179,35,0,0 ; movdqa 0x23b3(%rip),%xmm12 # 63a0 <_sk_callback_sse2+0xdfa>
+ DB 102,68,15,111,37,179,35,0,0 ; movdqa 0x23b3(%rip),%xmm12 # 63d0 <_sk_callback_sse2+0xdf6>
DB 102,65,15,239,204 ; pxor %xmm12,%xmm1
- DB 102,15,111,29,182,35,0,0 ; movdqa 0x23b6(%rip),%xmm3 # 63b0 <_sk_callback_sse2+0xe0a>
+ DB 102,15,111,29,182,35,0,0 ; movdqa 0x23b6(%rip),%xmm3 # 63e0 <_sk_callback_sse2+0xe06>
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0
DB 102,65,15,223,197 ; pandn %xmm13,%xmm0
@@ -22947,23 +23020,24 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,65,15,102,216 ; pcmpgtd %xmm8,%xmm3
DB 102,65,15,223,218 ; pandn %xmm10,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
+ DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_f16_sse2
_sk_store_f16_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 102,68,15,111,21,222,34,0,0 ; movdqa 0x22de(%rip),%xmm10 # 63c0 <_sk_callback_sse2+0xe1a>
+ DB 102,68,15,111,21,221,34,0,0 ; movdqa 0x22dd(%rip),%xmm10 # 63f0 <_sk_callback_sse2+0xe16>
DB 102,68,15,111,224 ; movdqa %xmm0,%xmm12
DB 102,69,15,219,226 ; pand %xmm10,%xmm12
DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13
DB 102,69,15,239,236 ; pxor %xmm12,%xmm13
- DB 102,68,15,111,13,209,34,0,0 ; movdqa 0x22d1(%rip),%xmm9 # 63d0 <_sk_callback_sse2+0xe2a>
+ DB 102,68,15,111,13,208,34,0,0 ; movdqa 0x22d0(%rip),%xmm9 # 6400 <_sk_callback_sse2+0xe26>
DB 102,65,15,114,212,16 ; psrld $0x10,%xmm12
DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8
DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8
DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13
- DB 102,68,15,111,29,194,34,0,0 ; movdqa 0x22c2(%rip),%xmm11 # 63e0 <_sk_callback_sse2+0xe3a>
+ DB 102,68,15,111,29,193,34,0,0 ; movdqa 0x22c1(%rip),%xmm11 # 6410 <_sk_callback_sse2+0xe36>
DB 102,69,15,235,227 ; por %xmm11,%xmm12
DB 102,69,15,254,229 ; paddd %xmm13,%xmm12
DB 102,65,15,114,244,16 ; pslld $0x10,%xmm12
@@ -23014,32 +23088,32 @@ _sk_store_f16_sse2 LABEL PROC
DB 102,69,15,97,225 ; punpcklwd %xmm9,%xmm12
DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9
DB 102,69,15,98,204 ; punpckldq %xmm12,%xmm9
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,21 ; jne 4240 <_sk_store_f16_sse2+0x16c>
- DB 68,15,17,12,248 ; movups %xmm9,(%rax,%rdi,8)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,21 ; jne 4271 <_sk_store_f16_sse2+0x16c>
+ DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8)
DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8
- DB 243,68,15,127,68,248,16 ; movdqu %xmm8,0x10(%rax,%rdi,8)
+ DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 102,68,15,214,12,248 ; movq %xmm9,(%rax,%rdi,8)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 423c <_sk_store_f16_sse2+0x168>
- DB 102,68,15,23,76,248,8 ; movhpd %xmm9,0x8(%rax,%rdi,8)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 423c <_sk_store_f16_sse2+0x168>
+ DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 426d <_sk_store_f16_sse2+0x168>
+ DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 426d <_sk_store_f16_sse2+0x168>
DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8
- DB 102,68,15,214,68,248,16 ; movq %xmm8,0x10(%rax,%rdi,8)
- DB 235,213 ; jmp 423c <_sk_store_f16_sse2+0x168>
+ DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8)
+ DB 235,213 ; jmp 426d <_sk_store_f16_sse2+0x168>
PUBLIC _sk_load_u16_be_sse2
_sk_load_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,190,0,0,0 ; jne 433b <_sk_load_u16_be_sse2+0xd4>
- DB 102,65,15,16,4,64 ; movupd (%r8,%rax,2),%xmm0
- DB 102,65,15,16,76,64,16 ; movupd 0x10(%r8,%rax,2),%xmm1
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,190,0,0,0 ; jne 436c <_sk_load_u16_be_sse2+0xd4>
+ DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0
+ DB 102,65,15,16,76,65,16 ; movupd 0x10(%r9,%rax,2),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
DB 102,15,97,209 ; punpcklwd %xmm1,%xmm2
DB 102,15,105,193 ; punpckhwd %xmm1,%xmm0
@@ -23054,7 +23128,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0
- DB 68,15,40,5,34,33,0,0 ; movaps 0x2122(%rip),%xmm8 # 63f0 <_sk_callback_sse2+0xe4a>
+ DB 68,15,40,5,33,33,0,0 ; movaps 0x2121(%rip),%xmm8 # 6420 <_sk_callback_sse2+0xe46>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -23080,29 +23154,29 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 65,15,89,216 ; mulps %xmm8,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 242,65,15,16,4,64 ; movsd (%r8,%rax,2),%xmm0
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,17 ; jne 4358 <_sk_load_u16_be_sse2+0xf1>
+ DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,17 ; jne 4389 <_sk_load_u16_be_sse2+0xf1>
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 233,50,255,255,255 ; jmpq 428a <_sk_load_u16_be_sse2+0x23>
- DB 102,65,15,22,68,64,8 ; movhpd 0x8(%r8,%rax,2),%xmm0
+ DB 233,50,255,255,255 ; jmpq 42bb <_sk_load_u16_be_sse2+0x23>
+ DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 15,130,29,255,255,255 ; jb 428a <_sk_load_u16_be_sse2+0x23>
- DB 242,65,15,16,76,64,16 ; movsd 0x10(%r8,%rax,2),%xmm1
- DB 233,17,255,255,255 ; jmpq 428a <_sk_load_u16_be_sse2+0x23>
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 15,130,29,255,255,255 ; jb 42bb <_sk_load_u16_be_sse2+0x23>
+ DB 242,65,15,16,76,65,16 ; movsd 0x10(%r9,%rax,2),%xmm1
+ DB 233,17,255,255,255 ; jmpq 42bb <_sk_load_u16_be_sse2+0x23>
PUBLIC _sk_load_rgb_u16_be_sse2
_sk_load_rgb_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,127 ; lea (%rdi,%rdi,2),%rax
- DB 72,133,201 ; test %rcx,%rcx
- DB 15,133,175,0,0,0 ; jne 443a <_sk_load_rgb_u16_be_sse2+0xc1>
- DB 243,65,15,111,20,64 ; movdqu (%r8,%rax,2),%xmm2
- DB 243,65,15,111,92,64,8 ; movdqu 0x8(%r8,%rax,2),%xmm3
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
+ DB 77,133,192 ; test %r8,%r8
+ DB 15,133,175,0,0,0 ; jne 446b <_sk_load_rgb_u16_be_sse2+0xc1>
+ DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2
+ DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3
DB 102,15,115,219,4 ; psrldq $0x4,%xmm3
DB 102,15,111,194 ; movdqa %xmm2,%xmm0
DB 102,15,115,216,6 ; psrldq $0x6,%xmm0
@@ -23121,7 +23195,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
DB 102,65,15,97,200 ; punpcklwd %xmm8,%xmm1
DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0
- DB 68,15,40,13,17,32,0,0 ; movaps 0x2011(%rip),%xmm9 # 6400 <_sk_callback_sse2+0xe5a>
+ DB 68,15,40,13,16,32,0,0 ; movaps 0x2010(%rip),%xmm9 # 6430 <_sk_callback_sse2+0xe56>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -23138,34 +23212,34 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,216,31,0,0 ; movaps 0x1fd8(%rip),%xmm3 # 6410 <_sk_callback_sse2+0xe6a>
+ DB 15,40,29,215,31,0,0 ; movaps 0x1fd7(%rip),%xmm3 # 6440 <_sk_callback_sse2+0xe66>
DB 255,224 ; jmpq *%rax
- DB 102,65,15,110,20,64 ; movd (%r8,%rax,2),%xmm2
- DB 102,65,15,196,84,64,4,2 ; pinsrw $0x2,0x4(%r8,%rax,2),%xmm2
+ DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2
+ DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,13 ; jne 445f <_sk_load_rgb_u16_be_sse2+0xe6>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,13 ; jne 4490 <_sk_load_rgb_u16_be_sse2+0xe6>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,80,255,255,255 ; jmpq 43af <_sk_load_rgb_u16_be_sse2+0x36>
- DB 102,65,15,110,68,64,6 ; movd 0x6(%r8,%rax,2),%xmm0
- DB 102,65,15,196,68,64,10,2 ; pinsrw $0x2,0xa(%r8,%rax,2),%xmm0
+ DB 233,80,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0
+ DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,24 ; jb 4490 <_sk_load_rgb_u16_be_sse2+0x117>
- DB 102,65,15,110,92,64,12 ; movd 0xc(%r8,%rax,2),%xmm3
- DB 102,65,15,196,92,64,16,2 ; pinsrw $0x2,0x10(%r8,%rax,2),%xmm3
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,24 ; jb 44c1 <_sk_load_rgb_u16_be_sse2+0x117>
+ DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3
+ DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,31,255,255,255 ; jmpq 43af <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 233,31,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 233,22,255,255,255 ; jmpq 43af <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 233,22,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36>
PUBLIC _sk_store_u16_be_sse2
_sk_store_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
- DB 72,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%rax
- DB 68,15,40,21,114,31,0,0 ; movaps 0x1f72(%rip),%xmm10 # 6420 <_sk_callback_sse2+0xe7a>
+ DB 76,139,8 ; mov (%rax),%r9
+ DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
+ DB 68,15,40,21,113,31,0,0 ; movaps 0x1f71(%rip),%xmm10 # 6450 <_sk_callback_sse2+0xe76>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
@@ -23209,36 +23283,36 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 102,69,15,97,202 ; punpcklwd %xmm10,%xmm9
DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10
DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,21 ; jne 45a8 <_sk_store_u16_be_sse2+0x10f>
- DB 69,15,17,20,64 ; movups %xmm10,(%r8,%rax,2)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,21 ; jne 45d9 <_sk_store_u16_be_sse2+0x10f>
+ DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2)
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
- DB 243,69,15,127,68,64,16 ; movdqu %xmm8,0x10(%r8,%rax,2)
+ DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 102,69,15,214,20,64 ; movq %xmm10,(%r8,%rax,2)
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,240 ; je 45a4 <_sk_store_u16_be_sse2+0x10b>
- DB 102,69,15,23,84,64,8 ; movhpd %xmm10,0x8(%r8,%rax,2)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,227 ; jb 45a4 <_sk_store_u16_be_sse2+0x10b>
+ DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2)
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,240 ; je 45d5 <_sk_store_u16_be_sse2+0x10b>
+ DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,227 ; jb 45d5 <_sk_store_u16_be_sse2+0x10b>
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
- DB 102,69,15,214,68,64,16 ; movq %xmm8,0x10(%r8,%rax,2)
- DB 235,213 ; jmp 45a4 <_sk_store_u16_be_sse2+0x10b>
+ DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2)
+ DB 235,213 ; jmp 45d5 <_sk_store_u16_be_sse2+0x10b>
PUBLIC _sk_load_f32_sse2
_sk_load_f32_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r8
- DB 72,137,248 ; mov %rdi,%rax
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 76,141,12,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r9
+ DB 72,137,208 ; mov %rdx,%rax
DB 72,193,224,4 ; shl $0x4,%rax
- DB 69,15,16,4,1 ; movups (%r9,%rax,1),%xmm8
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,66 ; jne 462f <_sk_load_f32_sse2+0x60>
- DB 67,15,16,68,129,16 ; movups 0x10(%r9,%r8,4),%xmm0
- DB 67,15,16,92,129,32 ; movups 0x20(%r9,%r8,4),%xmm3
- DB 71,15,16,76,129,48 ; movups 0x30(%r9,%r8,4),%xmm9
+ DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,66 ; jne 4660 <_sk_load_f32_sse2+0x60>
+ DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
+ DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
+ DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
DB 65,15,40,208 ; movaps %xmm8,%xmm2
DB 15,20,208 ; unpcklps %xmm0,%xmm2
DB 15,40,203 ; movaps %xmm3,%xmm1
@@ -23254,25 +23328,25 @@ _sk_load_f32_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 117,8 ; jne 4641 <_sk_load_f32_sse2+0x72>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 117,8 ; jne 4672 <_sk_load_f32_sse2+0x72>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
- DB 235,190 ; jmp 45ff <_sk_load_f32_sse2+0x30>
- DB 67,15,16,68,129,16 ; movups 0x10(%r9,%r8,4),%xmm0
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,8 ; jb 4655 <_sk_load_f32_sse2+0x86>
- DB 67,15,16,92,129,32 ; movups 0x20(%r9,%r8,4),%xmm3
- DB 235,170 ; jmp 45ff <_sk_load_f32_sse2+0x30>
+ DB 235,190 ; jmp 4630 <_sk_load_f32_sse2+0x30>
+ DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,8 ; jb 4686 <_sk_load_f32_sse2+0x86>
+ DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
+ DB 235,170 ; jmp 4630 <_sk_load_f32_sse2+0x30>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 235,165 ; jmp 45ff <_sk_load_f32_sse2+0x30>
+ DB 235,165 ; jmp 4630 <_sk_load_f32_sse2+0x30>
PUBLIC _sk_store_f32_sse2
_sk_store_f32_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,8 ; mov (%rax),%r9
- DB 76,141,4,189,0,0,0,0 ; lea 0x0(,%rdi,4),%r8
- DB 72,137,248 ; mov %rdi,%rax
+ DB 76,139,16 ; mov (%rax),%r10
+ DB 76,141,12,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r9
+ DB 72,137,208 ; mov %rdx,%rax
DB 72,193,224,4 ; shl $0x4,%rax
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 68,15,20,201 ; unpcklps %xmm1,%xmm9
@@ -23287,22 +23361,22 @@ _sk_store_f32_sse2 LABEL PROC
DB 69,15,18,193 ; movhlps %xmm9,%xmm8
DB 69,15,40,202 ; movaps %xmm10,%xmm9
DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9
- DB 102,69,15,17,36,1 ; movupd %xmm12,(%r9,%rax,1)
- DB 72,133,201 ; test %rcx,%rcx
- DB 117,29 ; jne 46cc <_sk_store_f32_sse2+0x72>
+ DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1)
+ DB 77,133,192 ; test %r8,%r8
+ DB 117,29 ; jne 46fd <_sk_store_f32_sse2+0x72>
DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10
- DB 71,15,17,68,129,16 ; movups %xmm8,0x10(%r9,%r8,4)
- DB 102,71,15,17,76,129,32 ; movupd %xmm9,0x20(%r9,%r8,4)
- DB 102,71,15,17,84,129,48 ; movupd %xmm10,0x30(%r9,%r8,4)
+ DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
+ DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
+ DB 102,71,15,17,84,138,48 ; movupd %xmm10,0x30(%r10,%r9,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
- DB 72,131,249,1 ; cmp $0x1,%rcx
- DB 116,246 ; je 46c8 <_sk_store_f32_sse2+0x6e>
- DB 71,15,17,68,129,16 ; movups %xmm8,0x10(%r9,%r8,4)
- DB 72,131,249,3 ; cmp $0x3,%rcx
- DB 114,234 ; jb 46c8 <_sk_store_f32_sse2+0x6e>
- DB 102,71,15,17,76,129,32 ; movupd %xmm9,0x20(%r9,%r8,4)
- DB 235,225 ; jmp 46c8 <_sk_store_f32_sse2+0x6e>
+ DB 73,131,248,1 ; cmp $0x1,%r8
+ DB 116,246 ; je 46f9 <_sk_store_f32_sse2+0x6e>
+ DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
+ DB 73,131,248,3 ; cmp $0x3,%r8
+ DB 114,234 ; jb 46f9 <_sk_store_f32_sse2+0x6e>
+ DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
+ DB 235,225 ; jmp 46f9 <_sk_store_f32_sse2+0x6e>
PUBLIC _sk_clamp_x_sse2
_sk_clamp_x_sse2 LABEL PROC
@@ -23338,7 +23412,7 @@ _sk_repeat_x_sse2 LABEL PROC
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,227,28,0,0 ; andps 0x1ce3(%rip),%xmm9 # 6430 <_sk_callback_sse2+0xe8a>
+ DB 68,15,84,13,226,28,0,0 ; andps 0x1ce2(%rip),%xmm9 # 6460 <_sk_callback_sse2+0xe86>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,92,194 ; subps %xmm10,%xmm0
@@ -23355,7 +23429,7 @@ _sk_repeat_y_sse2 LABEL PROC
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,185,28,0,0 ; andps 0x1cb9(%rip),%xmm9 # 6440 <_sk_callback_sse2+0xe9a>
+ DB 68,15,84,13,184,28,0,0 ; andps 0x1cb8(%rip),%xmm9 # 6470 <_sk_callback_sse2+0xe96>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,92,202 ; subps %xmm10,%xmm1
@@ -23376,7 +23450,7 @@ _sk_mirror_x_sse2 LABEL PROC
DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11
DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11
DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10
- DB 68,15,84,21,125,28,0,0 ; andps 0x1c7d(%rip),%xmm10 # 6450 <_sk_callback_sse2+0xeaa>
+ DB 68,15,84,21,124,28,0,0 ; andps 0x1c7c(%rip),%xmm10 # 6480 <_sk_callback_sse2+0xea6>
DB 69,15,87,228 ; xorps %xmm12,%xmm12
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 69,15,89,216 ; mulps %xmm8,%xmm11
@@ -23401,7 +23475,7 @@ _sk_mirror_y_sse2 LABEL PROC
DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11
DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11
DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10
- DB 68,15,84,21,49,28,0,0 ; andps 0x1c31(%rip),%xmm10 # 6460 <_sk_callback_sse2+0xeba>
+ DB 68,15,84,21,48,28,0,0 ; andps 0x1c30(%rip),%xmm10 # 6490 <_sk_callback_sse2+0xeb6>
DB 69,15,87,228 ; xorps %xmm12,%xmm12
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 69,15,89,216 ; mulps %xmm8,%xmm11
@@ -23416,7 +23490,7 @@ PUBLIC _sk_clamp_x_1_sse2
_sk_clamp_x_1_sse2 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,17,28,0,0 ; minps 0x1c11(%rip),%xmm8 # 6470 <_sk_callback_sse2+0xeca>
+ DB 68,15,93,5,16,28,0,0 ; minps 0x1c10(%rip),%xmm8 # 64a0 <_sk_callback_sse2+0xec6>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -23427,7 +23501,7 @@ _sk_repeat_x_1_sse2 LABEL PROC
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9
- DB 68,15,84,13,255,27,0,0 ; andps 0x1bff(%rip),%xmm9 # 6480 <_sk_callback_sse2+0xeda>
+ DB 68,15,84,13,254,27,0,0 ; andps 0x1bfe(%rip),%xmm9 # 64b0 <_sk_callback_sse2+0xed6>
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 65,15,92,192 ; subps %xmm8,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -23435,14 +23509,14 @@ _sk_repeat_x_1_sse2 LABEL PROC
PUBLIC _sk_mirror_x_1_sse2
_sk_mirror_x_1_sse2 LABEL PROC
- DB 68,15,40,5,251,27,0,0 ; movaps 0x1bfb(%rip),%xmm8 # 6490 <_sk_callback_sse2+0xeea>
+ DB 68,15,40,5,250,27,0,0 ; movaps 0x1bfa(%rip),%xmm8 # 64c0 <_sk_callback_sse2+0xee6>
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,13,255,27,0,0 ; movaps 0x1bff(%rip),%xmm9 # 64a0 <_sk_callback_sse2+0xefa>
+ DB 68,15,40,13,254,27,0,0 ; movaps 0x1bfe(%rip),%xmm9 # 64d0 <_sk_callback_sse2+0xef6>
DB 68,15,89,200 ; mulps %xmm0,%xmm9
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,245,27,0,0 ; andps 0x1bf5(%rip),%xmm9 # 64b0 <_sk_callback_sse2+0xf0a>
+ DB 68,15,84,13,244,27,0,0 ; andps 0x1bf4(%rip),%xmm9 # 64e0 <_sk_callback_sse2+0xf06>
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,88,210 ; addps %xmm10,%xmm10
@@ -23456,10 +23530,10 @@ _sk_mirror_x_1_sse2 LABEL PROC
PUBLIC _sk_luminance_to_alpha_sse2
_sk_luminance_to_alpha_sse2 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 15,89,5,219,27,0,0 ; mulps 0x1bdb(%rip),%xmm0 # 64c0 <_sk_callback_sse2+0xf1a>
- DB 15,89,13,228,27,0,0 ; mulps 0x1be4(%rip),%xmm1 # 64d0 <_sk_callback_sse2+0xf2a>
+ DB 15,89,5,218,27,0,0 ; mulps 0x1bda(%rip),%xmm0 # 64f0 <_sk_callback_sse2+0xf16>
+ DB 15,89,13,227,27,0,0 ; mulps 0x1be3(%rip),%xmm1 # 6500 <_sk_callback_sse2+0xf26>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,29,234,27,0,0 ; mulps 0x1bea(%rip),%xmm3 # 64e0 <_sk_callback_sse2+0xf3a>
+ DB 15,89,29,233,27,0,0 ; mulps 0x1be9(%rip),%xmm3 # 6510 <_sk_callback_sse2+0xf36>
DB 15,88,217 ; addps %xmm1,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
@@ -23725,86 +23799,86 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
DB 72,139,24 ; mov (%rax),%rbx
DB 76,139,112,8 ; mov 0x8(%rax),%r14
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 4d32 <_sk_evenly_spaced_gradient_sse2+0x18>
+ DB 120,7 ; js 4d63 <_sk_evenly_spaced_gradient_sse2+0x18>
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
- DB 235,21 ; jmp 4d47 <_sk_evenly_spaced_gradient_sse2+0x2d>
- DB 73,137,216 ; mov %rbx,%r8
- DB 73,209,232 ; shr %r8
+ DB 235,21 ; jmp 4d78 <_sk_evenly_spaced_gradient_sse2+0x2d>
+ DB 73,137,217 ; mov %rbx,%r9
+ DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
- DB 76,9,195 ; or %r8,%rbx
+ DB 76,9,203 ; or %r9,%rbx
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
DB 243,15,88,201 ; addss %xmm1,%xmm1
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
DB 15,89,200 ; mulps %xmm0,%xmm1
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
- DB 102,73,15,126,210 ; movq %xmm2,%r10
- DB 69,137,208 ; mov %r10d,%r8d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 102,73,15,126,211 ; movq %xmm2,%r11
DB 69,137,217 ; mov %r11d,%r9d
DB 73,193,235,32 ; shr $0x20,%r11
- DB 243,67,15,16,12,158 ; movss (%r14,%r11,4),%xmm1
- DB 243,67,15,16,20,150 ; movss (%r14,%r10,4),%xmm2
+ DB 102,72,15,126,203 ; movq %xmm1,%rbx
+ DB 65,137,218 ; mov %ebx,%r10d
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 243,71,15,16,4,142 ; movss (%r14,%r9,4),%xmm8
- DB 243,67,15,16,20,134 ; movss (%r14,%r8,4),%xmm2
+ DB 243,71,15,16,4,150 ; movss (%r14,%r10,4),%xmm8
+ DB 243,67,15,16,20,142 ; movss (%r14,%r9,4),%xmm2
DB 68,15,20,194 ; unpcklps %xmm2,%xmm8
DB 68,15,20,193 ; unpcklps %xmm1,%xmm8
- DB 72,139,88,40 ; mov 0x28(%rax),%rbx
- DB 243,66,15,16,12,155 ; movss (%rbx,%r11,4),%xmm1
- DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
+ DB 76,139,112,40 ; mov 0x28(%rax),%r14
+ DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 243,70,15,16,12,139 ; movss (%rbx,%r9,4),%xmm9
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,71,15,16,12,150 ; movss (%r14,%r10,4),%xmm9
+ DB 243,67,15,16,20,142 ; movss (%r14,%r9,4),%xmm2
DB 68,15,20,202 ; unpcklps %xmm2,%xmm9
DB 68,15,20,201 ; unpcklps %xmm1,%xmm9
- DB 72,139,88,16 ; mov 0x10(%rax),%rbx
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
- DB 243,66,15,16,12,147 ; movss (%rbx,%r10,4),%xmm1
+ DB 76,139,112,16 ; mov 0x10(%rax),%r14
+ DB 243,65,15,16,20,158 ; movss (%r14,%rbx,4),%xmm2
+ DB 243,67,15,16,12,158 ; movss (%r14,%r11,4),%xmm1
DB 15,20,209 ; unpcklps %xmm1,%xmm2
- DB 243,66,15,16,12,139 ; movss (%rbx,%r9,4),%xmm1
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,67,15,16,12,150 ; movss (%r14,%r10,4),%xmm1
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 15,20,203 ; unpcklps %xmm3,%xmm1
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,48 ; mov 0x30(%rax),%r14
+ DB 243,65,15,16,20,158 ; movss (%r14,%rbx,4),%xmm2
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
- DB 243,70,15,16,20,139 ; movss (%rbx,%r9,4),%xmm10
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,71,15,16,20,150 ; movss (%r14,%r10,4),%xmm10
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 68,15,20,211 ; unpcklps %xmm3,%xmm10
DB 68,15,20,210 ; unpcklps %xmm2,%xmm10
- DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 243,70,15,16,28,155 ; movss (%rbx,%r11,4),%xmm11
- DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
+ DB 76,139,112,24 ; mov 0x18(%rax),%r14
+ DB 243,69,15,16,28,158 ; movss (%r14,%rbx,4),%xmm11
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 68,15,20,218 ; unpcklps %xmm2,%xmm11
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,67,15,16,20,150 ; movss (%r14,%r10,4),%xmm2
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,211 ; unpcklps %xmm11,%xmm2
- DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 243,70,15,16,36,155 ; movss (%rbx,%r11,4),%xmm12
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,56 ; mov 0x38(%rax),%r14
+ DB 243,69,15,16,36,158 ; movss (%r14,%rbx,4),%xmm12
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 68,15,20,227 ; unpcklps %xmm3,%xmm12
- DB 243,70,15,16,28,139 ; movss (%rbx,%r9,4),%xmm11
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,71,15,16,28,150 ; movss (%r14,%r10,4),%xmm11
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 68,15,20,219 ; unpcklps %xmm3,%xmm11
DB 69,15,20,220 ; unpcklps %xmm12,%xmm11
- DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 243,70,15,16,36,155 ; movss (%rbx,%r11,4),%xmm12
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,32 ; mov 0x20(%rax),%r14
+ DB 243,69,15,16,36,158 ; movss (%r14,%rbx,4),%xmm12
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 68,15,20,227 ; unpcklps %xmm3,%xmm12
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
- DB 243,70,15,16,44,131 ; movss (%rbx,%r8,4),%xmm13
+ DB 243,67,15,16,28,150 ; movss (%r14,%r10,4),%xmm3
+ DB 243,71,15,16,44,142 ; movss (%r14,%r9,4),%xmm13
DB 65,15,20,221 ; unpcklps %xmm13,%xmm3
DB 65,15,20,220 ; unpcklps %xmm12,%xmm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 243,70,15,16,36,152 ; movss (%rax,%r11,4),%xmm12
- DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
+ DB 243,68,15,16,36,152 ; movss (%rax,%rbx,4),%xmm12
+ DB 243,70,15,16,44,152 ; movss (%rax,%r11,4),%xmm13
DB 69,15,20,229 ; unpcklps %xmm13,%xmm12
- DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
- DB 243,70,15,16,52,128 ; movss (%rax,%r8,4),%xmm14
+ DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
+ DB 243,70,15,16,52,136 ; movss (%rax,%r9,4),%xmm14
DB 69,15,20,238 ; unpcklps %xmm14,%xmm13
DB 69,15,20,236 ; unpcklps %xmm12,%xmm13
DB 68,15,89,192 ; mulps %xmm0,%xmm8
@@ -23823,15 +23897,15 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_sse2
_sk_gauss_a_to_rgba_sse2 LABEL PROC
- DB 15,40,5,29,22,0,0 ; movaps 0x161d(%rip),%xmm0 # 64f0 <_sk_callback_sse2+0xf4a>
+ DB 15,40,5,28,22,0,0 ; movaps 0x161c(%rip),%xmm0 # 6520 <_sk_callback_sse2+0xf46>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,35,22,0,0 ; addps 0x1623(%rip),%xmm0 # 6500 <_sk_callback_sse2+0xf5a>
+ DB 15,88,5,34,22,0,0 ; addps 0x1622(%rip),%xmm0 # 6530 <_sk_callback_sse2+0xf56>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,41,22,0,0 ; addps 0x1629(%rip),%xmm0 # 6510 <_sk_callback_sse2+0xf6a>
+ DB 15,88,5,40,22,0,0 ; addps 0x1628(%rip),%xmm0 # 6540 <_sk_callback_sse2+0xf66>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,47,22,0,0 ; addps 0x162f(%rip),%xmm0 # 6520 <_sk_callback_sse2+0xf7a>
+ DB 15,88,5,46,22,0,0 ; addps 0x162e(%rip),%xmm0 # 6550 <_sk_callback_sse2+0xf76>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,53,22,0,0 ; addps 0x1635(%rip),%xmm0 # 6530 <_sk_callback_sse2+0xf8a>
+ DB 15,88,5,52,22,0,0 ; addps 0x1634(%rip),%xmm0 # 6560 <_sk_callback_sse2+0xf86>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
@@ -23840,95 +23914,96 @@ _sk_gauss_a_to_rgba_sse2 LABEL PROC
PUBLIC _sk_gradient_sse2
_sk_gradient_sse2 LABEL PROC
+ DB 65,87 ; push %r15
+ DB 65,86 ; push %r14
+ DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,0 ; mov (%rax),%r8
+ DB 76,139,8 ; mov (%rax),%r9
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 73,131,248,2 ; cmp $0x2,%r8
- DB 114,51 ; jb 4f4a <_sk_gradient_sse2+0x42>
- DB 76,139,72,72 ; mov 0x48(%rax),%r9
- DB 73,255,200 ; dec %r8
- DB 73,131,193,4 ; add $0x4,%r9
+ DB 73,131,249,2 ; cmp $0x2,%r9
+ DB 114,50 ; jb 4f7f <_sk_gradient_sse2+0x46>
+ DB 72,139,88,72 ; mov 0x48(%rax),%rbx
+ DB 73,255,201 ; dec %r9
+ DB 72,131,195,4 ; add $0x4,%rbx
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 15,40,21,19,22,0,0 ; movaps 0x1613(%rip),%xmm2 # 6540 <_sk_callback_sse2+0xf9a>
- DB 243,65,15,16,25 ; movss (%r9),%xmm3
+ DB 15,40,21,13,22,0,0 ; movaps 0x160d(%rip),%xmm2 # 6570 <_sk_callback_sse2+0xf96>
+ DB 243,15,16,27 ; movss (%rbx),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
DB 15,84,218 ; andps %xmm2,%xmm3
DB 102,15,254,203 ; paddd %xmm3,%xmm1
- DB 73,131,193,4 ; add $0x4,%r9
- DB 73,255,200 ; dec %r8
- DB 117,227 ; jne 4f2d <_sk_gradient_sse2+0x25>
- DB 65,86 ; push %r14
- DB 83 ; push %rbx
+ DB 72,131,195,4 ; add $0x4,%rbx
+ DB 73,255,201 ; dec %r9
+ DB 117,228 ; jne 4f63 <_sk_gradient_sse2+0x2a>
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
- DB 102,73,15,126,210 ; movq %xmm2,%r10
- DB 69,137,208 ; mov %r10d,%r8d
- DB 73,193,234,32 ; shr $0x20,%r10
- DB 102,73,15,126,203 ; movq %xmm1,%r11
+ DB 102,73,15,126,211 ; movq %xmm2,%r11
DB 69,137,217 ; mov %r11d,%r9d
DB 73,193,235,32 ; shr $0x20,%r11
- DB 72,139,88,8 ; mov 0x8(%rax),%rbx
- DB 76,139,112,16 ; mov 0x10(%rax),%r14
- DB 243,66,15,16,12,155 ; movss (%rbx,%r11,4),%xmm1
- DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
+ DB 102,72,15,126,203 ; movq %xmm1,%rbx
+ DB 65,137,218 ; mov %ebx,%r10d
+ DB 72,193,235,32 ; shr $0x20,%rbx
+ DB 76,139,112,8 ; mov 0x8(%rax),%r14
+ DB 76,139,120,16 ; mov 0x10(%rax),%r15
+ DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 243,70,15,16,4,139 ; movss (%rbx,%r9,4),%xmm8
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,71,15,16,4,150 ; movss (%r14,%r10,4),%xmm8
+ DB 243,67,15,16,20,142 ; movss (%r14,%r9,4),%xmm2
DB 68,15,20,194 ; unpcklps %xmm2,%xmm8
DB 68,15,20,193 ; unpcklps %xmm1,%xmm8
- DB 72,139,88,40 ; mov 0x28(%rax),%rbx
- DB 243,66,15,16,12,155 ; movss (%rbx,%r11,4),%xmm1
- DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
+ DB 76,139,112,40 ; mov 0x28(%rax),%r14
+ DB 243,65,15,16,12,158 ; movss (%r14,%rbx,4),%xmm1
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 243,70,15,16,12,139 ; movss (%rbx,%r9,4),%xmm9
- DB 243,66,15,16,20,131 ; movss (%rbx,%r8,4),%xmm2
+ DB 243,71,15,16,12,150 ; movss (%r14,%r10,4),%xmm9
+ DB 243,67,15,16,20,142 ; movss (%r14,%r9,4),%xmm2
DB 68,15,20,202 ; unpcklps %xmm2,%xmm9
DB 68,15,20,201 ; unpcklps %xmm1,%xmm9
- DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
- DB 243,67,15,16,12,150 ; movss (%r14,%r10,4),%xmm1
+ DB 243,65,15,16,20,159 ; movss (%r15,%rbx,4),%xmm2
+ DB 243,67,15,16,12,159 ; movss (%r15,%r11,4),%xmm1
DB 15,20,209 ; unpcklps %xmm1,%xmm2
- DB 243,67,15,16,12,142 ; movss (%r14,%r9,4),%xmm1
- DB 243,67,15,16,28,134 ; movss (%r14,%r8,4),%xmm3
+ DB 243,67,15,16,12,151 ; movss (%r15,%r10,4),%xmm1
+ DB 243,67,15,16,28,143 ; movss (%r15,%r9,4),%xmm3
DB 15,20,203 ; unpcklps %xmm3,%xmm1
DB 15,20,202 ; unpcklps %xmm2,%xmm1
- DB 72,139,88,48 ; mov 0x30(%rax),%rbx
- DB 243,66,15,16,20,155 ; movss (%rbx,%r11,4),%xmm2
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,48 ; mov 0x30(%rax),%r14
+ DB 243,65,15,16,20,158 ; movss (%r14,%rbx,4),%xmm2
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
- DB 243,70,15,16,20,139 ; movss (%rbx,%r9,4),%xmm10
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,71,15,16,20,150 ; movss (%r14,%r10,4),%xmm10
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 68,15,20,211 ; unpcklps %xmm3,%xmm10
DB 68,15,20,210 ; unpcklps %xmm2,%xmm10
- DB 72,139,88,24 ; mov 0x18(%rax),%rbx
- DB 243,70,15,16,28,155 ; movss (%rbx,%r11,4),%xmm11
- DB 243,66,15,16,20,147 ; movss (%rbx,%r10,4),%xmm2
+ DB 76,139,112,24 ; mov 0x18(%rax),%r14
+ DB 243,69,15,16,28,158 ; movss (%r14,%rbx,4),%xmm11
+ DB 243,67,15,16,20,158 ; movss (%r14,%r11,4),%xmm2
DB 68,15,20,218 ; unpcklps %xmm2,%xmm11
- DB 243,66,15,16,20,139 ; movss (%rbx,%r9,4),%xmm2
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,67,15,16,20,150 ; movss (%r14,%r10,4),%xmm2
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,211 ; unpcklps %xmm11,%xmm2
- DB 72,139,88,56 ; mov 0x38(%rax),%rbx
- DB 243,70,15,16,36,155 ; movss (%rbx,%r11,4),%xmm12
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,56 ; mov 0x38(%rax),%r14
+ DB 243,69,15,16,36,158 ; movss (%r14,%rbx,4),%xmm12
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 68,15,20,227 ; unpcklps %xmm3,%xmm12
- DB 243,70,15,16,28,139 ; movss (%rbx,%r9,4),%xmm11
- DB 243,66,15,16,28,131 ; movss (%rbx,%r8,4),%xmm3
+ DB 243,71,15,16,28,150 ; movss (%r14,%r10,4),%xmm11
+ DB 243,67,15,16,28,142 ; movss (%r14,%r9,4),%xmm3
DB 68,15,20,219 ; unpcklps %xmm3,%xmm11
DB 69,15,20,220 ; unpcklps %xmm12,%xmm11
- DB 72,139,88,32 ; mov 0x20(%rax),%rbx
- DB 243,70,15,16,36,155 ; movss (%rbx,%r11,4),%xmm12
- DB 243,66,15,16,28,147 ; movss (%rbx,%r10,4),%xmm3
+ DB 76,139,112,32 ; mov 0x20(%rax),%r14
+ DB 243,69,15,16,36,158 ; movss (%r14,%rbx,4),%xmm12
+ DB 243,67,15,16,28,158 ; movss (%r14,%r11,4),%xmm3
DB 68,15,20,227 ; unpcklps %xmm3,%xmm12
- DB 243,66,15,16,28,139 ; movss (%rbx,%r9,4),%xmm3
- DB 243,70,15,16,44,131 ; movss (%rbx,%r8,4),%xmm13
+ DB 243,67,15,16,28,150 ; movss (%r14,%r10,4),%xmm3
+ DB 243,71,15,16,44,142 ; movss (%r14,%r9,4),%xmm13
DB 65,15,20,221 ; unpcklps %xmm13,%xmm3
DB 65,15,20,220 ; unpcklps %xmm12,%xmm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
- DB 243,70,15,16,36,152 ; movss (%rax,%r11,4),%xmm12
- DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
+ DB 243,68,15,16,36,152 ; movss (%rax,%rbx,4),%xmm12
+ DB 243,70,15,16,44,152 ; movss (%rax,%r11,4),%xmm13
DB 69,15,20,229 ; unpcklps %xmm13,%xmm12
- DB 243,70,15,16,44,136 ; movss (%rax,%r9,4),%xmm13
- DB 243,70,15,16,52,128 ; movss (%rax,%r8,4),%xmm14
+ DB 243,70,15,16,44,144 ; movss (%rax,%r10,4),%xmm13
+ DB 243,70,15,16,52,136 ; movss (%rax,%r9,4),%xmm14
DB 69,15,20,238 ; unpcklps %xmm14,%xmm13
DB 69,15,20,236 ; unpcklps %xmm12,%xmm13
DB 68,15,89,192 ; mulps %xmm0,%xmm8
@@ -23943,6 +24018,7 @@ _sk_gradient_sse2 LABEL PROC
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
+ DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
PUBLIC _sk_evenly_spaced_2_stop_gradient_sse2
@@ -23993,29 +24069,29 @@ _sk_xy_to_unit_angle_sse2 LABEL PROC
DB 69,15,94,220 ; divps %xmm12,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
- DB 68,15,40,45,210,19,0,0 ; movaps 0x13d2(%rip),%xmm13 # 6550 <_sk_callback_sse2+0xfaa>
+ DB 68,15,40,45,206,19,0,0 ; movaps 0x13ce(%rip),%xmm13 # 6580 <_sk_callback_sse2+0xfa6>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,214,19,0,0 ; addps 0x13d6(%rip),%xmm13 # 6560 <_sk_callback_sse2+0xfba>
+ DB 68,15,88,45,210,19,0,0 ; addps 0x13d2(%rip),%xmm13 # 6590 <_sk_callback_sse2+0xfb6>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,218,19,0,0 ; addps 0x13da(%rip),%xmm13 # 6570 <_sk_callback_sse2+0xfca>
+ DB 68,15,88,45,214,19,0,0 ; addps 0x13d6(%rip),%xmm13 # 65a0 <_sk_callback_sse2+0xfc6>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,222,19,0,0 ; addps 0x13de(%rip),%xmm13 # 6580 <_sk_callback_sse2+0xfda>
+ DB 68,15,88,45,218,19,0,0 ; addps 0x13da(%rip),%xmm13 # 65b0 <_sk_callback_sse2+0xfd6>
DB 69,15,89,235 ; mulps %xmm11,%xmm13
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,40,21,221,19,0,0 ; movaps 0x13dd(%rip),%xmm10 # 6590 <_sk_callback_sse2+0xfea>
+ DB 68,15,40,21,217,19,0,0 ; movaps 0x13d9(%rip),%xmm10 # 65c0 <_sk_callback_sse2+0xfe6>
DB 69,15,92,213 ; subps %xmm13,%xmm10
DB 69,15,84,209 ; andps %xmm9,%xmm10
DB 69,15,85,205 ; andnps %xmm13,%xmm9
DB 69,15,86,202 ; orps %xmm10,%xmm9
DB 68,15,194,192,1 ; cmpltps %xmm0,%xmm8
- DB 68,15,40,21,208,19,0,0 ; movaps 0x13d0(%rip),%xmm10 # 65a0 <_sk_callback_sse2+0xffa>
+ DB 68,15,40,21,204,19,0,0 ; movaps 0x13cc(%rip),%xmm10 # 65d0 <_sk_callback_sse2+0xff6>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,84,208 ; andps %xmm8,%xmm10
DB 69,15,85,193 ; andnps %xmm9,%xmm8
DB 69,15,86,194 ; orps %xmm10,%xmm8
DB 68,15,40,201 ; movaps %xmm1,%xmm9
DB 68,15,194,200,1 ; cmpltps %xmm0,%xmm9
- DB 68,15,40,21,191,19,0,0 ; movaps 0x13bf(%rip),%xmm10 # 65b0 <_sk_callback_sse2+0x100a>
+ DB 68,15,40,21,187,19,0,0 ; movaps 0x13bb(%rip),%xmm10 # 65e0 <_sk_callback_sse2+0x1006>
DB 69,15,92,208 ; subps %xmm8,%xmm10
DB 69,15,84,209 ; andps %xmm9,%xmm10
DB 69,15,85,200 ; andnps %xmm8,%xmm9
@@ -24038,7 +24114,7 @@ _sk_xy_to_radius_sse2 LABEL PROC
PUBLIC _sk_save_xy_sse2
_sk_save_xy_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,145,19,0,0 ; movaps 0x1391(%rip),%xmm8 # 65c0 <_sk_callback_sse2+0x101a>
+ DB 68,15,40,5,141,19,0,0 ; movaps 0x138d(%rip),%xmm8 # 65f0 <_sk_callback_sse2+0x1016>
DB 15,17,0 ; movups %xmm0,(%rax)
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,88,200 ; addps %xmm8,%xmm9
@@ -24046,7 +24122,7 @@ _sk_save_xy_sse2 LABEL PROC
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,40,217 ; movaps %xmm9,%xmm11
DB 69,15,194,218,1 ; cmpltps %xmm10,%xmm11
- DB 68,15,40,37,124,19,0,0 ; movaps 0x137c(%rip),%xmm12 # 65d0 <_sk_callback_sse2+0x102a>
+ DB 68,15,40,37,120,19,0,0 ; movaps 0x1378(%rip),%xmm12 # 6600 <_sk_callback_sse2+0x1026>
DB 69,15,84,220 ; andps %xmm12,%xmm11
DB 69,15,92,211 ; subps %xmm11,%xmm10
DB 69,15,92,202 ; subps %xmm10,%xmm9
@@ -24089,8 +24165,8 @@ _sk_bilinear_nx_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,245,18,0,0 ; addps 0x12f5(%rip),%xmm0 # 65e0 <_sk_callback_sse2+0x103a>
- DB 68,15,40,13,253,18,0,0 ; movaps 0x12fd(%rip),%xmm9 # 65f0 <_sk_callback_sse2+0x104a>
+ DB 15,88,5,241,18,0,0 ; addps 0x12f1(%rip),%xmm0 # 6610 <_sk_callback_sse2+0x1036>
+ DB 68,15,40,13,249,18,0,0 ; movaps 0x12f9(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x1046>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24101,7 +24177,7 @@ _sk_bilinear_px_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,236,18,0,0 ; addps 0x12ec(%rip),%xmm0 # 6600 <_sk_callback_sse2+0x105a>
+ DB 15,88,5,232,18,0,0 ; addps 0x12e8(%rip),%xmm0 # 6630 <_sk_callback_sse2+0x1056>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24111,8 +24187,8 @@ _sk_bilinear_ny_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,222,18,0,0 ; addps 0x12de(%rip),%xmm1 # 6610 <_sk_callback_sse2+0x106a>
- DB 68,15,40,13,230,18,0,0 ; movaps 0x12e6(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x107a>
+ DB 15,88,13,218,18,0,0 ; addps 0x12da(%rip),%xmm1 # 6640 <_sk_callback_sse2+0x1066>
+ DB 68,15,40,13,226,18,0,0 ; movaps 0x12e2(%rip),%xmm9 # 6650 <_sk_callback_sse2+0x1076>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24123,7 +24199,7 @@ _sk_bilinear_py_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,212,18,0,0 ; addps 0x12d4(%rip),%xmm1 # 6630 <_sk_callback_sse2+0x108a>
+ DB 15,88,13,208,18,0,0 ; addps 0x12d0(%rip),%xmm1 # 6660 <_sk_callback_sse2+0x1086>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24133,13 +24209,13 @@ _sk_bicubic_n3x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm0 # 6640 <_sk_callback_sse2+0x109a>
- DB 68,15,40,13,207,18,0,0 ; movaps 0x12cf(%rip),%xmm9 # 6650 <_sk_callback_sse2+0x10aa>
+ DB 15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm0 # 6670 <_sk_callback_sse2+0x1096>
+ DB 68,15,40,13,203,18,0,0 ; movaps 0x12cb(%rip),%xmm9 # 6680 <_sk_callback_sse2+0x10a6>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,203,18,0,0 ; mulps 0x12cb(%rip),%xmm9 # 6660 <_sk_callback_sse2+0x10ba>
- DB 68,15,88,13,211,18,0,0 ; addps 0x12d3(%rip),%xmm9 # 6670 <_sk_callback_sse2+0x10ca>
+ DB 68,15,89,13,199,18,0,0 ; mulps 0x12c7(%rip),%xmm9 # 6690 <_sk_callback_sse2+0x10b6>
+ DB 68,15,88,13,207,18,0,0 ; addps 0x12cf(%rip),%xmm9 # 66a0 <_sk_callback_sse2+0x10c6>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24150,16 +24226,16 @@ _sk_bicubic_n1x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,194,18,0,0 ; addps 0x12c2(%rip),%xmm0 # 6680 <_sk_callback_sse2+0x10da>
- DB 68,15,40,13,202,18,0,0 ; movaps 0x12ca(%rip),%xmm9 # 6690 <_sk_callback_sse2+0x10ea>
+ DB 15,88,5,190,18,0,0 ; addps 0x12be(%rip),%xmm0 # 66b0 <_sk_callback_sse2+0x10d6>
+ DB 68,15,40,13,198,18,0,0 ; movaps 0x12c6(%rip),%xmm9 # 66c0 <_sk_callback_sse2+0x10e6>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,206,18,0,0 ; movaps 0x12ce(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x10fa>
+ DB 68,15,40,5,202,18,0,0 ; movaps 0x12ca(%rip),%xmm8 # 66d0 <_sk_callback_sse2+0x10f6>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,210,18,0,0 ; addps 0x12d2(%rip),%xmm8 # 66b0 <_sk_callback_sse2+0x110a>
+ DB 68,15,88,5,206,18,0,0 ; addps 0x12ce(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x1106>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm8 # 66c0 <_sk_callback_sse2+0x111a>
+ DB 68,15,88,5,210,18,0,0 ; addps 0x12d2(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x1116>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,218,18,0,0 ; addps 0x12da(%rip),%xmm8 # 66d0 <_sk_callback_sse2+0x112a>
+ DB 68,15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm8 # 6700 <_sk_callback_sse2+0x1126>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24167,17 +24243,17 @@ _sk_bicubic_n1x_sse2 LABEL PROC
PUBLIC _sk_bicubic_p1x_sse2
_sk_bicubic_p1x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,212,18,0,0 ; movaps 0x12d4(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x113a>
+ DB 68,15,40,5,208,18,0,0 ; movaps 0x12d0(%rip),%xmm8 # 6710 <_sk_callback_sse2+0x1136>
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,21,208,18,0,0 ; movaps 0x12d0(%rip),%xmm10 # 66f0 <_sk_callback_sse2+0x114a>
+ DB 68,15,40,21,204,18,0,0 ; movaps 0x12cc(%rip),%xmm10 # 6720 <_sk_callback_sse2+0x1146>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,212,18,0,0 ; addps 0x12d4(%rip),%xmm10 # 6700 <_sk_callback_sse2+0x115a>
+ DB 68,15,88,21,208,18,0,0 ; addps 0x12d0(%rip),%xmm10 # 6730 <_sk_callback_sse2+0x1156>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,208,18,0,0 ; addps 0x12d0(%rip),%xmm10 # 6710 <_sk_callback_sse2+0x116a>
+ DB 68,15,88,21,204,18,0,0 ; addps 0x12cc(%rip),%xmm10 # 6740 <_sk_callback_sse2+0x1166>
DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24187,11 +24263,11 @@ _sk_bicubic_p3x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm0 # 6720 <_sk_callback_sse2+0x117a>
+ DB 15,88,5,191,18,0,0 ; addps 0x12bf(%rip),%xmm0 # 6750 <_sk_callback_sse2+0x1176>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,195,18,0,0 ; mulps 0x12c3(%rip),%xmm8 # 6730 <_sk_callback_sse2+0x118a>
- DB 68,15,88,5,203,18,0,0 ; addps 0x12cb(%rip),%xmm8 # 6740 <_sk_callback_sse2+0x119a>
+ DB 68,15,89,5,191,18,0,0 ; mulps 0x12bf(%rip),%xmm8 # 6760 <_sk_callback_sse2+0x1186>
+ DB 68,15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x1196>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24202,13 +24278,13 @@ _sk_bicubic_n3y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,185,18,0,0 ; addps 0x12b9(%rip),%xmm1 # 6750 <_sk_callback_sse2+0x11aa>
- DB 68,15,40,13,193,18,0,0 ; movaps 0x12c1(%rip),%xmm9 # 6760 <_sk_callback_sse2+0x11ba>
+ DB 15,88,13,181,18,0,0 ; addps 0x12b5(%rip),%xmm1 # 6780 <_sk_callback_sse2+0x11a6>
+ DB 68,15,40,13,189,18,0,0 ; movaps 0x12bd(%rip),%xmm9 # 6790 <_sk_callback_sse2+0x11b6>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,189,18,0,0 ; mulps 0x12bd(%rip),%xmm9 # 6770 <_sk_callback_sse2+0x11ca>
- DB 68,15,88,13,197,18,0,0 ; addps 0x12c5(%rip),%xmm9 # 6780 <_sk_callback_sse2+0x11da>
+ DB 68,15,89,13,185,18,0,0 ; mulps 0x12b9(%rip),%xmm9 # 67a0 <_sk_callback_sse2+0x11c6>
+ DB 68,15,88,13,193,18,0,0 ; addps 0x12c1(%rip),%xmm9 # 67b0 <_sk_callback_sse2+0x11d6>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24219,16 +24295,16 @@ _sk_bicubic_n1y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,179,18,0,0 ; addps 0x12b3(%rip),%xmm1 # 6790 <_sk_callback_sse2+0x11ea>
- DB 68,15,40,13,187,18,0,0 ; movaps 0x12bb(%rip),%xmm9 # 67a0 <_sk_callback_sse2+0x11fa>
+ DB 15,88,13,175,18,0,0 ; addps 0x12af(%rip),%xmm1 # 67c0 <_sk_callback_sse2+0x11e6>
+ DB 68,15,40,13,183,18,0,0 ; movaps 0x12b7(%rip),%xmm9 # 67d0 <_sk_callback_sse2+0x11f6>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,191,18,0,0 ; movaps 0x12bf(%rip),%xmm8 # 67b0 <_sk_callback_sse2+0x120a>
+ DB 68,15,40,5,187,18,0,0 ; movaps 0x12bb(%rip),%xmm8 # 67e0 <_sk_callback_sse2+0x1206>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm8 # 67c0 <_sk_callback_sse2+0x121a>
+ DB 68,15,88,5,191,18,0,0 ; addps 0x12bf(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x1216>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm8 # 67d0 <_sk_callback_sse2+0x122a>
+ DB 68,15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x1226>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,203,18,0,0 ; addps 0x12cb(%rip),%xmm8 # 67e0 <_sk_callback_sse2+0x123a>
+ DB 68,15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm8 # 6810 <_sk_callback_sse2+0x1236>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24236,17 +24312,17 @@ _sk_bicubic_n1y_sse2 LABEL PROC
PUBLIC _sk_bicubic_p1y_sse2
_sk_bicubic_p1y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,197,18,0,0 ; movaps 0x12c5(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x124a>
+ DB 68,15,40,5,193,18,0,0 ; movaps 0x12c1(%rip),%xmm8 # 6820 <_sk_callback_sse2+0x1246>
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 68,15,40,21,192,18,0,0 ; movaps 0x12c0(%rip),%xmm10 # 6800 <_sk_callback_sse2+0x125a>
+ DB 68,15,40,21,188,18,0,0 ; movaps 0x12bc(%rip),%xmm10 # 6830 <_sk_callback_sse2+0x1256>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,196,18,0,0 ; addps 0x12c4(%rip),%xmm10 # 6810 <_sk_callback_sse2+0x126a>
+ DB 68,15,88,21,192,18,0,0 ; addps 0x12c0(%rip),%xmm10 # 6840 <_sk_callback_sse2+0x1266>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,192,18,0,0 ; addps 0x12c0(%rip),%xmm10 # 6820 <_sk_callback_sse2+0x127a>
+ DB 68,15,88,21,188,18,0,0 ; addps 0x12bc(%rip),%xmm10 # 6850 <_sk_callback_sse2+0x1276>
DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -24256,11 +24332,11 @@ _sk_bicubic_p3y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,178,18,0,0 ; addps 0x12b2(%rip),%xmm1 # 6830 <_sk_callback_sse2+0x128a>
+ DB 15,88,13,174,18,0,0 ; addps 0x12ae(%rip),%xmm1 # 6860 <_sk_callback_sse2+0x1286>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,178,18,0,0 ; mulps 0x12b2(%rip),%xmm8 # 6840 <_sk_callback_sse2+0x129a>
- DB 68,15,88,5,186,18,0,0 ; addps 0x12ba(%rip),%xmm8 # 6850 <_sk_callback_sse2+0x12aa>
+ DB 68,15,89,5,174,18,0,0 ; mulps 0x12ae(%rip),%xmm8 # 6870 <_sk_callback_sse2+0x1296>
+ DB 68,15,88,5,182,18,0,0 ; addps 0x12b6(%rip),%xmm8 # 6880 <_sk_callback_sse2+0x12a6>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -24270,12 +24346,14 @@ PUBLIC _sk_callback_sse2
_sk_callback_sse2 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
+ DB 65,84 ; push %r12
DB 83 ; push %rbx
- DB 72,131,236,32 ; sub $0x20,%rsp
+ DB 72,131,236,40 ; sub $0x28,%rsp
DB 68,15,40,197 ; movaps %xmm5,%xmm8
DB 68,15,40,204 ; movaps %xmm4,%xmm9
- DB 73,137,207 ; mov %rcx,%r15
- DB 73,137,214 ; mov %rdx,%r14
+ DB 77,137,196 ; mov %r8,%r12
+ DB 73,137,206 ; mov %rcx,%r14
+ DB 73,137,215 ; mov %rdx,%r15
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,137,195 ; mov %rax,%rbx
DB 15,40,224 ; movaps %xmm0,%xmm4
@@ -24294,9 +24372,9 @@ _sk_callback_sse2 LABEL PROC
DB 15,17,107,24 ; movups %xmm5,0x18(%rbx)
DB 102,15,17,91,40 ; movupd %xmm3,0x28(%rbx)
DB 15,17,83,56 ; movups %xmm2,0x38(%rbx)
- DB 77,133,255 ; test %r15,%r15
+ DB 77,133,228 ; test %r12,%r12
DB 186,4,0,0,0 ; mov $0x4,%edx
- DB 65,15,69,215 ; cmovne %r15d,%edx
+ DB 65,15,69,212 ; cmovne %r12d,%edx
DB 72,137,217 ; mov %rbx,%rcx
DB 255,19 ; callq *(%rbx)
DB 72,139,131,136,0,0,0 ; mov 0x88(%rbx),%rax
@@ -24317,12 +24395,14 @@ _sk_callback_sse2 LABEL PROC
DB 102,15,20,211 ; unpcklpd %xmm3,%xmm2
DB 15,18,220 ; movhlps %xmm4,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,137,242 ; mov %r14,%rdx
- DB 76,137,249 ; mov %r15,%rcx
+ DB 76,137,250 ; mov %r15,%rdx
+ DB 76,137,241 ; mov %r14,%rcx
+ DB 77,137,224 ; mov %r12,%r8
DB 65,15,40,225 ; movaps %xmm9,%xmm4
DB 65,15,40,232 ; movaps %xmm8,%xmm5
- DB 72,131,196,32 ; add $0x20,%rsp
+ DB 72,131,196,40 ; add $0x28,%rsp
DB 91 ; pop %rbx
+ DB 65,92 ; pop %r12
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
DB 255,224 ; jmpq *%rax
@@ -24471,11 +24551,11 @@ ALIGN 16
DB 128,191,0,0,128,191,0 ; cmpb $0x0,-0x40800000(%rdi)
DB 0,224 ; add %ah,%al
DB 64,0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 5848 <.literal16+0x1d8>
+ DB 224,64 ; loopne 5878 <.literal16+0x1d8>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 584c <.literal16+0x1dc>
+ DB 224,64 ; loopne 587c <.literal16+0x1dc>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 5850 <.literal16+0x1e0>
+ DB 224,64 ; loopne 5880 <.literal16+0x1e0>
DB 154 ; (bad)
DB 153 ; cltd
DB 153 ; cltd
@@ -24495,13 +24575,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5871 <.literal16+0x201>
+ DB 71,225,61 ; rex.RXB loope 58a1 <.literal16+0x201>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5875 <.literal16+0x205>
+ DB 71,225,61 ; rex.RXB loope 58a5 <.literal16+0x205>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5879 <.literal16+0x209>
+ DB 71,225,61 ; rex.RXB loope 58a9 <.literal16+0x209>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 587d <.literal16+0x20d>
+ DB 71,225,61 ; rex.RXB loope 58ad <.literal16+0x20d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -24526,13 +24606,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58b1 <.literal16+0x241>
+ DB 71,225,61 ; rex.RXB loope 58e1 <.literal16+0x241>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58b5 <.literal16+0x245>
+ DB 71,225,61 ; rex.RXB loope 58e5 <.literal16+0x245>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58b9 <.literal16+0x249>
+ DB 71,225,61 ; rex.RXB loope 58e9 <.literal16+0x249>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58bd <.literal16+0x24d>
+ DB 71,225,61 ; rex.RXB loope 58ed <.literal16+0x24d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -24557,13 +24637,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58f1 <.literal16+0x281>
+ DB 71,225,61 ; rex.RXB loope 5921 <.literal16+0x281>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58f5 <.literal16+0x285>
+ DB 71,225,61 ; rex.RXB loope 5925 <.literal16+0x285>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58f9 <.literal16+0x289>
+ DB 71,225,61 ; rex.RXB loope 5929 <.literal16+0x289>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 58fd <.literal16+0x28d>
+ DB 71,225,61 ; rex.RXB loope 592d <.literal16+0x28d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -24588,13 +24668,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5931 <.literal16+0x2c1>
+ DB 71,225,61 ; rex.RXB loope 5961 <.literal16+0x2c1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5935 <.literal16+0x2c5>
+ DB 71,225,61 ; rex.RXB loope 5965 <.literal16+0x2c5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 5939 <.literal16+0x2c9>
+ DB 71,225,61 ; rex.RXB loope 5969 <.literal16+0x2c9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 593d <.literal16+0x2cd>
+ DB 71,225,61 ; rex.RXB loope 596d <.literal16+0x2cd>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -24615,11 +24695,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
DB 67,0,0 ; rex.XB add %al,(%r8)
- DB 127,67 ; jg 597b <.literal16+0x30b>
+ DB 127,67 ; jg 59ab <.literal16+0x30b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 597f <.literal16+0x30f>
+ DB 127,67 ; jg 59af <.literal16+0x30f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5983 <.literal16+0x313>
+ DB 127,67 ; jg 59b3 <.literal16+0x313>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -24859,13 +24939,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5b69 <.literal16+0x4f9>
+ DB 224,7 ; loopne 5b99 <.literal16+0x4f9>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5b6d <.literal16+0x4fd>
+ DB 224,7 ; loopne 5b9d <.literal16+0x4fd>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5b71 <.literal16+0x501>
+ DB 224,7 ; loopne 5ba1 <.literal16+0x501>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 5b75 <.literal16+0x505>
+ DB 224,7 ; loopne 5ba5 <.literal16+0x505>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -24930,11 +25010,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5c4b <.literal16+0x5db>
+ DB 127,67 ; jg 5c7b <.literal16+0x5db>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5c4f <.literal16+0x5df>
+ DB 127,67 ; jg 5c7f <.literal16+0x5df>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5c53 <.literal16+0x5e3>
+ DB 127,67 ; jg 5c83 <.literal16+0x5e3>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax)
@@ -24949,16 +25029,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5c44 <.literal16+0x5d4>
+ DB 127,0 ; jg 5c74 <.literal16+0x5d4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5c48 <.literal16+0x5d8>
+ DB 127,0 ; jg 5c78 <.literal16+0x5d8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5c4c <.literal16+0x5dc>
+ DB 127,0 ; jg 5c7c <.literal16+0x5dc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5c50 <.literal16+0x5e0>
+ DB 127,0 ; jg 5c80 <.literal16+0x5e0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -24967,7 +25047,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5cd5 <.literal16+0x665>
+ DB 119,115 ; ja 5d05 <.literal16+0x665>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -24978,7 +25058,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5c39 <.literal16+0x5c9>
+ DB 117,191 ; jne 5c69 <.literal16+0x5c9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -24990,7 +25070,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a39c7a <_sk_callback_sse2+0xffffffffe9a346d4>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a39caa <_sk_callback_sse2+0xffffffffe9a346d0>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -25044,16 +25124,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5d14 <.literal16+0x6a4>
+ DB 127,0 ; jg 5d44 <.literal16+0x6a4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5d18 <.literal16+0x6a8>
+ DB 127,0 ; jg 5d48 <.literal16+0x6a8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5d1c <.literal16+0x6ac>
+ DB 127,0 ; jg 5d4c <.literal16+0x6ac>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5d20 <.literal16+0x6b0>
+ DB 127,0 ; jg 5d50 <.literal16+0x6b0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -25062,7 +25142,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5da5 <.literal16+0x735>
+ DB 119,115 ; ja 5dd5 <.literal16+0x735>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -25073,7 +25153,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5d09 <.literal16+0x699>
+ DB 117,191 ; jne 5d39 <.literal16+0x699>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -25085,7 +25165,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a39d4a <_sk_callback_sse2+0xffffffffe9a347a4>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a39d7a <_sk_callback_sse2+0xffffffffe9a347a0>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -25139,16 +25219,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5de4 <.literal16+0x774>
+ DB 127,0 ; jg 5e14 <.literal16+0x774>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5de8 <.literal16+0x778>
+ DB 127,0 ; jg 5e18 <.literal16+0x778>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5dec <.literal16+0x77c>
+ DB 127,0 ; jg 5e1c <.literal16+0x77c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5df0 <.literal16+0x780>
+ DB 127,0 ; jg 5e20 <.literal16+0x780>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -25157,7 +25237,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5e75 <.literal16+0x805>
+ DB 119,115 ; ja 5ea5 <.literal16+0x805>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -25168,7 +25248,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5dd9 <.literal16+0x769>
+ DB 117,191 ; jne 5e09 <.literal16+0x769>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -25180,7 +25260,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a39e1a <_sk_callback_sse2+0xffffffffe9a34874>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a39e4a <_sk_callback_sse2+0xffffffffe9a34870>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -25234,16 +25314,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5eb4 <.literal16+0x844>
+ DB 127,0 ; jg 5ee4 <.literal16+0x844>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5eb8 <.literal16+0x848>
+ DB 127,0 ; jg 5ee8 <.literal16+0x848>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5ebc <.literal16+0x84c>
+ DB 127,0 ; jg 5eec <.literal16+0x84c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 5ec0 <.literal16+0x850>
+ DB 127,0 ; jg 5ef0 <.literal16+0x850>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -25252,7 +25332,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5f45 <.literal16+0x8d5>
+ DB 119,115 ; ja 5f75 <.literal16+0x8d5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -25263,7 +25343,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 5ea9 <.literal16+0x839>
+ DB 117,191 ; jne 5ed9 <.literal16+0x839>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -25275,7 +25355,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a39eea <_sk_callback_sse2+0xffffffffe9a34944>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a39f1a <_sk_callback_sse2+0xffffffffe9a34940>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -25325,13 +25405,13 @@ ALIGN 16
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
- DB 127,67 ; jg 5fc7 <.literal16+0x957>
+ DB 127,67 ; jg 5ff7 <.literal16+0x957>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5fcb <.literal16+0x95b>
+ DB 127,67 ; jg 5ffb <.literal16+0x95b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5fcf <.literal16+0x95f>
+ DB 127,67 ; jg 5fff <.literal16+0x95f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5fd3 <.literal16+0x963>
+ DB 127,67 ; jg 6003 <.literal16+0x963>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -25378,16 +25458,16 @@ ALIGN 16
DB 128,3,62 ; addb $0x3e,(%rbx)
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6053 <.literal16+0x9e3>
+ DB 118,63 ; jbe 6083 <.literal16+0x9e3>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6057 <.literal16+0x9e7>
+ DB 118,63 ; jbe 6087 <.literal16+0x9e7>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 605b <.literal16+0x9eb>
+ DB 118,63 ; jbe 608b <.literal16+0x9eb>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 605f <.literal16+0x9ef>
+ DB 118,63 ; jbe 608f <.literal16+0x9ef>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
@@ -25407,11 +25487,11 @@ ALIGN 16
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 60ab <.literal16+0xa3b>
+ DB 127,67 ; jg 60db <.literal16+0xa3b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 60af <.literal16+0xa3f>
+ DB 127,67 ; jg 60df <.literal16+0xa3f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 60b3 <.literal16+0xa43>
+ DB 127,67 ; jg 60e3 <.literal16+0xa43>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -25459,13 +25539,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6109 <.literal16+0xa99>
+ DB 224,7 ; loopne 6139 <.literal16+0xa99>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 610d <.literal16+0xa9d>
+ DB 224,7 ; loopne 613d <.literal16+0xa9d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6111 <.literal16+0xaa1>
+ DB 224,7 ; loopne 6141 <.literal16+0xaa1>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6115 <.literal16+0xaa5>
+ DB 224,7 ; loopne 6145 <.literal16+0xaa5>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -25511,13 +25591,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6179 <.literal16+0xb09>
+ DB 224,7 ; loopne 61a9 <.literal16+0xb09>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 617d <.literal16+0xb0d>
+ DB 224,7 ; loopne 61ad <.literal16+0xb0d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6181 <.literal16+0xb11>
+ DB 224,7 ; loopne 61b1 <.literal16+0xb11>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6185 <.literal16+0xb15>
+ DB 224,7 ; loopne 61b5 <.literal16+0xb15>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -25555,13 +25635,13 @@ ALIGN 16
DB 65,0,0 ; add %al,(%r8)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 6216 <.literal16+0xba6>
+ DB 124,66 ; jl 6246 <.literal16+0xba6>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 621a <.literal16+0xbaa>
+ DB 124,66 ; jl 624a <.literal16+0xbaa>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 621e <.literal16+0xbae>
+ DB 124,66 ; jl 624e <.literal16+0xbae>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 6222 <.literal16+0xbb2>
+ DB 124,66 ; jl 6252 <.literal16+0xbb2>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 0,240 ; add %dh,%al
@@ -25651,13 +25731,13 @@ ALIGN 16
DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax)
DB 61,137,136,136,61 ; cmp $0x3d888889,%eax
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6325 <.literal16+0xcb5>
+ DB 112,65 ; jo 6355 <.literal16+0xcb5>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6329 <.literal16+0xcb9>
+ DB 112,65 ; jo 6359 <.literal16+0xcb9>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 632d <.literal16+0xcbd>
+ DB 112,65 ; jo 635d <.literal16+0xcbd>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6331 <.literal16+0xcc1>
+ DB 112,65 ; jo 6361 <.literal16+0xcc1>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -25679,11 +25759,11 @@ ALIGN 16
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%rax)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 637b <.literal16+0xd0b>
+ DB 127,67 ; jg 63ab <.literal16+0xd0b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 637f <.literal16+0xd0f>
+ DB 127,67 ; jg 63af <.literal16+0xd0f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6383 <.literal16+0xd13>
+ DB 127,67 ; jg 63b3 <.literal16+0xd13>
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
DB 0,0 ; add %al,(%rax)
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
@@ -25759,13 +25839,13 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 646b <.literal16+0xdfb>
+ DB 127,71 ; jg 649b <.literal16+0xdfb>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 646f <.literal16+0xdff>
+ DB 127,71 ; jg 649f <.literal16+0xdff>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 6473 <.literal16+0xe03>
+ DB 127,71 ; jg 64a3 <.literal16+0xe03>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 6477 <.literal16+0xe07>
+ DB 127,71 ; jg 64a7 <.literal16+0xe07>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -25842,10 +25922,10 @@ ALIGN 16
DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax
DB 152 ; cwtl
DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx)
- DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0760a <_sk_callback_sse2+0x2dc02064>
+ DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0763a <_sk_callback_sse2+0x2dc02060>
DB 17,192 ; adc %eax,%eax
DB 45,16,17,192,18 ; sub $0x12c01110,%eax
- DB 120,57 ; js 653c <.literal16+0xecc>
+ DB 120,57 ; js 656c <.literal16+0xecc>
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
@@ -25973,11 +26053,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 6682 <.literal16+0x1012>
+ DB 62,114,28 ; jb,pt 66b2 <.literal16+0x1012>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6686 <.literal16+0x1016>
+ DB 62,114,28 ; jb,pt 66b6 <.literal16+0x1016>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 668a <.literal16+0x101a>
+ DB 62,114,28 ; jb,pt 66ba <.literal16+0x101a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -26021,7 +26101,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f515 <_sk_callback_sse2+0x3d639f6f>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f545 <_sk_callback_sse2+0x3d639f6b>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -26047,7 +26127,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f555 <_sk_callback_sse2+0x3d639faf>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f585 <_sk_callback_sse2+0x3d639fab>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -26056,13 +26136,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 674e <.literal16+0x10de>
+ DB 114,28 ; jb 677e <.literal16+0x10de>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6752 <.literal16+0x10e2>
+ DB 62,114,28 ; jb,pt 6782 <.literal16+0x10e2>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6756 <.literal16+0x10e6>
+ DB 62,114,28 ; jb,pt 6786 <.literal16+0x10e6>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 675a <.literal16+0x10ea>
+ DB 62,114,28 ; jb,pt 678a <.literal16+0x10ea>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -26083,11 +26163,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 6792 <.literal16+0x1122>
+ DB 62,114,28 ; jb,pt 67c2 <.literal16+0x1122>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6796 <.literal16+0x1126>
+ DB 62,114,28 ; jb,pt 67c6 <.literal16+0x1126>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 679a <.literal16+0x112a>
+ DB 62,114,28 ; jb,pt 67ca <.literal16+0x112a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -26131,7 +26211,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f625 <_sk_callback_sse2+0x3d63a07f>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f655 <_sk_callback_sse2+0x3d63a07b>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -26157,7 +26237,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f665 <_sk_callback_sse2+0x3d63a0bf>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f695 <_sk_callback_sse2+0x3d63a0bb>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -26166,13 +26246,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 685e <.literal16+0x11ee>
+ DB 114,28 ; jb 688e <.literal16+0x11ee>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6862 <_sk_callback_sse2+0x12bc>
+ DB 62,114,28 ; jb,pt 6892 <_sk_callback_sse2+0x12b8>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 6866 <_sk_callback_sse2+0x12c0>
+ DB 62,114,28 ; jb,pt 6896 <_sk_callback_sse2+0x12bc>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 686a <_sk_callback_sse2+0x12c4>
+ DB 62,114,28 ; jb,pt 689a <_sk_callback_sse2+0x12c0>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
diff --git a/src/jumper/SkJumper_stages.cpp b/src/jumper/SkJumper_stages.cpp
index e570af105b..027af09937 100644
--- a/src/jumper/SkJumper_stages.cpp
+++ b/src/jumper/SkJumper_stages.cpp
@@ -77,38 +77,40 @@ struct LazyCtx {
// tail == 0 ~~> work on a full kStride pixels
// tail != 0 ~~> work on only the first tail pixels
// tail is always < kStride.
-using Stage = void(size_t x, void** program, K* k, size_t tail, F,F,F,F, F,F,F,F);
+//
+// We keep program the second argument, so that it's passed in rsi for load_and_inc().
+using Stage = void(K* k, void** program, size_t x, size_t y, size_t tail, F,F,F,F, F,F,F,F);
MAYBE_MSABI
-extern "C" void WRAP(start_pipeline)(size_t x, void** program, K* k, size_t limit) {
+extern "C" void WRAP(start_pipeline)(size_t x, size_t y, size_t limit, void** program, K* k) {
F v{};
auto start = (Stage*)load_and_inc(program);
while (x + kStride <= limit) {
- start(x,program,k,0, v,v,v,v, v,v,v,v);
+ start(k,program,x,y,0, v,v,v,v, v,v,v,v);
x += kStride;
}
if (size_t tail = limit - x) {
- start(x,program,k,tail, v,v,v,v, v,v,v,v);
+ start(k,program,x,y,tail, v,v,v,v, v,v,v,v);
}
}
-#define STAGE(name) \
- SI void name##_k(size_t x, LazyCtx ctx, K* k, size_t tail, \
- F& r, F& g, F& b, F& a, F& dr, F& dg, F& db, F& da); \
- extern "C" void WRAP(name)(size_t x, void** program, K* k, size_t tail, \
- F r, F g, F b, F a, F dr, F dg, F db, F da) { \
- LazyCtx ctx(program); \
- name##_k(x,ctx,k,tail, r,g,b,a, dr,dg,db,da); \
- auto next = (Stage*)load_and_inc(program); \
- next(x,program,k,tail, r,g,b,a, dr,dg,db,da); \
- } \
- SI void name##_k(size_t x, LazyCtx ctx, K* k, size_t tail, \
+#define STAGE(name) \
+ SI void name##_k(K* k, LazyCtx ctx, size_t x, size_t y, size_t tail, \
+ F& r, F& g, F& b, F& a, F& dr, F& dg, F& db, F& da); \
+ extern "C" void WRAP(name)(K* k, void** program, size_t x, size_t y, size_t tail, \
+ F r, F g, F b, F a, F dr, F dg, F db, F da) { \
+ LazyCtx ctx(program); \
+ name##_k(k,ctx,x,y,tail, r,g,b,a, dr,dg,db,da); \
+ auto next = (Stage*)load_and_inc(program); \
+ next(k,program,x,y,tail, r,g,b,a, dr,dg,db,da); \
+ } \
+ SI void name##_k(K* k, LazyCtx ctx, size_t x, size_t y, size_t tail, \
F& r, F& g, F& b, F& a, F& dr, F& dg, F& db, F& da)
// just_return() is a simple no-op stage that only exists to end the chain,
// returning back up to start_pipeline(), and from there to the caller.
-extern "C" void WRAP(just_return)(size_t, void**, K*, F,F,F,F, F,F,F,F) {}
+extern "C" void WRAP(just_return)(K*, void**, size_t,size_t,size_t, F,F,F,F, F,F,F,F) {}
// We could start defining normal Stages now. But first, some helper functions.
@@ -242,8 +244,6 @@ SI U32 ix_and_ptr(T** ptr, const SkJumper_GatherCtx* ctx, F x, F y) {
// Now finally, normal Stages!
STAGE(seed_shader) {
- auto y = *(const int*)ctx;
-
// It's important for speed to explicitly cast(x) and cast(y),
// which has the effect of splatting them to vectors before converting to floats.
// On Intel this breaks a data dependency on previous loop iterations' registers.
@@ -255,11 +255,11 @@ STAGE(seed_shader) {
}
STAGE(dither) {
- auto c = (const SkJumper_DitherCtx*)ctx;
+ auto rate = *(const float*)ctx;
// Get [(x,y), (x+1,y), (x+2,y), ...] loaded up in integer vectors.
U32 X = x + unaligned_load<U32>(k->iota_U32),
- Y = (uint32_t)*c->y;
+ Y = y;
// We're doing 8x8 ordered dithering, see https://en.wikipedia.org/wiki/Ordered_dithering.
// In this case n=8 and we're using the matrix that looks like 1/64 x [ 0 48 12 60 ... ].
@@ -278,9 +278,9 @@ STAGE(dither) {
// like 0 and 1 unchanged after rounding.
F dither = cast(M) * (2/128.0f) - (63/128.0f);
- r += c->rate*dither;
- g += c->rate*dither;
- b += c->rate*dither;
+ r += rate*dither;
+ g += rate*dither;
+ b += rate*dither;
r = max(0, min(r, a));
g = max(0, min(g, a));