Skip to content

Improve performance by fusing kernels - #65

Merged
galekseev merged 13 commits into
masterfrom
perf/fuse-kernels-and-align
Aug 8, 2026
Merged

Improve performance by fusing kernels#65
galekseev merged 13 commits into
masterfrom
perf/fuse-kernels-and-align

Conversation

@galekseev

Copy link
Copy Markdown

Summary

  • Conflict-resolved re-submission of #57 (fork has maintainer_can_modify: false, so conflicts could not be pushed to the author's branch).
  • Same changes as Improve performance by fusing kernels #57: fuse iterate/transform/score into one kernel, align mp_number to 16 bytes (~8–12% faster), plus the OpenCL queue-properties and microsecond speed-sample fixes.
  • Merged current master (including Docker/bench work) with conflicts resolved in Dispatcher.cpp / Dispatcher.hpp / README.md.

Test plan

  • Build on macOS / Linux OpenCL
  • Smoke: --benchmark -z <pubkey> and --leading 0 -z <pubkey>
  • Confirm --no-cache / delete cache-opencl.* once after upgrade
  • Optionally compare hashrate vs master with bench/ scripts

Made with Cursor

@galekseev

Copy link
Copy Markdown
Author

@au2001 optimization from PR #57

@galekseev
galekseev merged commit b5fe25b into master Aug 8, 2026
1 check passed
@galekseev
galekseev deleted the perf/fuse-kernels-and-align branch August 8, 2026 21:33
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants