Peter Boyle
|
702773e5fb
|
BatchedBlas.h updates. May cause some churn. Trying to avoid scalar pointer copies to device.
|
2026-08-13 14:55:03 -04:00 |
|
Peter Boyle
|
4dfbd850ff
|
Buf fix on DenseCoarseMatrix.h, coefficient caching optimisation on BatchGEMM
|
2026-08-13 13:26:42 -04:00 |
|
Peter Boyle
|
b039e659af
|
4D pseudo fermion
|
2026-08-12 12:51:55 -04:00 |
|
Peter Boyle
|
d16d44dda0
|
Prepare for reduced Ls during evolution forces using 4D pseudo fermion.
Worth an effort to understand if the different stochastic estimator is cleaner.
|
2026-08-12 12:51:01 -04:00 |
|
Peter Boyle
|
1c19389ba6
|
Two flavour boson term
|
2026-08-12 12:50:32 -04:00 |
|
Peter Boyle
|
02fdff674c
|
Test the PVdagM left prec pseudofermion formulation
|
2026-08-12 12:49:59 -04:00 |
|
Peter Boyle
|
fd8b6a23a6
|
PvDagM or other left prec precon two flavour ratio
|
2026-08-12 12:49:21 -04:00 |
|
Peter Boyle
|
9e3a51d078
|
Use the new DenseCoarseInverse class
|
2026-08-12 12:48:19 -04:00 |
|
Peter Boyle
|
6f7a2ad7c7
|
Dense coarse inverse wrapper class, bundling up a bunch of useful work
|
2026-08-12 12:47:40 -04:00 |
|
Peter Boyle
|
499d656949
|
Batch blas test
|
2026-08-12 12:47:16 -04:00 |
|
Peter Boyle
|
ba68f09026
|
Batch inverse
|
2026-08-12 12:46:56 -04:00 |
|
Peter Boyle
|
3bdeeb73ef
|
Update
|
2026-08-12 12:44:56 -04:00 |
|
Peter Boyle
|
19868a800f
|
Blas optimise change
|
2026-08-12 12:43:40 -04:00 |
|
Peter Boyle
|
df908ee872
|
3 level dense
|
2026-08-11 17:50:12 -04:00 |
|
Peter Boyle
|
84715ff4b9
|
Default to fast path
|
2026-08-11 17:39:12 -04:00 |
|
Peter Boyle
|
5792195073
|
Check in codes used at time of Lattice conference for PVdagM multigrid
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
fb5662a449
|
Setup on Frontier
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
6b2ad3db80
|
Inverse improvements. Need to make this properly recursive
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
f1a969f0c3
|
Evict all optoin
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
f18320a152
|
GeneralCoarsenedMatrix speed up -- same optimisations for fast
calculation used by GeneralCoarsenedMatrixMultiRHS
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
bfcde59199
|
Memory manager improvements
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
f23e9e70cd
|
Global orthogonalise routine
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
06fcd31da0
|
Verbose options
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
7e4fe99b1e
|
Logging update
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
159ea3d64d
|
Better logging performance
|
2026-08-11 16:35:42 -04:00 |
|
Peter Boyle
|
1f55c13bc4
|
Test script for Frontier on I/O
|
2026-08-11 13:37:50 -04:00 |
|
Peter Boyle
|
d68b111d06
|
Switch on the faster IO be default
|
2026-08-11 13:36:50 -04:00 |
|
Peter Boyle
|
41f5a02204
|
IO updates for AllToAllV aggregation of contiguous chunks.
May finally clean up the poor MPI2 IO performance issue that has been persistent.
|
2026-08-11 13:33:04 -04:00 |
|
Peter Boyle
|
7647576863
|
Sourceme's for frontier
|
2026-06-26 11:50:44 -04:00 |
|
Peter Boyle
|
f11ba18df2
|
Remove accelerator_inline on CPU only code
|
2026-06-17 20:47:15 +02:00 |
|
Peter Boyle
|
cf8587e401
|
Update booster compiule
|
2026-06-17 20:46:53 +02:00 |
|
Peter Boyle
|
7dd35ef749
|
Make disable accelerator aware mpi compile for CUDA
|
2026-06-17 20:46:14 +02:00 |
|
Peter Boyle
|
41e570ddce
|
Annoying old CPU perfmon code should be removed or deprecated as not
worth maintaining
|
2026-06-17 20:45:32 +02:00 |
|
Peter Boyle
|
a452131b50
|
Print improvement
|
2026-06-17 20:45:04 +02:00 |
|
Peter Boyle
|
4e49ca55ab
|
Merge branch 'develop' of https://github.com/paboyle/Grid into develop
|
2026-06-16 11:20:12 -07:00 |
|
Peter Boyle
|
c3f4474401
|
Adding Mattia's memory leak test
|
2026-06-16 11:19:36 -07:00 |
|
Peter Boyle
|
3d3eff86f3
|
Modify move assignment operator to be noexcept
Add noexcept specifier to move assignment operator.
|
2026-06-11 09:44:24 -04:00 |
|
Peter Boyle
|
fc9f154ac1
|
Modify Lattice move constructor to be noexcept
Add noexcept specifier to move constructor for Lattice class.
|
2026-06-11 09:40:06 -04:00 |
|
Peter Boyle
|
4aa0bca4dc
|
Change sum operation to use gpucub mistake in PR from Chris
Updated the sum operation definition for GPU reduction to use gpucub instead of cub.
|
2026-06-01 14:12:25 -04:00 |
|
Peter Boyle
|
905da6f083
|
Merge branch 'feature/reduction-reorganisation' into develop
|
2026-05-27 21:01:30 -04:00 |
|
Peter Boyle
|
86c7f29183
|
Config command update
|
2026-05-27 16:19:33 -04:00 |
|
Peter Boyle
|
b0c99f876e
|
Configure on mac update
|
2026-05-27 16:16:55 -04:00 |
|
Peter Boyle
|
bf5fcdc860
|
Ease of use for std::complex interchangable with thrust
|
2026-05-27 16:05:37 -04:00 |
|
Peter Boyle
|
b58a1508fa
|
Perlmutter cuda version update
|
2026-05-21 13:25:13 -07:00 |
|
Peter Boyle
|
4d527e81fa
|
Remove hip specific files
|
2026-05-21 12:34:30 -04:00 |
|
 Peter BoyleandClaude Sonnet 4.6
|
7803580aa6
|
Lattice_reduction_gpu: demote timing logs to Debug, disable by default
skills/mpi-heterogeneous: add Bug Class 4 for Frontier GTL/libamdhip64 ABI mismatch
Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
|
2026-05-21 12:34:30 -04:00 |
|
 Peter BoyleandClaude Sonnet 4.6
|
32654db366
|
Test_planned_fft: fix PlannedFFT template parameter to use ::vector_object
Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
|
2026-05-21 12:34:30 -04:00 |
|
 Peter BoyleandClaude Sonnet 4.6
|
cd340cfab3
|
tests: add Test_planned_fft exercising PlannedFFT<vobj>
Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
|
2026-05-21 12:34:30 -04:00 |
|
 Peter BoyleandClaude Sonnet 4.6
|
f32866b2ff
|
tests/fft: remove PlanDestroy calls (FFT handles plans per-call)
Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
|
2026-05-21 12:34:30 -04:00 |
|
 Peter BoyleandClaude Sonnet 4.6
|
1cd1dc091e
|
FFT: add FFTbase, PlannedFFT; factor FFT_dim_execute free function
Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
|
2026-05-21 12:34:30 -04:00 |
|