summaryrefslogtreecommitdiff
path: root/prelude/slang-cuda-prelude.h
AgeCommit message (Expand)Author
2025-10-16Immutable access qualifier for pointers and use `__ldg` on cuda. (#8710)Yong He
2025-10-14Add support targeting older OptiX versions (#8700)Simon Kallweit
2025-10-08Improve texture loads and stores on CUDA (#8644)Simon Kallweit
2025-09-30Enhance buffer load specialization pass to specialize past field extracts. (#...Yong He
2025-09-09Always define OptixTraversableHandle (#8411)Simon Kallweit
2025-09-04Enable CUDA support for additional HLSL intrinsic tests (#8293)Harsh Aggarwal (NVIDIA)
2025-08-20Updated support to enable batch3 (#8219)Harsh Aggarwal (NVIDIA)
2025-08-12Enable CUDA testing for batch 2 (#8147)jarcherNV
2025-08-07Fix intrinsic LoadLocalRootTableConstant for optix (#7949)Harsh Aggarwal (NVIDIA)
2025-08-07Initial copy elision pass (#8042)ArielG-NV
2025-08-01Fix 7441: CUDA boolean vector layout to use 1-byte elements (#7862)Harsh Aggarwal (NVIDIA)
2025-07-29Fix CUDA backend missing U32_firstbitlow implementation (#7921)Copilot
2025-07-16Fix CUDA issues with texture reads and surface writes (#7780)Mukund Keshava
2025-07-03Replace SLANG_ALIGN_OF with C++11 alignof (#7523)Julius Ikkala
2025-05-30Enable LSS hit object test (#7273)Mukund Keshava
2025-05-27Add LSS intrinsics (#7200)Mukund Keshava
2025-05-26Implement shader execution reordering support for OptiX (#7211)Harsh Aggarwal (NVIDIA)
2025-05-20[CUDA] Add template specializations for signed integer texture fetches (#7161)Simon Kallweit
2025-05-12cuda: Add more formats for texture read/write (#7012)Mukund Keshava
2025-05-07[CUDA] Fix surface write intrinsics (#7004)Simon Kallweit
2025-05-05Add countbits 16-bit and 8-bit support (#6433) (#6897)sricker-nvidia
2025-04-30Add subscript operator support in cuda (#6830)Mukund Keshava
2025-04-19Implement 64bit countbits intrinsic (#6433) (#6845)sricker-nvidia
2025-01-24Add intptr_t abs/min/max operations for CPU & CUDA targets (#6160)Julius Ikkala
2024-11-07Fix CUDA prelude for makeMatrix (#5509)Yong He
2024-10-29formatEllie Hermaszewska
2024-10-28Replace the word stdlib or standard-library with core-module for source code ...Jay Kwak
2024-10-17Cleanup atomic intrinsics. (#5324)Yong He
2024-07-24Add missing make_bool intrinsics in cuda prelude. (#4735)Yong He
2024-07-18Allow CPP/CUDA/Metal to lower/legalize buffer-elements to support column_majo...ArielG-NV
2024-02-24Enable SLANG_MAKE_VECTOR calls when using SLANG_CUDA_ENABLE_HALF without SLAN...NBickford
2023-11-07CUDA: Fixes for NVRTC 12.x and warp mask ambiguity; adds CC 8.x warp reductio...Neil Bickford
2023-10-26Make the exponent return value from frexp int (#3284)Ellie Hermaszewska
2023-09-23More `slangpy` features + polishing (#3233)Sai Praveen Bangaru
2023-08-24Misc. SPIRV Fixes, Part 2. (#3147)Yong He
2023-08-23Lower all ByteAddressBuffer uses for SPIRV. (#3143)Yong He
2023-08-02Only define atomics for `float2` and `float4` when CUDA arch<900 (#3041)Sai Praveen Bangaru
2023-07-12Fix native string emit for CUDA/Cpp backend. (#2980)Yong He
2023-05-09Various fixes for autodiff and slangpy. (#2876)Yong He
2023-04-11Small fixes to TorchTensor. (#2790)Yong He
2023-04-05Fix linking issue in slangpy + no mask param for kernels. (#2778)Yong He
2023-03-30More builtin library support in torch backend. (#2760)Yong He
2023-03-28Add slangpy doc, fix cuda prelude. (#2748)Yong He
2023-03-26Update slang-llvm (#2735)Yong He
2023-03-26Add PyTorch C++ binding generation. (#2734)Yong He
2023-03-17Add support for emitting cuda kernel and host functions. (#2712)Yong He
2023-02-16Overhaul global inst deduplication and cpp/cuda backend. (#2654)Yong He
2022-06-08Improved bounds checking for C++/CUDA (#2263)jsmall-nvidia
2021-06-10CUDA layout corner cases/testing (#1881)jsmall-nvidia
2021-06-04Enable tracing rays with OptiX backend (#1871)Nathan V. Morrical