由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
gpu
话题找到数量
ScalingIntelligence/KernelBench
KernelBench:大语言模型能否编写GPU内核?——支持Torch转CUDA的基准测试与工具集
SciML/LinearSolve.jl
LinearSolve.jl:Julia线性求解器高性能统一接口,可在因子分解法与Krylov方法间自由切换,支持预条件器集成
JuliaHealth/KomaMRI.jl
Koma是一个GPU加速、兼容Pulseq的磁共振成像采集模拟框架,主要专注于模拟脉冲序列开发中遇到的各种场景。
psmarter/CUDA-Practice
CUDA编程练习项目——动手实践CUDA内核与性能优化,涵盖GEMM、FlashAttention、Tensor Cores、CUTLASS、量化、KV缓存、NCCL及性能分析。
CliMA/ClimaAtmos.jl
ClimaAtmos.jl 是一个大气模型,旨在利用数据同化和机器学习工具来建模和校准次网格尺度过程。