~/home / tags / 高性能计算

# 高性能计算

6 个相关产品 · 中文解读 · 按热度排序
Forward-Only, Autograd-Free PINN with 0ns Zero-Copy Memory Interlock
一种无需反向传播、内存零拷贝的前向仅限物理信息神经网络,专为高性能科学计算优化,面向研究者和高性能计算开发者;
cuTile Rust: Safe, data-race-free GPU kernels in Rust
cuTile 是一个用 Rust 编写的 GPU 内核开发工具,通过类型安全和内存安全机制,让开发者能编写无数据竞争的 GPU 程序,特别适合需要高性能计算又追求安全的 Rust
Real-time n-body tree code in CUDA
基于CUDA实现的实时n体树算法,用于高性能物理模拟与天文计算
NVIDIA/cuda-samples
NVIDIA CUDA Samples 提供了 CUDA 开发者所需的各种示例代码,涵盖 GPU 加速计算的各类场景,是学习和调试 CUDA 的实用资源。
flashinfer-ai/flashinfer
FlashInfer 是专为大语言模型推理优化的高性能内核库,通过低级算子优化显著提升 LLM 服务的吞吐与延迟,适合 AI 工程师和推理服务开发者。
tile-ai/tilelang
面向高性能计算的领域专用语言(TileLang),用于高效编写GPU/CPU/加速器上的计算内核,提升AI与科学计算性能
其他标签