1OFA会议4:基于BROADCOM ROCE的高性能可扩展MPI库(英文版)
30 页
2OFA会议5:使用MVAPICH中的混合GPU压缩来扩展大型语言模型训练(英文版)
22 页
3OFA会议7:使用OFA Sunfish管理可组合分解基础设施(英文版)
24 页
4OFA会议10:使用CXL实现系统可组合性(英文版)
11 页
5OFA会议13:在MPI中设计网络内计算感知缩减集合(英文版)
33 页
6OFA会议9:Cornelis Networks CN5000 适配器和软件更新(英文版)
23 页
7OFA会议12:RecoNIC:基于FPGA 的 SmartNIC上支持RDMA的计算卸载(英文版)
29 页
8OFA会议6:OFI集成共享内存卸载(英文版)
36 页
9OFA会议3:利用现代GPU集群基于GPU的高效压缩方案加速MPI ALLREDUCE通信(英文版)
21 页
10OFA会议2:MPICH 中OFI接口支持的状态(英文版)
17 页
11OFA会议1:OFI 2.0版本更新(英文版)
20 页
12OFA会议8:Sunfish 和 HPC工作负载管理器的集成深度强化学习代理可组合分解资源调度(英文版)
26 页
13OFA会议11:针对InfiniBand上的高性能MPI库优化的全对全连接建立(英文版)
22 页
14OFA会议:如何使用FSDP集群设置RDMA CI(英文版)
31 页
