Rust GPU Offload:可移植、安全且高性能
《GPU Offload in Rust: Portable, Safe, and Fast》是一篇介绍 Rust GPU 编译框架的论文,方案将 GPU 编译支持接入 rustc 和 LLVM 后端,尝试在多厂商 GPU 环境中保留 Rust 的所有权、类型系统和严格别名保证。
论文提出两阶段编译流程,处理主机与设备目标之间的 ABI 降低差异,以及手动和编译器生成的数据移动;框架基于 LLVM Offload 管理数据传输,并在 RAJAPerf 评测中生成了接近原生手写 CUDA/HIP C++ 基线的 GPU kernel 性能。论文共 13 页,提交于 2026 年 8 月 13 日。
原文链接:https://arxiv.org/abs/2608.13759
Cargo nightly 实验性减少 target 目录体积
Rust Cargo 团队发布的 Inside Rust 文章介绍了 nightly 渠道上的 target 目录体积优化实验,Cargo 和 nightly rustc 将默认启用 -Zembed-metadata=no,减少 .rlib 中与 .rmeta 重复存储的 crate metadata。
文章以 serde 和 Cargo 自身为例进行测量:serde 的 release 配置下 target 目录缩减约 29.8%,Cargo 在 release、带调试信息的配置下缩减约 33.4%,绝对值接近 300 MiB。该变化目前只针对 nightly,用户如果手动链接 .rlib,需要通过 --extern 同时提供对应的 .rmeta 文件。
原文链接:https://blog.rust-lang.org/inside-rust/2026/08/18/reducing-target-dir-size-on-nightly/
Fyrox Engine 初步接入 wgpu 后端
Fyrox Engine 的第 927 号 Pull Request 提供了 wgpu 图形后端的初始实现,并通过可选 Cargo feature 与现有 OpenGL 后端隔离,不改变默认引擎行为。
新后端可以根据操作系统可用能力在 DirectX 12、Vulkan 和 Metal 等图形 API 之间选择;当前实现已在 Windows 10 和 Fedora Linux 43 上测试。PR 还列出了延迟渲染中的网格位置、外部光源、调试渲染、正交投影和 MSAA 等待完善事项,测试方式为启用 backend_wgpu feature 运行编辑器。
原文链接:https://github.com/FyroxEngine/Fyrox/pull/927
diffable 0.5.0:用 Rust 类型表达微分几何与自动微分
diffable 是一个 Rust 微分几何框架,0.5.0 版本增加了自动微分 API,并继续使用 trait、类型和 blanket implementation 表达向量空间、张量、李群、流形等数学结构。
项目用结构化类型树表示张量积,避免依赖稳定 Rust 尚不支持的通用常量算术;d(f) 会把普通泛型函数转换为可组合的微分程序,d(d(f)) 可以继续计算高阶导数,方向导数则通过 .along(...) 指定。项目还支持非交换标量域、可选 no_std,并将 Jacobian 作为张量代数中的普通结果处理。
原文链接:https://www.reddit.com/r/rust/comments/1vrm593/diffable_050_now_with_a_very_nice_automatic/
评论区
写评论还没有评论