Base-GPU硬件架构基础
ALU、SIMD、Warp/Wave 和 half 精度分别描述 GPU 的执行电路、并行方式、线程调度单位与数据精度。它们属于不同层级,不能由某一个参数直接推导 GPU 的实际性能。 各概念的基本关系如下: ALU:真正执行数学
阅读更多ALU、SIMD、Warp/Wave 和 half 精度分别描述 GPU 的执行电路、并行方式、线程调度单位与数据精度。它们属于不同层级,不能由某一个参数直接推导 GPU 的实际性能。 各概念的基本关系如下: ALU:真正执行数学
阅读更多Shader 中出现 if 并不代表一定产生明显开销。分支成本主要取决于同一个 GPU 执行组中的线程是否选择了不同路径。 如果整个执行组都进入同一个分支,动态分支反而可以跳过大量无用计算;如果组内线程分别进入不同分支,就会产生线程发散(D
阅读更多这篇记一下ShadowMap阴影的技术。 1.ShadowMap相关ShadowMap的原理从Light的方向渲染场景的深度图,因为具有遮挡关系,所以能做阴影用。https://zhuanlan.zhihu.com/p/384446688
阅读更多这篇需要常复习。 1.坐标系笛卡尔坐标系2D 坐标系 3D 坐标系1.左手坐标系Unity的左手坐标系,y上z前x右 UE的左手坐标系,z上y右x前,相当于untiy的坐标系翻了一下,但仍然是左手。 2.右手坐标系y上z后x右
阅读更多常复习篇章。 渲染 空间转换过程VertShaderObject模型空间开始 ——(UNITY_MATTIX_M)——>World空间 ——(UNITY_MATTIX_V)——>View视角空间 ——(UNITY_MATRIX_
阅读更多1.PreZ带来的优势,同时会有哪些消耗?Pre-Z(Depth Prepass)先绘制深度,后续 Base Pass / GBuffer Pass 再使用 ZTest Equal 或 ZTest LEqual。提前建立的深度缓冲
阅读更多问题背景为什么直接一条流水线会有性能瓶颈?在IMR里,GPU流水线是: 提交三角形——>VS——>Raster——>FS——>输出合并 没有全局信息、没有延迟、完全按照顺序执行。 GPU在执行FS的时候,并不知道像素
阅读更多Temporal Anti-Aliasing(TAA,时域抗锯齿)通过跨帧累积样本,提高每个像素的有效采样数量。它能以较低的单帧成本抑制几何边缘和着色闪烁,因此成为实时渲染中常见的抗锯齿方案。 跨帧复用也会引入 Ghosting、Bleed
阅读更多渲染管线中,光照计算阶段的组织方式决定了渲染器的整体架构。前向渲染(Forward)和延迟渲染(Deferred)是两种最主流的方案,它们各自衍生出一系列变体。 下文从光源裁减、G-Buffer、带宽和透明渲染等方面比较两类方案及其常见变体
阅读更多