update parallel rdp

This commit is contained in:
Logan McNaughton
2024-05-27 12:38:09 -06:00
parent 981d2d459b
commit cf08f49a21
82 changed files with 59984 additions and 51057 deletions
+31 -29
View File
@@ -28,14 +28,12 @@
namespace Vulkan
{
void BufferPool::init(Device *device_, VkDeviceSize block_size_,
VkDeviceSize alignment_, VkBufferUsageFlags usage_,
bool need_device_local_)
VkDeviceSize alignment_, VkBufferUsageFlags usage_)
{
device = device_;
block_size = block_size_;
alignment = alignment_;
usage = usage_;
need_device_local = need_device_local_;
}
void BufferPool::set_spill_region_size(VkDeviceSize spill_size_)
@@ -59,40 +57,22 @@ void BufferPool::reset()
BufferBlock BufferPool::allocate_block(VkDeviceSize size)
{
BufferDomain ideal_domain = need_device_local ?
BufferDomain::Device :
((usage & VK_BUFFER_USAGE_TRANSFER_SRC_BIT) != 0) ? BufferDomain::Host : BufferDomain::LinkedDeviceHost;
VkBufferUsageFlags extra_usage = ideal_domain == BufferDomain::Device ? VK_BUFFER_USAGE_TRANSFER_DST_BIT : 0;
BufferDomain ideal_domain = ((usage & VK_BUFFER_USAGE_TRANSFER_SRC_BIT) != 0) ?
BufferDomain::Host : BufferDomain::LinkedDeviceHost;
BufferBlock block;
BufferCreateInfo info;
info.domain = ideal_domain;
info.size = size;
info.usage = usage | extra_usage;
info.usage = usage;
block.gpu = device->create_buffer(info, nullptr);
device->set_name(*block.gpu, "chain-allocated-block-gpu");
block.gpu->set_internal_sync_object();
block.buffer = device->create_buffer(info, nullptr);
device->set_name(*block.buffer, "chain-allocated-block");
block.buffer->set_internal_sync_object();
// Try to map it, will fail unless the memory is host visible.
block.mapped = static_cast<uint8_t *>(device->map_host_buffer(*block.gpu, MEMORY_ACCESS_WRITE_BIT));
if (!block.mapped)
{
// Fall back to host memory, and remember to sync to gpu on submission time using DMA queue. :)
BufferCreateInfo cpu_info;
cpu_info.domain = BufferDomain::Host;
cpu_info.size = size;
cpu_info.usage = VK_BUFFER_USAGE_TRANSFER_SRC_BIT;
block.cpu = device->create_buffer(cpu_info, nullptr);
block.cpu->set_internal_sync_object();
device->set_name(*block.cpu, "chain-allocated-block-cpu");
block.mapped = static_cast<uint8_t *>(device->map_host_buffer(*block.cpu, MEMORY_ACCESS_WRITE_BIT));
}
else
block.cpu = block.gpu;
block.mapped = static_cast<uint8_t *>(device->map_host_buffer(*block.buffer, MEMORY_ACCESS_WRITE_BIT));
block.offset = 0;
block.alignment = alignment;
@@ -112,7 +92,7 @@ BufferBlock BufferPool::request_block(VkDeviceSize minimum_size)
auto back = std::move(blocks.back());
blocks.pop_back();
back.mapped = static_cast<uint8_t *>(device->map_host_buffer(*back.cpu, MEMORY_ACCESS_WRITE_BIT));
back.mapped = static_cast<uint8_t *>(device->map_host_buffer(*back.buffer, MEMORY_ACCESS_WRITE_BIT));
back.offset = 0;
return back;
}
@@ -133,4 +113,26 @@ BufferPool::~BufferPool()
VK_ASSERT(blocks.empty());
}
BufferBlockAllocation BufferBlock::allocate(VkDeviceSize allocate_size)
{
auto aligned_offset = (offset + alignment - 1) & ~(alignment - 1);
if (aligned_offset + allocate_size <= size)
{
auto *ret = mapped + aligned_offset;
offset = aligned_offset + allocate_size;
VkDeviceSize padded_size = std::max<VkDeviceSize>(allocate_size, spill_size);
padded_size = std::min<VkDeviceSize>(padded_size, size - aligned_offset);
return { ret, buffer, aligned_offset, padded_size };
}
else
return { nullptr, {}, 0, 0 };
}
void BufferBlock::unmap(Device &device)
{
device.unmap_host_buffer(*buffer, MEMORY_ACCESS_WRITE_BIT);
mapped = nullptr;
}
}