| 1234567891011121314151617181920212223242526272829303132333435363738394041424344454647484950515253545556575859606162636465666768697071727374757677787980818283848586878889909192939495969798991001011021031041051061071081091101111121131141151161171181191201211221231241251261271281291301311321331341351361371381391401411421431441451461471481491501511521531541551561571581591601611621631641651661671681691701711721731741751761771781791801811821831841851861871881891901911921931941951961971981992002012022032042052062072082092102112122132142152162172182192202212222232242252262272282292302312322332342352362372382392402412422432442452462472482492502512522532542552562572582592602612622632642652662672682692702712722732742752762772782792802812822832842852862872882892902912922932942952962972982993003013023033043053063073083093103113123133143153163173183193203213223233243253263273283293303313323333343353363373383393403413423433443453463473483493503513523533543553563573583593603613623633643653663673683693703713723733743753763773783793803813823833843853863873883893903913923933943953963973983994004014024034044054064074084094104114124134144154164174184194204214224234244254264274284294304314324334344354364374384394404414424434444454464474484494504514524534544554564574584594604614624634644654664674684694704714724734744754764774784794804814824834844854864874884894904914924934944954964974984995005015025035045055065075085095105115125135145155165175185195205215225235245255265275285295305315325335345355365375385395405415425435445455465475485495505515525535545555565575585595605615625635645655665675685695705715725735745755765775785795805815825835845855865875885895905915925935945955965975985996006016026036046056066076086096106116126136146156166176186196206216226236246256266276286296306316326336346356366376386396406416426436446456466476486496506516526536546556566576586596606616626636646656666676686696706716726736746756766776786796806816826836846856866876886896906916926936946956966976986997007017027037047057067077087097107117127137147157167177187197207217227237247257267277287297307317327337347357367377387397407417427437447457467477487497507517527537547557567577587597607617627637647657667677687697707717727737747757767777787797807817827837847857867877887897907917927937947957967977987998008018028038048058068078088098108118128138148158168178188198208218228238248258268278288298308318328338348358368378388398408418428438448458468478488498508518528538548558568578588598608618628638648658668678688698708718728738748758768778788798808818828838848858868878888898908918928938948958968978988999009019029039049059069079089099109119129139149159169179189199209219229239249259269279289299309319329339349359369379389399409419429439449459469479489499509519529539549559569579589599609619629639649659669679689699709719729739749759769779789799809819829839849859869879889899909919929939949959969979989991000100110021003100410051006100710081009101010111012101310141015101610171018101910201021102210231024102510261027102810291030103110321033103410351036103710381039104010411042104310441045104610471048104910501051105210531054105510561057105810591060106110621063106410651066106710681069107010711072107310741075107610771078107910801081108210831084108510861087108810891090109110921093109410951096109710981099110011011102110311041105110611071108110911101111111211131114111511161117111811191120112111221123112411251126112711281129113011311132113311341135113611371138113911401141114211431144114511461147114811491150115111521153115411551156115711581159116011611162116311641165116611671168116911701171117211731174117511761177117811791180118111821183118411851186118711881189119011911192119311941195119611971198119912001201120212031204120512061207120812091210121112121213121412151216121712181219122012211222122312241225122612271228122912301231123212331234123512361237123812391240124112421243124412451246124712481249125012511252125312541255125612571258125912601261126212631264126512661267126812691270127112721273127412751276127712781279128012811282128312841285128612871288128912901291129212931294129512961297129812991300130113021303130413051306130713081309131013111312131313141315131613171318131913201321132213231324132513261327132813291330133113321333133413351336133713381339134013411342134313441345134613471348134913501351135213531354135513561357135813591360136113621363136413651366136713681369137013711372137313741375137613771378137913801381138213831384138513861387138813891390139113921393139413951396139713981399140014011402140314041405140614071408140914101411141214131414141514161417141814191420142114221423142414251426142714281429143014311432143314341435143614371438143914401441144214431444144514461447144814491450145114521453145414551456145714581459146014611462146314641465146614671468146914701471147214731474147514761477147814791480148114821483148414851486148714881489149014911492149314941495149614971498149915001501150215031504150515061507150815091510151115121513151415151516151715181519152015211522152315241525152615271528152915301531153215331534153515361537153815391540154115421543154415451546154715481549155015511552155315541555155615571558155915601561156215631564156515661567156815691570157115721573157415751576157715781579158015811582158315841585158615871588158915901591159215931594159515961597159815991600160116021603160416051606160716081609161016111612161316141615161616171618161916201621162216231624162516261627162816291630163116321633163416351636163716381639164016411642164316441645164616471648164916501651165216531654165516561657165816591660166116621663166416651666166716681669167016711672167316741675167616771678167916801681168216831684168516861687168816891690169116921693169416951696169716981699170017011702170317041705170617071708170917101711171217131714171517161717171817191720172117221723172417251726172717281729173017311732173317341735173617371738173917401741174217431744174517461747174817491750175117521753175417551756175717581759176017611762176317641765176617671768176917701771177217731774177517761777177817791780178117821783178417851786178717881789179017911792179317941795179617971798179918001801180218031804180518061807180818091810181118121813181418151816181718181819182018211822182318241825182618271828182918301831183218331834183518361837183818391840184118421843184418451846184718481849185018511852185318541855185618571858185918601861186218631864186518661867186818691870187118721873187418751876187718781879188018811882188318841885188618871888188918901891189218931894189518961897189818991900190119021903190419051906190719081909191019111912191319141915191619171918191919201921192219231924192519261927192819291930193119321933193419351936193719381939194019411942194319441945194619471948194919501951195219531954195519561957195819591960196119621963196419651966196719681969197019711972197319741975197619771978197919801981198219831984198519861987198819891990199119921993199419951996199719981999200020012002200320042005200620072008 |
- // SPDX-FileCopyrightText: 2021 yuzu Emulator Project
- // SPDX-License-Identifier: GPL-3.0-or-later
- #pragma once
- #include <unordered_set>
- #include "common/alignment.h"
- #include "common/settings.h"
- #include "video_core/control/channel_state.h"
- #include "video_core/dirty_flags.h"
- #include "video_core/engines/kepler_compute.h"
- #include "video_core/texture_cache/image_view_base.h"
- #include "video_core/texture_cache/samples_helper.h"
- #include "video_core/texture_cache/texture_cache_base.h"
- #include "video_core/texture_cache/util.h"
- namespace VideoCommon {
- using Tegra::Texture::SwizzleSource;
- using Tegra::Texture::TextureType;
- using Tegra::Texture::TICEntry;
- using Tegra::Texture::TSCEntry;
- using VideoCore::Surface::GetFormatType;
- using VideoCore::Surface::IsCopyCompatible;
- using VideoCore::Surface::PixelFormat;
- using VideoCore::Surface::PixelFormatFromDepthFormat;
- using VideoCore::Surface::PixelFormatFromRenderTargetFormat;
- using VideoCore::Surface::SurfaceType;
- using namespace Common::Literals;
- template <class P>
- TextureCache<P>::TextureCache(Runtime& runtime_, VideoCore::RasterizerInterface& rasterizer_)
- : runtime{runtime_}, rasterizer{rasterizer_} {
- // Configure null sampler
- TSCEntry sampler_descriptor{};
- sampler_descriptor.min_filter.Assign(Tegra::Texture::TextureFilter::Linear);
- sampler_descriptor.mag_filter.Assign(Tegra::Texture::TextureFilter::Linear);
- sampler_descriptor.mipmap_filter.Assign(Tegra::Texture::TextureMipmapFilter::Linear);
- sampler_descriptor.cubemap_anisotropy.Assign(1);
- // Make sure the first index is reserved for the null resources
- // This way the null resource becomes a compile time constant
- void(slot_images.insert(NullImageParams{}));
- void(slot_image_views.insert(runtime, NullImageViewParams{}));
- void(slot_samplers.insert(runtime, sampler_descriptor));
- if constexpr (HAS_DEVICE_MEMORY_INFO) {
- const s64 device_memory = static_cast<s64>(runtime.GetDeviceLocalMemory());
- const s64 min_spacing_expected = device_memory - 1_GiB - 512_MiB;
- const s64 min_spacing_critical = device_memory - 1_GiB;
- const s64 mem_threshold = std::min(device_memory, TARGET_THRESHOLD);
- const s64 min_vacancy_expected = (6 * mem_threshold) / 10;
- const s64 min_vacancy_critical = (3 * mem_threshold) / 10;
- expected_memory = static_cast<u64>(
- std::max(std::min(device_memory - min_vacancy_expected, min_spacing_expected),
- DEFAULT_EXPECTED_MEMORY));
- critical_memory = static_cast<u64>(
- std::max(std::min(device_memory - min_vacancy_critical, min_spacing_critical),
- DEFAULT_CRITICAL_MEMORY));
- minimum_memory = static_cast<u64>((device_memory - mem_threshold) / 2);
- } else {
- expected_memory = DEFAULT_EXPECTED_MEMORY + 512_MiB;
- critical_memory = DEFAULT_CRITICAL_MEMORY + 1_GiB;
- minimum_memory = 0;
- }
- }
- template <class P>
- void TextureCache<P>::RunGarbageCollector() {
- bool high_priority_mode = total_used_memory >= expected_memory;
- bool aggressive_mode = total_used_memory >= critical_memory;
- const u64 ticks_to_destroy = aggressive_mode ? 10ULL : high_priority_mode ? 25ULL : 50ULL;
- size_t num_iterations = aggressive_mode ? 40 : (high_priority_mode ? 20 : 10);
- const auto clean_up = [this, &num_iterations, &high_priority_mode,
- &aggressive_mode](ImageId image_id) {
- if (num_iterations == 0) {
- return true;
- }
- --num_iterations;
- auto& image = slot_images[image_id];
- const bool must_download =
- image.IsSafeDownload() && False(image.flags & ImageFlagBits::BadOverlap);
- if (!high_priority_mode &&
- (must_download || True(image.flags & ImageFlagBits::CostlyLoad))) {
- return false;
- }
- if (must_download) {
- auto map = runtime.DownloadStagingBuffer(image.unswizzled_size_bytes);
- const auto copies = FullDownloadCopies(image.info);
- image.DownloadMemory(map, copies);
- runtime.Finish();
- SwizzleImage(*gpu_memory, image.gpu_addr, image.info, copies, map.mapped_span);
- }
- if (True(image.flags & ImageFlagBits::Tracked)) {
- UntrackImage(image, image_id);
- }
- UnregisterImage(image_id);
- DeleteImage(image_id, image.scale_tick > frame_tick + 5);
- if (total_used_memory < critical_memory) {
- if (aggressive_mode) {
- // Sink the aggresiveness.
- num_iterations >>= 2;
- aggressive_mode = false;
- return false;
- }
- if (high_priority_mode && total_used_memory < expected_memory) {
- num_iterations >>= 1;
- high_priority_mode = false;
- }
- }
- return false;
- };
- lru_cache.ForEachItemBelow(frame_tick - ticks_to_destroy, clean_up);
- }
- template <class P>
- void TextureCache<P>::TickFrame() {
- // If we can obtain the memory info, use it instead of the estimate.
- if (runtime.CanReportMemoryUsage()) {
- total_used_memory = runtime.GetDeviceMemoryUsage();
- }
- if (total_used_memory > minimum_memory) {
- RunGarbageCollector();
- }
- sentenced_images.Tick();
- sentenced_framebuffers.Tick();
- sentenced_image_view.Tick();
- runtime.TickFrame();
- critical_gc = 0;
- ++frame_tick;
- }
- template <class P>
- const typename P::ImageView& TextureCache<P>::GetImageView(ImageViewId id) const noexcept {
- return slot_image_views[id];
- }
- template <class P>
- typename P::ImageView& TextureCache<P>::GetImageView(ImageViewId id) noexcept {
- return slot_image_views[id];
- }
- template <class P>
- void TextureCache<P>::MarkModification(ImageId id) noexcept {
- MarkModification(slot_images[id]);
- }
- template <class P>
- template <bool has_blacklists>
- void TextureCache<P>::FillGraphicsImageViews(std::span<ImageViewInOut> views) {
- FillImageViews<has_blacklists>(channel_state->graphics_image_table,
- channel_state->graphics_image_view_ids, views);
- }
- template <class P>
- void TextureCache<P>::FillComputeImageViews(std::span<ImageViewInOut> views) {
- FillImageViews<true>(channel_state->compute_image_table, channel_state->compute_image_view_ids,
- views);
- }
- template <class P>
- typename P::Sampler* TextureCache<P>::GetGraphicsSampler(u32 index) {
- if (index > channel_state->graphics_sampler_table.Limit()) {
- LOG_DEBUG(HW_GPU, "Invalid sampler index={}", index);
- return &slot_samplers[NULL_SAMPLER_ID];
- }
- const auto [descriptor, is_new] = channel_state->graphics_sampler_table.Read(index);
- SamplerId& id = channel_state->graphics_sampler_ids[index];
- if (is_new) {
- id = FindSampler(descriptor);
- }
- return &slot_samplers[id];
- }
- template <class P>
- typename P::Sampler* TextureCache<P>::GetComputeSampler(u32 index) {
- if (index > channel_state->compute_sampler_table.Limit()) {
- LOG_DEBUG(HW_GPU, "Invalid sampler index={}", index);
- return &slot_samplers[NULL_SAMPLER_ID];
- }
- const auto [descriptor, is_new] = channel_state->compute_sampler_table.Read(index);
- SamplerId& id = channel_state->compute_sampler_ids[index];
- if (is_new) {
- id = FindSampler(descriptor);
- }
- return &slot_samplers[id];
- }
- template <class P>
- void TextureCache<P>::SynchronizeGraphicsDescriptors() {
- using SamplerBinding = Tegra::Engines::Maxwell3D::Regs::SamplerBinding;
- const bool linked_tsc = maxwell3d->regs.sampler_binding == SamplerBinding::ViaHeaderBinding;
- const u32 tic_limit = maxwell3d->regs.tex_header.limit;
- const u32 tsc_limit = linked_tsc ? tic_limit : maxwell3d->regs.tex_sampler.limit;
- if (channel_state->graphics_sampler_table.Synchronize(maxwell3d->regs.tex_sampler.Address(),
- tsc_limit)) {
- channel_state->graphics_sampler_ids.resize(tsc_limit + 1, CORRUPT_ID);
- }
- if (channel_state->graphics_image_table.Synchronize(maxwell3d->regs.tex_header.Address(),
- tic_limit)) {
- channel_state->graphics_image_view_ids.resize(tic_limit + 1, CORRUPT_ID);
- }
- }
- template <class P>
- void TextureCache<P>::SynchronizeComputeDescriptors() {
- const bool linked_tsc = kepler_compute->launch_description.linked_tsc;
- const u32 tic_limit = kepler_compute->regs.tic.limit;
- const u32 tsc_limit = linked_tsc ? tic_limit : kepler_compute->regs.tsc.limit;
- const GPUVAddr tsc_gpu_addr = kepler_compute->regs.tsc.Address();
- if (channel_state->compute_sampler_table.Synchronize(tsc_gpu_addr, tsc_limit)) {
- channel_state->compute_sampler_ids.resize(tsc_limit + 1, CORRUPT_ID);
- }
- if (channel_state->compute_image_table.Synchronize(kepler_compute->regs.tic.Address(),
- tic_limit)) {
- channel_state->compute_image_view_ids.resize(tic_limit + 1, CORRUPT_ID);
- }
- }
- template <class P>
- bool TextureCache<P>::RescaleRenderTargets(bool is_clear) {
- auto& flags = maxwell3d->dirty.flags;
- u32 scale_rating = 0;
- bool rescaled = false;
- std::array<ImageId, NUM_RT> tmp_color_images{};
- ImageId tmp_depth_image{};
- do {
- flags[Dirty::RenderTargets] = false;
- has_deleted_images = false;
- // Render target control is used on all render targets, so force look ups when this one is
- // up
- const bool force = flags[Dirty::RenderTargetControl];
- flags[Dirty::RenderTargetControl] = false;
- scale_rating = 0;
- bool any_rescaled = false;
- bool can_rescale = true;
- const auto check_rescale = [&](ImageViewId view_id, ImageId& id_save) {
- if (view_id != NULL_IMAGE_VIEW_ID && view_id != ImageViewId{}) {
- const auto& view = slot_image_views[view_id];
- const auto image_id = view.image_id;
- id_save = image_id;
- auto& image = slot_images[image_id];
- can_rescale &= ImageCanRescale(image);
- any_rescaled |= True(image.flags & ImageFlagBits::Rescaled) ||
- GetFormatType(image.info.format) != SurfaceType::ColorTexture;
- scale_rating = std::max<u32>(scale_rating, image.scale_tick <= frame_tick
- ? image.scale_rating + 1U
- : image.scale_rating);
- } else {
- id_save = CORRUPT_ID;
- }
- };
- for (size_t index = 0; index < NUM_RT; ++index) {
- ImageViewId& color_buffer_id = render_targets.color_buffer_ids[index];
- if (flags[Dirty::ColorBuffer0 + index] || force) {
- flags[Dirty::ColorBuffer0 + index] = false;
- BindRenderTarget(&color_buffer_id, FindColorBuffer(index, is_clear));
- }
- check_rescale(color_buffer_id, tmp_color_images[index]);
- }
- if (flags[Dirty::ZetaBuffer] || force) {
- flags[Dirty::ZetaBuffer] = false;
- BindRenderTarget(&render_targets.depth_buffer_id, FindDepthBuffer(is_clear));
- }
- check_rescale(render_targets.depth_buffer_id, tmp_depth_image);
- if (can_rescale) {
- rescaled = any_rescaled || scale_rating >= 2;
- const auto scale_up = [this](ImageId image_id) {
- if (image_id != CORRUPT_ID) {
- Image& image = slot_images[image_id];
- ScaleUp(image);
- }
- };
- if (rescaled) {
- for (size_t index = 0; index < NUM_RT; ++index) {
- scale_up(tmp_color_images[index]);
- }
- scale_up(tmp_depth_image);
- scale_rating = 2;
- }
- } else {
- rescaled = false;
- const auto scale_down = [this](ImageId image_id) {
- if (image_id != CORRUPT_ID) {
- Image& image = slot_images[image_id];
- ScaleDown(image);
- }
- };
- for (size_t index = 0; index < NUM_RT; ++index) {
- scale_down(tmp_color_images[index]);
- }
- scale_down(tmp_depth_image);
- scale_rating = 1;
- }
- } while (has_deleted_images);
- const auto set_rating = [this, scale_rating](ImageId image_id) {
- if (image_id != CORRUPT_ID) {
- Image& image = slot_images[image_id];
- image.scale_rating = scale_rating;
- if (image.scale_tick <= frame_tick) {
- image.scale_tick = frame_tick + 1;
- }
- }
- };
- for (size_t index = 0; index < NUM_RT; ++index) {
- set_rating(tmp_color_images[index]);
- }
- set_rating(tmp_depth_image);
- return rescaled;
- }
- template <class P>
- void TextureCache<P>::UpdateRenderTargets(bool is_clear) {
- using namespace VideoCommon::Dirty;
- auto& flags = maxwell3d->dirty.flags;
- if (!flags[Dirty::RenderTargets]) {
- for (size_t index = 0; index < NUM_RT; ++index) {
- ImageViewId& color_buffer_id = render_targets.color_buffer_ids[index];
- PrepareImageView(color_buffer_id, true, is_clear && IsFullClear(color_buffer_id));
- }
- const ImageViewId depth_buffer_id = render_targets.depth_buffer_id;
- PrepareImageView(depth_buffer_id, true, is_clear && IsFullClear(depth_buffer_id));
- return;
- }
- const bool rescaled = RescaleRenderTargets(is_clear);
- if (is_rescaling != rescaled) {
- flags[Dirty::RescaleViewports] = true;
- flags[Dirty::RescaleScissors] = true;
- is_rescaling = rescaled;
- }
- for (size_t index = 0; index < NUM_RT; ++index) {
- ImageViewId& color_buffer_id = render_targets.color_buffer_ids[index];
- PrepareImageView(color_buffer_id, true, is_clear && IsFullClear(color_buffer_id));
- }
- const ImageViewId depth_buffer_id = render_targets.depth_buffer_id;
- PrepareImageView(depth_buffer_id, true, is_clear && IsFullClear(depth_buffer_id));
- for (size_t index = 0; index < NUM_RT; ++index) {
- render_targets.draw_buffers[index] = static_cast<u8>(maxwell3d->regs.rt_control.Map(index));
- }
- u32 up_scale = 1;
- u32 down_shift = 0;
- if (is_rescaling) {
- up_scale = Settings::values.resolution_info.up_scale;
- down_shift = Settings::values.resolution_info.down_shift;
- }
- render_targets.size = Extent2D{
- (maxwell3d->regs.surface_clip.width * up_scale) >> down_shift,
- (maxwell3d->regs.surface_clip.height * up_scale) >> down_shift,
- };
- render_targets.is_rescaled = is_rescaling;
- flags[Dirty::DepthBiasGlobal] = true;
- }
- template <class P>
- typename P::Framebuffer* TextureCache<P>::GetFramebuffer() {
- return &slot_framebuffers[GetFramebufferId(render_targets)];
- }
- template <class P>
- template <bool has_blacklists>
- void TextureCache<P>::FillImageViews(DescriptorTable<TICEntry>& table,
- std::span<ImageViewId> cached_image_view_ids,
- std::span<ImageViewInOut> views) {
- bool has_blacklisted = false;
- do {
- has_deleted_images = false;
- if constexpr (has_blacklists) {
- has_blacklisted = false;
- }
- for (ImageViewInOut& view : views) {
- view.id = VisitImageView(table, cached_image_view_ids, view.index);
- if constexpr (has_blacklists) {
- if (view.blacklist && view.id != NULL_IMAGE_VIEW_ID) {
- const ImageViewBase& image_view{slot_image_views[view.id]};
- auto& image = slot_images[image_view.image_id];
- has_blacklisted |= ScaleDown(image);
- image.scale_rating = 0;
- }
- }
- }
- } while (has_deleted_images || (has_blacklists && has_blacklisted));
- }
- template <class P>
- ImageViewId TextureCache<P>::VisitImageView(DescriptorTable<TICEntry>& table,
- std::span<ImageViewId> cached_image_view_ids,
- u32 index) {
- if (index > table.Limit()) {
- LOG_DEBUG(HW_GPU, "Invalid image view index={}", index);
- return NULL_IMAGE_VIEW_ID;
- }
- const auto [descriptor, is_new] = table.Read(index);
- ImageViewId& image_view_id = cached_image_view_ids[index];
- if (is_new) {
- image_view_id = FindImageView(descriptor);
- }
- if (image_view_id != NULL_IMAGE_VIEW_ID) {
- PrepareImageView(image_view_id, false, false);
- }
- return image_view_id;
- }
- template <class P>
- FramebufferId TextureCache<P>::GetFramebufferId(const RenderTargets& key) {
- const auto [pair, is_new] = framebuffers.try_emplace(key);
- FramebufferId& framebuffer_id = pair->second;
- if (!is_new) {
- return framebuffer_id;
- }
- std::array<ImageView*, NUM_RT> color_buffers;
- std::ranges::transform(key.color_buffer_ids, color_buffers.begin(),
- [this](ImageViewId id) { return id ? &slot_image_views[id] : nullptr; });
- ImageView* const depth_buffer =
- key.depth_buffer_id ? &slot_image_views[key.depth_buffer_id] : nullptr;
- framebuffer_id = slot_framebuffers.insert(runtime, color_buffers, depth_buffer, key);
- return framebuffer_id;
- }
- template <class P>
- void TextureCache<P>::WriteMemory(VAddr cpu_addr, size_t size) {
- ForEachImageInRegion(cpu_addr, size, [this](ImageId image_id, Image& image) {
- if (True(image.flags & ImageFlagBits::CpuModified)) {
- return;
- }
- image.flags |= ImageFlagBits::CpuModified;
- if (True(image.flags & ImageFlagBits::Tracked)) {
- UntrackImage(image, image_id);
- }
- });
- }
- template <class P>
- void TextureCache<P>::DownloadMemory(VAddr cpu_addr, size_t size) {
- std::vector<ImageId> images;
- ForEachImageInRegion(cpu_addr, size, [this, &images](ImageId image_id, ImageBase& image) {
- if (!image.IsSafeDownload()) {
- return;
- }
- image.flags &= ~ImageFlagBits::GpuModified;
- images.push_back(image_id);
- });
- if (images.empty()) {
- return;
- }
- std::ranges::sort(images, [this](ImageId lhs, ImageId rhs) {
- return slot_images[lhs].modification_tick < slot_images[rhs].modification_tick;
- });
- for (const ImageId image_id : images) {
- Image& image = slot_images[image_id];
- auto map = runtime.DownloadStagingBuffer(image.unswizzled_size_bytes);
- const auto copies = FullDownloadCopies(image.info);
- image.DownloadMemory(map, copies);
- runtime.Finish();
- SwizzleImage(*gpu_memory, image.gpu_addr, image.info, copies, map.mapped_span);
- }
- }
- template <class P>
- void TextureCache<P>::UnmapMemory(VAddr cpu_addr, size_t size) {
- std::vector<ImageId> deleted_images;
- ForEachImageInRegion(cpu_addr, size, [&](ImageId id, Image&) { deleted_images.push_back(id); });
- for (const ImageId id : deleted_images) {
- Image& image = slot_images[id];
- if (True(image.flags & ImageFlagBits::Tracked)) {
- UntrackImage(image, id);
- }
- UnregisterImage(id);
- DeleteImage(id);
- }
- }
- template <class P>
- void TextureCache<P>::UnmapGPUMemory(size_t as_id, GPUVAddr gpu_addr, size_t size) {
- std::vector<ImageId> deleted_images;
- ForEachImageInRegionGPU(as_id, gpu_addr, size,
- [&](ImageId id, Image&) { deleted_images.push_back(id); });
- for (const ImageId id : deleted_images) {
- Image& image = slot_images[id];
- if (True(image.flags & ImageFlagBits::CpuModified)) {
- return;
- }
- image.flags |= ImageFlagBits::CpuModified;
- if (True(image.flags & ImageFlagBits::Tracked)) {
- UntrackImage(image, id);
- }
- /*
- if (True(image.flags & ImageFlagBits::Remapped)) {
- continue;
- }
- image.flags |= ImageFlagBits::Remapped;
- if (True(image.flags & ImageFlagBits::Tracked)) {
- UntrackImage(image, id);
- }
- */
- }
- }
- template <class P>
- void TextureCache<P>::BlitImage(const Tegra::Engines::Fermi2D::Surface& dst,
- const Tegra::Engines::Fermi2D::Surface& src,
- const Tegra::Engines::Fermi2D::Config& copy) {
- const BlitImages images = GetBlitImages(dst, src, copy);
- const ImageId dst_id = images.dst_id;
- const ImageId src_id = images.src_id;
- PrepareImage(src_id, false, false);
- PrepareImage(dst_id, true, false);
- Image& dst_image = slot_images[dst_id];
- Image& src_image = slot_images[src_id];
- bool is_src_rescaled = True(src_image.flags & ImageFlagBits::Rescaled);
- bool is_dst_rescaled = True(dst_image.flags & ImageFlagBits::Rescaled);
- const bool is_resolve = src_image.info.num_samples != 1 && dst_image.info.num_samples == 1;
- if (is_src_rescaled != is_dst_rescaled) {
- if (ImageCanRescale(src_image)) {
- ScaleUp(src_image);
- is_src_rescaled = True(src_image.flags & ImageFlagBits::Rescaled);
- if (is_resolve) {
- dst_image.info.rescaleable = true;
- for (const auto& alias : dst_image.aliased_images) {
- Image& other_image = slot_images[alias.id];
- other_image.info.rescaleable = true;
- }
- }
- }
- if (ImageCanRescale(dst_image)) {
- ScaleUp(dst_image);
- is_dst_rescaled = True(dst_image.flags & ImageFlagBits::Rescaled);
- }
- }
- if (is_resolve && (is_src_rescaled != is_dst_rescaled)) {
- // A resolve requires both images to be the same dimensions. Resize down if needed.
- ScaleDown(src_image);
- ScaleDown(dst_image);
- is_src_rescaled = True(src_image.flags & ImageFlagBits::Rescaled);
- is_dst_rescaled = True(dst_image.flags & ImageFlagBits::Rescaled);
- }
- const auto& resolution = Settings::values.resolution_info;
- const auto scale_region = [&](Region2D& region) {
- region.start.x = resolution.ScaleUp(region.start.x);
- region.start.y = resolution.ScaleUp(region.start.y);
- region.end.x = resolution.ScaleUp(region.end.x);
- region.end.y = resolution.ScaleUp(region.end.y);
- };
- // TODO: Deduplicate
- const std::optional src_base = src_image.TryFindBase(src.Address());
- const SubresourceRange src_range{.base = src_base.value(), .extent = {1, 1}};
- const ImageViewInfo src_view_info(ImageViewType::e2D, images.src_format, src_range);
- const auto [src_framebuffer_id, src_view_id] = RenderTargetFromImage(src_id, src_view_info);
- const auto [src_samples_x, src_samples_y] = SamplesLog2(src_image.info.num_samples);
- Region2D src_region{
- Offset2D{.x = copy.src_x0 >> src_samples_x, .y = copy.src_y0 >> src_samples_y},
- Offset2D{.x = copy.src_x1 >> src_samples_x, .y = copy.src_y1 >> src_samples_y},
- };
- if (is_src_rescaled) {
- scale_region(src_region);
- }
- const std::optional dst_base = dst_image.TryFindBase(dst.Address());
- const SubresourceRange dst_range{.base = dst_base.value(), .extent = {1, 1}};
- const ImageViewInfo dst_view_info(ImageViewType::e2D, images.dst_format, dst_range);
- const auto [dst_framebuffer_id, dst_view_id] = RenderTargetFromImage(dst_id, dst_view_info);
- const auto [dst_samples_x, dst_samples_y] = SamplesLog2(dst_image.info.num_samples);
- Region2D dst_region{
- Offset2D{.x = copy.dst_x0 >> dst_samples_x, .y = copy.dst_y0 >> dst_samples_y},
- Offset2D{.x = copy.dst_x1 >> dst_samples_x, .y = copy.dst_y1 >> dst_samples_y},
- };
- if (is_dst_rescaled) {
- scale_region(dst_region);
- }
- // Always call this after src_framebuffer_id was queried, as the address might be invalidated.
- Framebuffer* const dst_framebuffer = &slot_framebuffers[dst_framebuffer_id];
- if constexpr (FRAMEBUFFER_BLITS) {
- // OpenGL blits from framebuffers, not images
- Framebuffer* const src_framebuffer = &slot_framebuffers[src_framebuffer_id];
- runtime.BlitFramebuffer(dst_framebuffer, src_framebuffer, dst_region, src_region,
- copy.filter, copy.operation);
- } else {
- // Vulkan can blit images, but it lacks format reinterpretations
- // Provide a framebuffer in case it's necessary
- ImageView& dst_view = slot_image_views[dst_view_id];
- ImageView& src_view = slot_image_views[src_view_id];
- runtime.BlitImage(dst_framebuffer, dst_view, src_view, dst_region, src_region, copy.filter,
- copy.operation);
- }
- }
- template <class P>
- typename P::ImageView* TextureCache<P>::TryFindFramebufferImageView(VAddr cpu_addr) {
- // TODO: Properly implement this
- const auto it = page_table.find(cpu_addr >> YUZU_PAGEBITS);
- if (it == page_table.end()) {
- return nullptr;
- }
- const auto& image_map_ids = it->second;
- for (const ImageMapId map_id : image_map_ids) {
- const ImageMapView& map = slot_map_views[map_id];
- const ImageBase& image = slot_images[map.image_id];
- if (image.cpu_addr != cpu_addr) {
- continue;
- }
- if (image.image_view_ids.empty()) {
- continue;
- }
- return &slot_image_views[image.image_view_ids.at(0)];
- }
- return nullptr;
- }
- template <class P>
- bool TextureCache<P>::HasUncommittedFlushes() const noexcept {
- return !uncommitted_downloads.empty();
- }
- template <class P>
- bool TextureCache<P>::ShouldWaitAsyncFlushes() const noexcept {
- return !committed_downloads.empty() && !committed_downloads.front().empty();
- }
- template <class P>
- void TextureCache<P>::CommitAsyncFlushes() {
- // This is intentionally passing the value by copy
- committed_downloads.push(uncommitted_downloads);
- uncommitted_downloads.clear();
- }
- template <class P>
- void TextureCache<P>::PopAsyncFlushes() {
- if (committed_downloads.empty()) {
- return;
- }
- const std::span<const ImageId> download_ids = committed_downloads.front();
- if (download_ids.empty()) {
- committed_downloads.pop();
- return;
- }
- size_t total_size_bytes = 0;
- for (const ImageId image_id : download_ids) {
- total_size_bytes += slot_images[image_id].unswizzled_size_bytes;
- }
- auto download_map = runtime.DownloadStagingBuffer(total_size_bytes);
- const size_t original_offset = download_map.offset;
- for (const ImageId image_id : download_ids) {
- Image& image = slot_images[image_id];
- const auto copies = FullDownloadCopies(image.info);
- image.DownloadMemory(download_map, copies);
- download_map.offset += image.unswizzled_size_bytes;
- }
- // Wait for downloads to finish
- runtime.Finish();
- download_map.offset = original_offset;
- std::span<u8> download_span = download_map.mapped_span;
- for (const ImageId image_id : download_ids) {
- const ImageBase& image = slot_images[image_id];
- const auto copies = FullDownloadCopies(image.info);
- SwizzleImage(*gpu_memory, image.gpu_addr, image.info, copies, download_span);
- download_map.offset += image.unswizzled_size_bytes;
- download_span = download_span.subspan(image.unswizzled_size_bytes);
- }
- committed_downloads.pop();
- }
- template <class P>
- bool TextureCache<P>::IsRescaling() const noexcept {
- return is_rescaling;
- }
- template <class P>
- bool TextureCache<P>::IsRescaling(const ImageViewBase& image_view) const noexcept {
- if (image_view.type == ImageViewType::Buffer) {
- return false;
- }
- const ImageBase& image = slot_images[image_view.image_id];
- return True(image.flags & ImageFlagBits::Rescaled);
- }
- template <class P>
- bool TextureCache<P>::IsRegionGpuModified(VAddr addr, size_t size) {
- bool is_modified = false;
- ForEachImageInRegion(addr, size, [&is_modified](ImageId, ImageBase& image) {
- if (False(image.flags & ImageFlagBits::GpuModified)) {
- return false;
- }
- is_modified = true;
- return true;
- });
- return is_modified;
- }
- template <class P>
- void TextureCache<P>::RefreshContents(Image& image, ImageId image_id) {
- if (False(image.flags & ImageFlagBits::CpuModified)) {
- // Only upload modified images
- return;
- }
- image.flags &= ~ImageFlagBits::CpuModified;
- TrackImage(image, image_id);
- if (image.info.num_samples > 1) {
- LOG_WARNING(HW_GPU, "MSAA image uploads are not implemented");
- return;
- }
- auto staging = runtime.UploadStagingBuffer(MapSizeBytes(image));
- UploadImageContents(image, staging);
- runtime.InsertUploadMemoryBarrier();
- }
- template <class P>
- template <typename StagingBuffer>
- void TextureCache<P>::UploadImageContents(Image& image, StagingBuffer& staging) {
- const std::span<u8> mapped_span = staging.mapped_span;
- const GPUVAddr gpu_addr = image.gpu_addr;
- if (True(image.flags & ImageFlagBits::AcceleratedUpload)) {
- gpu_memory->ReadBlockUnsafe(gpu_addr, mapped_span.data(), mapped_span.size_bytes());
- const auto uploads = FullUploadSwizzles(image.info);
- runtime.AccelerateImageUpload(image, staging, uploads);
- } else if (True(image.flags & ImageFlagBits::Converted)) {
- std::vector<u8> unswizzled_data(image.unswizzled_size_bytes);
- auto copies = UnswizzleImage(*gpu_memory, gpu_addr, image.info, unswizzled_data);
- ConvertImage(unswizzled_data, image.info, mapped_span, copies);
- image.UploadMemory(staging, copies);
- } else {
- const auto copies = UnswizzleImage(*gpu_memory, gpu_addr, image.info, mapped_span);
- image.UploadMemory(staging, copies);
- }
- }
- template <class P>
- ImageViewId TextureCache<P>::FindImageView(const TICEntry& config) {
- if (!IsValidEntry(*gpu_memory, config)) {
- return NULL_IMAGE_VIEW_ID;
- }
- const auto [pair, is_new] = channel_state->image_views.try_emplace(config);
- ImageViewId& image_view_id = pair->second;
- if (is_new) {
- image_view_id = CreateImageView(config);
- }
- return image_view_id;
- }
- template <class P>
- ImageViewId TextureCache<P>::CreateImageView(const TICEntry& config) {
- const ImageInfo info(config);
- if (info.type == ImageType::Buffer) {
- const ImageViewInfo view_info(config, 0);
- return slot_image_views.insert(runtime, info, view_info, config.Address());
- }
- const u32 layer_offset = config.BaseLayer() * info.layer_stride;
- const GPUVAddr image_gpu_addr = config.Address() - layer_offset;
- const ImageId image_id = FindOrInsertImage(info, image_gpu_addr);
- if (!image_id) {
- return NULL_IMAGE_VIEW_ID;
- }
- ImageBase& image = slot_images[image_id];
- const SubresourceBase base = image.TryFindBase(config.Address()).value();
- ASSERT(base.level == 0);
- const ImageViewInfo view_info(config, base.layer);
- const ImageViewId image_view_id = FindOrEmplaceImageView(image_id, view_info);
- ImageViewBase& image_view = slot_image_views[image_view_id];
- image_view.flags |= ImageViewFlagBits::Strong;
- image.flags |= ImageFlagBits::Strong;
- return image_view_id;
- }
- template <class P>
- ImageId TextureCache<P>::FindOrInsertImage(const ImageInfo& info, GPUVAddr gpu_addr,
- RelaxedOptions options) {
- if (const ImageId image_id = FindImage(info, gpu_addr, options); image_id) {
- return image_id;
- }
- return InsertImage(info, gpu_addr, options);
- }
- template <class P>
- ImageId TextureCache<P>::FindImage(const ImageInfo& info, GPUVAddr gpu_addr,
- RelaxedOptions options) {
- std::optional<VAddr> cpu_addr = gpu_memory->GpuToCpuAddress(gpu_addr);
- if (!cpu_addr) {
- cpu_addr = gpu_memory->GpuToCpuAddress(gpu_addr, CalculateGuestSizeInBytes(info));
- if (!cpu_addr) {
- return ImageId{};
- }
- }
- const bool broken_views =
- runtime.HasBrokenTextureViewFormats() || True(options & RelaxedOptions::ForceBrokenViews);
- const bool native_bgr = runtime.HasNativeBgr();
- const bool flexible_formats = True(options & RelaxedOptions::Format);
- ImageId image_id{};
- boost::container::small_vector<ImageId, 1> image_ids;
- const auto lambda = [&](ImageId existing_image_id, ImageBase& existing_image) {
- if (True(existing_image.flags & ImageFlagBits::Remapped)) {
- return false;
- }
- if (info.type == ImageType::Linear || existing_image.info.type == ImageType::Linear)
- [[unlikely]] {
- const bool strict_size = False(options & RelaxedOptions::Size) &&
- True(existing_image.flags & ImageFlagBits::Strong);
- const ImageInfo& existing = existing_image.info;
- if (existing_image.gpu_addr == gpu_addr && existing.type == info.type &&
- existing.pitch == info.pitch &&
- IsPitchLinearSameSize(existing, info, strict_size) &&
- IsViewCompatible(existing.format, info.format, broken_views, native_bgr)) {
- image_id = existing_image_id;
- image_ids.push_back(existing_image_id);
- return !flexible_formats && existing.format == info.format;
- }
- } else if (IsSubresource(info, existing_image, gpu_addr, options, broken_views,
- native_bgr)) {
- image_id = existing_image_id;
- image_ids.push_back(existing_image_id);
- return !flexible_formats && existing_image.info.format == info.format;
- }
- return false;
- };
- ForEachImageInRegion(*cpu_addr, CalculateGuestSizeInBytes(info), lambda);
- if (image_ids.size() <= 1) [[likely]] {
- return image_id;
- }
- auto image_ids_compare = [this](ImageId a, ImageId b) {
- auto& image_a = slot_images[a];
- auto& image_b = slot_images[b];
- return image_a.modification_tick < image_b.modification_tick;
- };
- return *std::ranges::max_element(image_ids, image_ids_compare);
- }
- template <class P>
- bool TextureCache<P>::ImageCanRescale(ImageBase& image) {
- if (!image.info.rescaleable) {
- return false;
- }
- if (Settings::values.resolution_info.downscale && !image.info.downscaleable) {
- return false;
- }
- if (True(image.flags & (ImageFlagBits::Rescaled | ImageFlagBits::CheckingRescalable))) {
- return true;
- }
- if (True(image.flags & ImageFlagBits::IsRescalable)) {
- return true;
- }
- image.flags |= ImageFlagBits::CheckingRescalable;
- for (const auto& alias : image.aliased_images) {
- Image& other_image = slot_images[alias.id];
- if (!ImageCanRescale(other_image)) {
- image.flags &= ~ImageFlagBits::CheckingRescalable;
- return false;
- }
- }
- image.flags &= ~ImageFlagBits::CheckingRescalable;
- image.flags |= ImageFlagBits::IsRescalable;
- return true;
- }
- template <class P>
- void TextureCache<P>::InvalidateScale(Image& image) {
- if (image.scale_tick <= frame_tick) {
- image.scale_tick = frame_tick + 1;
- }
- const std::span<const ImageViewId> image_view_ids = image.image_view_ids;
- auto& dirty = maxwell3d->dirty.flags;
- dirty[Dirty::RenderTargets] = true;
- dirty[Dirty::ZetaBuffer] = true;
- for (size_t rt = 0; rt < NUM_RT; ++rt) {
- dirty[Dirty::ColorBuffer0 + rt] = true;
- }
- for (const ImageViewId image_view_id : image_view_ids) {
- std::ranges::replace(render_targets.color_buffer_ids, image_view_id, ImageViewId{});
- if (render_targets.depth_buffer_id == image_view_id) {
- render_targets.depth_buffer_id = ImageViewId{};
- }
- }
- RemoveImageViewReferences(image_view_ids);
- RemoveFramebuffers(image_view_ids);
- for (const ImageViewId image_view_id : image_view_ids) {
- sentenced_image_view.Push(std::move(slot_image_views[image_view_id]));
- slot_image_views.erase(image_view_id);
- }
- image.image_view_ids.clear();
- image.image_view_infos.clear();
- for (size_t c : active_channel_ids) {
- auto& channel_info = channel_storage[c];
- if constexpr (ENABLE_VALIDATION) {
- std::ranges::fill(channel_info.graphics_image_view_ids, CORRUPT_ID);
- std::ranges::fill(channel_info.compute_image_view_ids, CORRUPT_ID);
- }
- channel_info.graphics_image_table.Invalidate();
- channel_info.compute_image_table.Invalidate();
- }
- has_deleted_images = true;
- }
- template <class P>
- u64 TextureCache<P>::GetScaledImageSizeBytes(ImageBase& image) {
- const u64 scale_up = static_cast<u64>(Settings::values.resolution_info.up_scale *
- Settings::values.resolution_info.up_scale);
- const u64 down_shift = static_cast<u64>(Settings::values.resolution_info.down_shift +
- Settings::values.resolution_info.down_shift);
- const u64 image_size_bytes =
- static_cast<u64>(std::max(image.guest_size_bytes, image.unswizzled_size_bytes));
- const u64 tentative_size = (image_size_bytes * scale_up) >> down_shift;
- const u64 fitted_size = Common::AlignUp(tentative_size, 1024);
- return fitted_size;
- }
- template <class P>
- bool TextureCache<P>::ScaleUp(Image& image) {
- const bool has_copy = image.HasScaled();
- const bool rescaled = image.ScaleUp();
- if (!rescaled) {
- return false;
- }
- if (!has_copy) {
- total_used_memory += GetScaledImageSizeBytes(image);
- }
- InvalidateScale(image);
- return true;
- }
- template <class P>
- bool TextureCache<P>::ScaleDown(Image& image) {
- const bool rescaled = image.ScaleDown();
- if (!rescaled) {
- return false;
- }
- InvalidateScale(image);
- return true;
- }
- template <class P>
- ImageId TextureCache<P>::InsertImage(const ImageInfo& info, GPUVAddr gpu_addr,
- RelaxedOptions options) {
- std::optional<VAddr> cpu_addr = gpu_memory->GpuToCpuAddress(gpu_addr);
- if (!cpu_addr) {
- const auto size = CalculateGuestSizeInBytes(info);
- cpu_addr = gpu_memory->GpuToCpuAddress(gpu_addr, size);
- if (!cpu_addr) {
- const VAddr fake_addr = ~(1ULL << 40ULL) + virtual_invalid_space;
- virtual_invalid_space += Common::AlignUp(size, 32);
- cpu_addr = std::optional<VAddr>(fake_addr);
- }
- }
- ASSERT_MSG(cpu_addr, "Tried to insert an image to an invalid gpu_addr=0x{:x}", gpu_addr);
- const ImageId image_id = JoinImages(info, gpu_addr, *cpu_addr);
- const Image& image = slot_images[image_id];
- // Using "image.gpu_addr" instead of "gpu_addr" is important because it might be different
- const auto [it, is_new] = image_allocs_table.try_emplace(image.gpu_addr);
- if (is_new) {
- it->second = slot_image_allocs.insert();
- }
- slot_image_allocs[it->second].images.push_back(image_id);
- return image_id;
- }
- template <class P>
- ImageId TextureCache<P>::JoinImages(const ImageInfo& info, GPUVAddr gpu_addr, VAddr cpu_addr) {
- ImageInfo new_info = info;
- const size_t size_bytes = CalculateGuestSizeInBytes(new_info);
- const bool broken_views = runtime.HasBrokenTextureViewFormats();
- const bool native_bgr = runtime.HasNativeBgr();
- std::vector<ImageId> overlap_ids;
- std::unordered_set<ImageId> overlaps_found;
- std::vector<ImageId> left_aliased_ids;
- std::vector<ImageId> right_aliased_ids;
- std::unordered_set<ImageId> ignore_textures;
- std::vector<ImageId> bad_overlap_ids;
- std::vector<ImageId> all_siblings;
- const bool this_is_linear = info.type == ImageType::Linear;
- const auto region_check = [&](ImageId overlap_id, ImageBase& overlap) {
- if (True(overlap.flags & ImageFlagBits::Remapped)) {
- ignore_textures.insert(overlap_id);
- return;
- }
- const bool overlap_is_linear = overlap.info.type == ImageType::Linear;
- if (this_is_linear != overlap_is_linear) {
- return;
- }
- if (this_is_linear && overlap_is_linear) {
- if (info.pitch == overlap.info.pitch && gpu_addr == overlap.gpu_addr) {
- // Alias linear images with the same pitch
- left_aliased_ids.push_back(overlap_id);
- }
- return;
- }
- overlaps_found.insert(overlap_id);
- static constexpr bool strict_size = true;
- const std::optional<OverlapResult> solution = ResolveOverlap(
- new_info, gpu_addr, cpu_addr, overlap, strict_size, broken_views, native_bgr);
- if (solution) {
- gpu_addr = solution->gpu_addr;
- cpu_addr = solution->cpu_addr;
- new_info.resources = solution->resources;
- overlap_ids.push_back(overlap_id);
- all_siblings.push_back(overlap_id);
- return;
- }
- static constexpr auto options = RelaxedOptions::Size | RelaxedOptions::Format;
- const ImageBase new_image_base(new_info, gpu_addr, cpu_addr);
- if (IsSubresource(new_info, overlap, gpu_addr, options, broken_views, native_bgr)) {
- left_aliased_ids.push_back(overlap_id);
- overlap.flags |= ImageFlagBits::Alias;
- all_siblings.push_back(overlap_id);
- } else if (IsSubresource(overlap.info, new_image_base, overlap.gpu_addr, options,
- broken_views, native_bgr)) {
- right_aliased_ids.push_back(overlap_id);
- overlap.flags |= ImageFlagBits::Alias;
- all_siblings.push_back(overlap_id);
- } else {
- bad_overlap_ids.push_back(overlap_id);
- overlap.flags |= ImageFlagBits::BadOverlap;
- }
- };
- ForEachImageInRegion(cpu_addr, size_bytes, region_check);
- const auto region_check_gpu = [&](ImageId overlap_id, ImageBase& overlap) {
- if (!overlaps_found.contains(overlap_id)) {
- if (True(overlap.flags & ImageFlagBits::Remapped)) {
- ignore_textures.insert(overlap_id);
- }
- if (overlap.gpu_addr == gpu_addr && overlap.guest_size_bytes == size_bytes) {
- ignore_textures.insert(overlap_id);
- }
- }
- };
- ForEachSparseImageInRegion(gpu_addr, size_bytes, region_check_gpu);
- bool can_rescale = info.rescaleable;
- bool any_rescaled = false;
- for (const ImageId sibling_id : all_siblings) {
- if (!can_rescale) {
- break;
- }
- Image& sibling = slot_images[sibling_id];
- can_rescale &= ImageCanRescale(sibling);
- any_rescaled |= True(sibling.flags & ImageFlagBits::Rescaled);
- }
- can_rescale &= any_rescaled;
- if (can_rescale) {
- for (const ImageId sibling_id : all_siblings) {
- Image& sibling = slot_images[sibling_id];
- ScaleUp(sibling);
- }
- } else {
- for (const ImageId sibling_id : all_siblings) {
- Image& sibling = slot_images[sibling_id];
- ScaleDown(sibling);
- }
- }
- const ImageId new_image_id = slot_images.insert(runtime, new_info, gpu_addr, cpu_addr);
- Image& new_image = slot_images[new_image_id];
- if (!gpu_memory->IsContinousRange(new_image.gpu_addr, new_image.guest_size_bytes)) {
- new_image.flags |= ImageFlagBits::Sparse;
- }
- for (const ImageId overlap_id : ignore_textures) {
- Image& overlap = slot_images[overlap_id];
- if (True(overlap.flags & ImageFlagBits::GpuModified)) {
- UNIMPLEMENTED();
- }
- if (True(overlap.flags & ImageFlagBits::Tracked)) {
- UntrackImage(overlap, overlap_id);
- }
- UnregisterImage(overlap_id);
- DeleteImage(overlap_id);
- }
- // TODO: Only upload what we need
- RefreshContents(new_image, new_image_id);
- if (can_rescale) {
- ScaleUp(new_image);
- } else {
- ScaleDown(new_image);
- }
- for (const ImageId overlap_id : overlap_ids) {
- Image& overlap = slot_images[overlap_id];
- if (True(overlap.flags & ImageFlagBits::GpuModified)) {
- new_image.flags |= ImageFlagBits::GpuModified;
- }
- if (overlap.info.num_samples != new_image.info.num_samples) {
- LOG_WARNING(HW_GPU, "Copying between images with different samples is not implemented");
- } else {
- const auto& resolution = Settings::values.resolution_info;
- const SubresourceBase base = new_image.TryFindBase(overlap.gpu_addr).value();
- const u32 up_scale = can_rescale ? resolution.up_scale : 1;
- const u32 down_shift = can_rescale ? resolution.down_shift : 0;
- auto copies = MakeShrinkImageCopies(new_info, overlap.info, base, up_scale, down_shift);
- runtime.CopyImage(new_image, overlap, std::move(copies));
- }
- if (True(overlap.flags & ImageFlagBits::Tracked)) {
- UntrackImage(overlap, overlap_id);
- }
- UnregisterImage(overlap_id);
- DeleteImage(overlap_id);
- }
- ImageBase& new_image_base = new_image;
- for (const ImageId aliased_id : right_aliased_ids) {
- ImageBase& aliased = slot_images[aliased_id];
- AddImageAlias(new_image_base, aliased, new_image_id, aliased_id);
- new_image.flags |= ImageFlagBits::Alias;
- }
- for (const ImageId aliased_id : left_aliased_ids) {
- ImageBase& aliased = slot_images[aliased_id];
- AddImageAlias(aliased, new_image_base, aliased_id, new_image_id);
- new_image.flags |= ImageFlagBits::Alias;
- }
- for (const ImageId aliased_id : bad_overlap_ids) {
- ImageBase& aliased = slot_images[aliased_id];
- aliased.overlapping_images.push_back(new_image_id);
- new_image.overlapping_images.push_back(aliased_id);
- new_image.flags |= ImageFlagBits::BadOverlap;
- }
- RegisterImage(new_image_id);
- return new_image_id;
- }
- template <class P>
- typename TextureCache<P>::BlitImages TextureCache<P>::GetBlitImages(
- const Tegra::Engines::Fermi2D::Surface& dst, const Tegra::Engines::Fermi2D::Surface& src,
- const Tegra::Engines::Fermi2D::Config& copy) {
- static constexpr auto FIND_OPTIONS = RelaxedOptions::Samples;
- const GPUVAddr dst_addr = dst.Address();
- const GPUVAddr src_addr = src.Address();
- ImageInfo dst_info(dst);
- ImageInfo src_info(src);
- const bool can_be_depth_blit =
- dst_info.format == src_info.format && copy.filter == Tegra::Engines::Fermi2D::Filter::Point;
- ImageId dst_id;
- ImageId src_id;
- RelaxedOptions try_options = FIND_OPTIONS;
- if (can_be_depth_blit) {
- try_options |= RelaxedOptions::Format;
- }
- do {
- has_deleted_images = false;
- src_id = FindImage(src_info, src_addr, try_options);
- dst_id = FindImage(dst_info, dst_addr, try_options);
- const ImageBase* const src_image = src_id ? &slot_images[src_id] : nullptr;
- if (src_image && src_image->info.num_samples > 1) {
- RelaxedOptions find_options{FIND_OPTIONS | RelaxedOptions::ForceBrokenViews};
- src_id = FindOrInsertImage(src_info, src_addr, find_options);
- dst_id = FindOrInsertImage(dst_info, dst_addr, find_options);
- if (has_deleted_images) {
- continue;
- }
- break;
- }
- if (can_be_depth_blit) {
- const ImageBase* const dst_image = dst_id ? &slot_images[dst_id] : nullptr;
- DeduceBlitImages(dst_info, src_info, dst_image, src_image);
- if (GetFormatType(dst_info.format) != GetFormatType(src_info.format)) {
- continue;
- }
- }
- if (!src_id) {
- src_id = InsertImage(src_info, src_addr, RelaxedOptions{});
- }
- if (!dst_id) {
- dst_id = InsertImage(dst_info, dst_addr, RelaxedOptions{});
- }
- } while (has_deleted_images);
- const ImageBase& src_image = slot_images[src_id];
- const ImageBase& dst_image = slot_images[dst_id];
- const bool native_bgr = runtime.HasNativeBgr();
- if (GetFormatType(dst_info.format) != GetFormatType(dst_image.info.format) ||
- GetFormatType(src_info.format) != GetFormatType(src_image.info.format) ||
- !VideoCore::Surface::IsViewCompatible(dst_info.format, dst_image.info.format, false,
- native_bgr) ||
- !VideoCore::Surface::IsViewCompatible(src_info.format, src_image.info.format, false,
- native_bgr)) {
- // Make sure the images match the expected format.
- do {
- has_deleted_images = false;
- src_id = FindOrInsertImage(src_info, src_addr, RelaxedOptions{});
- dst_id = FindOrInsertImage(dst_info, dst_addr, RelaxedOptions{});
- } while (has_deleted_images);
- }
- return BlitImages{
- .dst_id = dst_id,
- .src_id = src_id,
- .dst_format = dst_info.format,
- .src_format = src_info.format,
- };
- }
- template <class P>
- SamplerId TextureCache<P>::FindSampler(const TSCEntry& config) {
- if (std::ranges::all_of(config.raw, [](u64 value) { return value == 0; })) {
- return NULL_SAMPLER_ID;
- }
- const auto [pair, is_new] = channel_state->samplers.try_emplace(config);
- if (is_new) {
- pair->second = slot_samplers.insert(runtime, config);
- }
- return pair->second;
- }
- template <class P>
- ImageViewId TextureCache<P>::FindColorBuffer(size_t index, bool is_clear) {
- const auto& regs = maxwell3d->regs;
- if (index >= regs.rt_control.count) {
- return ImageViewId{};
- }
- const auto& rt = regs.rt[index];
- const GPUVAddr gpu_addr = rt.Address();
- if (gpu_addr == 0) {
- return ImageViewId{};
- }
- if (rt.format == Tegra::RenderTargetFormat::NONE) {
- return ImageViewId{};
- }
- const ImageInfo info(regs, index);
- return FindRenderTargetView(info, gpu_addr, is_clear);
- }
- template <class P>
- ImageViewId TextureCache<P>::FindDepthBuffer(bool is_clear) {
- const auto& regs = maxwell3d->regs;
- if (!regs.zeta_enable) {
- return ImageViewId{};
- }
- const GPUVAddr gpu_addr = regs.zeta.Address();
- if (gpu_addr == 0) {
- return ImageViewId{};
- }
- const ImageInfo info(regs);
- return FindRenderTargetView(info, gpu_addr, is_clear);
- }
- template <class P>
- ImageViewId TextureCache<P>::FindRenderTargetView(const ImageInfo& info, GPUVAddr gpu_addr,
- bool is_clear) {
- const auto options = is_clear ? RelaxedOptions::Samples : RelaxedOptions{};
- ImageId image_id{};
- bool delete_state = has_deleted_images;
- do {
- has_deleted_images = false;
- image_id = FindOrInsertImage(info, gpu_addr, options);
- delete_state |= has_deleted_images;
- } while (has_deleted_images);
- has_deleted_images = delete_state;
- if (!image_id) {
- return NULL_IMAGE_VIEW_ID;
- }
- Image& image = slot_images[image_id];
- const ImageViewType view_type = RenderTargetImageViewType(info);
- SubresourceBase base;
- if (image.info.type == ImageType::Linear) {
- base = SubresourceBase{.level = 0, .layer = 0};
- } else {
- base = image.TryFindBase(gpu_addr).value();
- }
- const s32 layers = image.info.type == ImageType::e3D ? info.size.depth : info.resources.layers;
- const SubresourceRange range{
- .base = base,
- .extent = {.levels = 1, .layers = layers},
- };
- return FindOrEmplaceImageView(image_id, ImageViewInfo(view_type, info.format, range));
- }
- template <class P>
- template <typename Func>
- void TextureCache<P>::ForEachImageInRegion(VAddr cpu_addr, size_t size, Func&& func) {
- using FuncReturn = typename std::invoke_result<Func, ImageId, Image&>::type;
- static constexpr bool BOOL_BREAK = std::is_same_v<FuncReturn, bool>;
- boost::container::small_vector<ImageId, 32> images;
- boost::container::small_vector<ImageMapId, 32> maps;
- ForEachCPUPage(cpu_addr, size, [this, &images, &maps, cpu_addr, size, func](u64 page) {
- const auto it = page_table.find(page);
- if (it == page_table.end()) {
- if constexpr (BOOL_BREAK) {
- return false;
- } else {
- return;
- }
- }
- for (const ImageMapId map_id : it->second) {
- ImageMapView& map = slot_map_views[map_id];
- if (map.picked) {
- continue;
- }
- if (!map.Overlaps(cpu_addr, size)) {
- continue;
- }
- map.picked = true;
- maps.push_back(map_id);
- Image& image = slot_images[map.image_id];
- if (True(image.flags & ImageFlagBits::Picked)) {
- continue;
- }
- image.flags |= ImageFlagBits::Picked;
- images.push_back(map.image_id);
- if constexpr (BOOL_BREAK) {
- if (func(map.image_id, image)) {
- return true;
- }
- } else {
- func(map.image_id, image);
- }
- }
- if constexpr (BOOL_BREAK) {
- return false;
- }
- });
- for (const ImageId image_id : images) {
- slot_images[image_id].flags &= ~ImageFlagBits::Picked;
- }
- for (const ImageMapId map_id : maps) {
- slot_map_views[map_id].picked = false;
- }
- }
- template <class P>
- template <typename Func>
- void TextureCache<P>::ForEachImageInRegionGPU(size_t as_id, GPUVAddr gpu_addr, size_t size,
- Func&& func) {
- using FuncReturn = typename std::invoke_result<Func, ImageId, Image&>::type;
- static constexpr bool BOOL_BREAK = std::is_same_v<FuncReturn, bool>;
- boost::container::small_vector<ImageId, 8> images;
- auto storage_id = getStorageID(as_id);
- if (!storage_id) {
- return;
- }
- auto& gpu_page_table = gpu_page_table_storage[*storage_id];
- ForEachGPUPage(gpu_addr, size, [this, gpu_page_table, &images, gpu_addr, size, func](u64 page) {
- const auto it = gpu_page_table.find(page);
- if (it == gpu_page_table.end()) {
- if constexpr (BOOL_BREAK) {
- return false;
- } else {
- return;
- }
- }
- for (const ImageId image_id : it->second) {
- Image& image = slot_images[image_id];
- if (True(image.flags & ImageFlagBits::Picked)) {
- continue;
- }
- if (!image.OverlapsGPU(gpu_addr, size)) {
- continue;
- }
- image.flags |= ImageFlagBits::Picked;
- images.push_back(image_id);
- if constexpr (BOOL_BREAK) {
- if (func(image_id, image)) {
- return true;
- }
- } else {
- func(image_id, image);
- }
- }
- if constexpr (BOOL_BREAK) {
- return false;
- }
- });
- for (const ImageId image_id : images) {
- slot_images[image_id].flags &= ~ImageFlagBits::Picked;
- }
- }
- template <class P>
- template <typename Func>
- void TextureCache<P>::ForEachSparseImageInRegion(GPUVAddr gpu_addr, size_t size, Func&& func) {
- using FuncReturn = typename std::invoke_result<Func, ImageId, Image&>::type;
- static constexpr bool BOOL_BREAK = std::is_same_v<FuncReturn, bool>;
- boost::container::small_vector<ImageId, 8> images;
- ForEachGPUPage(gpu_addr, size, [this, &images, gpu_addr, size, func](u64 page) {
- const auto it = sparse_page_table.find(page);
- if (it == sparse_page_table.end()) {
- if constexpr (BOOL_BREAK) {
- return false;
- } else {
- return;
- }
- }
- for (const ImageId image_id : it->second) {
- Image& image = slot_images[image_id];
- if (True(image.flags & ImageFlagBits::Picked)) {
- continue;
- }
- if (!image.OverlapsGPU(gpu_addr, size)) {
- continue;
- }
- image.flags |= ImageFlagBits::Picked;
- images.push_back(image_id);
- if constexpr (BOOL_BREAK) {
- if (func(image_id, image)) {
- return true;
- }
- } else {
- func(image_id, image);
- }
- }
- if constexpr (BOOL_BREAK) {
- return false;
- }
- });
- for (const ImageId image_id : images) {
- slot_images[image_id].flags &= ~ImageFlagBits::Picked;
- }
- }
- template <class P>
- template <typename Func>
- void TextureCache<P>::ForEachSparseSegment(ImageBase& image, Func&& func) {
- using FuncReturn = typename std::invoke_result<Func, GPUVAddr, VAddr, size_t>::type;
- static constexpr bool RETURNS_BOOL = std::is_same_v<FuncReturn, bool>;
- const auto segments = gpu_memory->GetSubmappedRange(image.gpu_addr, image.guest_size_bytes);
- for (const auto& [gpu_addr, size] : segments) {
- std::optional<VAddr> cpu_addr = gpu_memory->GpuToCpuAddress(gpu_addr);
- ASSERT(cpu_addr);
- if constexpr (RETURNS_BOOL) {
- if (func(gpu_addr, *cpu_addr, size)) {
- break;
- }
- } else {
- func(gpu_addr, *cpu_addr, size);
- }
- }
- }
- template <class P>
- ImageViewId TextureCache<P>::FindOrEmplaceImageView(ImageId image_id, const ImageViewInfo& info) {
- Image& image = slot_images[image_id];
- if (const ImageViewId image_view_id = image.FindView(info); image_view_id) {
- return image_view_id;
- }
- const ImageViewId image_view_id =
- slot_image_views.insert(runtime, info, image_id, image, slot_images);
- image.InsertView(info, image_view_id);
- return image_view_id;
- }
- template <class P>
- void TextureCache<P>::RegisterImage(ImageId image_id) {
- ImageBase& image = slot_images[image_id];
- ASSERT_MSG(False(image.flags & ImageFlagBits::Registered),
- "Trying to register an already registered image");
- image.flags |= ImageFlagBits::Registered;
- u64 tentative_size = std::max(image.guest_size_bytes, image.unswizzled_size_bytes);
- if ((IsPixelFormatASTC(image.info.format) &&
- True(image.flags & ImageFlagBits::AcceleratedUpload)) ||
- True(image.flags & ImageFlagBits::Converted)) {
- tentative_size = EstimatedDecompressedSize(tentative_size, image.info.format);
- }
- total_used_memory += Common::AlignUp(tentative_size, 1024);
- if (total_used_memory > critical_memory && critical_gc < GC_EMERGENCY_COUNTS) {
- RunGarbageCollector();
- critical_gc++;
- }
- image.lru_index = lru_cache.Insert(image_id, frame_tick);
- ForEachGPUPage(image.gpu_addr, image.guest_size_bytes, [this, image_id](u64 page) {
- (*channel_state->gpu_page_table)[page].push_back(image_id);
- });
- if (False(image.flags & ImageFlagBits::Sparse)) {
- auto map_id =
- slot_map_views.insert(image.gpu_addr, image.cpu_addr, image.guest_size_bytes, image_id);
- ForEachCPUPage(image.cpu_addr, image.guest_size_bytes,
- [this, map_id](u64 page) { page_table[page].push_back(map_id); });
- image.map_view_id = map_id;
- return;
- }
- std::vector<ImageViewId> sparse_maps{};
- ForEachSparseSegment(
- image, [this, image_id, &sparse_maps](GPUVAddr gpu_addr, VAddr cpu_addr, size_t size) {
- auto map_id = slot_map_views.insert(gpu_addr, cpu_addr, size, image_id);
- ForEachCPUPage(cpu_addr, size,
- [this, map_id](u64 page) { page_table[page].push_back(map_id); });
- sparse_maps.push_back(map_id);
- });
- sparse_views.emplace(image_id, std::move(sparse_maps));
- ForEachGPUPage(image.gpu_addr, image.guest_size_bytes,
- [this, image_id](u64 page) { sparse_page_table[page].push_back(image_id); });
- }
- template <class P>
- void TextureCache<P>::UnregisterImage(ImageId image_id) {
- Image& image = slot_images[image_id];
- ASSERT_MSG(True(image.flags & ImageFlagBits::Registered),
- "Trying to unregister an already registered image");
- image.flags &= ~ImageFlagBits::Registered;
- image.flags &= ~ImageFlagBits::BadOverlap;
- lru_cache.Free(image.lru_index);
- const auto& clear_page_table =
- [this, image_id](u64 page,
- std::unordered_map<u64, std::vector<ImageId>, Common::IdentityHash<u64>>&
- selected_page_table) {
- const auto page_it = selected_page_table.find(page);
- if (page_it == selected_page_table.end()) {
- ASSERT_MSG(false, "Unregistering unregistered page=0x{:x}", page << YUZU_PAGEBITS);
- return;
- }
- std::vector<ImageId>& image_ids = page_it->second;
- const auto vector_it = std::ranges::find(image_ids, image_id);
- if (vector_it == image_ids.end()) {
- ASSERT_MSG(false, "Unregistering unregistered image in page=0x{:x}",
- page << YUZU_PAGEBITS);
- return;
- }
- image_ids.erase(vector_it);
- };
- ForEachGPUPage(image.gpu_addr, image.guest_size_bytes, [this, &clear_page_table](u64 page) {
- clear_page_table(page, (*channel_state->gpu_page_table));
- });
- if (False(image.flags & ImageFlagBits::Sparse)) {
- const auto map_id = image.map_view_id;
- ForEachCPUPage(image.cpu_addr, image.guest_size_bytes, [this, map_id](u64 page) {
- const auto page_it = page_table.find(page);
- if (page_it == page_table.end()) {
- ASSERT_MSG(false, "Unregistering unregistered page=0x{:x}", page << YUZU_PAGEBITS);
- return;
- }
- std::vector<ImageMapId>& image_map_ids = page_it->second;
- const auto vector_it = std::ranges::find(image_map_ids, map_id);
- if (vector_it == image_map_ids.end()) {
- ASSERT_MSG(false, "Unregistering unregistered image in page=0x{:x}",
- page << YUZU_PAGEBITS);
- return;
- }
- image_map_ids.erase(vector_it);
- });
- slot_map_views.erase(map_id);
- return;
- }
- ForEachGPUPage(image.gpu_addr, image.guest_size_bytes, [this, &clear_page_table](u64 page) {
- clear_page_table(page, sparse_page_table);
- });
- auto it = sparse_views.find(image_id);
- ASSERT(it != sparse_views.end());
- auto& sparse_maps = it->second;
- for (auto& map_view_id : sparse_maps) {
- const auto& map_range = slot_map_views[map_view_id];
- const VAddr cpu_addr = map_range.cpu_addr;
- const std::size_t size = map_range.size;
- ForEachCPUPage(cpu_addr, size, [this, image_id](u64 page) {
- const auto page_it = page_table.find(page);
- if (page_it == page_table.end()) {
- ASSERT_MSG(false, "Unregistering unregistered page=0x{:x}", page << YUZU_PAGEBITS);
- return;
- }
- std::vector<ImageMapId>& image_map_ids = page_it->second;
- auto vector_it = image_map_ids.begin();
- while (vector_it != image_map_ids.end()) {
- ImageMapView& map = slot_map_views[*vector_it];
- if (map.image_id != image_id) {
- vector_it++;
- continue;
- }
- if (!map.picked) {
- map.picked = true;
- }
- vector_it = image_map_ids.erase(vector_it);
- }
- });
- slot_map_views.erase(map_view_id);
- }
- sparse_views.erase(it);
- }
- template <class P>
- void TextureCache<P>::TrackImage(ImageBase& image, ImageId image_id) {
- ASSERT(False(image.flags & ImageFlagBits::Tracked));
- image.flags |= ImageFlagBits::Tracked;
- if (False(image.flags & ImageFlagBits::Sparse)) {
- rasterizer.UpdatePagesCachedCount(image.cpu_addr, image.guest_size_bytes, 1);
- return;
- }
- if (True(image.flags & ImageFlagBits::Registered)) {
- auto it = sparse_views.find(image_id);
- ASSERT(it != sparse_views.end());
- auto& sparse_maps = it->second;
- for (auto& map_view_id : sparse_maps) {
- const auto& map = slot_map_views[map_view_id];
- const VAddr cpu_addr = map.cpu_addr;
- const std::size_t size = map.size;
- rasterizer.UpdatePagesCachedCount(cpu_addr, size, 1);
- }
- return;
- }
- ForEachSparseSegment(image,
- [this]([[maybe_unused]] GPUVAddr gpu_addr, VAddr cpu_addr, size_t size) {
- rasterizer.UpdatePagesCachedCount(cpu_addr, size, 1);
- });
- }
- template <class P>
- void TextureCache<P>::UntrackImage(ImageBase& image, ImageId image_id) {
- ASSERT(True(image.flags & ImageFlagBits::Tracked));
- image.flags &= ~ImageFlagBits::Tracked;
- if (False(image.flags & ImageFlagBits::Sparse)) {
- rasterizer.UpdatePagesCachedCount(image.cpu_addr, image.guest_size_bytes, -1);
- return;
- }
- ASSERT(True(image.flags & ImageFlagBits::Registered));
- auto it = sparse_views.find(image_id);
- ASSERT(it != sparse_views.end());
- auto& sparse_maps = it->second;
- for (auto& map_view_id : sparse_maps) {
- const auto& map = slot_map_views[map_view_id];
- const VAddr cpu_addr = map.cpu_addr;
- const std::size_t size = map.size;
- rasterizer.UpdatePagesCachedCount(cpu_addr, size, -1);
- }
- }
- template <class P>
- void TextureCache<P>::DeleteImage(ImageId image_id, bool immediate_delete) {
- ImageBase& image = slot_images[image_id];
- if (image.HasScaled()) {
- total_used_memory -= GetScaledImageSizeBytes(image);
- }
- u64 tentative_size = std::max(image.guest_size_bytes, image.unswizzled_size_bytes);
- if ((IsPixelFormatASTC(image.info.format) &&
- True(image.flags & ImageFlagBits::AcceleratedUpload)) ||
- True(image.flags & ImageFlagBits::Converted)) {
- tentative_size = EstimatedDecompressedSize(tentative_size, image.info.format);
- }
- total_used_memory -= Common::AlignUp(tentative_size, 1024);
- const GPUVAddr gpu_addr = image.gpu_addr;
- const auto alloc_it = image_allocs_table.find(gpu_addr);
- if (alloc_it == image_allocs_table.end()) {
- ASSERT_MSG(false, "Trying to delete an image alloc that does not exist in address 0x{:x}",
- gpu_addr);
- return;
- }
- const ImageAllocId alloc_id = alloc_it->second;
- std::vector<ImageId>& alloc_images = slot_image_allocs[alloc_id].images;
- const auto alloc_image_it = std::ranges::find(alloc_images, image_id);
- if (alloc_image_it == alloc_images.end()) {
- ASSERT_MSG(false, "Trying to delete an image that does not exist");
- return;
- }
- ASSERT_MSG(False(image.flags & ImageFlagBits::Tracked), "Image was not untracked");
- ASSERT_MSG(False(image.flags & ImageFlagBits::Registered), "Image was not unregistered");
- // Mark render targets as dirty
- auto& dirty = maxwell3d->dirty.flags;
- dirty[Dirty::RenderTargets] = true;
- dirty[Dirty::ZetaBuffer] = true;
- for (size_t rt = 0; rt < NUM_RT; ++rt) {
- dirty[Dirty::ColorBuffer0 + rt] = true;
- }
- const std::span<const ImageViewId> image_view_ids = image.image_view_ids;
- for (const ImageViewId image_view_id : image_view_ids) {
- std::ranges::replace(render_targets.color_buffer_ids, image_view_id, ImageViewId{});
- if (render_targets.depth_buffer_id == image_view_id) {
- render_targets.depth_buffer_id = ImageViewId{};
- }
- }
- RemoveImageViewReferences(image_view_ids);
- RemoveFramebuffers(image_view_ids);
- for (const AliasedImage& alias : image.aliased_images) {
- ImageBase& other_image = slot_images[alias.id];
- [[maybe_unused]] const size_t num_removed_aliases =
- std::erase_if(other_image.aliased_images, [image_id](const AliasedImage& other_alias) {
- return other_alias.id == image_id;
- });
- other_image.CheckAliasState();
- ASSERT_MSG(num_removed_aliases == 1, "Invalid number of removed aliases: {}",
- num_removed_aliases);
- }
- for (const ImageId overlap_id : image.overlapping_images) {
- ImageBase& other_image = slot_images[overlap_id];
- [[maybe_unused]] const size_t num_removed_overlaps = std::erase_if(
- other_image.overlapping_images,
- [image_id](const ImageId other_overlap_id) { return other_overlap_id == image_id; });
- other_image.CheckBadOverlapState();
- ASSERT_MSG(num_removed_overlaps == 1, "Invalid number of removed overlapps: {}",
- num_removed_overlaps);
- }
- for (const ImageViewId image_view_id : image_view_ids) {
- if (!immediate_delete) {
- sentenced_image_view.Push(std::move(slot_image_views[image_view_id]));
- }
- slot_image_views.erase(image_view_id);
- }
- if (!immediate_delete) {
- sentenced_images.Push(std::move(slot_images[image_id]));
- }
- slot_images.erase(image_id);
- alloc_images.erase(alloc_image_it);
- if (alloc_images.empty()) {
- image_allocs_table.erase(alloc_it);
- }
- for (size_t c : active_channel_ids) {
- auto& channel_info = channel_storage[c];
- if constexpr (ENABLE_VALIDATION) {
- std::ranges::fill(channel_info.graphics_image_view_ids, CORRUPT_ID);
- std::ranges::fill(channel_info.compute_image_view_ids, CORRUPT_ID);
- }
- channel_info.graphics_image_table.Invalidate();
- channel_info.compute_image_table.Invalidate();
- }
- has_deleted_images = true;
- }
- template <class P>
- void TextureCache<P>::RemoveImageViewReferences(std::span<const ImageViewId> removed_views) {
- for (size_t c : active_channel_ids) {
- auto& channel_info = channel_storage[c];
- auto it = channel_info.image_views.begin();
- while (it != channel_info.image_views.end()) {
- const auto found = std::ranges::find(removed_views, it->second);
- if (found != removed_views.end()) {
- it = channel_info.image_views.erase(it);
- } else {
- ++it;
- }
- }
- }
- }
- template <class P>
- void TextureCache<P>::RemoveFramebuffers(std::span<const ImageViewId> removed_views) {
- auto it = framebuffers.begin();
- while (it != framebuffers.end()) {
- if (it->first.Contains(removed_views)) {
- auto framebuffer_id = it->second;
- ASSERT(framebuffer_id);
- sentenced_framebuffers.Push(std::move(slot_framebuffers[framebuffer_id]));
- it = framebuffers.erase(it);
- } else {
- ++it;
- }
- }
- }
- template <class P>
- void TextureCache<P>::MarkModification(ImageBase& image) noexcept {
- image.flags |= ImageFlagBits::GpuModified;
- image.modification_tick = ++modification_tick;
- }
- template <class P>
- void TextureCache<P>::SynchronizeAliases(ImageId image_id) {
- boost::container::small_vector<const AliasedImage*, 1> aliased_images;
- Image& image = slot_images[image_id];
- bool any_rescaled = True(image.flags & ImageFlagBits::Rescaled);
- bool any_modified = True(image.flags & ImageFlagBits::GpuModified);
- u64 most_recent_tick = image.modification_tick;
- for (const AliasedImage& aliased : image.aliased_images) {
- ImageBase& aliased_image = slot_images[aliased.id];
- if (image.modification_tick < aliased_image.modification_tick) {
- most_recent_tick = std::max(most_recent_tick, aliased_image.modification_tick);
- aliased_images.push_back(&aliased);
- any_rescaled |= True(aliased_image.flags & ImageFlagBits::Rescaled);
- any_modified |= True(aliased_image.flags & ImageFlagBits::GpuModified);
- }
- }
- if (aliased_images.empty()) {
- return;
- }
- const bool can_rescale = ImageCanRescale(image);
- if (any_rescaled) {
- if (can_rescale) {
- ScaleUp(image);
- } else {
- ScaleDown(image);
- }
- }
- image.modification_tick = most_recent_tick;
- if (any_modified) {
- image.flags |= ImageFlagBits::GpuModified;
- }
- std::ranges::sort(aliased_images, [this](const AliasedImage* lhs, const AliasedImage* rhs) {
- const ImageBase& lhs_image = slot_images[lhs->id];
- const ImageBase& rhs_image = slot_images[rhs->id];
- return lhs_image.modification_tick < rhs_image.modification_tick;
- });
- const auto& resolution = Settings::values.resolution_info;
- for (const AliasedImage* const aliased : aliased_images) {
- if (!resolution.active || !any_rescaled) {
- CopyImage(image_id, aliased->id, aliased->copies);
- continue;
- }
- Image& aliased_image = slot_images[aliased->id];
- if (!can_rescale) {
- ScaleDown(aliased_image);
- CopyImage(image_id, aliased->id, aliased->copies);
- continue;
- }
- ScaleUp(aliased_image);
- CopyImage(image_id, aliased->id, aliased->copies);
- }
- }
- template <class P>
- void TextureCache<P>::PrepareImage(ImageId image_id, bool is_modification, bool invalidate) {
- Image& image = slot_images[image_id];
- if (invalidate) {
- image.flags &= ~(ImageFlagBits::CpuModified | ImageFlagBits::GpuModified);
- if (False(image.flags & ImageFlagBits::Tracked)) {
- TrackImage(image, image_id);
- }
- } else {
- RefreshContents(image, image_id);
- SynchronizeAliases(image_id);
- }
- if (is_modification) {
- MarkModification(image);
- }
- lru_cache.Touch(image.lru_index, frame_tick);
- }
- template <class P>
- void TextureCache<P>::PrepareImageView(ImageViewId image_view_id, bool is_modification,
- bool invalidate) {
- if (!image_view_id) {
- return;
- }
- const ImageViewBase& image_view = slot_image_views[image_view_id];
- if (image_view.IsBuffer()) {
- return;
- }
- PrepareImage(image_view.image_id, is_modification, invalidate);
- }
- template <class P>
- void TextureCache<P>::CopyImage(ImageId dst_id, ImageId src_id, std::vector<ImageCopy> copies) {
- Image& dst = slot_images[dst_id];
- Image& src = slot_images[src_id];
- const bool is_rescaled = True(src.flags & ImageFlagBits::Rescaled);
- if (is_rescaled) {
- ASSERT(True(dst.flags & ImageFlagBits::Rescaled));
- const bool both_2d{src.info.type == ImageType::e2D && dst.info.type == ImageType::e2D};
- const auto& resolution = Settings::values.resolution_info;
- for (auto& copy : copies) {
- copy.src_offset.x = resolution.ScaleUp(copy.src_offset.x);
- copy.dst_offset.x = resolution.ScaleUp(copy.dst_offset.x);
- copy.extent.width = resolution.ScaleUp(copy.extent.width);
- if (both_2d) {
- copy.src_offset.y = resolution.ScaleUp(copy.src_offset.y);
- copy.dst_offset.y = resolution.ScaleUp(copy.dst_offset.y);
- copy.extent.height = resolution.ScaleUp(copy.extent.height);
- }
- }
- }
- const auto dst_format_type = GetFormatType(dst.info.format);
- const auto src_format_type = GetFormatType(src.info.format);
- if (src_format_type == dst_format_type) {
- if constexpr (HAS_EMULATED_COPIES) {
- if (!runtime.CanImageBeCopied(dst, src)) {
- return runtime.EmulateCopyImage(dst, src, copies);
- }
- }
- return runtime.CopyImage(dst, src, copies);
- }
- UNIMPLEMENTED_IF(dst.info.type != ImageType::e2D);
- UNIMPLEMENTED_IF(src.info.type != ImageType::e2D);
- if (runtime.ShouldReinterpret(dst, src)) {
- return runtime.ReinterpretImage(dst, src, copies);
- }
- for (const ImageCopy& copy : copies) {
- UNIMPLEMENTED_IF(copy.dst_subresource.num_layers != 1);
- UNIMPLEMENTED_IF(copy.src_subresource.num_layers != 1);
- UNIMPLEMENTED_IF(copy.src_offset != Offset3D{});
- UNIMPLEMENTED_IF(copy.dst_offset != Offset3D{});
- const SubresourceBase dst_base{
- .level = copy.dst_subresource.base_level,
- .layer = copy.dst_subresource.base_layer,
- };
- const SubresourceBase src_base{
- .level = copy.src_subresource.base_level,
- .layer = copy.src_subresource.base_layer,
- };
- const SubresourceExtent dst_extent{.levels = 1, .layers = 1};
- const SubresourceExtent src_extent{.levels = 1, .layers = 1};
- const SubresourceRange dst_range{.base = dst_base, .extent = dst_extent};
- const SubresourceRange src_range{.base = src_base, .extent = src_extent};
- PixelFormat dst_format = dst.info.format;
- if (GetFormatType(src.info.format) == SurfaceType::DepthStencil &&
- GetFormatType(dst_format) == SurfaceType::ColorTexture &&
- BytesPerBlock(dst_format) == 4) {
- dst_format = PixelFormat::A8B8G8R8_UNORM;
- }
- const ImageViewInfo dst_view_info(ImageViewType::e2D, dst_format, dst_range);
- const ImageViewInfo src_view_info(ImageViewType::e2D, src.info.format, src_range);
- const auto [dst_framebuffer_id, dst_view_id] = RenderTargetFromImage(dst_id, dst_view_info);
- Framebuffer* const dst_framebuffer = &slot_framebuffers[dst_framebuffer_id];
- const ImageViewId src_view_id = FindOrEmplaceImageView(src_id, src_view_info);
- ImageView& dst_view = slot_image_views[dst_view_id];
- ImageView& src_view = slot_image_views[src_view_id];
- [[maybe_unused]] const Extent3D expected_size{
- .width = std::min(dst_view.size.width, src_view.size.width),
- .height = std::min(dst_view.size.height, src_view.size.height),
- .depth = std::min(dst_view.size.depth, src_view.size.depth),
- };
- const Extent3D scaled_extent = [is_rescaled, expected_size]() {
- if (!is_rescaled) {
- return expected_size;
- }
- const auto& resolution = Settings::values.resolution_info;
- return Extent3D{
- .width = resolution.ScaleUp(expected_size.width),
- .height = resolution.ScaleUp(expected_size.height),
- .depth = expected_size.depth,
- };
- }();
- UNIMPLEMENTED_IF(copy.extent != scaled_extent);
- runtime.ConvertImage(dst_framebuffer, dst_view, src_view);
- }
- }
- template <class P>
- void TextureCache<P>::BindRenderTarget(ImageViewId* old_id, ImageViewId new_id) {
- if (*old_id == new_id) {
- return;
- }
- if (new_id) {
- const ImageViewBase& old_view = slot_image_views[new_id];
- if (True(old_view.flags & ImageViewFlagBits::PreemtiveDownload)) {
- uncommitted_downloads.push_back(old_view.image_id);
- }
- }
- *old_id = new_id;
- }
- template <class P>
- std::pair<FramebufferId, ImageViewId> TextureCache<P>::RenderTargetFromImage(
- ImageId image_id, const ImageViewInfo& view_info) {
- const ImageViewId view_id = FindOrEmplaceImageView(image_id, view_info);
- const ImageBase& image = slot_images[image_id];
- const bool is_rescaled = True(image.flags & ImageFlagBits::Rescaled);
- const bool is_color = GetFormatType(image.info.format) == SurfaceType::ColorTexture;
- const ImageViewId color_view_id = is_color ? view_id : ImageViewId{};
- const ImageViewId depth_view_id = is_color ? ImageViewId{} : view_id;
- Extent3D extent = MipSize(image.info.size, view_info.range.base.level);
- if (is_rescaled) {
- const auto& resolution = Settings::values.resolution_info;
- extent.width = resolution.ScaleUp(extent.width);
- if (image.info.type == ImageType::e2D) {
- extent.height = resolution.ScaleUp(extent.height);
- }
- }
- const u32 num_samples = image.info.num_samples;
- const auto [samples_x, samples_y] = SamplesLog2(num_samples);
- const FramebufferId framebuffer_id = GetFramebufferId(RenderTargets{
- .color_buffer_ids = {color_view_id},
- .depth_buffer_id = depth_view_id,
- .size = {extent.width >> samples_x, extent.height >> samples_y},
- .is_rescaled = is_rescaled,
- });
- return {framebuffer_id, view_id};
- }
- template <class P>
- bool TextureCache<P>::IsFullClear(ImageViewId id) {
- if (!id) {
- return true;
- }
- const ImageViewBase& image_view = slot_image_views[id];
- const ImageBase& image = slot_images[image_view.image_id];
- const Extent3D size = image_view.size;
- const auto& regs = maxwell3d->regs;
- const auto& scissor = regs.scissor_test[0];
- if (image.info.resources.levels > 1 || image.info.resources.layers > 1) {
- // Images with multiple resources can't be cleared in a single call
- return false;
- }
- if (regs.clear_control.use_scissor == 0) {
- // If scissor testing is disabled, the clear is always full
- return true;
- }
- // Make sure the clear covers all texels in the subresource
- return scissor.min_x == 0 && scissor.min_y == 0 && scissor.max_x >= size.width &&
- scissor.max_y >= size.height;
- }
- template <class P>
- void TextureCache<P>::CreateChannel(struct Tegra::Control::ChannelState& channel) {
- VideoCommon::ChannelSetupCaches<TextureCacheChannelInfo>::CreateChannel(channel);
- const auto it = channel_map.find(channel.bind_id);
- auto* this_state = &channel_storage[it->second];
- const auto& this_as_ref = address_spaces[channel.memory_manager->GetID()];
- this_state->gpu_page_table = &gpu_page_table_storage[this_as_ref.storage_id];
- }
- /// Bind a channel for execution.
- template <class P>
- void TextureCache<P>::OnGPUASRegister([[maybe_unused]] size_t map_id) {
- gpu_page_table_storage.emplace_back();
- }
- } // namespace VideoCommon
|