11b09c13cSSteffen Eiden // SPDX-License-Identifier: GPL-2.0 21b09c13cSSteffen Eiden /* 31b09c13cSSteffen Eiden * Guest memory management for KVM/s390 41b09c13cSSteffen Eiden * 51b09c13cSSteffen Eiden * Copyright IBM Corp. 2008, 2020, 2024 61b09c13cSSteffen Eiden * 71b09c13cSSteffen Eiden * Author(s): Claudio Imbrenda <imbrenda@linux.ibm.com> 81b09c13cSSteffen Eiden * Martin Schwidefsky <schwidefsky@de.ibm.com> 91b09c13cSSteffen Eiden * David Hildenbrand <david@redhat.com> 101b09c13cSSteffen Eiden * Janosch Frank <frankja@linux.ibm.com> 111b09c13cSSteffen Eiden */ 121b09c13cSSteffen Eiden 131b09c13cSSteffen Eiden #include <linux/compiler.h> 141b09c13cSSteffen Eiden #include <linux/kvm.h> 151b09c13cSSteffen Eiden #include <linux/kvm_host.h> 161b09c13cSSteffen Eiden #include <linux/pgtable.h> 171b09c13cSSteffen Eiden #include <linux/pagemap.h> 181b09c13cSSteffen Eiden #include <asm/lowcore.h> 191b09c13cSSteffen Eiden #include <asm/uv.h> 201b09c13cSSteffen Eiden #include <asm/gmap_helpers.h> 211b09c13cSSteffen Eiden 221b09c13cSSteffen Eiden #include "dat.h" 231b09c13cSSteffen Eiden #include "gmap.h" 241b09c13cSSteffen Eiden #include "s390.h" 251b09c13cSSteffen Eiden #include "faultin.h" 261b09c13cSSteffen Eiden 271b09c13cSSteffen Eiden static int gmap_limit_to_type(gfn_t limit) 281b09c13cSSteffen Eiden { 291b09c13cSSteffen Eiden if (!limit) 301b09c13cSSteffen Eiden return TABLE_TYPE_REGION1; 311b09c13cSSteffen Eiden if (limit <= _REGION3_SIZE >> PAGE_SHIFT) 321b09c13cSSteffen Eiden return TABLE_TYPE_SEGMENT; 331b09c13cSSteffen Eiden if (limit <= _REGION2_SIZE >> PAGE_SHIFT) 341b09c13cSSteffen Eiden return TABLE_TYPE_REGION3; 351b09c13cSSteffen Eiden if (limit <= _REGION1_SIZE >> PAGE_SHIFT) 361b09c13cSSteffen Eiden return TABLE_TYPE_REGION2; 371b09c13cSSteffen Eiden return TABLE_TYPE_REGION1; 381b09c13cSSteffen Eiden } 391b09c13cSSteffen Eiden 401b09c13cSSteffen Eiden /** 411b09c13cSSteffen Eiden * gmap_new() - Allocate and initialize a guest address space. 421b09c13cSSteffen Eiden * @kvm: The kvm owning the guest. 431b09c13cSSteffen Eiden * @limit: Maximum address of the gmap address space. 441b09c13cSSteffen Eiden * 451b09c13cSSteffen Eiden * Return: A guest address space structure. 461b09c13cSSteffen Eiden */ 471b09c13cSSteffen Eiden struct gmap *gmap_new(struct kvm *kvm, gfn_t limit) 481b09c13cSSteffen Eiden { 491b09c13cSSteffen Eiden struct crst_table *table; 501b09c13cSSteffen Eiden struct gmap *gmap; 511b09c13cSSteffen Eiden int type; 521b09c13cSSteffen Eiden 531b09c13cSSteffen Eiden type = gmap_limit_to_type(limit); 541b09c13cSSteffen Eiden 551b09c13cSSteffen Eiden gmap = kzalloc_obj(*gmap, GFP_KERNEL_ACCOUNT); 561b09c13cSSteffen Eiden if (!gmap) 571b09c13cSSteffen Eiden return NULL; 581b09c13cSSteffen Eiden INIT_LIST_HEAD(&gmap->children); 591b09c13cSSteffen Eiden INIT_LIST_HEAD(&gmap->list); 601b09c13cSSteffen Eiden INIT_LIST_HEAD(&gmap->scb_users); 611b09c13cSSteffen Eiden INIT_RADIX_TREE(&gmap->host_to_rmap, GFP_KVM_S390_MMU_CACHE); 621b09c13cSSteffen Eiden spin_lock_init(&gmap->children_lock); 631b09c13cSSteffen Eiden spin_lock_init(&gmap->host_to_rmap_lock); 641b09c13cSSteffen Eiden refcount_set(&gmap->refcount, 1); 651b09c13cSSteffen Eiden 661b09c13cSSteffen Eiden table = dat_alloc_crst_sleepable(_CRSTE_EMPTY(type).val); 671b09c13cSSteffen Eiden if (!table) { 681b09c13cSSteffen Eiden kfree(gmap); 691b09c13cSSteffen Eiden return NULL; 701b09c13cSSteffen Eiden } 711b09c13cSSteffen Eiden 721b09c13cSSteffen Eiden gmap->asce.val = __pa(table); 731b09c13cSSteffen Eiden gmap->asce.dt = type; 741b09c13cSSteffen Eiden gmap->asce.tl = _ASCE_TABLE_LENGTH; 751b09c13cSSteffen Eiden gmap->asce.x = 1; 761b09c13cSSteffen Eiden gmap->asce.p = 1; 771b09c13cSSteffen Eiden gmap->asce.s = 1; 781b09c13cSSteffen Eiden gmap->kvm = kvm; 791b09c13cSSteffen Eiden set_bit(GMAP_FLAG_OWNS_PAGETABLES, &gmap->flags); 801b09c13cSSteffen Eiden 811b09c13cSSteffen Eiden return gmap; 821b09c13cSSteffen Eiden } 831b09c13cSSteffen Eiden 841b09c13cSSteffen Eiden static void gmap_add_child(struct gmap *parent, struct gmap *child) 851b09c13cSSteffen Eiden { 861b09c13cSSteffen Eiden KVM_BUG_ON(is_ucontrol(parent) && parent->parent, parent->kvm); 871b09c13cSSteffen Eiden KVM_BUG_ON(is_ucontrol(parent) && !owns_page_tables(parent), parent->kvm); 881b09c13cSSteffen Eiden KVM_BUG_ON(!refcount_read(&child->refcount), parent->kvm); 891b09c13cSSteffen Eiden lockdep_assert_held(&parent->children_lock); 901b09c13cSSteffen Eiden 911b09c13cSSteffen Eiden child->parent = parent; 921b09c13cSSteffen Eiden 931b09c13cSSteffen Eiden if (is_ucontrol(parent)) 941b09c13cSSteffen Eiden set_bit(GMAP_FLAG_IS_UCONTROL, &child->flags); 951b09c13cSSteffen Eiden else 961b09c13cSSteffen Eiden clear_bit(GMAP_FLAG_IS_UCONTROL, &child->flags); 971b09c13cSSteffen Eiden 981b09c13cSSteffen Eiden if (test_bit(GMAP_FLAG_ALLOW_HPAGE_1M, &parent->flags)) 991b09c13cSSteffen Eiden set_bit(GMAP_FLAG_ALLOW_HPAGE_1M, &child->flags); 1001b09c13cSSteffen Eiden else 1011b09c13cSSteffen Eiden clear_bit(GMAP_FLAG_ALLOW_HPAGE_1M, &child->flags); 1021b09c13cSSteffen Eiden 1031b09c13cSSteffen Eiden if (test_bit(GMAP_FLAG_ALLOW_HPAGE_2G, &parent->flags)) 1041b09c13cSSteffen Eiden set_bit(GMAP_FLAG_ALLOW_HPAGE_2G, &child->flags); 1051b09c13cSSteffen Eiden else 1061b09c13cSSteffen Eiden clear_bit(GMAP_FLAG_ALLOW_HPAGE_2G, &child->flags); 1071b09c13cSSteffen Eiden 1081b09c13cSSteffen Eiden if (kvm_is_ucontrol(parent->kvm)) 1091b09c13cSSteffen Eiden clear_bit(GMAP_FLAG_OWNS_PAGETABLES, &child->flags); 1101b09c13cSSteffen Eiden list_add(&child->list, &parent->children); 1111b09c13cSSteffen Eiden } 1121b09c13cSSteffen Eiden 1131b09c13cSSteffen Eiden struct gmap *gmap_new_child(struct gmap *parent, gfn_t limit) 1141b09c13cSSteffen Eiden { 1151b09c13cSSteffen Eiden struct gmap *res; 1161b09c13cSSteffen Eiden 1171b09c13cSSteffen Eiden lockdep_assert_not_held(&parent->children_lock); 1181b09c13cSSteffen Eiden res = gmap_new(parent->kvm, limit); 1191b09c13cSSteffen Eiden if (res) { 1201b09c13cSSteffen Eiden scoped_guard(spinlock, &parent->children_lock) 1211b09c13cSSteffen Eiden gmap_add_child(parent, res); 1221b09c13cSSteffen Eiden } 1231b09c13cSSteffen Eiden return res; 1241b09c13cSSteffen Eiden } 1251b09c13cSSteffen Eiden 1261b09c13cSSteffen Eiden int gmap_set_limit(struct gmap *gmap, gfn_t limit) 1271b09c13cSSteffen Eiden { 1281b09c13cSSteffen Eiden struct kvm_s390_mmu_cache *mc __free(kvm_s390_mmu_cache) = NULL; 1291b09c13cSSteffen Eiden int rc, type; 1301b09c13cSSteffen Eiden 1311b09c13cSSteffen Eiden type = gmap_limit_to_type(limit); 1321b09c13cSSteffen Eiden 1331b09c13cSSteffen Eiden mc = kvm_s390_new_mmu_cache(); 1341b09c13cSSteffen Eiden if (!mc) 1351b09c13cSSteffen Eiden return -ENOMEM; 1361b09c13cSSteffen Eiden 1371b09c13cSSteffen Eiden do { 1381b09c13cSSteffen Eiden rc = kvm_s390_mmu_cache_topup(mc); 1391b09c13cSSteffen Eiden if (rc) 1401b09c13cSSteffen Eiden return rc; 1411b09c13cSSteffen Eiden scoped_guard(write_lock, &gmap->kvm->mmu_lock) 1421b09c13cSSteffen Eiden rc = dat_set_asce_limit(mc, &gmap->asce, type); 1431b09c13cSSteffen Eiden } while (rc == -ENOMEM); 1441b09c13cSSteffen Eiden 1451b09c13cSSteffen Eiden return 0; 1461b09c13cSSteffen Eiden } 1471b09c13cSSteffen Eiden 1481b09c13cSSteffen Eiden static void gmap_rmap_radix_tree_free(struct radix_tree_root *root) 1491b09c13cSSteffen Eiden { 1501b09c13cSSteffen Eiden struct vsie_rmap *rmap, *rnext, *head; 1511b09c13cSSteffen Eiden struct radix_tree_iter iter; 1521b09c13cSSteffen Eiden unsigned long indices[16]; 1531b09c13cSSteffen Eiden unsigned long index; 1541b09c13cSSteffen Eiden void __rcu **slot; 1551b09c13cSSteffen Eiden int i, nr; 1561b09c13cSSteffen Eiden 1571b09c13cSSteffen Eiden /* A radix tree is freed by deleting all of its entries */ 1581b09c13cSSteffen Eiden index = 0; 1591b09c13cSSteffen Eiden do { 1601b09c13cSSteffen Eiden nr = 0; 1611b09c13cSSteffen Eiden radix_tree_for_each_slot(slot, root, &iter, index) { 1621b09c13cSSteffen Eiden indices[nr] = iter.index; 1631b09c13cSSteffen Eiden if (++nr == 16) 1641b09c13cSSteffen Eiden break; 1651b09c13cSSteffen Eiden } 1661b09c13cSSteffen Eiden for (i = 0; i < nr; i++) { 1671b09c13cSSteffen Eiden index = indices[i]; 1681b09c13cSSteffen Eiden head = radix_tree_delete(root, index); 1691b09c13cSSteffen Eiden gmap_for_each_rmap_safe(rmap, rnext, head) 1701b09c13cSSteffen Eiden kfree(rmap); 1711b09c13cSSteffen Eiden } 1721b09c13cSSteffen Eiden } while (nr > 0); 1731b09c13cSSteffen Eiden } 1741b09c13cSSteffen Eiden 1751b09c13cSSteffen Eiden void gmap_remove_child(struct gmap *child) 1761b09c13cSSteffen Eiden { 1771b09c13cSSteffen Eiden if (KVM_BUG_ON(!child->parent, child->kvm)) 1781b09c13cSSteffen Eiden return; 1791b09c13cSSteffen Eiden lockdep_assert_held(&child->parent->children_lock); 1801b09c13cSSteffen Eiden 1811b09c13cSSteffen Eiden list_del(&child->list); 1821b09c13cSSteffen Eiden child->parent = NULL; 1831b09c13cSSteffen Eiden child->invalidated = true; 1841b09c13cSSteffen Eiden } 1851b09c13cSSteffen Eiden 1861b09c13cSSteffen Eiden /** 1871b09c13cSSteffen Eiden * gmap_dispose() - Remove and free a guest address space and its children. 1881b09c13cSSteffen Eiden * @gmap: Pointer to the guest address space structure. 1891b09c13cSSteffen Eiden */ 1901b09c13cSSteffen Eiden void gmap_dispose(struct gmap *gmap) 1911b09c13cSSteffen Eiden { 1921b09c13cSSteffen Eiden /* The gmap must have been removed from the parent beforehands */ 1931b09c13cSSteffen Eiden KVM_BUG_ON(gmap->parent, gmap->kvm); 1941b09c13cSSteffen Eiden /* All children of this gmap must have been removed beforehands */ 1951b09c13cSSteffen Eiden KVM_BUG_ON(!list_empty(&gmap->children), gmap->kvm); 1961b09c13cSSteffen Eiden /* No VSIE shadow block is allowed to use this gmap */ 1971b09c13cSSteffen Eiden KVM_BUG_ON(!list_empty(&gmap->scb_users), gmap->kvm); 1981b09c13cSSteffen Eiden /* The ASCE must be valid */ 1991b09c13cSSteffen Eiden KVM_BUG_ON(!gmap->asce.val, gmap->kvm); 2001b09c13cSSteffen Eiden /* The refcount must be 0 */ 2011b09c13cSSteffen Eiden KVM_BUG_ON(refcount_read(&gmap->refcount), gmap->kvm); 2021b09c13cSSteffen Eiden 2031b09c13cSSteffen Eiden /* Flush tlb of all gmaps */ 2041b09c13cSSteffen Eiden asce_flush_tlb(gmap->asce); 2051b09c13cSSteffen Eiden 2061b09c13cSSteffen Eiden /* Free all DAT tables. */ 2071b09c13cSSteffen Eiden dat_free_level(dereference_asce(gmap->asce), owns_page_tables(gmap)); 2081b09c13cSSteffen Eiden 2091b09c13cSSteffen Eiden /* Free additional data for a shadow gmap */ 2101b09c13cSSteffen Eiden if (is_shadow(gmap)) 2111b09c13cSSteffen Eiden gmap_rmap_radix_tree_free(&gmap->host_to_rmap); 2121b09c13cSSteffen Eiden 2131b09c13cSSteffen Eiden kfree(gmap); 2141b09c13cSSteffen Eiden } 2151b09c13cSSteffen Eiden 2161b09c13cSSteffen Eiden /** 2171b09c13cSSteffen Eiden * s390_replace_asce() - Try to replace the current ASCE of a gmap with a copy. 2181b09c13cSSteffen Eiden * @gmap: The gmap whose ASCE needs to be replaced. 2191b09c13cSSteffen Eiden * 2201b09c13cSSteffen Eiden * If the ASCE is a SEGMENT type then this function will return -EINVAL, 2211b09c13cSSteffen Eiden * otherwise the pointers in the host_to_guest radix tree will keep pointing 2221b09c13cSSteffen Eiden * to the wrong pages, causing use-after-free and memory corruption. 2231b09c13cSSteffen Eiden * If the allocation of the new top level page table fails, the ASCE is not 2241b09c13cSSteffen Eiden * replaced. 2251b09c13cSSteffen Eiden * In any case, the old ASCE is always removed from the gmap CRST list. 2261b09c13cSSteffen Eiden * Therefore the caller has to make sure to save a pointer to it 2271b09c13cSSteffen Eiden * beforehand, unless a leak is actually intended. 2281b09c13cSSteffen Eiden * 2291b09c13cSSteffen Eiden * Return: 0 in case of success, -EINVAL if the ASCE is segment type ASCE, 2301b09c13cSSteffen Eiden * -ENOMEM if runinng out of memory. 2311b09c13cSSteffen Eiden */ 2321b09c13cSSteffen Eiden int s390_replace_asce(struct gmap *gmap) 2331b09c13cSSteffen Eiden { 2341b09c13cSSteffen Eiden struct crst_table *table; 2351b09c13cSSteffen Eiden union asce asce; 2361b09c13cSSteffen Eiden 2371b09c13cSSteffen Eiden /* Replacing segment type ASCEs would cause serious issues */ 2381b09c13cSSteffen Eiden if (gmap->asce.dt == ASCE_TYPE_SEGMENT) 2391b09c13cSSteffen Eiden return -EINVAL; 2401b09c13cSSteffen Eiden 2411b09c13cSSteffen Eiden table = dat_alloc_crst_sleepable(0); 2421b09c13cSSteffen Eiden if (!table) 2431b09c13cSSteffen Eiden return -ENOMEM; 2441b09c13cSSteffen Eiden memcpy(table, dereference_asce(gmap->asce), sizeof(*table)); 2451b09c13cSSteffen Eiden 2461b09c13cSSteffen Eiden /* Set new table origin while preserving existing ASCE control bits */ 2471b09c13cSSteffen Eiden asce = gmap->asce; 2481b09c13cSSteffen Eiden asce.rsto = virt_to_pfn(table); 2491b09c13cSSteffen Eiden WRITE_ONCE(gmap->asce, asce); 2501b09c13cSSteffen Eiden 2511b09c13cSSteffen Eiden return 0; 2521b09c13cSSteffen Eiden } 2531b09c13cSSteffen Eiden 254*188a15ccSSteffen Eiden #if KVM_S390_MANAGES_S390_GUEST 255*188a15ccSSteffen Eiden static inline bool kvm_s390_is_in_sie(struct kvm_vcpu *vcpu) 256*188a15ccSSteffen Eiden { 257*188a15ccSSteffen Eiden return vcpu->arch.sie_block->prog0c & PROG_IN_SIE; 258*188a15ccSSteffen Eiden } 259*188a15ccSSteffen Eiden 2601b09c13cSSteffen Eiden bool _gmap_unmap_prefix(struct gmap *gmap, gfn_t gfn, gfn_t end, bool hint) 2611b09c13cSSteffen Eiden { 2621b09c13cSSteffen Eiden struct kvm *kvm = gmap->kvm; 2631b09c13cSSteffen Eiden struct kvm_vcpu *vcpu; 2641b09c13cSSteffen Eiden gfn_t prefix_gfn; 2651b09c13cSSteffen Eiden unsigned long i; 2661b09c13cSSteffen Eiden 2671b09c13cSSteffen Eiden if (is_shadow(gmap)) 2681b09c13cSSteffen Eiden return false; 2691b09c13cSSteffen Eiden kvm_for_each_vcpu(i, vcpu, kvm) { 2701b09c13cSSteffen Eiden /* Match against both prefix pages */ 2711b09c13cSSteffen Eiden prefix_gfn = gpa_to_gfn(kvm_s390_get_prefix(vcpu)); 2721b09c13cSSteffen Eiden if (prefix_gfn < end && gfn <= prefix_gfn + 1) { 2731b09c13cSSteffen Eiden if (hint && kvm_s390_is_in_sie(vcpu)) 2741b09c13cSSteffen Eiden return false; 2751b09c13cSSteffen Eiden VCPU_EVENT(vcpu, 2, "gmap notifier for %llx-%llx", 2761b09c13cSSteffen Eiden gfn_to_gpa(gfn), gfn_to_gpa(end)); 2771b09c13cSSteffen Eiden kvm_s390_sync_request(KVM_REQ_REFRESH_GUEST_PREFIX, vcpu); 2781b09c13cSSteffen Eiden } 2791b09c13cSSteffen Eiden } 2801b09c13cSSteffen Eiden return true; 2811b09c13cSSteffen Eiden } 282*188a15ccSSteffen Eiden #endif /* KVM_S390_MANAGES_S390_GUEST */ 2831b09c13cSSteffen Eiden 2841b09c13cSSteffen Eiden struct clear_young_pte_priv { 2851b09c13cSSteffen Eiden struct gmap *gmap; 2861b09c13cSSteffen Eiden bool young; 2871b09c13cSSteffen Eiden }; 2881b09c13cSSteffen Eiden 2891b09c13cSSteffen Eiden static long gmap_clear_young_pte(union pte *ptep, gfn_t gfn, gfn_t end, struct dat_walk *walk) 2901b09c13cSSteffen Eiden { 2911b09c13cSSteffen Eiden struct clear_young_pte_priv *p = walk->priv; 2921b09c13cSSteffen Eiden union pgste pgste; 2931b09c13cSSteffen Eiden union pte pte, new; 2941b09c13cSSteffen Eiden 2951b09c13cSSteffen Eiden pte = READ_ONCE(*ptep); 2961b09c13cSSteffen Eiden 2971b09c13cSSteffen Eiden if (!pte.s.pr || (!pte.s.y && pte.h.i)) 2981b09c13cSSteffen Eiden return 0; 2991b09c13cSSteffen Eiden 3001b09c13cSSteffen Eiden pgste = pgste_get_lock(ptep); 3011b09c13cSSteffen Eiden if (!pgste.prefix_notif || gmap_mkold_prefix(p->gmap, gfn, end)) { 3021b09c13cSSteffen Eiden new = pte; 3031b09c13cSSteffen Eiden new.h.i = 1; 3041b09c13cSSteffen Eiden new.s.y = 0; 3051b09c13cSSteffen Eiden if ((new.s.d || !new.h.p) && !new.s.s) 3061b09c13cSSteffen Eiden folio_set_dirty(pfn_folio(pte.h.pfra)); 3071b09c13cSSteffen Eiden new.s.d = 0; 3081b09c13cSSteffen Eiden new.h.p = 1; 3091b09c13cSSteffen Eiden 3101b09c13cSSteffen Eiden pgste.prefix_notif = 0; 3111b09c13cSSteffen Eiden pgste = __dat_ptep_xchg(ptep, pgste, new, gfn, walk->asce, uses_skeys(p->gmap)); 3121b09c13cSSteffen Eiden } 3131b09c13cSSteffen Eiden p->young = 1; 3141b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 3151b09c13cSSteffen Eiden return 0; 3161b09c13cSSteffen Eiden } 3171b09c13cSSteffen Eiden 3181b09c13cSSteffen Eiden static long gmap_clear_young_crste(union crste *crstep, gfn_t gfn, gfn_t end, struct dat_walk *walk) 3191b09c13cSSteffen Eiden { 3201b09c13cSSteffen Eiden struct clear_young_pte_priv *priv = walk->priv; 3211b09c13cSSteffen Eiden union crste crste, new; 3221b09c13cSSteffen Eiden 3231b09c13cSSteffen Eiden do { 3241b09c13cSSteffen Eiden crste = READ_ONCE(*crstep); 3251b09c13cSSteffen Eiden 3261b09c13cSSteffen Eiden if (!crste.h.fc) 3271b09c13cSSteffen Eiden return 0; 3281b09c13cSSteffen Eiden if (!crste.s.fc1.y && crste.h.i) 3291b09c13cSSteffen Eiden return 0; 3301b09c13cSSteffen Eiden if (crste_prefix(crste) && !gmap_mkold_prefix(priv->gmap, gfn, end)) 3311b09c13cSSteffen Eiden break; 3321b09c13cSSteffen Eiden 3331b09c13cSSteffen Eiden new = crste; 3341b09c13cSSteffen Eiden new.h.i = 1; 3351b09c13cSSteffen Eiden new.s.fc1.y = 0; 3361b09c13cSSteffen Eiden new.s.fc1.prefix_notif = 0; 3371b09c13cSSteffen Eiden if ((new.s.fc1.d || !new.h.p) && !new.s.fc1.s) 3381b09c13cSSteffen Eiden folio_set_dirty(phys_to_folio(crste_origin_large(crste))); 3391b09c13cSSteffen Eiden new.s.fc1.d = 0; 3401b09c13cSSteffen Eiden new.h.p = 1; 3411b09c13cSSteffen Eiden } while (!dat_crstep_xchg_atomic(crstep, crste, new, gfn, walk->asce)); 3421b09c13cSSteffen Eiden 3431b09c13cSSteffen Eiden priv->young = 1; 3441b09c13cSSteffen Eiden return 0; 3451b09c13cSSteffen Eiden } 3461b09c13cSSteffen Eiden 3471b09c13cSSteffen Eiden /** 3481b09c13cSSteffen Eiden * gmap_age_gfn() - Clear young. 3491b09c13cSSteffen Eiden * @gmap: The guest gmap. 3501b09c13cSSteffen Eiden * @start: The first gfn to test. 3511b09c13cSSteffen Eiden * @end: The gfn after the last one to test. 3521b09c13cSSteffen Eiden * 3531b09c13cSSteffen Eiden * Context: Called with the kvm mmu write lock held. 3541b09c13cSSteffen Eiden * Return: 1 if any page in the given range was young, otherwise 0. 3551b09c13cSSteffen Eiden */ 3561b09c13cSSteffen Eiden bool gmap_age_gfn(struct gmap *gmap, gfn_t start, gfn_t end) 3571b09c13cSSteffen Eiden { 3581b09c13cSSteffen Eiden const struct dat_walk_ops ops = { 3591b09c13cSSteffen Eiden .pte_entry = gmap_clear_young_pte, 3601b09c13cSSteffen Eiden .pmd_entry = gmap_clear_young_crste, 3611b09c13cSSteffen Eiden .pud_entry = gmap_clear_young_crste, 3621b09c13cSSteffen Eiden }; 3631b09c13cSSteffen Eiden struct clear_young_pte_priv priv = { 3641b09c13cSSteffen Eiden .gmap = gmap, 3651b09c13cSSteffen Eiden .young = false, 3661b09c13cSSteffen Eiden }; 3671b09c13cSSteffen Eiden 3681b09c13cSSteffen Eiden _dat_walk_gfn_range(start, end, gmap->asce, &ops, 0, &priv); 3691b09c13cSSteffen Eiden 3701b09c13cSSteffen Eiden return priv.young; 3711b09c13cSSteffen Eiden } 3721b09c13cSSteffen Eiden 3731b09c13cSSteffen Eiden struct gmap_unmap_priv { 3741b09c13cSSteffen Eiden struct gmap *gmap; 3751b09c13cSSteffen Eiden struct kvm_memory_slot *slot; 3761b09c13cSSteffen Eiden }; 3771b09c13cSSteffen Eiden 3781b09c13cSSteffen Eiden static long _gmap_unmap_pte(union pte *ptep, gfn_t gfn, gfn_t next, struct dat_walk *w) 3791b09c13cSSteffen Eiden { 3801b09c13cSSteffen Eiden struct gmap_unmap_priv *priv = w->priv; 3811b09c13cSSteffen Eiden struct folio *folio = NULL; 3821b09c13cSSteffen Eiden unsigned long vmaddr; 3831b09c13cSSteffen Eiden union pgste pgste; 3841b09c13cSSteffen Eiden 3851b09c13cSSteffen Eiden pgste = pgste_get_lock(ptep); 3861b09c13cSSteffen Eiden if (ptep->s.pr && pgste.usage == PGSTE_GPS_USAGE_UNUSED) { 3871b09c13cSSteffen Eiden vmaddr = __gfn_to_hva_memslot(priv->slot, gfn); 3881b09c13cSSteffen Eiden gmap_helper_try_set_pte_unused(priv->gmap->kvm->mm, vmaddr); 3891b09c13cSSteffen Eiden } 3901b09c13cSSteffen Eiden if (ptep->s.pr && test_bit(GMAP_FLAG_EXPORT_ON_UNMAP, &priv->gmap->flags)) 3911b09c13cSSteffen Eiden folio = pfn_folio(ptep->h.pfra); 3921b09c13cSSteffen Eiden pgste = gmap_ptep_xchg(priv->gmap, ptep, _PTE_EMPTY, pgste, gfn); 3931b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 3941b09c13cSSteffen Eiden if (folio) 3951b09c13cSSteffen Eiden uv_convert_from_secure_folio(folio); 3961b09c13cSSteffen Eiden 3971b09c13cSSteffen Eiden return 0; 3981b09c13cSSteffen Eiden } 3991b09c13cSSteffen Eiden 4001b09c13cSSteffen Eiden static long _gmap_unmap_crste(union crste *crstep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 4011b09c13cSSteffen Eiden { 4021b09c13cSSteffen Eiden struct gmap_unmap_priv *priv = walk->priv; 4031b09c13cSSteffen Eiden struct folio *folio = NULL; 4041b09c13cSSteffen Eiden union crste old = *crstep; 4051b09c13cSSteffen Eiden bool ok; 4061b09c13cSSteffen Eiden 4071b09c13cSSteffen Eiden if (!old.h.fc) 4081b09c13cSSteffen Eiden return 0; 4091b09c13cSSteffen Eiden 4101b09c13cSSteffen Eiden if (old.s.fc1.pr && test_bit(GMAP_FLAG_EXPORT_ON_UNMAP, &priv->gmap->flags)) 4111b09c13cSSteffen Eiden folio = phys_to_folio(crste_origin_large(old)); 4121b09c13cSSteffen Eiden /* 4131b09c13cSSteffen Eiden * No races should happen because kvm->mmu_lock is held in write mode, 4141b09c13cSSteffen Eiden * but the unmap operation could have triggered an unshadow, which 4151b09c13cSSteffen Eiden * causes gmap_crstep_xchg_atomic() to return false and clear the 4161b09c13cSSteffen Eiden * vsie_notif bit. Allow the operation to fail once, if the old crste 4171b09c13cSSteffen Eiden * had the vsie_notif bit set. A second failure is not allowed, for 4181b09c13cSSteffen Eiden * the reasons above. 4191b09c13cSSteffen Eiden */ 4201b09c13cSSteffen Eiden ok = gmap_crstep_xchg_atomic(priv->gmap, crstep, old, _CRSTE_EMPTY(old.h.tt), gfn); 4211b09c13cSSteffen Eiden if (!ok) { 4221b09c13cSSteffen Eiden KVM_BUG_ON(!old.s.fc1.vsie_notif, priv->gmap->kvm); 4231b09c13cSSteffen Eiden old.s.fc1.vsie_notif = 0; 4241b09c13cSSteffen Eiden ok = gmap_crstep_xchg_atomic(priv->gmap, crstep, old, _CRSTE_EMPTY(old.h.tt), gfn); 4251b09c13cSSteffen Eiden KVM_BUG_ON(!ok, priv->gmap->kvm); 4261b09c13cSSteffen Eiden } 4271b09c13cSSteffen Eiden if (folio) 4281b09c13cSSteffen Eiden uv_convert_from_secure_folio(folio); 4291b09c13cSSteffen Eiden 4301b09c13cSSteffen Eiden return 0; 4311b09c13cSSteffen Eiden } 4321b09c13cSSteffen Eiden 4331b09c13cSSteffen Eiden /** 4341b09c13cSSteffen Eiden * gmap_unmap_gfn_range() - Unmap a range of guest addresses. 4351b09c13cSSteffen Eiden * @gmap: The gmap to act on. 4361b09c13cSSteffen Eiden * @slot: The memslot in which the range is located. 4371b09c13cSSteffen Eiden * @start: The first gfn to unmap. 4381b09c13cSSteffen Eiden * @end: The gfn after the last one to unmap. 4391b09c13cSSteffen Eiden * 4401b09c13cSSteffen Eiden * Context: Called with the kvm mmu write lock held. 4411b09c13cSSteffen Eiden * Return: false 4421b09c13cSSteffen Eiden */ 4431b09c13cSSteffen Eiden bool gmap_unmap_gfn_range(struct gmap *gmap, struct kvm_memory_slot *slot, gfn_t start, gfn_t end) 4441b09c13cSSteffen Eiden { 4451b09c13cSSteffen Eiden const struct dat_walk_ops ops = { 4461b09c13cSSteffen Eiden .pte_entry = _gmap_unmap_pte, 4471b09c13cSSteffen Eiden .pmd_entry = _gmap_unmap_crste, 4481b09c13cSSteffen Eiden .pud_entry = _gmap_unmap_crste, 4491b09c13cSSteffen Eiden }; 4501b09c13cSSteffen Eiden struct gmap_unmap_priv priv = { 4511b09c13cSSteffen Eiden .gmap = gmap, 4521b09c13cSSteffen Eiden .slot = slot, 4531b09c13cSSteffen Eiden }; 4541b09c13cSSteffen Eiden 4551b09c13cSSteffen Eiden lockdep_assert_held_write(&gmap->kvm->mmu_lock); 4561b09c13cSSteffen Eiden 4571b09c13cSSteffen Eiden _dat_walk_gfn_range(start, end, gmap->asce, &ops, 0, &priv); 4581b09c13cSSteffen Eiden return false; 4591b09c13cSSteffen Eiden } 4601b09c13cSSteffen Eiden 4611b09c13cSSteffen Eiden static union pgste __pte_test_and_clear_softdirty(union pte *ptep, union pgste pgste, gfn_t gfn, 4621b09c13cSSteffen Eiden struct gmap *gmap) 4631b09c13cSSteffen Eiden { 4641b09c13cSSteffen Eiden union pte pte = READ_ONCE(*ptep); 4651b09c13cSSteffen Eiden 4661b09c13cSSteffen Eiden if (!pte.s.pr || (pte.h.p && !pte.s.sd)) 4671b09c13cSSteffen Eiden return pgste; 4681b09c13cSSteffen Eiden 4691b09c13cSSteffen Eiden /* 4701b09c13cSSteffen Eiden * If this page contains one or more prefixes of vCPUS that are currently 4711b09c13cSSteffen Eiden * running, do not reset the protection, leave it marked as dirty. 4721b09c13cSSteffen Eiden */ 4731b09c13cSSteffen Eiden if (!pgste.prefix_notif || gmap_mkold_prefix(gmap, gfn, gfn + 1)) { 4741b09c13cSSteffen Eiden pte.h.p = 1; 4751b09c13cSSteffen Eiden pte.s.sd = 0; 4761b09c13cSSteffen Eiden pgste = gmap_ptep_xchg(gmap, ptep, pte, pgste, gfn); 4771b09c13cSSteffen Eiden } 4781b09c13cSSteffen Eiden 4791b09c13cSSteffen Eiden mark_page_dirty(gmap->kvm, gfn); 4801b09c13cSSteffen Eiden 4811b09c13cSSteffen Eiden return pgste; 4821b09c13cSSteffen Eiden } 4831b09c13cSSteffen Eiden 4841b09c13cSSteffen Eiden static long _pte_test_and_clear_softdirty(union pte *ptep, gfn_t gfn, gfn_t end, 4851b09c13cSSteffen Eiden struct dat_walk *walk) 4861b09c13cSSteffen Eiden { 4871b09c13cSSteffen Eiden struct gmap *gmap = walk->priv; 4881b09c13cSSteffen Eiden union pgste pgste; 4891b09c13cSSteffen Eiden 4901b09c13cSSteffen Eiden pgste = pgste_get_lock(ptep); 4911b09c13cSSteffen Eiden pgste = __pte_test_and_clear_softdirty(ptep, pgste, gfn, gmap); 4921b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 4931b09c13cSSteffen Eiden return 0; 4941b09c13cSSteffen Eiden } 4951b09c13cSSteffen Eiden 4961b09c13cSSteffen Eiden static long _crste_test_and_clear_softdirty(union crste *table, gfn_t gfn, gfn_t end, 4971b09c13cSSteffen Eiden struct dat_walk *walk) 4981b09c13cSSteffen Eiden { 4991b09c13cSSteffen Eiden struct gmap *gmap = walk->priv; 5001b09c13cSSteffen Eiden union crste crste, new; 5011b09c13cSSteffen Eiden 5021b09c13cSSteffen Eiden if (fatal_signal_pending(current)) 5031b09c13cSSteffen Eiden return 1; 5041b09c13cSSteffen Eiden do { 5051b09c13cSSteffen Eiden crste = READ_ONCE(*table); 5061b09c13cSSteffen Eiden if (!crste.h.fc) 5071b09c13cSSteffen Eiden return 0; 5081b09c13cSSteffen Eiden if (crste.h.p && !crste.s.fc1.sd) 5091b09c13cSSteffen Eiden return 0; 5101b09c13cSSteffen Eiden 5111b09c13cSSteffen Eiden /* 5121b09c13cSSteffen Eiden * If this large page contains one or more prefixes of vCPUs that are 5131b09c13cSSteffen Eiden * currently running, do not reset the protection, leave it marked as 5141b09c13cSSteffen Eiden * dirty. 5151b09c13cSSteffen Eiden */ 5161b09c13cSSteffen Eiden if (crste.s.fc1.prefix_notif && !gmap_mkold_prefix(gmap, gfn, end)) 5171b09c13cSSteffen Eiden break; 5181b09c13cSSteffen Eiden new = crste; 5191b09c13cSSteffen Eiden new.h.p = 1; 5201b09c13cSSteffen Eiden new.s.fc1.sd = 0; 5211b09c13cSSteffen Eiden } while (!gmap_crstep_xchg_atomic(gmap, table, crste, new, gfn)); 5221b09c13cSSteffen Eiden 5231b09c13cSSteffen Eiden for ( ; gfn < end; gfn++) 5241b09c13cSSteffen Eiden mark_page_dirty(gmap->kvm, gfn); 5251b09c13cSSteffen Eiden 5261b09c13cSSteffen Eiden return 0; 5271b09c13cSSteffen Eiden } 5281b09c13cSSteffen Eiden 5291b09c13cSSteffen Eiden void gmap_sync_dirty_log(struct gmap *gmap, gfn_t start, gfn_t end) 5301b09c13cSSteffen Eiden { 5311b09c13cSSteffen Eiden const struct dat_walk_ops walk_ops = { 5321b09c13cSSteffen Eiden .pte_entry = _pte_test_and_clear_softdirty, 5331b09c13cSSteffen Eiden .pmd_entry = _crste_test_and_clear_softdirty, 5341b09c13cSSteffen Eiden .pud_entry = _crste_test_and_clear_softdirty, 5351b09c13cSSteffen Eiden }; 5361b09c13cSSteffen Eiden 5371b09c13cSSteffen Eiden lockdep_assert_held(&gmap->kvm->mmu_lock); 5381b09c13cSSteffen Eiden 5391b09c13cSSteffen Eiden _dat_walk_gfn_range(start, end, gmap->asce, &walk_ops, 0, gmap); 5401b09c13cSSteffen Eiden } 5411b09c13cSSteffen Eiden 5421b09c13cSSteffen Eiden static int gmap_handle_minor_crste_fault(struct gmap *gmap, struct guest_fault *f) 5431b09c13cSSteffen Eiden { 5441b09c13cSSteffen Eiden union crste newcrste, oldcrste = READ_ONCE(*f->crstep); 5451b09c13cSSteffen Eiden 5461b09c13cSSteffen Eiden /* Somehow the crste is not large anymore, let the slow path deal with it. */ 5471b09c13cSSteffen Eiden if (!oldcrste.h.fc) 5481b09c13cSSteffen Eiden return 1; 5491b09c13cSSteffen Eiden 5501b09c13cSSteffen Eiden f->pfn = PHYS_PFN(large_crste_to_phys(oldcrste, f->gfn)); 5511b09c13cSSteffen Eiden f->writable = oldcrste.s.fc1.w; 5521b09c13cSSteffen Eiden 5531b09c13cSSteffen Eiden f->crste_region3 = is_pud(oldcrste); 5541b09c13cSSteffen Eiden /* Appropriate permissions already (race with another handler), nothing to do. */ 5551b09c13cSSteffen Eiden if (!oldcrste.h.i && !(f->write_attempt && oldcrste.h.p)) 5561b09c13cSSteffen Eiden return 0; 5571b09c13cSSteffen Eiden 5581b09c13cSSteffen Eiden if (!f->write_attempt || oldcrste.s.fc1.w) { 5591b09c13cSSteffen Eiden f->write_attempt |= oldcrste.s.fc1.w && oldcrste.s.fc1.d; 5601b09c13cSSteffen Eiden newcrste = oldcrste; 5611b09c13cSSteffen Eiden newcrste.h.i = 0; 5621b09c13cSSteffen Eiden newcrste.s.fc1.y = 1; 5631b09c13cSSteffen Eiden if (f->write_attempt) { 5641b09c13cSSteffen Eiden newcrste.h.p = 0; 5651b09c13cSSteffen Eiden newcrste.s.fc1.d = 1; 5661b09c13cSSteffen Eiden newcrste.s.fc1.sd = 1; 5671b09c13cSSteffen Eiden } 5681b09c13cSSteffen Eiden /* In case of races, let the slow path deal with it. */ 5691b09c13cSSteffen Eiden return !gmap_crstep_xchg_atomic(gmap, f->crstep, oldcrste, newcrste, f->gfn); 5701b09c13cSSteffen Eiden } 5711b09c13cSSteffen Eiden /* Trying to write on a read-only page, let the slow path deal with it. */ 5721b09c13cSSteffen Eiden return 1; 5731b09c13cSSteffen Eiden } 5741b09c13cSSteffen Eiden 5751b09c13cSSteffen Eiden static int _gmap_handle_minor_pte_fault(struct gmap *gmap, union pgste *pgste, 5761b09c13cSSteffen Eiden struct guest_fault *f) 5771b09c13cSSteffen Eiden { 5781b09c13cSSteffen Eiden union pte newpte, oldpte = READ_ONCE(*f->ptep); 5791b09c13cSSteffen Eiden 5801b09c13cSSteffen Eiden f->pfn = oldpte.h.pfra; 5811b09c13cSSteffen Eiden f->writable = oldpte.s.w; 5821b09c13cSSteffen Eiden 5831b09c13cSSteffen Eiden /* Appropriate permissions already (race with another handler), nothing to do. */ 5841b09c13cSSteffen Eiden if (!oldpte.h.i && !(f->write_attempt && oldpte.h.p)) 5851b09c13cSSteffen Eiden return 0; 5861b09c13cSSteffen Eiden /* Trying to write on a read-only page, let the slow path deal with it. */ 5871b09c13cSSteffen Eiden if (!oldpte.s.pr || (f->write_attempt && !oldpte.s.w)) 5881b09c13cSSteffen Eiden return 1; 5891b09c13cSSteffen Eiden 5901b09c13cSSteffen Eiden newpte = oldpte; 5911b09c13cSSteffen Eiden newpte.h.i = 0; 5921b09c13cSSteffen Eiden newpte.s.y = 1; 5931b09c13cSSteffen Eiden if (f->write_attempt) { 5941b09c13cSSteffen Eiden newpte.h.p = 0; 5951b09c13cSSteffen Eiden newpte.s.d = 1; 5961b09c13cSSteffen Eiden newpte.s.sd = 1; 5971b09c13cSSteffen Eiden } 5981b09c13cSSteffen Eiden *pgste = gmap_ptep_xchg(gmap, f->ptep, newpte, *pgste, f->gfn); 5991b09c13cSSteffen Eiden 6001b09c13cSSteffen Eiden return 0; 6011b09c13cSSteffen Eiden } 6021b09c13cSSteffen Eiden 6031b09c13cSSteffen Eiden /** 6041b09c13cSSteffen Eiden * gmap_try_fixup_minor() -- Try to fixup a minor gmap fault. 6051b09c13cSSteffen Eiden * @gmap: The gmap whose fault needs to be resolved. 6061b09c13cSSteffen Eiden * @fault: Describes the fault that is being resolved. 6071b09c13cSSteffen Eiden * 6081b09c13cSSteffen Eiden * A minor fault is a fault that can be resolved quickly within gmap. 6091b09c13cSSteffen Eiden * The page is already mapped, the fault is only due to dirty/young tracking. 6101b09c13cSSteffen Eiden * 6111b09c13cSSteffen Eiden * Return: 0 in case of success, < 0 in case of error, > 0 if the fault could 6121b09c13cSSteffen Eiden * not be resolved and needs to go through the slow path. 6131b09c13cSSteffen Eiden */ 6141b09c13cSSteffen Eiden int gmap_try_fixup_minor(struct gmap *gmap, struct guest_fault *fault) 6151b09c13cSSteffen Eiden { 6161b09c13cSSteffen Eiden union pgste pgste; 6171b09c13cSSteffen Eiden int rc; 6181b09c13cSSteffen Eiden 6191b09c13cSSteffen Eiden lockdep_assert_held(&gmap->kvm->mmu_lock); 6201b09c13cSSteffen Eiden 6211b09c13cSSteffen Eiden rc = dat_entry_walk(NULL, fault->gfn, gmap->asce, DAT_WALK_LEAF, TABLE_TYPE_PAGE_TABLE, 6221b09c13cSSteffen Eiden &fault->crstep, &fault->ptep); 6231b09c13cSSteffen Eiden /* If a PTE or a leaf CRSTE could not be reached, slow path. */ 6241b09c13cSSteffen Eiden if (rc) 6251b09c13cSSteffen Eiden return 1; 6261b09c13cSSteffen Eiden 6271b09c13cSSteffen Eiden if (fault->ptep) { 6281b09c13cSSteffen Eiden pgste = pgste_get_lock(fault->ptep); 6291b09c13cSSteffen Eiden rc = _gmap_handle_minor_pte_fault(gmap, &pgste, fault); 6301b09c13cSSteffen Eiden if (!rc && fault->callback) 6311b09c13cSSteffen Eiden fault->callback(fault); 6321b09c13cSSteffen Eiden pgste_set_unlock(fault->ptep, pgste); 6331b09c13cSSteffen Eiden } else { 6341b09c13cSSteffen Eiden rc = gmap_handle_minor_crste_fault(gmap, fault); 6351b09c13cSSteffen Eiden if (!rc && fault->callback) 6361b09c13cSSteffen Eiden fault->callback(fault); 6371b09c13cSSteffen Eiden } 6381b09c13cSSteffen Eiden return rc; 6391b09c13cSSteffen Eiden } 6401b09c13cSSteffen Eiden 6411b09c13cSSteffen Eiden /** 6421b09c13cSSteffen Eiden * gmap_2g_allowed() - Check whether a 2G hugepage is allowed. 6431b09c13cSSteffen Eiden * @gmap: The gmap of the guest. 6441b09c13cSSteffen Eiden * @f: Describes the fault that is being resolved. 6451b09c13cSSteffen Eiden * @slot: The memslot the faulting address belongs to. 6461b09c13cSSteffen Eiden * 6471b09c13cSSteffen Eiden * The function checks whether the GMAP_FLAG_ALLOW_HPAGE_2G flag is set for 6481b09c13cSSteffen Eiden * @gmap, whether the offset of the address in the 2G virtual frame is the 6491b09c13cSSteffen Eiden * same as the offset in the physical 2G frame, and finally whether the whole 6501b09c13cSSteffen Eiden * 2G page would fit in the given memslot. 6511b09c13cSSteffen Eiden * 6521b09c13cSSteffen Eiden * Return: true if a 2G hugepage is allowed to back the faulting address, false 6531b09c13cSSteffen Eiden * otherwise. 6541b09c13cSSteffen Eiden */ 6551b09c13cSSteffen Eiden static inline bool gmap_2g_allowed(struct gmap *gmap, struct guest_fault *f, 6561b09c13cSSteffen Eiden struct kvm_memory_slot *slot) 6571b09c13cSSteffen Eiden { 6581b09c13cSSteffen Eiden return test_bit(GMAP_FLAG_ALLOW_HPAGE_2G, &gmap->flags) && 6591b09c13cSSteffen Eiden !((f->gfn ^ f->pfn) & ~_REGION3_FR_MASK) && 6601b09c13cSSteffen Eiden slot->base_gfn <= ALIGN_DOWN(f->gfn, _PAGES_PER_REGION3) && 6611b09c13cSSteffen Eiden slot->base_gfn + slot->npages >= ALIGN(f->gfn + 1, _PAGES_PER_REGION3); 6621b09c13cSSteffen Eiden } 6631b09c13cSSteffen Eiden 6641b09c13cSSteffen Eiden /** 6651b09c13cSSteffen Eiden * gmap_1m_allowed() - Check whether a 1M hugepage is allowed. 6661b09c13cSSteffen Eiden * @gmap: The gmap of the guest. 6671b09c13cSSteffen Eiden * @f: Describes the fault that is being resolved. 6681b09c13cSSteffen Eiden * @slot: The memslot the faulting address belongs to. 6691b09c13cSSteffen Eiden * 6701b09c13cSSteffen Eiden * The function checks whether the GMAP_FLAG_ALLOW_HPAGE_1M flag is set for 6711b09c13cSSteffen Eiden * @gmap, whether the offset of the address in the 1M virtual frame is the 6721b09c13cSSteffen Eiden * same as the offset in the physical 1M frame, and finally whether the whole 6731b09c13cSSteffen Eiden * 1M page would fit in the given memslot. 6741b09c13cSSteffen Eiden * 6751b09c13cSSteffen Eiden * Return: true if a 1M hugepage is allowed to back the faulting address, false 6761b09c13cSSteffen Eiden * otherwise. 6771b09c13cSSteffen Eiden */ 6781b09c13cSSteffen Eiden static inline bool gmap_1m_allowed(struct gmap *gmap, struct guest_fault *f, 6791b09c13cSSteffen Eiden struct kvm_memory_slot *slot) 6801b09c13cSSteffen Eiden { 6811b09c13cSSteffen Eiden return test_bit(GMAP_FLAG_ALLOW_HPAGE_1M, &gmap->flags) && 6821b09c13cSSteffen Eiden !((f->gfn ^ f->pfn) & ~_SEGMENT_FR_MASK) && 6831b09c13cSSteffen Eiden slot->base_gfn <= ALIGN_DOWN(f->gfn, _PAGES_PER_SEGMENT) && 6841b09c13cSSteffen Eiden slot->base_gfn + slot->npages >= ALIGN(f->gfn + 1, _PAGES_PER_SEGMENT); 6851b09c13cSSteffen Eiden } 6861b09c13cSSteffen Eiden 6871b09c13cSSteffen Eiden static int _gmap_link(struct kvm_s390_mmu_cache *mc, struct gmap *gmap, int level, 6881b09c13cSSteffen Eiden struct guest_fault *f) 6891b09c13cSSteffen Eiden { 6901b09c13cSSteffen Eiden union crste oldval, newval; 6911b09c13cSSteffen Eiden union pte newpte, oldpte; 6921b09c13cSSteffen Eiden union pgste pgste; 6931b09c13cSSteffen Eiden int rc = 0; 6941b09c13cSSteffen Eiden 6951b09c13cSSteffen Eiden rc = dat_entry_walk(mc, f->gfn, gmap->asce, DAT_WALK_ALLOC_CONTINUE, level, 6961b09c13cSSteffen Eiden &f->crstep, &f->ptep); 6971b09c13cSSteffen Eiden if (rc == -ENOMEM) 6981b09c13cSSteffen Eiden return rc; 6991b09c13cSSteffen Eiden if (KVM_BUG_ON(rc == -EINVAL, gmap->kvm)) 7001b09c13cSSteffen Eiden return rc; 7011b09c13cSSteffen Eiden if (rc) 7021b09c13cSSteffen Eiden return -EAGAIN; 7031b09c13cSSteffen Eiden if (KVM_BUG_ON(get_level(f->crstep, f->ptep) > level, gmap->kvm)) 7041b09c13cSSteffen Eiden return -EINVAL; 7051b09c13cSSteffen Eiden 7061b09c13cSSteffen Eiden if (f->ptep) { 7071b09c13cSSteffen Eiden pgste = pgste_get_lock(f->ptep); 7081b09c13cSSteffen Eiden oldpte = *f->ptep; 7091b09c13cSSteffen Eiden newpte = _pte(f->pfn, f->writable, f->write_attempt | oldpte.s.d, !f->page); 7101b09c13cSSteffen Eiden newpte.s.sd = oldpte.s.sd; 7111b09c13cSSteffen Eiden oldpte.s.sd = 0; 7121b09c13cSSteffen Eiden if (oldpte.val == _PTE_EMPTY.val || oldpte.h.pfra == f->pfn) { 7131b09c13cSSteffen Eiden pgste = gmap_ptep_xchg(gmap, f->ptep, newpte, pgste, f->gfn); 7141b09c13cSSteffen Eiden if (f->callback) 7151b09c13cSSteffen Eiden f->callback(f); 7161b09c13cSSteffen Eiden } else { 7171b09c13cSSteffen Eiden rc = -EAGAIN; 7181b09c13cSSteffen Eiden } 7191b09c13cSSteffen Eiden pgste_set_unlock(f->ptep, pgste); 7201b09c13cSSteffen Eiden } else { 7211b09c13cSSteffen Eiden do { 7221b09c13cSSteffen Eiden oldval = READ_ONCE(*f->crstep); 7231b09c13cSSteffen Eiden newval = _crste_fc1(f->pfn, oldval.h.tt, f->writable, 7241b09c13cSSteffen Eiden f->write_attempt | oldval.s.fc1.d); 7251b09c13cSSteffen Eiden newval.s.fc1.s = !f->page; 7261b09c13cSSteffen Eiden newval.s.fc1.sd = oldval.s.fc1.sd; 7271b09c13cSSteffen Eiden if (oldval.val != _CRSTE_EMPTY(oldval.h.tt).val && 7281b09c13cSSteffen Eiden crste_origin_large(oldval) != crste_origin_large(newval)) 7291b09c13cSSteffen Eiden return -EAGAIN; 7301b09c13cSSteffen Eiden f->crste_region3 = is_pud(newval); 7311b09c13cSSteffen Eiden } while (!gmap_crstep_xchg_atomic(gmap, f->crstep, oldval, newval, f->gfn)); 7321b09c13cSSteffen Eiden if (f->callback) 7331b09c13cSSteffen Eiden f->callback(f); 7341b09c13cSSteffen Eiden } 7351b09c13cSSteffen Eiden 7361b09c13cSSteffen Eiden return rc; 7371b09c13cSSteffen Eiden } 7381b09c13cSSteffen Eiden 7391b09c13cSSteffen Eiden int gmap_link(struct kvm_s390_mmu_cache *mc, struct gmap *gmap, struct guest_fault *f, 7401b09c13cSSteffen Eiden struct kvm_memory_slot *slot) 7411b09c13cSSteffen Eiden { 7421b09c13cSSteffen Eiden unsigned int order; 7431b09c13cSSteffen Eiden int level; 7441b09c13cSSteffen Eiden 7451b09c13cSSteffen Eiden lockdep_assert_held(&gmap->kvm->mmu_lock); 7461b09c13cSSteffen Eiden 7471b09c13cSSteffen Eiden level = TABLE_TYPE_PAGE_TABLE; 7481b09c13cSSteffen Eiden if (f->page) { 7491b09c13cSSteffen Eiden order = folio_order(page_folio(f->page)); 7501b09c13cSSteffen Eiden if (order >= get_order(_REGION3_SIZE) && gmap_2g_allowed(gmap, f, slot)) 7511b09c13cSSteffen Eiden level = TABLE_TYPE_REGION3; 7521b09c13cSSteffen Eiden else if (order >= get_order(_SEGMENT_SIZE) && gmap_1m_allowed(gmap, f, slot)) 7531b09c13cSSteffen Eiden level = TABLE_TYPE_SEGMENT; 7541b09c13cSSteffen Eiden } 7551b09c13cSSteffen Eiden return _gmap_link(mc, gmap, level, f); 7561b09c13cSSteffen Eiden } 7571b09c13cSSteffen Eiden 7581b09c13cSSteffen Eiden static int gmap_ucas_map_one(struct kvm_s390_mmu_cache *mc, struct gmap *gmap, 7591b09c13cSSteffen Eiden gfn_t p_gfn, gfn_t c_gfn, bool force_alloc) 7601b09c13cSSteffen Eiden { 7611b09c13cSSteffen Eiden union crste newcrste, oldcrste; 7621b09c13cSSteffen Eiden struct page_table *pt; 7631b09c13cSSteffen Eiden union crste *crstep; 7641b09c13cSSteffen Eiden union pte *ptep; 7651b09c13cSSteffen Eiden int rc; 7661b09c13cSSteffen Eiden 7671b09c13cSSteffen Eiden if (force_alloc) 7681b09c13cSSteffen Eiden rc = dat_entry_walk(mc, p_gfn, gmap->parent->asce, DAT_WALK_ALLOC, 7691b09c13cSSteffen Eiden TABLE_TYPE_PAGE_TABLE, &crstep, &ptep); 7701b09c13cSSteffen Eiden else 7711b09c13cSSteffen Eiden rc = dat_entry_walk(mc, p_gfn, gmap->parent->asce, DAT_WALK_ALLOC_CONTINUE, 7721b09c13cSSteffen Eiden TABLE_TYPE_SEGMENT, &crstep, &ptep); 7731b09c13cSSteffen Eiden if (rc) 7741b09c13cSSteffen Eiden return rc; 7751b09c13cSSteffen Eiden if (!ptep) { 7761b09c13cSSteffen Eiden newcrste = _crste_fc0(p_gfn, TABLE_TYPE_SEGMENT); 7771b09c13cSSteffen Eiden newcrste.h.i = 1; 7781b09c13cSSteffen Eiden newcrste.h.fc0.tl = 1; 7791b09c13cSSteffen Eiden } else { 7801b09c13cSSteffen Eiden pt = pte_table_start(ptep); 7811b09c13cSSteffen Eiden dat_set_ptval(pt, PTVAL_VMADDR, p_gfn >> (_SEGMENT_SHIFT - PAGE_SHIFT)); 7821b09c13cSSteffen Eiden newcrste = _crste_fc0(virt_to_pfn(pt), TABLE_TYPE_SEGMENT); 7831b09c13cSSteffen Eiden } 7841b09c13cSSteffen Eiden rc = dat_entry_walk(mc, c_gfn, gmap->asce, DAT_WALK_ALLOC, TABLE_TYPE_SEGMENT, 7851b09c13cSSteffen Eiden &crstep, &ptep); 7861b09c13cSSteffen Eiden if (rc) 7871b09c13cSSteffen Eiden return rc; 7881b09c13cSSteffen Eiden do { 7891b09c13cSSteffen Eiden oldcrste = READ_ONCE(*crstep); 7901b09c13cSSteffen Eiden if (oldcrste.val == newcrste.val) 7911b09c13cSSteffen Eiden break; 7921b09c13cSSteffen Eiden } while (!dat_crstep_xchg_atomic(crstep, oldcrste, newcrste, c_gfn, gmap->asce)); 7931b09c13cSSteffen Eiden return 0; 7941b09c13cSSteffen Eiden } 7951b09c13cSSteffen Eiden 7961b09c13cSSteffen Eiden static int gmap_ucas_translate_simple(struct gmap *gmap, gpa_t *gaddr, union crste **crstepp) 7971b09c13cSSteffen Eiden { 7981b09c13cSSteffen Eiden union pte *ptep; 7991b09c13cSSteffen Eiden int rc; 8001b09c13cSSteffen Eiden 8011b09c13cSSteffen Eiden rc = dat_entry_walk(NULL, gpa_to_gfn(*gaddr), gmap->asce, DAT_WALK_CONTINUE, 8021b09c13cSSteffen Eiden TABLE_TYPE_SEGMENT, crstepp, &ptep); 8031b09c13cSSteffen Eiden if (rc || (!ptep && !crste_is_ucas(**crstepp))) 8041b09c13cSSteffen Eiden return -EREMOTE; 8051b09c13cSSteffen Eiden if (!ptep) 8061b09c13cSSteffen Eiden return 1; 8071b09c13cSSteffen Eiden *gaddr &= ~_SEGMENT_MASK; 8081b09c13cSSteffen Eiden *gaddr |= dat_get_ptval(pte_table_start(ptep), PTVAL_VMADDR) << _SEGMENT_SHIFT; 8091b09c13cSSteffen Eiden return 0; 8101b09c13cSSteffen Eiden } 8111b09c13cSSteffen Eiden 8121b09c13cSSteffen Eiden /** 8131b09c13cSSteffen Eiden * gmap_ucas_translate() - Translate a vcpu address into a host gmap address 8141b09c13cSSteffen Eiden * @mc: The memory cache to be used for allocations. 8151b09c13cSSteffen Eiden * @gmap: The per-cpu gmap. 8161b09c13cSSteffen Eiden * @gaddr: Pointer to the address to be translated, will get overwritten with 8171b09c13cSSteffen Eiden * the translated address in case of success. 8181b09c13cSSteffen Eiden * Translates the per-vCPU guest address into a fake guest address, which can 8191b09c13cSSteffen Eiden * then be used with the fake memslots that are identity mapping userspace. 8201b09c13cSSteffen Eiden * This allows ucontrol VMs to use the normal fault resolution path, like 8211b09c13cSSteffen Eiden * normal VMs. 8221b09c13cSSteffen Eiden * 8231b09c13cSSteffen Eiden * Return: %0 in case of success, otherwise %-EREMOTE. 8241b09c13cSSteffen Eiden */ 8251b09c13cSSteffen Eiden int gmap_ucas_translate(struct kvm_s390_mmu_cache *mc, struct gmap *gmap, gpa_t *gaddr) 8261b09c13cSSteffen Eiden { 8271b09c13cSSteffen Eiden gpa_t translated_address; 8281b09c13cSSteffen Eiden union crste *crstep; 8291b09c13cSSteffen Eiden gfn_t gfn; 8301b09c13cSSteffen Eiden int rc; 8311b09c13cSSteffen Eiden 8321b09c13cSSteffen Eiden gfn = gpa_to_gfn(*gaddr); 8331b09c13cSSteffen Eiden 8341b09c13cSSteffen Eiden scoped_guard(read_lock, &gmap->kvm->mmu_lock) { 8351b09c13cSSteffen Eiden rc = gmap_ucas_translate_simple(gmap, gaddr, &crstep); 8361b09c13cSSteffen Eiden if (rc <= 0) 8371b09c13cSSteffen Eiden return rc; 8381b09c13cSSteffen Eiden } 8391b09c13cSSteffen Eiden do { 8401b09c13cSSteffen Eiden scoped_guard(write_lock, &gmap->kvm->mmu_lock) { 8411b09c13cSSteffen Eiden rc = gmap_ucas_translate_simple(gmap, gaddr, &crstep); 8421b09c13cSSteffen Eiden if (rc <= 0) 8431b09c13cSSteffen Eiden return rc; 8441b09c13cSSteffen Eiden translated_address = (*gaddr & ~_SEGMENT_MASK) | 8451b09c13cSSteffen Eiden (crstep->val & _SEGMENT_MASK); 8461b09c13cSSteffen Eiden rc = gmap_ucas_map_one(mc, gmap, gpa_to_gfn(translated_address), gfn, true); 8471b09c13cSSteffen Eiden } 8481b09c13cSSteffen Eiden if (!rc) { 8491b09c13cSSteffen Eiden *gaddr = translated_address; 8501b09c13cSSteffen Eiden return 0; 8511b09c13cSSteffen Eiden } 8521b09c13cSSteffen Eiden if (rc != -ENOMEM) 8531b09c13cSSteffen Eiden return -EREMOTE; 8541b09c13cSSteffen Eiden rc = kvm_s390_mmu_cache_topup(mc); 8551b09c13cSSteffen Eiden if (rc) 8561b09c13cSSteffen Eiden return rc; 8571b09c13cSSteffen Eiden } while (1); 8581b09c13cSSteffen Eiden return 0; 8591b09c13cSSteffen Eiden } 8601b09c13cSSteffen Eiden 8611b09c13cSSteffen Eiden int gmap_ucas_map(struct gmap *gmap, gfn_t p_gfn, gfn_t c_gfn, unsigned long count) 8621b09c13cSSteffen Eiden { 8631b09c13cSSteffen Eiden struct kvm_s390_mmu_cache *mc __free(kvm_s390_mmu_cache) = NULL; 8641b09c13cSSteffen Eiden int rc = 0; 8651b09c13cSSteffen Eiden 8661b09c13cSSteffen Eiden mc = kvm_s390_new_mmu_cache(); 8671b09c13cSSteffen Eiden if (!mc) 8681b09c13cSSteffen Eiden return -ENOMEM; 8691b09c13cSSteffen Eiden 8701b09c13cSSteffen Eiden while (count) { 8711b09c13cSSteffen Eiden scoped_guard(write_lock, &gmap->kvm->mmu_lock) 8721b09c13cSSteffen Eiden rc = gmap_ucas_map_one(mc, gmap, p_gfn, c_gfn, false); 8731b09c13cSSteffen Eiden if (rc == -ENOMEM) { 8741b09c13cSSteffen Eiden rc = kvm_s390_mmu_cache_topup(mc); 8751b09c13cSSteffen Eiden if (rc) 8761b09c13cSSteffen Eiden return rc; 8771b09c13cSSteffen Eiden continue; 8781b09c13cSSteffen Eiden } 8791b09c13cSSteffen Eiden if (rc) 8801b09c13cSSteffen Eiden return rc; 8811b09c13cSSteffen Eiden 8821b09c13cSSteffen Eiden count--; 8831b09c13cSSteffen Eiden c_gfn += _PAGE_ENTRIES; 8841b09c13cSSteffen Eiden p_gfn += _PAGE_ENTRIES; 8851b09c13cSSteffen Eiden } 8861b09c13cSSteffen Eiden return rc; 8871b09c13cSSteffen Eiden } 8881b09c13cSSteffen Eiden 8891b09c13cSSteffen Eiden static void gmap_ucas_unmap_one(struct gmap *gmap, gfn_t c_gfn) 8901b09c13cSSteffen Eiden { 8911b09c13cSSteffen Eiden union crste *crstep; 8921b09c13cSSteffen Eiden union pte *ptep; 8931b09c13cSSteffen Eiden int rc; 8941b09c13cSSteffen Eiden 8951b09c13cSSteffen Eiden rc = dat_entry_walk(NULL, c_gfn, gmap->asce, 0, TABLE_TYPE_SEGMENT, &crstep, &ptep); 8961b09c13cSSteffen Eiden if (rc) 8971b09c13cSSteffen Eiden return; 8981b09c13cSSteffen Eiden while (!dat_crstep_xchg_atomic(crstep, READ_ONCE(*crstep), _PMD_EMPTY, c_gfn, gmap->asce)) 8991b09c13cSSteffen Eiden ; 9001b09c13cSSteffen Eiden } 9011b09c13cSSteffen Eiden 9021b09c13cSSteffen Eiden void gmap_ucas_unmap(struct gmap *gmap, gfn_t c_gfn, unsigned long count) 9031b09c13cSSteffen Eiden { 9041b09c13cSSteffen Eiden guard(read_lock)(&gmap->kvm->mmu_lock); 9051b09c13cSSteffen Eiden 9061b09c13cSSteffen Eiden for ( ; count; count--, c_gfn += _PAGE_ENTRIES) 9071b09c13cSSteffen Eiden gmap_ucas_unmap_one(gmap, c_gfn); 9081b09c13cSSteffen Eiden } 9091b09c13cSSteffen Eiden 9101b09c13cSSteffen Eiden static long _gmap_split_crste(union crste *crstep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 9111b09c13cSSteffen Eiden { 9121b09c13cSSteffen Eiden struct gmap *gmap = walk->priv; 9131b09c13cSSteffen Eiden union crste crste, newcrste; 9141b09c13cSSteffen Eiden 9151b09c13cSSteffen Eiden crste = READ_ONCE(*crstep); 9161b09c13cSSteffen Eiden newcrste = _CRSTE_EMPTY(crste.h.tt); 9171b09c13cSSteffen Eiden 9181b09c13cSSteffen Eiden while (crste_leaf(crste)) { 9191b09c13cSSteffen Eiden if (crste_prefix(crste)) 9201b09c13cSSteffen Eiden gmap_unmap_prefix(gmap, gfn, next); 9211b09c13cSSteffen Eiden if (crste.s.fc1.vsie_notif) 9221b09c13cSSteffen Eiden gmap_handle_vsie_unshadow_event(gmap, gfn); 9231b09c13cSSteffen Eiden if (dat_crstep_xchg_atomic(crstep, crste, newcrste, gfn, walk->asce)) 9241b09c13cSSteffen Eiden break; 9251b09c13cSSteffen Eiden crste = READ_ONCE(*crstep); 9261b09c13cSSteffen Eiden } 9271b09c13cSSteffen Eiden 9281b09c13cSSteffen Eiden if (need_resched()) 9291b09c13cSSteffen Eiden return next; 9301b09c13cSSteffen Eiden 9311b09c13cSSteffen Eiden return 0; 9321b09c13cSSteffen Eiden } 9331b09c13cSSteffen Eiden 9341b09c13cSSteffen Eiden void gmap_split_huge_pages(struct gmap *gmap) 9351b09c13cSSteffen Eiden { 9361b09c13cSSteffen Eiden const struct dat_walk_ops ops = { 9371b09c13cSSteffen Eiden .pmd_entry = _gmap_split_crste, 9381b09c13cSSteffen Eiden .pud_entry = _gmap_split_crste, 9391b09c13cSSteffen Eiden }; 9401b09c13cSSteffen Eiden gfn_t start = 0; 9411b09c13cSSteffen Eiden 9421b09c13cSSteffen Eiden do { 9431b09c13cSSteffen Eiden scoped_guard(read_lock, &gmap->kvm->mmu_lock) 9441b09c13cSSteffen Eiden start = _dat_walk_gfn_range(start, asce_end(gmap->asce), gmap->asce, 9451b09c13cSSteffen Eiden &ops, DAT_WALK_IGN_HOLES, gmap); 9461b09c13cSSteffen Eiden } while (start); 9471b09c13cSSteffen Eiden } 9481b09c13cSSteffen Eiden 949a07276d5SSteffen Eiden #if KVM_S390_MANAGES_S390_GUEST 950a07276d5SSteffen Eiden 9511b09c13cSSteffen Eiden static int _gmap_enable_skeys(struct gmap *gmap) 9521b09c13cSSteffen Eiden { 9531b09c13cSSteffen Eiden gfn_t start = 0; 9541b09c13cSSteffen Eiden int rc; 9551b09c13cSSteffen Eiden 9561b09c13cSSteffen Eiden if (uses_skeys(gmap)) 9571b09c13cSSteffen Eiden return 0; 9581b09c13cSSteffen Eiden 9591b09c13cSSteffen Eiden set_bit(GMAP_FLAG_USES_SKEYS, &gmap->flags); 9601b09c13cSSteffen Eiden rc = gmap_helper_disable_cow_sharing(); 9611b09c13cSSteffen Eiden if (rc) { 9621b09c13cSSteffen Eiden clear_bit(GMAP_FLAG_USES_SKEYS, &gmap->flags); 9631b09c13cSSteffen Eiden return rc; 9641b09c13cSSteffen Eiden } 9651b09c13cSSteffen Eiden 9661b09c13cSSteffen Eiden do { 9671b09c13cSSteffen Eiden scoped_guard(write_lock, &gmap->kvm->mmu_lock) 9681b09c13cSSteffen Eiden start = dat_reset_skeys(gmap->asce, start); 9691b09c13cSSteffen Eiden } while (start); 9701b09c13cSSteffen Eiden return 0; 9711b09c13cSSteffen Eiden } 9721b09c13cSSteffen Eiden 9731b09c13cSSteffen Eiden int gmap_enable_skeys(struct gmap *gmap) 9741b09c13cSSteffen Eiden { 9751b09c13cSSteffen Eiden int rc; 9761b09c13cSSteffen Eiden 9771b09c13cSSteffen Eiden mmap_write_lock(gmap->kvm->mm); 9781b09c13cSSteffen Eiden rc = _gmap_enable_skeys(gmap); 9791b09c13cSSteffen Eiden mmap_write_unlock(gmap->kvm->mm); 9801b09c13cSSteffen Eiden return rc; 9811b09c13cSSteffen Eiden } 982a07276d5SSteffen Eiden #endif /* KVM_S390_MANAGES_S390_GUEST */ 9831b09c13cSSteffen Eiden 9841b09c13cSSteffen Eiden static long _destroy_pages_pte(union pte *ptep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 9851b09c13cSSteffen Eiden { 9861b09c13cSSteffen Eiden if (!ptep->s.pr) 9871b09c13cSSteffen Eiden return 0; 9881b09c13cSSteffen Eiden __kvm_s390_pv_destroy_page(phys_to_page(pte_origin(*ptep))); 9891b09c13cSSteffen Eiden if (need_resched()) 9901b09c13cSSteffen Eiden return next; 9911b09c13cSSteffen Eiden return 0; 9921b09c13cSSteffen Eiden } 9931b09c13cSSteffen Eiden 9941b09c13cSSteffen Eiden static long _destroy_pages_crste(union crste *crstep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 9951b09c13cSSteffen Eiden { 9961b09c13cSSteffen Eiden phys_addr_t origin, cur, end; 9971b09c13cSSteffen Eiden 9981b09c13cSSteffen Eiden if (!crstep->h.fc || !crstep->s.fc1.pr) 9991b09c13cSSteffen Eiden return 0; 10001b09c13cSSteffen Eiden 10011b09c13cSSteffen Eiden origin = crste_origin_large(*crstep); 10021b09c13cSSteffen Eiden cur = ((max(gfn, walk->start) - gfn) << PAGE_SHIFT) + origin; 10031b09c13cSSteffen Eiden end = ((min(next, walk->end) - gfn) << PAGE_SHIFT) + origin; 10041b09c13cSSteffen Eiden for ( ; cur < end; cur += PAGE_SIZE) 10051b09c13cSSteffen Eiden __kvm_s390_pv_destroy_page(phys_to_page(cur)); 10061b09c13cSSteffen Eiden if (need_resched()) 10071b09c13cSSteffen Eiden return next; 10081b09c13cSSteffen Eiden return 0; 10091b09c13cSSteffen Eiden } 10101b09c13cSSteffen Eiden 10111b09c13cSSteffen Eiden int gmap_pv_destroy_range(struct gmap *gmap, gfn_t start, gfn_t end, bool interruptible) 10121b09c13cSSteffen Eiden { 10131b09c13cSSteffen Eiden const struct dat_walk_ops ops = { 10141b09c13cSSteffen Eiden .pte_entry = _destroy_pages_pte, 10151b09c13cSSteffen Eiden .pmd_entry = _destroy_pages_crste, 10161b09c13cSSteffen Eiden .pud_entry = _destroy_pages_crste, 10171b09c13cSSteffen Eiden }; 10181b09c13cSSteffen Eiden 10191b09c13cSSteffen Eiden do { 10201b09c13cSSteffen Eiden scoped_guard(read_lock, &gmap->kvm->mmu_lock) 10211b09c13cSSteffen Eiden start = _dat_walk_gfn_range(start, end, gmap->asce, &ops, 10221b09c13cSSteffen Eiden DAT_WALK_IGN_HOLES, NULL); 10231b09c13cSSteffen Eiden if (interruptible && fatal_signal_pending(current)) 10241b09c13cSSteffen Eiden return -EINTR; 10251b09c13cSSteffen Eiden } while (start && start < end); 10261b09c13cSSteffen Eiden return 0; 10271b09c13cSSteffen Eiden } 10281b09c13cSSteffen Eiden 10291b09c13cSSteffen Eiden int gmap_insert_rmap(struct kvm_s390_mmu_cache *mc, struct gmap *sg, gfn_t p_gfn, 10301b09c13cSSteffen Eiden gfn_t r_gfn, int level) 10311b09c13cSSteffen Eiden { 10321b09c13cSSteffen Eiden struct vsie_rmap *rmap __free(kvfree) = NULL; 10331b09c13cSSteffen Eiden struct vsie_rmap *temp; 10341b09c13cSSteffen Eiden void __rcu **slot; 10351b09c13cSSteffen Eiden int rc = 0; 10361b09c13cSSteffen Eiden 10371b09c13cSSteffen Eiden KVM_BUG_ON(!is_shadow(sg), sg->kvm); 10381b09c13cSSteffen Eiden lockdep_assert_held(&sg->host_to_rmap_lock); 10391b09c13cSSteffen Eiden 10401b09c13cSSteffen Eiden rmap = kvm_s390_mmu_cache_alloc_rmap(mc); 10411b09c13cSSteffen Eiden if (!rmap) 10421b09c13cSSteffen Eiden return -ENOMEM; 10431b09c13cSSteffen Eiden 10441b09c13cSSteffen Eiden rmap->r_gfn = r_gfn; 10451b09c13cSSteffen Eiden rmap->level = level; 10461b09c13cSSteffen Eiden slot = radix_tree_lookup_slot(&sg->host_to_rmap, p_gfn); 10471b09c13cSSteffen Eiden if (slot) { 10481b09c13cSSteffen Eiden rmap->next = radix_tree_deref_slot_protected(slot, &sg->host_to_rmap_lock); 10491b09c13cSSteffen Eiden for (temp = rmap->next; temp; temp = temp->next) { 10501b09c13cSSteffen Eiden if (temp->val == rmap->val) 10511b09c13cSSteffen Eiden return 0; 10521b09c13cSSteffen Eiden } 10531b09c13cSSteffen Eiden radix_tree_replace_slot(&sg->host_to_rmap, slot, rmap); 10541b09c13cSSteffen Eiden } else { 10551b09c13cSSteffen Eiden rmap->next = NULL; 10561b09c13cSSteffen Eiden rc = radix_tree_insert(&sg->host_to_rmap, p_gfn, rmap); 10571b09c13cSSteffen Eiden if (rc) 10581b09c13cSSteffen Eiden return rc; 10591b09c13cSSteffen Eiden } 10601b09c13cSSteffen Eiden rmap = NULL; 10611b09c13cSSteffen Eiden 10621b09c13cSSteffen Eiden return 0; 10631b09c13cSSteffen Eiden } 10641b09c13cSSteffen Eiden 10651b09c13cSSteffen Eiden int gmap_protect_rmap(struct kvm_s390_mmu_cache *mc, struct gmap *sg, gfn_t p_gfn, gfn_t r_gfn, 10661b09c13cSSteffen Eiden kvm_pfn_t pfn, int level, bool wr) 10671b09c13cSSteffen Eiden { 10681b09c13cSSteffen Eiden unsigned long bitmask; 10691b09c13cSSteffen Eiden union crste *crstep; 10701b09c13cSSteffen Eiden union pgste pgste; 10711b09c13cSSteffen Eiden union pte *ptep; 10721b09c13cSSteffen Eiden union pte pte; 10731b09c13cSSteffen Eiden int flags, rc; 10741b09c13cSSteffen Eiden 10751b09c13cSSteffen Eiden if (KVM_BUG_ON(!is_shadow(sg) || level <= TABLE_TYPE_PAGE_TABLE, sg->kvm)) 10761b09c13cSSteffen Eiden return -EINVAL; 10771b09c13cSSteffen Eiden lockdep_assert_held(&sg->parent->children_lock); 10781b09c13cSSteffen Eiden 10791b09c13cSSteffen Eiden flags = DAT_WALK_SPLIT_ALLOC | (uses_skeys(sg->parent) ? DAT_WALK_USES_SKEYS : 0); 10801b09c13cSSteffen Eiden rc = dat_entry_walk(mc, p_gfn, sg->parent->asce, flags, 10811b09c13cSSteffen Eiden TABLE_TYPE_PAGE_TABLE, &crstep, &ptep); 10821b09c13cSSteffen Eiden if (rc) 10831b09c13cSSteffen Eiden return rc; 10841b09c13cSSteffen Eiden if (level <= TABLE_TYPE_REGION1) { 10851b09c13cSSteffen Eiden bitmask = -1UL << (8 + 11 * level); 10861b09c13cSSteffen Eiden scoped_guard(spinlock, &sg->host_to_rmap_lock) 10871b09c13cSSteffen Eiden rc = gmap_insert_rmap(mc, sg, p_gfn, r_gfn & bitmask, level); 10881b09c13cSSteffen Eiden } 10891b09c13cSSteffen Eiden if (rc) 10901b09c13cSSteffen Eiden return rc; 10911b09c13cSSteffen Eiden 10921b09c13cSSteffen Eiden if (!pgste_get_trylock(ptep, &pgste)) 10931b09c13cSSteffen Eiden return -EAGAIN; 10941b09c13cSSteffen Eiden pte = ptep->s.pr ? *ptep : _pte(pfn, wr, false, false); 10951b09c13cSSteffen Eiden pte.h.p = 1; 10961b09c13cSSteffen Eiden pgste = _gmap_ptep_xchg(sg->parent, ptep, pte, pgste, p_gfn, false); 10971b09c13cSSteffen Eiden pgste.vsie_notif = 1; 10981b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 10991b09c13cSSteffen Eiden 11001b09c13cSSteffen Eiden return 0; 11011b09c13cSSteffen Eiden } 11021b09c13cSSteffen Eiden 1103ce4bee6aSSteffen Eiden #if KVM_S390_MANAGES_S390_GUEST 11041b09c13cSSteffen Eiden static long __set_cmma_clean_pte(union pte *ptep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 11051b09c13cSSteffen Eiden { 11061b09c13cSSteffen Eiden union pgste pgste; 11071b09c13cSSteffen Eiden 11081b09c13cSSteffen Eiden pgste = pgste_get_lock(ptep); 11091b09c13cSSteffen Eiden pgste.cmma_d = 0; 11101b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 11111b09c13cSSteffen Eiden 11121b09c13cSSteffen Eiden if (need_resched()) 11131b09c13cSSteffen Eiden return next; 11141b09c13cSSteffen Eiden return 0; 11151b09c13cSSteffen Eiden } 11161b09c13cSSteffen Eiden 11171b09c13cSSteffen Eiden static long __set_cmma_dirty_pte(union pte *ptep, gfn_t gfn, gfn_t next, struct dat_walk *walk) 11181b09c13cSSteffen Eiden { 11191b09c13cSSteffen Eiden union pgste pgste; 11201b09c13cSSteffen Eiden 11211b09c13cSSteffen Eiden pgste = pgste_get_lock(ptep); 11221b09c13cSSteffen Eiden if (!pgste.cmma_d) 11231b09c13cSSteffen Eiden atomic64_inc(walk->priv); 11241b09c13cSSteffen Eiden pgste.cmma_d = 1; 11251b09c13cSSteffen Eiden pgste_set_unlock(ptep, pgste); 11261b09c13cSSteffen Eiden 11271b09c13cSSteffen Eiden if (need_resched()) 11281b09c13cSSteffen Eiden return next; 11291b09c13cSSteffen Eiden return 0; 11301b09c13cSSteffen Eiden } 11311b09c13cSSteffen Eiden 11321b09c13cSSteffen Eiden void _gmap_set_cmma_all(struct gmap *gmap, bool dirty) 11331b09c13cSSteffen Eiden { 11341b09c13cSSteffen Eiden const struct dat_walk_ops ops = { 11351b09c13cSSteffen Eiden .pte_entry = dirty ? __set_cmma_dirty_pte : __set_cmma_clean_pte, 11361b09c13cSSteffen Eiden }; 11371b09c13cSSteffen Eiden gfn_t gfn = 0; 11381b09c13cSSteffen Eiden 11391b09c13cSSteffen Eiden do { 11401b09c13cSSteffen Eiden scoped_guard(read_lock, &gmap->kvm->mmu_lock) 11411b09c13cSSteffen Eiden gfn = _dat_walk_gfn_range(gfn, asce_end(gmap->asce), gmap->asce, &ops, 11421b09c13cSSteffen Eiden DAT_WALK_IGN_HOLES, 11431b09c13cSSteffen Eiden &gmap->kvm->arch.cmma_dirty_pages); 11441b09c13cSSteffen Eiden } while (gfn); 11451b09c13cSSteffen Eiden } 1146ce4bee6aSSteffen Eiden #endif /* KVM_S390_MANAGES_S390_GUEST */ 11471b09c13cSSteffen Eiden 11481b09c13cSSteffen Eiden static void gmap_unshadow_level(struct gmap *sg, gfn_t r_gfn, int level) 11491b09c13cSSteffen Eiden { 11501b09c13cSSteffen Eiden unsigned long align = PAGE_SIZE; 11511b09c13cSSteffen Eiden gpa_t gaddr = gfn_to_gpa(r_gfn); 11521b09c13cSSteffen Eiden union crste *crstep; 11531b09c13cSSteffen Eiden union crste crste; 11541b09c13cSSteffen Eiden union pte *ptep; 11551b09c13cSSteffen Eiden 11561b09c13cSSteffen Eiden if (level > TABLE_TYPE_PAGE_TABLE) 11571b09c13cSSteffen Eiden align = 1UL << (11 * level + _SEGMENT_SHIFT); 11581b09c13cSSteffen Eiden kvm_s390_vsie_gmap_notifier(sg, ALIGN_DOWN(gaddr, align), ALIGN(gaddr + 1, align)); 11591b09c13cSSteffen Eiden sg->invalidated = true; 11601b09c13cSSteffen Eiden if (dat_entry_walk(NULL, r_gfn, sg->asce, 0, level, &crstep, &ptep)) 11611b09c13cSSteffen Eiden return; 11621b09c13cSSteffen Eiden if (ptep) { 11631b09c13cSSteffen Eiden if (READ_ONCE(*ptep).val != _PTE_EMPTY.val) 11641b09c13cSSteffen Eiden dat_ptep_xchg(ptep, _PTE_EMPTY, r_gfn, sg->asce, uses_skeys(sg)); 11651b09c13cSSteffen Eiden return; 11661b09c13cSSteffen Eiden } 11671b09c13cSSteffen Eiden 11681b09c13cSSteffen Eiden crste = dat_crstep_clear_atomic(crstep, r_gfn, sg->asce); 11691b09c13cSSteffen Eiden if (crste_leaf(crste) || crste.h.i) 11701b09c13cSSteffen Eiden return; 11711b09c13cSSteffen Eiden if (is_pmd(crste)) 11721b09c13cSSteffen Eiden dat_free_pt(dereference_pmd(crste.pmd)); 11731b09c13cSSteffen Eiden else 11741b09c13cSSteffen Eiden dat_free_level(dereference_crste(crste), true); 11751b09c13cSSteffen Eiden } 11761b09c13cSSteffen Eiden 11771b09c13cSSteffen Eiden static void gmap_unshadow(struct gmap *sg) 11781b09c13cSSteffen Eiden { 11791b09c13cSSteffen Eiden struct gmap_cache *gmap_cache, *next; 11801b09c13cSSteffen Eiden 11811b09c13cSSteffen Eiden KVM_BUG_ON(!is_shadow(sg), sg->kvm); 11821b09c13cSSteffen Eiden KVM_BUG_ON(!sg->parent, sg->kvm); 11831b09c13cSSteffen Eiden 11841b09c13cSSteffen Eiden lockdep_assert_held(&sg->parent->children_lock); 11851b09c13cSSteffen Eiden 11861b09c13cSSteffen Eiden gmap_remove_child(sg); 11871b09c13cSSteffen Eiden kvm_s390_vsie_gmap_notifier(sg, 0, -1UL); 11881b09c13cSSteffen Eiden 11891b09c13cSSteffen Eiden list_for_each_entry_safe(gmap_cache, next, &sg->scb_users, list) { 11901b09c13cSSteffen Eiden gmap_cache->gmap = NULL; 11911b09c13cSSteffen Eiden list_del(&gmap_cache->list); 11921b09c13cSSteffen Eiden } 11931b09c13cSSteffen Eiden 11941b09c13cSSteffen Eiden gmap_put(sg); 11951b09c13cSSteffen Eiden } 11961b09c13cSSteffen Eiden 11971b09c13cSSteffen Eiden void _gmap_handle_vsie_unshadow_event(struct gmap *parent, gfn_t gfn) 11981b09c13cSSteffen Eiden { 11991b09c13cSSteffen Eiden struct vsie_rmap *rmap, *rnext, *head; 12001b09c13cSSteffen Eiden struct gmap *sg, *next; 12011b09c13cSSteffen Eiden gfn_t start, end; 12021b09c13cSSteffen Eiden 12031b09c13cSSteffen Eiden list_for_each_entry_safe(sg, next, &parent->children, list) { 12041b09c13cSSteffen Eiden start = sg->guest_asce.rsto; 12051b09c13cSSteffen Eiden end = start + sg->guest_asce.tl + 1; 12061b09c13cSSteffen Eiden if (!sg->guest_asce.r && gfn >= start && gfn < end) { 12071b09c13cSSteffen Eiden gmap_unshadow(sg); 12081b09c13cSSteffen Eiden continue; 12091b09c13cSSteffen Eiden } 12101b09c13cSSteffen Eiden scoped_guard(spinlock, &sg->host_to_rmap_lock) 12111b09c13cSSteffen Eiden head = radix_tree_delete(&sg->host_to_rmap, gfn); 12121b09c13cSSteffen Eiden gmap_for_each_rmap_safe(rmap, rnext, head) { 12131b09c13cSSteffen Eiden gmap_unshadow_level(sg, rmap->r_gfn, rmap->level); 12141b09c13cSSteffen Eiden kfree(rmap); 12151b09c13cSSteffen Eiden } 12161b09c13cSSteffen Eiden } 12171b09c13cSSteffen Eiden } 12181b09c13cSSteffen Eiden 12191b09c13cSSteffen Eiden /** 12201b09c13cSSteffen Eiden * gmap_find_shadow() - Find a specific ASCE in the list of shadow tables. 12211b09c13cSSteffen Eiden * @parent: Pointer to the parent gmap. 12221b09c13cSSteffen Eiden * @asce: ASCE for which the shadow table is created. 12231b09c13cSSteffen Eiden * @edat_level: Edat level to be used for the shadow translation. 12241b09c13cSSteffen Eiden * 12251b09c13cSSteffen Eiden * Context: Called with parent->children_lock held. 12261b09c13cSSteffen Eiden * 12271b09c13cSSteffen Eiden * Return: The pointer to a gmap if a shadow table with the given asce is 12281b09c13cSSteffen Eiden * already available, ERR_PTR(-EAGAIN) if another one is just being created, 12291b09c13cSSteffen Eiden * otherwise NULL. 12301b09c13cSSteffen Eiden */ 12311b09c13cSSteffen Eiden static struct gmap *gmap_find_shadow(struct gmap *parent, union asce asce, int edat_level) 12321b09c13cSSteffen Eiden { 12331b09c13cSSteffen Eiden struct gmap *sg; 12341b09c13cSSteffen Eiden 12351b09c13cSSteffen Eiden lockdep_assert_held(&parent->children_lock); 12361b09c13cSSteffen Eiden list_for_each_entry(sg, &parent->children, list) { 12371b09c13cSSteffen Eiden if (!gmap_is_shadow_valid(sg, asce, edat_level)) 12381b09c13cSSteffen Eiden continue; 12391b09c13cSSteffen Eiden return sg; 12401b09c13cSSteffen Eiden } 12411b09c13cSSteffen Eiden return NULL; 12421b09c13cSSteffen Eiden } 12431b09c13cSSteffen Eiden 12441b09c13cSSteffen Eiden #define CRST_TABLE_PAGES (_CRST_TABLE_SIZE / PAGE_SIZE) 12451b09c13cSSteffen Eiden struct gmap_protect_asce_top_level { 12461b09c13cSSteffen Eiden unsigned long seq; 12471b09c13cSSteffen Eiden struct guest_fault f[CRST_TABLE_PAGES]; 12481b09c13cSSteffen Eiden }; 12491b09c13cSSteffen Eiden 12501b09c13cSSteffen Eiden static inline int __gmap_protect_asce_top_level(struct kvm_s390_mmu_cache *mc, struct gmap *sg, 12511b09c13cSSteffen Eiden struct gmap_protect_asce_top_level *context) 12521b09c13cSSteffen Eiden { 12531b09c13cSSteffen Eiden struct gmap *parent; 12541b09c13cSSteffen Eiden int rc, i; 12551b09c13cSSteffen Eiden 12561b09c13cSSteffen Eiden guard(write_lock)(&sg->kvm->mmu_lock); 12571b09c13cSSteffen Eiden 12581b09c13cSSteffen Eiden if (kvm_s390_array_needs_retry_safe(sg->kvm, context->seq, context->f)) 12591b09c13cSSteffen Eiden return -EAGAIN; 12601b09c13cSSteffen Eiden 12611b09c13cSSteffen Eiden parent = READ_ONCE(sg->parent); 12621b09c13cSSteffen Eiden if (!parent) 12631b09c13cSSteffen Eiden return -EAGAIN; 12641b09c13cSSteffen Eiden scoped_guard(spinlock, &parent->children_lock) { 12651b09c13cSSteffen Eiden if (READ_ONCE(sg->parent) != parent) 12661b09c13cSSteffen Eiden return -EAGAIN; 12671b09c13cSSteffen Eiden sg->invalidated = false; 12681b09c13cSSteffen Eiden for (i = 0; i < CRST_TABLE_PAGES; i++) { 12691b09c13cSSteffen Eiden if (!context->f[i].valid) 12701b09c13cSSteffen Eiden continue; 12711b09c13cSSteffen Eiden rc = gmap_protect_rmap(mc, sg, context->f[i].gfn, 0, context->f[i].pfn, 12721b09c13cSSteffen Eiden TABLE_TYPE_REGION1 + 1, context->f[i].writable); 12731b09c13cSSteffen Eiden if (rc) 12741b09c13cSSteffen Eiden return rc; 12751b09c13cSSteffen Eiden } 12761b09c13cSSteffen Eiden gmap_add_child(sg->parent, sg); 12771b09c13cSSteffen Eiden } 12781b09c13cSSteffen Eiden 12791b09c13cSSteffen Eiden kvm_s390_release_faultin_array(sg->kvm, context->f, false); 12801b09c13cSSteffen Eiden return 0; 12811b09c13cSSteffen Eiden } 12821b09c13cSSteffen Eiden 12831b09c13cSSteffen Eiden static inline int _gmap_protect_asce_top_level(struct kvm_s390_mmu_cache *mc, struct gmap *sg, 12841b09c13cSSteffen Eiden struct gmap_protect_asce_top_level *context) 12851b09c13cSSteffen Eiden { 12861b09c13cSSteffen Eiden int rc; 12871b09c13cSSteffen Eiden 12881b09c13cSSteffen Eiden if (kvm_s390_array_needs_retry_unsafe(sg->kvm, context->seq, context->f)) 12891b09c13cSSteffen Eiden return -EAGAIN; 12901b09c13cSSteffen Eiden do { 12911b09c13cSSteffen Eiden rc = kvm_s390_mmu_cache_topup(mc); 12921b09c13cSSteffen Eiden if (rc) 12931b09c13cSSteffen Eiden return rc; 12941b09c13cSSteffen Eiden rc = radix_tree_preload(GFP_KERNEL); 12951b09c13cSSteffen Eiden if (rc) 12961b09c13cSSteffen Eiden return rc; 12971b09c13cSSteffen Eiden rc = __gmap_protect_asce_top_level(mc, sg, context); 12981b09c13cSSteffen Eiden radix_tree_preload_end(); 12991b09c13cSSteffen Eiden } while (rc == -ENOMEM); 13001b09c13cSSteffen Eiden 13011b09c13cSSteffen Eiden return rc; 13021b09c13cSSteffen Eiden } 13031b09c13cSSteffen Eiden 13041b09c13cSSteffen Eiden static int gmap_protect_asce_top_level(struct kvm_s390_mmu_cache *mc, struct gmap *sg) 13051b09c13cSSteffen Eiden { 13061b09c13cSSteffen Eiden struct gmap_protect_asce_top_level context = {}; 13071b09c13cSSteffen Eiden union asce asce = sg->guest_asce; 13081b09c13cSSteffen Eiden int rc; 13091b09c13cSSteffen Eiden 13101b09c13cSSteffen Eiden KVM_BUG_ON(!is_shadow(sg), sg->kvm); 13111b09c13cSSteffen Eiden 13121b09c13cSSteffen Eiden context.seq = sg->kvm->mmu_invalidate_seq; 13131b09c13cSSteffen Eiden /* Pairs with the smp_wmb() in kvm_mmu_invalidate_end(). */ 13141b09c13cSSteffen Eiden smp_rmb(); 13151b09c13cSSteffen Eiden 13161b09c13cSSteffen Eiden rc = kvm_s390_get_guest_pages(sg->kvm, context.f, asce.rsto, asce.tl + 1, false); 13171b09c13cSSteffen Eiden if (rc > 0) 13181b09c13cSSteffen Eiden rc = -EFAULT; 13191b09c13cSSteffen Eiden if (!rc) 13201b09c13cSSteffen Eiden rc = _gmap_protect_asce_top_level(mc, sg, &context); 13211b09c13cSSteffen Eiden if (rc) 13221b09c13cSSteffen Eiden kvm_s390_release_faultin_array(sg->kvm, context.f, true); 13231b09c13cSSteffen Eiden return rc; 13241b09c13cSSteffen Eiden } 13251b09c13cSSteffen Eiden 13261b09c13cSSteffen Eiden /** 13271b09c13cSSteffen Eiden * gmap_create_shadow() - Create/find a shadow guest address space. 13281b09c13cSSteffen Eiden * @mc: The cache to use to allocate dat tables. 13291b09c13cSSteffen Eiden * @parent: Pointer to the parent gmap. 13301b09c13cSSteffen Eiden * @asce: ASCE for which the shadow table is created. 13311b09c13cSSteffen Eiden * @edat_level: Edat level to be used for the shadow translation. 13321b09c13cSSteffen Eiden * 13331b09c13cSSteffen Eiden * The pages of the top level page table referred by the asce parameter 13341b09c13cSSteffen Eiden * will be set to read-only and marked in the PGSTEs of the kvm process. 13351b09c13cSSteffen Eiden * The shadow table will be removed automatically on any change to the 13361b09c13cSSteffen Eiden * PTE mapping for the source table. 13371b09c13cSSteffen Eiden * 13381b09c13cSSteffen Eiden * The returned shadow gmap will be returned with one extra reference. 13391b09c13cSSteffen Eiden * 13401b09c13cSSteffen Eiden * Return: A guest address space structure, ERR_PTR(-ENOMEM) if out of memory, 13411b09c13cSSteffen Eiden * ERR_PTR(-EAGAIN) if the caller has to retry and ERR_PTR(-EFAULT) if the 13421b09c13cSSteffen Eiden * parent gmap table could not be protected. 13431b09c13cSSteffen Eiden */ 13441b09c13cSSteffen Eiden struct gmap *gmap_create_shadow(struct kvm_s390_mmu_cache *mc, struct gmap *parent, 13451b09c13cSSteffen Eiden union asce asce, int edat_level) 13461b09c13cSSteffen Eiden { 13471b09c13cSSteffen Eiden struct gmap *sg, *new; 13481b09c13cSSteffen Eiden int rc; 13491b09c13cSSteffen Eiden 13501b09c13cSSteffen Eiden if (WARN_ON(!parent)) 13511b09c13cSSteffen Eiden return ERR_PTR(-EINVAL); 13521b09c13cSSteffen Eiden 13531b09c13cSSteffen Eiden scoped_guard(spinlock, &parent->children_lock) { 13541b09c13cSSteffen Eiden sg = gmap_find_shadow(parent, asce, edat_level); 13551b09c13cSSteffen Eiden if (sg) { 13561b09c13cSSteffen Eiden gmap_get(sg); 13571b09c13cSSteffen Eiden return sg; 13581b09c13cSSteffen Eiden } 13591b09c13cSSteffen Eiden } 13601b09c13cSSteffen Eiden /* Create a new shadow gmap. */ 13611b09c13cSSteffen Eiden new = gmap_new(parent->kvm, asce.r ? 1UL << (64 - PAGE_SHIFT) : asce_end(asce)); 13621b09c13cSSteffen Eiden if (!new) 13631b09c13cSSteffen Eiden return ERR_PTR(-ENOMEM); 13641b09c13cSSteffen Eiden new->guest_asce = asce; 13651b09c13cSSteffen Eiden new->edat_level = edat_level; 13661b09c13cSSteffen Eiden set_bit(GMAP_FLAG_SHADOW, &new->flags); 13671b09c13cSSteffen Eiden 13681b09c13cSSteffen Eiden scoped_guard(spinlock, &parent->children_lock) { 13691b09c13cSSteffen Eiden /* Recheck if another CPU created the same shadow. */ 13701b09c13cSSteffen Eiden sg = gmap_find_shadow(parent, asce, edat_level); 13711b09c13cSSteffen Eiden if (sg) { 13721b09c13cSSteffen Eiden gmap_put(new); 13731b09c13cSSteffen Eiden gmap_get(sg); 13741b09c13cSSteffen Eiden return sg; 13751b09c13cSSteffen Eiden } 13761b09c13cSSteffen Eiden if (asce.r) { 13771b09c13cSSteffen Eiden /* Only allow one real-space gmap shadow. */ 13781b09c13cSSteffen Eiden list_for_each_entry(sg, &parent->children, list) { 13791b09c13cSSteffen Eiden if (sg->guest_asce.r) { 13801b09c13cSSteffen Eiden if (write_trylock(&parent->kvm->mmu_lock)) { 13811b09c13cSSteffen Eiden gmap_unshadow(sg); 13821b09c13cSSteffen Eiden write_unlock(&parent->kvm->mmu_lock); 13831b09c13cSSteffen Eiden } else { 13841b09c13cSSteffen Eiden gmap_put(new); 13851b09c13cSSteffen Eiden return ERR_PTR(-EAGAIN); 13861b09c13cSSteffen Eiden } 13871b09c13cSSteffen Eiden break; 13881b09c13cSSteffen Eiden } 13891b09c13cSSteffen Eiden } 13901b09c13cSSteffen Eiden gmap_add_child(parent, new); 13911b09c13cSSteffen Eiden /* Nothing to protect, return right away. */ 13921b09c13cSSteffen Eiden gmap_get(new); 13931b09c13cSSteffen Eiden return new; 13941b09c13cSSteffen Eiden } 13951b09c13cSSteffen Eiden } 13961b09c13cSSteffen Eiden 13971b09c13cSSteffen Eiden gmap_get(new); 13981b09c13cSSteffen Eiden new->parent = parent; 13991b09c13cSSteffen Eiden /* Protect while inserting, protects against invalidation races. */ 14001b09c13cSSteffen Eiden rc = gmap_protect_asce_top_level(mc, new); 14011b09c13cSSteffen Eiden if (rc) { 14021b09c13cSSteffen Eiden new->parent = NULL; 14031b09c13cSSteffen Eiden gmap_put(new); 14041b09c13cSSteffen Eiden gmap_put(new); 14051b09c13cSSteffen Eiden return ERR_PTR(rc); 14061b09c13cSSteffen Eiden } 14071b09c13cSSteffen Eiden return new; 14081b09c13cSSteffen Eiden } 1409