Lines Matching +full:support +full:- +full:nesting
1 // SPDX-License-Identifier: GPL-2.0
3 * Performance events ring-buffer code:
6 * Copyright (C) 2008-2011 Red Hat, Inc., Ingo Molnar
7 * Copyright (C) 2008-2011 Red Hat, Inc., Peter Zijlstra
22 atomic_set(&handle->rb->poll, EPOLLIN | EPOLLRDNORM); in perf_output_wakeup()
24 handle->event->pending_wakeup = 1; in perf_output_wakeup()
26 if (*perf_event_fasync(handle->event) && !handle->event->pending_kill) in perf_output_wakeup()
27 handle->event->pending_kill = POLL_IN; in perf_output_wakeup()
29 irq_work_queue(&handle->event->pending_irq); in perf_output_wakeup()
37 * We only publish the head (and generate a wakeup) when the outer-most
42 struct perf_buffer *rb = handle->rb; in perf_output_get_handle()
50 (*(volatile unsigned int *)&rb->nest)++; in perf_output_get_handle()
51 handle->wakeup = local_read(&rb->wakeup); in perf_output_get_handle()
56 struct perf_buffer *rb = handle->rb; in perf_output_put_handle()
61 * If this isn't the outermost nesting, we don't have to update in perf_output_put_handle()
62 * @rb->user_page->data_head. in perf_output_put_handle()
64 nest = READ_ONCE(rb->nest); in perf_output_put_handle()
66 WRITE_ONCE(rb->nest, nest - 1); in perf_output_put_handle()
73 * we must ensure the load of @rb->head happens after we've in perf_output_put_handle()
74 * incremented @rb->nest. in perf_output_put_handle()
76 * Otherwise we can observe a @rb->head value before one published in perf_output_put_handle()
80 head = local_read(&rb->head); in perf_output_put_handle()
83 * IRQ/NMI can happen here and advance @rb->head, causing our in perf_output_put_handle()
92 * if (LOAD ->data_tail) { LOAD ->data_head in perf_output_put_handle()
96 * STORE ->data_head STORE ->data_tail in perf_output_put_handle()
102 * the ->data_tail and the stores of $data. In case ->data_tail in perf_output_put_handle()
114 WRITE_ONCE(rb->user_page->data_head, head); in perf_output_put_handle()
122 WRITE_ONCE(rb->nest, 0); in perf_output_put_handle()
125 * Ensure we decrement @rb->nest before we validate the @rb->head. in perf_output_put_handle()
129 if (unlikely(head != local_read(&rb->head))) { in perf_output_put_handle()
130 WRITE_ONCE(rb->nest, 1); in perf_output_put_handle()
134 if (handle->wakeup != local_read(&rb->wakeup)) in perf_output_put_handle()
171 if (event->parent) in __perf_output_begin()
172 event = event->parent; in __perf_output_begin()
174 rb = rcu_dereference(event->rb); in __perf_output_begin()
178 if (unlikely(rb->paused)) { in __perf_output_begin()
179 if (rb->nr_pages) { in __perf_output_begin()
180 local_inc(&rb->lost); in __perf_output_begin()
181 atomic64_inc(&event->lost_samples); in __perf_output_begin()
186 handle->rb = rb; in __perf_output_begin()
187 handle->event = event; in __perf_output_begin()
188 handle->flags = 0; in __perf_output_begin()
190 have_lost = local_read(&rb->lost); in __perf_output_begin()
193 if (event->attr.sample_id_all) in __perf_output_begin()
194 size += event->id_header_size; in __perf_output_begin()
199 offset = local_read(&rb->head); in __perf_output_begin()
202 tail = READ_ONCE(rb->user_page->data_tail); in __perf_output_begin()
203 if (!rb->overwrite) { in __perf_output_begin()
225 head -= size; in __perf_output_begin()
226 } while (!local_try_cmpxchg(&rb->head, &offset, head)); in __perf_output_begin()
230 head = (u64)(-head); in __perf_output_begin()
238 if (unlikely(head - local_read(&rb->wakeup) > rb->watermark)) in __perf_output_begin()
239 local_add(rb->watermark, &rb->wakeup); in __perf_output_begin()
243 handle->page = (offset >> page_shift) & (rb->nr_pages - 1); in __perf_output_begin()
244 offset &= (1UL << page_shift) - 1; in __perf_output_begin()
245 handle->addr = rb->data_pages[handle->page] + offset; in __perf_output_begin()
246 handle->size = (1UL << page_shift) - offset; in __perf_output_begin()
252 lost_event.id = event->id; in __perf_output_begin()
253 lost_event.lost = local_xchg(&rb->lost, 0); in __perf_output_begin()
264 local_inc(&rb->lost); in __perf_output_begin()
265 atomic64_inc(&event->lost_samples); in __perf_output_begin()
270 return -ENOSPC; in __perf_output_begin()
320 rb->watermark = min(max_size, watermark); in ring_buffer_init()
322 if (!rb->watermark) in ring_buffer_init()
323 rb->watermark = max_size / 2; in ring_buffer_init()
326 rb->overwrite = 0; in ring_buffer_init()
328 rb->overwrite = 1; in ring_buffer_init()
330 refcount_set(&rb->refcount, 1); in ring_buffer_init()
332 INIT_LIST_HEAD(&rb->event_list); in ring_buffer_init()
333 spin_lock_init(&rb->event_lock); in ring_buffer_init()
336 * perf_output_begin() only checks rb->paused, therefore in ring_buffer_init()
337 * rb->paused must be true if we have no pages for output. in ring_buffer_init()
339 if (!rb->nr_pages) in ring_buffer_init()
340 rb->paused = 1; in ring_buffer_init()
342 mutex_init(&rb->aux_mutex); in ring_buffer_init()
343 rb->mmap_user = get_current_user(); in ring_buffer_init()
344 refcount_set(&rb->mmap_count, 1); in ring_buffer_init()
356 handle->aux_flags |= flags; in perf_aux_output_flag()
382 if (output_event->parent) in perf_aux_output_begin()
383 output_event = output_event->parent; in perf_aux_output_begin()
405 if (!refcount_read(&rb->aux_mmap_count)) in perf_aux_output_begin()
408 if (!refcount_inc_not_zero(&rb->aux_refcount)) in perf_aux_output_begin()
411 nest = READ_ONCE(rb->aux_nest); in perf_aux_output_begin()
413 * Nesting is not supported for AUX area, make sure nested in perf_aux_output_begin()
419 WRITE_ONCE(rb->aux_nest, nest + 1); in perf_aux_output_begin()
421 aux_head = rb->aux_head; in perf_aux_output_begin()
423 handle->rb = rb; in perf_aux_output_begin()
424 handle->event = event; in perf_aux_output_begin()
425 handle->head = aux_head; in perf_aux_output_begin()
426 handle->size = 0; in perf_aux_output_begin()
427 handle->aux_flags = 0; in perf_aux_output_begin()
432 * (B) <-> (C) ordering is still observed by the pmu driver. in perf_aux_output_begin()
434 if (!rb->aux_overwrite) { in perf_aux_output_begin()
435 aux_tail = READ_ONCE(rb->user_page->aux_tail); in perf_aux_output_begin()
436 handle->wakeup = rb->aux_wakeup + rb->aux_watermark; in perf_aux_output_begin()
437 if (aux_head - aux_tail < perf_aux_size(rb)) in perf_aux_output_begin()
438 handle->size = CIRC_SPACE(aux_head, aux_tail, perf_aux_size(rb)); in perf_aux_output_begin()
441 * handle->size computation depends on aux_tail load; this forms a in perf_aux_output_begin()
445 if (!handle->size) { /* A, matches D */ in perf_aux_output_begin()
446 perf_event_disable_inatomic(handle->event); in perf_aux_output_begin()
448 WRITE_ONCE(rb->aux_nest, 0); in perf_aux_output_begin()
453 return handle->rb->aux_priv; in perf_aux_output_begin()
461 handle->event = NULL; in perf_aux_output_begin()
469 if (rb->aux_overwrite) in rb_need_aux_wakeup()
472 if (rb->aux_head - rb->aux_wakeup >= rb->aux_watermark) { in rb_need_aux_wakeup()
473 rb->aux_wakeup = rounddown(rb->aux_head, rb->aux_watermark); in rb_need_aux_wakeup()
492 bool wakeup = !!(handle->aux_flags & PERF_AUX_FLAG_TRUNCATED); in perf_aux_output_end()
493 struct perf_buffer *rb = handle->rb; in perf_aux_output_end()
497 if (rb->aux_overwrite) { in perf_aux_output_end()
498 handle->aux_flags |= PERF_AUX_FLAG_OVERWRITE; in perf_aux_output_end()
500 aux_head = handle->head; in perf_aux_output_end()
501 rb->aux_head = aux_head; in perf_aux_output_end()
503 handle->aux_flags &= ~PERF_AUX_FLAG_OVERWRITE; in perf_aux_output_end()
505 aux_head = rb->aux_head; in perf_aux_output_end()
506 rb->aux_head += size; in perf_aux_output_end()
513 * has occurred, so ignore them for zero-sized records. in perf_aux_output_end()
517 * aside from the short-lived offset, that becomes history at in perf_aux_output_end()
518 * the next event sched-in and therefore isn't useful. in perf_aux_output_end()
525 (handle->aux_flags & ~(u64)(PERF_AUX_FLAG_PMU_FORMAT_TYPE_MASK | in perf_aux_output_end()
527 perf_event_aux_event(handle->event, aux_head, size, in perf_aux_output_end()
528 handle->aux_flags); in perf_aux_output_end()
530 WRITE_ONCE(rb->user_page->aux_head, rb->aux_head); in perf_aux_output_end()
535 if (handle->aux_flags & PERF_AUX_FLAG_TRUNCATED) in perf_aux_output_end()
536 perf_event_disable_inatomic(handle->event); in perf_aux_output_end()
540 handle->event = NULL; in perf_aux_output_end()
542 WRITE_ONCE(rb->aux_nest, 0); in perf_aux_output_end()
555 struct perf_buffer *rb = handle->rb; in perf_aux_output_skip()
557 if (size > handle->size) in perf_aux_output_skip()
558 return -ENOSPC; in perf_aux_output_skip()
560 rb->aux_head += size; in perf_aux_output_skip()
562 WRITE_ONCE(rb->user_page->aux_head, rb->aux_head); in perf_aux_output_skip()
565 handle->wakeup = rb->aux_wakeup + rb->aux_watermark; in perf_aux_output_skip()
568 handle->head = rb->aux_head; in perf_aux_output_skip()
569 handle->size -= size; in perf_aux_output_skip()
578 if (!handle->event) in perf_get_aux()
581 return handle->rb->aux_priv; in perf_get_aux()
592 struct perf_buffer *rb = aux_handle->rb; in perf_output_copy_aux()
596 from &= (rb->aux_nr_pages << PAGE_SHIFT) - 1; in perf_output_copy_aux()
597 to &= (rb->aux_nr_pages << PAGE_SHIFT) - 1; in perf_output_copy_aux()
600 tocopy = PAGE_SIZE - offset_in_page(from); in perf_output_copy_aux()
602 tocopy = min(tocopy, to - from); in perf_output_copy_aux()
606 addr = rb->aux_pages[from >> PAGE_SHIFT]; in perf_output_copy_aux()
611 return -EFAULT; in perf_output_copy_aux()
615 from &= (rb->aux_nr_pages << PAGE_SHIFT) - 1; in perf_output_copy_aux()
632 } while (!page && order--); in rb_alloc_aux_page()
637 * if we managed to secure a high-order allocation, in rb_alloc_aux_page()
651 struct page *page = virt_to_page(rb->aux_pages[idx]); in rb_free_aux_page()
669 if (rb->aux_priv) { in __rb_free_aux()
670 rb->free_aux(rb->aux_priv); in __rb_free_aux()
671 rb->free_aux = NULL; in __rb_free_aux()
672 rb->aux_priv = NULL; in __rb_free_aux()
675 if (rb->aux_nr_pages) { in __rb_free_aux()
676 for (pg = 0; pg < rb->aux_nr_pages; pg++) in __rb_free_aux()
679 kfree(rb->aux_pages); in __rb_free_aux()
680 rb->aux_nr_pages = 0; in __rb_free_aux()
688 int node = (event->cpu == -1) ? -1 : cpu_to_node(event->cpu); in rb_alloc_aux()
689 bool use_contiguous_pages = event->pmu->capabilities & ( in rb_alloc_aux()
697 int ret = -ENOMEM; in rb_alloc_aux()
700 return -EOPNOTSUPP; in rb_alloc_aux()
703 return -EINVAL; in rb_alloc_aux()
713 (unsigned long)nr_pages << (PAGE_SHIFT - 1)); in rb_alloc_aux()
737 return -ENOMEM; in rb_alloc_aux()
738 rb->aux_pages = kcalloc_node(nr_pages, sizeof(void *), GFP_KERNEL, in rb_alloc_aux()
740 if (!rb->aux_pages) in rb_alloc_aux()
741 return -ENOMEM; in rb_alloc_aux()
743 rb->free_aux = event->pmu->free_aux; in rb_alloc_aux()
744 for (rb->aux_nr_pages = 0; rb->aux_nr_pages < nr_pages;) { in rb_alloc_aux()
748 order = min(max_order, ilog2(nr_pages - rb->aux_nr_pages)); in rb_alloc_aux()
753 for (last = rb->aux_nr_pages + (1 << page_private(page)); in rb_alloc_aux()
754 last > rb->aux_nr_pages; rb->aux_nr_pages++) in rb_alloc_aux()
755 rb->aux_pages[rb->aux_nr_pages] = page_address(page++); in rb_alloc_aux()
759 * In overwrite mode, PMUs that don't support SG may not handle more in rb_alloc_aux()
764 if ((event->pmu->capabilities & PERF_PMU_CAP_AUX_NO_SG) && in rb_alloc_aux()
766 struct page *page = virt_to_page(rb->aux_pages[0]); in rb_alloc_aux()
772 rb->aux_priv = event->pmu->setup_aux(event, rb->aux_pages, nr_pages, in rb_alloc_aux()
774 if (!rb->aux_priv) in rb_alloc_aux()
785 refcount_set(&rb->aux_refcount, 1); in rb_alloc_aux()
787 rb->aux_overwrite = overwrite; in rb_alloc_aux()
788 rb->aux_watermark = watermark; in rb_alloc_aux()
792 rb->aux_pgoff = pgoff; in rb_alloc_aux()
801 if (refcount_dec_and_test(&rb->aux_refcount)) in rb_free_aux()
808 * Back perf_mmap() with regular GFP_KERNEL-0 pages.
814 if (pgoff > rb->nr_pages) in __perf_mmap_to_page()
818 return virt_to_page(rb->user_page); in __perf_mmap_to_page()
820 return virt_to_page(rb->data_pages[pgoff - 1]); in __perf_mmap_to_page()
828 node = (cpu == -1) ? cpu : cpu_to_node(cpu); in perf_mmap_alloc_page()
855 node = (cpu == -1) ? cpu : cpu_to_node(cpu); in rb_alloc()
860 rb->user_page = perf_mmap_alloc_page(cpu); in rb_alloc()
861 if (!rb->user_page) in rb_alloc()
865 rb->data_pages[i] = perf_mmap_alloc_page(cpu); in rb_alloc()
866 if (!rb->data_pages[i]) in rb_alloc()
870 rb->nr_pages = nr_pages; in rb_alloc()
877 for (i--; i >= 0; i--) in rb_alloc()
878 perf_mmap_free_page(rb->data_pages[i]); in rb_alloc()
880 perf_mmap_free_page(rb->user_page); in rb_alloc()
893 perf_mmap_free_page(rb->user_page); in rb_free()
894 for (i = 0; i < rb->nr_pages; i++) in rb_free()
895 perf_mmap_free_page(rb->data_pages[i]); in rb_free()
907 return vmalloc_to_page((void *)rb->user_page + pgoff * PAGE_SIZE); in __perf_mmap_to_page()
916 vfree(rb->user_page); in rb_free_work()
922 schedule_work(&rb->work); in rb_free()
935 node = (cpu == -1) ? cpu : cpu_to_node(cpu); in rb_alloc()
940 INIT_WORK(&rb->work, rb_free_work); in rb_alloc()
946 rb->user_page = all_buf; in rb_alloc()
947 rb->data_pages[0] = all_buf + PAGE_SIZE; in rb_alloc()
949 rb->nr_pages = 1; in rb_alloc()
950 rb->page_order = ilog2(nr_pages); in rb_alloc()
969 if (rb->aux_nr_pages) { in perf_mmap_to_page()
971 if (pgoff > rb->aux_pgoff + rb->aux_nr_pages) in perf_mmap_to_page()
975 if (pgoff >= rb->aux_pgoff) { in perf_mmap_to_page()
976 int aux_pgoff = array_index_nospec(pgoff - rb->aux_pgoff, rb->aux_nr_pages); in perf_mmap_to_page()
977 return virt_to_page(rb->aux_pages[aux_pgoff]); in perf_mmap_to_page()