From: Daniel Vetter <daniel@ffwll.ch>
To: Intel Graphics Development <intel-gfx@lists.freedesktop.org>
Cc: Daniel Vetter <daniel.vetter@ffwll.ch>
Subject: Re: [PATCH 07/16] drm/i915: don't call shmem_read_mapping unnecessarily
Date: Mon, 26 Mar 2012 11:10:05 +0200 [thread overview]
Message-ID: <20120326091005.GF4014@phenom.ffwll.local> (raw)
In-Reply-To: <1332697663-31256-7-git-send-email-daniel.vetter@ffwll.ch>
On Sun, Mar 25, 2012 at 07:47:34PM +0200, Daniel Vetter wrote:
> This speeds up pwrite and pread from ~120 µs ro ~100 µs for
> reading/writing 1mb on my snb (if the backing storage pages
> are already pinned, of course).
>
> v2: Chris Wilson pointed out a claring page reference bug - I've
s/claring/glaring, noticed by Chris.
Note to self: Fix this when applying.
-Daniel
> unconditionally dropped the reference. With that fixed (and the
> associated reduction of dirt in dmesg) it's now even a notch faster.
>
> v3: Unconditionaly grab a page reference when dropping
> dev->struct_mutex to simplify the code-flow.
>
> Signed-off-by: Daniel Vetter <daniel.vetter@ffwll.ch>
> ---
> drivers/gpu/drm/i915/i915_gem.c | 42 +++++++++++++++++++++++++++-----------
> 1 files changed, 30 insertions(+), 12 deletions(-)
>
> diff --git a/drivers/gpu/drm/i915/i915_gem.c b/drivers/gpu/drm/i915/i915_gem.c
> index c5b250c..117fda4 100644
> --- a/drivers/gpu/drm/i915/i915_gem.c
> +++ b/drivers/gpu/drm/i915/i915_gem.c
> @@ -321,6 +321,7 @@ i915_gem_shmem_pread(struct drm_device *dev,
> int obj_do_bit17_swizzling, page_do_bit17_swizzling;
> int hit_slowpath = 0;
> int needs_clflush = 0;
> + int release_page;
>
> user_data = (char __user *) (uintptr_t) args->data_ptr;
> remain = args->size;
> @@ -355,10 +356,16 @@ i915_gem_shmem_pread(struct drm_device *dev,
> if ((shmem_page_offset + page_length) > PAGE_SIZE)
> page_length = PAGE_SIZE - shmem_page_offset;
>
> - page = shmem_read_mapping_page(mapping, offset >> PAGE_SHIFT);
> - if (IS_ERR(page)) {
> - ret = PTR_ERR(page);
> - goto out;
> + if (obj->pages) {
> + page = obj->pages[offset >> PAGE_SHIFT];
> + release_page = 0;
> + } else {
> + page = shmem_read_mapping_page(mapping, offset >> PAGE_SHIFT);
> + if (IS_ERR(page)) {
> + ret = PTR_ERR(page);
> + goto out;
> + }
> + release_page = 1;
> }
>
> page_do_bit17_swizzling = obj_do_bit17_swizzling &&
> @@ -378,7 +385,7 @@ i915_gem_shmem_pread(struct drm_device *dev,
> }
>
> hit_slowpath = 1;
> -
> + page_cache_get(page);
> mutex_unlock(&dev->struct_mutex);
>
> vaddr = kmap(page);
> @@ -397,9 +404,11 @@ i915_gem_shmem_pread(struct drm_device *dev,
> kunmap(page);
>
> mutex_lock(&dev->struct_mutex);
> + page_cache_release(page);
> next_page:
> mark_page_accessed(page);
> - page_cache_release(page);
> + if (release_page)
> + page_cache_release(page);
>
> if (ret) {
> ret = -EFAULT;
> @@ -680,6 +689,7 @@ i915_gem_shmem_pwrite(struct drm_device *dev,
> int shmem_page_offset, page_length, ret = 0;
> int obj_do_bit17_swizzling, page_do_bit17_swizzling;
> int hit_slowpath = 0;
> + int release_page;
>
> user_data = (char __user *) (uintptr_t) args->data_ptr;
> remain = args->size;
> @@ -704,10 +714,16 @@ i915_gem_shmem_pwrite(struct drm_device *dev,
> if ((shmem_page_offset + page_length) > PAGE_SIZE)
> page_length = PAGE_SIZE - shmem_page_offset;
>
> - page = shmem_read_mapping_page(mapping, offset >> PAGE_SHIFT);
> - if (IS_ERR(page)) {
> - ret = PTR_ERR(page);
> - goto out;
> + if (obj->pages) {
> + page = obj->pages[offset >> PAGE_SHIFT];
> + release_page = 0;
> + } else {
> + page = shmem_read_mapping_page(mapping, offset >> PAGE_SHIFT);
> + if (IS_ERR(page)) {
> + ret = PTR_ERR(page);
> + goto out;
> + }
> + release_page = 1;
> }
>
> page_do_bit17_swizzling = obj_do_bit17_swizzling &&
> @@ -725,7 +741,7 @@ i915_gem_shmem_pwrite(struct drm_device *dev,
> }
>
> hit_slowpath = 1;
> -
> + page_cache_get(page);
> mutex_unlock(&dev->struct_mutex);
>
> vaddr = kmap(page);
> @@ -740,10 +756,12 @@ i915_gem_shmem_pwrite(struct drm_device *dev,
> kunmap(page);
>
> mutex_lock(&dev->struct_mutex);
> + page_cache_release(page);
> next_page:
> set_page_dirty(page);
> mark_page_accessed(page);
> - page_cache_release(page);
> + if (release_page)
> + page_cache_release(page);
>
> if (ret) {
> ret = -EFAULT;
> --
> 1.7.7.6
>
--
Daniel Vetter
Mail: daniel@ffwll.ch
Mobile: +41 (0)79 365 57 48
next prev parent reply other threads:[~2012-03-26 9:09 UTC|newest]
Thread overview: 24+ messages / expand[flat|nested] mbox.gz Atom feed top
2012-03-25 17:47 [PATCH 01/16] drm/i915: merge shmem_pwrite slow&fast-path Daniel Vetter
2012-03-25 17:47 ` [PATCH 02/16] drm/i915: merge shmem_pread slow&fast-path Daniel Vetter
2012-03-25 17:47 ` [PATCH 03/16] drm: add helper to clflush a virtual address range Daniel Vetter
2012-03-25 17:47 ` [PATCH 04/16] drm/i915: move clflushing into shmem_pread Daniel Vetter
2012-03-25 17:47 ` [PATCH 05/16] drm/i915: kill ranged cpu read domain support Daniel Vetter
2012-03-25 17:47 ` [PATCH 06/16] drm/i915: don't use gtt_pwrite on LLC cached objects Daniel Vetter
2012-03-25 17:47 ` [PATCH 07/16] drm/i915: don't call shmem_read_mapping unnecessarily Daniel Vetter
2012-03-26 9:10 ` Daniel Vetter [this message]
2012-03-25 17:47 ` [PATCH 08/16] drm/i915: drop gtt slowpath Daniel Vetter
2012-03-25 17:47 ` [PATCH 09/16] drm/i915: don't clobber userspace memory before commiting to the pread Daniel Vetter
2012-03-25 17:47 ` [PATCH 10/16] drm/i915: implement inline clflush for pwrite Daniel Vetter
2012-03-25 17:47 ` [PATCH 11/16] drm/i915: fall back to shmem pwrite when the buffer is not accessible Daniel Vetter
2012-03-25 17:47 ` [PATCH 12/16] drm/i915: use uncached writes in pwrite Daniel Vetter
2012-03-25 17:47 ` [PATCH 13/16] drm/i915: extract copy helpers from shmem_pread|pwrite Daniel Vetter
2012-03-26 9:05 ` Chris Wilson
2012-03-25 17:47 ` [PATCH 14/16] mm: extend prefault helpers to fault in more than PAGE_SIZE Daniel Vetter
2012-03-26 9:09 ` Chris Wilson
2012-03-25 17:47 ` [PATCH 15/16] drm/i915: fixup in-line clflushing on bit17 swizzled bos Daniel Vetter
2012-03-26 9:18 ` Chris Wilson
2012-03-26 9:26 ` Daniel Vetter
2012-03-26 12:50 ` Chris Wilson
2012-03-25 17:47 ` [PATCH 16/16] drm/i915: mark pwrite/pread slowpaths with unlikely Daniel Vetter
2012-03-26 9:09 ` Chris Wilson
2012-03-27 11:42 ` Daniel Vetter
Reply instructions:
You may reply publicly to this message via plain-text email
using any one of the following methods:
* Save the following mbox file, import it into your mail client,
and reply-to-all from there: mbox
Avoid top-posting and favor interleaved quoting:
https://en.wikipedia.org/wiki/Posting_style#Interleaved_style
* Reply using the --to, --cc, and --in-reply-to
switches of git-send-email(1):
git send-email \
--in-reply-to=20120326091005.GF4014@phenom.ffwll.local \
--to=daniel@ffwll.ch \
--cc=daniel.vetter@ffwll.ch \
--cc=intel-gfx@lists.freedesktop.org \
/path/to/YOUR_REPLY
https://kernel.org/pub/software/scm/git/docs/git-send-email.html
* If your mail client supports setting the In-Reply-To header
via mailto: links, try the mailto: link
Be sure your reply has a Subject: header at the top and a blank line
before the message body.
This is a public inbox, see mirroring instructions
for how to clone and mirror all data and code used for this inbox