i915/selftests/i915_request.c

1.1  riastrad /*	$NetBSD: i915_request.c,v 1.2 2021/12/18 23:45:31 riastradh Exp $	*/
1.1  riastrad
1.1  riastrad /*
1.1  riastrad  * Copyright  2016 Intel Corporation
1.1  riastrad  *
1.1  riastrad  * Permission is hereby granted, free of charge, to any person obtaining a
1.1  riastrad  * copy of this software and associated documentation files (the "Software"),
1.1  riastrad  * to deal in the Software without restriction, including without limitation
1.1  riastrad  * the rights to use, copy, modify, merge, publish, distribute, sublicense,
1.1  riastrad  * and/or sell copies of the Software, and to permit persons to whom the
1.1  riastrad  * Software is furnished to do so, subject to the following conditions:
1.1  riastrad  *
1.1  riastrad  * The above copyright notice and this permission notice (including the next
1.1  riastrad  * paragraph) shall be included in all copies or substantial portions of the
1.1  riastrad  * Software.
1.1  riastrad  *
1.1  riastrad  * THE SOFTWARE IS PROVIDED "AS IS", WITHOUT WARRANTY OF ANY KIND, EXPRESS OR
1.1  riastrad  * IMPLIED, INCLUDING BUT NOT LIMITED TO THE WARRANTIES OF MERCHANTABILITY,
1.1  riastrad  * FITNESS FOR A PARTICULAR PURPOSE AND NONINFRINGEMENT.  IN NO EVENT SHALL
1.1  riastrad  * THE AUTHORS OR COPYRIGHT HOLDERS BE LIABLE FOR ANY CLAIM, DAMAGES OR OTHER
1.1  riastrad  * LIABILITY, WHETHER IN AN ACTION OF CONTRACT, TORT OR OTHERWISE, ARISING
1.1  riastrad  * FROM, OUT OF OR IN CONNECTION WITH THE SOFTWARE OR THE USE OR OTHER DEALINGS
1.1  riastrad  * IN THE SOFTWARE.
1.1  riastrad  *
1.1  riastrad  */
1.1  riastrad
1.1  riastrad #include <sys/cdefs.h>
1.1  riastrad __KERNEL_RCSID(0, "$NetBSD: i915_request.c,v 1.2 2021/12/18 23:45:31 riastradh Exp $");
1.1  riastrad
1.1  riastrad #include <linux/prime_numbers.h>
1.1  riastrad
1.1  riastrad #include "gem/i915_gem_pm.h"
1.1  riastrad #include "gem/selftests/mock_context.h"
1.1  riastrad
1.1  riastrad #include "gt/intel_engine_pm.h"
1.1  riastrad #include "gt/intel_gt.h"
1.1  riastrad
1.1  riastrad #include "i915_random.h"
1.1  riastrad #include "i915_selftest.h"
1.1  riastrad #include "igt_live_test.h"
1.1  riastrad #include "igt_spinner.h"
1.1  riastrad #include "lib_sw_fence.h"
1.1  riastrad
1.1  riastrad #include "mock_drm.h"
1.1  riastrad #include "mock_gem_device.h"
1.1  riastrad
1.1  riastrad static unsigned int num_uabi_engines(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	unsigned int count;
1.1  riastrad
1.1  riastrad 	count = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915)
1.1  riastrad 		count++;
1.1  riastrad
1.1  riastrad 	return count;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int igt_add_request(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct i915_request *request;
1.1  riastrad
1.1  riastrad 	/* Basic preliminary test to create a request and let it loose! */
1.1  riastrad
1.1  riastrad 	request = mock_request(i915->engine[RCS0]->kernel_context, HZ / 10);
1.1  riastrad 	if (!request)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	i915_request_add(request);
1.1  riastrad
1.1  riastrad 	return 0;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int igt_wait_request(void *arg)
1.1  riastrad {
1.1  riastrad 	const long T = HZ / 4;
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct i915_request *request;
1.1  riastrad 	int err = -EINVAL;
1.1  riastrad
1.1  riastrad 	/* Submit a request, then wait upon it */
1.1  riastrad
1.1  riastrad 	request = mock_request(i915->engine[RCS0]->kernel_context, T);
1.1  riastrad 	if (!request)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	i915_request_get(request);
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, 0) != -ETIME) {
1.1  riastrad 		pr_err("request wait (busy query) succeeded (expected timeout before submit!)\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, T) != -ETIME) {
1.1  riastrad 		pr_err("request wait succeeded (expected timeout before submit!)\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_completed(request)) {
1.1  riastrad 		pr_err("request completed before submit!!\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	i915_request_add(request);
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, 0) != -ETIME) {
1.1  riastrad 		pr_err("request wait (busy query) succeeded (expected timeout after submit!)\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_completed(request)) {
1.1  riastrad 		pr_err("request completed immediately!\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, T / 2) != -ETIME) {
1.1  riastrad 		pr_err("request wait succeeded (expected timeout!)\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, T) == -ETIME) {
1.1  riastrad 		pr_err("request wait timed out!\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (!i915_request_completed(request)) {
1.1  riastrad 		pr_err("request not complete after waiting!\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(request, 0, T) == -ETIME) {
1.1  riastrad 		pr_err("request wait timed out when already complete!\n");
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = 0;
1.1  riastrad out_request:
1.1  riastrad 	i915_request_put(request);
1.1  riastrad 	mock_device_flush(i915);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int igt_fence_wait(void *arg)
1.1  riastrad {
1.1  riastrad 	const long T = HZ / 4;
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct i915_request *request;
1.1  riastrad 	int err = -EINVAL;
1.1  riastrad
1.1  riastrad 	/* Submit a request, treat it as a fence and wait upon it */
1.1  riastrad
1.1  riastrad 	request = mock_request(i915->engine[RCS0]->kernel_context, T);
1.1  riastrad 	if (!request)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	if (dma_fence_wait_timeout(&request->fence, false, T) != -ETIME) {
1.1  riastrad 		pr_err("fence wait success before submit (expected timeout)!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	i915_request_add(request);
1.1  riastrad
1.1  riastrad 	if (dma_fence_is_signaled(&request->fence)) {
1.1  riastrad 		pr_err("fence signaled immediately!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (dma_fence_wait_timeout(&request->fence, false, T / 2) != -ETIME) {
1.1  riastrad 		pr_err("fence wait success after submit (expected timeout)!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (dma_fence_wait_timeout(&request->fence, false, T) <= 0) {
1.1  riastrad 		pr_err("fence wait timed out (expected success)!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (!dma_fence_is_signaled(&request->fence)) {
1.1  riastrad 		pr_err("fence unsignaled after waiting!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (dma_fence_wait_timeout(&request->fence, false, T) <= 0) {
1.1  riastrad 		pr_err("fence wait timed out when complete (expected success)!\n");
1.1  riastrad 		goto out;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = 0;
1.1  riastrad out:
1.1  riastrad 	mock_device_flush(i915);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int igt_request_rewind(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct i915_request *request, *vip;
1.1  riastrad 	struct i915_gem_context *ctx[2];
1.1  riastrad 	struct intel_context *ce;
1.1  riastrad 	int err = -EINVAL;
1.1  riastrad
1.1  riastrad 	ctx[0] = mock_context(i915, "A");
1.1  riastrad
1.1  riastrad 	ce = i915_gem_context_get_engine(ctx[0], RCS0);
1.1  riastrad 	GEM_BUG_ON(IS_ERR(ce));
1.1  riastrad 	request = mock_request(ce, 2 * HZ);
1.1  riastrad 	intel_context_put(ce);
1.1  riastrad 	if (!request) {
1.1  riastrad 		err = -ENOMEM;
1.1  riastrad 		goto err_context_0;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	i915_request_get(request);
1.1  riastrad 	i915_request_add(request);
1.1  riastrad
1.1  riastrad 	ctx[1] = mock_context(i915, "B");
1.1  riastrad
1.1  riastrad 	ce = i915_gem_context_get_engine(ctx[1], RCS0);
1.1  riastrad 	GEM_BUG_ON(IS_ERR(ce));
1.1  riastrad 	vip = mock_request(ce, 0);
1.1  riastrad 	intel_context_put(ce);
1.1  riastrad 	if (!vip) {
1.1  riastrad 		err = -ENOMEM;
1.1  riastrad 		goto err_context_1;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	/* Simulate preemption by manual reordering */
1.1  riastrad 	if (!mock_cancel_request(request)) {
1.1  riastrad 		pr_err("failed to cancel request (already executed)!\n");
1.1  riastrad 		i915_request_add(vip);
1.1  riastrad 		goto err_context_1;
1.1  riastrad 	}
1.1  riastrad 	i915_request_get(vip);
1.1  riastrad 	i915_request_add(vip);
1.1  riastrad 	rcu_read_lock();
1.1  riastrad 	request->engine->submit_request(request);
1.1  riastrad 	rcu_read_unlock();
1.1  riastrad
1.1  riastrad
1.1  riastrad 	if (i915_request_wait(vip, 0, HZ) == -ETIME) {
1.1  riastrad 		pr_err("timed out waiting for high priority request\n");
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (i915_request_completed(request)) {
1.1  riastrad 		pr_err("low priority request already completed\n");
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = 0;
1.1  riastrad err:
1.1  riastrad 	i915_request_put(vip);
1.1  riastrad err_context_1:
1.1  riastrad 	mock_context_close(ctx[1]);
1.1  riastrad 	i915_request_put(request);
1.1  riastrad err_context_0:
1.1  riastrad 	mock_context_close(ctx[0]);
1.1  riastrad 	mock_device_flush(i915);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad struct smoketest {
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct i915_gem_context **contexts;
1.1  riastrad 	atomic_long_t num_waits, num_fences;
1.1  riastrad 	int ncontexts, max_batch;
1.1  riastrad 	struct i915_request *(*request_alloc)(struct intel_context *ce);
1.1  riastrad };
1.1  riastrad
1.1  riastrad static struct i915_request *
1.1  riastrad __mock_request_alloc(struct intel_context *ce)
1.1  riastrad {
1.1  riastrad 	return mock_request(ce, 0);
1.1  riastrad }
1.1  riastrad
1.1  riastrad static struct i915_request *
1.1  riastrad __live_request_alloc(struct intel_context *ce)
1.1  riastrad {
1.1  riastrad 	return intel_context_create_request(ce);
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int __igt_breadcrumbs_smoketest(void *arg)
1.1  riastrad {
1.1  riastrad 	struct smoketest *t = arg;
1.1  riastrad 	const unsigned int max_batch = min(t->ncontexts, t->max_batch) - 1;
1.1  riastrad 	const unsigned int total = 4 * t->ncontexts + 1;
1.1  riastrad 	unsigned int num_waits = 0, num_fences = 0;
1.1  riastrad 	struct i915_request **requests;
1.1  riastrad 	I915_RND_STATE(prng);
1.1  riastrad 	unsigned int *order;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * A very simple test to catch the most egregious of list handling bugs.
1.1  riastrad 	 *
1.1  riastrad 	 * At its heart, we simply create oodles of requests running across
1.1  riastrad 	 * multiple kthreads and enable signaling on them, for the sole purpose
1.1  riastrad 	 * of stressing our breadcrumb handling. The only inspection we do is
1.1  riastrad 	 * that the fences were marked as signaled.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	requests = kcalloc(total, sizeof(*requests), GFP_KERNEL);
1.1  riastrad 	if (!requests)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	order = i915_random_order(total, &prng);
1.1  riastrad 	if (!order) {
1.1  riastrad 		err = -ENOMEM;
1.1  riastrad 		goto out_requests;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	while (!kthread_should_stop()) {
1.1  riastrad 		struct i915_sw_fence *submit, *wait;
1.1  riastrad 		unsigned int n, count;
1.1  riastrad
1.1  riastrad 		submit = heap_fence_create(GFP_KERNEL);
1.1  riastrad 		if (!submit) {
1.1  riastrad 			err = -ENOMEM;
1.1  riastrad 			break;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		wait = heap_fence_create(GFP_KERNEL);
1.1  riastrad 		if (!wait) {
1.1  riastrad 			i915_sw_fence_commit(submit);
1.1  riastrad 			heap_fence_put(submit);
1.1  riastrad 			err = ENOMEM;
1.1  riastrad 			break;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		i915_random_reorder(order, total, &prng);
1.1  riastrad 		count = 1 + i915_prandom_u32_max_state(max_batch, &prng);
1.1  riastrad
1.1  riastrad 		for (n = 0; n < count; n++) {
1.1  riastrad 			struct i915_gem_context *ctx =
1.1  riastrad 				t->contexts[order[n] % t->ncontexts];
1.1  riastrad 			struct i915_request *rq;
1.1  riastrad 			struct intel_context *ce;
1.1  riastrad
1.1  riastrad 			ce = i915_gem_context_get_engine(ctx, t->engine->legacy_idx);
1.1  riastrad 			GEM_BUG_ON(IS_ERR(ce));
1.1  riastrad 			rq = t->request_alloc(ce);
1.1  riastrad 			intel_context_put(ce);
1.1  riastrad 			if (IS_ERR(rq)) {
1.1  riastrad 				err = PTR_ERR(rq);
1.1  riastrad 				count = n;
1.1  riastrad 				break;
1.1  riastrad 			}
1.1  riastrad
1.1  riastrad 			err = i915_sw_fence_await_sw_fence_gfp(&rq->submit,
1.1  riastrad 							       submit,
1.1  riastrad 							       GFP_KERNEL);
1.1  riastrad
1.1  riastrad 			requests[n] = i915_request_get(rq);
1.1  riastrad 			i915_request_add(rq);
1.1  riastrad
1.1  riastrad 			if (err >= 0)
1.1  riastrad 				err = i915_sw_fence_await_dma_fence(wait,
1.1  riastrad 								    &rq->fence,
1.1  riastrad 								    0,
1.1  riastrad 								    GFP_KERNEL);
1.1  riastrad
1.1  riastrad 			if (err < 0) {
1.1  riastrad 				i915_request_put(rq);
1.1  riastrad 				count = n;
1.1  riastrad 				break;
1.1  riastrad 			}
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		i915_sw_fence_commit(submit);
1.1  riastrad 		i915_sw_fence_commit(wait);
1.1  riastrad
1.1  riastrad 		if (!wait_event_timeout(wait->wait,
1.1  riastrad 					i915_sw_fence_done(wait),
1.1  riastrad 					5 * HZ)) {
1.1  riastrad 			struct i915_request *rq = requests[count - 1];
1.1  riastrad
1.1  riastrad 			pr_err("waiting for %d/%d fences (last %llx:%lld) on %s timed out!\n",
1.1  riastrad 			       atomic_read(&wait->pending), count,
1.1  riastrad 			       rq->fence.context, rq->fence.seqno,
1.1  riastrad 			       t->engine->name);
1.1  riastrad 			GEM_TRACE_DUMP();
1.1  riastrad
1.1  riastrad 			intel_gt_set_wedged(t->engine->gt);
1.1  riastrad 			GEM_BUG_ON(!i915_request_completed(rq));
1.1  riastrad 			i915_sw_fence_wait(wait);
1.1  riastrad 			err = -EIO;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		for (n = 0; n < count; n++) {
1.1  riastrad 			struct i915_request *rq = requests[n];
1.1  riastrad
1.1  riastrad 			if (!test_bit(DMA_FENCE_FLAG_SIGNALED_BIT,
1.1  riastrad 				      &rq->fence.flags)) {
1.1  riastrad 				pr_err("%llu:%llu was not signaled!\n",
1.1  riastrad 				       rq->fence.context, rq->fence.seqno);
1.1  riastrad 				err = -EINVAL;
1.1  riastrad 			}
1.1  riastrad
1.1  riastrad 			i915_request_put(rq);
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		heap_fence_put(wait);
1.1  riastrad 		heap_fence_put(submit);
1.1  riastrad
1.1  riastrad 		if (err < 0)
1.1  riastrad 			break;
1.1  riastrad
1.1  riastrad 		num_fences += count;
1.1  riastrad 		num_waits++;
1.1  riastrad
1.1  riastrad 		cond_resched();
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	atomic_long_add(num_fences, &t->num_fences);
1.1  riastrad 	atomic_long_add(num_waits, &t->num_waits);
1.1  riastrad
1.1  riastrad 	kfree(order);
1.1  riastrad out_requests:
1.1  riastrad 	kfree(requests);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int mock_breadcrumbs_smoketest(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct smoketest t = {
1.1  riastrad 		.engine = i915->engine[RCS0],
1.1  riastrad 		.ncontexts = 1024,
1.1  riastrad 		.max_batch = 1024,
1.1  riastrad 		.request_alloc = __mock_request_alloc
1.1  riastrad 	};
1.1  riastrad 	unsigned int ncpus = num_online_cpus();
1.1  riastrad 	struct task_struct **threads;
1.1  riastrad 	unsigned int n;
1.1  riastrad 	int ret = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Smoketest our breadcrumb/signal handling for requests across multiple
1.1  riastrad 	 * threads. A very simple test to only catch the most egregious of bugs.
1.1  riastrad 	 * See __igt_breadcrumbs_smoketest();
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	threads = kcalloc(ncpus, sizeof(*threads), GFP_KERNEL);
1.1  riastrad 	if (!threads)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	t.contexts = kcalloc(t.ncontexts, sizeof(*t.contexts), GFP_KERNEL);
1.1  riastrad 	if (!t.contexts) {
1.1  riastrad 		ret = -ENOMEM;
1.1  riastrad 		goto out_threads;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	for (n = 0; n < t.ncontexts; n++) {
1.1  riastrad 		t.contexts[n] = mock_context(t.engine->i915, "mock");
1.1  riastrad 		if (!t.contexts[n]) {
1.1  riastrad 			ret = -ENOMEM;
1.1  riastrad 			goto out_contexts;
1.1  riastrad 		}
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	for (n = 0; n < ncpus; n++) {
1.1  riastrad 		threads[n] = kthread_run(__igt_breadcrumbs_smoketest,
1.1  riastrad 					 &t, "igt/%d", n);
1.1  riastrad 		if (IS_ERR(threads[n])) {
1.1  riastrad 			ret = PTR_ERR(threads[n]);
1.1  riastrad 			ncpus = n;
1.1  riastrad 			break;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		get_task_struct(threads[n]);
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	yield(); /* start all threads before we begin */
1.1  riastrad 	msleep(jiffies_to_msecs(i915_selftest.timeout_jiffies));
1.1  riastrad
1.1  riastrad 	for (n = 0; n < ncpus; n++) {
1.1  riastrad 		int err;
1.1  riastrad
1.1  riastrad 		err = kthread_stop(threads[n]);
1.1  riastrad 		if (err < 0 && !ret)
1.1  riastrad 			ret = err;
1.1  riastrad
1.1  riastrad 		put_task_struct(threads[n]);
1.1  riastrad 	}
1.1  riastrad 	pr_info("Completed %lu waits for %lu fence across %d cpus\n",
1.1  riastrad 		atomic_long_read(&t.num_waits),
1.1  riastrad 		atomic_long_read(&t.num_fences),
1.1  riastrad 		ncpus);
1.1  riastrad
1.1  riastrad out_contexts:
1.1  riastrad 	for (n = 0; n < t.ncontexts; n++) {
1.1  riastrad 		if (!t.contexts[n])
1.1  riastrad 			break;
1.1  riastrad 		mock_context_close(t.contexts[n]);
1.1  riastrad 	}
1.1  riastrad 	kfree(t.contexts);
1.1  riastrad out_threads:
1.1  riastrad 	kfree(threads);
1.1  riastrad 	return ret;
1.1  riastrad }
1.1  riastrad
1.1  riastrad int i915_request_mock_selftests(void)
1.1  riastrad {
1.1  riastrad 	static const struct i915_subtest tests[] = {
1.1  riastrad 		SUBTEST(igt_add_request),
1.1  riastrad 		SUBTEST(igt_wait_request),
1.1  riastrad 		SUBTEST(igt_fence_wait),
1.1  riastrad 		SUBTEST(igt_request_rewind),
1.1  riastrad 		SUBTEST(mock_breadcrumbs_smoketest),
1.1  riastrad 	};
1.1  riastrad 	struct drm_i915_private *i915;
1.1  riastrad 	intel_wakeref_t wakeref;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	i915 = mock_gem_device();
1.1  riastrad 	if (!i915)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	with_intel_runtime_pm(&i915->runtime_pm, wakeref)
1.1  riastrad 		err = i915_subtests(tests, i915);
1.1  riastrad
1.1  riastrad 	drm_dev_put(&i915->drm);
1.1  riastrad
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_nop_request(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct igt_live_test t;
1.1  riastrad 	int err = -ENODEV;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Submit various sized batches of empty requests, to each engine
1.1  riastrad 	 * (individually), and wait for the batch to complete. We can check
1.1  riastrad 	 * the overhead of submitting requests to the hardware.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		unsigned long n, prime;
1.1  riastrad 		IGT_TIMEOUT(end_time);
1.1  riastrad 		ktime_t times[2] = {};
1.1  riastrad
1.1  riastrad 		err = igt_live_test_begin(&t, i915, __func__, engine->name);
1.1  riastrad 		if (err)
1.1  riastrad 			return err;
1.1  riastrad
1.1  riastrad 		intel_engine_pm_get(engine);
1.1  riastrad 		for_each_prime_number_from(prime, 1, 8192) {
1.1  riastrad 			struct i915_request *request = NULL;
1.1  riastrad
1.1  riastrad 			times[1] = ktime_get_raw();
1.1  riastrad
1.1  riastrad 			for (n = 0; n < prime; n++) {
1.1  riastrad 				i915_request_put(request);
1.1  riastrad 				request = i915_request_create(engine->kernel_context);
1.1  riastrad 				if (IS_ERR(request))
1.1  riastrad 					return PTR_ERR(request);
1.1  riastrad
1.1  riastrad 				/*
1.1  riastrad 				 * This space is left intentionally blank.
1.1  riastrad 				 *
1.1  riastrad 				 * We do not actually want to perform any
1.1  riastrad 				 * action with this request, we just want
1.1  riastrad 				 * to measure the latency in allocation
1.1  riastrad 				 * and submission of our breadcrumbs -
1.1  riastrad 				 * ensuring that the bare request is sufficient
1.1  riastrad 				 * for the system to work (i.e. proper HEAD
1.1  riastrad 				 * tracking of the rings, interrupt handling,
1.1  riastrad 				 * etc). It also gives us the lowest bounds
1.1  riastrad 				 * for latency.
1.1  riastrad 				 */
1.1  riastrad
1.1  riastrad 				i915_request_get(request);
1.1  riastrad 				i915_request_add(request);
1.1  riastrad 			}
1.1  riastrad 			i915_request_wait(request, 0, MAX_SCHEDULE_TIMEOUT);
1.1  riastrad 			i915_request_put(request);
1.1  riastrad
1.1  riastrad 			times[1] = ktime_sub(ktime_get_raw(), times[1]);
1.1  riastrad 			if (prime == 1)
1.1  riastrad 				times[0] = times[1];
1.1  riastrad
1.1  riastrad 			if (__igt_timeout(end_time, NULL))
1.1  riastrad 				break;
1.1  riastrad 		}
1.1  riastrad 		intel_engine_pm_put(engine);
1.1  riastrad
1.1  riastrad 		err = igt_live_test_end(&t);
1.1  riastrad 		if (err)
1.1  riastrad 			return err;
1.1  riastrad
1.1  riastrad 		pr_info("Request latencies on %s: 1 = %lluns, %lu = %lluns\n",
1.1  riastrad 			engine->name,
1.1  riastrad 			ktime_to_ns(times[0]),
1.1  riastrad 			prime, div64_u64(ktime_to_ns(times[1]), prime));
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static struct i915_vma *empty_batch(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_gem_object *obj;
1.1  riastrad 	struct i915_vma *vma;
1.1  riastrad 	u32 *cmd;
1.1  riastrad 	int err;
1.1  riastrad
1.1  riastrad 	obj = i915_gem_object_create_internal(i915, PAGE_SIZE);
1.1  riastrad 	if (IS_ERR(obj))
1.1  riastrad 		return ERR_CAST(obj);
1.1  riastrad
1.1  riastrad 	cmd = i915_gem_object_pin_map(obj, I915_MAP_WB);
1.1  riastrad 	if (IS_ERR(cmd)) {
1.1  riastrad 		err = PTR_ERR(cmd);
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	*cmd = MI_BATCH_BUFFER_END;
1.1  riastrad
1.1  riastrad 	__i915_gem_object_flush_map(obj, 0, 64);
1.1  riastrad 	i915_gem_object_unpin_map(obj);
1.1  riastrad
1.1  riastrad 	intel_gt_chipset_flush(&i915->gt);
1.1  riastrad
1.1  riastrad 	vma = i915_vma_instance(obj, &i915->ggtt.vm, NULL);
1.1  riastrad 	if (IS_ERR(vma)) {
1.1  riastrad 		err = PTR_ERR(vma);
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = i915_vma_pin(vma, 0, 0, PIN_USER | PIN_GLOBAL);
1.1  riastrad 	if (err)
1.1  riastrad 		goto err;
1.1  riastrad
1.1  riastrad 	/* Force the wait wait now to avoid including it in the benchmark */
1.1  riastrad 	err = i915_vma_sync(vma);
1.1  riastrad 	if (err)
1.1  riastrad 		goto err_pin;
1.1  riastrad
1.1  riastrad 	return vma;
1.1  riastrad
1.1  riastrad err_pin:
1.1  riastrad 	i915_vma_unpin(vma);
1.1  riastrad err:
1.1  riastrad 	i915_gem_object_put(obj);
1.1  riastrad 	return ERR_PTR(err);
1.1  riastrad }
1.1  riastrad
1.1  riastrad static struct i915_request *
1.1  riastrad empty_request(struct intel_engine_cs *engine,
1.1  riastrad 	      struct i915_vma *batch)
1.1  riastrad {
1.1  riastrad 	struct i915_request *request;
1.1  riastrad 	int err;
1.1  riastrad
1.1  riastrad 	request = i915_request_create(engine->kernel_context);
1.1  riastrad 	if (IS_ERR(request))
1.1  riastrad 		return request;
1.1  riastrad
1.1  riastrad 	err = engine->emit_bb_start(request,
1.1  riastrad 				    batch->node.start,
1.1  riastrad 				    batch->node.size,
1.1  riastrad 				    I915_DISPATCH_SECURE);
1.1  riastrad 	if (err)
1.1  riastrad 		goto out_request;
1.1  riastrad
1.1  riastrad 	i915_request_get(request);
1.1  riastrad out_request:
1.1  riastrad 	i915_request_add(request);
1.1  riastrad 	return err ? ERR_PTR(err) : request;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_empty_request(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct igt_live_test t;
1.1  riastrad 	struct i915_vma *batch;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Submit various sized batches of empty requests, to each engine
1.1  riastrad 	 * (individually), and wait for the batch to complete. We can check
1.1  riastrad 	 * the overhead of submitting requests to the hardware.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	batch = empty_batch(i915);
1.1  riastrad 	if (IS_ERR(batch))
1.1  riastrad 		return PTR_ERR(batch);
1.1  riastrad
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		IGT_TIMEOUT(end_time);
1.1  riastrad 		struct i915_request *request;
1.1  riastrad 		unsigned long n, prime;
1.1  riastrad 		ktime_t times[2] = {};
1.1  riastrad
1.1  riastrad 		err = igt_live_test_begin(&t, i915, __func__, engine->name);
1.1  riastrad 		if (err)
1.1  riastrad 			goto out_batch;
1.1  riastrad
1.1  riastrad 		intel_engine_pm_get(engine);
1.1  riastrad
1.1  riastrad 		/* Warmup / preload */
1.1  riastrad 		request = empty_request(engine, batch);
1.1  riastrad 		if (IS_ERR(request)) {
1.1  riastrad 			err = PTR_ERR(request);
1.1  riastrad 			intel_engine_pm_put(engine);
1.1  riastrad 			goto out_batch;
1.1  riastrad 		}
1.1  riastrad 		i915_request_wait(request, 0, MAX_SCHEDULE_TIMEOUT);
1.1  riastrad
1.1  riastrad 		for_each_prime_number_from(prime, 1, 8192) {
1.1  riastrad 			times[1] = ktime_get_raw();
1.1  riastrad
1.1  riastrad 			for (n = 0; n < prime; n++) {
1.1  riastrad 				i915_request_put(request);
1.1  riastrad 				request = empty_request(engine, batch);
1.1  riastrad 				if (IS_ERR(request)) {
1.1  riastrad 					err = PTR_ERR(request);
1.1  riastrad 					intel_engine_pm_put(engine);
1.1  riastrad 					goto out_batch;
1.1  riastrad 				}
1.1  riastrad 			}
1.1  riastrad 			i915_request_wait(request, 0, MAX_SCHEDULE_TIMEOUT);
1.1  riastrad
1.1  riastrad 			times[1] = ktime_sub(ktime_get_raw(), times[1]);
1.1  riastrad 			if (prime == 1)
1.1  riastrad 				times[0] = times[1];
1.1  riastrad
1.1  riastrad 			if (__igt_timeout(end_time, NULL))
1.1  riastrad 				break;
1.1  riastrad 		}
1.1  riastrad 		i915_request_put(request);
1.1  riastrad 		intel_engine_pm_put(engine);
1.1  riastrad
1.1  riastrad 		err = igt_live_test_end(&t);
1.1  riastrad 		if (err)
1.1  riastrad 			goto out_batch;
1.1  riastrad
1.1  riastrad 		pr_info("Batch latencies on %s: 1 = %lluns, %lu = %lluns\n",
1.1  riastrad 			engine->name,
1.1  riastrad 			ktime_to_ns(times[0]),
1.1  riastrad 			prime, div64_u64(ktime_to_ns(times[1]), prime));
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad out_batch:
1.1  riastrad 	i915_vma_unpin(batch);
1.1  riastrad 	i915_vma_put(batch);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static struct i915_vma *recursive_batch(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_gem_object *obj;
1.1  riastrad 	const int gen = INTEL_GEN(i915);
1.1  riastrad 	struct i915_vma *vma;
1.1  riastrad 	u32 *cmd;
1.1  riastrad 	int err;
1.1  riastrad
1.1  riastrad 	obj = i915_gem_object_create_internal(i915, PAGE_SIZE);
1.1  riastrad 	if (IS_ERR(obj))
1.1  riastrad 		return ERR_CAST(obj);
1.1  riastrad
1.1  riastrad 	vma = i915_vma_instance(obj, i915->gt.vm, NULL);
1.1  riastrad 	if (IS_ERR(vma)) {
1.1  riastrad 		err = PTR_ERR(vma);
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = i915_vma_pin(vma, 0, 0, PIN_USER);
1.1  riastrad 	if (err)
1.1  riastrad 		goto err;
1.1  riastrad
1.1  riastrad 	cmd = i915_gem_object_pin_map(obj, I915_MAP_WC);
1.1  riastrad 	if (IS_ERR(cmd)) {
1.1  riastrad 		err = PTR_ERR(cmd);
1.1  riastrad 		goto err;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	if (gen >= 8) {
1.1  riastrad 		*cmd++ = MI_BATCH_BUFFER_START | 1 << 8 | 1;
1.1  riastrad 		*cmd++ = lower_32_bits(vma->node.start);
1.1  riastrad 		*cmd++ = upper_32_bits(vma->node.start);
1.1  riastrad 	} else if (gen >= 6) {
1.1  riastrad 		*cmd++ = MI_BATCH_BUFFER_START | 1 << 8;
1.1  riastrad 		*cmd++ = lower_32_bits(vma->node.start);
1.1  riastrad 	} else {
1.1  riastrad 		*cmd++ = MI_BATCH_BUFFER_START | MI_BATCH_GTT;
1.1  riastrad 		*cmd++ = lower_32_bits(vma->node.start);
1.1  riastrad 	}
1.1  riastrad 	*cmd++ = MI_BATCH_BUFFER_END; /* terminate early in case of error */
1.1  riastrad
1.1  riastrad 	__i915_gem_object_flush_map(obj, 0, 64);
1.1  riastrad 	i915_gem_object_unpin_map(obj);
1.1  riastrad
1.1  riastrad 	intel_gt_chipset_flush(&i915->gt);
1.1  riastrad
1.1  riastrad 	return vma;
1.1  riastrad
1.1  riastrad err:
1.1  riastrad 	i915_gem_object_put(obj);
1.1  riastrad 	return ERR_PTR(err);
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int recursive_batch_resolve(struct i915_vma *batch)
1.1  riastrad {
1.1  riastrad 	u32 *cmd;
1.1  riastrad
1.1  riastrad 	cmd = i915_gem_object_pin_map(batch->obj, I915_MAP_WC);
1.1  riastrad 	if (IS_ERR(cmd))
1.1  riastrad 		return PTR_ERR(cmd);
1.1  riastrad
1.1  riastrad 	*cmd = MI_BATCH_BUFFER_END;
1.1  riastrad 	intel_gt_chipset_flush(batch->vm->gt);
1.1  riastrad
1.1  riastrad 	i915_gem_object_unpin_map(batch->obj);
1.1  riastrad
1.1  riastrad 	return 0;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_all_engines(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	const unsigned int nengines = num_uabi_engines(i915);
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct i915_request **request;
1.1  riastrad 	struct igt_live_test t;
1.1  riastrad 	struct i915_vma *batch;
1.1  riastrad 	unsigned int idx;
1.1  riastrad 	int err;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Check we can submit requests to all engines simultaneously. We
1.1  riastrad 	 * send a recursive batch to each engine - checking that we don't
1.1  riastrad 	 * block doing so, and that they don't complete too soon.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	request = kcalloc(nengines, sizeof(*request), GFP_KERNEL);
1.1  riastrad 	if (!request)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	err = igt_live_test_begin(&t, i915, __func__, "");
1.1  riastrad 	if (err)
1.1  riastrad 		goto out_free;
1.1  riastrad
1.1  riastrad 	batch = recursive_batch(i915);
1.1  riastrad 	if (IS_ERR(batch)) {
1.1  riastrad 		err = PTR_ERR(batch);
1.1  riastrad 		pr_err("%s: Unable to create batch, err=%d\n", __func__, err);
1.1  riastrad 		goto out_free;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		request[idx] = intel_engine_create_kernel_request(engine);
1.1  riastrad 		if (IS_ERR(request[idx])) {
1.1  riastrad 			err = PTR_ERR(request[idx]);
1.1  riastrad 			pr_err("%s: Request allocation failed with err=%d\n",
1.1  riastrad 			       __func__, err);
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		err = engine->emit_bb_start(request[idx],
1.1  riastrad 					    batch->node.start,
1.1  riastrad 					    batch->node.size,
1.1  riastrad 					    0);
1.1  riastrad 		GEM_BUG_ON(err);
1.1  riastrad 		request[idx]->batch = batch;
1.1  riastrad
1.1  riastrad 		i915_vma_lock(batch);
1.1  riastrad 		err = i915_request_await_object(request[idx], batch->obj, 0);
1.1  riastrad 		if (err == 0)
1.1  riastrad 			err = i915_vma_move_to_active(batch, request[idx], 0);
1.1  riastrad 		i915_vma_unlock(batch);
1.1  riastrad 		GEM_BUG_ON(err);
1.1  riastrad
1.1  riastrad 		i915_request_get(request[idx]);
1.1  riastrad 		i915_request_add(request[idx]);
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		if (i915_request_completed(request[idx])) {
1.1  riastrad 			pr_err("%s(%s): request completed too early!\n",
1.1  riastrad 			       __func__, engine->name);
1.1  riastrad 			err = -EINVAL;
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = recursive_batch_resolve(batch);
1.1  riastrad 	if (err) {
1.1  riastrad 		pr_err("%s: failed to resolve batch, err=%d\n", __func__, err);
1.1  riastrad 		goto out_request;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		long timeout;
1.1  riastrad
1.1  riastrad 		timeout = i915_request_wait(request[idx], 0,
1.1  riastrad 					    MAX_SCHEDULE_TIMEOUT);
1.1  riastrad 		if (timeout < 0) {
1.1  riastrad 			err = timeout;
1.1  riastrad 			pr_err("%s: error waiting for request on %s, err=%d\n",
1.1  riastrad 			       __func__, engine->name, err);
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		GEM_BUG_ON(!i915_request_completed(request[idx]));
1.1  riastrad 		i915_request_put(request[idx]);
1.1  riastrad 		request[idx] = NULL;
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = igt_live_test_end(&t);
1.1  riastrad
1.1  riastrad out_request:
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		if (request[idx])
1.1  riastrad 			i915_request_put(request[idx]);
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad 	i915_vma_unpin(batch);
1.1  riastrad 	i915_vma_put(batch);
1.1  riastrad out_free:
1.1  riastrad 	kfree(request);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_sequential_engines(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	const unsigned int nengines = num_uabi_engines(i915);
1.1  riastrad 	struct i915_request **request;
1.1  riastrad 	struct i915_request *prev = NULL;
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct igt_live_test t;
1.1  riastrad 	unsigned int idx;
1.1  riastrad 	int err;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Check we can submit requests to all engines sequentially, such
1.1  riastrad 	 * that each successive request waits for the earlier ones. This
1.1  riastrad 	 * tests that we don't execute requests out of order, even though
1.1  riastrad 	 * they are running on independent engines.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	request = kcalloc(nengines, sizeof(*request), GFP_KERNEL);
1.1  riastrad 	if (!request)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	err = igt_live_test_begin(&t, i915, __func__, "");
1.1  riastrad 	if (err)
1.1  riastrad 		goto out_free;
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		struct i915_vma *batch;
1.1  riastrad
1.1  riastrad 		batch = recursive_batch(i915);
1.1  riastrad 		if (IS_ERR(batch)) {
1.1  riastrad 			err = PTR_ERR(batch);
1.1  riastrad 			pr_err("%s: Unable to create batch for %s, err=%d\n",
1.1  riastrad 			       __func__, engine->name, err);
1.1  riastrad 			goto out_free;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		request[idx] = intel_engine_create_kernel_request(engine);
1.1  riastrad 		if (IS_ERR(request[idx])) {
1.1  riastrad 			err = PTR_ERR(request[idx]);
1.1  riastrad 			pr_err("%s: Request allocation failed for %s with err=%d\n",
1.1  riastrad 			       __func__, engine->name, err);
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		if (prev) {
1.1  riastrad 			err = i915_request_await_dma_fence(request[idx],
1.1  riastrad 							   &prev->fence);
1.1  riastrad 			if (err) {
1.1  riastrad 				i915_request_add(request[idx]);
1.1  riastrad 				pr_err("%s: Request await failed for %s with err=%d\n",
1.1  riastrad 				       __func__, engine->name, err);
1.1  riastrad 				goto out_request;
1.1  riastrad 			}
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		err = engine->emit_bb_start(request[idx],
1.1  riastrad 					    batch->node.start,
1.1  riastrad 					    batch->node.size,
1.1  riastrad 					    0);
1.1  riastrad 		GEM_BUG_ON(err);
1.1  riastrad 		request[idx]->batch = batch;
1.1  riastrad
1.1  riastrad 		i915_vma_lock(batch);
1.1  riastrad 		err = i915_request_await_object(request[idx],
1.1  riastrad 						batch->obj, false);
1.1  riastrad 		if (err == 0)
1.1  riastrad 			err = i915_vma_move_to_active(batch, request[idx], 0);
1.1  riastrad 		i915_vma_unlock(batch);
1.1  riastrad 		GEM_BUG_ON(err);
1.1  riastrad
1.1  riastrad 		i915_request_get(request[idx]);
1.1  riastrad 		i915_request_add(request[idx]);
1.1  riastrad
1.1  riastrad 		prev = request[idx];
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		long timeout;
1.1  riastrad
1.1  riastrad 		if (i915_request_completed(request[idx])) {
1.1  riastrad 			pr_err("%s(%s): request completed too early!\n",
1.1  riastrad 			       __func__, engine->name);
1.1  riastrad 			err = -EINVAL;
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		err = recursive_batch_resolve(request[idx]->batch);
1.1  riastrad 		if (err) {
1.1  riastrad 			pr_err("%s: failed to resolve batch, err=%d\n",
1.1  riastrad 			       __func__, err);
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		timeout = i915_request_wait(request[idx], 0,
1.1  riastrad 					    MAX_SCHEDULE_TIMEOUT);
1.1  riastrad 		if (timeout < 0) {
1.1  riastrad 			err = timeout;
1.1  riastrad 			pr_err("%s: error waiting for request on %s, err=%d\n",
1.1  riastrad 			       __func__, engine->name, err);
1.1  riastrad 			goto out_request;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		GEM_BUG_ON(!i915_request_completed(request[idx]));
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	err = igt_live_test_end(&t);
1.1  riastrad
1.1  riastrad out_request:
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		u32 *cmd;
1.1  riastrad
1.1  riastrad 		if (!request[idx])
1.1  riastrad 			break;
1.1  riastrad
1.1  riastrad 		cmd = i915_gem_object_pin_map(request[idx]->batch->obj,
1.1  riastrad 					      I915_MAP_WC);
1.1  riastrad 		if (!IS_ERR(cmd)) {
1.1  riastrad 			*cmd = MI_BATCH_BUFFER_END;
1.1  riastrad 			intel_gt_chipset_flush(engine->gt);
1.1  riastrad
1.1  riastrad 			i915_gem_object_unpin_map(request[idx]->batch->obj);
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		i915_vma_put(request[idx]->batch);
1.1  riastrad 		i915_request_put(request[idx]);
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad out_free:
1.1  riastrad 	kfree(request);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int __live_parallel_engine1(void *arg)
1.1  riastrad {
1.1  riastrad 	struct intel_engine_cs *engine = arg;
1.1  riastrad 	IGT_TIMEOUT(end_time);
1.1  riastrad 	unsigned long count;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	count = 0;
1.1  riastrad 	intel_engine_pm_get(engine);
1.1  riastrad 	do {
1.1  riastrad 		struct i915_request *rq;
1.1  riastrad
1.1  riastrad 		rq = i915_request_create(engine->kernel_context);
1.1  riastrad 		if (IS_ERR(rq)) {
1.1  riastrad 			err = PTR_ERR(rq);
1.1  riastrad 			break;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		i915_request_get(rq);
1.1  riastrad 		i915_request_add(rq);
1.1  riastrad
1.1  riastrad 		err = 0;
1.1  riastrad 		if (i915_request_wait(rq, 0, HZ / 5) < 0)
1.1  riastrad 			err = -ETIME;
1.1  riastrad 		i915_request_put(rq);
1.1  riastrad 		if (err)
1.1  riastrad 			break;
1.1  riastrad
1.1  riastrad 		count++;
1.1  riastrad 	} while (!__igt_timeout(end_time, NULL));
1.1  riastrad 	intel_engine_pm_put(engine);
1.1  riastrad
1.1  riastrad 	pr_info("%s: %lu request + sync\n", engine->name, count);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int __live_parallel_engineN(void *arg)
1.1  riastrad {
1.1  riastrad 	struct intel_engine_cs *engine = arg;
1.1  riastrad 	IGT_TIMEOUT(end_time);
1.1  riastrad 	unsigned long count;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	count = 0;
1.1  riastrad 	intel_engine_pm_get(engine);
1.1  riastrad 	do {
1.1  riastrad 		struct i915_request *rq;
1.1  riastrad
1.1  riastrad 		rq = i915_request_create(engine->kernel_context);
1.1  riastrad 		if (IS_ERR(rq)) {
1.1  riastrad 			err = PTR_ERR(rq);
1.1  riastrad 			break;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		i915_request_add(rq);
1.1  riastrad 		count++;
1.1  riastrad 	} while (!__igt_timeout(end_time, NULL));
1.1  riastrad 	intel_engine_pm_put(engine);
1.1  riastrad
1.1  riastrad 	pr_info("%s: %lu requests\n", engine->name, count);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static bool wake_all(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	if (atomic_dec_and_test(&i915->selftest.counter)) {
1.1  riastrad 		wake_up_var(&i915->selftest.counter);
1.1  riastrad 		return true;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	return false;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int wait_for_all(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	if (wake_all(i915))
1.1  riastrad 		return 0;
1.1  riastrad
1.1  riastrad 	if (wait_var_event_timeout(&i915->selftest.counter,
1.1  riastrad 				   !atomic_read(&i915->selftest.counter),
1.1  riastrad 				   i915_selftest.timeout_jiffies))
1.1  riastrad 		return 0;
1.1  riastrad
1.1  riastrad 	return -ETIME;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int __live_parallel_spin(void *arg)
1.1  riastrad {
1.1  riastrad 	struct intel_engine_cs *engine = arg;
1.1  riastrad 	struct igt_spinner spin;
1.1  riastrad 	struct i915_request *rq;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Create a spinner running for eternity on each engine. If a second
1.1  riastrad 	 * spinner is incorrectly placed on the same engine, it will not be
1.1  riastrad 	 * able to start in time.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	if (igt_spinner_init(&spin, engine->gt)) {
1.1  riastrad 		wake_all(engine->i915);
1.1  riastrad 		return -ENOMEM;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	intel_engine_pm_get(engine);
1.1  riastrad 	rq = igt_spinner_create_request(&spin,
1.1  riastrad 					engine->kernel_context,
1.1  riastrad 					MI_NOOP); /* no preemption */
1.1  riastrad 	intel_engine_pm_put(engine);
1.1  riastrad 	if (IS_ERR(rq)) {
1.1  riastrad 		err = PTR_ERR(rq);
1.1  riastrad 		if (err == -ENODEV)
1.1  riastrad 			err = 0;
1.1  riastrad 		wake_all(engine->i915);
1.1  riastrad 		goto out_spin;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	i915_request_get(rq);
1.1  riastrad 	i915_request_add(rq);
1.1  riastrad 	if (igt_wait_for_spinner(&spin, rq)) {
1.1  riastrad 		/* Occupy this engine for the whole test */
1.1  riastrad 		err = wait_for_all(engine->i915);
1.1  riastrad 	} else {
1.1  riastrad 		pr_err("Failed to start spinner on %s\n", engine->name);
1.1  riastrad 		err = -EINVAL;
1.1  riastrad 	}
1.1  riastrad 	igt_spinner_end(&spin);
1.1  riastrad
1.1  riastrad 	if (err == 0 && i915_request_wait(rq, 0, HZ / 5) < 0)
1.1  riastrad 		err = -EIO;
1.1  riastrad 	i915_request_put(rq);
1.1  riastrad
1.1  riastrad out_spin:
1.1  riastrad 	igt_spinner_fini(&spin);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_parallel_engines(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	static int (* const func[])(void *arg) = {
1.1  riastrad 		__live_parallel_engine1,
1.1  riastrad 		__live_parallel_engineN,
1.1  riastrad 		__live_parallel_spin,
1.1  riastrad 		NULL,
1.1  riastrad 	};
1.1  riastrad 	const unsigned int nengines = num_uabi_engines(i915);
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	int (* const *fn)(void *arg);
1.1  riastrad 	struct task_struct **tsk;
1.1  riastrad 	int err = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Check we can submit requests to all engines concurrently. This
1.1  riastrad 	 * tests that we load up the system maximally.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	tsk = kcalloc(nengines, sizeof(*tsk), GFP_KERNEL);
1.1  riastrad 	if (!tsk)
1.1  riastrad 		return -ENOMEM;
1.1  riastrad
1.1  riastrad 	for (fn = func; !err && *fn; fn++) {
1.1  riastrad 		char name[KSYM_NAME_LEN];
1.1  riastrad 		struct igt_live_test t;
1.1  riastrad 		unsigned int idx;
1.1  riastrad
1.1  riastrad 		snprintf(name, sizeof(name), "%pS", fn);
1.1  riastrad 		err = igt_live_test_begin(&t, i915, __func__, name);
1.1  riastrad 		if (err)
1.1  riastrad 			break;
1.1  riastrad
1.1  riastrad 		atomic_set(&i915->selftest.counter, nengines);
1.1  riastrad
1.1  riastrad 		idx = 0;
1.1  riastrad 		for_each_uabi_engine(engine, i915) {
1.1  riastrad 			tsk[idx] = kthread_run(*fn, engine,
1.1  riastrad 					       "igt/parallel:%s",
1.1  riastrad 					       engine->name);
1.1  riastrad 			if (IS_ERR(tsk[idx])) {
1.1  riastrad 				err = PTR_ERR(tsk[idx]);
1.1  riastrad 				break;
1.1  riastrad 			}
1.1  riastrad 			get_task_struct(tsk[idx++]);
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		yield(); /* start all threads before we kthread_stop() */
1.1  riastrad
1.1  riastrad 		idx = 0;
1.1  riastrad 		for_each_uabi_engine(engine, i915) {
1.1  riastrad 			int status;
1.1  riastrad
1.1  riastrad 			if (IS_ERR(tsk[idx]))
1.1  riastrad 				break;
1.1  riastrad
1.1  riastrad 			status = kthread_stop(tsk[idx]);
1.1  riastrad 			if (status && !err)
1.1  riastrad 				err = status;
1.1  riastrad
1.1  riastrad 			put_task_struct(tsk[idx++]);
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		if (igt_live_test_end(&t))
1.1  riastrad 			err = -EIO;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	kfree(tsk);
1.1  riastrad 	return err;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int
1.1  riastrad max_batches(struct i915_gem_context *ctx, struct intel_engine_cs *engine)
1.1  riastrad {
1.1  riastrad 	struct i915_request *rq;
1.1  riastrad 	int ret;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Before execlists, all contexts share the same ringbuffer. With
1.1  riastrad 	 * execlists, each context/engine has a separate ringbuffer and
1.1  riastrad 	 * for the purposes of this test, inexhaustible.
1.1  riastrad 	 *
1.1  riastrad 	 * For the global ringbuffer though, we have to be very careful
1.1  riastrad 	 * that we do not wrap while preventing the execution of requests
1.1  riastrad 	 * with a unsignaled fence.
1.1  riastrad 	 */
1.1  riastrad 	if (HAS_EXECLISTS(ctx->i915))
1.1  riastrad 		return INT_MAX;
1.1  riastrad
1.1  riastrad 	rq = igt_request_alloc(ctx, engine);
1.1  riastrad 	if (IS_ERR(rq)) {
1.1  riastrad 		ret = PTR_ERR(rq);
1.1  riastrad 	} else {
1.1  riastrad 		int sz;
1.1  riastrad
1.1  riastrad 		ret = rq->ring->size - rq->reserved_space;
1.1  riastrad 		i915_request_add(rq);
1.1  riastrad
1.1  riastrad 		sz = rq->ring->emit - rq->head;
1.1  riastrad 		if (sz < 0)
1.1  riastrad 			sz += rq->ring->size;
1.1  riastrad 		ret /= sz;
1.1  riastrad 		ret /= 2; /* leave half spare, in case of emergency! */
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	return ret;
1.1  riastrad }
1.1  riastrad
1.1  riastrad static int live_breadcrumbs_smoketest(void *arg)
1.1  riastrad {
1.1  riastrad 	struct drm_i915_private *i915 = arg;
1.1  riastrad 	const unsigned int nengines = num_uabi_engines(i915);
1.1  riastrad 	const unsigned int ncpus = num_online_cpus();
1.1  riastrad 	unsigned long num_waits, num_fences;
1.1  riastrad 	struct intel_engine_cs *engine;
1.1  riastrad 	struct task_struct **threads;
1.1  riastrad 	struct igt_live_test live;
1.1  riastrad 	intel_wakeref_t wakeref;
1.1  riastrad 	struct smoketest *smoke;
1.1  riastrad 	unsigned int n, idx;
1.1  riastrad 	struct file *file;
1.1  riastrad 	int ret = 0;
1.1  riastrad
1.1  riastrad 	/*
1.1  riastrad 	 * Smoketest our breadcrumb/signal handling for requests across multiple
1.1  riastrad 	 * threads. A very simple test to only catch the most egregious of bugs.
1.1  riastrad 	 * See __igt_breadcrumbs_smoketest();
1.1  riastrad 	 *
1.1  riastrad 	 * On real hardware this time.
1.1  riastrad 	 */
1.1  riastrad
1.1  riastrad 	wakeref = intel_runtime_pm_get(&i915->runtime_pm);
1.1  riastrad
1.1  riastrad 	file = mock_file(i915);
1.1  riastrad 	if (IS_ERR(file)) {
1.1  riastrad 		ret = PTR_ERR(file);
1.1  riastrad 		goto out_rpm;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	smoke = kcalloc(nengines, sizeof(*smoke), GFP_KERNEL);
1.1  riastrad 	if (!smoke) {
1.1  riastrad 		ret = -ENOMEM;
1.1  riastrad 		goto out_file;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	threads = kcalloc(ncpus * nengines, sizeof(*threads), GFP_KERNEL);
1.1  riastrad 	if (!threads) {
1.1  riastrad 		ret = -ENOMEM;
1.1  riastrad 		goto out_smoke;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	smoke[0].request_alloc = __live_request_alloc;
1.1  riastrad 	smoke[0].ncontexts = 64;
1.1  riastrad 	smoke[0].contexts = kcalloc(smoke[0].ncontexts,
1.1  riastrad 				    sizeof(*smoke[0].contexts),
1.1  riastrad 				    GFP_KERNEL);
1.1  riastrad 	if (!smoke[0].contexts) {
1.1  riastrad 		ret = -ENOMEM;
1.1  riastrad 		goto out_threads;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	for (n = 0; n < smoke[0].ncontexts; n++) {
1.1  riastrad 		smoke[0].contexts[n] = live_context(i915, file);
1.1  riastrad 		if (!smoke[0].contexts[n]) {
1.1  riastrad 			ret = -ENOMEM;
1.1  riastrad 			goto out_contexts;
1.1  riastrad 		}
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	ret = igt_live_test_begin(&live, i915, __func__, "");
1.1  riastrad 	if (ret)
1.1  riastrad 		goto out_contexts;
1.1  riastrad
1.1  riastrad 	idx = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		smoke[idx] = smoke[0];
1.1  riastrad 		smoke[idx].engine = engine;
1.1  riastrad 		smoke[idx].max_batch =
1.1  riastrad 			max_batches(smoke[0].contexts[0], engine);
1.1  riastrad 		if (smoke[idx].max_batch < 0) {
1.1  riastrad 			ret = smoke[idx].max_batch;
1.1  riastrad 			goto out_flush;
1.1  riastrad 		}
1.1  riastrad 		/* One ring interleaved between requests from all cpus */
1.1  riastrad 		smoke[idx].max_batch /= num_online_cpus() + 1;
1.1  riastrad 		pr_debug("Limiting batches to %d requests on %s\n",
1.1  riastrad 			 smoke[idx].max_batch, engine->name);
1.1  riastrad
1.1  riastrad 		for (n = 0; n < ncpus; n++) {
1.1  riastrad 			struct task_struct *tsk;
1.1  riastrad
1.1  riastrad 			tsk = kthread_run(__igt_breadcrumbs_smoketest,
1.1  riastrad 					  &smoke[idx], "igt/%d.%d", idx, n);
1.1  riastrad 			if (IS_ERR(tsk)) {
1.1  riastrad 				ret = PTR_ERR(tsk);
1.1  riastrad 				goto out_flush;
1.1  riastrad 			}
1.1  riastrad
1.1  riastrad 			get_task_struct(tsk);
1.1  riastrad 			threads[idx * ncpus + n] = tsk;
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad
1.1  riastrad 	yield(); /* start all threads before we begin */
1.1  riastrad 	msleep(jiffies_to_msecs(i915_selftest.timeout_jiffies));
1.1  riastrad
1.1  riastrad out_flush:
1.1  riastrad 	idx = 0;
1.1  riastrad 	num_waits = 0;
1.1  riastrad 	num_fences = 0;
1.1  riastrad 	for_each_uabi_engine(engine, i915) {
1.1  riastrad 		for (n = 0; n < ncpus; n++) {
1.1  riastrad 			struct task_struct *tsk = threads[idx * ncpus + n];
1.1  riastrad 			int err;
1.1  riastrad
1.1  riastrad 			if (!tsk)
1.1  riastrad 				continue;
1.1  riastrad
1.1  riastrad 			err = kthread_stop(tsk);
1.1  riastrad 			if (err < 0 && !ret)
1.1  riastrad 				ret = err;
1.1  riastrad
1.1  riastrad 			put_task_struct(tsk);
1.1  riastrad 		}
1.1  riastrad
1.1  riastrad 		num_waits += atomic_long_read(&smoke[idx].num_waits);
1.1  riastrad 		num_fences += atomic_long_read(&smoke[idx].num_fences);
1.1  riastrad 		idx++;
1.1  riastrad 	}
1.1  riastrad 	pr_info("Completed %lu waits for %lu fences across %d engines and %d cpus\n",
1.1  riastrad 		num_waits, num_fences, RUNTIME_INFO(i915)->num_engines, ncpus);
1.1  riastrad
1.1  riastrad 	ret = igt_live_test_end(&live) ?: ret;
1.1  riastrad out_contexts:
1.1  riastrad 	kfree(smoke[0].contexts);
1.1  riastrad out_threads:
1.1  riastrad 	kfree(threads);
1.1  riastrad out_smoke:
1.1  riastrad 	kfree(smoke);
1.1  riastrad out_file:
1.1  riastrad 	fput(file);
1.1  riastrad out_rpm:
1.1  riastrad 	intel_runtime_pm_put(&i915->runtime_pm, wakeref);
1.1  riastrad
1.1  riastrad 	return ret;
1.1  riastrad }
1.1  riastrad
1.1  riastrad int i915_request_live_selftests(struct drm_i915_private *i915)
1.1  riastrad {
1.1  riastrad 	static const struct i915_subtest tests[] = {
1.1  riastrad 		SUBTEST(live_nop_request),
1.1  riastrad 		SUBTEST(live_all_engines),
1.1  riastrad 		SUBTEST(live_sequential_engines),
1.1  riastrad 		SUBTEST(live_parallel_engines),
1.1  riastrad 		SUBTEST(live_empty_request),
1.1  riastrad 		SUBTEST(live_breadcrumbs_smoketest),
1.1  riastrad 	};
1.1  riastrad
1.1  riastrad 	if (intel_gt_is_wedged(&i915->gt))
1.1  riastrad 		return 0;
1.1  riastrad
1.1  riastrad 	return i915_subtests(tests, i915);
1.1  riastrad }