Merge remote branch 'origin/master' into pipe-video

[mesa.git] / src / mesa / drivers / dri / i965 / brw_wm_emit.c
diff --git a/src/mesa/drivers/dri/i965/brw_wm_emit.c b/src/mesa/drivers/dri/i965/brw_wm_emit.c

index 9be3bfbbfe2d06a9c8d88c9e404bf6202bcaa467..a0e86034e1e2cd7d352f3b556b23322377b436d0 100644 (file)
--- a/src/mesa/drivers/dri/i965/brw_wm_emit.c
+++ b/src/mesa/drivers/dri/i965/brw_wm_emit.c
@@ -83,6 +83,7 @@ brw_wm_arg_can_be_immediate(enum prog_opcode opcode, int arg)
        [OPCODE_SLE] = 2,
        [OPCODE_SLT] = 2,
        [OPCODE_SNE] = 2,
+      [OPCODE_SWZ] = 1,
        [OPCODE_XPD] = 2,
     };
  
@@ -173,6 +174,7 @@ void emit_delta_xy(struct brw_compile *p,
                    GLuint mask,
                    const struct brw_reg *arg0)
  {
+   struct intel_context *intel = &p->brw->intel;
     struct brw_reg r1 = brw_vec1_grf(1, 0);
  
     if (mask == 0)
@@ -180,6 +182,21 @@ void emit_delta_xy(struct brw_compile *p,
  
     assert(mask == WRITEMASK_XY);
  
+   if (intel->gen >= 6) {
+       /* XXX Gen6 WM doesn't have Xstart/Ystart in payload r1.0/r1.1.
+         Just add them with 0.0 for dst reg.. */
+       r1 = brw_imm_v(0x00000000);
+       brw_ADD(p,
+              dst[0],
+              retype(arg0[0], BRW_REGISTER_TYPE_UW),
+              r1);
+       brw_ADD(p,
+              dst[1],
+              retype(arg0[1], BRW_REGISTER_TYPE_UW),
+              r1);
+       return;
+   }
+
     /* Calc delta X,Y by subtracting origin in r1 from the pixel
      * centers produced by emit_pixel_xy().
      */
@@ -253,6 +270,13 @@ void emit_pixel_w(struct brw_wm_compile *c,
  {
     struct brw_compile *p = &c->func;
     struct intel_context *intel = &p->brw->intel;
+   struct brw_reg src;
+   struct brw_reg temp_dst;
+
+   if (intel->gen >= 6)
+       temp_dst = dst[3];
+   else
+       temp_dst = brw_message_reg(2);
  
     assert(intel->gen < 6);
  
@@ -266,24 +290,29 @@ void emit_pixel_w(struct brw_wm_compile *c,
         * result straight into a message reg.
         */
        if (can_do_pln(intel, deltas)) {
-        brw_PLN(p, brw_message_reg(2), interp3, deltas[0]);
+        brw_PLN(p, temp_dst, interp3, deltas[0]);
        } else {
          brw_LINE(p, brw_null_reg(), interp3, deltas[0]);
-        brw_MAC(p, brw_message_reg(2), suboffset(interp3, 1), deltas[1]);
+        brw_MAC(p, temp_dst, suboffset(interp3, 1), deltas[1]);
        }
  
        /* Calc w */
+      if (intel->gen >= 6)
+        src = temp_dst;
+      else
+        src = brw_null_reg();
+
        if (c->dispatch_width == 16) {
          brw_math_16(p, dst[3],
                      BRW_MATH_FUNCTION_INV,
                      BRW_MATH_SATURATE_NONE,
-                    2, brw_null_reg(),
+                    2, src,
                      BRW_MATH_PRECISION_FULL);
        } else {
          brw_math(p, dst[3],
                   BRW_MATH_FUNCTION_INV,
                   BRW_MATH_SATURATE_NONE,
-                 2, brw_null_reg(),
+                 2, src,
                   BRW_MATH_DATA_VECTOR,
                   BRW_MATH_PRECISION_FULL);
        }
@@ -867,11 +896,16 @@ void emit_math1(struct brw_wm_compile *c,
                       BRW_MATH_SATURATE_NONE);
     struct brw_reg src;
  
-   if (intel->gen >= 6 && arg0[0].hstride == BRW_HORIZONTAL_STRIDE_0) {
-      /* Gen6 math requires that source and dst horizontal stride be 1.
+   if (intel->gen >= 6 && ((arg0[0].hstride == BRW_HORIZONTAL_STRIDE_0 ||
+                           arg0[0].file != BRW_GENERAL_REGISTER_FILE) ||
+                          arg0[0].negate || arg0[0].abs)) {
+      /* Gen6 math requires that source and dst horizontal stride be 1,
+       * and that the argument be in the GRF.
         *
+       * The hardware ignores source modifiers (negate and abs) on math
+       * instructions, so we also move to a temp to set those up.
         */
-      src = *dst;
+      src = dst[dst_chan];
        brw_MOV(p, src, arg0[0]);
     } else {
        src = arg0[0];
@@ -1102,7 +1136,7 @@ void emit_tex(struct brw_wm_compile *c,
  
     /* Fill in the shadow comparison reference value. */
     if (shadow) {
-      if (intel->gen == 5) {
+      if (intel->gen >= 5) {
          /* Fill in the cube map array index value. */
          brw_MOV(p, brw_message_reg(cur_mrf), brw_imm_f(0));
          cur_mrf += mrf_per_channel;
@@ -1115,7 +1149,7 @@ void emit_tex(struct brw_wm_compile *c,
        cur_mrf += mrf_per_channel;
     }
  
-   if (intel->gen == 5) {
+   if (intel->gen >= 5) {
        if (shadow)
          msg_type = BRW_SAMPLER_MESSAGE_SAMPLE_COMPARE_GEN5;
        else
@@ -1168,7 +1202,7 @@ void emit_txb(struct brw_wm_compile *c,
      * from mattering.
      */
     if (c->dispatch_width == 16 || intel->gen < 5) {
-      if (intel->gen == 5)
+      if (intel->gen >= 5)
          msg_type = BRW_SAMPLER_MESSAGE_SAMPLE_BIAS_GEN5;
        else
          msg_type = BRW_SAMPLER_MESSAGE_SIMD16_SAMPLE_BIAS;
@@ -1271,9 +1305,15 @@ static void emit_kil( struct brw_wm_compile *c,
                       struct brw_reg *arg0)
  {
     struct brw_compile *p = &c->func;
-   struct brw_reg r0uw = retype(brw_vec1_grf(0, 0), BRW_REGISTER_TYPE_UW);
+   struct intel_context *intel = &p->brw->intel;
+   struct brw_reg pixelmask;
     GLuint i, j;
  
+   if (intel->gen >= 6)
+      pixelmask = retype(brw_vec1_grf(1, 7), BRW_REGISTER_TYPE_UW);
+   else
+      pixelmask = retype(brw_vec1_grf(0, 0), BRW_REGISTER_TYPE_UW);
+
     for (i = 0; i < 4; i++) {
        /* Check if we've already done the comparison for this reg
         * -- common when someone does KIL TEMP.wwww.
@@ -1289,26 +1329,11 @@ static void emit_kil( struct brw_wm_compile *c,
        brw_CMP(p, brw_null_reg(), BRW_CONDITIONAL_GE, arg0[i], brw_imm_f(0));   
        brw_set_predicate_control_flag_value(p, 0xff);
        brw_set_compression_control(p, BRW_COMPRESSION_NONE);
-      brw_AND(p, r0uw, brw_flag_reg(), r0uw);
+      brw_AND(p, pixelmask, brw_flag_reg(), pixelmask);
        brw_pop_insn_state(p);
     }
  }
  
-/* KIL_NV kills the pixels that are currently executing, not based on a test
- * of the arguments.
- */
-void emit_kil_nv( struct brw_wm_compile *c )
-{
-   struct brw_compile *p = &c->func;
-   struct brw_reg r0uw = retype(brw_vec1_grf(0, 0), BRW_REGISTER_TYPE_UW);
-
-   brw_push_insn_state(p);
-   brw_set_mask_control(p, BRW_MASK_DISABLE);
-   brw_NOT(p, c->emit_mask_reg, brw_mask_reg(1)); /* IMASK */
-   brw_AND(p, r0uw, c->emit_mask_reg, r0uw);
-   brw_pop_insn_state(p);
-}
-
  static void fire_fb_write( struct brw_wm_compile *c,
                            GLuint base_reg,
                            GLuint nr,
@@ -1357,8 +1382,8 @@ static void emit_aa( struct brw_wm_compile *c,
                      GLuint reg )
  {
     struct brw_compile *p = &c->func;
-   GLuint comp = c->key.aa_dest_stencil_reg / 2;
-   GLuint off = c->key.aa_dest_stencil_reg % 2;
+   GLuint comp = c->aa_dest_stencil_reg / 2;
+   GLuint off = c->aa_dest_stencil_reg % 2;
     struct brw_reg aa = offset(arg1[comp], off);
  
     brw_push_insn_state(p);
@@ -1386,11 +1411,10 @@ void emit_fb_write(struct brw_wm_compile *c,
     struct intel_context *intel = &brw->intel;
     GLuint nr = 2;
     GLuint channel;
-   int base_reg; /* For gen6 fb write with no header, starting from color payload directly!. */
  
     /* Reserve a space for AA - may not be needed:
      */
-   if (c->key.aa_dest_stencil_reg)
+   if (c->aa_dest_stencil_reg)
        nr += 1;
  
     /* I don't really understand how this achieves the color interleave
@@ -1398,11 +1422,6 @@ void emit_fb_write(struct brw_wm_compile *c,
      */
     brw_push_insn_state(p);
  
-   if (intel->gen >= 6)
-       base_reg = nr;
-   else
-       base_reg = 0;
-
     for (channel = 0; channel < 4; channel++) {
        if (intel->gen >= 6) {
          /* gen6 SIMD16 single source DP write looks like:
@@ -1463,9 +1482,9 @@ void emit_fb_write(struct brw_wm_compile *c,
  
     brw_pop_insn_state(p);
  
-   if (c->key.source_depth_to_render_target)
+   if (c->source_depth_to_render_target)
     {
-      if (c->key.computes_depth) 
+      if (c->computes_depth)
          brw_MOV(p, brw_message_reg(nr), arg2[2]);
        else 
          brw_MOV(p, brw_message_reg(nr), arg1[1]); /* ? */
@@ -1473,10 +1492,10 @@ void emit_fb_write(struct brw_wm_compile *c,
        nr += 2;
     }
  
-   if (c->key.dest_depth_reg)
+   if (c->dest_depth_reg)
     {
-      GLuint comp = c->key.dest_depth_reg / 2;
-      GLuint off = c->key.dest_depth_reg % 2;
+      GLuint comp = c->dest_depth_reg / 2;
+      GLuint off = c->dest_depth_reg % 2;
  
        if (off != 0) {
           brw_push_insn_state(p);
@@ -1494,15 +1513,27 @@ void emit_fb_write(struct brw_wm_compile *c,
     }
  
     if (intel->gen >= 6) {
-      /* Subtract off the message header, since we send headerless. */
-      nr -= 2;
+      /* Load the message header.  There's no implied move from src0
+       * to the base mrf on gen6.
+       */
+      brw_push_insn_state(p);
+      brw_set_mask_control(p, BRW_MASK_DISABLE);
+      brw_MOV(p, brw_message_reg(0), brw_vec8_grf(0, 0));
+      brw_pop_insn_state(p);
+
+      if (target != 0) {
+        brw_MOV(p, retype(brw_vec1_reg(BRW_MESSAGE_REGISTER_FILE,
+                                       0,
+                                       2), BRW_REGISTER_TYPE_UD),
+                brw_imm_ud(target));
+      }
     }
  
-   if (!c->key.runtime_check_aads_emit) {
-      if (c->key.aa_dest_stencil_reg)
+   if (!c->runtime_check_aads_emit) {
+      if (c->aa_dest_stencil_reg)
          emit_aa(c, arg1, 2);
  
-      fire_fb_write(c, base_reg, nr, target, eot);
+      fire_fb_write(c, 0, nr, target, eot);
     }
     else {
        struct brw_reg v1_null_ud = vec1(retype(brw_null_reg(), BRW_REGISTER_TYPE_UD));
@@ -1548,9 +1579,7 @@ static void emit_spill( struct brw_wm_compile *c,
       mov (1) r0.2<1>:d    0x00000080:d     { Align1 NoMask }
       send (16) null.0<1>:uw m1               r0.0<8;8,1>:uw   0x053003ff:ud    { Align1 }
     */
-   brw_dp_WRITE_16(p, 
-                  retype(vec16(brw_vec8_grf(0, 0)), BRW_REGISTER_TYPE_UW),
-                  slot);
+   brw_oword_block_write_scratch(p, brw_message_reg(1), 2, slot);
  }
  
  
@@ -1575,9 +1604,7 @@ static void emit_unspill( struct brw_wm_compile *c,
       send (16) r110.0<1>:uw m1               r0.0<8;8,1>:uw   0x041243ff:ud    { Align1 }
     */
  
-   brw_dp_READ_16(p,
-                 retype(vec16(reg), BRW_REGISTER_TYPE_UW),
-                 slot);
+   brw_oword_block_read(p, vec16(reg), brw_message_reg(1), 2, slot);
  }
  
  
@@ -1627,9 +1654,12 @@ static void spill_values( struct brw_wm_compile *c,
  void brw_wm_emit( struct brw_wm_compile *c )
  {
     struct brw_compile *p = &c->func;
+   struct intel_context *intel = &p->brw->intel;
     GLuint insn;
  
     brw_set_compression_control(p, BRW_COMPRESSION_COMPRESSED);
+   if (intel->gen >= 6)
+       brw_set_acc_write_control(p, 1);
  
     /* Check if any of the payload regs need to be spilled:
      */
@@ -1741,7 +1771,11 @@ void brw_wm_emit( struct brw_wm_compile *c )
          break;
  
        case OPCODE_TRUNC:
-        emit_alu1(p, brw_RNDZ, dst, dst_flags, args[0]);
+        for (i = 0; i < 4; i++) {
+           if (dst_flags & (1<<i)) {
+              brw_RNDZ(p, dst[i], args[0][i]);
+           }
+        }
          break;
  
        case OPCODE_LRP:
@@ -1864,10 +1898,6 @@ void brw_wm_emit( struct brw_wm_compile *c )
          emit_kil(c, args[0]);
          break;
  
-      case OPCODE_KIL_NV:
-        emit_kil_nv(c);
-        break;
-
        default:
          printf("Unsupported opcode %i (%s) in fragment shader\n",
                 inst->opcode, inst->opcode < MAX_OPCODE ?
@@ -1889,7 +1919,7 @@ void brw_wm_emit( struct brw_wm_compile *c )
         brw_remove_grf_to_mrf_moves(p);
     }
  
-   if (INTEL_DEBUG & DEBUG_WM) {
+   if (unlikely(INTEL_DEBUG & DEBUG_WM)) {
        int i;
  
       printf("wm-native:\n");