Target/R600/R600InstrInfo.cpp

249259Sdim//===-- R600InstrInfo.cpp - R600 Instruction Information ------------------===//
249259Sdim//
249259Sdim//                     The LLVM Compiler Infrastructure
249259Sdim//
249259Sdim// This file is distributed under the University of Illinois Open Source
249259Sdim// License. See LICENSE.TXT for details.
249259Sdim//
249259Sdim//===----------------------------------------------------------------------===//
249259Sdim//
249259Sdim/// \file
249259Sdim/// \brief R600 Implementation of TargetInstrInfo.
249259Sdim//
249259Sdim//===----------------------------------------------------------------------===//
249259Sdim
249259Sdim#include "R600InstrInfo.h"
251662Sdim#include "AMDGPU.h"
249259Sdim#include "AMDGPUSubtarget.h"
249259Sdim#include "AMDGPUTargetMachine.h"
249259Sdim#include "R600Defines.h"
249259Sdim#include "R600MachineFunctionInfo.h"
249259Sdim#include "R600RegisterInfo.h"
263508Sdim#include "llvm/CodeGen/MachineFrameInfo.h"
249259Sdim#include "llvm/CodeGen/MachineInstrBuilder.h"
249259Sdim#include "llvm/CodeGen/MachineRegisterInfo.h"
249259Sdim
263508Sdim#define GET_INSTRINFO_CTOR_DTOR
249259Sdim#include "AMDGPUGenDFAPacketizer.inc"
249259Sdim
249259Sdimusing namespace llvm;
249259Sdim
249259SdimR600InstrInfo::R600InstrInfo(AMDGPUTargetMachine &tm)
249259Sdim  : AMDGPUInstrInfo(tm),
263508Sdim    RI(tm),
251662Sdim    ST(tm.getSubtarget<AMDGPUSubtarget>())
249259Sdim  { }
249259Sdim
249259Sdimconst R600RegisterInfo &R600InstrInfo::getRegisterInfo() const {
249259Sdim  return RI;
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isTrig(const MachineInstr &MI) const {
249259Sdim  return get(MI.getOpcode()).TSFlags & R600_InstFlag::TRIG;
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isVector(const MachineInstr &MI) const {
249259Sdim  return get(MI.getOpcode()).TSFlags & R600_InstFlag::VECTOR;
249259Sdim}
249259Sdim
249259Sdimvoid
249259SdimR600InstrInfo::copyPhysReg(MachineBasicBlock &MBB,
249259Sdim                           MachineBasicBlock::iterator MI, DebugLoc DL,
249259Sdim                           unsigned DestReg, unsigned SrcReg,
249259Sdim                           bool KillSrc) const {
263508Sdim  unsigned VectorComponents = 0;
263508Sdim  if (AMDGPU::R600_Reg128RegClass.contains(DestReg) &&
263508Sdim      AMDGPU::R600_Reg128RegClass.contains(SrcReg)) {
263508Sdim    VectorComponents = 4;
263508Sdim  } else if(AMDGPU::R600_Reg64RegClass.contains(DestReg) &&
263508Sdim            AMDGPU::R600_Reg64RegClass.contains(SrcReg)) {
263508Sdim    VectorComponents = 2;
263508Sdim  }
263508Sdim
263508Sdim  if (VectorComponents > 0) {
263508Sdim    for (unsigned I = 0; I < VectorComponents; I++) {
249259Sdim      unsigned SubRegIndex = RI.getSubRegFromChannel(I);
249259Sdim      buildDefaultInstruction(MBB, MI, AMDGPU::MOV,
249259Sdim                              RI.getSubReg(DestReg, SubRegIndex),
249259Sdim                              RI.getSubReg(SrcReg, SubRegIndex))
249259Sdim                              .addReg(DestReg,
249259Sdim                                      RegState::Define | RegState::Implicit);
249259Sdim    }
249259Sdim  } else {
249259Sdim    MachineInstr *NewMI = buildDefaultInstruction(MBB, MI, AMDGPU::MOV,
249259Sdim                                                  DestReg, SrcReg);
263508Sdim    NewMI->getOperand(getOperandIdx(*NewMI, AMDGPU::OpName::src0))
249259Sdim                                    .setIsKill(KillSrc);
249259Sdim  }
249259Sdim}
249259Sdim
263508Sdim/// \returns true if \p MBBI can be moved into a new basic.
263508Sdimbool R600InstrInfo::isLegalToSplitMBBAt(MachineBasicBlock &MBB,
263508Sdim                                       MachineBasicBlock::iterator MBBI) const {
263508Sdim  for (MachineInstr::const_mop_iterator I = MBBI->operands_begin(),
263508Sdim                                        E = MBBI->operands_end(); I != E; ++I) {
263508Sdim    if (I->isReg() && !TargetRegisterInfo::isVirtualRegister(I->getReg()) &&
263508Sdim        I->isUse() && RI.isPhysRegLiveAcrossClauses(I->getReg()))
263508Sdim      return false;
263508Sdim  }
263508Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimunsigned R600InstrInfo::getIEQOpcode() const {
249259Sdim  return AMDGPU::SETE_INT;
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isMov(unsigned Opcode) const {
249259Sdim
249259Sdim
249259Sdim  switch(Opcode) {
249259Sdim  default: return false;
249259Sdim  case AMDGPU::MOV:
249259Sdim  case AMDGPU::MOV_IMM_F32:
249259Sdim  case AMDGPU::MOV_IMM_I32:
249259Sdim    return true;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdim// Some instructions act as place holders to emulate operations that the GPU
249259Sdim// hardware does automatically. This function can be used to check if
249259Sdim// an opcode falls into this category.
249259Sdimbool R600InstrInfo::isPlaceHolderOpcode(unsigned Opcode) const {
249259Sdim  switch (Opcode) {
249259Sdim  default: return false;
249259Sdim  case AMDGPU::RETURN:
249259Sdim    return true;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isReductionOp(unsigned Opcode) const {
263508Sdim  return false;
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isCubeOp(unsigned Opcode) const {
249259Sdim  switch(Opcode) {
249259Sdim    default: return false;
249259Sdim    case AMDGPU::CUBE_r600_pseudo:
249259Sdim    case AMDGPU::CUBE_r600_real:
249259Sdim    case AMDGPU::CUBE_eg_pseudo:
249259Sdim    case AMDGPU::CUBE_eg_real:
249259Sdim      return true;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimbool R600InstrInfo::isALUInstr(unsigned Opcode) const {
249259Sdim  unsigned TargetFlags = get(Opcode).TSFlags;
249259Sdim
263508Sdim  return (TargetFlags & R600_InstFlag::ALU_INST);
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::hasInstrModifiers(unsigned Opcode) const {
263508Sdim  unsigned TargetFlags = get(Opcode).TSFlags;
263508Sdim
249259Sdim  return ((TargetFlags & R600_InstFlag::OP1) |
249259Sdim          (TargetFlags & R600_InstFlag::OP2) |
249259Sdim          (TargetFlags & R600_InstFlag::OP3));
249259Sdim}
249259Sdim
263508Sdimbool R600InstrInfo::isLDSInstr(unsigned Opcode) const {
263508Sdim  unsigned TargetFlags = get(Opcode).TSFlags;
263508Sdim
263508Sdim  return ((TargetFlags & R600_InstFlag::LDS_1A) |
263508Sdim          (TargetFlags & R600_InstFlag::LDS_1A1D) |
263508Sdim          (TargetFlags & R600_InstFlag::LDS_1A2D));
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::isLDSNoRetInstr(unsigned Opcode) const {
263508Sdim  return isLDSInstr(Opcode) && getOperandIdx(Opcode, AMDGPU::OpName::dst) == -1;
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::isLDSRetInstr(unsigned Opcode) const {
263508Sdim  return isLDSInstr(Opcode) && getOperandIdx(Opcode, AMDGPU::OpName::dst) != -1;
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::canBeConsideredALU(const MachineInstr *MI) const {
263508Sdim  if (isALUInstr(MI->getOpcode()))
263508Sdim    return true;
263508Sdim  if (isVector(*MI) || isCubeOp(MI->getOpcode()))
263508Sdim    return true;
263508Sdim  switch (MI->getOpcode()) {
263508Sdim  case AMDGPU::PRED_X:
263508Sdim  case AMDGPU::INTERP_PAIR_XY:
263508Sdim  case AMDGPU::INTERP_PAIR_ZW:
263508Sdim  case AMDGPU::INTERP_VEC_LOAD:
263508Sdim  case AMDGPU::COPY:
263508Sdim  case AMDGPU::DOT_4:
263508Sdim    return true;
263508Sdim  default:
263508Sdim    return false;
263508Sdim  }
263508Sdim}
263508Sdim
251662Sdimbool R600InstrInfo::isTransOnly(unsigned Opcode) const {
263508Sdim  if (ST.hasCaymanISA())
263508Sdim    return false;
263508Sdim  return (get(Opcode).getSchedClass() == AMDGPU::Sched::TransALU);
251662Sdim}
251662Sdim
251662Sdimbool R600InstrInfo::isTransOnly(const MachineInstr *MI) const {
251662Sdim  return isTransOnly(MI->getOpcode());
251662Sdim}
251662Sdim
263508Sdimbool R600InstrInfo::isVectorOnly(unsigned Opcode) const {
263508Sdim  return (get(Opcode).getSchedClass() == AMDGPU::Sched::VecALU);
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::isVectorOnly(const MachineInstr *MI) const {
263508Sdim  return isVectorOnly(MI->getOpcode());
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::isExport(unsigned Opcode) const {
263508Sdim  return (get(Opcode).TSFlags & R600_InstFlag::IS_EXPORT);
263508Sdim}
263508Sdim
251662Sdimbool R600InstrInfo::usesVertexCache(unsigned Opcode) const {
251662Sdim  return ST.hasVertexCache() && IS_VTX(get(Opcode));
251662Sdim}
251662Sdim
251662Sdimbool R600InstrInfo::usesVertexCache(const MachineInstr *MI) const {
251662Sdim  const R600MachineFunctionInfo *MFI = MI->getParent()->getParent()->getInfo<R600MachineFunctionInfo>();
251662Sdim  return MFI->ShaderType != ShaderType::COMPUTE && usesVertexCache(MI->getOpcode());
251662Sdim}
251662Sdim
251662Sdimbool R600InstrInfo::usesTextureCache(unsigned Opcode) const {
251662Sdim  return (!ST.hasVertexCache() && IS_VTX(get(Opcode))) || IS_TEX(get(Opcode));
251662Sdim}
251662Sdim
251662Sdimbool R600InstrInfo::usesTextureCache(const MachineInstr *MI) const {
251662Sdim  const R600MachineFunctionInfo *MFI = MI->getParent()->getParent()->getInfo<R600MachineFunctionInfo>();
251662Sdim  return (MFI->ShaderType == ShaderType::COMPUTE && usesVertexCache(MI->getOpcode())) ||
251662Sdim         usesTextureCache(MI->getOpcode());
251662Sdim}
251662Sdim
263508Sdimbool R600InstrInfo::mustBeLastInClause(unsigned Opcode) const {
263508Sdim  switch (Opcode) {
263508Sdim  case AMDGPU::KILLGT:
263508Sdim  case AMDGPU::GROUP_BARRIER:
263508Sdim    return true;
263508Sdim  default:
263508Sdim    return false;
263508Sdim  }
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::usesAddressRegister(MachineInstr *MI) const {
263508Sdim  return  MI->findRegisterUseOperandIdx(AMDGPU::AR_X) != -1;
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::definesAddressRegister(MachineInstr *MI) const {
263508Sdim  return MI->findRegisterDefOperandIdx(AMDGPU::AR_X) != -1;
263508Sdim}
263508Sdim
263508Sdimbool R600InstrInfo::readsLDSSrcReg(const MachineInstr *MI) const {
263508Sdim  if (!isALUInstr(MI->getOpcode())) {
263508Sdim    return false;
263508Sdim  }
263508Sdim  for (MachineInstr::const_mop_iterator I = MI->operands_begin(),
263508Sdim                                        E = MI->operands_end(); I != E; ++I) {
263508Sdim    if (!I->isReg() || !I->isUse() ||
263508Sdim        TargetRegisterInfo::isVirtualRegister(I->getReg()))
263508Sdim      continue;
263508Sdim
263508Sdim    if (AMDGPU::R600_LDS_SRC_REGRegClass.contains(I->getReg()))
263508Sdim      return true;
263508Sdim  }
263508Sdim  return false;
263508Sdim}
263508Sdim
263508Sdimint R600InstrInfo::getSrcIdx(unsigned Opcode, unsigned SrcNum) const {
263508Sdim  static const unsigned OpTable[] = {
263508Sdim    AMDGPU::OpName::src0,
263508Sdim    AMDGPU::OpName::src1,
263508Sdim    AMDGPU::OpName::src2
263508Sdim  };
263508Sdim
263508Sdim  assert (SrcNum < 3);
263508Sdim  return getOperandIdx(Opcode, OpTable[SrcNum]);
263508Sdim}
263508Sdim
263508Sdim#define SRC_SEL_ROWS 11
263508Sdimint R600InstrInfo::getSelIdx(unsigned Opcode, unsigned SrcIdx) const {
263508Sdim  static const unsigned SrcSelTable[SRC_SEL_ROWS][2] = {
263508Sdim    {AMDGPU::OpName::src0, AMDGPU::OpName::src0_sel},
263508Sdim    {AMDGPU::OpName::src1, AMDGPU::OpName::src1_sel},
263508Sdim    {AMDGPU::OpName::src2, AMDGPU::OpName::src2_sel},
263508Sdim    {AMDGPU::OpName::src0_X, AMDGPU::OpName::src0_sel_X},
263508Sdim    {AMDGPU::OpName::src0_Y, AMDGPU::OpName::src0_sel_Y},
263508Sdim    {AMDGPU::OpName::src0_Z, AMDGPU::OpName::src0_sel_Z},
263508Sdim    {AMDGPU::OpName::src0_W, AMDGPU::OpName::src0_sel_W},
263508Sdim    {AMDGPU::OpName::src1_X, AMDGPU::OpName::src1_sel_X},
263508Sdim    {AMDGPU::OpName::src1_Y, AMDGPU::OpName::src1_sel_Y},
263508Sdim    {AMDGPU::OpName::src1_Z, AMDGPU::OpName::src1_sel_Z},
263508Sdim    {AMDGPU::OpName::src1_W, AMDGPU::OpName::src1_sel_W}
263508Sdim  };
263508Sdim
263508Sdim  for (unsigned i = 0; i < SRC_SEL_ROWS; ++i) {
263508Sdim    if (getOperandIdx(Opcode, SrcSelTable[i][0]) == (int)SrcIdx) {
263508Sdim      return getOperandIdx(Opcode, SrcSelTable[i][1]);
263508Sdim    }
263508Sdim  }
263508Sdim  return -1;
263508Sdim}
263508Sdim#undef SRC_SEL_ROWS
263508Sdim
263508SdimSmallVector<std::pair<MachineOperand *, int64_t>, 3>
263508SdimR600InstrInfo::getSrcs(MachineInstr *MI) const {
263508Sdim  SmallVector<std::pair<MachineOperand *, int64_t>, 3> Result;
263508Sdim
263508Sdim  if (MI->getOpcode() == AMDGPU::DOT_4) {
263508Sdim    static const unsigned OpTable[8][2] = {
263508Sdim      {AMDGPU::OpName::src0_X, AMDGPU::OpName::src0_sel_X},
263508Sdim      {AMDGPU::OpName::src0_Y, AMDGPU::OpName::src0_sel_Y},
263508Sdim      {AMDGPU::OpName::src0_Z, AMDGPU::OpName::src0_sel_Z},
263508Sdim      {AMDGPU::OpName::src0_W, AMDGPU::OpName::src0_sel_W},
263508Sdim      {AMDGPU::OpName::src1_X, AMDGPU::OpName::src1_sel_X},
263508Sdim      {AMDGPU::OpName::src1_Y, AMDGPU::OpName::src1_sel_Y},
263508Sdim      {AMDGPU::OpName::src1_Z, AMDGPU::OpName::src1_sel_Z},
263508Sdim      {AMDGPU::OpName::src1_W, AMDGPU::OpName::src1_sel_W},
263508Sdim    };
263508Sdim
263508Sdim    for (unsigned j = 0; j < 8; j++) {
263508Sdim      MachineOperand &MO = MI->getOperand(getOperandIdx(MI->getOpcode(),
263508Sdim                                                        OpTable[j][0]));
263508Sdim      unsigned Reg = MO.getReg();
263508Sdim      if (Reg == AMDGPU::ALU_CONST) {
263508Sdim        unsigned Sel = MI->getOperand(getOperandIdx(MI->getOpcode(),
263508Sdim                                                    OpTable[j][1])).getImm();
263508Sdim        Result.push_back(std::pair<MachineOperand *, int64_t>(&MO, Sel));
263508Sdim        continue;
263508Sdim      }
263508Sdim
263508Sdim    }
263508Sdim    return Result;
263508Sdim  }
263508Sdim
263508Sdim  static const unsigned OpTable[3][2] = {
263508Sdim    {AMDGPU::OpName::src0, AMDGPU::OpName::src0_sel},
263508Sdim    {AMDGPU::OpName::src1, AMDGPU::OpName::src1_sel},
263508Sdim    {AMDGPU::OpName::src2, AMDGPU::OpName::src2_sel},
263508Sdim  };
263508Sdim
263508Sdim  for (unsigned j = 0; j < 3; j++) {
263508Sdim    int SrcIdx = getOperandIdx(MI->getOpcode(), OpTable[j][0]);
263508Sdim    if (SrcIdx < 0)
263508Sdim      break;
263508Sdim    MachineOperand &MO = MI->getOperand(SrcIdx);
263508Sdim    unsigned Reg = MI->getOperand(SrcIdx).getReg();
263508Sdim    if (Reg == AMDGPU::ALU_CONST) {
263508Sdim      unsigned Sel = MI->getOperand(
263508Sdim          getOperandIdx(MI->getOpcode(), OpTable[j][1])).getImm();
263508Sdim      Result.push_back(std::pair<MachineOperand *, int64_t>(&MO, Sel));
263508Sdim      continue;
263508Sdim    }
263508Sdim    if (Reg == AMDGPU::ALU_LITERAL_X) {
263508Sdim      unsigned Imm = MI->getOperand(
263508Sdim          getOperandIdx(MI->getOpcode(), AMDGPU::OpName::literal)).getImm();
263508Sdim      Result.push_back(std::pair<MachineOperand *, int64_t>(&MO, Imm));
263508Sdim      continue;
263508Sdim    }
263508Sdim    Result.push_back(std::pair<MachineOperand *, int64_t>(&MO, 0));
263508Sdim  }
263508Sdim  return Result;
263508Sdim}
263508Sdim
263508Sdimstd::vector<std::pair<int, unsigned> >
263508SdimR600InstrInfo::ExtractSrcs(MachineInstr *MI,
263508Sdim                           const DenseMap<unsigned, unsigned> &PV,
263508Sdim                           unsigned &ConstCount) const {
263508Sdim  ConstCount = 0;
263508Sdim  const SmallVector<std::pair<MachineOperand *, int64_t>, 3> Srcs = getSrcs(MI);
263508Sdim  const std::pair<int, unsigned> DummyPair(-1, 0);
263508Sdim  std::vector<std::pair<int, unsigned> > Result;
263508Sdim  unsigned i = 0;
263508Sdim  for (unsigned n = Srcs.size(); i < n; ++i) {
263508Sdim    unsigned Reg = Srcs[i].first->getReg();
263508Sdim    unsigned Index = RI.getEncodingValue(Reg) & 0xff;
263508Sdim    if (Reg == AMDGPU::OQAP) {
263508Sdim      Result.push_back(std::pair<int, unsigned>(Index, 0));
263508Sdim    }
263508Sdim    if (PV.find(Reg) != PV.end()) {
263508Sdim      // 255 is used to tells its a PS/PV reg
263508Sdim      Result.push_back(std::pair<int, unsigned>(255, 0));
263508Sdim      continue;
263508Sdim    }
263508Sdim    if (Index > 127) {
263508Sdim      ConstCount++;
263508Sdim      Result.push_back(DummyPair);
263508Sdim      continue;
263508Sdim    }
263508Sdim    unsigned Chan = RI.getHWRegChan(Reg);
263508Sdim    Result.push_back(std::pair<int, unsigned>(Index, Chan));
263508Sdim  }
263508Sdim  for (; i < 3; ++i)
263508Sdim    Result.push_back(DummyPair);
263508Sdim  return Result;
263508Sdim}
263508Sdim
263508Sdimstatic std::vector<std::pair<int, unsigned> >
263508SdimSwizzle(std::vector<std::pair<int, unsigned> > Src,
263508Sdim        R600InstrInfo::BankSwizzle Swz) {
263508Sdim  if (Src[0] == Src[1])
263508Sdim    Src[1].first = -1;
263508Sdim  switch (Swz) {
263508Sdim  case R600InstrInfo::ALU_VEC_012_SCL_210:
263508Sdim    break;
263508Sdim  case R600InstrInfo::ALU_VEC_021_SCL_122:
263508Sdim    std::swap(Src[1], Src[2]);
263508Sdim    break;
263508Sdim  case R600InstrInfo::ALU_VEC_102_SCL_221:
263508Sdim    std::swap(Src[0], Src[1]);
263508Sdim    break;
263508Sdim  case R600InstrInfo::ALU_VEC_120_SCL_212:
263508Sdim    std::swap(Src[0], Src[1]);
263508Sdim    std::swap(Src[0], Src[2]);
263508Sdim    break;
263508Sdim  case R600InstrInfo::ALU_VEC_201:
263508Sdim    std::swap(Src[0], Src[2]);
263508Sdim    std::swap(Src[0], Src[1]);
263508Sdim    break;
263508Sdim  case R600InstrInfo::ALU_VEC_210:
263508Sdim    std::swap(Src[0], Src[2]);
263508Sdim    break;
263508Sdim  }
263508Sdim  return Src;
263508Sdim}
263508Sdim
263508Sdimstatic unsigned
263508SdimgetTransSwizzle(R600InstrInfo::BankSwizzle Swz, unsigned Op) {
263508Sdim  switch (Swz) {
263508Sdim  case R600InstrInfo::ALU_VEC_012_SCL_210: {
263508Sdim    unsigned Cycles[3] = { 2, 1, 0};
263508Sdim    return Cycles[Op];
263508Sdim  }
263508Sdim  case R600InstrInfo::ALU_VEC_021_SCL_122: {
263508Sdim    unsigned Cycles[3] = { 1, 2, 2};
263508Sdim    return Cycles[Op];
263508Sdim  }
263508Sdim  case R600InstrInfo::ALU_VEC_120_SCL_212: {
263508Sdim    unsigned Cycles[3] = { 2, 1, 2};
263508Sdim    return Cycles[Op];
263508Sdim  }
263508Sdim  case R600InstrInfo::ALU_VEC_102_SCL_221: {
263508Sdim    unsigned Cycles[3] = { 2, 2, 1};
263508Sdim    return Cycles[Op];
263508Sdim  }
263508Sdim  default:
263508Sdim    llvm_unreachable("Wrong Swizzle for Trans Slot");
263508Sdim    return 0;
263508Sdim  }
263508Sdim}
263508Sdim
263508Sdim/// returns how many MIs (whose inputs are represented by IGSrcs) can be packed
263508Sdim/// in the same Instruction Group while meeting read port limitations given a
263508Sdim/// Swz swizzle sequence.
263508Sdimunsigned  R600InstrInfo::isLegalUpTo(
263508Sdim    const std::vector<std::vector<std::pair<int, unsigned> > > &IGSrcs,
263508Sdim    const std::vector<R600InstrInfo::BankSwizzle> &Swz,
263508Sdim    const std::vector<std::pair<int, unsigned> > &TransSrcs,
263508Sdim    R600InstrInfo::BankSwizzle TransSwz) const {
263508Sdim  int Vector[4][3];
263508Sdim  memset(Vector, -1, sizeof(Vector));
263508Sdim  for (unsigned i = 0, e = IGSrcs.size(); i < e; i++) {
263508Sdim    const std::vector<std::pair<int, unsigned> > &Srcs =
263508Sdim        Swizzle(IGSrcs[i], Swz[i]);
263508Sdim    for (unsigned j = 0; j < 3; j++) {
263508Sdim      const std::pair<int, unsigned> &Src = Srcs[j];
263508Sdim      if (Src.first < 0 || Src.first == 255)
263508Sdim        continue;
263508Sdim      if (Src.first == GET_REG_INDEX(RI.getEncodingValue(AMDGPU::OQAP))) {
263508Sdim        if (Swz[i] != R600InstrInfo::ALU_VEC_012_SCL_210 &&
263508Sdim            Swz[i] != R600InstrInfo::ALU_VEC_021_SCL_122) {
263508Sdim            // The value from output queue A (denoted by register OQAP) can
263508Sdim            // only be fetched during the first cycle.
263508Sdim            return false;
263508Sdim        }
263508Sdim        // OQAP does not count towards the normal read port restrictions
263508Sdim        continue;
263508Sdim      }
263508Sdim      if (Vector[Src.second][j] < 0)
263508Sdim        Vector[Src.second][j] = Src.first;
263508Sdim      if (Vector[Src.second][j] != Src.first)
263508Sdim        return i;
263508Sdim    }
263508Sdim  }
263508Sdim  // Now check Trans Alu
263508Sdim  for (unsigned i = 0, e = TransSrcs.size(); i < e; ++i) {
263508Sdim    const std::pair<int, unsigned> &Src = TransSrcs[i];
263508Sdim    unsigned Cycle = getTransSwizzle(TransSwz, i);
263508Sdim    if (Src.first < 0)
263508Sdim      continue;
263508Sdim    if (Src.first == 255)
263508Sdim      continue;
263508Sdim    if (Vector[Src.second][Cycle] < 0)
263508Sdim      Vector[Src.second][Cycle] = Src.first;
263508Sdim    if (Vector[Src.second][Cycle] != Src.first)
263508Sdim      return IGSrcs.size() - 1;
263508Sdim  }
263508Sdim  return IGSrcs.size();
263508Sdim}
263508Sdim
263508Sdim/// Given a swizzle sequence SwzCandidate and an index Idx, returns the next
263508Sdim/// (in lexicographic term) swizzle sequence assuming that all swizzles after
263508Sdim/// Idx can be skipped
263508Sdimstatic bool
263508SdimNextPossibleSolution(
263508Sdim    std::vector<R600InstrInfo::BankSwizzle> &SwzCandidate,
263508Sdim    unsigned Idx) {
263508Sdim  assert(Idx < SwzCandidate.size());
263508Sdim  int ResetIdx = Idx;
263508Sdim  while (ResetIdx > -1 && SwzCandidate[ResetIdx] == R600InstrInfo::ALU_VEC_210)
263508Sdim    ResetIdx --;
263508Sdim  for (unsigned i = ResetIdx + 1, e = SwzCandidate.size(); i < e; i++) {
263508Sdim    SwzCandidate[i] = R600InstrInfo::ALU_VEC_012_SCL_210;
263508Sdim  }
263508Sdim  if (ResetIdx == -1)
263508Sdim    return false;
263508Sdim  int NextSwizzle = SwzCandidate[ResetIdx] + 1;
263508Sdim  SwzCandidate[ResetIdx] = (R600InstrInfo::BankSwizzle)NextSwizzle;
263508Sdim  return true;
263508Sdim}
263508Sdim
263508Sdim/// Enumerate all possible Swizzle sequence to find one that can meet all
263508Sdim/// read port requirements.
263508Sdimbool R600InstrInfo::FindSwizzleForVectorSlot(
263508Sdim    const std::vector<std::vector<std::pair<int, unsigned> > > &IGSrcs,
263508Sdim    std::vector<R600InstrInfo::BankSwizzle> &SwzCandidate,
263508Sdim    const std::vector<std::pair<int, unsigned> > &TransSrcs,
263508Sdim    R600InstrInfo::BankSwizzle TransSwz) const {
263508Sdim  unsigned ValidUpTo = 0;
263508Sdim  do {
263508Sdim    ValidUpTo = isLegalUpTo(IGSrcs, SwzCandidate, TransSrcs, TransSwz);
263508Sdim    if (ValidUpTo == IGSrcs.size())
263508Sdim      return true;
263508Sdim  } while (NextPossibleSolution(SwzCandidate, ValidUpTo));
263508Sdim  return false;
263508Sdim}
263508Sdim
263508Sdim/// Instructions in Trans slot can't read gpr at cycle 0 if they also read
263508Sdim/// a const, and can't read a gpr at cycle 1 if they read 2 const.
263508Sdimstatic bool
263508SdimisConstCompatible(R600InstrInfo::BankSwizzle TransSwz,
263508Sdim                  const std::vector<std::pair<int, unsigned> > &TransOps,
263508Sdim                  unsigned ConstCount) {
263508Sdim  // TransALU can't read 3 constants
263508Sdim  if (ConstCount > 2)
263508Sdim    return false;
263508Sdim  for (unsigned i = 0, e = TransOps.size(); i < e; ++i) {
263508Sdim    const std::pair<int, unsigned> &Src = TransOps[i];
263508Sdim    unsigned Cycle = getTransSwizzle(TransSwz, i);
263508Sdim    if (Src.first < 0)
263508Sdim      continue;
263508Sdim    if (ConstCount > 0 && Cycle == 0)
263508Sdim      return false;
263508Sdim    if (ConstCount > 1 && Cycle == 1)
263508Sdim      return false;
263508Sdim  }
263508Sdim  return true;
263508Sdim}
263508Sdim
249259Sdimbool
263508SdimR600InstrInfo::fitsReadPortLimitations(const std::vector<MachineInstr *> &IG,
263508Sdim                                       const DenseMap<unsigned, unsigned> &PV,
263508Sdim                                       std::vector<BankSwizzle> &ValidSwizzle,
263508Sdim                                       bool isLastAluTrans)
263508Sdim    const {
263508Sdim  //Todo : support shared src0 - src1 operand
263508Sdim
263508Sdim  std::vector<std::vector<std::pair<int, unsigned> > > IGSrcs;
263508Sdim  ValidSwizzle.clear();
263508Sdim  unsigned ConstCount;
263508Sdim  BankSwizzle TransBS = ALU_VEC_012_SCL_210;
263508Sdim  for (unsigned i = 0, e = IG.size(); i < e; ++i) {
263508Sdim    IGSrcs.push_back(ExtractSrcs(IG[i], PV, ConstCount));
263508Sdim    unsigned Op = getOperandIdx(IG[i]->getOpcode(),
263508Sdim        AMDGPU::OpName::bank_swizzle);
263508Sdim    ValidSwizzle.push_back( (R600InstrInfo::BankSwizzle)
263508Sdim        IG[i]->getOperand(Op).getImm());
263508Sdim  }
263508Sdim  std::vector<std::pair<int, unsigned> > TransOps;
263508Sdim  if (!isLastAluTrans)
263508Sdim    return FindSwizzleForVectorSlot(IGSrcs, ValidSwizzle, TransOps, TransBS);
263508Sdim
263508Sdim  TransOps = IGSrcs.back();
263508Sdim  IGSrcs.pop_back();
263508Sdim  ValidSwizzle.pop_back();
263508Sdim
263508Sdim  static const R600InstrInfo::BankSwizzle TransSwz[] = {
263508Sdim    ALU_VEC_012_SCL_210,
263508Sdim    ALU_VEC_021_SCL_122,
263508Sdim    ALU_VEC_120_SCL_212,
263508Sdim    ALU_VEC_102_SCL_221
263508Sdim  };
263508Sdim  for (unsigned i = 0; i < 4; i++) {
263508Sdim    TransBS = TransSwz[i];
263508Sdim    if (!isConstCompatible(TransBS, TransOps, ConstCount))
263508Sdim      continue;
263508Sdim    bool Result = FindSwizzleForVectorSlot(IGSrcs, ValidSwizzle, TransOps,
263508Sdim        TransBS);
263508Sdim    if (Result) {
263508Sdim      ValidSwizzle.push_back(TransBS);
263508Sdim      return true;
263508Sdim    }
263508Sdim  }
263508Sdim
263508Sdim  return false;
263508Sdim}
263508Sdim
263508Sdim
263508Sdimbool
249259SdimR600InstrInfo::fitsConstReadLimitations(const std::vector<unsigned> &Consts)
249259Sdim    const {
249259Sdim  assert (Consts.size() <= 12 && "Too many operands in instructions group");
249259Sdim  unsigned Pair1 = 0, Pair2 = 0;
249259Sdim  for (unsigned i = 0, n = Consts.size(); i < n; ++i) {
249259Sdim    unsigned ReadConstHalf = Consts[i] & 2;
249259Sdim    unsigned ReadConstIndex = Consts[i] & (~3);
249259Sdim    unsigned ReadHalfConst = ReadConstIndex | ReadConstHalf;
249259Sdim    if (!Pair1) {
249259Sdim      Pair1 = ReadHalfConst;
249259Sdim      continue;
249259Sdim    }
249259Sdim    if (Pair1 == ReadHalfConst)
249259Sdim      continue;
249259Sdim    if (!Pair2) {
249259Sdim      Pair2 = ReadHalfConst;
249259Sdim      continue;
249259Sdim    }
249259Sdim    if (Pair2 != ReadHalfConst)
249259Sdim      return false;
249259Sdim  }
249259Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimbool
263508SdimR600InstrInfo::fitsConstReadLimitations(const std::vector<MachineInstr *> &MIs)
263508Sdim    const {
249259Sdim  std::vector<unsigned> Consts;
263508Sdim  SmallSet<int64_t, 4> Literals;
249259Sdim  for (unsigned i = 0, n = MIs.size(); i < n; i++) {
263508Sdim    MachineInstr *MI = MIs[i];
249259Sdim    if (!isALUInstr(MI->getOpcode()))
249259Sdim      continue;
249259Sdim
263508Sdim    const SmallVectorImpl<std::pair<MachineOperand *, int64_t> > &Srcs =
263508Sdim        getSrcs(MI);
263508Sdim
263508Sdim    for (unsigned j = 0, e = Srcs.size(); j < e; j++) {
263508Sdim      std::pair<MachineOperand *, unsigned> Src = Srcs[j];
263508Sdim      if (Src.first->getReg() == AMDGPU::ALU_LITERAL_X)
263508Sdim        Literals.insert(Src.second);
263508Sdim      if (Literals.size() > 4)
263508Sdim        return false;
263508Sdim      if (Src.first->getReg() == AMDGPU::ALU_CONST)
263508Sdim        Consts.push_back(Src.second);
263508Sdim      if (AMDGPU::R600_KC0RegClass.contains(Src.first->getReg()) ||
263508Sdim          AMDGPU::R600_KC1RegClass.contains(Src.first->getReg())) {
263508Sdim        unsigned Index = RI.getEncodingValue(Src.first->getReg()) & 0xff;
263508Sdim        unsigned Chan = RI.getHWRegChan(Src.first->getReg());
251662Sdim        Consts.push_back((Index << 2) | Chan);
251662Sdim      }
249259Sdim    }
249259Sdim  }
249259Sdim  return fitsConstReadLimitations(Consts);
249259Sdim}
249259Sdim
249259SdimDFAPacketizer *R600InstrInfo::CreateTargetScheduleState(const TargetMachine *TM,
249259Sdim    const ScheduleDAG *DAG) const {
249259Sdim  const InstrItineraryData *II = TM->getInstrItineraryData();
249259Sdim  return TM->getSubtarget<AMDGPUSubtarget>().createDFAPacketizer(II);
249259Sdim}
249259Sdim
249259Sdimstatic bool
249259SdimisPredicateSetter(unsigned Opcode) {
249259Sdim  switch (Opcode) {
249259Sdim  case AMDGPU::PRED_X:
249259Sdim    return true;
249259Sdim  default:
249259Sdim    return false;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimstatic MachineInstr *
249259SdimfindFirstPredicateSetterFrom(MachineBasicBlock &MBB,
249259Sdim                             MachineBasicBlock::iterator I) {
249259Sdim  while (I != MBB.begin()) {
249259Sdim    --I;
249259Sdim    MachineInstr *MI = I;
249259Sdim    if (isPredicateSetter(MI->getOpcode()))
249259Sdim      return MI;
249259Sdim  }
249259Sdim
249259Sdim  return NULL;
249259Sdim}
249259Sdim
249259Sdimstatic
249259Sdimbool isJump(unsigned Opcode) {
249259Sdim  return Opcode == AMDGPU::JUMP || Opcode == AMDGPU::JUMP_COND;
249259Sdim}
249259Sdim
263508Sdimstatic bool isBranch(unsigned Opcode) {
263508Sdim  return Opcode == AMDGPU::BRANCH || Opcode == AMDGPU::BRANCH_COND_i32 ||
263508Sdim      Opcode == AMDGPU::BRANCH_COND_f32;
263508Sdim}
263508Sdim
249259Sdimbool
249259SdimR600InstrInfo::AnalyzeBranch(MachineBasicBlock &MBB,
249259Sdim                             MachineBasicBlock *&TBB,
249259Sdim                             MachineBasicBlock *&FBB,
249259Sdim                             SmallVectorImpl<MachineOperand> &Cond,
249259Sdim                             bool AllowModify) const {
249259Sdim  // Most of the following comes from the ARM implementation of AnalyzeBranch
249259Sdim
249259Sdim  // If the block has no terminators, it just falls into the block after it.
249259Sdim  MachineBasicBlock::iterator I = MBB.end();
249259Sdim  if (I == MBB.begin())
249259Sdim    return false;
249259Sdim  --I;
249259Sdim  while (I->isDebugValue()) {
249259Sdim    if (I == MBB.begin())
249259Sdim      return false;
249259Sdim    --I;
249259Sdim  }
263508Sdim  // AMDGPU::BRANCH* instructions are only available after isel and are not
263508Sdim  // handled
263508Sdim  if (isBranch(I->getOpcode()))
263508Sdim    return true;
249259Sdim  if (!isJump(static_cast<MachineInstr *>(I)->getOpcode())) {
249259Sdim    return false;
249259Sdim  }
249259Sdim
266715Sdim  // Remove successive JUMP
266715Sdim  while (I != MBB.begin() && llvm::prior(I)->getOpcode() == AMDGPU::JUMP) {
266715Sdim      MachineBasicBlock::iterator PriorI = llvm::prior(I);
266715Sdim      if (AllowModify)
266715Sdim        I->removeFromParent();
266715Sdim      I = PriorI;
266715Sdim  }
249259Sdim  MachineInstr *LastInst = I;
249259Sdim
249259Sdim  // If there is only one terminator instruction, process it.
249259Sdim  unsigned LastOpc = LastInst->getOpcode();
249259Sdim  if (I == MBB.begin() ||
249259Sdim          !isJump(static_cast<MachineInstr *>(--I)->getOpcode())) {
249259Sdim    if (LastOpc == AMDGPU::JUMP) {
249259Sdim      TBB = LastInst->getOperand(0).getMBB();
249259Sdim      return false;
249259Sdim    } else if (LastOpc == AMDGPU::JUMP_COND) {
249259Sdim      MachineInstr *predSet = I;
249259Sdim      while (!isPredicateSetter(predSet->getOpcode())) {
249259Sdim        predSet = --I;
249259Sdim      }
249259Sdim      TBB = LastInst->getOperand(0).getMBB();
249259Sdim      Cond.push_back(predSet->getOperand(1));
249259Sdim      Cond.push_back(predSet->getOperand(2));
249259Sdim      Cond.push_back(MachineOperand::CreateReg(AMDGPU::PRED_SEL_ONE, false));
249259Sdim      return false;
249259Sdim    }
249259Sdim    return true;  // Can't handle indirect branch.
249259Sdim  }
249259Sdim
249259Sdim  // Get the instruction before it if it is a terminator.
249259Sdim  MachineInstr *SecondLastInst = I;
249259Sdim  unsigned SecondLastOpc = SecondLastInst->getOpcode();
249259Sdim
249259Sdim  // If the block ends with a B and a Bcc, handle it.
249259Sdim  if (SecondLastOpc == AMDGPU::JUMP_COND && LastOpc == AMDGPU::JUMP) {
249259Sdim    MachineInstr *predSet = --I;
249259Sdim    while (!isPredicateSetter(predSet->getOpcode())) {
249259Sdim      predSet = --I;
249259Sdim    }
249259Sdim    TBB = SecondLastInst->getOperand(0).getMBB();
249259Sdim    FBB = LastInst->getOperand(0).getMBB();
249259Sdim    Cond.push_back(predSet->getOperand(1));
249259Sdim    Cond.push_back(predSet->getOperand(2));
249259Sdim    Cond.push_back(MachineOperand::CreateReg(AMDGPU::PRED_SEL_ONE, false));
249259Sdim    return false;
249259Sdim  }
249259Sdim
249259Sdim  // Otherwise, can't handle this.
249259Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimint R600InstrInfo::getBranchInstr(const MachineOperand &op) const {
249259Sdim  const MachineInstr *MI = op.getParent();
249259Sdim
249259Sdim  switch (MI->getDesc().OpInfo->RegClass) {
249259Sdim  default: // FIXME: fallthrough??
249259Sdim  case AMDGPU::GPRI32RegClassID: return AMDGPU::BRANCH_COND_i32;
249259Sdim  case AMDGPU::GPRF32RegClassID: return AMDGPU::BRANCH_COND_f32;
249259Sdim  };
249259Sdim}
249259Sdim
263508Sdimstatic
263508SdimMachineBasicBlock::iterator FindLastAluClause(MachineBasicBlock &MBB) {
263508Sdim  for (MachineBasicBlock::reverse_iterator It = MBB.rbegin(), E = MBB.rend();
263508Sdim      It != E; ++It) {
263508Sdim    if (It->getOpcode() == AMDGPU::CF_ALU ||
263508Sdim        It->getOpcode() == AMDGPU::CF_ALU_PUSH_BEFORE)
263508Sdim      return llvm::prior(It.base());
263508Sdim  }
263508Sdim  return MBB.end();
263508Sdim}
263508Sdim
249259Sdimunsigned
249259SdimR600InstrInfo::InsertBranch(MachineBasicBlock &MBB,
249259Sdim                            MachineBasicBlock *TBB,
249259Sdim                            MachineBasicBlock *FBB,
249259Sdim                            const SmallVectorImpl<MachineOperand> &Cond,
249259Sdim                            DebugLoc DL) const {
249259Sdim  assert(TBB && "InsertBranch must not be told to insert a fallthrough");
249259Sdim
249259Sdim  if (FBB == 0) {
249259Sdim    if (Cond.empty()) {
249259Sdim      BuildMI(&MBB, DL, get(AMDGPU::JUMP)).addMBB(TBB);
249259Sdim      return 1;
249259Sdim    } else {
249259Sdim      MachineInstr *PredSet = findFirstPredicateSetterFrom(MBB, MBB.end());
249259Sdim      assert(PredSet && "No previous predicate !");
249259Sdim      addFlag(PredSet, 0, MO_FLAG_PUSH);
249259Sdim      PredSet->getOperand(2).setImm(Cond[1].getImm());
249259Sdim
249259Sdim      BuildMI(&MBB, DL, get(AMDGPU::JUMP_COND))
249259Sdim             .addMBB(TBB)
249259Sdim             .addReg(AMDGPU::PREDICATE_BIT, RegState::Kill);
263508Sdim      MachineBasicBlock::iterator CfAlu = FindLastAluClause(MBB);
263508Sdim      if (CfAlu == MBB.end())
263508Sdim        return 1;
263508Sdim      assert (CfAlu->getOpcode() == AMDGPU::CF_ALU);
263508Sdim      CfAlu->setDesc(get(AMDGPU::CF_ALU_PUSH_BEFORE));
249259Sdim      return 1;
249259Sdim    }
249259Sdim  } else {
249259Sdim    MachineInstr *PredSet = findFirstPredicateSetterFrom(MBB, MBB.end());
249259Sdim    assert(PredSet && "No previous predicate !");
249259Sdim    addFlag(PredSet, 0, MO_FLAG_PUSH);
249259Sdim    PredSet->getOperand(2).setImm(Cond[1].getImm());
249259Sdim    BuildMI(&MBB, DL, get(AMDGPU::JUMP_COND))
249259Sdim            .addMBB(TBB)
249259Sdim            .addReg(AMDGPU::PREDICATE_BIT, RegState::Kill);
249259Sdim    BuildMI(&MBB, DL, get(AMDGPU::JUMP)).addMBB(FBB);
263508Sdim    MachineBasicBlock::iterator CfAlu = FindLastAluClause(MBB);
263508Sdim    if (CfAlu == MBB.end())
263508Sdim      return 2;
263508Sdim    assert (CfAlu->getOpcode() == AMDGPU::CF_ALU);
263508Sdim    CfAlu->setDesc(get(AMDGPU::CF_ALU_PUSH_BEFORE));
249259Sdim    return 2;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimunsigned
249259SdimR600InstrInfo::RemoveBranch(MachineBasicBlock &MBB) const {
249259Sdim
249259Sdim  // Note : we leave PRED* instructions there.
249259Sdim  // They may be needed when predicating instructions.
249259Sdim
249259Sdim  MachineBasicBlock::iterator I = MBB.end();
249259Sdim
249259Sdim  if (I == MBB.begin()) {
249259Sdim    return 0;
249259Sdim  }
249259Sdim  --I;
249259Sdim  switch (I->getOpcode()) {
249259Sdim  default:
249259Sdim    return 0;
249259Sdim  case AMDGPU::JUMP_COND: {
249259Sdim    MachineInstr *predSet = findFirstPredicateSetterFrom(MBB, I);
249259Sdim    clearFlag(predSet, 0, MO_FLAG_PUSH);
249259Sdim    I->eraseFromParent();
263508Sdim    MachineBasicBlock::iterator CfAlu = FindLastAluClause(MBB);
263508Sdim    if (CfAlu == MBB.end())
263508Sdim      break;
263508Sdim    assert (CfAlu->getOpcode() == AMDGPU::CF_ALU_PUSH_BEFORE);
263508Sdim    CfAlu->setDesc(get(AMDGPU::CF_ALU));
249259Sdim    break;
249259Sdim  }
249259Sdim  case AMDGPU::JUMP:
249259Sdim    I->eraseFromParent();
249259Sdim    break;
249259Sdim  }
249259Sdim  I = MBB.end();
249259Sdim
249259Sdim  if (I == MBB.begin()) {
249259Sdim    return 1;
249259Sdim  }
249259Sdim  --I;
249259Sdim  switch (I->getOpcode()) {
249259Sdim    // FIXME: only one case??
249259Sdim  default:
249259Sdim    return 1;
249259Sdim  case AMDGPU::JUMP_COND: {
249259Sdim    MachineInstr *predSet = findFirstPredicateSetterFrom(MBB, I);
249259Sdim    clearFlag(predSet, 0, MO_FLAG_PUSH);
249259Sdim    I->eraseFromParent();
263508Sdim    MachineBasicBlock::iterator CfAlu = FindLastAluClause(MBB);
263508Sdim    if (CfAlu == MBB.end())
263508Sdim      break;
263508Sdim    assert (CfAlu->getOpcode() == AMDGPU::CF_ALU_PUSH_BEFORE);
263508Sdim    CfAlu->setDesc(get(AMDGPU::CF_ALU));
249259Sdim    break;
249259Sdim  }
249259Sdim  case AMDGPU::JUMP:
249259Sdim    I->eraseFromParent();
249259Sdim    break;
249259Sdim  }
249259Sdim  return 2;
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isPredicated(const MachineInstr *MI) const {
249259Sdim  int idx = MI->findFirstPredOperandIdx();
249259Sdim  if (idx < 0)
249259Sdim    return false;
249259Sdim
249259Sdim  unsigned Reg = MI->getOperand(idx).getReg();
249259Sdim  switch (Reg) {
249259Sdim  default: return false;
249259Sdim  case AMDGPU::PRED_SEL_ONE:
249259Sdim  case AMDGPU::PRED_SEL_ZERO:
249259Sdim  case AMDGPU::PREDICATE_BIT:
249259Sdim    return true;
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isPredicable(MachineInstr *MI) const {
249259Sdim  // XXX: KILL* instructions can be predicated, but they must be the last
249259Sdim  // instruction in a clause, so this means any instructions after them cannot
249259Sdim  // be predicated.  Until we have proper support for instruction clauses in the
249259Sdim  // backend, we will mark KILL* instructions as unpredicable.
249259Sdim
249259Sdim  if (MI->getOpcode() == AMDGPU::KILLGT) {
249259Sdim    return false;
263508Sdim  } else if (MI->getOpcode() == AMDGPU::CF_ALU) {
263508Sdim    // If the clause start in the middle of MBB then the MBB has more
263508Sdim    // than a single clause, unable to predicate several clauses.
263508Sdim    if (MI->getParent()->begin() != MachineBasicBlock::iterator(MI))
263508Sdim      return false;
263508Sdim    // TODO: We don't support KC merging atm
263508Sdim    if (MI->getOperand(3).getImm() != 0 || MI->getOperand(4).getImm() != 0)
263508Sdim      return false;
263508Sdim    return true;
249259Sdim  } else if (isVector(*MI)) {
249259Sdim    return false;
249259Sdim  } else {
249259Sdim    return AMDGPUInstrInfo::isPredicable(MI);
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isProfitableToIfCvt(MachineBasicBlock &MBB,
249259Sdim                                   unsigned NumCyles,
249259Sdim                                   unsigned ExtraPredCycles,
249259Sdim                                   const BranchProbability &Probability) const{
249259Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isProfitableToIfCvt(MachineBasicBlock &TMBB,
249259Sdim                                   unsigned NumTCycles,
249259Sdim                                   unsigned ExtraTCycles,
249259Sdim                                   MachineBasicBlock &FMBB,
249259Sdim                                   unsigned NumFCycles,
249259Sdim                                   unsigned ExtraFCycles,
249259Sdim                                   const BranchProbability &Probability) const {
249259Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isProfitableToDupForIfCvt(MachineBasicBlock &MBB,
249259Sdim                                         unsigned NumCyles,
249259Sdim                                         const BranchProbability &Probability)
249259Sdim                                         const {
249259Sdim  return true;
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::isProfitableToUnpredicate(MachineBasicBlock &TMBB,
249259Sdim                                         MachineBasicBlock &FMBB) const {
249259Sdim  return false;
249259Sdim}
249259Sdim
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::ReverseBranchCondition(SmallVectorImpl<MachineOperand> &Cond) const {
249259Sdim  MachineOperand &MO = Cond[1];
249259Sdim  switch (MO.getImm()) {
249259Sdim  case OPCODE_IS_ZERO_INT:
249259Sdim    MO.setImm(OPCODE_IS_NOT_ZERO_INT);
249259Sdim    break;
249259Sdim  case OPCODE_IS_NOT_ZERO_INT:
249259Sdim    MO.setImm(OPCODE_IS_ZERO_INT);
249259Sdim    break;
249259Sdim  case OPCODE_IS_ZERO:
249259Sdim    MO.setImm(OPCODE_IS_NOT_ZERO);
249259Sdim    break;
249259Sdim  case OPCODE_IS_NOT_ZERO:
249259Sdim    MO.setImm(OPCODE_IS_ZERO);
249259Sdim    break;
249259Sdim  default:
249259Sdim    return true;
249259Sdim  }
249259Sdim
249259Sdim  MachineOperand &MO2 = Cond[2];
249259Sdim  switch (MO2.getReg()) {
249259Sdim  case AMDGPU::PRED_SEL_ZERO:
249259Sdim    MO2.setReg(AMDGPU::PRED_SEL_ONE);
249259Sdim    break;
249259Sdim  case AMDGPU::PRED_SEL_ONE:
249259Sdim    MO2.setReg(AMDGPU::PRED_SEL_ZERO);
249259Sdim    break;
249259Sdim  default:
249259Sdim    return true;
249259Sdim  }
249259Sdim  return false;
249259Sdim}
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::DefinesPredicate(MachineInstr *MI,
249259Sdim                                std::vector<MachineOperand> &Pred) const {
249259Sdim  return isPredicateSetter(MI->getOpcode());
249259Sdim}
249259Sdim
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::SubsumesPredicate(const SmallVectorImpl<MachineOperand> &Pred1,
249259Sdim                       const SmallVectorImpl<MachineOperand> &Pred2) const {
249259Sdim  return false;
249259Sdim}
249259Sdim
249259Sdim
249259Sdimbool
249259SdimR600InstrInfo::PredicateInstruction(MachineInstr *MI,
249259Sdim                      const SmallVectorImpl<MachineOperand> &Pred) const {
249259Sdim  int PIdx = MI->findFirstPredOperandIdx();
249259Sdim
263508Sdim  if (MI->getOpcode() == AMDGPU::CF_ALU) {
263508Sdim    MI->getOperand(8).setImm(0);
263508Sdim    return true;
263508Sdim  }
263508Sdim
263508Sdim  if (MI->getOpcode() == AMDGPU::DOT_4) {
263508Sdim    MI->getOperand(getOperandIdx(*MI, AMDGPU::OpName::pred_sel_X))
263508Sdim        .setReg(Pred[2].getReg());
263508Sdim    MI->getOperand(getOperandIdx(*MI, AMDGPU::OpName::pred_sel_Y))
263508Sdim        .setReg(Pred[2].getReg());
263508Sdim    MI->getOperand(getOperandIdx(*MI, AMDGPU::OpName::pred_sel_Z))
263508Sdim        .setReg(Pred[2].getReg());
263508Sdim    MI->getOperand(getOperandIdx(*MI, AMDGPU::OpName::pred_sel_W))
263508Sdim        .setReg(Pred[2].getReg());
263508Sdim    MachineInstrBuilder MIB(*MI->getParent()->getParent(), MI);
263508Sdim    MIB.addReg(AMDGPU::PREDICATE_BIT, RegState::Implicit);
263508Sdim    return true;
263508Sdim  }
263508Sdim
249259Sdim  if (PIdx != -1) {
249259Sdim    MachineOperand &PMO = MI->getOperand(PIdx);
249259Sdim    PMO.setReg(Pred[2].getReg());
249259Sdim    MachineInstrBuilder MIB(*MI->getParent()->getParent(), MI);
249259Sdim    MIB.addReg(AMDGPU::PREDICATE_BIT, RegState::Implicit);
249259Sdim    return true;
249259Sdim  }
249259Sdim
249259Sdim  return false;
249259Sdim}
249259Sdim
263508Sdimunsigned int R600InstrInfo::getPredicationCost(const MachineInstr *) const {
263508Sdim  return 2;
263508Sdim}
263508Sdim
249259Sdimunsigned int R600InstrInfo::getInstrLatency(const InstrItineraryData *ItinData,
249259Sdim                                            const MachineInstr *MI,
249259Sdim                                            unsigned *PredCost) const {
249259Sdim  if (PredCost)
249259Sdim    *PredCost = 2;
249259Sdim  return 2;
249259Sdim}
249259Sdim
263508Sdimvoid  R600InstrInfo::reserveIndirectRegisters(BitVector &Reserved,
249259Sdim                                             const MachineFunction &MF) const {
249259Sdim  const AMDGPUFrameLowering *TFL =
249259Sdim                 static_cast<const AMDGPUFrameLowering*>(TM.getFrameLowering());
249259Sdim
249259Sdim  unsigned StackWidth = TFL->getStackWidth(MF);
249259Sdim  int End = getIndirectIndexEnd(MF);
249259Sdim
263508Sdim  if (End == -1)
263508Sdim    return;
249259Sdim
249259Sdim  for (int Index = getIndirectIndexBegin(MF); Index <= End; ++Index) {
249259Sdim    unsigned SuperReg = AMDGPU::R600_Reg128RegClass.getRegister(Index);
263508Sdim    Reserved.set(SuperReg);
249259Sdim    for (unsigned Chan = 0; Chan < StackWidth; ++Chan) {
249259Sdim      unsigned Reg = AMDGPU::R600_TReg32RegClass.getRegister((4 * Index) + Chan);
263508Sdim      Reserved.set(Reg);
249259Sdim    }
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimunsigned R600InstrInfo::calculateIndirectAddress(unsigned RegIndex,
249259Sdim                                                 unsigned Channel) const {
249259Sdim  // XXX: Remove when we support a stack width > 2
249259Sdim  assert(Channel == 0);
249259Sdim  return RegIndex;
249259Sdim}
249259Sdim
263508Sdimconst TargetRegisterClass *R600InstrInfo::getIndirectAddrRegClass() const {
263508Sdim  return &AMDGPU::R600_TReg32_XRegClass;
249259Sdim}
249259Sdim
249259SdimMachineInstrBuilder R600InstrInfo::buildIndirectWrite(MachineBasicBlock *MBB,
249259Sdim                                       MachineBasicBlock::iterator I,
249259Sdim                                       unsigned ValueReg, unsigned Address,
249259Sdim                                       unsigned OffsetReg) const {
249259Sdim  unsigned AddrReg = AMDGPU::R600_AddrRegClass.getRegister(Address);
249259Sdim  MachineInstr *MOVA = buildDefaultInstruction(*MBB, I, AMDGPU::MOVA_INT_eg,
249259Sdim                                               AMDGPU::AR_X, OffsetReg);
263508Sdim  setImmOperand(MOVA, AMDGPU::OpName::write, 0);
249259Sdim
249259Sdim  MachineInstrBuilder Mov = buildDefaultInstruction(*MBB, I, AMDGPU::MOV,
249259Sdim                                      AddrReg, ValueReg)
263508Sdim                                      .addReg(AMDGPU::AR_X,
263508Sdim                                           RegState::Implicit | RegState::Kill);
263508Sdim  setImmOperand(Mov, AMDGPU::OpName::dst_rel, 1);
249259Sdim  return Mov;
249259Sdim}
249259Sdim
249259SdimMachineInstrBuilder R600InstrInfo::buildIndirectRead(MachineBasicBlock *MBB,
249259Sdim                                       MachineBasicBlock::iterator I,
249259Sdim                                       unsigned ValueReg, unsigned Address,
249259Sdim                                       unsigned OffsetReg) const {
249259Sdim  unsigned AddrReg = AMDGPU::R600_AddrRegClass.getRegister(Address);
249259Sdim  MachineInstr *MOVA = buildDefaultInstruction(*MBB, I, AMDGPU::MOVA_INT_eg,
249259Sdim                                                       AMDGPU::AR_X,
249259Sdim                                                       OffsetReg);
263508Sdim  setImmOperand(MOVA, AMDGPU::OpName::write, 0);
249259Sdim  MachineInstrBuilder Mov = buildDefaultInstruction(*MBB, I, AMDGPU::MOV,
249259Sdim                                      ValueReg,
249259Sdim                                      AddrReg)
263508Sdim                                      .addReg(AMDGPU::AR_X,
263508Sdim                                           RegState::Implicit | RegState::Kill);
263508Sdim  setImmOperand(Mov, AMDGPU::OpName::src0_rel, 1);
249259Sdim
249259Sdim  return Mov;
249259Sdim}
249259Sdim
249259Sdimunsigned R600InstrInfo::getMaxAlusPerClause() const {
249259Sdim  return 115;
249259Sdim}
249259Sdim
249259SdimMachineInstrBuilder R600InstrInfo::buildDefaultInstruction(MachineBasicBlock &MBB,
249259Sdim                                                  MachineBasicBlock::iterator I,
249259Sdim                                                  unsigned Opcode,
249259Sdim                                                  unsigned DstReg,
249259Sdim                                                  unsigned Src0Reg,
249259Sdim                                                  unsigned Src1Reg) const {
249259Sdim  MachineInstrBuilder MIB = BuildMI(MBB, I, MBB.findDebugLoc(I), get(Opcode),
249259Sdim    DstReg);           // $dst
249259Sdim
249259Sdim  if (Src1Reg) {
249259Sdim    MIB.addImm(0)     // $update_exec_mask
249259Sdim       .addImm(0);    // $update_predicate
249259Sdim  }
249259Sdim  MIB.addImm(1)        // $write
249259Sdim     .addImm(0)        // $omod
249259Sdim     .addImm(0)        // $dst_rel
249259Sdim     .addImm(0)        // $dst_clamp
249259Sdim     .addReg(Src0Reg)  // $src0
249259Sdim     .addImm(0)        // $src0_neg
249259Sdim     .addImm(0)        // $src0_rel
249259Sdim     .addImm(0)        // $src0_abs
249259Sdim     .addImm(-1);       // $src0_sel
249259Sdim
249259Sdim  if (Src1Reg) {
249259Sdim    MIB.addReg(Src1Reg) // $src1
249259Sdim       .addImm(0)       // $src1_neg
249259Sdim       .addImm(0)       // $src1_rel
249259Sdim       .addImm(0)       // $src1_abs
249259Sdim       .addImm(-1);      // $src1_sel
249259Sdim  }
249259Sdim
249259Sdim  //XXX: The r600g finalizer expects this to be 1, once we've moved the
249259Sdim  //scheduling to the backend, we can change the default to 0.
249259Sdim  MIB.addImm(1)        // $last
249259Sdim      .addReg(AMDGPU::PRED_SEL_OFF) // $pred_sel
251662Sdim      .addImm(0)         // $literal
251662Sdim      .addImm(0);        // $bank_swizzle
249259Sdim
249259Sdim  return MIB;
249259Sdim}
249259Sdim
263508Sdim#define OPERAND_CASE(Label) \
263508Sdim  case Label: { \
263508Sdim    static const unsigned Ops[] = \
263508Sdim    { \
263508Sdim      Label##_X, \
263508Sdim      Label##_Y, \
263508Sdim      Label##_Z, \
263508Sdim      Label##_W \
263508Sdim    }; \
263508Sdim    return Ops[Slot]; \
263508Sdim  }
263508Sdim
263508Sdimstatic unsigned getSlotedOps(unsigned  Op, unsigned Slot) {
263508Sdim  switch (Op) {
263508Sdim  OPERAND_CASE(AMDGPU::OpName::update_exec_mask)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::update_pred)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::write)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::omod)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::dst_rel)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::clamp)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src0)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src0_neg)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src0_rel)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src0_abs)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src0_sel)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src1)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src1_neg)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src1_rel)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src1_abs)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::src1_sel)
263508Sdim  OPERAND_CASE(AMDGPU::OpName::pred_sel)
263508Sdim  default:
263508Sdim    llvm_unreachable("Wrong Operand");
263508Sdim  }
263508Sdim}
263508Sdim
263508Sdim#undef OPERAND_CASE
263508Sdim
263508SdimMachineInstr *R600InstrInfo::buildSlotOfVectorInstruction(
263508Sdim    MachineBasicBlock &MBB, MachineInstr *MI, unsigned Slot, unsigned DstReg)
263508Sdim    const {
263508Sdim  assert (MI->getOpcode() == AMDGPU::DOT_4 && "Not Implemented");
263508Sdim  unsigned Opcode;
263508Sdim  const AMDGPUSubtarget &ST = TM.getSubtarget<AMDGPUSubtarget>();
263508Sdim  if (ST.getGeneration() <= AMDGPUSubtarget::R700)
263508Sdim    Opcode = AMDGPU::DOT4_r600;
263508Sdim  else
263508Sdim    Opcode = AMDGPU::DOT4_eg;
263508Sdim  MachineBasicBlock::iterator I = MI;
263508Sdim  MachineOperand &Src0 = MI->getOperand(
263508Sdim      getOperandIdx(MI->getOpcode(), getSlotedOps(AMDGPU::OpName::src0, Slot)));
263508Sdim  MachineOperand &Src1 = MI->getOperand(
263508Sdim      getOperandIdx(MI->getOpcode(), getSlotedOps(AMDGPU::OpName::src1, Slot)));
263508Sdim  MachineInstr *MIB = buildDefaultInstruction(
263508Sdim      MBB, I, Opcode, DstReg, Src0.getReg(), Src1.getReg());
263508Sdim  static const unsigned  Operands[14] = {
263508Sdim    AMDGPU::OpName::update_exec_mask,
263508Sdim    AMDGPU::OpName::update_pred,
263508Sdim    AMDGPU::OpName::write,
263508Sdim    AMDGPU::OpName::omod,
263508Sdim    AMDGPU::OpName::dst_rel,
263508Sdim    AMDGPU::OpName::clamp,
263508Sdim    AMDGPU::OpName::src0_neg,
263508Sdim    AMDGPU::OpName::src0_rel,
263508Sdim    AMDGPU::OpName::src0_abs,
263508Sdim    AMDGPU::OpName::src0_sel,
263508Sdim    AMDGPU::OpName::src1_neg,
263508Sdim    AMDGPU::OpName::src1_rel,
263508Sdim    AMDGPU::OpName::src1_abs,
263508Sdim    AMDGPU::OpName::src1_sel,
263508Sdim  };
263508Sdim
263508Sdim  MachineOperand &MO = MI->getOperand(getOperandIdx(MI->getOpcode(),
263508Sdim      getSlotedOps(AMDGPU::OpName::pred_sel, Slot)));
263508Sdim  MIB->getOperand(getOperandIdx(Opcode, AMDGPU::OpName::pred_sel))
263508Sdim      .setReg(MO.getReg());
263508Sdim
263508Sdim  for (unsigned i = 0; i < 14; i++) {
263508Sdim    MachineOperand &MO = MI->getOperand(
263508Sdim        getOperandIdx(MI->getOpcode(), getSlotedOps(Operands[i], Slot)));
263508Sdim    assert (MO.isImm());
263508Sdim    setImmOperand(MIB, Operands[i], MO.getImm());
263508Sdim  }
263508Sdim  MIB->getOperand(20).setImm(0);
263508Sdim  return MIB;
263508Sdim}
263508Sdim
249259SdimMachineInstr *R600InstrInfo::buildMovImm(MachineBasicBlock &BB,
249259Sdim                                         MachineBasicBlock::iterator I,
249259Sdim                                         unsigned DstReg,
249259Sdim                                         uint64_t Imm) const {
249259Sdim  MachineInstr *MovImm = buildDefaultInstruction(BB, I, AMDGPU::MOV, DstReg,
249259Sdim                                                  AMDGPU::ALU_LITERAL_X);
263508Sdim  setImmOperand(MovImm, AMDGPU::OpName::literal, Imm);
249259Sdim  return MovImm;
249259Sdim}
249259Sdim
263508SdimMachineInstr *R600InstrInfo::buildMovInstr(MachineBasicBlock *MBB,
263508Sdim                                       MachineBasicBlock::iterator I,
263508Sdim                                       unsigned DstReg, unsigned SrcReg) const {
263508Sdim  return buildDefaultInstruction(*MBB, I, AMDGPU::MOV, DstReg, SrcReg);
263508Sdim}
263508Sdim
263508Sdimint R600InstrInfo::getOperandIdx(const MachineInstr &MI, unsigned Op) const {
249259Sdim  return getOperandIdx(MI.getOpcode(), Op);
249259Sdim}
249259Sdim
263508Sdimint R600InstrInfo::getOperandIdx(unsigned Opcode, unsigned Op) const {
263508Sdim  return AMDGPU::getNamedOperandIdx(Opcode, Op);
249259Sdim}
249259Sdim
263508Sdimvoid R600InstrInfo::setImmOperand(MachineInstr *MI, unsigned Op,
249259Sdim                                  int64_t Imm) const {
249259Sdim  int Idx = getOperandIdx(*MI, Op);
249259Sdim  assert(Idx != -1 && "Operand not supported for this instruction.");
249259Sdim  assert(MI->getOperand(Idx).isImm());
249259Sdim  MI->getOperand(Idx).setImm(Imm);
249259Sdim}
249259Sdim
249259Sdim//===----------------------------------------------------------------------===//
249259Sdim// Instruction flag getters/setters
249259Sdim//===----------------------------------------------------------------------===//
249259Sdim
249259Sdimbool R600InstrInfo::hasFlagOperand(const MachineInstr &MI) const {
249259Sdim  return GET_FLAG_OPERAND_IDX(get(MI.getOpcode()).TSFlags) != 0;
249259Sdim}
249259Sdim
249259SdimMachineOperand &R600InstrInfo::getFlagOp(MachineInstr *MI, unsigned SrcIdx,
249259Sdim                                         unsigned Flag) const {
249259Sdim  unsigned TargetFlags = get(MI->getOpcode()).TSFlags;
249259Sdim  int FlagIndex = 0;
249259Sdim  if (Flag != 0) {
249259Sdim    // If we pass something other than the default value of Flag to this
249259Sdim    // function, it means we are want to set a flag on an instruction
249259Sdim    // that uses native encoding.
249259Sdim    assert(HAS_NATIVE_OPERANDS(TargetFlags));
249259Sdim    bool IsOP3 = (TargetFlags & R600_InstFlag::OP3) == R600_InstFlag::OP3;
249259Sdim    switch (Flag) {
249259Sdim    case MO_FLAG_CLAMP:
263508Sdim      FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::clamp);
249259Sdim      break;
249259Sdim    case MO_FLAG_MASK:
263508Sdim      FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::write);
249259Sdim      break;
249259Sdim    case MO_FLAG_NOT_LAST:
249259Sdim    case MO_FLAG_LAST:
263508Sdim      FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::last);
249259Sdim      break;
249259Sdim    case MO_FLAG_NEG:
249259Sdim      switch (SrcIdx) {
263508Sdim      case 0: FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::src0_neg); break;
263508Sdim      case 1: FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::src1_neg); break;
263508Sdim      case 2: FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::src2_neg); break;
249259Sdim      }
249259Sdim      break;
249259Sdim
249259Sdim    case MO_FLAG_ABS:
249259Sdim      assert(!IsOP3 && "Cannot set absolute value modifier for OP3 "
249259Sdim                       "instructions.");
249259Sdim      (void)IsOP3;
249259Sdim      switch (SrcIdx) {
263508Sdim      case 0: FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::src0_abs); break;
263508Sdim      case 1: FlagIndex = getOperandIdx(*MI, AMDGPU::OpName::src1_abs); break;
249259Sdim      }
249259Sdim      break;
249259Sdim
249259Sdim    default:
249259Sdim      FlagIndex = -1;
249259Sdim      break;
249259Sdim    }
249259Sdim    assert(FlagIndex != -1 && "Flag not supported for this instruction");
249259Sdim  } else {
249259Sdim      FlagIndex = GET_FLAG_OPERAND_IDX(TargetFlags);
249259Sdim      assert(FlagIndex != 0 &&
249259Sdim         "Instruction flags not supported for this instruction");
249259Sdim  }
249259Sdim
249259Sdim  MachineOperand &FlagOp = MI->getOperand(FlagIndex);
249259Sdim  assert(FlagOp.isImm());
249259Sdim  return FlagOp;
249259Sdim}
249259Sdim
249259Sdimvoid R600InstrInfo::addFlag(MachineInstr *MI, unsigned Operand,
249259Sdim                            unsigned Flag) const {
249259Sdim  unsigned TargetFlags = get(MI->getOpcode()).TSFlags;
249259Sdim  if (Flag == 0) {
249259Sdim    return;
249259Sdim  }
249259Sdim  if (HAS_NATIVE_OPERANDS(TargetFlags)) {
249259Sdim    MachineOperand &FlagOp = getFlagOp(MI, Operand, Flag);
249259Sdim    if (Flag == MO_FLAG_NOT_LAST) {
249259Sdim      clearFlag(MI, Operand, MO_FLAG_LAST);
249259Sdim    } else if (Flag == MO_FLAG_MASK) {
249259Sdim      clearFlag(MI, Operand, Flag);
249259Sdim    } else {
249259Sdim      FlagOp.setImm(1);
249259Sdim    }
249259Sdim  } else {
249259Sdim      MachineOperand &FlagOp = getFlagOp(MI, Operand);
249259Sdim      FlagOp.setImm(FlagOp.getImm() | (Flag << (NUM_MO_FLAGS * Operand)));
249259Sdim  }
249259Sdim}
249259Sdim
249259Sdimvoid R600InstrInfo::clearFlag(MachineInstr *MI, unsigned Operand,
249259Sdim                              unsigned Flag) const {
249259Sdim  unsigned TargetFlags = get(MI->getOpcode()).TSFlags;
249259Sdim  if (HAS_NATIVE_OPERANDS(TargetFlags)) {
249259Sdim    MachineOperand &FlagOp = getFlagOp(MI, Operand, Flag);
249259Sdim    FlagOp.setImm(0);
249259Sdim  } else {
249259Sdim    MachineOperand &FlagOp = getFlagOp(MI);
249259Sdim    unsigned InstFlags = FlagOp.getImm();
249259Sdim    InstFlags &= ~(Flag << (NUM_MO_FLAGS * Operand));
249259Sdim    FlagOp.setImm(InstFlags);
249259Sdim  }
249259Sdim}