<!-- mobian-agent-page publisher="dailydev" canonical="https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u" -->

---
title: Advancing GPU Programming with the CUDA Tile IR Backend...
description: NVIDIA is integrating CUDA Tile as a backend for OpenAI Triton, enabling developers to compile Triton kernels to CUDA Tile IR instead of PTX. CUDA Tile,...
canonical: https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u
twitter:card: summary_large_image
twitter:site: @dailydotdev
og:type: website
og:site_name: daily.dev
og:title: Advancing GPU Programming with the CUDA Tile IR Backend for OpenAI Triton | daily.dev
og:description: NVIDIA is integrating CUDA Tile as a backend for OpenAI Triton, enabling developers to compile Triton kernels to CUDA Tile IR instead of PTX. CUDA Tile,...
og:url: https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u
og:image: https://api.daily.dev/og/posts/TDsXd1o1U.png
og:image:alt: Advancing GPU Programming with the CUDA Tile IR Backend for OpenAI Triton
og:image:width: 1200
og:image:height: 630
og:locale: en
---

> ## Documentation Index
> Fetch the complete documentation index at: https://daily.dev/llms.txt
> Use this file to discover all available pages before exploring further.

# Advancing GPU Programming with the CUDA Tile IR Backend for OpenAI Triton

**[NVIDIA Developer](https://daily.dev/sources/nvidiadev)** · 8 min read · 0 upvotes · 0 comments

## Summary

NVIDIA is integrating CUDA Tile as a backend for OpenAI Triton, enabling developers to compile Triton kernels to CUDA Tile IR instead of PTX. CUDA Tile, introduced in CUDA 13.1, shifts GPU programming from thread-level SIMT to tile-based abstractions, reducing complexity while enabling compiler optimizations. The Triton-to-TileIR bridge preserves tile-level semantics and provides native Tensor Core support with architectural portability. Currently in active development as an incubator project, it requires CUDA 13.1+ and Blackwell GPUs, with source-based compilation only. Known limitations include unsupported operations and suboptimal tensor-of-pointer performance, which can be addressed by adopting TMA load/store APIs. Users can switch backends via environment variables without code rewrites.

## Full article

daily.dev links to this article rather than hosting it. Read it at the original source: <https://developer.nvidia.com/blog/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton/>

## Similar posts on daily.dev

- [NVIDIA/cuda-tile: CUDA Tile IR is an MLIR-based intermediate representation and compiler infrastructure for CUDA kernel optimization, focusing on tile-based computation patterns and optimizations targ](https://daily.dev/posts/nvidia-cuda-tile-cuda-tile-ir-is-an-mlir-based-intermediate-representation-and-compiler-infrastruct-acvocrzbi) · Hacker News · 1 upvotes · 0 comments

---

Tags: [#nvidia](https://daily.dev/tags/nvidia), [#gpu](https://daily.dev/tags/gpu), [#compiler](https://daily.dev/tags/compiler), [#cuda](https://daily.dev/tags/cuda)

[View this post on daily.dev](https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u)

```json
{"@context":"https://schema.org","@graph":[{"@type":"Organization","@id":"https://daily.dev/#organization","name":"daily.dev","url":"https://daily.dev","logo":{"@type":"ImageObject","url":"https://daily.dev/apple-touch-icon.png","width":180,"height":180},"sameAs":["https://twitter.com/dailydotdev","https://github.com/dailydotdev","https://www.linkedin.com/company/daily-dev-ltd"]},{"@type":"WebSite","@id":"https://daily.dev/#website","url":"https://daily.dev","name":"daily.dev","publisher":{"@id":"https://daily.dev/#organization"},"potentialAction":{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https://daily.dev/search?q={search_term_string}"},"query-input":"required name=search_term_string"}}]}
{"@context":"https://schema.org","@type":"TechArticle","headline":"Advancing GPU Programming with the CUDA Tile IR Backend for OpenAI Triton","url":"https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u","mainEntityOfPage":{"@type":"WebPage","@id":"https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u"},"datePublished":"2026-01-30T20:04:35.362Z","dateModified":"2026-01-30T20:05:00.249Z","description":"NVIDIA is integrating CUDA Tile as a backend for OpenAI Triton, enabling developers to compile Triton kernels to CUDA Tile IR instead of PTX. CUDA Tile,...","image":"https://media.daily.dev/image/upload/f_auto,q_auto/v1/posts/88b9d74b38bf7137a8fc4dd4d31d1595?_a=AQAEulh","thumbnailUrl":"https://media.daily.dev/image/upload/f_auto,q_auto/v1/posts/88b9d74b38bf7137a8fc4dd4d31d1595?_a=AQAEulh","isAccessibleForFree":true,"articleSection":"NVIDIA Developer","inLanguage":"en","publisher":{"@type":"Organization","name":"daily.dev","url":"https://daily.dev","logo":{"@type":"ImageObject","url":"https://daily.dev/apple-touch-icon.png","width":180,"height":180}},"author":{"@type":"Organization","name":"NVIDIA Developer","logo":"https://media.daily.dev/image/upload/t_logo,f_auto/v1/logos/86e45aab42ba48ce83103d01b1119910","url":"https://daily.dev/sources/nvidiadev"},"commentCount":0,"discussionUrl":"https://daily.dev/posts/advancing-gpu-programming-with-the-cuda-tile-ir-backend-for-openai-triton-tdsxd1o1u","interactionStatistic":[{"@type":"InteractionCounter","interactionType":{"@type":"LikeAction"},"userInteractionCount":0},{"@type":"InteractionCounter","interactionType":{"@type":"CommentAction"},"userInteractionCount":0}],"keywords":"nvidia,gpu,compiler,cuda","timeRequired":"PT8M"}
{"@context":"https://schema.org","@type":"BreadcrumbList","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https://daily.dev"},{"@type":"ListItem","position":2,"name":"NVIDIA Developer","item":"https://daily.dev/sources/nvidiadev"},{"@type":"ListItem","position":3,"name":"Advancing GPU Programming with the CUDA Tile IR Backend for OpenAI Triton"}]}
```

