# Set up LiteRT to optimize an AI model tflite Sheet.256 Sheet.27 Input data Input data Sheet.28 LiteRT model LiteRTmodel Sheet.29 Output result Output result Sheet.102 Sheet.103 Sheet.104 Sheet.105 Sheet.106 Sheet.107 Sheet.108 Sheet.109 Sheet.110 Sheet.111 Sheet.112 Sheet.113 Sheet.114 Sheet.115 Sheet.116 Sheet.117 Sheet.118 Sheet.119 Sheet.120 Sheet.121 Sheet.122 Sheet.123 Sheet.124 Sheet.125 Sheet.126 Sheet.127 Sheet.128 Sheet.129 Sheet.130 Sheet.131 Sheet.132 Sheet.133 Sheet.134 Sheet.135 Sheet.136 Sheet.137 Sheet.138 Sheet.139 Sheet.140 Sheet.141 Sheet.142 Sheet.143 Sheet.144 Sheet.145 Sheet.146 Sheet.147 Sheet.148 Sheet.149 Sheet.150 Sheet.151 Sheet.152 Sheet.153 Sheet.154 Sheet.155 Sheet.156 Sheet.157 Sheet.158 Sheet.159 Sheet.160 Sheet.161 Sheet.162 Sheet.163 Sheet.164 Sheet.165 Sheet.166 Sheet.167 Sheet.168 Sheet.169 GPU GPU Sheet.240 LiteRT runtime LiteRT runtime Sheet.241 Delegates Delegates Sheet.242 XNNPack delegate for CPU XNNPack delegate for CPU Sheet.243 GPU delegate GPUdelegate Sheet.244 QNN delegate QNNdelegate Sheet.245 Sheet.100 Sheet.34 Sheet.35 Sheet.36 Sheet.37 Sheet.38 Sheet.39 Sheet.40 Sheet.41 Sheet.42 Sheet.43 Sheet.44 Sheet.45 Sheet.46 Sheet.47 Sheet.48 Sheet.49 Sheet.50 Sheet.51 Sheet.52 Sheet.53 Sheet.54 Sheet.55 Sheet.56 Sheet.57 Sheet.58 Sheet.59 Sheet.60 Sheet.61 Sheet.62 Sheet.63 Sheet.64 Sheet.65 Sheet.66 Sheet.67 Sheet.68 Sheet.69 Sheet.70 Sheet.71 Sheet.72 Sheet.73 Sheet.74 Sheet.75 Sheet.76 Sheet.77 Sheet.78 Sheet.79 Sheet.80 Sheet.81 Sheet.82 Sheet.83 Sheet.84 Sheet.85 Sheet.86 Sheet.87 Sheet.88 Sheet.89 Sheet.90 Sheet.91 Sheet.92 Sheet.93 Sheet.94 Sheet.95 Sheet.96 Sheet.97 Sheet.98 Sheet.99 Sheet.101 CPU CPU Sheet.170 Sheet.171 Sheet.172 Sheet.173 Sheet.174 Sheet.175 Sheet.176 Sheet.177 Sheet.178 Sheet.179 Sheet.180 Sheet.181 Sheet.182 Sheet.183 Sheet.184 Sheet.185 Sheet.186 Sheet.187 Sheet.188 Sheet.189 Sheet.190 Sheet.191 Sheet.192 Sheet.193 Sheet.194 Sheet.195 Sheet.196 Sheet.197 Sheet.198 Sheet.199 Sheet.200 Sheet.201 Sheet.202 Sheet.203 Sheet.204 Sheet.205 Sheet.206 Sheet.207 Sheet.208 Sheet.209 Sheet.210 Sheet.211 Sheet.212 Sheet.213 Sheet.214 Sheet.215 Sheet.216 Sheet.217 Sheet.218 Sheet.219 Sheet.220 Sheet.221 Sheet.222 Sheet.223 Sheet.224 Sheet.225 Sheet.226 Sheet.227 Sheet.228 Sheet.229 Sheet.230 Sheet.231 Sheet.232 Sheet.233 Sheet.234 Sheet.235 Sheet.236 Sheet.237 HTP HTP Sheet.250 Sheet.251 Sheet.252 Sheet.253 Sheet.254 Sheet.255 LiteRT is an open-source deep learning framework for on-device inference. LiteRT helps developers run their models on mobile, embedded, and edge platforms by optimizing the model for latency, model size, power consumption, etc. Qualcomm supports executing LiteRT models natively on Qualcomm Linux hardware through LiteRT Delegates as listed below. | **Delegate** | **Acceleration** | | --- | --- | | AI Engine Direct Delegate (QNN Delegate) | CPU, GPU and HTP | | XNNPack Delegate | CPU | | GPU Delegate | GPU | Reference guide ![arrow-right](data:image/png;base64,UklGRpwAAABXRUJQVlA4TJAAAAAvF8AFEH+goG0bxqU4/kwuDQNp22T7Hd2/tito24Zxx5/keDw1kaw6pAoFSMK/iB/qXPECxHNdR35a5LyfAAqFBeA/Hm9S6E2CUWxbbf5gABvsO2yRgABSJERZJERCJMRBb/sM1UBE/xWmbcM46e4lUEfjF2LpUYCVX6HiHS5YDP3Jhgk/hl+K1nlAASYCVQQ=) [Reference guide](https://docs.qualcomm.com/bundle/publicresource/topics/80-70018-54/tflite-landing-page.html) Run sample app ![arrow-right](data:image/png;base64,UklGRpwAAABXRUJQVlA4TJAAAAAvF8AFEH+goG0bxqU4/kwuDQNp22T7Hd2/tito24Zxx5/keDw1kaw6pAoFSMK/iB/qXPECxHNdR35a5LyfAAqFBeA/Hm9S6E2CUWxbbf5gABvsO2yRgABSJERZJERCJMRBb/sM1UBE/xWmbcM46e4lUEfjF2LpUYCVX6HiHS5YDP3Jhgk/hl+K1nlAASYCVQQ=) [Run](https://docs.qualcomm.com/bundle/publicresource/topics/80-70018-50/ai-ml-sample-applications.html) API Reference ![arrow-right-up](data:image/png;base64,UklGRnoAAABXRUJQVlA4TG4AAAAvF8AFEDdAIAiRO/7v4waBIETu+L8PAUni/6l9CBS0bcOUepmeDcYLoO0x6J8S2iYYtY0kKVIjmAvAQJg9IGzjaP40tqdeAyCi/xPASXsppcxs/EoGRFd8CdFN8MUuugm+2EU3wRdCN+UF+LJDAg==) [C/C++](https://www.tensorflow.org/lite/api_docs/cc?_gl=1%2Axotull%2A_ga%2AOTM5NzE4ODUwLjE2ODk2OTQ3MDI.%2A_ga_W0YLR4190T%2AMTcxNTM3NzQyMS4yNy4xLjE3MTUzNzc0MjEuMC4wLjA) Last Published: Oct 13, 2025 [Previous Topic Use AI Hub to optimize an AI model](https://docs.qualcomm.com/bundle/publicresource/80-70018-15B/topics/ai-hub.md) [Next Topic Use Qualcomm AI Runtime SDK to optimize an AI model](https://docs.qualcomm.com/bundle/publicresource/80-70018-15B/topics/qairt.md)