<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>References on FlagGems</title><link>https://flagos-ai.github.io/FlagGems/references/</link><description>Recent content in References on FlagGems</description><generator>Hugo</generator><language>en</language><atom:link href="https://flagos-ai.github.io/FlagGems/references/index.xml" rel="self" type="application/rss+xml"/><item><title>Operators Supported</title><link>https://flagos-ai.github.io/FlagGems/references/operators/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://flagos-ai.github.io/FlagGems/references/operators/</guid><description>&lt;!--
 Copyright 2026 FlagOS Contributors

 Licensed under the Apache License, Version 2.0 (the "License");
 you may not use this file except in compliance with the License.
 You may obtain a copy of the License at

 http://www.apache.org/licenses/LICENSE-2.0

 Unless required by applicable law or agreed to in writing, software
 distributed under the License is distributed on an "AS IS" BASIS,
 WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
 See the License for the specific language governing permissions and
 limitations under the License.
 --&gt;
&lt;h1 id="operator-list"&gt;Operator List&lt;a class="anchor" href="#operator-list"&gt;#&lt;/a&gt;&lt;/h1&gt;



&lt;table&gt;
&lt;thead&gt;
 &lt;tr&gt;
 &lt;th&gt;No.&lt;/th&gt;
 &lt;th&gt;Name&lt;/th&gt;
 &lt;th&gt;Kind&lt;/th&gt;
 &lt;th&gt;Stage&lt;/th&gt;
 &lt;th&gt;Since&lt;/th&gt;
 &lt;th&gt;Labels&lt;/th&gt;
 &lt;th&gt;Description&lt;/th&gt;
 &lt;tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;


&lt;tr&gt;
 &lt;td&gt;1 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;_adaptive_avg_pool3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of 3D adaptive average pooling.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;2 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;_flash_attention_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Run the canonical FlashAttention forward operator.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;3 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;_reshape_alias&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a view of the input tensor with the given size and stride,
sharing the same storage as the input. This is an internal reshape
helper that skips the validity checks a normal reshape performs.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;4 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;_weight_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, fused, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Reparameterizes a module's weight tensor by decoupling its magnitude (g)
from its direction (v). It is a hook that compute the actual weight before
each forward pass.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;5 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;abs&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the absolute value of each element in &lt;code&gt;input&lt;/code&gt;.
This is a simple wrapper of the existing torch &lt;code&gt;abs&lt;/code&gt; operator.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;6 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;abs_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;abs()&lt;/code&gt;, which is a simple wrapper of the Torch &lt;code&gt;abs&lt;/code&gt; operator.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;7 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;absolute&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aaten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is an alias for &lt;code&gt;abs()&lt;/code&gt; with the low-level operations implemented
by invoking low-level Torch operators.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;8 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;absolute_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;absolute()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;9 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;acos&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the arccosine (in radians) of each element in &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;10 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;acos_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, inplace, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of acos. Computes the arccosine (in radians) of each element of &lt;code&gt;input&lt;/code&gt; and writes the result back to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;11 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;acosh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for acosh.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;12 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;acosh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;acosh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;13 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;act_quant_triton&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 This is a fused operator.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;14 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_avg_pool1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a one-dimensional adaptive average pooling over an input signal,
producing an output of the requested length.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;15 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_avg_pool2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Apply a 2D adaptive average pooling over an input signal composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;16 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_avg_pool2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of two-dimensional adaptive average pooling with
respect to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;17 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_avg_pool3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of 3D adaptive average pooling.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;18 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_max_pool2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies two-dimensional adaptive max pooling and returns both pooled values
and the selected input indices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;19 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_max_pool2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the input gradient for two-dimensional adaptive max pooling by
scattering output gradients to the saved maximum indices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;20 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;adaptive_max_pool3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient for adaptive max pooling 3D.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;21 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;add&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Add a scalar or tensor to &lt;code&gt;self&lt;/code&gt; tensor. If both &lt;code&gt;alpha&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt; are specified,
each element of &lt;code&gt;other&lt;/code&gt; is scaled by &lt;code&gt;alpha&lt;/code&gt; before being used.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;22 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;add_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;add()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;23 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;add_relu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for _add_relu.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;24 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;add_relu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for the in-place &lt;code&gt;_add_relu_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;25 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;add_rms_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Normalization&lt;/td&gt;
 &lt;td&gt;
 Add two inputs element-wise and apply Root Mean Square Layer Normalization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;26 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addbmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs a batch matrix-matrix product of matrices in &lt;code&gt;batch1&lt;/code&gt; and &lt;code&gt;batch2&lt;/code&gt;,
with a reduced add step (sum over batch dimension), and adds &lt;code&gt;input&lt;/code&gt; to the result.
Formula: out = beta * input + alpha * (sum_i batch1_i @ batch2_i).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;27 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addbmm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Inplace variant of addbmm. Performs a batch matrix-matrix product of matrices in
&lt;code&gt;batch1&lt;/code&gt; and &lt;code&gt;batch2&lt;/code&gt;, with a reduced add step, and stores the result in &lt;code&gt;self&lt;/code&gt;.
Formula: self = beta * self + alpha * (sum_i batch1_i @ batch2_i).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;28 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcdiv&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Performs the element-wise division of &lt;code&gt;tensor1&lt;/code&gt; by &lt;code&gt;tensor2&lt;/code&gt;, multiplies the result
by the scalar &lt;code&gt;value&lt;/code&gt; and adds it to &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;29 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcdiv_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;addcdiv()&lt;/code&gt;. Performs the element-wise division of
&lt;code&gt;tensor1&lt;/code&gt; by &lt;code&gt;tensor2&lt;/code&gt;, multiplies the result by the scalar &lt;code&gt;value&lt;/code&gt; and adds
it to &lt;code&gt;input&lt;/code&gt;, storing the result in &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;30 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcdiv_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;addcdiv()&lt;/code&gt; that assigns the output to the given &lt;code&gt;out&lt;/code&gt; parameter..
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;31 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcmul&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Performs the element-wise multiplication of &lt;code&gt;tensor1&lt;/code&gt; by &lt;code&gt;tensor2&lt;/code&gt;,
multiplies the result by the scalar &lt;code&gt;value&lt;/code&gt; and adds it to &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;32 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcmul_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;addcmul()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;33 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addcmul_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;addcmul&lt;/code&gt; that allows the output to be assigned to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;34 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix multiplication of the matrices &lt;code&gt;mat1&lt;/code&gt; and &lt;code&gt;mat2&lt;/code&gt;.
The matrix &lt;code&gt;input&lt;/code&gt; is added to the final result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;35 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;addmm&lt;/code&gt;. Performs the matrix multiplication of &lt;code&gt;mat1&lt;/code&gt;
and &lt;code&gt;mat2&lt;/code&gt;, multiplied by &lt;code&gt;alpha&lt;/code&gt;, then adds &lt;code&gt;beta&lt;/code&gt; times &lt;code&gt;input&lt;/code&gt; to the result
in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;36 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmm_dtype&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;addmm&lt;/code&gt; that allows the dtype of the output tensor to be specified.
This is supported only on CUDA and for &lt;code&gt;torch.float32&lt;/code&gt; given &lt;code&gt;torch.float16&lt;/code&gt; or &lt;code&gt;torch.bfloat16&lt;/code&gt; input dtypes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;37 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmm_dtype_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;addmm_dtype()&lt;/code&gt; that allows the output to be saved to the provided &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;38 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;addmm&lt;/code&gt; that assigns to the output to the provided &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;39 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmv&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix-vector product of the matrix &lt;code&gt;mat&lt;/code&gt; and the vector &lt;code&gt;vec&lt;/code&gt;.
The vector &lt;code&gt;input&lt;/code&gt; is added to the final result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;40 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmv_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs matrix-vector product with accumulation in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;41 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addmv_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix-vector product of the matrix &lt;code&gt;mat&lt;/code&gt; and the vector &lt;code&gt;vec&lt;/code&gt;.
The vector &lt;code&gt;input&lt;/code&gt; is added to the final result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;42 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs the outer-product of vectors &lt;code&gt;vec1&lt;/code&gt; and &lt;code&gt;vec2&lt;/code&gt;
and adds it to the matrix &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;43 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;addr_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of addr. Performs the outer-product of vectors &lt;code&gt;vec1&lt;/code&gt; and &lt;code&gt;vec2&lt;/code&gt;
and adds it to the matrix &lt;code&gt;input&lt;/code&gt; in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;44 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;affine_grid_generator&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Generates a 2D or 3D flow field (sampling grid), given a batch of affine matrices theta.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;45 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;alias&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Return a view tensor sharing the same storage (zero-copy alias).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;46 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;alias_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a new tensor that shares the same storage data as the original tensor,
but without preserving the original tensor's metadata (like shape or strides)
in a way that links future mutations.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;47 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;alias_copy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;alias_copy()&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;48 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;all&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Tests if all elements in input evaluate to True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;49 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;all_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 For each row of &lt;code&gt;input&lt;/code&gt; in the given dimension &lt;code&gt;dim&lt;/code&gt;, returns True if all elements
in the row evaluate to True and False otherwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;50 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;all_dims&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;all&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;51 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;allclose&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This function checks if &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt; satisfy a condition specified via
&lt;code&gt;atol&lt;/code&gt; and &lt;code&gt;rtol&lt;/code&gt; elementwise, for all elements of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;52 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;alpha_dropout&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies alpha dropout to the input. Alpha Dropout is a type of Dropout
that maintains the self-normalizing property by scaling activations
with SELU activation function parameters.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;53 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;alpha_dropout_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies alpha dropout to the input inplace. Alpha Dropout is a type of
Dropout that maintains the self-normalizing property by scaling
activations with SELU activation function parameters.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;54 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;amax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the maximum value of each slice of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension(s) &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;55 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;amin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the minimum value of each row of the input tensor in the given dimension dim.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;56 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;amin_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of amin, returns the minimum value of each row in the given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;57 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;aminmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the minimum and maximum values of the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;58 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;amp_foreach_non_finite_check_and_unscale_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Checks gradient tensors for non-finite values (inf or nan) and
unscales each tensor in-place by &lt;code&gt;inv_scale&lt;/code&gt;. If any non-finite
value is detected, &lt;code&gt;found_inf&lt;/code&gt; is set to 1.0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;59 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;amp_update_scale_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Updates the AMP loss scale in-place: when &lt;code&gt;found_inf&lt;/code&gt; is non-zero the
scale is multiplied by &lt;code&gt;scale_backoff_factor&lt;/code&gt; and the growth tracker
is reset to 0; otherwise the growth tracker is incremented and, once
it reaches &lt;code&gt;growth_interval&lt;/code&gt;, the scale is multiplied by
&lt;code&gt;scale_growth_factor&lt;/code&gt; and the tracker is reset to 0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;60 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;and_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise AND operation through the tensor dunder method with a scalar operand.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;61 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;and_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise AND operation through the tensor dunder method with tensor operands.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;62 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;angle&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise angle (in radians) of the given &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;63 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;any&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Tests if any element in &lt;code&gt;input&lt;/code&gt; evaluates to True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;64 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;any_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 For each row of &lt;code&gt;input&lt;/code&gt; in the given dimension &lt;code&gt;dim&lt;/code&gt;, returns True if any element in the row evaluate to True and False otherwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;65 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;any_dims&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 For each row of &lt;code&gt;input&lt;/code&gt; in the given dimensions in &lt;code&gt;dims&lt;/code&gt;, returns True if any element in the row evaluate to True and False otherwise.
The &lt;code&gt;dims&lt;/code&gt; contains tuple of ints indicating the dimensions to reduce.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;66 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;apply_repetition_penalties&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 Modifies logit tensors in place to penalize tokens that have already appeared in the generated sequence.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;67 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;apply_rotary_pos_emb&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 A method to incorporate positional information into the Transformer architecture.
Rotary Positional Embedding (RoPE) applies position-dependent rotation to the query (Q)
and key (K) vectors before computing the attention score.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;68 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arange&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a 1-D tensor of size &lt;code&gt;ceiling((end−start)/step)&lt;/code&gt; with values from the interval &lt;code&gt;[start, end)&lt;/code&gt;
taken with common difference &lt;code&gt;step&lt;/code&gt; beginning from start.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;69 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arange_start&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arange&lt;/code&gt;, with &lt;code&gt;start&lt;/code&gt; and/or &lt;code&gt;step&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;70 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arange_start_step&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arange&lt;/code&gt;, with &lt;code&gt;start&lt;/code&gt; and/or &lt;code&gt;step&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;71 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arccos&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the arccosine of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;72 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arccos_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;arccos()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;73 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arccosh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the inverse hyperbolic cosine of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;74 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arccosh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise inverse hyperbolic cosine of a given input tensor.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;75 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arccosh_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arccosh&lt;/code&gt; that allows the output to be assigned to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;76 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the arcsine of the elements of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;77 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsin_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;arcsin()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;78 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsin_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arcsin&lt;/code&gt; that allows the output to be assigned to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;79 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsinh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs an element-wise inverse hyperbolic sine computation on the given tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;80 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsinh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;arcsinh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;81 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arcsinh_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arcsinh&lt;/code&gt; that allows the output to be assigned to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;82 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctan&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the element-wise inverse tangent (arctangent) of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;83 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctan2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise arctangent of &lt;code&gt;input&lt;/code&gt; / &lt;code&gt;other&lt;/code&gt;. Alias for &lt;code&gt;atan2&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;84 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctan2_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;arctan2()&lt;/code&gt;.
Computes the element-wise arc tangent of &lt;code&gt;input/other(y/x)&lt;/code&gt;,
returning angles in radians between &lt;code&gt;-PI&lt;/code&gt; and &lt;code&gt;PI&lt;/code&gt; and stores the result in &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;85 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctan_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise inverse tangent (arctangent) of a given input tensor.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;86 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctanh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise inverse hyperbolic tangent of a given input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;87 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctanh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise inverse hyperbolic tangent of a given input tensor.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;88 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;arctanh_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;arctanh&lt;/code&gt; that assigns the output to the provided &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;89 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;argmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the indices of the maximum value of all elements in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;90 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;argmin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the indices of the minimum value(s) of the flattened tensor or along a dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;91 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;argsort&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;skip_precision_check, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Sorting/selection operator (argsort).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;92 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;as_strided_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a contiguous copy of an &lt;code&gt;as_strided&lt;/code&gt; view of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;93 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;as_strided_copy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;as_strided_copy()&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;94 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;as_strided_scatter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a clone of the input storage with source values written through a
view defined by the requested size, stride, and storage offset.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;95 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;asin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the arcsine of the elements of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;96 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;asin_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;asin()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;97 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;asinh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the inverse hyperbolic sine of the elements of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;98 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;asinh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the inverse hyperbolic sine for each element of a tensor in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;99 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;assert_async&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;utility&lt;/td&gt;
 &lt;td&gt;
 A utility used to perform data-dependent assertions on GPU tensors
without triggering an immediate, performance-heavy GPU-to-CPU synchronization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;100 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atan&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the arctangent of the elements (in radians) in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;101 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atan2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise arc tangent of &lt;code&gt;input/other(y/x)&lt;/code&gt;,
returning angles in radians between &lt;code&gt;-PI&lt;/code&gt; and &lt;code&gt;PI&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;102 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atan2_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise arctangent of input/other in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;103 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atan2_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;atan2&lt;/code&gt; that allows the output to be saved into &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;104 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atan_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;atan()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;105 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atanh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for atanh.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;106 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;atanh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;atanh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;107 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;avg_pool1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies 1D average-pooling operation in kL regions by step size sL steps.
The number of output features is equal to the number of input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;108 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;avg_pool2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional&lt;/td&gt;
 &lt;td&gt;
 Applies 2D average-pooling operation in &lt;code&gt;kH \mul kW&lt;/code&gt; regions by step size &lt;code&gt;sH \mul sW&lt;/code&gt; steps.
The number of output features is equal to the number of input planes.
This is for the forward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;109 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;avg_pool2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;avg_pool2d()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;110 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;avg_pool3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies 3D average-pooling operation in &lt;code&gt;kD \times kH \times kW&lt;/code&gt; regions by step size
&lt;code&gt;sD \times sH \times sW&lt;/code&gt; steps.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;111 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;avg_pool3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the backward version of &lt;code&gt;avg_pool3d()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;112 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;baddbmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a batch matrix-matrix product of matrices in &lt;code&gt;batch1&lt;/code&gt; and &lt;code&gt;batch2&lt;/code&gt;.
&lt;code&gt;input&lt;/code&gt; is added to the final result. &lt;code&gt;batch1&lt;/code&gt; and &lt;code&gt;batch2&lt;/code&gt; must be 3-D tensors
each containing the same number of matrices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;113 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;baddbmm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs batched matrix-matrix product with accumulation in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;114 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;baddbmm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is a variant of &lt;code&gt;baddbmm()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;115 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 An internal operator used for implementing the &lt;code&gt;BatchNorm&lt;/code&gt; functionality.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;116 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;batch_norm()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;117 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm_impl_index&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies Batch Normalization and returns the normalized output along with saved statistics, a reserve tensor, and the backend implementation index.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;118 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm_impl_index_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward pass dispatcher for &lt;code&gt;_batch_norm_impl_index&lt;/code&gt;. Selects the
matching batch-norm backward backend (native / cudnn / miopen) from the
&lt;code&gt;impl_index&lt;/code&gt; returned by the forward and produces the gradients with
respect to the input, weight and bias.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;119 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm_no_update&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies Batch Normalization using precomputed running statistics without updating running_mean/running_var.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;120 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;batch_norm_with_update_functional&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Functional variant of _batch_norm_with_update that applies training-mode Batch Normalization and updates running statistics.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;121 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;beam_search_score&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;KernelGen, fused&lt;/td&gt;
 &lt;td&gt;
 Computes beam search scores by adding cumulative log probabilities with new token scores.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;122 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;beam_search_score_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;KernelGen, fused&lt;/td&gt;
 &lt;td&gt;
 In-place version of beam search score computation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;123 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bernoulli&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Draws binary random numbers (0 or 1) from a Bernoulli distribution with per-element probabilities.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;124 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bernoulli_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Draws binary random numbers (0 or 1) from a Bernoulli distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;125 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bf16_paged_mqa_logits&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute multi-head weighted ReLU attention logits on paged BF16
KV cache. Uses shape-specialized Triton kernels for H=32 and H=64
with zero-constexpr dispatch for decode-phase inference.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;126 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bilinear&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a bilinear transformation to the incoming data: y = x1^T A x2 + b.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;127 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binary_cross_entropy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Measures the binary cross entropy between the target and input probabilities,
with optional per-element weighting.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;128 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binary_cross_entropy_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of binary cross entropy loss with respect to the input, with optional per-element weight.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;129 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binary_cross_entropy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The out variant of binary_cross_entropy. Measures the binary cross entropy
between the target and input probabilities and writes the result to the
provided output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;130 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binary_cross_entropy_with_logits&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional, KernelGen, aten&lt;/td&gt;
 &lt;td&gt;
 Compute the binary cross entropy loss with logits.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;131 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bincount&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Count the frequency of each value in an array of non-negative integers.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;132 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binomial&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Draws samples from a binomial distribution with the number of trials
given by &lt;code&gt;count&lt;/code&gt; and the success probability given by &lt;code&gt;prob&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;133 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;binomial_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of binomial() that writes the result into the out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;134 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_and_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise AND of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt; scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;135 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_and_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place, scalar version of &lt;code&gt;bitwise_and()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;136 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_and_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;bitwise_and()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;137 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_and_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The Tensor method version of &lt;code&gt;bitwise_and()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;138 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_and_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place, Tensor method version of &lt;code&gt;bitwise_and()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;139 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_left_shift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the left arithmetic shift of &lt;code&gt;input&lt;/code&gt; by &lt;code&gt;other&lt;/code&gt; bits.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;140 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_left_shift_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_left_shift()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;141 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_not&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise NOT of the given &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;142 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_not_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_not()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;143 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_or_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise OR of scalars &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;144 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_or_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_or_scalar&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;145 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_or_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise OR of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;146 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_or_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise OR of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;, this is the Tensor method variant.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;147 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_or_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_or_tensor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;148 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_right_shift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the right arithmetic shift of &lt;code&gt;input&lt;/code&gt; by &lt;code&gt;other&lt;/code&gt; bits.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;149 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_right_shift_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_right_shift()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;150 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_xor_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise XOR of tensor &lt;code&gt;input&lt;/code&gt; and scalar &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;151 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_xor_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_xor_scalar()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;152 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_xor_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise XOR of scalar &lt;code&gt;input&lt;/code&gt; and tensor &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;153 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_xor_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise bitwise XOR of tensor &lt;code&gt;input&lt;/code&gt; and tensor &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;154 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bitwise_xor_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;bitwise_xor_tensor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;155 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;blackman_window&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Blackman window function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;156 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;blackman_window_periodic&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of blackman_window() that takes an explicit periodic flag.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;157 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;block_diag&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a block diagonal matrix from provided tensors. Each input tensor
forms a diagonal block in the output, with zeros elsewhere.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;158 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a batch matrix-matrix product of matrices stored in &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;mat2&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;159 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bmm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a batch matrix-matrix product of matrices stored in &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;mat2&lt;/code&gt;.
This is a variant of &lt;code&gt;bmm&lt;/code&gt; with &lt;code&gt;out&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;160 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bmm_w8a8_fp8&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, Quantization&lt;/td&gt;
 &lt;td&gt;
 Performs batched matrix multiplication with block-wise FP8 E4M3
quantized activations and weights using FP32 accumulation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;161 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;broadcast_tensors&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Broadcasts the given tensors to a common shape according to broadcasting semantics, returning a list of tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;162 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;broadcast_to&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Broadcasts input to the shape size. Equivalent to calling input.expand(size).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;163 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bucket_sort_topk&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, DSA&lt;/td&gt;
 &lt;td&gt;
 A wrapper of the TLE version and the Triton version bucket-sort topk operation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;164 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;bucketize&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the indices of the buckets to which each input value belongs.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;165 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cat&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Concatenates the given sequence of tensors in tensors in the given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;166 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cat_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;cat&lt;/code&gt; that assigns the result to the provided &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;167 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cauchy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Draws random numbers from a Cauchy distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;168 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cauchy_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Fills the tensor with numbers drawn from the Cauchy distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;169 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cdist&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the p-norm distance between each pair of the two collections of row vectors.
This is the canonical user-facing API for cdist computation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;170 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cdist_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the backward pass for the batched pairwise distance (cdist) computation,
computing the gradient with respect to the input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;171 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cdist_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the batched pairwise distance (cdist) between two collections of row vectors,
supporting p=2.0 (L2 norm).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;172 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ceil&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the ceil of the elements of &lt;code&gt;input&lt;/code&gt;, the smallest integer greater than
or equal to each element.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;173 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ceil_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;ceil()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;174 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ceil_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;ceil()&lt;/code&gt; with &lt;code&gt;out&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;175 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;celu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 Applies the quantized CELU (Continuously Differentiable Exponential Linear Unit)
activation function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;176 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;celu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;celu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;177 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;chalf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a copy of the tensor cast to the &lt;code&gt;complex32&lt;/code&gt; dtype. Real inputs are
down-cast to a complex tensor with zero imaginary part, and complex inputs have
both their real and imaginary components cast to half precision.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;178 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;channel_shuffle&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Divides the channels into groups and rearranges each group.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;179 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cholesky_inverse&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute inverse of symmetric positive-definite matrix from Cholesky factor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;180 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cholesky_solve&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Solves a system of linear equations with a symmetric positive-definite matrix
using its Cholesky factorization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;181 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cholesky_solve_helper&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Solves a positive-definite linear system using its lower- or upper-triangular
Cholesky factor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;182 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cholesky_solve_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Solves a system of linear equations with a symmetric positive-definite matrix
using its Cholesky factorization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;183 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;choose_qparams_optimized&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Chooses optimized quantization parameters (scale and zero-point) for a tensor
by searching candidate value ranges and selecting the pair that minimizes the
quantization error.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;184 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;chunk&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Split a tensor into a specific number of chunks along a given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;185 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;chunk_cat&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for _chunk_cat.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;186 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;chunk_gated_delta_rule_fwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, FLA&lt;/td&gt;
 &lt;td&gt;
 The forward case for &lt;code&gt;ChunkGatedDeltaRuleFunction&lt;/code&gt; with Flash Linear Attention (FLA).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;187 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Clamps all elements in &lt;code&gt;input&lt;/code&gt; into the range &lt;code&gt;[min, max]&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;188 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;clamp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;189 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_max&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Clamps all elements in &lt;code&gt;input&lt;/code&gt; to be smaller or equal &lt;code&gt;max&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;190 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_max_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;clamp_max()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;191 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_min&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;clamp()&lt;/code&gt; with &lt;code&gt;min&lt;/code&gt; set to &lt;code&gt;min&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;192 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_min_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;clamp_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;193 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The tensor version of &lt;code&gt;clamp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;194 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clamp_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place, tensor version of &lt;code&gt;clamp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;195 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clip&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is identical to &lt;code&gt;clamp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;196 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clip_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is identical to &lt;code&gt;clamp_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;197 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;clone&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;KernelGen, aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Pure layout/memory operation (clone).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;198 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;coalesced_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Sets the &lt;code&gt;coalesced&lt;/code&gt; flag of a sparse coordinate (COO) tensor in place
and returns &lt;code&gt;self&lt;/code&gt;. This is a metadata-only mutation: the underlying
indices/values data is not modified, only the &lt;code&gt;is_coalesced&lt;/code&gt; bit is
toggled. The flag flip is dispatched through the native backend kernel
(below the autograd key); a Triton identity kernel is provided over the
values data as the per-element implementation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;199 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;col2im&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Rearranges column blocks back into a multidimensional tensor (inverse of im2col).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;200 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;column_stack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a new tensor by horizontally stacking the tensors in tensors. Equivalent to
torch.hstack after 0-D and 1-D tensors have been reshaped into (numel, 1) columns.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;201 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;column_stack_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of column_stack() that writes the result into the out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;202 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;combine_topk_swa_indices&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Combines compressed top-k sparse attention indices with sliding-window attention indices
for DeepSeekV4 attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;203 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;compute_global_topk_indices_and_lens&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Converts local top-k sparse attention indices to global KV-cache indices and computes
valid top-k lengths for DeepSeekV4 attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;204 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;compute_linear_combination&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes a batched linear combination: given &lt;code&gt;coefficients&lt;/code&gt; of shape
&lt;code&gt;[m, n]&lt;/code&gt; and &lt;code&gt;input&lt;/code&gt; of shape &lt;code&gt;[n, ...]&lt;/code&gt;, returns an output of shape
&lt;code&gt;[m, ...]&lt;/code&gt; where &lt;code&gt;output[i, ...] = sum_j coefficients[i, j] * input[j, ...]&lt;/code&gt;
(equivalent to &lt;code&gt;coefficients @ input.flatten(1)&lt;/code&gt;). Backs the string-padding
form dispatched by &lt;code&gt;torch._compute_linear_combination&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;205 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;compute_linear_combination_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;_compute_linear_combination()&lt;/code&gt; that writes the result into
the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;206 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;concat&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An alias of &lt;code&gt;cat()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;207 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;concat_and_cache_mla&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, MLA&lt;/td&gt;
 &lt;td&gt;
 Writes the latent and RoPE value into KV cache for Multi-head Latent Attention forward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;208 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;concatenate&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An alias of &lt;code&gt;cat()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;209 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conj&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise conjugate of a complex tensor.
For non-complex tensors, returns the input unchanged.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;210 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conj_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise conjugate of a complex &lt;code&gt;input&lt;/code&gt; tensor and
returns it as a new (copied) tensor. For non-complex tensors this op
is not supported.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;211 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conj_copy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;_conj_copy()&lt;/code&gt; that writes the result into the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;212 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conj_physical&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise conjugate of the given &lt;code&gt;input&lt;/code&gt; tensor.
If &lt;code&gt;input&lt;/code&gt; has a non-complex dtype, this function just returns &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;213 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conj_physical_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 In-place version of &lt;code&gt;conj_physical&lt;/code&gt;.
Computes the element-wise conjugate of the given &lt;code&gt;input&lt;/code&gt; tensor in place.
If &lt;code&gt;input&lt;/code&gt; has a non-complex dtype, this function just returns &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;214 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;constant_pad_nd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR&lt;/td&gt;
 &lt;td&gt;
 Pads the input tensor boundaries with a constant value.
This is an IR representation, not a public API.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;215 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;contiguous&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Removed&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a contiguous in memory tensor containing the same data as &lt;code&gt;self&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;216 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 1D convolution over a quantized 1D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;217 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv1d_padding&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 1D convolution over a quantized 1D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;218 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 2D convolution over a quantized 2D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;219 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv2d_padding&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 2D convolution over a quantized 2D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;220 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 3D convolution over a quantized 3D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;221 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv3d_padding&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 3D convolution over a quantized 3D input composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;222 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv_depthwise2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Convolution, NoCPU&lt;/td&gt;
 &lt;td&gt;
 A depthwise convolution for the conv2d neural network function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;223 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv_tbc_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for conv_tbc_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;224 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv_transpose1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a 1D transposed convolution operator over an input image composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;225 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv_transpose2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a 2D transposed convolution operator over an input image composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;226 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;conv_transpose3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a 3D transposed convolution operator over an input volume composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;227 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;convert_weight_to_int4pack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Converts a weight tensor to int4 packed format.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;228 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;convolution_double_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Second-order backward of a convolution, supporting both 1D (3-D operands
[N, C, L]) and 2D (4-D operands [N, C, H, W]) cases. Given the gradients of
the first-order gradients (ggI, ggW, ggb) and the output gradient (gO),
returns the gradients of the scalar &lt;code&gt;&amp;lt;gX, ggI&amp;gt; + &amp;lt;gW, ggW&amp;gt; + &amp;lt;gB, ggb&amp;gt;&lt;/code&gt; with
respect to (gO, input, weight). The 2D path runs on Triton conv /
conv-transpose kernels plus a custom Triton weight-gradient correlation
kernel; 1D reuses the 2D path by unsqueezing the lone spatial axis
(mirroring how &lt;code&gt;conv1d&lt;/code&gt; delegates to &lt;code&gt;conv2d&lt;/code&gt;). 3D (5-D operands) is not
yet supported and raises &lt;code&gt;NotImplementedError&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;229 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;convolution_mode&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Convolution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Low-level dispatcher backing the string-padding form of convolution.
Given an input, a weight, an optional bias, stride, a string padding mode
(&lt;code&gt;valid&lt;/code&gt; or &lt;code&gt;same&lt;/code&gt;), dilation and groups, it computes the N-D convolution
by dispatching to the FlagGems &lt;code&gt;conv1d&lt;/code&gt;/&lt;code&gt;conv2d&lt;/code&gt;/&lt;code&gt;conv3d&lt;/code&gt; Triton kernels
based on the spatial dimensionality of the weight tensor. &lt;code&gt;same&lt;/code&gt; padding
requires unit strides.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;230 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 As a wrapper of &lt;code&gt;copy_&lt;/code&gt;, this operator copies elements from &lt;code&gt;src&lt;/code&gt; to &lt;code&gt;out&lt;/code&gt;
using given template for shapes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;231 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;copy_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Copies the elements from &lt;code&gt;src&lt;/code&gt; into &lt;code&gt;self&lt;/code&gt; tensor and returns &lt;code&gt;self&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;232 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;copysign&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Create a new floating-point tensor with the magnitude of input and the sign of other, elementwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;233 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;copysign_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for copysign_.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;234 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;copysign_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;copysign&lt;/code&gt; that allows the output to be saved into &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;235 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;corrcoef&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Estimates the Pearson product-moment correlation coefficient matrix of the
variables given by the input matrix, where rows are the variables and
columns are the observations. The correlation matrix R is computed from
the covariance matrix C as R_ij = C_ij / sqrt(C_ii * C_jj), with the
internal computation carried out in float32 for numerical stability.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;236 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cos&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the cosine of the elements of &lt;code&gt;input&lt;/code&gt; given in radians.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;237 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cos_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;cos()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;238 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cosh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the hyperbolic cosine of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;239 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cosh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;cosh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;240 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cosh_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is an variant of &lt;code&gt;cosh()&lt;/code&gt; that assigns the output to the provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;241 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cosine_embedding_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the cosine embedding loss.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;242 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;count_nonzero&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Counts the number of non-zero values in the tensor &lt;code&gt;input&lt;/code&gt; along the given &lt;code&gt;dim&lt;/code&gt;.
If no &lt;code&gt;dim&lt;/code&gt; is specified then all non-zeros in the tensor are counted.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;243 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cov&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Estimates the covariance matrix of the variables given by the input
matrix, where rows are the variables and columns are the observations.
Supports Bessel's correction and optional frequency/analytic observation
weights, with the internal computation carried out in float32 for
numerical stability.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;244 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cp_gather_indexer_k_quant_cache&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 This is a fused operator that gathers FP8 K cache values and scales.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;245 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cross_entropy_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Removed&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the cross entropy loss between input logits and target.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;246 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ctc_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Connectionist Temporal Classification loss for sequence-to-sequence models.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;247 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cudnn_attention_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.5&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Forward kernel for cuDNN attention, computing scaled dot-product
attention outputs and log-sum-exp statistics. Uses a Triton
FlashAttention-2 kernel in BHSD layout.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;248 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cudnn_batch_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for cudnn_batch_norm_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;249 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cudnn_convolution&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A wrapper for cuDNN convolution backend.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;250 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cudnn_convolution_transpose&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Wrapper for torch.cudnn_convolution_transpose, providing autograd support and device-agnostic interface for cuDNN transposed convolution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;251 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cudnn_rnn_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward pass of a single-layer unidirectional cuDNN LSTM. Reimplements the
RNN forward in pure PyTorch and applies autograd to compute gradients,
avoiding the opaque cuDNN reserve tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;252 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cummax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a named tuple &lt;code&gt;(values, indices)&lt;/code&gt; where &lt;code&gt;values&lt;/code&gt; is the cumulative maximum of elements
of &lt;code&gt;input&lt;/code&gt; in the dimension &lt;code&gt;dim&lt;/code&gt;. And &lt;code&gt;indices&lt;/code&gt; is the index location of each maximum value
found in the dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;253 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cummax_helper&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;code&gt;_cummax_helper&lt;/code&gt;, the out-of-place helper used
by &lt;code&gt;aten::cummax&lt;/code&gt; / &lt;code&gt;aten::cummax.out&lt;/code&gt;. It writes the cumulative maximum of
elements of &lt;code&gt;input&lt;/code&gt; along &lt;code&gt;dim&lt;/code&gt; into the pre-allocated &lt;code&gt;values&lt;/code&gt; tensor and the
index location of each maximum value into the pre-allocated &lt;code&gt;indices&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;254 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cummaxmin_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Backward pass shared by &lt;code&gt;cummax&lt;/code&gt; and &lt;code&gt;cummin&lt;/code&gt;. Scatter-adds the output gradient back to the
input positions selected during the forward pass (given by &lt;code&gt;indices&lt;/code&gt;), accumulating in
float32 for numerical stability. Equivalent to &lt;code&gt;grad_input.scatter_add_(dim, indices, grad_output)&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;255 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cummin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a named tuple &lt;code&gt;(values, indices)&lt;/code&gt; where values is the cumulative minimum of elements
of &lt;code&gt;input&lt;/code&gt; in the dimension &lt;code&gt;dim&lt;/code&gt;. And &lt;code&gt;indices&lt;/code&gt; is the index location of each minimum value
found in the dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;256 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cummin_helper&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;code&gt;_cummin_helper&lt;/code&gt;, the out-of-place helper used
by &lt;code&gt;aten::cummin&lt;/code&gt; / &lt;code&gt;aten::cummin.out&lt;/code&gt;. It writes the cumulative minimum of
elements of &lt;code&gt;input&lt;/code&gt; along &lt;code&gt;dim&lt;/code&gt; into the pre-allocated &lt;code&gt;values&lt;/code&gt; tensor and the
index location of each minimum value into the pre-allocated &lt;code&gt;indices&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;257 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumprod&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the cumulative product of elements of &lt;code&gt;input&lt;/code&gt; in the dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;258 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumprod_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;cumprod()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;259 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumsum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;260 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumsum_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of cumsum.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;261 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumsum_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;262 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cumulative_trapezoid&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Cumulatively integrate y using the composite trapezoidal rule with uniform spacing dx along the given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;263 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;cutlass_scaled_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;264 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;deg2rad&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Converts angles from degrees to radians.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;265 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;deg2rad_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of deg2rad.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;266 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;deg2rad_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of deg2rad with pre-allocated output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;267 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dequantize&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns an fp32 Tensor by dequantizing a quantized Tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;268 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dequantize_and_gather_k_cache&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Dequantizes FP8 K-cache entries and gathers them into a BF16 tensor for DeepSeekV4 attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;269 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dgeglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 Gaussian Error Gated Linear Unit with GELU activation instead of sigmoid function.
This is for the backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;270 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diag&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 &lt;ul&gt;
&lt;li&gt;If &lt;code&gt;input&lt;/code&gt; is a vector (1-D tensor), then returns a 2-D square tensor
with the elements of &lt;code&gt;input&lt;/code&gt; as the diagonal.&lt;/li&gt;
&lt;li&gt;If &lt;code&gt;input&lt;/code&gt; is a matrix (2-D tensor), then returns a 1-D tensor
with the diagonal elements of &lt;code&gt;input&lt;/code&gt;.&lt;/li&gt;
&lt;/ul&gt;

 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;271 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diag_embed&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Creates a tensor whose diagonals of certain 2D planes (specified by &lt;code&gt;dim1&lt;/code&gt; and &lt;code&gt;dim2&lt;/code&gt;) are filled by &lt;code&gt;input&lt;/code&gt;.
To facilitate creating batched diagonal matrices, the 2D planes formed by the last two dimensions
of the returned tensor are chosen by default.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;272 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diagonal_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A diagonal operation returns a partial view of &lt;code&gt;input&lt;/code&gt; with the its diagonal elements
with respect to &lt;code&gt;dim1&lt;/code&gt; and &lt;code&gt;dim2&lt;/code&gt; appended as a dimension at the end of the shape.
This is the backward case for &lt;code&gt;diagonal()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;273 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diagonal_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs the same operation as torch.diagonal, but all output tensors
are freshly created instead of aliasing the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;274 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diagonal_scatter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Scatter source values into the diagonal of a tensor with optional offset.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;275 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;diff&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the n-th forward difference along the given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;276 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;digamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the digamma function, which is the logarithmic derivative of the Gamma function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;277 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;digamma_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the in-place digamma function, which is the logarithmic derivative of the Gamma function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;278 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dispatch_fused_moe_kernel&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Activation, vLLM&lt;/td&gt;
 &lt;td&gt;
 Accelerates neural network training by combining token routing (dispatch/all-to-all communication),
expert computation (GEMM), and result aggregation into a single GPU kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;279 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dist&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the p-norm distance between two tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;280 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_mode&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Divides each element of the &lt;code&gt;input&lt;/code&gt; by the corresponding element of &lt;code&gt;other&lt;/code&gt;.
An optional &lt;code&gt;rounding_mode&lt;/code&gt; can be specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;281 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_mode_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;div_mode()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;282 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is an variant of &lt;code&gt;div()&lt;/code&gt; with an &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;283 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the scalar version of &lt;code&gt;div()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;284 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;div_scalar()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;285 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Divides each element of the input &lt;code&gt;input&lt;/code&gt; by the corresponding element of &lt;code&gt;other&lt;/code&gt;.
Note that &lt;code&gt;torch.divide()&lt;/code&gt; is an alias of &lt;code&gt;torch.div()&lt;/code&gt; and &lt;code&gt;torch.true_divide()&lt;/code&gt;
is an alias of &lt;code&gt;torch.div()&lt;/code&gt; with &lt;code&gt;rounding_mode=None&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;286 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;div_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;div_tensor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;287 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;divide&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An alias of &lt;code&gt;div()&lt;/code&gt; for element-wise division.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;288 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dot&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the dot product of two 1D tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;289 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dreglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 Rectified Gated Linear Unit is a variant of GLU that uses ReLU instead of
the sigmoid function for gating. This is the backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;290 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dropout&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 An internal IR for implementing &lt;code&gt;torch.nn.functional.dropout&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;291 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dsplit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Split a tensor along the third axis (depth-wise). Pure layout operation returning zero-copy views.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;292 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dswiglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 Swish-Gated Linear Unit, a variant of GLU with the Swish activation function.
This is for the backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;293 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dunder_ior_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;dunder_ior_tensor&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;294 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dunder_ior_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of bitwise or operation for tensor and scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;295 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dunder_or_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;dunder_or_tensor&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;296 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dunder_or_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of bitwise or operation for tensor and scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;297 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;dyn_quant_pack_4bit_weight&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Packs dynamic 4-bit quantized weights, scale/zero values, and optional bias
into ATen's portable packed representation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;298 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;efficient_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Backward kernel for FlashAttention, computing gradients of queries, keys, values, and attention outputs efficiently.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;299 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;einsum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Sums the product of the elements of the input &lt;code&gt;operands&lt;/code&gt; along dimensions specified using a notation
based on the Einstein summation convention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;300 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;elu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 Apply the Exponential Linear Unit (ELU) function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;301 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;elu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;elu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;302 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;elu_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;elu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;303 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Generate a simple lookup table that looks up embeddings in a fixed dictionary and size.
Note that the parameter sequence differs from &lt;code&gt;torch.nn.functional.embedding&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;304 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;embedding()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;305 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding_bag_dense_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient for the backward pass of embedding_bag in dense mode.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;306 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding_bag_per_sample_weights_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for _embedding_bag_per_sample_weights_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;307 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding_dense_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Calculates the gradient of the weight matrix for a dense embedding layer during backpropagation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;308 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;embedding_renorm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place renormalization of the embedding rows selected by indices: each indexed row whose norm_type-norm exceeds max_norm is scaled down so its norm equals max_norm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;309 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;empty&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Tensor factory operator — verifies dtype inference for newly allocated tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;310 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;empty_permuted&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Tensor factory operator — allocates an uninitialized tensor whose memory
follows the given physical layout.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;311 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eq&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes element-wise equality.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;312 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eq_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;eq()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;313 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eq_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes equality between scalars.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;314 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eq_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;eq_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;315 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;equal&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns True if two tensors have the same size and elements, False otherwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;316 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Science
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the error function of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;317 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erf_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Science
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;erf()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;318 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erfc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the complementary error function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;319 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erfc_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of &lt;code&gt;erfc&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;320 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erfinv&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the inverse error function of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;321 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;erfinv_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;erfinv()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;322 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;euclidean_dist&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes pairwise Euclidean distances between rows of two 2D tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;323 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the exponential of the elements of the input tensor &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;324 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exp2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the base two exponential function of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;325 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exp2_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;exp2()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;326 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exp_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;exp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;327 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exp_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;exp2()&lt;/code&gt;, with &lt;code&gt;out&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;328 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expand&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Pure layout operation (expand).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;329 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expand_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Pure layout operation (expand, in-place).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;330 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expand_as&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Expand tensor to the same size as another tensor (view operation).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;331 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expand_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a copy of the input tensor expanded by broadcasting singleton dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;332 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expm1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the exponential of the elements minus 1 of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;333 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expm1_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The inplace version of &lt;code&gt;expm1&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;334 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;expm1_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;expm1&lt;/code&gt; that saves the output to the specified &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;335 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exponential&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with elements drawn from an exponential PDF (probability density function).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;336 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;exponential_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Fills &lt;code&gt;self&lt;/code&gt; tensor with elements drawn from a PDF (probability density function).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;337 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eye&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a 2-D tensor with ones on the diagonal and zeros elsewhere.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;338 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;eye_m&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Triton-based implementation of &lt;code&gt;torch.eye_m(n, m)&lt;/code&gt;, using 2D tiles to split the matrix into blocks.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;339 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_learnable_per_channel_affine_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;code&gt;_fake_quantize_learnable_per_channel_affine_backward&lt;/code&gt;,
the backward of learnable per-channel fake quantization. Computes the gradients
with respect to the input, scale and zero-point, accounting for the saturation
branch where the quantized value is clamped to &lt;code&gt;[quant_min, quant_max]&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;340 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_learnable_per_tensor_affine&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Fake-quantizes the input tensor per-tensor with learnable scale and zero_point.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;341 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_learnable_per_tensor_affine_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for the backward pass of learnable
per-tensor affine fake quantization. Computes gradients with respect to
the input, scale, and zero-point.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;342 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_channel_affine&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies fake quantization per channel with affine parameters (scale and zero_point).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;343 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_channel_affine_cachemask&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies per-channel affine fake quantization and returns the quantization-range mask.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;344 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_channel_affine_cachemask_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the cache mask to the gradient of per-channel affine fake quantization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;345 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_channel_affine_cachemask_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;fake_quantize_per_channel_affine_cachemask&lt;/code&gt; that assigns the results to the provided output tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;346 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_tensor_affine&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies per-tensor affine fake quantization using shared scale and zero-point parameters.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;347 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fake_quantize_per_tensor_affine_cachemask_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient for fake_quantize_per_tensor_affine_cachemask by multiplying the incoming
gradient by the cached boolean mask.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;348 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;feature_dropout&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies feature dropout to the &lt;code&gt;input&lt;/code&gt; tensor. Randomly zeroes out entire channels of the &lt;code&gt;input&lt;/code&gt; tensor with probability &lt;code&gt;p&lt;/code&gt;.
Each batch element has its own independent channel mask.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;349 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;feature_dropout_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;feature_dropout()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;350 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fft_irfftn&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the N-dimensional inverse of torch.fft.rfftn.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;351 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_diagonal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fills the main diagonal of a tensor that has at least two dimensions
with the specified scalar value, in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;352 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_mem_eff_dropout_mask_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;code&gt;_fill_mem_eff_dropout_mask_&lt;/code&gt;, the in-place
helper used by the memory efficient attention dropout path. It fills a
contiguous 4D float32 tensor of shape &lt;code&gt;(batch, heads, queries, keys)&lt;/code&gt; with
random uniform values in [0, 1) drawn from a Philox4x32-10 stream
identified by &lt;code&gt;seed&lt;/code&gt; and &lt;code&gt;offset&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;353 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Fills a scalar with the specified value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;354 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;fill_scalar()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;355 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_scalar_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;fill_scalar()&lt;/code&gt; that assigns the output to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;356 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Fills a tensor with the specified value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;357 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;fill_tensor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;358 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fill_tensor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;fill_tensor()&lt;/code&gt; that assigns the output to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;359 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fix&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 fix operator
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;360 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fix_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of fix. Truncates each element toward zero
(floor for non-negative values, ceil for negative values).
Integer tensors are left unchanged.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;361 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Backward kernel for FlashAttention, computing gradients of queries, keys, values, and attention outputs efficiently.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;362 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_attention_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;363 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_attn_varlen_func&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Attention, FlashAttention&lt;/td&gt;
 &lt;td&gt;
 Compute attention for sequences of variable lengths within a single batch.
Eliminating the need for padding.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;364 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_attn_varlen_opt_func&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Attention, FlashAttention&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;flash_attn_varlen_func&lt;/code&gt; that has &lt;code&gt;lse&lt;/code&gt; as an optional parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;365 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_mla&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM&lt;/td&gt;
 &lt;td&gt;
 A variant of Multi-head Latent Attention (MLA).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;366 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flash_mla_sparse_fwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM&lt;/td&gt;
 &lt;td&gt;
 Part of the FlashMLA.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;367 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flatten&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Flatten a contiguous range of dimensions into a single dimension (view operation).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;368 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flip&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Reverse the order of an n-D tensor along given axis in dims.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;369 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fliplr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Flips a tensor in the left-to-right direction by reversing dimension 1.
The input must have at least two dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;370 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;flipud&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Flips a tensor in the up-to-down direction by reversing dimension 0.
The input must have at least one dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;371 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for float_power_.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;372 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes a scalar base raised element-wise to tensor exponents in float64.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;373 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_scalar_tensor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out variant of float_power.Scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;374 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_tensor_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Raises tensor elements to a scalar exponent in float64.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;375 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_tensor_scalar_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out variant of float_power.Tensor_Scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;376 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_tensor_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Raises tensor elements to tensor exponents in float64 with broadcasting.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;377 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;float_power_tensor_tensor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out variant of float_power.Tensor_Tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;378 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs an element-wise floor operation, rounding each element of a tensor
down to the nearest integer less than or equal to itself.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;379 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs an in-place element-wise floor operation, rounding each element of a tensor
down to the nearest integer less than or equal to itself.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;380 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_divide_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input&lt;/code&gt; divided by &lt;code&gt;other&lt;/code&gt;, elementwise, and floors the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;381 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_divide_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input&lt;/code&gt; divided by &lt;code&gt;other&lt;/code&gt;, elementwise, and floors the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;382 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_divide_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input&lt;/code&gt; divided by &lt;code&gt;other&lt;/code&gt;, elementwise, and floors the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;383 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_divide_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input&lt;/code&gt; divided by &lt;code&gt;other&lt;/code&gt;, elementwise, and floors the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;384 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;floor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs an element-wise floor operation with output tensor, rounding each element
down to the nearest integer less than or equal to itself.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;385 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise maximum of input and other, ignoring NaNs.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;386 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmax_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise maximum of input and other, ignoring NaNs (out variant).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;387 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise minimum of two tensors, specially handling NaN values
by prioritizing the numerical value. Unlike &lt;code&gt;minimum()&lt;/code&gt;, if one input is NaN and the other is a number,
&lt;code&gt;fmin()&lt;/code&gt; returns the number. It supports broadcasting, type promotion, and operates on both CPU and GPU.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;388 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmin_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;fmin()&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;389 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmod_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place remainder of division (fmod_), computes element-wise remainder with truncation toward zero.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;390 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmod_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise remainder of division of input by a scalar divisor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;391 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmod_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of fmod with a scalar divisor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;392 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmod_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise remainder of division of input by a tensor divisor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;393 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fmod_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of fmod with a tensor divisor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;394 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fp8_fp4_mega_moe&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, Triton&lt;/td&gt;
 &lt;td&gt;
 Functional Triton fallback for local FP8 x FP4 MegaMoE. It consumes
staged FP8 activations, packed FP4 expert weights, scales, and top-k
routing tensors, then computes the two-layer SwiGLU MoE output.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;395 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fp8_fp4_mqa_logits&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute weighted MQA logits with FP8 quantized Q and K tensors.
Uses head-batched tiled dot products with K reuse for high throughput
on DeepSeek V4 sparse attention indexer workloads.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;396 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fp8_fp4_paged_mqa_logits&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DeepSeekV4, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute paged multi-query attention logits from FP8 queries against
FP8/FP4 paged KV cache with per-token scaling. Used in DeepSeek-V4
decode-phase inference with adaptive tile sizing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;397 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fp8_mqa_logits&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 For each token in the given E4M3 tensor, iterate all tokens from two other given tensors,
calculate the logit.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;398 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;frac&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the fractional part of each element, returning x - trunc(x).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;399 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;frac_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place fractional part computation, returning x - trunc(x).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;400 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fractional_max_pool2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies 2D fractional max pooling over an input signal composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;401 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fractional_max_pool2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of fractional_max_pool2d.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;402 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;frexp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Return mantissa and exponent of input, such that x = mantissa * 2^exponent, with mantissa in (-1, 1).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;403 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;full&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Creates a tensor of size &lt;code&gt;size&lt;/code&gt; filled with &lt;code&gt;fill_value&lt;/code&gt;.
The tensor's dtype is inferred from &lt;code&gt;fill_value&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;404 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;full_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor with the same size as &lt;code&gt;input&lt;/code&gt; filled with &lt;code&gt;fill_value&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;405 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;functional_assert_async&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;utility, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Functional version of _assert_async that takes a dependency token and returns a new token.
Part of PyTorch's functionalization framework for tracking operation dependencies.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;406 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;functional_sym_constrain_range&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A low-level function used in symbolic shape analysis to restrict the possible numerical range
(min/max) of a symbolic integer based on tensor input arguments.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;407 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;functional_sym_constrain_range_for_size&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A low-level function used in symbolic shape analysis to restrict the possible numerical range
(min/max) of an unbacked symbolic integer.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;408 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_adam&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fused Adam optimizer step with optional AdamW weight decay, AMSGrad, and gradient maximize support.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;409 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_adam_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;fused_adam()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;410 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_add_rms_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Normalization&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;411 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_deepseek_v4_qnorm_rope_kv_rope_insert&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Horizontally-fused DeepseekV4-MLA BF16 variant.
per-head RMSNorm + GPT-J RoPE for Q, and GPT-J RoPE + bf16 paged
cache insert for KV, all in one kernel launch. No FP8 quantization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;412 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_deepseek_v4_qnorm_rope_kv_rope_quant_insert&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Horizontally-fused DeepseekV4-MLA.
per-head RMSNorm + GPT-J RoPE for Q, and GPT-J RoPE + UE8M0 FP8
quant + paged cache insert for KV, all in one kernel launch.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;413 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_experts_impl&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, MoE&lt;/td&gt;
 &lt;td&gt;
 An implementation of fused MoE.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;414 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_indexer_q_rope_quant&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Applies RoPE to sparse indexer Q, quantizes it to FP8 or MXFP4, and folds
indexer weights for DeepSeekV4 attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;415 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_moe&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, MoE&lt;/td&gt;
 &lt;td&gt;
 The generic interface for fused MoE.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;416 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_moving_avg_obs_fq_helper&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, quantization, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fused moving-average observer with fake-quantize for QAT; updates running min/max, recomputes scale/zero_point, and fake-quantizes the input for both per-tensor and per-channel modes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;417 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_q_kv_rmsnorm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Attention, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Applies RMSNorm to Q and KV tensors in a single fused kernel for DeepSeekV4 attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;418 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_recurrent_gated_delta_rule_fwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, FLA&lt;/td&gt;
 &lt;td&gt;
 The forward case for &lt;code&gt;fused_recurrent_gated_delta_rule&lt;/code&gt; used in Flash Linear Attention (FLA).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;419 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_rms_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fused RMS normalization returning the normalized output and inverse RMS.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;420 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;fused_rms_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes input and weight gradients for fused RMS normalization using the
saved reciprocal root-mean-square values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;421 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gather&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Gathers values along an axis specified by &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;422 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gather_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;gather()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;423 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gather_block_quantized&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for gather_block_quantized.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;424 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gcd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise greatest common divisor (GCD) of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;425 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gcd_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise greatest common divisor (GCD) of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt; in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;426 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gcd_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;gcd()&lt;/code&gt; that allows the output to be assigned to the specified &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;427 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ge&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input&lt;/code&gt; is greater or equal to &lt;code&gt;other&lt;/code&gt; element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;428 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ge_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;ge()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;429 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;geglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Activation, Transformer&lt;/td&gt;
 &lt;td&gt;
 Gaussian Error Gated Linear Unit with GELU activation instead of sigmoid function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;430 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gelu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, Activation, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Apply Cumulative Distribution Function for Gaussian Distribution function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;431 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gelu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;gelu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;432 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gelu_and_mul&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, pointwise, Activation&lt;/td&gt;
 &lt;td&gt;
 An activation function for GeGLU.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;433 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gelu_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;gelu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;434 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;geometric&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Draws random numbers from a geometric distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;435 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;geometric_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Fills self tensor with elements drawn from the geometric distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;436 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;get_paged_mqa_logits_metadata&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;vLLM&lt;/td&gt;
 &lt;td&gt;
 Build scheduling metadata for paged MQA logits.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;437 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;get_scheduler_metadata&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, vLLM&lt;/td&gt;
 &lt;td&gt;
 Computes scheduling metadata for attention work partitioning so that
CPU computations can be routed to ISA-specific kernel implmentations.
The metadata is stored in a tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;438 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;glu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise&lt;/td&gt;
 &lt;td&gt;
 Gated Linear Unit activation for modulating the output of a linear transformation with a gate.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;439 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;glu_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;glu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;440 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;greater&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Test if input is greater than &lt;code&gt;other&lt;/code&gt; elementwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;441 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;greater_equal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;greater_equal()&lt;/code&gt;, which is an alias for &lt;code&gt;ge()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;442 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;greater_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;greater&lt;/code&gt; that saves the output to the specified &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;443 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;greater_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;greater&lt;/code&gt; for scalar variables.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;444 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;greater_scalar_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;greater_out&lt;/code&gt; that saves the output to the specified &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;445 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;grid_sample&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Given an &lt;code&gt;input&lt;/code&gt; and a flow-field &lt;code&gt;grid&lt;/code&gt;, computes the &lt;code&gt;output&lt;/code&gt; using &lt;code&gt;input&lt;/code&gt; values and
pixel locations from &lt;code&gt;grid&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;446 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;grid_sampler_3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Given an &lt;code&gt;input&lt;/code&gt; and a flow-field &lt;code&gt;grid&lt;/code&gt; in 3D, computes the &lt;code&gt;output&lt;/code&gt; using &lt;code&gt;input&lt;/code&gt; values and pixel locations from &lt;code&gt;grid&lt;/code&gt; with trilinear or nearest interpolation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;447 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;grid_sampler_3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward pass for 3D grid sampling with bilinear/nearest interpolation and multiple padding modes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;448 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;group_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 An internal IR for applying Group Normalization for last certain number of dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;449 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;group_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 The backward case for &lt;code&gt;group_norm()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;450 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;grouped_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Grouped matrix multiply is a functional operator designed to accelerate Mixture-of-Experts (MoE) models
by computing multiple matrix multiplications in a single kernel launch.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;451 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;grouped_topk&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, NoCPU, vLLM&lt;/td&gt;
 &lt;td&gt;
 A specialized routing mechanism used in Mixture-of-Experts (MoE) models (like DeepSeek-V3/R1)
to select top-k experts by first grouping them, rather than selecting globally.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;452 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gru&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Gated recurrent unit (GRU). At each time step, computes a new hidden state from the input and the previous hidden state using a reset gate and an update gate, across one or more layers and optionally bidirectionally.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;453 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gru_data&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Gated recurrent unit (GRU) over packed-sequence data.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;454 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gt&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes that &lt;code&gt;input&lt;/code&gt; is greater than &lt;code&gt;other&lt;/code&gt; element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;455 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gt_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;gt()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;456 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gt_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of gt for scalar comparison, computes element-wise greater-than with a scalar storing result in input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;457 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;gt_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of gt for tensor comparison, computes element-wise greater-than with a tensor storing result in input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;458 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardshrink&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the hard shrinkage function element-wise: returns x if |x| &amp;gt; lambd, else 0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;459 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardshrink_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-variant of hardshrink. Writes the element-wise result into the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;460 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardsigmoid&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An activation function that provides a piecewise linear approximation of the standard sigmoid function,
mapping inputs to a range between 0 and 1.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;461 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardsigmoid_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen, Activation&lt;/td&gt;
 &lt;td&gt;
 An in-place variant of &lt;code&gt;hardsigmoid&lt;/code&gt;, an activation function that provides a piecewise
linear approximation of the standard sigmoid function, mapping inputs to a range between 0 and 1.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;462 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardsigmoid_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The backward pass for &lt;code&gt;hardsigmoid&lt;/code&gt;. Computes the gradient of the hardsigmoid
activation function: &lt;code&gt;grad_output * (|self| &amp;lt; 3) / 6&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;463 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardsigmoid_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;hardsigmoid&lt;/code&gt; that supports an output tensor to receive the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;464 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardswish&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the Hard Swish activation function, commonly used in models like MobileNetV3
to improve accuracy while reducing computational cost compared to traditional Swish.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;465 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardswish_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen, Activation&lt;/td&gt;
 &lt;td&gt;
 Applies the Hard Swish activation function, commonly used in models like MobileNetV3
to improve accuracy while reducing computational cost compared to traditional Swish.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;466 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardswish_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The backward pass for &lt;code&gt;hardswish&lt;/code&gt;. Computes the gradient of the hardswish activation
function: piecewise derivative &lt;code&gt;0&lt;/code&gt; for &lt;code&gt;x &amp;lt;= -3&lt;/code&gt;, &lt;code&gt;(2x + 3) / 6&lt;/code&gt; for &lt;code&gt;-3 &amp;lt; x &amp;lt; 3&lt;/code&gt;,
and &lt;code&gt;1&lt;/code&gt; for &lt;code&gt;x &amp;gt;= 3&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;467 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardswish_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;hardswish&lt;/code&gt; that supports an output tensor to receive the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;468 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardtanh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An activation function that clips input values to lie within a fixed range
[min_val, max_val], leaving values inside the range unchanged.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;469 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardtanh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An activation function that clips input values to lie within a fixed range
[min_val, max_val], leaving values inside the range unchanged.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;470 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardtanh_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The backward pass for hardtanh activation function. Computes the gradient of hardtanh:
grad_output when min_val &amp;lt; x &amp;lt; max_val, 0 otherwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;471 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hardtanh_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;hardtanh&lt;/code&gt; that supports an output tensor to receive the result.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;472 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;has_compatible_shallow_copy_type&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Metadata-only check that returns True when &lt;code&gt;self&lt;/code&gt; can shallow-copy the
TensorImpl type of &lt;code&gt;from&lt;/code&gt;. Compatibility is decided on the tensors'
DispatchKeySets: the sets are equal, or both are dense, both are sparse
COO, or both are sparse compressed. It is independent of dtype and shape,
and of device within a family, but opaque impls (meta, MKL-DNN, nested,
quantized) only match an identical key set even though some of them
report a strided layout.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;473 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hc_head_fused_kernel&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DSA&lt;/td&gt;
 &lt;td&gt;
 The head fusion kernel for MHC (Manifold-Constrained Hyper-Connections).
This fused implementation computes RMS-normalized hidden states and applies
per-head weighted mixing to produce the output activations.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;474 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hc_split_sinkhorn_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Computes a differentiable approximation of the Wasserstein distance (Optimal Transport)
between two probability distributions or point clouds.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;475 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;heaviside&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The heaviside step function. Computes 0 where input &amp;lt; 0, 1 where input &amp;gt; 0,
and values where input == 0. Supports tensor values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;476 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;heaviside_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of heaviside. For each element: 0 if x &amp;lt; 0, 1 if x &amp;gt; 0,
and the corresponding &lt;code&gt;values&lt;/code&gt; element if x == 0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;477 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;histc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the histogram of a tensor, binning each element into equal-width bins.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;478 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hsplit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Split a tensor into multiple sub-tensors horizontally (column-wise).
Equivalent to tensor_split with dim=1 for 2D+ tensors, or dim=0 for 1D tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;479 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hstack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Stack tensors in sequence horizontally (column wise). This is equivalent to concatenation
along the first axis for 1-D tensors, and along the second axis for all other tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;480 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;huber_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Loss&lt;/td&gt;
 &lt;td&gt;
 Computes the Huber loss between input and target. Quadratic for small errors
(|x - y| &amp;lt;= delta) and linear for large errors. Supports reduction none/mean/sum.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;481 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;huber_loss_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Loss&lt;/td&gt;
 &lt;td&gt;
 Out-variant of huber_loss. Writes the computed loss into the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;482 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hypot&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Given the legs of a right triangle, return its hypotenuse.
The shapes of both input tensors must be broadcastable.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;483 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hypot_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of hypot. Given the legs of a right triangle, writes its
hypotenuse into &lt;code&gt;self&lt;/code&gt;. The shape of &lt;code&gt;other&lt;/code&gt; must be broadcastable to &lt;code&gt;self&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;484 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;hypot_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Given the legs of a right triangle, return its hypotenuse.
The shapes of both input tensors must be broadcastable.
This is a variant of &lt;code&gt;hypot&lt;/code&gt; that allows the output to be a different tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;485 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;i0&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the modified Bessel function of the first kind of order zero element-wise for a given input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;486 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;i0_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The inplace version of &lt;code&gt;i0&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;487 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;i0_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;i0&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;488 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;igamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the regularized lower incomplete gamma function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;489 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;igamma_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place computation of the regularized lower incomplete gamma function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;490 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;igammac&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the regularized upper incomplete gamma function Q(a, x) element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;491 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;igammac_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 In-place version of igammac. Computes the regularized upper incomplete gamma function complement.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;492 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;igammac_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of igammac that writes the result to the out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;493 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ilshift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the in-place bitwise left shift of &lt;code&gt;self&lt;/code&gt; by &lt;code&gt;other&lt;/code&gt; bits.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;494 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;im2col&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Extracts sliding local blocks from a batched input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;495 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Extract, access or modify specific elements, slices, or subsets of data within a tensor.
The location of data is specified for each dimension, starting from index 0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;496 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_add&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Accumulate the elements of &lt;code&gt;alpha&lt;/code&gt; times &lt;code&gt;source&lt;/code&gt; into the &lt;code&gt;input&lt;/code&gt; tensor
by adding to the indices in the order given in &lt;code&gt;index&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;497 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_add_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;index_add()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;498 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Copies the elements from &lt;code&gt;source&lt;/code&gt; into &lt;code&gt;input&lt;/code&gt; at the positions specified by
&lt;code&gt;index&lt;/code&gt; along the given &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;499 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_copy_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;index_copy()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;500 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_fill&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Fills elements of the input tensor with a scalar or 0-dimensional tensor value
at positions selected by &lt;code&gt;index&lt;/code&gt; along the given &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;501 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_fill_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;index_fill()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;502 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_put&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Puts values from the tensor &lt;code&gt;values&lt;/code&gt; into the tensor &lt;code&gt;input&lt;/code&gt; using the indices specified
in &lt;code&gt;indices&lt;/code&gt; (which is a tuple of Tensors).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;503 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_put_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;index_put()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;504 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_put_impl_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 An internal C++ function that handles the heavy lifting for placing values into a tensor at specific indices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;505 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_reduce_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Accumulates the elements of &lt;code&gt;source&lt;/code&gt; into &lt;code&gt;input&lt;/code&gt; at the indices specified
by &lt;code&gt;index&lt;/code&gt; along &lt;code&gt;dim&lt;/code&gt;, using &lt;code&gt;prod&lt;/code&gt;, &lt;code&gt;mean&lt;/code&gt;, &lt;code&gt;amax&lt;/code&gt;, or &lt;code&gt;amin&lt;/code&gt; reduction.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;506 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_select&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor which indexes the &lt;code&gt;input&lt;/code&gt; tensor along dimension &lt;code&gt;dim&lt;/code&gt;
using the entries in &lt;code&gt;index&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;507 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;index_select_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward of index_select. Accumulates gradients into the output at positions specified by the index.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;508 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;indexer_k_quant_and_cache&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 This is a fused operator that quantizes K tensors and writes them into the FP8 KV cache.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;509 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;inplace_fused_experts&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Activation, vLLM&lt;/td&gt;
 &lt;td&gt;
 This operator writes output directly to &lt;code&gt;hidden_states&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;510 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;instance_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Apply Instance Normalization independently for each channel in every data sample within a batch.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;511 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;irshift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;strong&gt;irshift&lt;/strong&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;512 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;is_all_true&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The low-level implementation for checking if all elements in a tensor are True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;513 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;is_nonzero&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns True if the single-element input tensor is not equal to zero.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;514 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isclose&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with boolean elements representing if each element of &lt;code&gt;input&lt;/code&gt;
is &amp;quot;close&amp;quot; to the corresponding element of &lt;code&gt;other&lt;/code&gt;.
The closeness is defined with &lt;code&gt;rtol&lt;/code&gt; and &lt;code&gt;atol&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;515 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isfinite&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with boolean elements representing if each element is finite or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;516 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Tests if each element of &lt;code&gt;elements&lt;/code&gt; is in &lt;code&gt;test_elements&lt;/code&gt;.
Returns a boolean tensor of the same shape as &lt;code&gt;elements&lt;/code&gt; that is True
for elements in &lt;code&gt;test_elements&lt;/code&gt; and False otherwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;517 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isin_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;isin()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;518 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isin_tensor_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;isin()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;519 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isinf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Tests if each element of &lt;code&gt;input&lt;/code&gt; is infinite (positive or negative infinity) or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;520 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isnan&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with boolean elements representing if each element of &lt;code&gt;input&lt;/code&gt; is NaN or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;521 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isneginf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Tests if each element of &lt;code&gt;input&lt;/code&gt; is negative infinity or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;522 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isneginf_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;isneginf&lt;/code&gt; that saves the output to the specified &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;523 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;isposinf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Tests if each element of input is positive infinity or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;524 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ixor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise XOR of input tensors or a tensor and a scalar (inplace).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;525 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;jagged_to_padded_dense_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Converts a jagged (variable-length) tensor to a padded dense tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;526 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;kron&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the Kronecker product of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;527 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;kthvalue&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the kth smallest element of the given input tensor along a given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;528 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;layer_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 An internal IR for applying Layer Normalization for last certain number of dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;529 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;layer_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The backward case for &lt;code&gt;layer_norm()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;530 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lcm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Pointwise
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the element-wise least common multiple of input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;531 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lcm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Pointwise
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the element-wise least common multiple of input tensors, storing result in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;532 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;le&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes that &lt;code&gt;input&lt;/code&gt; is less than or equal to &lt;code&gt;other&lt;/code&gt; element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;533 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;le_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;le()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;534 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;le_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;le()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;535 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;le_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;le_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;536 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;leaky_relu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies the LeakyReLU function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;537 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;leaky_relu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;leaky_relu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;538 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;leaky_relu_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;leaky_relu()&lt;/code&gt; for backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;539 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;leaky_relu_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;leaky_relu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;540 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lerp_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;lerp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;541 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lerp_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place, scalar version of &lt;code&gt;lerp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;542 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lerp_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Performs a linear interpolation of two tensors &lt;code&gt;start&lt;/code&gt; (given by &lt;code&gt;input&lt;/code&gt;) and &lt;code&gt;end&lt;/code&gt;
based on a scalar or tensor &lt;code&gt;weight&lt;/code&gt; and returns the resulting &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;543 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lerp_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;lerp()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;544 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;less()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;545 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_equal&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes element-wise less-than-or-equal-to comparison.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;546 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_equal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;less_equal()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;547 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_equal_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes less-than-or-equal-to comparison with a scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;548 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_equal_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;less_equal_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;549 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;less_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;less_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;550 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lgamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the logarithm of the gamma function on input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;551 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lgamma_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of lgamma().
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;552 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns self tensor. Used within compiled graphs to lift
tensors out of the graph or modify autograd metadata.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;553 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lift_fresh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a fresh tensor holding the same values as the input, used to
lift constants into a compiled graph.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;554 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lift_fresh_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a new, independent copy of a tensor within a compiled graph.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;555 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lift_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of lift that copies self to the out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;556 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_cholesky&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Cholesky decomposition of a symmetric positive-definite matrix A
or for batches of symmetric positive-definite matrices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;557 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_cross&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the cross product of two 3-dimensional vectors along a specified dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;558 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_cross_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;linalg_cross&lt;/code&gt; that allows the output to be assigned to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;559 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_det&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the determinant of a square matrix via LU decomposition with partial pivoting.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;560 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_det_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of linalg_det that writes the determinant to the provided out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;561 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_eig&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the eigenvalue decomposition of a general square matrix, returning
the complex eigenvalues and eigenvectors. Also supports batches of matrices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;562 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_eigvals&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the eigenvalues of a square matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;563 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_householder_product&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the matrix product of Householder matrices from QR decomposition.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;564 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_ldl_factor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the compact LDL factorization of a Hermitian or symmetric matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;565 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_ldl_factor_ex&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the LDL factorization with pivot information for a symmetric or Hermitian matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;566 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_ldl_solve&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for linalg_ldl_solve.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;567 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lstsq&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the least-squares solution (gels driver) to A X = B for full-rank
over- or underdetermined systems, including batches, via Householder TSQR.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;568 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the LU factorization with partial pivoting of a matrix and
returns the permutation matrix P and the lower/upper triangular factors
L and U such that P @ L @ U = A (or L @ U = A for pivot=False).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;569 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu_factor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes a compact representation of the LU factorization with partial pivoting of a matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;570 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu_factor_ex&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes a compact representation of the LU factorization with partial
pivoting of a matrix and returns an info tensor indicating whether the
factorization was successful (info == 0) or the position of the first zero
pivot (1-indexed). This is the &amp;quot;expert&amp;quot; version of linalg_lu_factor,
equivalent to LAPACK's getrf.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;571 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu_factor_ex_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place version of linalg_lu_factor_ex. Supports calling
torch.linalg.lu_factor_ex(A, *, pivot=True, check_errors=False,
out=(LU, pivots, info)). The out parameter provides pre-allocated output
tensors for in-place writing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;572 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu_factor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place version of linalg_lu_factor. Supports calling torch.linalg.lu_factor(A, *, pivot=True, out=(LU, pivots)). The out parameter provides pre-allocated output tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;573 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_lu_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place version of linalg_lu. Supports calling
torch.linalg.lu(A, *, pivot=True, out=(P, L, U)). The out parameter
provides pre-allocated output tensors for in-place writing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;574 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_exp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the matrix exponential of a square matrix via scaling-and-squaring with an optimized Taylor polynomial approximation of degree 18.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;575 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_exp_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of linalg_matrix_exp that writes the matrix exponential to the provided out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;576 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the matrix norm over the given dimensions.
Supports ord values: 1, -1, 2, -2, inf, -inf, 'fro', 'nuc'.
For ord=2/-2/nuc, internally uses SVD (singular value decomposition).
For ord=1/-1/inf/-inf, uses max/min absolute column/row sums.
For ord='fro', uses Frobenius norm via per-row L2 reduction.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;577 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_power&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the n-th power of a square matrix using binary exponentiation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;578 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_power_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place version of linalg_matrix_power. Supports calling torch.linalg.matrix_power(A, n, *, out=None). The out parameter provides a pre-allocated output tensor for in-place writing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;579 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the numerical rank of a matrix or a batch of matrices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;580 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_atol_rtol_float&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using optional scalar absolute and relative tolerances.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;581 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_atol_rtol_float_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using scalar tolerances and an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;582 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_atol_rtol_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using optional tensor absolute and relative tolerances.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;583 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_atol_rtol_tensor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using tensor tolerances and an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;584 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using a scalar tolerance and an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;585 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_out_tol_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using a tensor tolerance and an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;586 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_rank_tol_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes numerical matrix rank using a positional tensor tolerance.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;587 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_sqrth&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the principal square root of a symmetric or Hermitian positive-definite matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;588 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_matrix_sqrth_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Writes the principal square root of a symmetric or Hermitian positive-definite matrix to an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;589 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes a vector or matrix norm, mirroring torch.linalg.norm dispatch.
The vector branch (ord=None/2/1/0/p/±inf, dim as int or 1-tuple or None)
reuses linalg_vector_norm; the matrix branch (ord='fro'/'nuc'/±1/±2/±inf,
dim as 2-tuple) reuses linalg_matrix_norm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;590 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_qr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the QR decomposition of a matrix (or a batch of matrices) via a blocked Householder algorithm with a TSQR fast path for tall-skinny inputs. Pure-Triton implementation supporting the &amp;quot;reduced&amp;quot;, &amp;quot;complete&amp;quot; and &amp;quot;r&amp;quot; modes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;591 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_qr_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The &lt;code&gt;out=&lt;/code&gt; variant of &lt;code&gt;linalg_qr&lt;/code&gt;; writes the Q and R factors into the caller-provided output tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;592 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_slogdet&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the sign and natural logarithm of the absolute value of the determinant of a square matrix using LU decomposition with partial pivoting.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;593 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_solve_triangular&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Solves a triangular system of linear equations with a unique solution, returning
a tensor X such that A&lt;em&gt;X = B (or X&lt;/em&gt;A = B when right=True) for a triangular
matrix A and matrix of right-hand sides B.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;594 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_solve_triangular_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of linalg_solve_triangular: solves a triangular system
of linear equations and writes the result into the provided out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;595 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_svd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the singular value decomposition (SVD) of a matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;596 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_svdvals&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the singular values of a matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;597 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_vecdot&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the dot product of two vectors along a specified dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;598 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linalg_vecdot_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the dot product of two vectors along a specified dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;599 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linear&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a linear transformation to the incoming data: y = x @ W^T + b.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;600 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linear_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for linear_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;601 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;linspace&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Creates a one-dimensional tensor of size &lt;code&gt;steps&lt;/code&gt; whose values are evenly spaced from &lt;code&gt;start&lt;/code&gt; to &lt;code&gt;end&lt;/code&gt;, inclusive.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;602 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;list_to_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 &lt;/td&gt;
 
 
 &lt;td&gt;aten, KernelGen, IR&lt;/td&gt;
 &lt;td&gt;
 Constructs a 1-D int32 tensor from a Python list of integers. This is an
IR/prim operator; the FlagGems implementation copies the values into the
output tensor with a Triton kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;603 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the natural logarithm of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;604 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log10&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the logarithm to the base 10 of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;605 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log10_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;log10()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;606 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log10_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;log10()&lt;/code&gt; that assigns the output to the provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;607 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log1p&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the natural logarithm of &lt;code&gt;1+x(y_i=log_e(x_i+1))&lt;/code&gt; for each element in the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;608 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log1p_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the natural logarithm of &lt;code&gt;1+x(y_i=log_e(x_i+1))&lt;/code&gt; for each element in the input tensor in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;609 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the logarithm to the base 2 of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;610 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log2_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;log2()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;611 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;log()&lt;/code&gt;. Computes the natural logarithm of each element in the input tensor in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;612 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_normal&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with log-normal samples parameterized by mean and standard deviation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;613 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_normal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fills the tensor with log-normal samples parameterized by mean and standard deviation, in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;614 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_sigmoid&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Applies the Logsigmoid function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;615 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_sigmoid_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the input gradient of the Logsigmoid function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;616 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_sigmoid_backward_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;log_sigmoid_backward&lt;/code&gt; that assigns the output to the &lt;code&gt;grad_input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;617 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_sigmoid_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the output and buffer for the log-sigmoid function, used in autograd backward pass.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;618 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 An internal IR for applying a softmax followed by a logarithm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;619 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_softmax_backward_data&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of the input tensor with respect to a &lt;code&gt;log_softmax&lt;/code&gt; operation
during backpropagation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;620 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_softmax_backward_data_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;_log_softmax_backward_data&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;621 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;log_softmax_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 An internal IR for applying a softmax followed by a logarithm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;622 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logaddexp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logarithm of the sum of the exponentials of two input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;623 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logaddexp2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise base-2 logarithm of the sum of base-2 exponentiations of two input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;624 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logaddexp2_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;logaddexp2&lt;/code&gt; that allows the output to be assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;625 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logaddexp_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;logaddexp&lt;/code&gt; that allows the output to be assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;626 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logcumsumexp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for logcumsumexp.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;627 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logcumsumexp_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;logcumsumexp&lt;/code&gt; that allows the output to be assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;628 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_and&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical AND of the given &lt;code&gt;input&lt;/code&gt; tensors.
Zeros are treated as False and nonzeros are treated as True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;629 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_and_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;logical_and()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;630 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_not&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical NOT of the given &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;631 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_not_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of logical_not. Computes the element-wise logical NOT.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;632 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_or&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical OR of the given input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;633 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_or_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;logical_or()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;634 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_xor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical XOR of the given input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;635 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logical_xor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;logical_xor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;636 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the logit of the elements of &lt;code&gt;input&lt;/code&gt;.
&lt;code&gt;input&lt;/code&gt; is clamped to &lt;code&gt;[eps, 1-eps]&lt;/code&gt; when &lt;code&gt;eps&lt;/code&gt; is not None.
When eps is None and &lt;code&gt;input&amp;lt;0&lt;/code&gt; or &lt;code&gt;input&amp;gt;1&lt;/code&gt;, the function will yield NaN.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;637 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logit_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;logit()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;638 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logit_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for logit_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;639 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logit_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;logit&lt;/code&gt; that allows the output to be assigned to another tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;640 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logspace&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Creates a one-dimensional tensor of size &lt;code&gt;steps&lt;/code&gt; whose values are evenly spaced
from &lt;code&gt;base^start&lt;/code&gt; to &lt;code&gt;base^end&lt;/code&gt;, inclusive, on a logarithmic scale with base &lt;code&gt;base&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;641 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;logsumexp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the log of the sum of exponentials of elements in the input tensor along given dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;642 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lshift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;strong&gt;lshift&lt;/strong&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;643 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lstm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for lstm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;644 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lt&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes that &lt;code&gt;input&lt;/code&gt; is less than &lt;code&gt;other&lt;/code&gt; element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;645 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lt_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;lt()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;646 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lt_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;lt&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;647 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lt_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;lt_()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;648 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lu_unpack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Unpacks the LU decomposition returned by &lt;code&gt;lu_factor&lt;/code&gt; into separate permutation matrix P, lower triangular L, and upper triangular U.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;649 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;lu_unpack_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of lu_unpack that writes results into pre-allocated output tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;650 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;make_dep_token&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a scalar tensor as a dependency token for TorchScript tracing
and class-based compiler frameworks. The value of the returned tensor
is uninitialized and should not be consumed.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;651 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;margin_ranking_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the margin ranking loss.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;652 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_fill&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Fills elements of given tensor with &lt;code&gt;value&lt;/code&gt; where &lt;code&gt;mask&lt;/code&gt; is True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;653 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_fill_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;masked_fill()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;654 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_fill_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Fills elements of given tensor with &lt;code&gt;value&lt;/code&gt; where &lt;code&gt;mask&lt;/code&gt; is True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;655 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_fill_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;masked_fill()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;656 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_scale&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 The low-level implementation for computing input multiplied by scale with masking.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;657 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_scatter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Copies elements from &lt;code&gt;source&lt;/code&gt; into the given tensor at positions where the &lt;code&gt;mask&lt;/code&gt; is True.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;658 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_scatter_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;masked_scatter()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;659 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_scatter_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Backward of &lt;code&gt;masked_scatter&lt;/code&gt; with respect to the &lt;code&gt;source&lt;/code&gt; tensor.
Returns a tensor of shape &lt;code&gt;sizes&lt;/code&gt; where the first &lt;code&gt;mask.sum()&lt;/code&gt; elements
are the gradient values from the positions where &lt;code&gt;mask&lt;/code&gt; was True
(obtained via stream-compaction / masked_select), and the remaining
elements are zero (the tail of &lt;code&gt;source&lt;/code&gt; that was never consumed by the
forward pass).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;660 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;masked_select&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a new 1-D tensor which indexes the &lt;code&gt;input&lt;/code&gt; tensor according to
the boolean mask &lt;code&gt;mask&lt;/code&gt; which is a BoolTensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;661 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;matmul_bias_activation&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fused matrix multiplication with bias addition and ReLU activation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;662 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;matmuladd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes matrix multiplication followed by bias addition.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;663 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;matrix_exp_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for matrix_exp_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;664 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the maximum value of all elements in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;665 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a namedtuple &lt;code&gt;(values, indices)&lt;/code&gt; where &lt;code&gt;values&lt;/code&gt; is the maximum value
of each row of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
And &lt;code&gt;indices&lt;/code&gt; is the index location of each maximum value found (argmax).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;666 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for max_pool1d.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;667 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 IR
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 2D max pooling over an input signal composed of several input planes.
This is an IR representation rather than a public API and it is for the backward step.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;668 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool2d_with_indices&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 IR
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Applies a 2D max pooling over an input signal composed of several input planes.
This is an IR representation rather than a public API.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;669 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool2d_with_indices_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;max_pool2d_with_indices()&lt;/code&gt;.
This is an IR representation rather than a public API and it is for the backward step.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;670 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;max_pool2d_with_indices()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;671 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool3d_with_indices&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Applies a 3D max pooling over an input signal composed of several input planes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;672 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_pool3d_with_indices_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward pass for 3D max pooling with indices. Computes the gradient of the
input given the gradient of the output and the indices from the forward pass.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;673 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_unpool2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes a partial inverse of &lt;code&gt;MaxPool2d&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;674 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;max_unpool3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for max_unpool3d.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;675 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;maximum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise maximum of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;676 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mean&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the mean value of all elements in the &lt;code&gt;input&lt;/code&gt; tensor. Input must be floating point or complex.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;677 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mean_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the mean value of each row of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
If &lt;code&gt;dim&lt;/code&gt; is a list of dimensions, reduce over all of them.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;678 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;median&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the median of the values in &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;679 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;median_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a namedtuple &lt;code&gt;(values, indices)&lt;/code&gt; where &lt;code&gt;values&lt;/code&gt; contains the median
of each row of &lt;code&gt;input&lt;/code&gt; in the dimension &lt;code&gt;dim&lt;/code&gt;, and &lt;code&gt;indices&lt;/code&gt; contains the
index location of each median value found.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;680 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;median_dim_values&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;median_dim()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;681 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;median_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;median()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;682 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mhc_bwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DSA&lt;/td&gt;
 &lt;td&gt;
 The backward case for MHC (Manifold-Constrained Hyper-Connections).
This is the Triton implmentation for Sinkhorn implicit CG differentiation.
It computes the gradient of the Sinkhorn normalization using implicit differentiation via the conjugate gradient method.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;683 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mhc_post&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DSA&lt;/td&gt;
 &lt;td&gt;
 Triton implementation of mHC Post operator (optimized v3).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;684 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mhc_pre&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DSA&lt;/td&gt;
 &lt;td&gt;
 Triton implementation of mHC Pre operator (optimized v2).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;685 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;min&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the minimum value of all elements in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;686 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;min_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a namedtuple &lt;code&gt;(values, indices)&lt;/code&gt; where &lt;code&gt;values&lt;/code&gt; is the minimum value of
each row of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
And &lt;code&gt;indices&lt;/code&gt; is the index location of each minimum value found (argmin).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;687 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;minimum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise minimum of &lt;code&gt;input&lt;/code&gt; and &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;688 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;miopen_batch_norm_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for miopen_batch_norm_backward.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;689 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mish&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise, Activation&lt;/td&gt;
 &lt;td&gt;
 Applies the Mish activation function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;690 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mish_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise, Activation&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;mish()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;691 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mish_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of Mish activation with respect to the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;692 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mkldnn_rnn_layer&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Applies a single-layer unidirectional LSTM (oneDNN mkldnn_rnn_layer, mode=2)
to the input sequence, returning the output sequence and the final hidden and
cell states.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;693 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix multiplication of the two input matrices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;694 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;mm()&lt;/code&gt; with &lt;code&gt;out&lt;/code&gt; specified.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;695 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mm_w8a8_fp8&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, Quantization&lt;/td&gt;
 &lt;td&gt;
 Dynamically quantizes BF16 activations and weights to FP8 E4M3, computes their matrix product with FP8 Tensor Cores, and applies FP32 scales.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;696 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mode&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a namedtuple (values, indices) where values is the mode value of each row of the input tensor in the given dimension dim, i.e. a value which appears most often in that row, and indices is the index location of each mode value found.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;697 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;moe_align_block_size_triton&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Reduction, vLLM&lt;/td&gt;
 &lt;td&gt;
 Aligns the token distribution across experts to be compatible with block size
for matrix multiplication.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;698 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;moe_sum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Reduction, vLLM&lt;/td&gt;
 &lt;td&gt;
 An implementation of Mixture of Experts (MoE) with sum-based aggregation
instead of the more common weighted average.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;699 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mse_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Compute the element-wise mean squared error, with optional weighting.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;700 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mse_loss_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NeuralNetwork, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the gradient of mean squared error loss with respect to the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;701 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mul&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Multiplies &lt;code&gt;input&lt;/code&gt; by &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;702 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mul_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;mul()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;703 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;multinomial&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor where each row contains &lt;code&gt;num_samples&lt;/code&gt; indices sampled
from the multinomial probability distribution located in the corresponding row
of tensor &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;704 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;multiply&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Multiplies input by other element-wise (out-of-place alias for mul).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;705 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;multiply_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place multiplication using Triton kernel (alias for mul_). Supports tensor-tensor and tensor-scalar operations.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;706 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mv&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix-vector product of the matrix &lt;code&gt;input&lt;/code&gt; and the vector &lt;code&gt;vec&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;707 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mvlgamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the multivariate log-gamma function element-wise (out-of-place).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;708 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;mvlgamma_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the multivariate log-gamma function in-place for each element of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;709 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nan_to_num&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Replaces &lt;code&gt;NaN&lt;/code&gt;, positive infinity, and negative infinity values in &lt;code&gt;input&lt;/code&gt;
with the values specified by &lt;code&gt;nan&lt;/code&gt;, &lt;code&gt;posinf&lt;/code&gt;, and &lt;code&gt;neginf&lt;/code&gt;, respectively.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;710 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nan_to_num_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Replaces NaN, positive infinity, and negative infinity values in input in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;711 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nanmedian&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the median of the values in &lt;code&gt;input&lt;/code&gt;, ignoring &lt;code&gt;NaN&lt;/code&gt; values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;712 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nanmedian_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns a namedtuple &lt;code&gt;(values, indices)&lt;/code&gt; where &lt;code&gt;values&lt;/code&gt; contains the median
of each row of &lt;code&gt;input&lt;/code&gt; in the dimension &lt;code&gt;dim&lt;/code&gt;, ignoring &lt;code&gt;NaN&lt;/code&gt; values, and
&lt;code&gt;indices&lt;/code&gt; contains the index location of each median value found.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;713 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nanmedian_dim_values&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;nanmedian_dim()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;714 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nanmedian_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;nanmedian()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;715 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nansum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the sum of all elements in the &lt;code&gt;input&lt;/code&gt; tensor, treating &lt;code&gt;NaN&lt;/code&gt; values as zero.
Supports global reduction and reduction along specified dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;716 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nansum_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;nansum()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;717 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;narrow&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Pure layout operation (narrow); returns a zero-copy view sharing storage with the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;718 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;narrow_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for narrow_copy.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;719 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Apply native batch normalization using the existing implementation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;720 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Batch normalization with in-place running statistics updates, returning the normalized output along with the saved mean and inverse standard deviation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;721 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit_functional&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Functional version of batch normalization that returns the saved mean and inverse standard deviation, along with updated running estimates.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;722 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit_no_stats&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Batch normalization without persistent running statistics.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;723 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit_no_stats_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out variant of batch normalization without running statistics.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;724 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit_no_training&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Inference-only batch normalization using precomputed running_mean and running_var without updating them; returns the normalized output plus two empty save_mean/save_var tensors matching the aten schema.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;725 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_batch_norm_legit_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out variant of batch normalization with running statistics.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;726 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_dropout_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 The backward case of &lt;code&gt;dropout()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;727 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_group_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Apply native group normalization using the existing implementation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;728 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;native_layer_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Apply native layer normalization using the existing implementation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;729 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ne&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes that &lt;code&gt;input&lt;/code&gt; is not equal to &lt;code&gt;other&lt;/code&gt; element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;730 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ne_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes element-wise not-equal comparison in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;731 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ne_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The scalar version of &lt;code&gt;ne()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;732 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;neg&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the negative of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;733 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;neg_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;neg()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;734 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;negative&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 negative operator
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;735 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;negative_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the negative of input in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;736 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nested_from_padded_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Constructs a nested tensor from a padded tensor and offsets.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;737 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nested_sum_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for &lt;code&gt;_nested_sum_backward&lt;/code&gt;, the backward of
a (nested) tensor &lt;code&gt;sum&lt;/code&gt; over a single dimension. It broadcasts the
gradient back to the shape of the original input along the reduced dim.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;738 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nested_tensor_from_mask_left_aligned&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Checks whether a 3D tensor &lt;code&gt;t&lt;/code&gt; (N * L * D) combined with a 2D boolean padding
mask (N * L) is left-aligned, i.e. the valid (True) elements of every row appear
at the beginning with no gaps. Returns a bool.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;739 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nested_view_from_buffer_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Metax&lt;/td&gt;
 &lt;td&gt;
 Creates a nested tensor from a flat buffer using component sizes, strides,
and offsets, with a Metax backend specialization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;740 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nested_view_from_jagged&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Constructs a jagged-layout nested tensor from a flat values buffer and an
offsets tensor. This is a pure view operation that wraps the values buffer
without copying any data.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;741 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;new_full&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a Tensor of size &lt;code&gt;size&lt;/code&gt; filled with &lt;code&gt;fill_value&lt;/code&gt;.
By default, the returned Tensor has the same &lt;code&gt;torch.dtype&lt;/code&gt; and &lt;code&gt;torch.device&lt;/code&gt;
as this tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;742 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;new_ones&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a Tensor of size &lt;code&gt;size&lt;/code&gt; filled with 1, with the
same &lt;code&gt;torch.dtype&lt;/code&gt; and &lt;code&gt;torch.device&lt;/code&gt; as the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;743 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nextafter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Return the next floating-point value after input towards other, elementwise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;744 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nextafter_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns the next representable floating-point value from &lt;code&gt;input&lt;/code&gt; toward
&lt;code&gt;other&lt;/code&gt;, elementwise. In-place version of &lt;code&gt;nextafter&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;745 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Negative log likelihood loss for a 4D input (N, C, H, W) of log-probabilities
and a 3D integer target (N, H, W). Returns only the loss tensor, applying the
requested reduction (none/mean/sum) with optional per-class weights and an
ignore_index.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;746 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR&lt;/td&gt;
 &lt;td&gt;
 An internal IR for supporting &lt;code&gt;torch.nn.NLLLoss2d&lt;/code&gt;, which has been deprecated
and is now integrated into the standard &lt;code&gt;torch.nn.NLLLoss&lt;/code&gt;.
This is the backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;747 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss2d_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR&lt;/td&gt;
 &lt;td&gt;
 An internal IR for supporting &lt;code&gt;torch.nn.NLLLoss2d&lt;/code&gt;, which has been deprecated
and is now integrated into the standard &lt;code&gt;torch.nn.NLLLoss&lt;/code&gt;. This is the forward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;748 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR&lt;/td&gt;
 &lt;td&gt;
 Compute the negative log likelihood loss. This is the backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;749 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR&lt;/td&gt;
 &lt;td&gt;
 Compute the negative log likelihood loss. This is the forward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;750 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss_nd_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Measures the performance of a classification model by penalizing low probabilities for correct classe.s
This computes the gradients of this loss with respect to model parameters using automatic differentiation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;751 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nll_loss_nd_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Measures the performance of a classification model by calculating the negative log probability
of the true class. This defines the computation flow, transforming input data through layers
to produce output predictions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;752 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nonzero&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a 2-D tensor where each row is the index for a nonzero value.
When &lt;code&gt;as_tuple&lt;/code&gt; is explicitly set to True, this returns a tuple of 1-D index tensors,
allowing for advanced indexing of all nonzero values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;753 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nonzero_numpy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a tuple of 1-D tensors, one for each dimension, containing the indices of
the nonzero elements in the input tensor (NumPy-style).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;754 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nonzero_static&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a fixed-size 2-D int64 tensor containing indices of nonzero elements.
Rows beyond the number of nonzero elements are filled with &lt;code&gt;fill_value&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;755 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nonzero_static_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;nonzero_static&lt;/code&gt; that writes the fixed-size result to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;756 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 Computes the norm of vectors, matrices, and tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;757 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;norm_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;norm&lt;/code&gt; that computes the norm over all elements.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;758 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;norm_scalaropt_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;norm&lt;/code&gt; that computes the norm along specified dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;759 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Random sampling operator (normal_).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;760 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normal_float_float_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor of random numbers drawn from separate normal distributions
whose mean and standard deviation are given.
This is one of the variants that takes a float &lt;code&gt;mean&lt;/code&gt; and a float &lt;code&gt;std&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;761 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normal_float_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor of random numbers drawn from separate normal distributions
whose mean and standard deviation are given.
This is one of the variants that takes a float &lt;code&gt;mean&lt;/code&gt; and a tensor &lt;code&gt;std&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;762 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normal_tensor_float&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor of random numbers drawn from separate normal distributions
whose mean and standard deviation are given.
This is one of the variants that takes a tensor &lt;code&gt;mean&lt;/code&gt; and a float &lt;code&gt;std&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;763 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normal_tensor_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor of random numbers drawn from separate normal distributions
whose mean and standard deviation are given.
This is one of the variants that takes a tensor &lt;code&gt;mean&lt;/code&gt; and a tensor &lt;code&gt;std&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;764 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;normed_cumsum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Get the normalized cumulative sum where each step is divided by the total sum
of the dataset, resulting in values ranging from 0 to 1.
Internally used by the &lt;code&gt;multinomial&lt;/code&gt; operator.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;765 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;not_equal&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Logic
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical NOT EQUAL of the given input tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;766 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;not_equal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Logic
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes element-wise not-equal comparison in-place.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;767 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;not_equal_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Logic
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the element-wise logical NOT EQUAL comparing a tensor to a scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;768 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;nuclear_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the nuclear norm (sum of singular values) of a matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;769 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;one_hot&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Takes LongTensor with index values of shape &lt;code&gt;(*)&lt;/code&gt; and returns a tensor of shape &lt;code&gt;(*, num_classes)&lt;/code&gt;
that have zeros everywhere except where the index of last dimension matches the corresponding value
of the input tensor, in which case it will be 1.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;770 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ones&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with the scalar value 1, with the shape defined
by the variable argument &lt;code&gt;size&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;771 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ones_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with the scalar value 1, with the same size as &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;772 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;ormqr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the matrix-matrix multiplication of a product of Householder matrices
with a general matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;773 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;outer&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Computes outer product of self and the input vector.
If the self tensor is a vector of size &lt;code&gt;n&lt;/code&gt; and the input tensor is a vector of size &lt;code&gt;m&lt;/code&gt;,
the &lt;code&gt;out&lt;/code&gt; tensor (if specified) must be a matrix of size &lt;code&gt;n * m&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;774 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;outplace_fused_experts&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Activation, vLLM&lt;/td&gt;
 &lt;td&gt;
 This operator allocates and returns a new output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;775 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pack_seq_triton&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Pack variable-length token sequences into a padded batched tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;776 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pad&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 This pads a tenor using the specified mode.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;777 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pairwise_distance&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Computes the pairwise distance between input vectors, or between columns of input matrices.
Distances are computed using p-norm, with constant eps added to avoid division
by zero if p is negative.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;778 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pdist&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the p-norm distance between every pair of row vectors in the input.
Input must be a 2-D tensor of shape (N, M). Returns a tensor of shape
(N*(N-1)//2,) containing pairwise distances.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;779 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pdist_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of pairwise distance computation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;780 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pdist_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the pairwise distance between rows of a matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;781 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;per_token_group_quant_fp8&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Quantization
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, vLLM&lt;/td&gt;
 &lt;td&gt;
 Function to perform per-token-group quantization on an input tensor &lt;code&gt;x&lt;/code&gt;.
It converts the tensor values into signed float8 values and returns the
quantized tensor along with the scaling factor used for quantization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;782 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;permute_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates and returns a copy of x with permuted dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;783 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pixel_shuffle&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Rearranges elements in a tensor to a new tensor of different shape.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;784 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pixel_unshuffle&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Rearranges elements from a low-resolution feature map with many channels
into a higher-resolution feature map with fewer channels.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;785 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pixel_unshuffle_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;pixel_unshuffle&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;786 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;poisson&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor of the same size as &lt;code&gt;input&lt;/code&gt; with each element sampled
from a Poisson distribution with rate given by the corresponding element in &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;787 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;polar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Constructs a complex tensor whose elements are Cartesian coordinates corresponding to
the polar coordinates with absolute value &lt;code&gt;abs&lt;/code&gt; and angle &lt;code&gt;angle&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;788 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;polygamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the n-th derivative of the digamma function of the input (the polygamma function),
dispatching to dedicated digamma (n=0), trigamma (n=1), or Hurwitz-zeta (n&amp;gt;=2) Triton kernels.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;789 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;polygamma_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;polygamma()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;790 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;polygamma_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;polygamma&lt;/code&gt; that allows the output to be assigned to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;791 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;post_layer_norm_residual&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Fuses LayerNorm followed by a residual addition.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;792 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pow_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Takes the power of each element in &lt;code&gt;input&lt;/code&gt; with &lt;code&gt;exponent&lt;/code&gt; and returns a tensor with the result.
The input is a single float, while the &lt;code&gt;exponent&lt;/code&gt; is a tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;793 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pow_tensor_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Takes the power of each element in &lt;code&gt;input&lt;/code&gt; with &lt;code&gt;exponent&lt;/code&gt; and returns a tensor with the result.
The input is a tensor, while the &lt;code&gt;exponent&lt;/code&gt; is a float.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;794 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pow_tensor_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;pow_tensor_scalar()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;795 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pow_tensor_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Takes the power of each element in &lt;code&gt;input&lt;/code&gt; with &lt;code&gt;exponent&lt;/code&gt; and returns a tensor with the result.
The input is a tensor, while the &lt;code&gt;exponent&lt;/code&gt; is also a tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;796 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;pow_tensor_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;pow_tensor_tensor()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;797 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;prelu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 An activation function used in neural networks that improves upon ReLU (Rectified Linear Unit)
by allowing the network to learn the slope of negative inputs.
It performs an element-wise operation that keeps positive values and scales negative values
by a learnable parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;798 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;prelu_kernel&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the element-wise Parametric ReLU (PReLU) activation: f(x)=max(0,x)+weight*min(0,x),
where weight is a learnable parameter with the same shape as the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;799 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;prelu_kernel_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes backward gradients for Parametric ReLU (PReLU) forward pass.
PReLU scales negative inputs by a learnable per-channel weight. This backward
kernel computes gradients with respect to both input and weight.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;800 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;prod&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the product of all elements in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;801 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;prod_dim_int&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the product of each row of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;802 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;quantile&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the q-th quantiles of each row of the &lt;code&gt;input&lt;/code&gt; tensor along the dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;803 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;quantized_lstm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a multi-layer quantized LSTM over an input sequence. Takes the input sequence, initial hidden and cell states, and per-layer quantized weights, and returns the output sequence together with the final hidden and cell states.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;804 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rad2deg&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Converts each element from angles in radians to degrees.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;805 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rad2deg_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 In-place version of rad2deg.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;806 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rand&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with random numbers from a uniform distribution on the interval &lt;code&gt;[0,1)&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;807 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rand_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor with the same size as &lt;code&gt;input&lt;/code&gt; that is filled with random numbers
from a uniform distribution on the interval &lt;code&gt;[0,1)&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;808 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;randint&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with random integers generated uniformly between low (inclusive) and high (exclusive).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;809 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;randint_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor with the same size as &lt;code&gt;input&lt;/code&gt; that is filled with random integers
generated uniformly between &lt;code&gt;0&lt;/code&gt; (inclusive) and &lt;code&gt;high&lt;/code&gt; (exclusive).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;810 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;randn&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with random numbers from a normal distribution with mean 0
and variance 1 (also called the standard normal distribution).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;811 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;randn_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor with the same size as &lt;code&gt;input&lt;/code&gt; that is filled with random numbers
from a normal distribution with mean 0 and variance 1.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;812 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;random_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Random sampling operator (random_).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;813 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;randperm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a random permutation of integers from &lt;code&gt;0&lt;/code&gt; to &lt;code&gt;n - 1&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;814 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;range&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a 1-D tensor of size &lt;code&gt;floor(end - start) + 1&lt;/code&gt; with values from &lt;code&gt;start&lt;/code&gt; to
&lt;code&gt;end&lt;/code&gt; with step &lt;code&gt;1&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;815 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reciprocal&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the reciprocal of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;816 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reciprocal_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;reciprocal()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;817 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Pads the input 3D or 2D tensor (typically representing signals or sequences)
by reflecting the boundary values at the edges.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;818 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad1d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of reflection_pad1d with respect to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;819 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad1d_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;reflection_pad1d&lt;/code&gt; that assigns the output to &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;820 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Pads the input 3D or 2D tensor (typically representing signals or sequences)
by reflecting the boundary values at the both edges.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;821 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of reflection_pad2d with respect to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;822 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad2d_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;reflection_pad2d&lt;/code&gt; that assigns the output to &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;823 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Pads the input 5D tensor by reflecting the boundary values at both edges
along the last three spatial dimensions (depth, height, width).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;824 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reflection_pad3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of reflection_pad3d with respect to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;825 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 Rectified Gated Linear Unit is a variant of GLU that uses ReLU instead of the sigmoid function for gating.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;826 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;relu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Apply the RELU (Rectified Linear Unit) activation function element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;827 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;relu6&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the element-wise function &lt;code&gt;f(x)=min(max(0,x),6)&lt;/code&gt;.
This is a variation of the standard ReLU activation function that &amp;quot;caps&amp;quot; its output
at a maximum value of 6.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;828 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;relu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, Activation&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;relu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;829 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes Python's modulus operation entrywise. The result has the same sign
as the divisor &lt;code&gt;other&lt;/code&gt; and its absolute value is less than that of &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;830 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes Python's modulus operation entrywise. The result has the same sign
as the divisor &lt;code&gt;other&lt;/code&gt; and its absolute value is less than that of &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;831 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder_scalar_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;remainder()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;832 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes Python's modulus operation entrywise. The result has the same sign
as the divisor &lt;code&gt;other&lt;/code&gt; and its absolute value is less than that of &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;833 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes Python's modulus operation entrywise. The result has the same sign
as the divisor &lt;code&gt;other&lt;/code&gt; and its absolute value is less than that of &lt;code&gt;other&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;834 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;remainder_tensor_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;remainder()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;835 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;renorm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor where each sub-tensor along the given dimension is normalized such that the p-norm is lower than a max norm value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;836 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;renorm_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;renorm()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;837 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;repeat&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Repeats this tensor along the specified dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;838 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;repeat_interleave_self_int&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Repeats elements of a tensor. The number of repetitions is specified as an integer &lt;code&gt;repeats&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;839 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;repeat_interleave_self_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Repeats elements of a tensor. The number of repetitions is specified as a tensor &lt;code&gt;repeats&lt;/code&gt;.
&lt;code&gt;repeats&lt;/code&gt; is broadcasted to fit the shape of the given axis.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;840 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;repeat_interleave_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Repeats 0 &lt;code&gt;repeats[0]&lt;/code&gt; times, 1 &lt;code&gt;repeats[1]&lt;/code&gt; times, 2 &lt;code&gt;repeats[2]&lt;/code&gt; times, etc.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;841 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Pads the edge of a 1D input tensor by repeating the boundary values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;842 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad1d_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;replication_pad1d&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;843 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Pads the edge of a 2D input tensor by repeating the boundary values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;844 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient for replication_pad2d. Gradients from padded output are redistributed back to the original input boundaries via replication (edge-value duplication) semantics.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;845 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad2d_backward_grad_input&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;replication_pad2d_backward&lt;/code&gt; that writes gradients into a pre-allocated &lt;code&gt;grad_input&lt;/code&gt; tensor instead of allocating a new one.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;846 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad2d_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;replication_pad2d&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;847 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Pads the edge of a 3D input tensor by repeating the boundary values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;848 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;replication_pad3d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Accumulates output gradients into the clamped input positions used by
three-dimensional replication padding.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;849 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reshape_and_cache&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 Store the key/value token states into the pre-allcated kv_cache buffers of paged attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;850 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;reshape_and_cache_flash&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Attention
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Store the key/value token states into the pre-allcated kv_cache buffers of paged attention.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;851 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Resizes the input tensor to the specified size.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;852 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;resize()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;853 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize_as&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for resize_as.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;854 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize_as_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;resize_as()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;855 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize_output&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Resizes tensor output storage and copies overlapping elements.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;856 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resize_output_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Resizes the output tensor in-place to the given size.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;857 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resolve_conj&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Science
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with materialized conjugation if &lt;code&gt;input&lt;/code&gt;'s conjugate bit is set to True,
else returns &lt;code&gt;input&lt;/code&gt;. The output tensor will always have its conjugate bit set to False.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;858 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;resolve_neg&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Science
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with materialized negation if &lt;code&gt;input&lt;/code&gt;'s negative bit is set to True,
else returns &lt;code&gt;input&lt;/code&gt;. The output tensor will always have its negative bit set to False.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;859 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rms_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, Reduction&lt;/td&gt;
 &lt;td&gt;
 Apply Root Mean Square Layer Normalization over a mini-batch of inputs.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;860 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rms_norm_w8a16_fp8&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, Normalization, Quantization&lt;/td&gt;
 &lt;td&gt;
 Applies Root Mean Square Layer Normalization to BF16 activations using
group-wise FP8 E4M3 weights and per-group scales.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;861 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rnn_relu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for rnn_relu.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;862 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;roll&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Roll the tensor input along the given dimension(s). Elements that are shifted beyond the last position
are re-introduced at the first position.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;863 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rot90&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for rot90.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;864 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;round&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Rounds elements of input to the nearest integer.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;865 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;round_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The inplace version of &lt;code&gt;round&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;866 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;round_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;round&lt;/code&gt; that assigns the output to the specifiec &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;867 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rrelu_with_noise_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of the Randomized Leaky ReLU (RReLU) activation function with respect to
its input during backpropagation. It uses the noise tensor generated in the forward pass
to correctly apply the slope to negative input values.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;868 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rrelu_with_noise_functional&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for rrelu_with_noise_functional.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;869 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rshift&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies a bitwise right shift to an integer tensor with a tensor or scalar shift value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;870 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rshift_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;rshift()&lt;/code&gt; that assigns the output to the given &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;871 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rsqrt&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the reciprocal of the square-root of each of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;872 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rsqrt_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;rsqrt()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;873 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rsub_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Substracts &lt;code&gt;other&lt;/code&gt;, scaled by &lt;code&gt;alpha&lt;/code&gt;, from &lt;code&gt;input&lt;/code&gt;. This is the scalar version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;874 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rsub_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Substracts &lt;code&gt;other&lt;/code&gt;, scaled by &lt;code&gt;alpha&lt;/code&gt;, from &lt;code&gt;input&lt;/code&gt;. This is the tensor version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;875 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rwkv_ka_fusion&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 RWKV
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Merges, aligns, and enhances features from different data sources or spatial directions
using the efficient, linear-time RWKV framework.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;876 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;rwkv_mm_sparsity&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 RWKV
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Optimized, lossless sparse matrix multiplication in RWKV-7 models.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;877 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;safe_softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, IR, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Apply a softmax function. Note this version may not be functional.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;878 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Creates a 0-dimensional (scalar) tensor from a Python numeric value.
The tensor's dtype can be specified, otherwise inferred from the input value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;879 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_attention&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional, Attention&lt;/td&gt;
 &lt;td&gt;
 Computes scaled dot product attention on query, key and value tensors,
using an optional attention mask if passed and applying dropout
if a probability greater than 0.0 is specified.
The optional scale argument can only be specified as a keyword argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;880 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional, Attention&lt;/td&gt;
 &lt;td&gt;
 The backward case for &lt;code&gt;scaled_dot_product_attention&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;881 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_attention_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional, Attention&lt;/td&gt;
 &lt;td&gt;
 The forward case for &lt;code&gt;scaled_dot_product_attention&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;882 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_attention_math&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes scaled dot-product attention using the math-based implementation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;883 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_cudnn_attention&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes scaled dot product attention using the cuDNN attention API
interface, returning output, log-sum-exp, and auxiliary tensors for
backward computation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;884 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_cudnn_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Backward kernel for FlashAttention, computing gradients of queries, keys, values, and attention outputs efficiently.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;885 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_efficient_attention&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;KernelGen, nn.functional, Attention, aten&lt;/td&gt;
 &lt;td&gt;
 Computes the efficient memory attention for &lt;code&gt;scaled_dot_product_attention&lt;/code&gt;.
This is a composite operator that wraps scaled_dot_product_attention_forward
and additionally returns log-sumexp and dropout RNG state.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;886 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_efficient_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Backward kernel for FlashAttention, computing gradients of queries, keys, values, and attention outputs efficiently.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;887 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_flash_attention&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Run the scaled dot product FlashAttention forward operation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;888 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_flash_attention_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Backward kernel for FlashAttention, computing gradients of queries, keys, values, and attention outputs efficiently.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;889 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_dot_product_fused_attention_overrideable&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Attention, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes scaled dot product attention on query, key and value tensors, using an optional attention mask if passed. Returns extra values including logsumexp, cumulative sequence lengths, max sequence lengths, philox RNG state, and debug attention mask.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;890 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_grouped_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;MoE&lt;/td&gt;
 &lt;td&gt;
 Performs grouped matrix multiplication with row-wise and column-wise scaling,
commonly used by quantized Mixture-of-Experts (MoE) workloads.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;891 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs a scaled matrix multiplication. The result of &lt;code&gt;self @ mat2&lt;/code&gt; is
multiplied by &lt;code&gt;scale_a&lt;/code&gt; and &lt;code&gt;scale_b&lt;/code&gt;, then an optional bias is added.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;892 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_mm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;_scaled_mm&lt;/code&gt; that writes the result into &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;893 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_softmax_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The backward pass for a scaled softmax function, commonly used in Scaled Dot-Product Attention (SDPA)
within Transformer models, computes the gradient of the loss with respect to the input logits,
incorporating a scaling factor to stabilize training.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;894 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scaled_softmax_forward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The backward pass for a scaled softmax function, commonly used in Scaled Dot-Product Attention (SDPA)
within Transformer models, computes the gradient of the loss with respect to the input logits,
incorporating a scaling factor to stabilize training.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;895 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_add&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-of-place version of scatter_add_: adds all values from the tensor &lt;code&gt;src&lt;/code&gt;
into &lt;code&gt;inp&lt;/code&gt; at the indices specified in the &lt;code&gt;index&lt;/code&gt; tensor along dimension
&lt;code&gt;dim&lt;/code&gt; and returns the result without modifying the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;896 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_add_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Adds all values from the tensor &lt;code&gt;src&lt;/code&gt; into &lt;code&gt;self&lt;/code&gt; at the indices specified
in the &lt;code&gt;index&lt;/code&gt; tensor in a similar fashion as &lt;code&gt;scatter_()&lt;/code&gt;.
For each value in &lt;code&gt;src&lt;/code&gt;, it is added to an index in &lt;code&gt;self&lt;/code&gt; which is specified
by its index in &lt;code&gt;src&lt;/code&gt; for &lt;code&gt;dimension != dim&lt;/code&gt; and by the corresponding value
in &lt;code&gt;index&lt;/code&gt; for &lt;code&gt;dimension = dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;897 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_reduce&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Writes all values from the tensor &lt;code&gt;src&lt;/code&gt; into provided tensor at the indices
specified in the &lt;code&gt;index&lt;/code&gt; tensor. For each value in &lt;code&gt;src&lt;/code&gt;, its output index
is specified by its index in &lt;code&gt;src&lt;/code&gt; for &lt;code&gt;dimension != dim&lt;/code&gt; and by the corresponding value
in &lt;code&gt;index&lt;/code&gt; for &lt;code&gt;dimension = dim&lt;/code&gt;.
The optional &lt;code&gt;reduce&lt;/code&gt; argument allows specification of an optional reduction operation,
which is applied to all values in the tensor &lt;code&gt;src&lt;/code&gt; into the tensor at the indices
specified in the &lt;code&gt;index&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;898 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_reduce_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;scatter_reduce()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;899 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_reduce_two_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A specific low-level ATen operator primarily encountered during model compilation
or when using advanced backends like TensorRT or MPS.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;900 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_src&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Writes all values from the tensor &lt;code&gt;src&lt;/code&gt; into provided tensor at the indices
specified in the &lt;code&gt;index&lt;/code&gt; tensor. For each value in &lt;code&gt;src&lt;/code&gt;, its output index
is specified by its index in &lt;code&gt;src&lt;/code&gt; for &lt;code&gt;dimension != dim&lt;/code&gt; and by the corresponding value
in &lt;code&gt;index&lt;/code&gt; for &lt;code&gt;dimension = dim&lt;/code&gt;.
The optional &lt;code&gt;reduce&lt;/code&gt; argument allows specification of an optional reduction operation,
which is applied to all values in the tensor &lt;code&gt;src&lt;/code&gt; into the tensor at the indices
specified in the &lt;code&gt;index&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;901 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;scatter_src_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;scatter_src()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;902 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;searchsorted&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Finds insertion indices for tensor values in sorted innermost-dimension boundaries.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;903 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;searchsorted_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;searchsorted.Tensor&lt;/code&gt; that assigns the result to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;904 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;searchsorted_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Finds insertion indices for a scalar value in one-dimensional sorted boundaries.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;905 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;searchsorted_scalar_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;searchsorted.Scalar&lt;/code&gt; that assigns the result to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;906 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;segment_reduce&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Reduces contiguous segments of a tensor along the specified axis. Segments are described
by &lt;code&gt;lengths&lt;/code&gt; or &lt;code&gt;offsets&lt;/code&gt;, and supported reductions include sum, mean, max, min, and prod.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;907 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;segment_reduce_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes gradients for &lt;code&gt;segment_reduce&lt;/code&gt; with lengths or offsets based segment definitions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;908 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;segment_reduce_backward_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;_segment_reduce_backward&lt;/code&gt; that assigns the gradient input to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;909 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;segment_reduce_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;segment_reduce&lt;/code&gt; that assigns the reduced segments to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;910 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;select_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Calculate the gradient during the backward pass in the neural network.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;911 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;select_scatter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Embeds the values of the &lt;code&gt;src&lt;/code&gt; tensor into &lt;code&gt;input&lt;/code&gt; at the given index.
This function returns a tensor with fresh storage; it does not create a view.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;912 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;selu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies an element-wise activation function that induces self-normalizing properties in neural networks.
It scales the Exponential Linear Unit (ELU) to ensure activations remain close to zero mean and unit variance.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;913 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;selu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;selu&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;914 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sgn&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the sign of each element in the input tensor, element-wise.
This function extends &lt;code&gt;sign()&lt;/code&gt; to complex tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;915 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sgn_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the sign of each element in the &lt;code&gt;self&lt;/code&gt; tensor, element-wise.
This function is an extension of &lt;code&gt;sign()&lt;/code&gt; designed to handle complex tensors
in addition to real-valued ones.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;916 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sgn_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Writes the element-wise sign of the input tensor to the &lt;code&gt;out&lt;/code&gt; tensor.
This function extends &lt;code&gt;sign()&lt;/code&gt; to complex tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;917 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sigmoid&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the expit (also known as the logistic sigmoid function) of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;918 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sigmoid_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;sigmoid()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;919 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sigmoid_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;sigmoid()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;920 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sign&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the sign of the elements of input.
For real numbers: 1 if x &amp;gt; 0, -1 if x &amp;lt; 0, 0 if x == 0, 0 if x is NaN.
Complex dtypes are not supported (use torch.sgn instead).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;921 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sign_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Out-variant of sign. Writes the element-wise sign to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;922 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;signbit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Tests if each element of &lt;code&gt;input&lt;/code&gt; has its sign bit set or not.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;923 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;signbit_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;signbit&lt;/code&gt; that assigns the output to &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;924 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 SiLU (Sigmoid Linear Unit), a simple approximation of ReLU but
without any discontinuity of the first derivative.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;925 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;silu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;926 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_and_mul&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Activation
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, pointwise, vLLM&lt;/td&gt;
 &lt;td&gt;
 A custom operator in vLLM as activation function for SwiGLU.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;927 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_and_mul_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Activation
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, pointwise, vLLM&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;silu_and_mul&lt;/code&gt; with an extra &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;928 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_and_mul_with_clamp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Activation
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, pointwise, vLLM&lt;/td&gt;
 &lt;td&gt;
 A custom operator in vLLM as activation function for SwiGLU.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;929 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_and_mul_with_clamp_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Activation
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, pointwise, vLLM&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;silu_and_mul_with_clamp&lt;/code&gt; with an extra &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;930 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;silu_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;silu()&lt;/code&gt; for backward case.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;931 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sin&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the sine of the elements in the &lt;code&gt;input&lt;/code&gt; tensor,
where each value in this input tensor is in radians.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;932 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sin_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;sin()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;933 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sinc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the normalized sinc function &lt;code&gt;sin(π·x) / (π·x)&lt;/code&gt; for each element of the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;934 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sinc_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;sinc()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;935 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sinh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the hyperbolic sine (e^x - e^{-x}) / 2 element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;936 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sinh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the hyperbolic sine &lt;code&gt;(e^x-e^{-x})/2&lt;/code&gt; of each element in a tensor.
This is an in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;937 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;skip_layer_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 An optimized operation used in Transformer models to improve performance
by combining residual connection (skip connection) addition and Layer Normalization
(LayerNorm) into a single kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;938 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;slice&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Slices the input tensor along the specified dimension.
Returns a view of the original tensor with the given dimension sliced from start to end.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;939 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;slice_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 An automatic differentiation (autograd) function that computes the gradient of a tensor slicing operation
(&lt;code&gt;tensor[start:end]&lt;/code&gt;) during backpropagation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;940 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;slice_scatter&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Embeds the values of the &lt;code&gt;src&lt;/code&gt; tensor into &lt;code&gt;input&lt;/code&gt; at the given dimension.
This function returns a tensor with fresh storage; it does not create a view.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;941 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;smooth_l1_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Compute the smooth L1 loss between input and target tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;942 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;smooth_l1_loss_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Compute the gradient of smooth L1 loss with respect to the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;943 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;soft_margin_loss&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Compute the soft margin loss.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;944 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;soft_margin_loss_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Backward pass for soft margin loss, a two-class classification logistic loss between input and target tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;945 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Apply a softmax function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;946 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softmax_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;softmax()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;947 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softmax_backward_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;softmax_backward()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;948 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softmax_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 Apply a softmax function, with given &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;949 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softplus&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 Applies element-wise, the function Softplus.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;950 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softplus_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Activation, pointwise&lt;/td&gt;
 &lt;td&gt;
 The backward version of &lt;code&gt;softplus()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;951 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softshrink&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the soft shrinkage function element-wise to an input tensor.
It is an activation function often used in signal processing and sparse representation,
such as image denoising.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;952 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;softshrink_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, Activation, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is a variant of &lt;code&gt;softshrink&lt;/code&gt; that supports an output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;953 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sort&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Sorts the elements of the &lt;code&gt;input&lt;/code&gt; tensor along a given dimension in ascending order by value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;954 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sort_stable&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Sorts the elements of the &lt;code&gt;input&lt;/code&gt; tensor along a given dimension in ascending order by value.
This is a variant of &lt;code&gt;sort()&lt;/code&gt; where &lt;code&gt;stable&lt;/code&gt; is set to True to preserve the order of equivalent elements.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;955 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_attn_triton&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, NoCPU&lt;/td&gt;
 &lt;td&gt;
 Sparse attention with attention-sink.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;956 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_mla_fwd_interface&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 DSA
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 A generic interface for sparse MLA (Multi-head Latent Attention) for DeepSeek v3/v3.2.
It is currently not exposed as a standalone operator for use.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;957 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_sampled_addmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes alpha * (mat1 @ mat2) * spy(input) + beta * input, where input is a sparse CSR tensor
and spy(input) keeps only its sparsity pattern. The result shares the CSR pattern with input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;958 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_sampled_addmm_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of sparse_sampled_addmm that assigns the result to the provided sparse CSR out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;959 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_semi_structured_addmm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs a matrix multiplication of the sparse semi-structured
(2:4 sparsity) matrices mat1 and mat2 with input added.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;960 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sparse_semi_structured_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs a sparse semi-structured matrix multiplication of a dense matrix with a 2:4 sparsity pattern against a dense matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;961 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_airy_ai&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Airy function Ai(x) for each element of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;962 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_airy_ai_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_airy_ai&lt;/code&gt; with output saved to provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;963 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_bessel_j0&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Bessel function of the first kind of order 0 for each element
of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;964 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_bessel_j1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the Bessel function of the first kind of order 1 for each element of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;965 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_bessel_y0&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the Bessel function of the second kind of order 0 for each element of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;966 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_bessel_y1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Bessel function of the second kind of order 1 (Y_1(x)) for each element
in the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;967 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_chebyshev_polynomial_u&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Chebyshev polynomial of the second kind U_n(x) for each element
of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;968 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_chebyshev_polynomial_v&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for special_chebyshev_polynomial_v.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;969 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_chebyshev_polynomial_w&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Chebyshev polynomial of the fourth kind
:math:&lt;code&gt;W_{n}(\\text{input})&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;970 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_chebyshev_polynomial_w_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_chebyshev_polynomial_w()&lt;/code&gt; with output saved to
provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;971 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_digamma&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the digamma function (logarithmic derivative of the gamma function).
Alias for digamma; delegates to the digamma kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;972 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erf&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the error function of &lt;code&gt;input&lt;/code&gt; element-wise.
Alias for erf; delegates to the erf kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;973 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erfc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the complementary error function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;974 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erfcx&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the scaled complementary error function for each element of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;975 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erfinv&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the inverse error function element-wise.
Maps values in (-1, 1) to the real line.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;976 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erfinv_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;special_erfinv()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;977 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_erfinv_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_erfinv()&lt;/code&gt; that assigns the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;978 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_exp2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the base two exponential function of &lt;code&gt;input&lt;/code&gt; element-wise.
Alias for exp2; delegates to the exp2 kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;979 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_expit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the expit (sigmoid) function element-wise. Returns 1 / (1 + exp(-x)).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;980 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_gammainc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the regularized lower incomplete gamma function P(a, x) element-wise.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;981 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_gammaincc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the regularized upper incomplete gamma function Q(a, x) element-wise.
Out-of-place counterpart of igammac_; delegates to the igammac kernel.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;982 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_gammaln&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the logarithm of the absolute value of the Gamma function on input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;983 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_gammaln_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-of-place variant of special_gammaln that writes the result to the out tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;984 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_hermite_polynomial_h&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the physicist's Hermite polynomial H_n(x) of degree n at input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;985 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i0e&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the exponentially scaled zeroth order modified Bessel function
of the first kind for each element of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;986 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i0e_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_i0e()&lt;/code&gt; with output saved to provided &lt;code&gt;out&lt;/code&gt;..
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;987 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the modified Bessel function of the first kind of order 1 (I_1(x)) for each element
in the input tensor, designed for special mathematical functions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;988 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i1_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_i1&lt;/code&gt; that allows the output to be assigned to another tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;989 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i1e&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the exponentially scaled modified Bessel function of the first kind
of order 1, i1e(x) = i1(x) * exp(-|x|), for each element in the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;990 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_i1e_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_i1e()&lt;/code&gt; that saves the output to the provided &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;991 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_legendre_polynomial_p&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the Legendre polynomial P_n(x) of degree n for each element in the input tensor,
designed for special mathematical functions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;992 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_log1p&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes log(1 + x) for each element of the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;993 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_log1p_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special.log1p&lt;/code&gt; that allows the output to be assigned to another tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;994 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_log_ndtr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the log of the cumulative distribution function of the standard
normal distribution (log_ndtr(x)) for each element in the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;995 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_log_softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Applies the log of the softmax function along a given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;996 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_logit&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the logit of the elements of input.
Input is clamped to [eps, 1 - eps] when eps is not None.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;997 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_logit_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_logit&lt;/code&gt; that allows the output to be assigned to another tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;998 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_logsumexp&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the natural logarithm of the sum of exponentials of each row
of the input tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;999 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_i0&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the modified Bessel function of the first kind of order 0 (I_0(x)) for each element
in the input tensor, designed for special mathematical functions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1000 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_i0_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_modified_bessel_i0&lt;/code&gt; that writes the modified Bessel
function of the first kind of order 0 (I_0(x)) into a preallocated output tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1001 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_k0&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for special_modified_bessel_k0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1002 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_k0_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for special_modified_bessel_k0.out.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1003 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_k1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Modified Bessel function of the second kind of order 1.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1004 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_modified_bessel_k1_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_modified_bessel_k1&lt;/code&gt; that allows the output to be assigned to another tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1005 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_multigammaln&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the multivariate log-gamma function for each element of the input.
Out-of-place counterpart of mvlgamma_; delegates to the mvlgamma kernel,
which supports orders p up to 12.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1006 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_ndtr&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the standard normal cumulative distribution function (CDF).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1007 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_ndtri&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the argument &lt;code&gt;x&lt;/code&gt; for which the area under the standard Gaussian
probability density function, integrated from minus infinity to &lt;code&gt;x&lt;/code&gt;, equals
&lt;code&gt;input&lt;/code&gt;. In other words it is the inverse of the standard normal CDF.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1008 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_round&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Rounds a tensor to the nearest integer, with ties rounding to the nearest
even value (banker's rounding).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1009 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_round_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;special_round()&lt;/code&gt; with output saved to provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1010 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_scaled_modified_bessel_k1&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes the scaled modified Bessel function of the first kind
of order 1 (scaled K_1(x) = exp(x)*K_1(x)) for each element in the input tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1011 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_shifted_chebyshev_polynomial_t&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the shifted Chebyshev polynomial of the first kind T_n^*(x)
for each pair of elements in &lt;code&gt;x&lt;/code&gt; and &lt;code&gt;n&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1012 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_shifted_chebyshev_polynomial_u&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the shifted Chebyshev polynomial of the second kind U_n^*(x)
for each pair of elements in &lt;code&gt;x&lt;/code&gt; and &lt;code&gt;n&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1013 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_shifted_chebyshev_polynomial_u_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Inplace variant of &lt;code&gt;special_shifted_chebyshev_polynomial_u&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1014 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_shifted_chebyshev_polynomial_v&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the shifted Chebyshev polynomial of the third kind V_n^*(x).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1015 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_shifted_chebyshev_polynomial_w&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the shifted Chebyshev polynomial of the second kind W_n(x).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1016 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_sinc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes sin(pi * x) / (pi * x) for each element of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1017 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, reduction, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the softmax of &lt;code&gt;input&lt;/code&gt; along dimension &lt;code&gt;dim&lt;/code&gt;; alias of
&lt;code&gt;torch.nn.functional.softmax&lt;/code&gt; exposed under &lt;code&gt;torch.special&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1018 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_xlog1py&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;x * log1p(y)&lt;/code&gt; for each element pair in the input tensors &lt;code&gt;x&lt;/code&gt; and &lt;code&gt;y&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1019 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_xlogy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;x * log(y)&lt;/code&gt; for each element pair in the input tensors &lt;code&gt;x&lt;/code&gt; and &lt;code&gt;y&lt;/code&gt;. Returns 0 if &lt;code&gt;x == 0&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1020 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;special_xlogy_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;special_xlogy()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1021 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;split_with_sizes_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Splits a tensor into sub-tensors along a given dimension,
where each split has a specified size. Always returns copies.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1022 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sqrt&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the square-root of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1023 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sqrt_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;sqrt()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1024 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;square&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the square of the elements of input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1025 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;square_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 The inplace version of &lt;code&gt;square&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1026 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;square_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;square&lt;/code&gt; that assigns the output to the provided &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1027 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;squeeze_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for squeeze_copy.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1028 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;stack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Concatenates a sequence of tensors along a new dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1029 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;stage_deepseek_v4_mega_moe_inputs&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, DeepSeekV4, MoE&lt;/td&gt;
 &lt;td&gt;
 Stages DeepSeekV4 Mega-MoE inputs by quantizing hidden states to FP8
with UE8M0 scales and copying top-k indices and weights to output buffers.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1030 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;std&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Calculates the standard deviation over the dimensions specified by &lt;code&gt;dim&lt;/code&gt;.
&lt;code&gt;dim&lt;/code&gt; can be a single dimension, list of dimensions, or &lt;code&gt;None&lt;/code&gt;
to reduce over all dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1031 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sub&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Subtracts &lt;code&gt;other&lt;/code&gt;, scaled by &lt;code&gt;alpha&lt;/code&gt;, from the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1032 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sub_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Subtracts &lt;code&gt;other&lt;/code&gt;, scaled by &lt;code&gt;alpha&lt;/code&gt;, from the &lt;code&gt;input&lt;/code&gt; tensor.
This is the in-place version.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1033 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;subtract&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Subtracts &lt;code&gt;other&lt;/code&gt;, scaled by &lt;code&gt;alpha&lt;/code&gt;, from &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1034 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;subtract_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of subtract. Subtracts other, scaled by alpha, from input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1035 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sum&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the sum of all elements in the &lt;code&gt;input&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1036 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sum_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Returns the sum of each row of the &lt;code&gt;input&lt;/code&gt; tensor in the given dimension &lt;code&gt;dim&lt;/code&gt;.
&lt;code&gt;dim&lt;/code&gt; is a list of dimensions, reduce over all of them.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1037 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sum_dim_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;sum_dim()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1038 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sum_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;sum()&lt;/code&gt; with the &lt;code&gt;out&lt;/code&gt; argument.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1039 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sum_to_size&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for sum_to_size.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1040 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;swiglu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Transformer&lt;/td&gt;
 &lt;td&gt;
 Swish-Gated Linear Unit, a variant of GLU with the Swish activation function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1041 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sym_constrain_range&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Constrains the range of a symbolic integer value. Used for torch.compile symbolic tracing to provide bounds information.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1042 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sym_storage_offset&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the storage offset of the input tensor as an integer. Used for torch.compile symbolic tracing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1043 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;sym_stride&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the stride of the input tensor as a tuple of integers. Used for torch.compile symbolic tracing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1044 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;t_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Transpose a 2D tensor into a new tensor with contiguous memory layout.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1045 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;t_copy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;t_copy()&lt;/code&gt; that allows the output to be assigned to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1046 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;take&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the elements of &lt;code&gt;input&lt;/code&gt; at the given flat
&lt;code&gt;index&lt;/code&gt;. The input is treated as a flattened 1-D tensor and the result
takes the shape of &lt;code&gt;index&lt;/code&gt;. Negative indices are supported.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1047 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;take_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Out-variant of take. Writes the gathered elements into the &lt;code&gt;out&lt;/code&gt; tensor,
resizing it to the shape of &lt;code&gt;index&lt;/code&gt; if needed.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1048 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tan&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the tangent of the elements in the &lt;code&gt;input&lt;/code&gt; tensor,
where each value in this &lt;code&gt;input&lt;/code&gt; tensor is in radians.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1049 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tan_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;tan()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1050 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tanh&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with the hyperbolic tangent of the elements of &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1051 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tanh_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the in-place version of &lt;code&gt;tanh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1052 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tanh_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the backward case for &lt;code&gt;tanh()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1053 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;te_rmsnorm_bwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Normalization&lt;/td&gt;
 &lt;td&gt;
 RMSNorm backward pass aligned with TransformerEngine's rmsnorm_bwd signature.
Computes gradients dx (w.r.t. input) and dgamma (w.r.t. weight).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1054 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;te_rmsnorm_fwd&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, Normalization&lt;/td&gt;
 &lt;td&gt;
 RMSNorm forward pass aligned with TransformerEngine's rmsnorm_fwd signature.
Supports zero_centered_gamma, pre-allocated output tensor, and output dtype conversion.
Returns (output, None, rsigma).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1055 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tensor_split&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Splits a tensor into multiple sub-tensors along a given dimension,
using either a number of sections or a list of split indices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1056 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;thnn_differentiable_gru_cell_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes differentiable gradients for a fused GRU cell.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1057 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;thnn_fused_lstm_cell&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fused LSTM cell computation with optional input and hidden biases.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1058 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;thnn_fused_lstm_cell_backward_impl&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes gradients for the fused LSTM cell operation (_thnn_fused_lstm_cell).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1059 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;threshold&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 Apply a threshold to each element of the input Tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1060 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;threshold_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of threshold(). Thresholds each element of the input Tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1061 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;threshold_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is the backward version for &lt;code&gt;threshold&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1062 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tile&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Constructs a tensor by repeating the elements of &lt;code&gt;input&lt;/code&gt;.
The &lt;code&gt;dims&lt;/code&gt; argument specifies the number of repetitions in each dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1063 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;to_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1064 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;top_k_per_row_decode&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DeepSeekV4, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton top-K per row for DeepSeek V4 decode-phase token selection.
Radix-select based approach with three dispatch tiers for different vocab sizes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1065 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;top_k_per_row_prefill&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton top-K per row for DeepSeek V4 sparse attention prefill phase.
Replaces vLLM persistent_topk CUDA kernel with in-place masking + adaptive topk selection.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1066 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;topk&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns the &lt;code&gt;k&lt;/code&gt; largest elements of the given &lt;code&gt;input&lt;/code&gt; tensor along a given dimension.
If &lt;code&gt;dim&lt;/code&gt; is not given, the last dimension of the &lt;code&gt;input&lt;/code&gt; is chosen.
If &lt;code&gt;largest&lt;/code&gt; is False then the &lt;code&gt;k&lt;/code&gt; smallest elements are returned.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1067 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;topk_softmax&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM&lt;/td&gt;
 &lt;td&gt;
 Selects the k most likely next-token candicates, sets all others to zero,
and renormalize the prbabilities of these top candidates.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1068 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;topk_softplus_sqrt&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 MoE
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, KernelGen, vLLM&lt;/td&gt;
 &lt;td&gt;
 Fused softplus + sqrt + top-k selection and optional renormalization
for MoE gating in models like DeepSeek-V3/V4.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1069 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;topk_w8a16_fp8&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;NoCPU, Quantization&lt;/td&gt;
 &lt;td&gt;
 Returns the k largest (or smallest) elements of a group-wise FP8 E5M2 tensor along the last dimension, dequantizing with per-group scales.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1070 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;trace&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;4.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the sum of the elements of the diagonal of the input 2-D matrix.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1071 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;transpose&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a view of the original tensor with its two dimensions swapped.
This is a zero-copy view operation that swaps the sizes and strides of
the two specified dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1072 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tril&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns the lower triangular part of an input matrix (or a batch of matrices) and
sets all other elements to zero.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1073 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tril_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;tril()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1074 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;tril_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;tril()&lt;/code&gt; that explicitly assigns the output to the &lt;code&gt;out&lt;/code&gt; parameter.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1075 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;triton_lighting_indexer_k_tiled_interface&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, DSA&lt;/td&gt;
 &lt;td&gt;
 Part of FP8 MQA framework. It is currently not exposed as an operator for use.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1076 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;triu&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;1.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the upper triangular part of a matrix (2-D tensor) or batch of matrices &lt;code&gt;input&lt;/code&gt;,
the other elements of the result tensor &lt;code&gt;out&lt;/code&gt; are set to 0.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1077 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;triu_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;triu()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1078 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;true_divide&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Performs element-wise true division between two tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1079 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;true_divide_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Performs element-wise true division in-place between two tensors.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1080 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;trunc&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Rounds each element of the input tensor to the nearest integer towards zero.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1081 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;trunc_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;trunc()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1082 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;trunc_divide&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The &lt;code&gt;div&lt;/code&gt; function with rounding_mode set to &lt;code&gt;trunc&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1083 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;trunc_divide_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 The in-place version of &lt;code&gt;trunc_divide&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1084 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unbind&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Pure layout operation (unbind); returns zero-copy views sharing storage with the input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1085 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unbind_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Removes a tensor dimension and returns a tuple of all slices along a given dimension as copies.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1086 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unflatten&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Expand a single dimension into multiple dimensions (inverse of flatten).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1087 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unfold&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Return a view of the tensor with a sliding window along the given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1088 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unfold_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, nn.functional&lt;/td&gt;
 &lt;td&gt;
 An operator for calculating the gradient of the &lt;code&gt;unfold&lt;/code&gt; operation during backpropagation.
It takes the gradient of the unfolded output and accumulates it back into
the original input shape, reversing sliding local block extraction and resolving overlaps.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1089 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unfold_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a view of the original tensor which contains all slices of size from self tensor in the specified dimension with given step between two slices.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1090 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;uniform_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Fills &lt;code&gt;self&lt;/code&gt; tensor with numbers sampled from the continuous uniform distribution.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1091 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unique2&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the unique elements of the input tensor. This is an internal PyTorch function.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1092 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unique_consecutive&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Distribution
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Eliminates all but the first element from every consecutive group of equivalent elements.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1093 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unique_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns the unique slices of the input tensor along a dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1094 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unpack_seq_triton&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;fused, vLLM, DeepSeekV4&lt;/td&gt;
 &lt;td&gt;
 Unpack a packed sequence tensor back to its original variable-length form.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1095 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_chunk&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Split a tensor into a specified number of chunks along a given dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1096 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_index&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Indexes &lt;code&gt;input&lt;/code&gt; along each dimension with the given indices, matching
&lt;code&gt;aten._unsafe_index&lt;/code&gt;. Unlike the safe &lt;code&gt;index&lt;/code&gt; operator, it performs no
bounds checking and rejects &lt;code&gt;bool&lt;/code&gt; / &lt;code&gt;int8&lt;/code&gt; masks.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1097 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_masked_index&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Gathers elements from self at given indices where mask is True, filling unmasked positions with a scalar value.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1098 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_masked_index_put_accumulate&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Reads values and indices tensors, performs masked scatter accumulation on
input tensor at specified indices where mask is True. The accumulate
variant uses atomic_add instead of replacement.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1099 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_split_with_sizes&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Splits a tensor into sub-tensors along a given dimension, where each split
has a specified size. Returns views into the original tensor without safety
checks.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1100 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsafe_view&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Creates a new view of an existing tensor with a different shape without
performing safety checks, such as verifying if the tensor is contiguous or
if the reshape is valid.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1101 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsqueeze&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a new tensor with a dimension of size one inserted at the specified position.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1102 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;unsqueeze_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 In-place version of &lt;code&gt;unsqueeze()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1103 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bicubic2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;upsample()&lt;/code&gt; that has &lt;code&gt;mode&lt;/code&gt; set to &lt;code&gt;bicubic&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1104 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bicubic2d_aa&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;upsample()&lt;/code&gt; that has &lt;code&gt;mode&lt;/code&gt; set to &lt;code&gt;bicubic&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1105 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bicubic2d_aa_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A backward case for &lt;code&gt;_upsample_bicubic2d_aa()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1106 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bilinear2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Upsamples the input, using bilinear mode.
The input has to be 4 dimensional, and the &lt;code&gt;output_size&lt;/code&gt; is a tuple of 2 ints.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1107 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bilinear2d_aa&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Upsamples the input, using bilinear mode with anti-aliasing.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1108 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_bilinear2d_aa_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A backward case for &lt;code&gt;_upsample_bilinear2d_aa()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1109 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_lanczos2d_aa&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 Resizes a 4D image tensor with antialiased Lanczos-3 interpolation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1110 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_lanczos2d_aa_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 An out variant of &lt;code&gt;_upsample_lanczos2d_aa()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1111 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_lanczos2d_aa_vec&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 A vector-parameter variant of &lt;code&gt;_upsample_lanczos2d_aa()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1112 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_linear1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Upsamples the &lt;code&gt;input&lt;/code&gt;, using linear mode.
The input has to be 3 dimensional, and the &lt;code&gt;output_size&lt;/code&gt; is an optional tuple of ints.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1113 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_linear1d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 A backward case for &lt;code&gt;upsample_linear1d()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1114 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Upsamples the &lt;code&gt;input&lt;/code&gt;, using nearest neighbours' pixel values.
The input has to be 3 dimensional, and the &lt;code&gt;output_size&lt;/code&gt; is an optional tuple of ints.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1115 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Upsamples the &lt;code&gt;input&lt;/code&gt;, using nearest neighbours' pixel values. The input has to be 4 dimensional.
The scales can be provided with &lt;code&gt;scales_h&lt;/code&gt; and &lt;code&gt;scales_w&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1116 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Performs 3D nearest-neighbor interpolation to increase the spatial size of volumetric data,
such as 5D tensors. It scales up inputs by copying values from the nearest pixel/voxel,
without calculating new values through linear interpolation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1117 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact1d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Increases the length of a 1D tensor using nearest-neighbor interpolation,
ensuring the output aligns with library-standard algorithms like PIL.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1118 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact1d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 A backward case for &lt;code&gt;_upsample_nearest_exact1d()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1119 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact1d_backward_grad_input&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, Reduction&lt;/td&gt;
 &lt;td&gt;
 An out variant of &lt;code&gt;_upsample_nearest_exact1d_backward()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1120 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact2d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Triton kernel implementation for _upsample_nearest_exact2d.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1121 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact2d_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 A backward case for &lt;code&gt;_upsample_nearest_exact2d()&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1122 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_nearest_exact3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, NeuralNetwork, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Increases the depth, height, and width of a 3D tensor using nearest-neighbor interpolation,
ensuring the output aligns with library-standard algorithms like PIL.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1123 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;upsample_trilinear3d&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Upsamples the input (NCDHW) using trilinear interpolation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1124 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;value_selecting_reduction_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Reduction
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the gradient of a value-selecting reduction (such as &lt;code&gt;max.dim&lt;/code&gt;
or &lt;code&gt;min.dim&lt;/code&gt;) by scattering the upstream gradient to the positions
given by the indices of the selected values in the original input.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1125 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;var&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Calculates the variance over all dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1126 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;var_correction&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 A variant of the &lt;code&gt;var()&lt;/code&gt; operator, with an optional &lt;code&gt;correction&lt;/code&gt; for specifying
difference between the sample size and sample degrees of freedom.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1127 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;var_dim&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Calculates the variance over the dimensions specified by dim.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1128 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;var_mean&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Calculates the variance and mean over the dimensions specified by &lt;code&gt;dim&lt;/code&gt;. &lt;code&gt;dim&lt;/code&gt; can be a single dimension,
list of dimensions, or &lt;code&gt;None&lt;/code&gt; to reduce over all dimensions.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1129 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;vdot&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Computes the dot product of two 1D vectors along a dimension.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1130 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;vector_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 LinearAlg
 
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, Reduction&lt;/td&gt;
 &lt;td&gt;
 Computes a vector norm.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1131 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;view_as_complex&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a view of the real input tensor as a complex tensor (zero-copy view operation).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1132 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;view_copy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Returns a copy of the tensor with the specified shape.
Unlike view(), this always returns a new tensor rather than an alias.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1133 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;vstack&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Stack tensors in sequence vertically (row wise).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1134 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;w8a8_block_fp8_matmul&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;vLLM&lt;/td&gt;
 &lt;td&gt;
 Performs matrix multiplication with block-wise quantization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1135 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;weight_int4pack_mm_with_scales_and_zeros&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Int4 quantized matrix multiplication with separate scales and zeros. Computes
C = matmul(A, W_deq) where W is a packed uint8 int4 weight matrix and A is
the activation matrix, using per-group scale and zero-point quantization.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1136 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;weight_int8pack_mm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 BLAS
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Performs int8 weight-only quantized matrix multiplication with per-channel scales.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1137 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;weight_norm&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;fused&lt;/td&gt;
 &lt;td&gt;
 Reparameterizes a module's weight tensor by decoupling its magnitude (g)
from its direction (v). It is a hook that compute the actual weight before
each forward pass.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1138 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;weight_norm_interface&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, fused&lt;/td&gt;
 &lt;td&gt;
 Apply weight normalization to neural network layers, decoupling the magnitued
of a weight tensor from its direction. It is used to stabilize training, particularly
for models with small batch sizes.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1139 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;weight_norm_interface_backward&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 NeuralNetwork
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;3.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, fused&lt;/td&gt;
 &lt;td&gt;
 Computes the gradients for weight normalization during the backward pass.
It calculates the necessary derivatives for updating both the magnitude (g)
and direction (v) parameters of a weight-normalized layer, based on gradients
received from the previous operation.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1140 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;where_self&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Returns a LongTensor. This operation is identical to &lt;code&gt;torch.nonzero(condition, as_tuple=True)&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1141 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;where_self_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.2&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 This is a variant of &lt;code&gt;where_self()&lt;/code&gt; with an argument &lt;code&gt;out&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1142 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes &lt;code&gt;input * log(other)&lt;/code&gt; element-wise, returning zero where &lt;code&gt;input&lt;/code&gt; is zero (following PyTorch's &lt;code&gt;xlogy&lt;/code&gt; semantics).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1143 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen, pointwise&lt;/td&gt;
 &lt;td&gt;
 Computes x * log(y) element-wise in-place on x.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1144 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;xlogy&lt;/code&gt; that allows the output to be assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1145 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_scalar_tensor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;xlogy&lt;/code&gt; where &lt;code&gt;input&lt;/code&gt; is a scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1146 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_scalar_tensor_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;xlogy&lt;/code&gt; where &lt;code&gt;input&lt;/code&gt; is a scalar and the output is assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1147 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_tensor_scalar&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;xlogy&lt;/code&gt; where &lt;code&gt;other&lt;/code&gt; is a scalar.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1148 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xlogy_tensor_scalar_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Beta&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise&lt;/td&gt;
 &lt;td&gt;
 A variant of &lt;code&gt;xlogy&lt;/code&gt; where &lt;code&gt;other&lt;/code&gt; is a scalar and the output is assigned to an &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1149 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;xor&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Math
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Alpha&lt;/td&gt;
 &lt;td&gt;5.4&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, pointwise, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Computes the bitwise XOR of input tensors or a tensor and a scalar (non-inplace).
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1150 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;zero&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fills tensor with zeros.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1151 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;zero_&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.0&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Fills &lt;code&gt;self&lt;/code&gt; tensor with zeros.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1152 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;zero_out&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;5.3&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, KernelGen&lt;/td&gt;
 &lt;td&gt;
 Fills tensor with zeros but assign the output to the &lt;code&gt;out&lt;/code&gt; tensor.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1153 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;zeros&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten, skip_precision_check&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with the scalar value 0, with the shape defined by
the variable argument &lt;code&gt;size&lt;/code&gt;.
 &lt;/td&gt;


&lt;tr&gt;
 &lt;td&gt;1154 &lt;/td&gt;
 &lt;td&gt;&lt;tt&gt;zeros_like&lt;/tt&gt;&lt;/td&gt;
 &lt;td&gt;
 Tensor
 
 &lt;/td&gt;
 
 
 
 
 &lt;td&gt;Stable&lt;/td&gt;
 &lt;td&gt;2.1&lt;/td&gt;
 
 
 
 &lt;td&gt;aten&lt;/td&gt;
 &lt;td&gt;
 Returns a tensor filled with the scalar value 0, with the same size as &lt;code&gt;input&lt;/code&gt;.
 &lt;/td&gt;

&lt;/tbody&gt;
&lt;/table&gt;</description></item><item><title>Experimental Operators</title><link>https://flagos-ai.github.io/FlagGems/references/experimental/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://flagos-ai.github.io/FlagGems/references/experimental/</guid><description>&lt;!--
 Copyright 2026 FlagOS Contributors

 Licensed under the Apache License, Version 2.0 (the "License");
 you may not use this file except in compliance with the License.
 You may obtain a copy of the License at

 http://www.apache.org/licenses/LICENSE-2.0

 Unless required by applicable law or agreed to in writing, software
 distributed under the License is distributed on an "AS IS" BASIS,
 WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
 See the License for the specific language governing permissions and
 limitations under the License.
 --&gt;
&lt;h1 id="flaggems-experimental-operators"&gt;FlagGems Experimental Operators&lt;a class="anchor" href="#flaggems-experimental-operators"&gt;#&lt;/a&gt;&lt;/h1&gt;
&lt;p&gt;This document lists all experimental operators in FlagGems that have achieved an average speedup of 0.8x or higher compared to PyTorch implementations.&lt;/p&gt;</description></item><item><title>Project Structure</title><link>https://flagos-ai.github.io/FlagGems/references/project_structure/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://flagos-ai.github.io/FlagGems/references/project_structure/</guid><description>&lt;!--
 Copyright 2026 FlagOS Contributors

 Licensed under the Apache License, Version 2.0 (the "License");
 you may not use this file except in compliance with the License.
 You may obtain a copy of the License at

 http://www.apache.org/licenses/LICENSE-2.0

 Unless required by applicable law or agreed to in writing, software
 distributed under the License is distributed on an "AS IS" BASIS,
 WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
 See the License for the specific language governing permissions and
 limitations under the License.
 --&gt;
&lt;h1 id="project-structure"&gt;Project Structure&lt;a class="anchor" href="#project-structure"&gt;#&lt;/a&gt;&lt;/h1&gt;
&lt;pre tabindex="0"&gt;&lt;code class="language-none" data-lang="none"&gt;FlagGems
├── src // python source code
│ └──flag_gems
│ ├──utils // python automatic code generation utilities
│ ├──ops // python single operators
│ ├──fused // python fused operators
│ `──testing // python testing utility
├── tests // python accuracy test files
├── benchmark // python performance test files
├── examples // python model test files
├── cmake // c++ cmake files for C-extension
├── include // c++ headers
├── lib // c++ source code for operator lib
├── ctest // c++ testing files
├── triton_src // triton jit functions src temporary
├── docs // docs for flag_gems
├── LICENSE
├── README.md
├── CONTRIBUTING.md
├── ...&lt;/code&gt;&lt;/pre&gt;</description></item><item><title>Changelog</title><link>https://flagos-ai.github.io/FlagGems/references/changelog/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://flagos-ai.github.io/FlagGems/references/changelog/</guid><description>&lt;!--
 Copyright 2026 FlagOS Contributors

 Licensed under the Apache License, Version 2.0 (the "License");
 you may not use this file except in compliance with the License.
 You may obtain a copy of the License at

 http://www.apache.org/licenses/LICENSE-2.0

 Unless required by applicable law or agreed to in writing, software
 distributed under the License is distributed on an "AS IS" BASIS,
 WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
 See the License for the specific language governing permissions and
 limitations under the License.
 --&gt;
&lt;h1 id="change-history"&gt;Change History&lt;a class="anchor" href="#change-history"&gt;#&lt;/a&gt;&lt;/h1&gt;
&lt;h2 id="v5-0"&gt;v5.0&lt;a class="anchor" href="#v5-0"&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;Release date&lt;/strong&gt;: TBD&lt;/p&gt;</description></item></channel></rss>