quant-phFeb 6, 2026

Quantum Attention by Overlap Interference: Predicting Classical and Many-Body Quantum Sequences

Authors: Alessio Pecilli, Matteo Rosati

Organizations: Dipartimento di Ingegneria Civile, Informatica e delle Tecnologie Aeronautiche, Universit`a degli Studi Roma Tre, Via della Vasca Navale 79, 00146 Rome, Italy

Abstract

We propose a variational quantum implementation of self-attention (QSA)-the core operation in transformers and large language models-which predicts future elements of a sequence by forming overlap-weighted combinations of past data. At variance with previous approaches, our QSA realizes the required nonlinearity through interference of state overlaps and a degree-kk polynomial kernel, and estimates a loss based on Rényi-1/21/2 entropic functionals via two observables' expectation values, avoiding the decoding of amplitude-encoded predictions into classical probabilities. QSA also accommodates a constrained, trainable data-embedding tying state overlaps to data-level similarities. Its dominant end-to-end training complexity scales as O(μ−1k2Td)O\left(μ^{-1}k^2Td\right), versus O(Tdk+1)O\left(T d^{k+1}\right) of the fairest classical comparison, with μμ a training signal; we show numerically that this allows a complexity advantage in the regime where sequence length TT dominates the embedding size dd. In simulations, our QSA-based quantum transformer learns sequence prediction on classical data and on many-body transverse-field Ising trajectories-establishing trainable attention as a practical primitive for quantum dynamical modeling.

Figures & tables

Explore similar work

CardsList
  1. Quantum Adaptive Self-Attention for Quantum Transformer Models

    Apr 5, 2025Chi-Sheng Chen, En-Jui KuoQuantum Machine LearningQubit

  2. QLAM: A Quantum Long-Attention Memory Approach to Long-Sequence Token Modeling

    May 13, 2026Hoang-Quan Nguyen, Sankalp Pandey, Khoa LuuHybrid Quantum-Classical PipelineSequence Modeling

  3. Variational Quantum Transformer Architecture for Synthetic Language Generation

    Sep 16, 2026Julian Hager, Michael Kölle, Gerhard Stenzel +3Transformer ArchitecturesAutoregressive Token Prediction