Search

Topics

Papers 6,751–6,780 of 6,861

CardsList
  1. AIR: Analytic Imbalance Rectifier for Continual Learning

    Aug 19, 2024Di Fang, Yinan Zhu, Zhiping Lin +3Extreme Class ImbalanceLearning-Augmented Algorithms

  2. ProSpec RL: Plan Ahead, then Execute

    Jul 31, 2024Liangliang Liu, Yi Guan, BoRan Wang +5Model-Free Reinforcement LearningDeep Reinforcement Learning

  3. Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms

    Jul 21, 2024Sheila Schoepp, Mehran Taghian, Shotaro Miwa +3Fault ToleranceAgent Framework

  4. Open-Vocabulary Object-Goal Navigation by Generalizing Semantic Mapping with Dense CLIP

    Jul 12, 2024Meng Wei, Chenyang Wan, Tai Wang +6Vision-Language NavigationOpen-Vocabulary

  5. Lifelong Learning of Video Diffusion Models From a Single Video Stream

    Jun 7, 2024Jason Yoo, Yingchen He, Saeid Naderiparizi +4

  6. Federated Class-Incremental Learning with Hierarchical Generative Prototypes

    Jun 4, 2024Riccardo Salami, Pietro Buzzega, Matteo Mosconi +2Domain Incremental LearningLearnable Prototypes

  7. Active Exploration via Autoregressive Generation of Missing Data

    May 29, 2024Tiffany Tianhui Cai, Hongseok Namkoong, Daniel Russo +1Efficient ExplorationUncertainty-Aware Inference

  8. Invariant Graph Representations for Continuous-Time Dynamic Graphs Under Distribution Shifts

    May 29, 2024Lanting Fang, Yulian Yang, Yawei Zhang +3Graph Representation LearningDistribution Shifts

  9. On the Approximation and Convergence of Distributional Policy Gradient Algorithms for Risk-Sensitive Reinforcement Learning

    May 23, 2024Xian Yu, Minheng Xiao, Lei YingConditional-Value-At-Risk

  10. Realistic Continual Learning Approach using Pre-trained Models

    Apr 11, 2024Nadia Nasri, Carlos Gutiérrez-Álvarez, Sergio Lafuente-Arroyo +2Efficient Continual LearningContinual Learning Methods

  11. A Probabilistic Approach for Model Alignment with Human Comparisons

    Mar 16, 2024Junyu Cao, Mohsen BayatiReinforcement Learning From Human FeedbackModel Evaluation

  12. FedReview: Review and Dispose Poisoned Updates without Validation Datasets or Historic Knowledge

    Feb 26, 2024Tianhang Zheng, Yanlu Li, Bohan Deng +1Federated LearningData Poisoning

  13. HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA

    Feb 1, 2024Xinyue Chen, Pengyu Gao, Jiangjiang Song +1Multi-Hop Question Answering BenchmarksMultimodal Documents

  14. TERC: A Transfer Entropy Redundancy Criterion for State Variable Selection in Reinforcement Learning

    Jan 21, 2024Charles Westphal, Stephen Hailes, Mirco MusolesiEntropy Regularized Reinforcement LearningProximal Policy Optimization

  15. Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation

    Dec 17, 2023Xiangtong Yao, Hongkuan Zhou, Oier Mees +12Generalizable Robotic ManipulationsLanguage-Conditioning Space Policy

  16. Uncertainty Quantification in Machine Learning for Biosignal Applications -- A Review

    Nov 15, 2023Ivo Pascal de Jong, Andreea Ioana Sburlea, Matias Valdenegro-ToroMultimodal Physiological SignalsReliable Uncertainty Quantification

  17. DIRA-SS:Dynamic Domain Incremental Regularised Adaptation -- Self-Supervised

    Nov 13, 2023Abanoub Ghobrial, Kerstin EderDomain AdaptationSelf-Supervised

  18. Causal Discovery in Mixtures of Populations

    Nov 13, 2023Bijan Mazaheri, Spencer Gordon, Yuval Rabani +1Causal Foundation ModelsStructural Equation Models

  19. Data Market Design through Deep Learning

    Oct 31, 2023Sai Srivatsa Ravindranath, Yanchen Jiang, David C. ParkesBayesian Experimental DesignFirst-Price Auctions

  20. UWA360CAM: A 360∘^{\circ} 24/7 Real-Time Streaming Camera System for Underwater Applications

    Sep 22, 2023Quan-Dung Pham, Yipeng Zhu, Tan-Sang Ha +3Underwater Image EnhancementOnboard Robot Cameras

  21. ETHER: Aligning Emergent Communication for Hindsight Experience Replay

    Jul 28, 2023Kevin Yandoka Denamganaï, Daniel Hernandez, Ozan Vardal +2Goal-Conditioned Reinforcement LearningReinforcement Learning From Human Feedback

  22. Calibrated Stackelberg Games: Learning Optimal Commitments Against Calibrated Agents

    Jun 5, 2023Nika Haghtalab, Chara Podimata, Kunhe YangMulticalibration and Calibration

  23. RoMu4o: A Robotic Manipulation Unit For Orchard Operations Automating Proximal Hyperspectral Leaf Sensing

    Date pendingMehrad Mortazavi, David J. Cappelleri, Reza EhsaniAgricultural RobotsRobotic Perception

  24. Safe Learning Under Irreversible Dynamics via Asking for Help

    Date pendingBenjamin Plaut, Juan Liévano-Karim, Hanlin Zhu +1Markov Decision ProcessesNear-Optimal Regret Guarantees

  25. FLOAT Drone: A Fully-actuated Coaxial Aerial Robot for Close-Proximity Operations

    Date pendingJunxiao Lin, Shuhang Ji, Yuze Wu +3Aerial RobotsDrone

  26. Discovering Temporal Structure: An Overview of Hierarchical Reinforcement Learning

    Date pendingMartin Klissarov, Akhil Bagaria, Ziyan Luo +3Hierarchical Reinforcement LearningHierarchical