|
scholar.google.com
|
My Google Scholar Profile
|
|
arxiv.org
|
Unlabeled Data Can Provably Enhance In-Context Learning of Transformers
|
|
arxiv.org
|
Greedy Sampling Is Provably Efficient For RLHF
|
|
arxiv.org
|
Chain-of-Thought Enhanced Shallow Transformers for Wireless Symbol Detection
|
|
arxiv.org
|
Augmenting Online RL with Offline Data is All You Need:
A Unified Hybrid RL Algorithm Design and Analysis
|
|
arxiv.org
|
How Transformers Learn Regular Language Recognition: A Theoretical Study on Training Dynamics and Implicit Bias
|
|
arxiv.org
|
On the Training Convergence of Transformers for In-Context Classification
|
|
arxiv.org
|
Decision Feedback In-Context Symbol Detection over Block-Fading Channels
|
|
arxiv.org
|
A Shared Low-Rank Adaptation Approach to Personalized RLHF
|
|
arxiv.org
|
Data-adaptive Differentially Private Prompt Synthesis for In-Context Learning
|
|
arxiv.org
|
On the Learn-to-Optimize Capabilities of Transformers in In-Context Sparse Recovery
|
|
arxiv.org
|
Federated Online Prediction from Experts with Differential Privacy: Separations and Regret Speed-ups
|
|
arxiv.org
|
Non-asymptotic Convergence of Training Transformers for Next-token Prediction
|
|
arxiv.org
|
Efficient Prompt Optimization Through the Lens of Best Arm Identification
|
|
arxiv.org
|
Transformers as Game Players: Provable In-context Game-playing Capabilities of Pre-trained Models
|
|
arxiv.org
|
Average Reward Reinforcement Learning for Wireless Radio Resource Management
|
|
arxiv.org
|
Federated Representation Learning in the Under-Parameterized Regime
|
|
arxiv.org
|
Improving Sample Efficiency of Model-Free Algorithms for Zero-Sum Markov Games
|
|
ieeexplore.ieee.org
|
Towards General Function Approximation in Nonstationary Reinforcement Learning
|
|
ieeexplore.ieee.org
|
Advancing RAN Slicing with Offline Reinforcement Learning
|
|
arxiv.org
|
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost
|
|
arxiv.org
|
Provably Efficient UCB-type Algorithms For Learning Predictive State Representations
|
|
arxiv.org
|
Provable Benefits of Multi-task RL under Non-Markovian Decision Making Processes
|
|
arxiv.org
|
Provably Efficient Algorithm for Nonstationary Low-Rank MDPs
|
|
ieeexplore.ieee.org
|
Offline Reinforcement Learning for Wireless Network Optimization with Mixture Datasets
|
|
ieeexplore.ieee.org
|
Joint User Association and Wireless Scheduling with Smaller Time-Scale Rate Adaptation
|
|
arxiv.org
|
Near-optimal Conservative Exploration in Reinforcement Learning under Episode-wise Constraints
|
|
arxiv.org
|
Federated Linear Contextual Bandits with User-level Differential Privacy
|
|
arxiv.org
|
Non-stationary Reinforcement Learning under General Function Approximation
|
|
arxiv.org
|
Provably Efficient Offline Reinforcement Learning with Perturbed Data Sources
|
|
ieeexplore.ieee.org
|
Exploiting Feature Heterogeneity for Improved Generalization in Federated Multi-task Learning
|
|
arxiv.org
|
Reward Teaching for Federated Multi-Armed Bandits
|
|
arxiv.org
|
Safe Exploration Incurs Nearly No Additional Sample Complexity for Reward-free RL
|
|
openreview.net
|
Improved Sample Complexity for Reward-free Reinforcement Learning under Low-rank MDPs
|
|
arxiv.org
|
FLORAS: Differentially Private Wireless Federated Learning Using Orthogonal Sequences
|
|
arxiv.org
|
Provable Benefit of Multitask Representation Learning in Reinforcement Learning
|
|
arxiv.org
|
On Federated Learning with Energy Harvesting Clients
|
|
arxiv.org
|
Random Orthogonalization for Federated Learning in Massive MIMO Systems
|
|
arxiv.org
|
Federated Linear Contextual Bandits
|
|
proceedings.neurips.cc
|
Heterogeneous Multi-player Multi-armed Bandits: Closing the Gap and Generalization
|
|
ieeexplore.ieee.org
|
Adaptive Surveillance Testing for Efficient Infection Rate Estimation
|
|
spiedigitallibrary.org
|
Pooled Testing with Compressive Sensing
|
|
arxiv.org
|
Federated Multi-armed Bandits with Personalization
|
|
github.com
|
Code
|
|
arxiv.org
|
Stochastic Linear Contextual Bandits with Diverse Contexts
|
|
arxiv.org
|
Decentralized Multi-player Multi-armed Bandits with No Collision Information
|
|
arxiv.org
|
Timely Synchronization with Sporadic Status Changes
|
|
arxiv.org
|
Information Freshness for Timely Detection of Status Changes
|
|
arxiv.org
|
Adaptive Coding for Information Freshness in a Two-user Broadcast Erasure Channel
|
|
arxiv.org
|
Online Learning with Diverse User Preferences
|
|
arxiv.org
|
Using Erasure Feedback for Online Timely Updating with an Energy Harvesting Sensor
|
|
arxiv.org
|
Age-Optimal Transmission of Rateless Codes in an Erasure Channel
|
|
arxiv.org
|
Online Timely Status Updates with Erasures for Energy Harvesting Sensors
|
|
arxiv.org
|
Cost-aware Cascading Bandits
|
|
arxiv.org
|
To Skip or to Switch? Minimizing Age of Information under Link Capacity Constraint
|
|
arxiv.org
|
Non-Asymptotic Achievable Rates for Gaussian Energy-Harvesting Channels: Best-Effort and Save-and-Transmit
|
|
arxiv.org
|
Sending Information Through Status Updates
|
|
arxiv.org
|
Age-Minimal Online Policies for Energy Harvesting Sensors with Random Battery Recharges
|
|
arxiv.org
|
Optimal Status Updating for an Energy Harvesting Sensor with a Noisy Channel
|
|
arxiv.org
|
Age-Minimal Online Policies for Energy Harvesting Sensors with Incremental Battery Recharges
|
|
ieeexplore.ieee.org
|
Graph-based Multiple-Line Outage Identification in Power Transmission Systems
|
|
ieeexplore.ieee.org
|
Optimum PMU Placement for Power System State Estimation
|
|
ieeexplore.ieee.org
|
Optimizing Age-of-Information and Energy Efficiency Tradeoff for Mobile Pushing Notifications
|
|
ieeexplore.ieee.org
|
Optimal Transmission for Energy Harvesting Nodes under Battery Size and Usage Constraints
|
|
ieeexplore.ieee.org
|
Optimal Status Updating to Minimize Age of Information with an Energy Harvesting Source
|
|
ieeexplore.ieee.org
|
Distributed Estimation of a Spatially Correlated Random Field in Decentralized Sensor Networks
|
|
ieeexplore.ieee.org
|
Optimum Poisson Sensing with Energy Harvesting Power Sources
|
|
ieeexplore.ieee.org
|
Optimal Energy Management for Energy Harvesting Transmitters under Battery Usage Constraint
|
|
ieeexplore.ieee.org
|
A Non-Asymptotic Achievable Rate for the AWGN Energy-Harvesting Channel using Save-and-Transmit
|
|
ieeexplore.ieee.org
|
Optimal Energy Efficient Level Set Estimation of Spatially-Temporally Correlated Random Fields
|
|
ieeexplore.ieee.org
|
Optimal Level Set Estimation of a Time-Varying Random Field under a Power Constraint
|
|
ieeexplore.ieee.org
|
Online Throughput Maximization in an Energy-Harvesting Multiple Access Channel with Fading
|
|
ieeexplore.ieee.org
|
Optimal Sensing of a Time-Varying Random Event with Energy Harvesting Power Sources
|
|
ieeexplore.ieee.org
|
Adaptive Sensing Scheduling for Energy Harvesting Sensors with Finite Battery
|
|
ieeexplore.ieee.org
|
The Effects of Flooding Attacks on Time-Critical Communications in the Smart Grid
|
|
jemdoc.jaboc.net
|
jemdoc
|