|
scholar.google.com
|
Google Scholar Profile
|
|
arxiv.org
|
Is One Score Enough? Rethinking the Evaluation of Sequentially Evolving LLM Memory
|
|
arxiv.org
|
The Past Is Prologue: A Plug-in Controller for Selective Updates in Sequentially Evolving LLM Memory
|
|
arxiv.org
|
On the convergence analysis of MUON
|
|
arxiv.org
|
<img class="eq" src="eqs/3080454559640615423-130.png" alt="f" style="vertical-align: -4px">-Divergence Regularized RLHF: Two Tales of Sampling and Unified Analyses
|
|
arxiv.org
|
HeteroFedSyn: Differentially Private Tabular Data Synthesis for Heterogeneous Federated Settings
|
|
arxiv.org
|
MLorc: Momentum Low-rank Compression for Large Language Model Adaptation
|
|
openreview.net
|
Efficient Multi-objective Prompt Optimization via Pure-exploration Bandits
|
|
arxiv.org
|
Greedy Sampling Is Provably Efficient For RLHF
|
|
arxiv.org
|
A Single-Loop First-Order Algorithm for Linearly Constrained Bilevel Optimization
|
|
arxiv.org
|
From Cross-Task Examples to In-Task Prompts: A Graph-Based Pseudo-Labeling Framework for In-context Learning
|
|
aclanthology.org
|
Separate the Wheat from the Chaff: Winnowing Down Divergent Views in Retrieval Augmented Generation
|
|
dl.acm.org
|
Graph Prompting for Graph Learning Models: Recent Advances and Future Directions
|
|
arxiv.org
|
Augmenting Online RL with Offline Data is All You Need: A Unified Hybrid RL Algorithm Design and Analysis
|
|
arxiv.org
|
MAPLE: Many-Shot Adaptive Pseudo-Labeling In-Context Learning
|
|
arxiv.org
|
On the Training Convergence of Transformers for In-Context Classification of Gaussian Mixtures
|
|
arxiv.org
|
Cost-Aware Optimal Pairwise Pure Exploration
|
|
arxiv.org
|
A Shared Low-Rank Adaptation Approach to Personalized RLHF
|
|
arxiv.org
|
Data-adaptive Differentially Private Prompt Synthesis for In-Context Learning
|
|
arxiv.org
|
On the Learn-to-Optimize Capabilities of Transformers in In-Context Sparse Recovery
|
|
arxiv.org
|
FedHERO: A Federated Learning Approach for Node Classification Task on Heterophilic Graphs
|
|
arxiv.org
|
Transformers as Game Players: Provable In-context Game-playing Capabilities of Pre-trained Models
|
|
arxiv.org
|
Efficient Prompt Optimization Through the Lens of Best Arm Identification
|
|
openreview.net
|
Mixture of Demonstrations for In-Context Learning
|
|
openreview.net
|
Harnessing the Power of Federated Learning in Federated Contextual Bandits
|
|
arxiv.org
|
FastGAS: Fast Graph-based Annotation Selection for In-Context Learning
|
|
openreview.net
|
Verification of Machine Unlearning is Fragile
|
|
arxiv.org
|
Federated Representation Learning in the Under-Parameterized Regime
|
|
proceedings.mlr.press
|
Stochastic Smoothed Gradient Descent Ascent for Federated Minimax Optimization
|
|
arxiv.org
|
Federated Linear Bandits with Finite Adversarial Actions
|
|
proceedings.mlr.press
|
Provably Efficient Offline Reinforcement Learning with Perturbed Data Sources
|
|
proceedings.mlr.press
|
Near-optimal Conservative Exploration in Reinforcement Learning under Episode-wise Constraints
|
|
openreview.net
|
Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov Game
|
|
proceedings.mlr.press
|
A Self-Play Posterior Sampling Algorithm for Zero-Sum Markov Games
|
|
arxiv.org
|
(Almost) Free Incentivized Exploration from Decentralized Learning Agents
|
|
arxiv.org
|
Heterogeneous Multi-player Multi-armed Bandits: Closing the Gap and Generalization
|
|
arxiv.org
|
Federated Linear Contextual Bandits
|
|
proceedings.mlr.press
|
SDF-Bayes: Cautious Optimism in Safe Dose-Finding Clinical Trials with Drug Combinations and Heterogeneous Patient Groups
|
|
proceedings.mlr.press
|
Federated Multi-armed Bandits with Personalization
|
|
github.com
|
[Code]
|
|
arxiv.org
|
Federated Multi-Armed Bandits
|
|
github.com
|
[Code]
|
|
arxiv.org
|
Robust Recursive Partitioning for Heterogeneous Treatment Effects with Uncertainty Quantification
|
|
proceedings.mlr.press
|
Contextual Constrained Learning for Dose-Finding Clinical Trials
|
|
proceedings.mlr.press
|
Decentralized Multi-player Multi-armed Bandits with No Collision Information
|
|
proceedings.mlr.press
|
Stochastic Linear Contextual Bandits with Diverse Contexts
|
|
proceedings.mlr.press
|
Learning for Dose Allocation in Adaptive Clinical Trials with Safety Constraints
|
|
ijcai.org
|
Cost-aware Cascading Bandits
|
|
proceedings.mlr.press
|
Regional Multi-Armed Bandits
|
|
ieeexplore.ieee.org
|
Robust Pathloss Radio Map Prediction via Physics-Informed Transformer
|
|
arxiv.org
|
Chain-of-Thought Enhanced Shallow Transformers for Wireless Symbol Detection
|
|
arxiv.org
|
Decision Feedback In-Context Symbol Detection over Block-Fading Channels
|
|
ieeexplore.ieee.org
|
Multi-Agent Decision Transformer for Power Control in Wireless Networks
|
|
arxiv.org
|
Average Reward Reinforcement Learning for Wireless Radio Resource Management
|
|
arxiv.org
|
Advancing RAN Slicing with Offline Reinforcement Learning
|
|
arxiv.org
|
An Autoencoder-Based Constellation Design for AirComp in Wireless Federated Learning
|
|
ieeexplore.ieee.org
|
MIMO Beamforming and Signal Modulation Design for Federated Learning Optimization
|
|
arxiv.org
|
Offline Reinforcement Learning for Wireless Network Optimization with Mixture Datasets
|
|
arxiv.org
|
Communication and Storage Efficient Federated Split Learning
|
|
arxiv.org
|
FLORAS: Differentially Private Wireless Federated Learning Using Orthogonal Sequences
|
|
ieeexplore.ieee.org
|
Federated Learning via Indirect Server-Client Communications
|
|
ieeexplore.ieee.org
|
Multi-Agent Reinforcement Learning for Wireless User Scheduling: Performance, Scalablility, and Generalization
|
|
ieeexplore.ieee.org
|
Optimizing Federated Averaging Over Fading Channels
|
|
arxiv.org
|
On Federated Learning with Energy Harvesting Clients
|
|
arxiv.org
|
Random Orthogonalization for Federated Learning in Massive MIMO Systems
|
|
ieeexplore.ieee.org
|
On the Convergence of Hybrid Federated Learning with Server-Clients Collaborative Training
|
|
ieeexplore.ieee.org
|
A Machine Learning Approach for Rate Prediction in Multicast File-stream Distribution Networks
|
|
ieeexplore.ieee.org
|
Federated Learning over Noisy Channels
|
|
ieeexplore.ieee.org
|
Design and Analysis of Uplink and Downlink Communications for Federated Learning
|
|
ieeexplore.ieee.org
|
Federated Learning with Heterogeneous Quantization
|
|
ieeexplore.ieee.org
|
MIMO Receive Antenna Selection via Deep Learning and Greedy Adaptation
|
|
ieeexplore.ieee.org
|
Deep Reinforcement Learning based Wireless Network Optimization: A Comparative Study
|
|
ieeexplore.ieee.org
|
A Cascading Bandit Approach to Efficient Mobility Management in Ultra-Dense Networks
|
|
ieeexplore.ieee.org
|
Power Control for Interference Management via Ensembling Deep Neural Networks
|
|
ieeexplore.ieee.org
|
Opportunistic Spectrum Access via Good Arm Identification
|
|
ieeexplore.ieee.org
|
A Machine Learning Approach to User Association in Enterprise Small Cell Networks
|
|
ieeexplore.ieee.org
|
Small Cell Power Assignment with Unimodal Continuum-armed Bandit Learning
|
|
ieeexplore.ieee.org
|
A Non-Stationary Online Learning Approach to Mobility Management
|
|
ieeexplore.ieee.org
|
Exploiting Noise Correlation for Channel Decoding with Convolutional Neural Networks
|
|
ieeexplore.ieee.org
|
On Energy Efficient Uplink Multi-User MIMO with Shared LNA Control
|
|
ieeexplore.ieee.org
|
Thresholded Wirtinger Flow for Fast Millimeter Wave Beam Alignment
|
|
ieeexplore.ieee.org
|
On Top-k Selection from m-wise Partial Rankings via Borda Counting
|
|
ieeexplore.ieee.org
|
Privacy-Aware Edge Computing Based on Adaptive DNN Partitioning
|
|
ieeexplore.ieee.org
|
New Results On Multilevel Diversity Coding with Secure Regeneration
|
|
ieeexplore.ieee.org
|
Designing Interdependent Networks Against Cascading Failures with Node Protections
|
|
ieeexplore.ieee.org
|
Online Geographical Load Balancing for Energy-Harvesting Mobile Edge Computing
|
|
ieeexplore.ieee.org
|
How to Interconnect for Massive MIMO Self-Calibration?
|
|
ieeexplore.ieee.org
|
Adaptive Resource Allocation for LTE/WiFi Coexistence in the Unlicensed Spectrum
|
|
ieeexplore.ieee.org
|
Aligning DL Paths for Scalable CSI Feedback in FDD Massive MIMO
|
|
ieeexplore.ieee.org
|
DL CSI Acquisition and Feedback in FDD Massive MIMO via Path Aligning
|
|
ieeexplore.ieee.org
|
On the Tradeoff Region of Secure Exact-Repair Regenerating Codes
|
|
ieeexplore.ieee.org
|
On Scheduling Policies in the Presence of Heavy-Tailed Interference
|
|
jemdoc.jaboc.net
|
jemdoc
|