|
arxiv.org
|
AgentCAT: An LLM Agent for Extracting and Analyzing Catalytic Reaction Data from Chemical Engineering Literature.
|
|
arxiv.org
|
Model Specific Task Similarity for Vision Language Model Selection via Layer Conductance.
|
|
arxiv.org
|
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective.
|
|
arxiv.org
|
Rethinking Reinforcement Fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective.
|
|
arxiv.org
|
LLM Cache Bandit Revisited: Addressing Query Heterogeneity for Cost-Effective LLM Inference.
|
|
arxiv.org
|
Advancing and Benchmarking Personalized Tool Invocation for LLMs.
|
|
dl.acm.org
|
M2-MFP: A Multi-Scale and Multi-Level Memory Failure Prediction Framework for ReliableCloud Infrastructure
|
|
aclanthology.org
|
Exploring the Choice Behavior of Large Language Models
|
|
dl.acm.org
|
Conflict-Buffering Optimization by Symmetry Teleportation for Deep Long-Tailed Recognition
|
|
openreview.net
|
Multi-play Multi-armed Bandits with Shareable Arm Capacities Revisited: Settling Scarce Capacity
|
|
dl.acm.org
|
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
|
|
ijcai.org
|
Adaptive Order Q-learning
|
|
aclanthology.org
|
Understanding and Patching Compositional Reasoning in LLMs
|
|
ieeexplore.ieee.org
|
Investigating User Popularity Preference Differences for Long-term Fairness on Interactive Recommendation: A Hierarchical Reinforcement Learning Approach
|
|
link.springer.com
|
False Negative Sample Aware Negative Sampling for Recommendation
|
|
ieeexplore.ieee.org
|
A Thompson Sampling Approach to User-Centric Selection Problems
|
|
link.springer.com
|
Contextual Bandit with Herding Effects: Algorithms and Recommendation Applications
|
|
link.springer.com
|
Achieving Group Fairness under Erroneous Pseudo-Labels of Sensitive Attributes
|
|
proceedings.neurips.cc
|
Uncertainty-Aware Instance Reweighting for Off-Policy Learning
|
|
ieeexplore.ieee.org
|
Towards Long-term Fairness in Interactive Recommendation: A Maximum Entropy Reinforcement Learning Approach
|
|
ieeexplore.ieee.org
|
CGCCMR: An Enhanced Multi-gate Model for Cross-Market Recommendation
|
|
dl.acm.org
|
A Multi-player MAB Approach for Distributed Selection Problems
|
|
link.springer.com
|
A Thompson Sampling Approach to Unifying Causal Inference and Bandit Learning
|
|
dl.acm.org
|
Interactive Log Parsing via Light-weight Feedback
|
|
link.springer.com
|
A Predictive Coding Approach to Multivariate Time Series Anomaly Detection
|
|
ieeexplore.ieee.org
|
Variance-Adaptive Algorithm for Probabilistic Maximum Coverage Bandits with General Feedback.
|
|
computer.org
|
Reposting Service in Online Social Networks: Modeling and Online Incentive Protocols.
|
|
proceedings.mlr.press
|
Multiple-Play Stochastic Bandits with Shareable Finite-Capacity Arms.
|
|
ijcai.org
|
Multi-Player Multi-Armed Bandits with Finite Shareable Resources Arms: Learning Algorithms & Applications.
|
|
ojs.aaai.org
|
An Online Learning Approach to Sequential User-centric Selection Problems.
|
|
ieeexplore.ieee.org
|
A Robust Algorithm to Unifying Offline Causal Inference and Online Multi-armed Bandit Learning.
|
|
dl.acm.org
|
Quantifying Assimilate-Contrast Effects in Online Rating Systems: Modeling, Analysis and Application.
|
|
ojs.aaai.org
|
Robust Contextual Bandits via Bootstrapping.
|
|
dl.acm.org
|
Unifying Offline Causal Inference and Online Bandit Learning for Data Driven Decision.
|
|
ieeexplore.ieee.org
|
A Bootstrapping Approach to Optimize Random Walk Based Statistical Estimation over Graphs.
|
|
dl.acm.org
|
Pricing Social Visibility Service in Online Social Networks: Modeling and Algorithms.
|
|
ieeexplore.ieee.org
|
Social Visibility Optimization in OSNs with Anonymity Guarantees: Modeling, Algorithms and Applications.
|
|
ieeexplore.ieee.org
|
Heterogeneous Information Assisted Bandit Learning: Theory and Application.
|
|
ieeexplore.ieee.org
|
``Optimizing Mixture Importance Sampling Via Online Learning: Algorithms and Applications. ''
|
|
usenix.org
|
``GraphWalker: An I/O-Efficient and Resource-Friendly Graph Analytic System for Fast and Scalable Random Walks. ''
|
|
dl.acm.org
|
``Conversational Contextual Bandits: Algorithm and Application.''
|
|
ieeexplore.ieee.org
|
``Robust Product Rating Rules Against Herding Effects: Theory and Applications.''
|
|
ieeexplore.ieee.org
|
``To Be or Not To Be: Analyzing & Modeling Social Recommendation in Online Social Networks.''
|
|
ieeexplore.ieee.org
|
``Walking with Perception: Efficient Random Walk Sampling via Common Neighbor Awareness.''
|
|
wvvw.aaai.org
|
``Understanding Persuasion Cascades in Online Product Rating Systems. ''
|
|
wvvw.aaai.org
|
``Optimizing Discount & Reputation Trade-offs in E-commerce Systems:
Characterization and Online Learning. ''
|
|
ijcai.org
|
``Modeling the AssimilationContrast
Effects in Online Product Rating Systems: Debiasing and Recommendations. ''
|
|
ieeexplore.ieee.org
|
``Sybil Detection in Social-Activity Networks:
Modeling, Algorithms and Evaluations. ''
|
|
ieeexplore.ieee.org
|
``Quantifying Deployability & Evolvability of Future Internet Architectures via Economic Models. ''
|
|
sigmetrics.org
|
``A Markov Decision Process Approach to Analyze Discount
& Reputation Trade-offs in E-commerce Systems. ''
|
|
ieeexplore.ieee.org
|
Mining Customer Valuations to Optimize Bundling Strategy.
|
|
link.springer.com
|
``Measuring and Maximizing Influence via Random Walk in Social Activity Networks.''
|
|
dl.acm.org
|
``Generalization of Information Spreading Forensics via Sequential Dependent Snapshots.''
|
|
dl.acm.org
|
``Trading Discount for Reputation? On the Design and Analysis
of E-Commerce Discount Mechanisms..''
|
|
ieeexplore.ieee.org
|
``A Data Driven Approach to Uncover Deficiencies in Online Reputation Systems.''
|
|
sciencedirect.com
|
``Modeling eBay-Like Reputation Systems: Analysis, Characterization
and Insurance Mechanism Design.''
|
|
ieeexplore.ieee.org
|
``Incentive and Reputation Mechanisms for Online Crowdsourcing Systems.''
|
|
ieeexplore.ieee.org
|
``A Mechanism Approach to Reduce the Ramp Up Time in eBay like
Reputation Mechanisms.''
|
|
ieeexplore.ieee.org
|
``Mathematical Modeling of Crowdsourcing Systems:
Incentive Mechanism and Rating System Design.''
|
|
ieeexplore.ieee.org
|
``Incentive Mechanism and Protocol Design for Crowdsourcing Systems.''
|
|
dl.acm.org
|
``Modeling crowdsourcing systems: design and analysis of incentive
mechanism and rating system.''
|
|
dl.acm.org
|
``A Provable Algorithmic Approach to Product Selection
Problems for Market Entry and Sustainability.''
|
|
dl.acm.org
|
`` Cross-Domain Semantic Transfer for Domain Generalization.''
|
|
ieeexplore.ieee.org
|
`` Variance-Aware Bandit Framework for Dynamic Probabilistic Maximum Coverage Problem with Triggered or Self-Reliant Arms.''
|
|
link.springer.com
|
`` Invariant Representation Learning via Decoupling Style and Spurious Features.''
|
|
dl.acm.org
|
`` Online Incentive Protocol Design for Reposting Service in Online Social Networks.''
|
|
dl.acm.org
|
``A Meta-learning Approach to Mitigating the Estimation Bias of Q-learning.''
|
|
link.springer.com
|
``Adaptive Moving Average Q-learning.''
|
|
dl.acm.org
|
``Relieving Popularity Bias in Interactive Recommendation: A Diversity-Novelty-Aware Reinforcement Learning Approach.''
|
|
ieeexplore.ieee.org
|
``Probabilistic Modeling of Assimilate-ContrastEffects in Online Rating Systems.''
|
|
sciencedirect.com
|
``Asynchronous SGD with Stale Gradient Dynamic Adjustment for Deep Learning Training.''
|
|
ieeexplore.ieee.org
|
``Maximum Entropy Policy for Long-term Fairness in Interactive Recommender Systems.''
|
|
ieeexplore.ieee.org
|
``Reinforcement Learning with Adaptive Policy Gradient Transfer Across Heterogeneous Problems.''
|
|
sciencedirect.com
|
``Robust and Efficient Algorithms for Conversational Contextual Bandit.''
|
|
sciencedirect.com
|
``Q-learning with Heterogeneous Update Strategy.''
|
|
ieeexplore.ieee.org
|
``Analyzing Queueing Problems via Bandits with Linear Reward & Nonlinear Workload Fairness.''
|
|
ieeexplore.ieee.org
|
``Optimizing Random Walk Based Statistical Estimation over Graphs via Bootstrapping.''
|
|
ieeexplore.ieee.org
|
``Common Neighbors Matter: Fast Random Walk Sampling with Common Neighbor Awareness.''
|
|
ieeexplore.ieee.org
|
``Cooperation Preference Aware Shapley Value: Modeling, Algorithms and Applications.''
|
|
ieeexplore.ieee.org
|
``A Multiplier Bootstrap Approach to Designing Robust Algorithms for Contextual Bandits.''
|
|
ieeexplore.ieee.org
|
``Generalized Contextual Bandits With Latent Features: Algorithms and Applications.''
|
|
sciencedirect.com
|
``Efficient Algorithms for Multi-armed Bandits with Additional Feedbacks: Modeling and Algorithms.''
|
|
ieeexplore.ieee.org
|
``Pricing Social Visibility Service in Online Social Networks: Modeling and Algorithms.''
|
|
ieeexplore.ieee.org
|
``Enhancing Sybil Detection via Social-Activity Networks: A Random Walk Approach.''
|
|
sciencedirect.com
|
``Optimizing Recommendations under Abandonment Risks: Models and Algorithms.''
|
|
ieeexplore.ieee.org
|
``Online Zero-Cost Learning: Optimizing Large Scale Network Rare Threats Simulation.''
|
|
ieeexplore.ieee.org
|
``Quantifying Worker Reliability for Crowdsensing Applications: Robust Feedback Rating & Convergence.''
|
|
ieeexplore.ieee.org
|
``A Reinforcement Learning Approach to Price Cloud Resources with Provable Convergence Guarantees.''
|
|
dl.acm.org
|
``Towards Fast and Scalable Random Walks over Disk-Resident Graphs via Efficient I/O Management.''
|
|
dl.acm.org
|
``Taxi-Passenger's Destination Prediction via GPS Embedding and Attention-Based BiLSTM Model.''
|
|
ieeexplore.ieee.org
|
``Optimizing Social Visibility in OSNs with Anonymity Guarantees: Efficient Algorithms and Applications.''
|
|
dl.acm.org
|
``Improving Bandit Learning via Heterogeneous Information Networks: Algorithms and Applications.''
|
|
ieeexplore.ieee.org
|
``Rewarding Social Recommendation in OSNs: Empirical Evidences, Modeling and Optimizations.''
|
|
link.springer.com
|
``Understanding and visualizing passengers' travel behaviours: a device-free sensing way leveraging taxi trajectory data.''
|
|
link.springer.com
|
``Betweenness centrality-based community adaptive network representation for link prediction.''
|
|
journalofcloudcomputing.springeropen.com
|
``A novel vehicular task deployment method in hybrid MEC.''
|
|
dl.acm.org
|
``On Modeling Influence Maximization in Social Activity Networks under General Settings.''
|
|
dl.acm.org
|
``Understanding Persuasion Cascades in Online Product Rating Systems: Modeling, Analysis and Inference.''
|
|
dl.acm.org
|
``A Reinforcement Learning Approach to Optimize Discount & Reputation Trade-offs in E-commerce Systems.''
|
|
ieeexplore.ieee.org
|
``Quantifying Deployability & Evolvability of Future Internet Architectures via Economic Models.''
|