Skip to main content
Nubint
エージェント
リソース
料金プラン
会社概要
JA
Home
論文レビュー
Decision Sciences
Decision Sciences 論文レビュー
Decision Sciences 分野の主要論文を動機・手法・結果に構造化した AI 論文レビュー一覧です。
すべて
Computer Science
Mathematics
Physics and Astronomy
Engineering
Materials Science
Chemistry
Chemical Engineering
Earth and Planetary Sciences
Environmental Science
Energy
Biochemistry, Genetics and Molecular Biology
Neuroscience
Immunology and Microbiology
Agricultural and Biological Sciences
Medicine
Pharmacology, Toxicology and Pharmaceutics
Health Professions
Economics, Econometrics and Finance
Business, Management and Accounting
Decision Sciences
Social Sciences
Psychology
Arts and Humanities
Filter
5,756 results
Online Regret Bounds for Undiscounted Continuous Reinforcement Learning
Ronald Ortner, Daniil Ryabko
arXiv (Cornell University)
|
2013
|
44 citations
Pictures of Processes: Automated Graph Rewriting for Monoidal Categories and Applications to Quantum Computing
Aleks Kissinger
arXiv (Cornell University)
|
2012
|
44 citations
Surrogate Regret Bounds for Bipartite Ranking via Strongly Proper Losses
Shivani Agarwal
NOT FOUND REPOSITORY (Indian Institute of Science Bangalore)
|
2012
|
44 citations
Two Time-scale Off-Policy TD Learning: Non-asymptotic Analysis over Markovian Samples
Tengyu Xu, Shaofeng Zou, +1
arXiv (Cornell University)
|
2019
|
44 citations
A brief introduction to the Grey Machine Learning
Xin Ma
arXiv (Cornell University)
|
2018
|
43 citations
Accuracy of citation data in Web of Science and Scopus
Nees Jan van Eck, Ludo Waltman
arXiv (Cornell University)
|
2019
|
43 citations
Deception by Design: Evidence-Based Signaling Games for Network Defense
Jeffrey Pawlick, Quanyan Zhu
arXiv (Cornell University)
|
2015
|
43 citations
Explore no more: Improved high-probability regret bounds for non-stochastic bandits
Gergely Neu
arXiv (Cornell University)
|
2015
|
43 citations
Model-based Reinforcement Learning and the Eluder Dimension
Ian Osband, Benjamin Van Roy
arXiv (Cornell University)
|
2014
|
43 citations
Online Stochastic Optimization under Correlated Bandit Feedback
Mohammad Gheshlaghi Azar, Alessandro Lazaric, +1
arXiv (Cornell University)
|
2014
|
43 citations
36
37
38
39
40