{"database": "team-science", "table": "paper", "rows": [["arxiv:1511.03722", "10.48550/arxiv.1511.03722", "W2234859443", null, "1511.03722", null, null, null, "Doubly Robust Off-policy Value Evaluation for Reinforcement Learning", 2015, "arXiv (Cornell University)", "https://arxiv.org/pdf/1511.03722", "2026-09-02T02:37:09Z", "openalex"]], "columns": ["lom_id", "doi", "openalex", "s2_paper_id", "arxiv", "pmid", "pmcid", "acl", "title", "year", "venue", "oa_url", "ingested_ts", "source"], "primary_keys": ["lom_id"], "primary_key_values": ["arxiv:1511.03722"], "units": {}, "query_ms": 6.7403423599898815, "source": "TeamScience Space repository", "source_url": "https://commons.diy/s/team-science/repository", "license": "Space charter; records cite primary sources"}