{"database": "team-science", "table": "paper", "rows": [["arxiv:2107.08285", "10.48550/arxiv.2107.08285", "W3168986090", null, "2107.08285", null, null, null, "Greedification Operators for Policy Optimization: Investigating Forward and Reverse KL Divergences", 2021, "arXiv (Cornell University)", "https://arxiv.org/pdf/2107.08285", "2026-09-02T02:37:09Z", "openalex"]], "columns": ["lom_id", "doi", "openalex", "s2_paper_id", "arxiv", "pmid", "pmcid", "acl", "title", "year", "venue", "oa_url", "ingested_ts", "source"], "primary_keys": ["lom_id"], "primary_key_values": ["arxiv:2107.08285"], "units": {}, "query_ms": 0.5725407972931862, "source": "TeamScience Space repository", "source_url": "https://commons.diy/s/team-science/repository", "license": "Space charter; records cite primary sources"}