home / team-science

citation_edge

cites / cited_by / stub edges with a locator. Only when bibliography or OpenAlex referenced_works supports them.

Data license: Space charter; records cite primary sources · Data source: TeamScience Space repository

52 rows where from_lom_id = "arxiv:1910.04098"

✎ View and edit SQL

This data as json, CSV (advanced)

Suggested facets: locator

Link from_lom_id to_lom_id kind locator
arxiv:1910.04098,arxiv:1312.5602,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Playing Atari with Deep Reinforcement Learning arxiv:1312.5602 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1312.6114,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Auto-Encoding Variational Bayes arxiv:1312.6114 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1401.4082,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Stochastic Backpropagation and Approximate Inference in Deep Generative\n Models arxiv:1401.4082 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1502.05477,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Trust Region Policy Optimization arxiv:1502.05477 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1506.02438,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 High-Dimensional Continuous Control Using Generalized Advantage Estimation arxiv:1506.02438 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1511.06295,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Policy Distillation arxiv:1511.06295 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1511.06342,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Actor-Mimic: Deep Multitask and Transfer Reinforcement Learning arxiv:1511.06342 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1606.01885,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to Optimize arxiv:1606.01885 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1611.02779,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning arxiv:1611.02779 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1611.05763,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to reinforcement learn arxiv:1611.05763 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1703.00441,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to Optimize Neural Nets arxiv:1703.00441 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1703.03400,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks arxiv:1703.03400 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1706.09529,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to Learn: Meta-Critic Networks for Sample Efficient Learning arxiv:1706.09529 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1707.03141,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 A Simple Neural Attentive Meta-Learner arxiv:1707.03141 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1801.08930,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Recasting Gradient-Based Meta-Learning as Hierarchical Bayes arxiv:1801.08930 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1802.09464,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research arxiv:1802.09464 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1804.03720,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Gotta Learn Fast: A New Benchmark for Generalization in RL arxiv:1804.03720 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1809.01999,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Recurrent World Models Facilitate Policy Evolution arxiv:1809.01999 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:1905.10985,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Ai-gas: Ai-generating algorithms, an alternate paradigm for producing general artificial intelligence arxiv:1905.10985 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,arxiv:2003.05325,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Meta-learning curiosity algorithms arxiv:2003.05325 cites OpenAlex cites:W2995196103 (top 20 by cited_by_count)
arxiv:1910.04098,doi:10.1007/3-540-44668-0_13,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to Learn Using Gradient Descent doi:10.1007/3-540-44668-0_13 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1007/978-1-4471-2063-6_107,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 A ‘Self-Referential’ Weight Matrix doi:10.1007/978-1-4471-2063-6_107 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1007/bf00992696,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Simple statistical gradient-following algorithms for connectionist reinforcement learning doi:10.1007/bf00992696 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1109/icnn.1988.23856,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 On the use of backpropagation in associative reinforcement learning doi:10.1109/icnn.1988.23856 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1109/icpr48806.2021.9412010,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Meta Learning via Learned Loss doi:10.1109/icpr48806.2021.9412010 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1109/iros.2012.6386109,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 MuJoCo: A physics engine for model-based control doi:10.1109/iros.2012.6386109 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1126/science.aau6249,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Human-level performance in 3D multiplayer games with population-based reinforcement learning doi:10.1126/science.aau6249 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1145/2001858.2001957,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Evolution of reward functions for reinforcement learning doi:10.1145/2001858.2001957 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1162/089976600300015015,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to Forget: Continual Prediction with LSTM doi:10.1162/089976600300015015 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1162/neco.1997.9.5.1015,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Reduction of the Hodgkin-Huxley Equations to a Single-Variable Threshold Model doi:10.1162/neco.1997.9.5.1015 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.1162/neco.1997.9.8.1735,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Long Short-Term Memory doi:10.1162/neco.1997.9.8.1735 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.15607/rss.2018.xiv.002,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 One-Shot Imitation from Observing Humans via Domain-Adaptive Meta-Learning doi:10.15607/rss.2018.xiv.002 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.21236/ada440280,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Intrinsically Motivated Reinforcement Learning doi:10.21236/ada440280 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.4230/lipics.cp.2021.42,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 (untitled in OpenAlex) doi:10.4230/lipics.cp.2021.42 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.4230/oasics.dx.2024.16,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Diagnosing Non-Intermittent Anomalies in Reinforcement Learning Policy Executions (Short Paper) doi:10.4230/oasics.dx.2024.16 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.71910/supsi.7440,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Direct Policy Search and Uncertain Policy Evaluation doi:10.71910/supsi.7440 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.71910/supsi.7462,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 HQ-Learning: Discovering Markovian Subgoals for Non-Markovian Reinforcement Learning doi:10.71910/supsi.7462 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,doi:10.7551/mitpress/3115.003.0030,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 A Possibility for Implementing Curiosity and Boredom in Model-Building Neural Controllers doi:10.7551/mitpress/3115.003.0030 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2160371091,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Feudal Reinforcement Learning openalex:W2160371091 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2165150801,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Deterministic Policy Gradient Algorithms openalex:W2165150801 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2166160300,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Natural Evolution Strategies openalex:W2166160300 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2779040504,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Ray RLLib: A Composable and Scalable Reinforcement Learning Library openalex:W2779040504 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2783130291,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning to generate sub-goals for action sequences openalex:W2783130291 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2796429358,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Learning Unsupervised Learning Rules openalex:W2796429358 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2963094322,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 RLlib: Abstractions for Distributed Reinforcement Learning openalex:W2963094322 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2963639957,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 VIME: Variational Information Maximizing Exploration openalex:W2963639957 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2963864421,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Continuous control with deep reinforcement learning openalex:W2963864421 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2963923407,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Addressing Function Approximation Error in Actor-Critic Methods openalex:W2963923407 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2964121937,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Bayesian Model-Agnostic Meta-Learning openalex:W2964121937 cites OpenAlex referenced_works of W2979869797
arxiv:1910.04098,openalex:W2964227899,cites Improving generalization in meta reinforcement learning using learned objectives arxiv:1910.04098 Evolved Policy Gradients openalex:W2964227899 cites OpenAlex referenced_works of W2979869797

Next page

Advanced export

JSON shape: default, array, newline-delimited, object

CSV options:

CREATE TABLE citation_edge (
  from_lom_id  TEXT NOT NULL REFERENCES paper(lom_id),
  to_lom_id    TEXT NOT NULL REFERENCES paper(lom_id),
  kind         TEXT NOT NULL CHECK (kind IN ('cites','cited_by','stub')),
  locator      TEXT,
  PRIMARY KEY (from_lom_id, to_lom_id, kind),
  CHECK (from_lom_id <> to_lom_id)
);
Powered by Datasette · Queries took 5.319ms · Data license: Space charter; records cite primary sources · Data source: TeamScience Space repository