{"as_of":"2026-08-23T22:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10cbc57cd6399edade4cfa9c189651c5ab0d46f891512c4ff4ecaf3ab52f9109","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:15:14.358886Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18830/citation-record","integrity":"/paper/2607.18830/integrity","json":"/paper/2607.18830/citation-record.json","paper":"/paper/2607.18830"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.04924","last_updated":"2022-09-15T19:33:24Z","snapshot_observed_at":"2026-08-20T19:47:01.816521Z","submitted_at":"2022-09-11T19:42:48Z","title":"Meta-Reinforcement Learning via Language Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.04924","snapshot_observed_at":"2026-08-01T14:15:14.236250Z","title":"arXiv preprint arXiv:2209.04924 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.236250Z"},"links":{"cited_paper":"/paper/2209.04924","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:d53a7c5eae1d86473a1c2509e20091d96deb34f89e6c330f3a410015e577a537","observation_id":"7b4f6fc8-9410-457b-9a71-da84699f2aee","resolution":{"observed_at":"2026-08-01T14:15:14.236250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-01T14:15:14.242664Z","title":"arXiv preprint arXiv:1604.07316 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.242664Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:eb2e687310d05312dd1c00e1c8621c71cee7ee6b7f88849a4b35598cab6b0fa5","observation_id":"5b5ee942-2a51-4d7c-b136-015d75a6dce5","resolution":{"observed_at":"2026-08-01T14:15:14.242664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08272","last_updated":"2019-12-19T15:44:33Z","snapshot_observed_at":"2026-08-18T15:47:16.281254Z","submitted_at":"2018-10-18T20:48:08Z","title":"BabyAI: A Platform to Study the Sample Efficiency of Grounded Language Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08272","snapshot_observed_at":"2026-08-01T14:15:14.248277Z","title":"arXiv preprint arXiv:1810.08272 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.248277Z"},"links":{"cited_paper":"/paper/1810.08272","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:374afe4ce580781e7fa631ee8003ed2d816846dd65cf40b3a847ca70f860ac39","observation_id":"596c7fbd-8913-42be-8452-e72057e22bca","resolution":{"observed_at":"2026-08-01T14:15:14.248277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.253534Z","title":"In: Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.253534Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:c84e8c7ec8947be7695d6108a69c184c7e159d1a701b99caef16c4c1e7d6ef62","observation_id":"a5431748-7ba4-4dea-bd62-497f709f206d","resolution":{"observed_at":"2026-08-01T14:15:14.253534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.259141Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.259141Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:d36fd3131c17db56ce609d6174be9adf10eb4459a8b0e9db5c992fc2f1667942","observation_id":"95d8c804-4203-4ebd-a002-5711f78515fd","resolution":{"observed_at":"2026-08-01T14:15:14.259141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00025","last_updated":"2020-02-18T08:57:58Z","snapshot_observed_at":"2026-08-20T01:11:14.771509Z","submitted_at":"2019-08-30T18:27:35Z","title":"Meta-Learning with Warped Gradient Descent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.00025","snapshot_observed_at":"2026-08-01T14:15:14.265099Z","title":"arXiv preprint arXiv:1909.00025 (2019) 12 Authors Suppressed Due to Excessive Length","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.265099Z"},"links":{"cited_paper":"/paper/1909.00025","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:cf6eb17e1c6c3b2d97162e7287c0ded18bc1f4efc21a85a31ec7f3ff84456025","observation_id":"861ae59b-623f-414f-b05b-ca740fe6ea56","resolution":{"observed_at":"2026-08-01T14:15:14.265099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.272617Z","title":"The Inter- national Journal of Robotics Research40(4-5), 698–721 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.272617Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:370d07ad5424f6ce63dd3e47943d6c5096859133bc63938e6f1a265f3a1da263","observation_id":"6fbad931-15b4-4a91-b545-40b860f574e3","resolution":{"observed_at":"2026-08-01T14:15:14.272617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.277992Z","title":"Journal of Machine Learning Research17(39), 1–40 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.277992Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:7d27f1f285d353b53d81b72fa232e40e1f877badf3ae6e21ea1753a07a1ad3aa","observation_id":"8e2b09cd-8129-4b92-b1f5-c5451aa874e5","resolution":{"observed_at":"2026-08-01T14:15:14.277992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.283442Z","title":"Statistics in medicine41(20), 4034–4056 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.283442Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:8ceaf784bc81def0697d72a47947c23e72217c7e4c632acc0a81f80991398ef1","observation_id":"3016345c-f4b2-4a56-9ea5-c90cb7d68d34","resolution":{"observed_at":"2026-08-01T14:15:14.283442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.290319Z","title":"In: Proceedings of the 2022 Conference of the North American Chapter of the Association for Computational Linguistics (NAACL) (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.290319Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:34ae3566532bffe8e70b13fc6029d28091de0f0e3708af5a2119477ebf205d84","observation_id":"3ae61141-3e89-43a1-b1d5-6f8fc0c3aedf","resolution":{"observed_at":"2026-08-01T14:15:14.290319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-01T14:15:14.295217Z","title":"arXiv preprint arXiv:1312.5602 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.295217Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:6c0b4c889a6a3587f2d0941df39d8aa9b29d1aaecf7275cdd6d94ba472ee436e","observation_id":"148eb2f1-99a8-41f1-a175-8180402f59ca","resolution":{"observed_at":"2026-08-01T14:15:14.295217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.300469Z","title":"Nature518, 529–533 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.300469Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:af83099b23721e24054eeba03b61bc8e949fc5f9378dfd65c4ba1506b1ffc629","observation_id":"59d6dc82-4de6-4754-b94a-89cf4c718146","resolution":{"observed_at":"2026-08-01T14:15:14.300469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.305749Z","title":"In: Advances in Neural Information Processing Systems (NeurIPS) (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.305749Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:23c96a3e4c058793fd3a3352402fbb5a528ad24d73d9532056603f1233f54405","observation_id":"43e587c0-de4e-4c26-81df-a8cdccbf226e","resolution":{"observed_at":"2026-08-01T14:15:14.305749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09157","last_updated":"2020-02-12T15:29:39Z","snapshot_observed_at":"2026-08-09T17:12:58.580827Z","submitted_at":"2019-09-19T16:30:42Z","title":"Rapid Learning or Feature Reuse? Towards Understanding the Effectiveness of MAML","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09157","snapshot_observed_at":"2026-08-01T14:15:14.311571Z","title":"arXiv preprint arXiv:1909.09157 (2019)","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.311571Z"},"links":{"cited_paper":"/paper/1909.09157","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:7a258efe7a9b5fefa0f36b34897c1e09cf3275f341f8a4cf2267cd6c69862fc5","observation_id":"593cda1a-2f2c-42c4-8fa7-872aeda69a00","resolution":{"observed_at":"2026-08-01T14:15:14.311571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.317280Z","title":"In: Proceedings of the 2019 conference on empirical methods in natural language processing and the 9th international joint conference on natural language processing (EMNLP-IJCNLP)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.317280Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:bbb65f181fcef7527254e5d6a861796c628654c0afde7fdde123fcdf7c46c057","observation_id":"04b664d7-8abc-450f-b201-42b68969937d","resolution":{"observed_at":"2026-08-01T14:15:14.317280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05960","last_updated":"2019-03-26T13:36:45Z","snapshot_observed_at":"2026-08-14T18:51:27.233335Z","submitted_at":"2018-07-16T16:35:29Z","title":"Meta-Learning with Latent Embedding Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.05960","snapshot_observed_at":"2026-08-01T14:15:14.322590Z","title":"arXiv preprint arXiv:1807.05960 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.322590Z"},"links":{"cited_paper":"/paper/1807.05960","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:3cb7cb3e91a038a6b33fc9b90bebb9a5f4d88304771be7a439ed52aacb538033","observation_id":"91fbff65-d82c-41e6-a0dc-c918a6dabd3c","resolution":{"observed_at":"2026-08-01T14:15:14.322590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.328466Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.328466Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:0804ad778507a0d45a22c9d5eb8305dcf3e659d6461d1c96d11cbfe7f1b9c3b5","observation_id":"92011d35-e887-4ad2-8c13-452e0df2e864","resolution":{"observed_at":"2026-08-01T14:15:14.328466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-01T14:15:14.333922Z","title":"arXiv preprint arXiv:1506.02438 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.333922Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:3d28a0d532c1dee9080e5d90555bdb3df43aee0380d02b3fabba6252ec1f9c77","observation_id":"bc7776ec-1b3d-4631-967d-9d78f8305d7c","resolution":{"observed_at":"2026-08-01T14:15:14.333922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.339225Z","title":"Nature529, 484–489 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.339225Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:c429fefdc2e50850d99ae10bd2f5f779d42b8904819265d6939515bfed88b30b","observation_id":"f5dbf621-7bea-47ab-8e31-36c33b5cc53c","resolution":{"observed_at":"2026-08-01T14:15:14.339225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.344080Z","title":"In: Pro- ceedings of the 2020 Conference on Robot Learning (CoRL) (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.344080Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:91bd8b5680fa066a394635346551c02d853b6eb3a6cde1c529e43dd81073e1d2","observation_id":"8463e505-486f-4750-a5f8-4fa6700086aa","resolution":{"observed_at":"2026-08-01T14:15:14.344080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.348989Z","title":"MIT Press, 2 edn","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.348989Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:1a2f0e71d4972a15186ab02a3ff818e1878f0a59b763f58adac00e87ddd4c8ba","observation_id":"630ead43-f794-4f13-9ee1-97582ca47b1e","resolution":{"observed_at":"2026-08-01T14:15:14.348989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.353930Z","title":"In: Proceedings of the 2022 IEEE International Conference on Robotics and Automation (ICRA) (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.353930Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:326be98966ea768eb341ad63dea4755c19d99f3c36dac8781d1bedfc6a69661d","observation_id":"4ba8d989-6be6-4a42-afd3-60e6e0e68394","resolution":{"observed_at":"2026-08-01T14:15:14.353930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:15:14.358886Z","title":"In: Proceedings of the 36th International Conference on Machine Learning (ICML) (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:15:14.358886Z"},"links":{"citing_paper":"/paper/2607.18830"},"observation_digest":"sha256:2021ffd20915e975c0189c05dbce8b40fb8dcdd01c01af1a4b7b3196f4fbd9d2","observation_id":"65fb7753-eeb9-4732-8735-095e87c5bee5","resolution":{"observed_at":"2026-08-01T14:15:14.358886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18830","last_updated":"2026-07-21T08:10:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T21:57:59.526458Z","submitted_at":"2026-07-21T08:10:45Z","title":"From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.18830."}