{"as_of":"2026-08-10T05:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae2b9936d9c35f8129f47d069b158ed7e1e49ac6c1b4fcaa92204a429748f1f8","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:09:25.742768Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:25:31.371167Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T16:23:34.381553Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00983","snapshot_observed_at":"2026-08-06T16:25:31.371167Z","title":"Causalcomrl: Context-based offline meta- reinforcement learning with causal representation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13710","last_updated":"2025-07-26T10:45:43Z","snapshot_observed_at":"2026-08-08T22:39:37.733727Z","submitted_at":"2025-07-18T07:43:22Z","title":"SoftPipe: A Soft-Guided Reinforcement Learning Framework for Automated Data Preparation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:31.371167Z"},"links":{"cited_paper":"/paper/2502.00983","citing_paper":"/paper/2507.13710"},"observation_digest":"sha256:922780341cdd5b1c3dcf168284636d88695f4877d9cc571d69f8fb31785b2d9c","observation_id":"ed53ff61-3358-490b-9ce0-54ef7fb264a4","resolution":{"observed_at":"2026-08-06T16:25:31.371167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"cited_work":{"arxiv_id":"2502.00983","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00983","snapshot_observed_at":"2026-08-06T16:23:34.381553Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","venue":"cs.LG","work_id":"04a6c2d4-decb-4a4e-8b13-5ee5c0dafcb4","year":2025},"citing_paper":{"arxiv_id":"2507.13712","last_updated":"2025-07-18T07:52:19Z","snapshot_observed_at":"2026-08-09T08:19:30.509468Z","submitted_at":"2025-07-18T07:52:19Z","title":"LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:23:32.524916Z"},"links":{"cited_paper":"/paper/2502.00983","citing_paper":"/paper/2507.13712"},"observation_digest":"sha256:e996bc19aa040f5c659ebb59b60d2e94f5d0518178d2b59dd7b0ea19d21a6ca5","observation_id":"89481932-2ac6-4fe0-9e47-f94860f87c58","resolution":{"observed_at":"2026-08-06T16:23:34.470691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00983/citation-record","integrity":"/paper/2502.00983/integrity","json":"/paper/2502.00983/citation-record.json","paper":"/paper/2502.00983"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.413587Z","title":"Reinforcement learning in robotics: A survey","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.413587Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:fb70d2e0099de80ef610456c7bcf402019a2b348c2ff006a4be5a3ec5a809c13","observation_id":"6a89439f-ddbd-4b79-8bbe-2d8cf64a3237","resolution":{"observed_at":"2026-08-09T17:09:25.413587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.804687Z","title":"Sim-to-real transfer of robotic control with dynamics randomization","venue":null,"work_id":"9ecfbe28-0cb0-4450-9de6-4ae5bfafbf68","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.419654Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:47578fde18a4823fb9b06bf48de3ea09f2653b037e69522e86f73a5d7fe3bd3c","observation_id":"bc769ed1-133e-4e1e-8735-3af480d68fe2","resolution":{"observed_at":"2026-08-09T17:09:26.811136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.786940Z","title":"Modular deep reinforcement learning from reward and punishment for robot navigation","venue":null,"work_id":"c4d2624d-7174-4fdd-9f36-c5f63bbd72b1","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.424995Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:d058b330f22fd987674878bbb1b71361042c95ab93d1a392208d59336b68a278","observation_id":"d6afe497-6b3e-460e-8b3d-acd7648776fd","resolution":{"observed_at":"2026-08-09T17:09:26.792979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.770726Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"4937bad7-e8d8-48eb-82b6-f42f9ceee3a2","year":2015},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.430933Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:2a41df81ca1525c5f0c6760cec134836628373f4d6633bebd8986d8b0568b1b4","observation_id":"91f59041-99d7-489e-899f-259c146ff9f3","resolution":{"observed_at":"2026-08-09T17:09:26.775925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.435875Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.435875Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:8322437f8f23601d34a95ac1360df4a01afd4e268cf11dc92724658e43f75463","observation_id":"494d0913-01f6-4017-9df1-ce113f565613","resolution":{"observed_at":"2026-08-09T17:09:25.435875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.743770Z","title":"Improved robustness of reinforcement learning policies upon conversion to spiking neuronal network platforms applied to atari breakout game","venue":null,"work_id":"a8b3fc53-1f6e-4785-97fb-77dafa2f715c","year":2019},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.441003Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:3e7c344117c797300be8340f0fddb8d058ef1465e8ae346ab19c012c0b1889bb","observation_id":"82713058-ac7f-4773-a75c-11307108501c","resolution":{"observed_at":"2026-08-09T17:09:26.748510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.728717Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":"65571fda-91eb-43fd-9d89-e5412e048f0d","year":2017},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.446878Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:2a96ea048b64214b23bea1dec946c9204f4b5bbb6bbb0a91358d10372791870c","observation_id":"aba8092c-6399-4b17-b3be-1cc6fa69bb71","resolution":{"observed_at":"2026-08-09T17:09:26.733619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.712214Z","title":"Brain-inspired meta-reinforcement learning cognitive control in conflictual in- hibition decision-making task for artificial agents","venue":null,"work_id":"998c57b8-d8a1-414e-998e-6f6419381973","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.451714Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:e6d24cee244cd81500c965364de77000a3d8d8a3caf95747b8f370136b1f4f61","observation_id":"3ce9c48a-b9bf-4395-bffa-70ae3b355a9c","resolution":{"observed_at":"2026-08-09T17:09:26.717062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.695629Z","title":"Explaining aha! moments in artificial agents through ike-xai: Implicit knowledge extraction for explainable ai","venue":null,"work_id":"e843113b-e8f8-4ee1-9e49-63444f9ff65a","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.456671Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:f4c46854655eaadfb8db45b85608352b0807a5c675a6b2031a2f0fb76425054f","observation_id":"aaa1c710-6e8e-4061-a913-3f1171d8db22","resolution":{"observed_at":"2026-08-09T17:09:26.700836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.679318Z","title":"Deep reinforcement learning in a handful of trials using probabilistic dynamics models","venue":null,"work_id":"10cededf-3fde-49fd-a953-f25d4061e86d","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.462153Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:8f9c48a550f19b41cf0c7263937195215401b5450b03e4e10341ff0d4b655365","observation_id":"0adfd0eb-888b-4eed-8454-0d74c26a375e","resolution":{"observed_at":"2026-08-09T17:09:26.684575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.664222Z","title":"Offline meta-reinforcement learning for industrial insertion","venue":null,"work_id":"5e7174f9-b460-4b53-b749-b283878fc2e5","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.467133Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:dfcf6e7018d5935b20f6be83c6aa6beb2cf8846f368f29c03f4edee41a239a4f","observation_id":"3534f9dd-0331-4ee3-adae-168f5c9532ea","resolution":{"observed_at":"2026-08-09T17:09:26.669165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-09T17:09:25.473022Z","title":"Offline reinforce- ment learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.473022Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:2aa0cdd58021db3523f2fac6544859bddd0b0d988011ede4a7adaad785d8a608","observation_id":"1cba7439-d12d-4233-abe6-7d725a559fc0","resolution":{"observed_at":"2026-08-09T17:09:25.473022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.648092Z","title":"Meta-learning in reinforcement learn- ing","venue":null,"work_id":"8d65f88a-419e-4c16-acbe-a182dfc5366d","year":2003},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.479232Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:5c14b3860f4d6018ffb9d0cb2d32633793edd9454e25fb0bc43b59d6f224fa3c","observation_id":"0d7b7bd8-d9c0-40b3-b013-4ddee0bed699","resolution":{"observed_at":"2026-08-09T17:09:26.652831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.630673Z","title":"Model-agnostic meta- learning for fast adaptation of deep networks","venue":null,"work_id":"71d6513a-3397-4ea3-87a9-658f728c80a0","year":2017},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.484203Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:749f86111e8fcc8dd0b6bb7ed596101531aabea9f000e41ec35150da69cb0fc3","observation_id":"63ca22ad-6f29-46ab-aac6-509c514bc659","resolution":{"observed_at":"2026-08-09T17:09:26.636610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.615709Z","title":"Meta-reinforcement learning of structured exploration strategies","venue":null,"work_id":"de1b0353-fd75-4e32-a2a1-62f1c2422f25","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.489050Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:c01e64682baaee56e65de3c18ebea922ed4bbaa7962c071a7ad8ffb410be395c","observation_id":"600fb497-8f12-4e24-8896-613917264989","resolution":{"observed_at":"2026-08-09T17:09:26.620654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.599608Z","title":"Enhanced meta reinforcement learning via demonstra- tions in sparse reward environments","venue":null,"work_id":"5b86730b-d2fd-4a73-bd6b-6f5c4d46cbed","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.494738Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:6dfb85715da4cbb0b718f5a3875ac5ff10fd41b58ffde01fa87fa9c2ceaf7092","observation_id":"d64dd9e0-1eaa-421c-80d6-d73d214362c9","resolution":{"observed_at":"2026-08-09T17:09:26.604724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.582371Z","title":"Efficient off-policy meta-reinforcement learning via probabilistic context vari- ables","venue":null,"work_id":"b0abfc5f-221d-4c40-b0a9-947ebdb2ac78","year":2019},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.499964Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:be4667c2c8fedbd522c62091ea534a36dab2545337d57f8ef9534e7365283657","observation_id":"40392227-fc4e-4609-b0c1-761eddf57b7e","resolution":{"observed_at":"2026-08-09T17:09:26.587928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.565972Z","title":"Focal: Efficient fully-offline meta- reinforcement learning via distance metric learning and behavior regulariza- tion","venue":null,"work_id":"007959db-f438-4c25-9cb7-d885abfcdb0d","year":2020},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.504809Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:5dca6cf709b084d122cf2453d5cc069dc0f434b4bd4281d2823fc47b0d2171bd","observation_id":"7c09a386-4d75-4f35-9fee-6a40ac3327f8","resolution":{"observed_at":"2026-08-09T17:09:26.570940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.550702Z","title":"Context meta-reinforcement learning via neuromodulation","venue":null,"work_id":"b8417577-e7b1-4dba-805a-7f611e3e049d","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.511307Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:c6d4a9f7e7981e83477586870445c420c24f310dfd9ae71caaf19f99a52ebaf1","observation_id":"90116d42-1fcc-4707-aa7d-a1b98f4faf1c","resolution":{"observed_at":"2026-08-09T17:09:26.555665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.534524Z","title":"Representation learning for continuous action spaces is beneficial for efficient policy learning","venue":null,"work_id":"aef92e1d-5453-42fb-9357-4707a9e0808a","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.516809Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:948a49b8915c8be6a1df91088d84548cacc266638e50fcef5e46fe0157409421","observation_id":"d235c8d8-ad8d-4698-a929-69a0086a9918","resolution":{"observed_at":"2026-08-09T17:09:26.539705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.517307Z","title":"A survey on negative transfer","venue":null,"work_id":"edfab4d4-84ee-4fc9-b0f3-5fedea3099cb","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.521952Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:a4008d2d12d2e37b17421e7351e5653fb6d9ec4fa898e25f4c96e6b000d193f3","observation_id":"80694e0d-7866-4d5c-8447-dcb9df7e73df","resolution":{"observed_at":"2026-08-09T17:09:26.523219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-06T07:16:48.853653Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-09T17:09:25.527110Z","title":"A survey of meta-reinforcement learn- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.527110Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:81bcf551f1e906f706221c64d07fef7dc0ee4f8a4a692beb21f357dd4c49b95d","observation_id":"827f82a1-f7ad-441d-a5ac-50b99948f016","resolution":{"observed_at":"2026-08-09T17:09:25.527110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.498865Z","title":"Episodic task agnostic contrastive training for multi-task learning","venue":null,"work_id":"32d99b83-7b60-4980-9fed-0262cff4af88","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.532259Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:c764c1319e49227a6cbc0fdf147c12c1db8361dc5650197d8e2c62cbd2f132e4","observation_id":"3b04b625-ca20-4b85-90bc-9bc63e53ac45","resolution":{"observed_at":"2026-08-09T17:09:26.504471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10774","last_updated":"2021-10-15T10:10:32Z","snapshot_observed_at":"2026-07-06T10:43:21.381832Z","submitted_at":"2021-02-22T05:05:16Z","title":"Provably Improved Context-Based Offline Meta-RL with Attention and Contrastive Learning","version":2},"cited_work":{"arxiv_id":"2102.10774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.10774","snapshot_observed_at":"2026-08-09T17:09:25.870133Z","title":"Provably Improved Context-Based Offline Meta-RL with Attention and Contrastive Learning","venue":"cs.LG","work_id":"2c8d2b16-13e6-463c-a03e-5aba86a71ea7","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.537058Z"},"links":{"cited_paper":"/paper/2102.10774","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:6459344d3a8e8e0e1db67400a5b23bf2001fb7ce3500a7d30421320dabdabdd7","observation_id":"35ec8f25-bfd4-4201-8c77-7977cff2b912","resolution":{"observed_at":"2026-08-09T17:09:25.877658Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.482869Z","title":"Robust task representations for offline meta- reinforcement learning via contrastive learning","venue":null,"work_id":"0e087147-91cb-40b7-bcfa-01f696d50b72","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.542234Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:4ba56e1348a098e5cbba2587b593c28bf9cad408af52f1c99a715f05e177cefe","observation_id":"c0adae51-da36-417e-b59b-95bda323106a","resolution":{"observed_at":"2026-08-09T17:09:26.487961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.466126Z","title":"Meta-reinforcement learning based on self-supervised task representation learning","venue":null,"work_id":"77c097a3-3efa-4d4b-a9a5-1aac2d745b55","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.547461Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:0a50d8a990e9aafbc96808175d810d7e16e47c4c86850729e954d6653f8803db","observation_id":"9a0eb48d-168e-4cfa-bd4a-b1433fde63f1","resolution":{"observed_at":"2026-08-09T17:09:26.471175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.450128Z","title":"Context shift reduction for offline meta-reinforcement learning","venue":null,"work_id":"db4e91c4-20e9-4888-ba35-54c80d49b838","year":2024},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.552835Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:0af340f73b5179879e8ea8158012e505c8d70c912fd53172a4f8c8f3499c30e1","observation_id":"e500de27-0df5-4db3-997c-dc5c4e881e2c","resolution":{"observed_at":"2026-08-09T17:09:26.455152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02429","last_updated":"2025-01-13T14:58:30Z","snapshot_observed_at":"2026-08-08T11:50:26.930173Z","submitted_at":"2024-02-04T09:58:42Z","title":"Towards an Information Theoretic Framework of Context-Based Offline Meta-Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02429","snapshot_observed_at":"2026-08-09T17:09:25.558055Z","title":"Towards an information theoretic framework of context- based offline meta-reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.558055Z"},"links":{"cited_paper":"/paper/2402.02429","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:dd51d387eff06568e960ece45aa3a0c3fb9727901121666e0d7dc1f4d182b258","observation_id":"ea167ddd-dd18-462f-aee1-5a17846f17a4","resolution":{"observed_at":"2026-08-09T17:09:25.558055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.433557Z","title":"Seeing is not believing: Robust reinforcement learning against spurious correlation","venue":null,"work_id":"b366e3a9-278f-4129-9596-174288a1965f","year":2024},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.564243Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:f4ad28b1a7275289bac5165f8b69fcad8ebb0113404a6e1c82ccbf94adabb3e2","observation_id":"18067392-041d-4049-9b99-01514f457b11","resolution":{"observed_at":"2026-08-09T17:09:26.438854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.417333Z","title":"Improving multi-task generalization via regularizing spurious correlation","venue":null,"work_id":"d715eff3-d8c2-4114-88b9-44d012b7ff7c","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.569776Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:ca5bd08828f3479f5ddb9fe732583d90c2358e4b9d546ff69169e1c2c37dfbbc","observation_id":"ce66caeb-59e8-4c79-be60-2ce89477ee56","resolution":{"observed_at":"2026-08-09T17:09:26.422590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.399968Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"71a3ef07-d1d0-46a6-a904-1514939a1b91","year":2012},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.575411Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:0147fb9a2a2840715c34200e92c9800a9dd19f63050732a25412dd4586cce0bd","observation_id":"52ce6866-2684-474b-81f4-301bf4019588","resolution":{"observed_at":"2026-08-09T17:09:26.405928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.383326Z","title":"Toward causal repre- sentation learning","venue":null,"work_id":"dca3ea22-c987-4a38-87a7-053cd7d57cc5","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.580588Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:4e828f145660344eef82366aac3fd0dca01864af8f2ce5aad089403907907ff6","observation_id":"1bc505b0-0942-4678-a549-53141b97ae65","resolution":{"observed_at":"2026-08-09T17:09:26.388760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.366371Z","title":"Provably efficient causal reinforcement learning with confounded observational data","venue":null,"work_id":"f50d7435-dec0-486b-9cfe-eeb7ec08742b","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.585082Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:2075223e36db95b7d2891e79f2951cfcdfd4939dc960d00e617b0c5b452cadb7","observation_id":"15cc7217-f8ce-4c36-b890-a90314fd6ba9","resolution":{"observed_at":"2026-08-09T17:09:26.371572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.350848Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"71065239-2eb2-46c6-9d21-4605c57373e7","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.589691Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:df809e70d6e8602ab853cb624e00a2c358eed167c79cbafab64b706998013a9e","observation_id":"1b4837a3-4569-46cb-af0e-b3fef05e08a5","resolution":{"observed_at":"2026-08-09T17:09:26.355840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-09T17:09:25.595775Z","title":"Awac: Ac- celerating online reinforcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.595775Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:388e7887913e62541d9ab443995a0ff361df7ed2b7a8005f11b32547bd1b742b","observation_id":"a02ed3a9-acc5-43d6-90d5-6dd8631670a1","resolution":{"observed_at":"2026-08-09T17:09:25.595775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.335500Z","title":"A perspective of q-value estimation on offline-to-online reinforcement learning","venue":null,"work_id":"df98ef0e-567f-49b7-a675-707246e16dfb","year":2024},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.601546Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:f25f55ccb26ee1d753079b0b72bfcea2c0a448f06739a0e5fefd836f31fb1640","observation_id":"83225b25-386b-439b-a48a-d5981832a57a","resolution":{"observed_at":"2026-08-09T17:09:26.340272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.320730Z","title":"Offline meta reinforcement learning with in-distribution online adaptation","venue":null,"work_id":"d5f95967-51e2-4117-83f7-48fc58f78d90","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.606410Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:862b3eae2eeadc4981bec9c793315225796c392f042b1902d1b6b7de524c30be","observation_id":"fb302d62-5631-41e0-b643-005179a4a33c","resolution":{"observed_at":"2026-08-09T17:09:26.325460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.304926Z","title":"Weakly supervised representation learning with sparse perturbations","venue":null,"work_id":"50553c9c-7a06-41e6-96ca-f18be0ad323e","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.611357Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:d7272b0f24f68467a4a5f8595208e40fd9282a76785910d0895c79231eb087af","observation_id":"3a94ebff-61b5-4b97-a721-18daa611cbd7","resolution":{"observed_at":"2026-08-09T17:09:26.310640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.288741Z","title":"Weakly supervised causal representation learning","venue":null,"work_id":"ae6bc803-29ae-45fe-ac08-13df8d389677","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.616869Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:31d2d04e5ae60f35502d747a8595ac6f8cde5dbaeafba2b4978a7959da409581","observation_id":"6d18db0f-fa06-469f-b164-9a156b163444","resolution":{"observed_at":"2026-08-09T17:09:26.293849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.273048Z","title":"Independent mechanism analysis, a new concept? In Advances in Neural Information Processing Systems, volume 34, pages 28233– 28248, 2021","venue":null,"work_id":"8d668a47-ee21-44b3-b69b-26b2cc844ebb","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.621451Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:10adbf8fe34efc0c54637cb9a51d3a21afbb94f1c0000f2f01739cdb4039e312","observation_id":"3d344cae-3a89-4c8a-aeb3-007fa004ac59","resolution":{"observed_at":"2026-08-09T17:09:26.278411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.256149Z","title":"Disentanglement via mechanism sparsity regularization: A new principle for nonlinear ica","venue":null,"work_id":"cfaef346-a9f2-40eb-ba51-e1bd6b66f2bd","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.626762Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:4b35788a0109d233dc9439e669e4f5ca45d8f769010cf0b1406d6889de8622bd","observation_id":"6ae7a645-6ec1-4bab-b0af-81d45a3a6a9e","resolution":{"observed_at":"2026-08-09T17:09:26.262035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.238519Z","title":"Causalgan: Learning causal implicit generative models with ad- versarial training","venue":null,"work_id":"61dca23b-170a-424b-be4b-2ebb80d8ceab","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.631547Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:8688f2046d81737a580f4a39e40452f4405d5aeb3a05801e732e21c7cac76dee","observation_id":"43f07eec-c8ea-4f1b-af1f-2f5702d516d2","resolution":{"observed_at":"2026-08-09T17:09:26.243562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.223459Z","title":"Causalvae: Disentangled representation learning via neural structural causal models","venue":null,"work_id":"ed6c56a7-f3cb-4013-8ffa-3574a63a9c11","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.636700Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:5be0ba220c86b9ce70972c9c4ea0bab0586e3a4dfb8ca60669a19fa0e766159d","observation_id":"4bfe6973-b87b-4fba-b495-3cabae540bb4","resolution":{"observed_at":"2026-08-09T17:09:26.228474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.206711Z","title":"Weakly supervised disentangled generative causal representation learning","venue":null,"work_id":"0dfd4cc4-129d-4185-b2cf-ad9a9d4740a1","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.641180Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:39ae70aada70f795c8a3242e432264583d0d46a51b7db5c51d7c99f90bc7cf27","observation_id":"ab1e11fc-6624-4d38-9f0b-5ad5aad9fe59","resolution":{"observed_at":"2026-08-09T17:09:26.212650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.190424Z","title":"On causally disentangled representations","venue":null,"work_id":"56019738-1e11-41ea-a7b8-a6b118be32c1","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.646362Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:26c76bcc179114cabb9fd266e10fa9eb6a59631e89eb24be15bbc059279266d6","observation_id":"58d94aeb-f81a-4833-ad07-fc0ebb5e389f","resolution":{"observed_at":"2026-08-09T17:09:26.195873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.174369Z","title":"Causal influence detection for improving efficiency in reinforcement learning","venue":null,"work_id":"d7e6987f-bc4d-4e7a-b1e3-c85a52a3dc3b","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.650934Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:15d5d0ef1863c2329be21664ae734f6ab08f4e79b9ae23d8dd16bcc7ca5eac60","observation_id":"b12efeb2-af55-4334-a152-b5a874a86a97","resolution":{"observed_at":"2026-08-09T17:09:26.179393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.158609Z","title":"Generalizing goal- conditioned reinforcement learning with variational causal reasoning","venue":null,"work_id":"305681e1-09da-43bd-9774-55777a79e842","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.656110Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:0b9dcab10185521f052c6485e534604fdcc05a589f393a04c94238f69285d7c4","observation_id":"527c2c29-99ea-4337-9b8a-44339f2faf99","resolution":{"observed_at":"2026-08-09T17:09:26.164173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.142637Z","title":"Passive learning of active causal strategies in agents and language models","venue":null,"work_id":"56138bc8-5a82-477c-8c96-636bc4ef98e3","year":2024},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.660917Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:861ec52fd683409c258ec949bca45ca92d5ae4dbe0cc61e64196dbcbe57e7c5b","observation_id":"43d152dc-6394-4475-bc52-c044c4a21e2a","resolution":{"observed_at":"2026-08-09T17:09:26.147621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-09T17:09:25.665713Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.665713Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:414d92f22986cfc87a7fa0a0e743381e69c61b4f1f726e35bc7b0330957b0bfb","observation_id":"0e816702-6581-41c1-a9ca-7a1c933ea84d","resolution":{"observed_at":"2026-08-09T17:09:25.665713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.127710Z","title":"Domino: Decomposed mutual information optimization for generalized context in meta-reinforcement learning","venue":null,"work_id":"cd57de42-509e-4cd2-aa1e-a05927584c3f","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.670797Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:d97c0fd450aa603cea965e0ecff064d54edf1891f81e8e675189b09c04b7941e","observation_id":"09f0def4-cdaf-473b-be34-045e2bf7734c","resolution":{"observed_at":"2026-08-09T17:09:26.132594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.111945Z","title":"Contrabar: Contrastive bayes-adaptive deep rl","venue":null,"work_id":"20743eba-365d-4563-bf05-c714f8bc5355","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.675931Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:b919ced7f57bc5d762e116b7fbd48d9cac0d7f4ddc6131d5325a9f981ddc6c12","observation_id":"43893fbb-b93a-41f1-b811-81326004fe7e","resolution":{"observed_at":"2026-08-09T17:09:26.117044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-09T17:09:25.680773Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.680773Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:50a4fcde56e62468ed09b7ce678fb9e8860f8cb9967eb1f614d816a5669f266a","observation_id":"0ddd36a9-020d-4116-ad61-7d072c8bb636","resolution":{"observed_at":"2026-08-09T17:09:25.680773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.094567Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"8da9cdee-f5da-44df-9792-22d5f78c581c","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.685582Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:2b579329e6588adf8787f0e467fc2a9275bf234200384a8eaf4c882a161dced4","observation_id":"f8b49565-2303-4191-928a-f1ab47a1eff1","resolution":{"observed_at":"2026-08-09T17:09:26.100191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.076914Z","title":"Consert: A contrastive framework for self-supervised sentence represen- tation transfer","venue":null,"work_id":"dc728237-aab2-4af6-97c8-4e9cdc8f187a","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.690627Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:0f78fa63267f3e3e5e8885992b4bb71c87e207c19fd756deb4aceebc2152e474","observation_id":"c184d352-bf51-43f4-b97d-1312863c7fa2","resolution":{"observed_at":"2026-08-09T17:09:26.083149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.060269Z","title":"Simcse: Simple contrastive learning of sentence embeddings","venue":null,"work_id":"8ebfd19e-dbd3-4b94-a41d-8af8828cdd94","year":2021},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.696056Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:3313906c7ace6edbd9eae22c5f3b732218bdae5e829ca9801bdd8063ffd894ff","observation_id":"e4c0ddad-36e9-4f09-94ae-1440ee02fc1f","resolution":{"observed_at":"2026-08-09T17:09:26.065835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.043603Z","title":"Contrastive identity-aware learning for multi-agent value decomposition","venue":null,"work_id":"87ffd5d1-3850-4196-b104-154e3f5340b3","year":2023},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.701514Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:cfa5b36313d3fff63dd2368da158997eba1b0c902196f45299e5e559c925848d","observation_id":"4d904a85-4e49-4c79-8454-5f8cbd27a005","resolution":{"observed_at":"2026-08-09T17:09:26.048931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.025913Z","title":"Reinforcement learning: An intro- duction","venue":null,"work_id":"7abc27c9-203d-4b6d-b9f0-55ed0c9d5f29","year":2018},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.706190Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:6b6ec364b80a8a18da85e0ddbf73958d9f73df6ec245684e8c8db845332cb5d3","observation_id":"0f8fc2aa-4283-43b9-a5b6-eb96965b606b","resolution":{"observed_at":"2026-08-09T17:09:26.032101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-09T17:09:25.711391Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.711391Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:3efee2b3f5dba3197da4104b32c53aeb0aed91b598b7baa39277c447425f1d61","observation_id":"c6926bc4-0274-45fe-8fbf-a96ded73e332","resolution":{"observed_at":"2026-08-09T17:09:25.711391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:26.009382Z","title":"A linear non-gaussian acyclic model for causal discovery","venue":null,"work_id":"e9580d83-13a2-409b-afe0-bb9e61abdec3","year":2006},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.716874Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:008decdce58d5ee369a416ffe6a0ed69fda7e2f2ddae5ff23ca48c562a9abff7","observation_id":"d8d74261-2cf6-4016-8b66-90db7c4c755f","resolution":{"observed_at":"2026-08-09T17:09:26.014962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.990089Z","title":"D’ya like dags? a survey on structure learning and causal discovery","venue":null,"work_id":"20b8564d-99b5-456b-9331-e5f0a0a7b4e0","year":2022},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.722522Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:43229950e9e7f0d9f306c784a8a224887c33f27fea222b4c18fdfa1583ea89f8","observation_id":"59c07916-40c2-4b5e-89c0-ee746596f549","resolution":{"observed_at":"2026-08-09T17:09:25.996673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.973226Z","title":"Dag-gnn: Dag structure learning with graph neural networks","venue":null,"work_id":"9e957d71-bfa6-4dfb-89cd-335ff9f48459","year":2019},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.727563Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:a73cfaf74940b576ef356bcb63e7b040c1792fd6ca6b9cbe4722e92d20c47b72","observation_id":"56bde1ef-3fca-43d4-bec6-1fecdf1a60d5","resolution":{"observed_at":"2026-08-09T17:09:25.978853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.956497Z","title":"Multi-task batch reinforcement learning with metric learning","venue":null,"work_id":"7b71b8a8-ee06-4163-8f7d-a62f7bce6904","year":2020},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.732956Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:1994bfce88e707726f9f11a54dc5993165ddd31fb82921af098b10c0488716b5","observation_id":"b8163607-541d-49a1-b054-b8d89a167577","resolution":{"observed_at":"2026-08-09T17:09:25.961652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.938793Z","title":"Training region- based object detectors with online hard example mining","venue":null,"work_id":"8b94fb76-841e-4589-ba03-baaef587c241","year":2016},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.738183Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:1effb51b17577efb8dc93c110908549c2df1c812c56854b0e91c98c678ea980e","observation_id":"14259b8d-9381-431e-94a4-81f2211ad859","resolution":{"observed_at":"2026-08-09T17:09:25.944245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:25.923373Z","title":"Visualizing data using t-sne","venue":null,"work_id":"547b8663-5182-4c3e-b33e-47193be45778","year":2008},"citing_paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T17:09:25.742768Z"},"links":{"citing_paper":"/paper/2502.00983"},"observation_digest":"sha256:4088d43bcc5470d62d06857bed13f8f4d086ea4fdd1af2bc1e87fe8d0db159f1","observation_id":"640d5bd6-3140-42cd-9e61-572889548658","resolution":{"observed_at":"2026-08-09T17:09:25.928019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00983","last_updated":"2025-02-03T01:43:54Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T16:58:40.000173Z","submitted_at":"2025-02-03T01:43:54Z","title":"CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":54},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 2 inbound Pith citation observations for arXiv:2502.00983."}