{"as_of":"2026-08-10T09:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9360f0d06b67f75d5f427f3e3708a138a57378a2eb9a32d011ae3616e09bae42","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:46:03.231288Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00347/citation-record","integrity":"/paper/2509.00347/integrity","json":"/paper/2509.00347/citation-record.json","paper":"/paper/2509.00347"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.15657","last_updated":"2023-07-10T07:25:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-28T18:59:02Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15657","snapshot_observed_at":"2026-08-05T13:46:02.217620Z","title":"Is conditional generative modeling all you need for decision-making? arXiv preprint arXiv:2211.15657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.217620Z"},"links":{"cited_paper":"/paper/2211.15657","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:7109216c4ab0b1a19c51749b6af779d8f23c2927bf4587d37a830e3ae01b7427","observation_id":"cddb5748-84c8-4599-8a79-66bcf1635332","resolution":{"observed_at":"2026-08-05T13:46:02.217620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09991","last_updated":"2022-12-21T01:06:18Z","snapshot_observed_at":"2026-08-06T05:32:02.292779Z","submitted_at":"2022-05-20T07:02:03Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09991","snapshot_observed_at":"2026-08-05T13:46:02.350406Z","title":"Planning with diffusion for flexible behavior synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.350406Z"},"links":{"cited_paper":"/paper/2205.09991","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:0fe102a1936e042aeca8b19eb20316106fa312e2ad1a918f83a9bd69ea55d954","observation_id":"fd1ace3d-5848-43db-8f71-c981711f80bb","resolution":{"observed_at":"2026-08-05T13:46:02.350406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:03.886184Z","title":"Ad4rl: Autonomous driving benchmarks for of- fline reinforcement learning with value-based dataset","venue":null,"work_id":"19963ab2-33c7-4b75-9ca8-4820a1fcb5e9","year":2024},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.387100Z"},"links":{"citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:d5d49de8f793428317b226c486b5f01e7a3e8e616b03e6101c9f072c097adc02","observation_id":"4a5fffbe-172a-45b3-8c98-208015532ea9","resolution":{"observed_at":"2026-08-05T13:46:03.957230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03882","last_updated":"2023-09-24T16:32:33Z","snapshot_observed_at":"2026-08-06T13:13:24.072371Z","submitted_at":"2023-08-07T19:24:47Z","title":"Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations","version":2},"cited_work":{"arxiv_id":"2308.03882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.03882","snapshot_observed_at":"2026-08-05T13:46:03.507348Z","title":"Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations","venue":"cs.LG","work_id":"f4e8adad-956e-4e1e-b7e9-717c00a74171","year":2023},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.477661Z"},"links":{"cited_paper":"/paper/2308.03882","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:ae41708282b9aa98bd075e4f9a686c777a238f8f783388c54da2b84c03305078","observation_id":"01f8c809-2436-4020-b774-450034bef383","resolution":{"observed_at":"2026-08-05T13:46:03.559746Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:03.775192Z","title":"Soft adversarial offline reinforcement learning via reducing the attack strength for generalization","venue":null,"work_id":"0bcf2864-84ea-4bc1-be44-5ac1b6adec92","year":2024},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.545337Z"},"links":{"citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:433dfc86b0876af36bf0578b2e89c4205ce7926ec65d34ddca0d42e3cc7c4579","observation_id":"819b1949-d086-48b9-8cad-bc5faae2c2ba","resolution":{"observed_at":"2026-08-05T13:46:03.832525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12819","last_updated":"2025-08-25T02:35:43Z","snapshot_observed_at":"2026-07-06T18:17:21.217971Z","submitted_at":"2024-05-21T14:24:01Z","title":"Large Language Models Meet NLP: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12819","snapshot_observed_at":"2026-08-05T13:46:02.642782Z","title":"Large language models meet nlp: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.642782Z"},"links":{"cited_paper":"/paper/2405.12819","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:3d26ffe1e9050da4d35711c3d3a7215361034957c445bbad0a842d5f402b7fcc","observation_id":"a3c743bb-61f6-4e56-9bbe-68086e6d8572","resolution":{"observed_at":"2026-08-05T13:46:02.642782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:03.675651Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"74cf19d6-a4f4-4628-95af-5b5791df7718","year":2012},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.910684Z"},"links":{"citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:30356d0bc5d1b6c538ecd562f20064b6ee093167622205301e6bea4823bddad6","observation_id":"69d9f2f7-0787-43bb-9a0a-8e948284061b","resolution":{"observed_at":"2026-08-05T13:46:03.699111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-05T13:46:03.161222Z","title":"A survey on knowledge distillation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:03.161222Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:dbd91998b47c9afb73d06995b43d517025d549948e9918c22d5f89a8eabc91bc","observation_id":"08620d10-b74b-4347-b5fd-b48fc279c181","resolution":{"observed_at":"2026-08-05T13:46:03.161222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15587","last_updated":"2021-12-03T05:40:31Z","snapshot_observed_at":"2026-08-06T22:06:23.346843Z","submitted_at":"2021-06-29T17:21:59Z","title":"Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation","version":2},"cited_work":{"arxiv_id":"2106.15587","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.15587","snapshot_observed_at":"2026-08-05T13:46:03.418101Z","title":"Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation","venue":"cs.LG","work_id":"058ba179-e4d4-4fc8-8ab7-47d2ca744f90","year":2021},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:03.192637Z"},"links":{"cited_paper":"/paper/2106.15587","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:91eb050079ac155107aaa644b7351fefbfb3a6e163849c3e4041f1628c04955e","observation_id":"ea991915-d6c7-4e22-a76d-27ddd1176e20","resolution":{"observed_at":"2026-08-05T13:46:03.459519Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01753","last_updated":"2019-02-21T01:17:31Z","snapshot_observed_at":"2026-08-10T09:06:00.813932Z","submitted_at":"2019-01-07T11:28:36Z","title":"Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01753","snapshot_observed_at":"2026-08-05T13:46:03.033891Z","title":"LLM-empowered state representation for reinforcement learning","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:03.033891Z"},"links":{"cited_paper":"/paper/1901.01753","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:7e17ef70590a83ecd6921a3326ad429884c5feeaab966ac3b7d87da0d59e9170","observation_id":"4b80b5fd-0993-424f-8b9e-54b8c6fec6b1","resolution":{"observed_at":"2026-08-05T13:46:03.033891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-05T13:46:02.328405Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.328405Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:4804ccfe196dd747c60cde6d3342354125645a224deab5c3a57589c81b86f7e1","observation_id":"076455a5-efce-4483-a759-dc9dd8131d7f","resolution":{"observed_at":"2026-08-05T13:46:02.328405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10393","last_updated":"2025-07-10T10:09:40Z","snapshot_observed_at":"2026-08-05T12:22:21.565596Z","submitted_at":"2024-04-16T08:48:46Z","title":"Offline Trajectory Optimization for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2404.10393","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10393","snapshot_observed_at":"2026-08-05T13:46:03.307607Z","title":"Offline Trajectory Optimization for Offline Reinforcement Learning","venue":"cs.LG","work_id":"b6296505-5d6e-45c9-8d56-c0b246792a72","year":2024},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:03.231288Z"},"links":{"cited_paper":"/paper/2404.10393","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:04e95e7083cd63c613a52952f6cf7e0d7f72090d42744fe5bc8d01788ef858f6","observation_id":"2ebc30eb-88bc-4c90-a44a-bd7abe79f9f3","resolution":{"observed_at":"2026-08-05T13:46:03.367828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11106","last_updated":"2024-05-17T22:10:23Z","snapshot_observed_at":"2026-08-05T03:50:46.269415Z","submitted_at":"2024-05-17T22:10:23Z","title":"LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11106","snapshot_observed_at":"2026-08-05T13:46:02.788254Z","title":"Llm-based multi-agent reinforcement learn- ing: Current and future directions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.788254Z"},"links":{"cited_paper":"/paper/2405.11106","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:8cd83cd98efc53d610e0f0d0bdb82f9e75c44ce4d36d3e83d7412728ba070ed5","observation_id":"fabc8d4a-808d-47a5-a9f6-17af5f205a5f","resolution":{"observed_at":"2026-08-05T13:46:02.788254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T13:46:02.269056Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.269056Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:85bbf1057d2c37ef23247fa92092aae694c25f62b3449f5e79d00d1622369e2f","observation_id":"d4fabd4e-6e44-4eda-aa65-79ad9c01bfdd","resolution":{"observed_at":"2026-08-05T13:46:02.269056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-05T13:46:02.304215Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:02.304215Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2509.00347"},"observation_digest":"sha256:51015830731a0426dadb44f21c6d6403f2a9fd98b40134af708d4e4125131248","observation_id":"4d68f3ad-e4fc-40e6-be86-ce3a31ed6f15","resolution":{"observed_at":"2026-08-05T13:46:02.304215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00347","last_updated":"2025-08-30T04:02:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T19:57:10.685641Z","submitted_at":"2025-08-30T04:02:33Z","title":"LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":3},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2509.00347."}