{"as_of":"2026-08-10T14:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8e2a7152eb5b70a62fe58ce4e9492f6b3a961fde0ac615e5f04bdb35f451a4b","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:06:06.951316Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06701/citation-record","integrity":"/paper/2507.06701/integrity","json":"/paper/2507.06701/citation-record.json","paper":"/paper/2507.06701"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00597","last_updated":"2022-03-22T10:14:14Z","snapshot_observed_at":"2026-08-02T19:26:55.644557Z","submitted_at":"2021-12-01T16:12:32Z","title":"Wish you were here: Hindsight Goal Selection for long-horizon dexterous manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00597","snapshot_observed_at":"2026-08-06T19:06:06.116005Z","title":"Davchev, T., Sushkov, O","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.116005Z"},"links":{"cited_paper":"/paper/2112.00597","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:fb0f5c0bea05dd74e3bc5e6bb527ded77369e75123dc72d97b451c00796e6b85","observation_id":"a27a6172-f7a0-46cf-b531-e4a07e871936","resolution":{"observed_at":"2026-08-06T19:06:06.116005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-08T03:18:33.595658Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-06T19:06:06.602130Z","title":"Reed, S., Zolna, K., Parisotto, E., Colmenarejo, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.602130Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:b56798a4e48d8b065497cf256beeb91a167a8368fd6367321823f523e651cf30","observation_id":"35e2ba22-e5ea-4da3-aa74-c9507fab7691","resolution":{"observed_at":"2026-08-06T19:06:06.602130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:07.413262Z","title":null,"venue":null,"work_id":"75713d0d-854c-4258-adc4-93ad7c3ea71d","year":2016},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.743130Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:780f18a7004dea1bc54e85a0f21c5c2a8779cd7f4a1085f0490e50f59b5c2fc3","observation_id":"1d3d755d-d3b6-4273-a0a9-604db3f09052","resolution":{"observed_at":"2026-08-06T19:06:07.444819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13885","last_updated":"2020-11-27T18:20:04Z","snapshot_observed_at":"2026-07-06T10:18:28.593525Z","submitted_at":"2020-11-27T18:20:04Z","title":"Offline Learning from Demonstrations and Unlabeled Experience","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13885","snapshot_observed_at":"2026-08-06T19:06:06.902037Z","title":"Zolna, K., Novikov, A., Konyushkova, K., Gulcehre, C., Wang, Z., Aytar, Y ., Denil, M., de Freitas, N., and Reed, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.902037Z"},"links":{"cited_paper":"/paper/2011.13885","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:2a2036116df18e3dfccb714736da9cf49c39267c6de61a85317f99522d40aff3","observation_id":"99c2d47e-7fff-4ee7-b1fd-7501c86f79c6","resolution":{"observed_at":"2026-08-06T19:06:06.902037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:07.279060Z","title":null,"venue":null,"work_id":"4532ccc9-a813-41b1-857c-caf56426a5a3","year":2023},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.951316Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:b117dcfe72ea9f6ca3c070ea32f8a48102c0063b81b35f5aadb70f2fc8c69867","observation_id":"9c306700-d951-45f0-8fea-32d6a439cce9","resolution":{"observed_at":"2026-08-06T19:06:07.318510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-08-09T02:27:34.152063Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11610","snapshot_observed_at":"2026-08-06T19:06:06.248583Z","title":"cc/paper_files/paper/2014/file/ 5ca3e9b122f61f8f06494c97b1afccf3-Paper","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.248583Z"},"links":{"cited_paper":"/paper/2210.11610","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:671246ce75690f2c15fd2ccfea6d58977bf0f6f76c1013c2960cbd5dda6f7b77","observation_id":"379b2b3e-48a3-4756-a055-b3f92a1131a7","resolution":{"observed_at":"2026-08-06T19:06:06.248583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.04888","last_updated":"2016-03-11T11:02:00Z","snapshot_observed_at":"2026-07-06T04:24:07.477067Z","submitted_at":"2015-07-17T09:30:03Z","title":"Maximum Entropy Deep Inverse Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.04888","snapshot_observed_at":"2026-08-06T19:06:06.805435Z","title":"cc/paper_files/paper/2018/file/ 4aec1b3435c52abbdf8334ea0e7141e0-Paper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.805435Z"},"links":{"cited_paper":"/paper/1507.04888","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:30ecb6f8cc8f55b6f6b69252c8972e45d13d23d402d9376732b0b0853c5d7338","observation_id":"29bfdde9-336a-4003-b743-3b7accb25f0d","resolution":{"observed_at":"2026-08-06T19:06:06.805435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:06.454510Z","title":"Kwon, T., Palo, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.454510Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:31f9adc00de649997e433f75818d7e4b2c48f38e8282d4e7d98317fc0c21b1df","observation_id":"4a047633-9609-4812-8932-74bf9035e92d","resolution":{"observed_at":"2026-08-06T19:06:06.454510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07749","last_updated":"2021-06-10T23:54:34Z","snapshot_observed_at":"2026-08-06T05:54:55.251384Z","submitted_at":"2021-04-15T20:10:11Z","title":"Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07749","snapshot_observed_at":"2026-08-06T19:06:06.043894Z","title":"Chebotar, Y ., Hausman, K., Lu, Y ., Xiao, T., Kalashnikov, D., Varley, J., Irpan, A., Eysenbach, B., Julian, R., Finn, C., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.043894Z"},"links":{"cited_paper":"/paper/2104.07749","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:9b088000b0899751dfd8a81544430933d8100f37828f0e9609ce0bda5b09a341","observation_id":"98b7e95c-a3b6-4886-ab6d-1702aa029fe1","resolution":{"observed_at":"2026-08-06T19:06:06.043894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.05032","last_updated":"2019-12-10T22:31:09Z","snapshot_observed_at":"2026-08-09T18:56:44.864560Z","submitted_at":"2019-12-10T22:31:09Z","title":"Imitation Learning via Off-Policy Distribution Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.05032","snapshot_observed_at":"2026-08-06T19:06:06.332378Z","title":"Kostrikov, I., Agrawal, K","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.332378Z"},"links":{"cited_paper":"/paper/1912.05032","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:394e2f1a86465604dad9edb1aabccad8a3cb23479248296e46ee533b09c36046","observation_id":"a695a859-fe68-432b-9b3f-443714294e47","resolution":{"observed_at":"2026-08-06T19:06:06.332378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01369","last_updated":"2024-12-09T14:26:42Z","snapshot_observed_at":"2026-08-04T00:02:01.409816Z","submitted_at":"2024-09-02T16:48:57Z","title":"Imitating Language via Scalable Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01369","snapshot_observed_at":"2026-08-06T19:06:06.864052Z","title":"org/CorpusID:265609417","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.864052Z"},"links":{"cited_paper":"/paper/2409.01369","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:891d01a7a8af260b068b9d8068987269fc8e7a15b55078a8b779edff0af4163d","observation_id":"d3dbb16b-69ea-4a80-9af1-4462da4e71b3","resolution":{"observed_at":"2026-08-06T19:06:06.864052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:06.677382Z","title":"org/CorpusID:269605913","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.677382Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:65da32f845fe38fed30183b87da3d8f6fa629c1dc8d251b82482fa75f705d278","observation_id":"a681f6c3-2c41-460e-9cd3-9279e8e30a02","resolution":{"observed_at":"2026-08-06T19:06:06.677382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T14:35:59.689546Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2507.06701."}