{"as_of":"2026-08-21T21:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4af84ab020c0f0dce16854c0bfb512267ec8ec1f33ad37e7f014cb66e8056085","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:22:16.177487Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T04:01:31.928056Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T21:51:30.641060Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"cited_work":{"arxiv_id":"2505.10010","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10010","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imag- inebench: Evaluating reinforcement learning with large language model rollouts.arXiv preprint arXiv:2505.10010","venue":null,"work_id":"0b5d9a5e-d898-4adf-bb7d-471dc34957d7","year":null},"citing_paper":{"arxiv_id":"2604.24729","last_updated":"2026-04-27T17:40:18Z","snapshot_observed_at":"2026-08-12T13:11:55.493073Z","submitted_at":"2026-04-27T17:40:18Z","title":"SpecRLBench: A Benchmark for Generalization in Specification-Guided Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T04:01:31.928056Z"},"links":{"cited_paper":"/paper/2505.10010","citing_paper":"/paper/2604.24729"},"observation_digest":"sha256:2987f423b8d9254424140e41e40bf211d065750b1cb3a3ca247dd251fb0e5e58","observation_id":"65da9b3c-af91-4fe4-867b-48c09c4344dd","resolution":{"observed_at":"2026-05-11T21:51:30.671346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10010/citation-record","integrity":"/paper/2505.10010/integrity","json":"/paper/2505.10010/citation-record.json","paper":"/paper/2505.10010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.725607Z","title":null,"venue":null,"work_id":"afa6b9b2-1916-48f5-bc9d-0eaa59fa21c0","year":1977},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.012007Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d8414d33edc1173312227dbe71fad761cfee3454233f2d309489b75a36bd29d2","observation_id":"9f743604-27f1-41ba-8b19-a8aba4033be0","resolution":{"observed_at":"2026-08-15T21:22:16.729635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-15T21:22:16.017057Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.017057Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:165516fccf14f7ccbcb8da54a0f57405ded5a66b4b6daf2a6a19602564d942d1","observation_id":"b187e487-1d3b-47ae-8d52-c89fead7a742","resolution":{"observed_at":"2026-08-15T21:22:16.017057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.713081Z","title":null,"venue":null,"work_id":"bd33547a-0edb-4617-a54c-a8bb6f114588","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.022030Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:522b3c83d430c5824b1563c2c20f5451eaeda3f66c92aa75456272e87a88a4ab","observation_id":"1e510c66-52ab-4ea7-8a57-8adc8a8fc99a","resolution":{"observed_at":"2026-08-15T21:22:16.717923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.701159Z","title":null,"venue":null,"work_id":"ea2476aa-8b7d-448d-92e3-bf126d974524","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.026377Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:32c3928185d8af78ce3c1e6b0d44552a0f06f500d12aa70bbd37575376574197","observation_id":"a1cabfba-522e-4906-805d-2c7b1659af10","resolution":{"observed_at":"2026-08-15T21:22:16.705099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.688466Z","title":"H., and Bengio, Y","venue":null,"work_id":"3473b8dd-7d99-46b4-a008-4169e0d6da2b","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.030639Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:4aa7502c496185f4b840a8af6bfa9174f0208806331d7bcbe638cf3478481957","observation_id":"aa5e79ce-f043-4fe4-adbf-3c282e25f02b","resolution":{"observed_at":"2026-08-15T21:22:16.692421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.676813Z","title":null,"venue":null,"work_id":"64ae97ce-50ff-42df-95ca-ca222f05fbc5","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.034472Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:cb85a90f9a1c23395408c944563b51e4dd34e7a224dfc7fb3d7a485d9cad7031","observation_id":"532b3888-9ecb-4018-9e22-f74e731c49ef","resolution":{"observed_at":"2026-08-15T21:22:16.680689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T21:22:16.039373Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.039373Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:ea41c4a0fd53aa0b98491674fe0369539a34d7278b0f5656718e58a6c42132ab","observation_id":"e7381cc0-f19a-4c8a-a4ee-5db9e3a7af84","resolution":{"observed_at":"2026-08-15T21:22:16.039373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.664567Z","title":"and Gu, S","venue":null,"work_id":"a2f5535e-644d-439f-a61a-b8054bde5142","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.043862Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:626f8f91b337f819011f6b1d2ddf0201ef025eaf6eab4c0b843b4ed1480b626e","observation_id":"e60411c5-6134-4a86-ba86-7b8fb0c411eb","resolution":{"observed_at":"2026-08-15T21:22:16.668415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.652273Z","title":null,"venue":null,"work_id":"00a47aaf-5aaf-49f4-8882-f97abbd60b11","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.047375Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:ae88ade93a693ff14b719da851298c2c6b3e9d1015ba9d06ba57068f02fbdd62","observation_id":"258a95ab-f5a7-4d2c-8817-6b2de3421209","resolution":{"observed_at":"2026-08-15T21:22:16.656503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.640196Z","title":null,"venue":null,"work_id":"02365c70-9918-4269-a023-3afc6a41bae2","year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.051056Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:ab2568c5cfda4bb682843c56fe269539b7473944db8a8b66fcae87cf55ee29f5","observation_id":"e7eef8cc-ca56-43f0-a063-679dc4c2e17d","resolution":{"observed_at":"2026-08-15T21:22:16.644260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.627499Z","title":"S., Mankowitz, D","venue":null,"work_id":"42381424-d5cc-4cbc-a303-c6cf68c378b7","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.054462Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:21eae2c55af8396648919ee21abce06fa85749b7400bfd4a2cd2024bc264dbed","observation_id":"0f5be4ff-caf9-4627-b612-eff700309295","resolution":{"observed_at":"2026-08-15T21:22:16.631545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-17T07:51:41.384508Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-15T21:22:16.058417Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.058417Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:3a88161ddd695f882ca7a3ac5af36554e0ccd47836781a95c9cbff6f37d6d6b8","observation_id":"3c98b5f2-3f95-4cac-a906-96933cc6fd8e","resolution":{"observed_at":"2026-08-15T21:22:16.058417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.614120Z","title":"Do as I can, not as I say: Grounding language in robotic affordances","venue":null,"work_id":"b2cc5317-83ca-41a7-b3c7-970aaa1bf1b8","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.062228Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:e8c9f413c9de6700fcfa89a1c93a269ad77c0680e4392e0a8b4618bdb4e4c9dd","observation_id":"2c049fdb-8567-439a-ac62-4b8f60ddc5cc","resolution":{"observed_at":"2026-08-15T21:22:16.619680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.600093Z","title":null,"venue":null,"work_id":"d13f8ea7-ced7-49d7-b7bc-617f0873fa92","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.065876Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:c755992a860240ad34f65857bf1be33370eff82c82e4cbe87d0f7423457222cb","observation_id":"df1bc545-17f4-4604-a05d-2c3bd589c519","resolution":{"observed_at":"2026-08-15T21:22:16.604602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.587707Z","title":null,"venue":null,"work_id":"e5a3ab50-b62d-4f7b-a077-645d1b370194","year":2015},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.069944Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:ffa328fc59ce3055c0ab474943298ba8f071fb154235758bd34cc78cfe2616e4","observation_id":"36773faf-f240-4d40-8ce2-a02ccb905f38","resolution":{"observed_at":"2026-08-15T21:22:16.591566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.574401Z","title":null,"venue":null,"work_id":"28152d42-f86d-4bd5-8fd3-d82dd0280cba","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.073964Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:0f3ffd34cff20301651b0466eb974a8d09df8d47240742a5e8905af4c2c8a352","observation_id":"be98b178-e7fa-4b55-871d-765f408d2c04","resolution":{"observed_at":"2026-08-15T21:22:16.578572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.561652Z","title":null,"venue":null,"work_id":"89c798bc-3b44-4b9a-a5ca-2efdf74f4ac1","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.077673Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:f00b80267098974553d4e53ae1bf71530652a2daf9fcafdd759a597b674c33ce","observation_id":"2fe4dfc9-2ca6-4618-920f-0b8387eb6d5a","resolution":{"observed_at":"2026-08-15T21:22:16.565726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-08-21T15:57:22.153221Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T21:22:16.081307Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.081307Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d804f0e640ef4784dbf45931aae461e1701fb876df9e10d75788ed67b29f7210","observation_id":"e7a38d0b-3e54-468e-a543-cdc554804492","resolution":{"observed_at":"2026-08-15T21:22:16.081307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.547957Z","title":null,"venue":null,"work_id":"cbe10735-c5fd-434e-8990-6733a15d9f4e","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.085717Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:73855fa8581a138c68598d2feeda0a1778e2dea30e49f914f3a9a54f5d967d98","observation_id":"be62e38e-be7e-40dc-aa0f-6ef066ea6b6a","resolution":{"observed_at":"2026-08-15T21:22:16.552946Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.533749Z","title":null,"venue":null,"work_id":"72682d42-22fa-4b6e-bcb6-de3777bee3c4","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.089878Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:a3276fc10cfdb0af5e3bc94f955319fde8117f7476ff043418533665bf3ea8aa","observation_id":"6d754aa9-eb23-47f1-8f9d-bdfd64665d3f","resolution":{"observed_at":"2026-08-15T21:22:16.537809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.519187Z","title":null,"venue":null,"work_id":"50a579f7-4e43-4b24-a1b2-72b41291356e","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.093700Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:02e1f45d10cb4ea67cd34d89bea5bac1003ba304f187e34dd3441d09ebbdd619","observation_id":"cf4be6e9-9218-4b69-b9db-669d9fc65961","resolution":{"observed_at":"2026-08-15T21:22:16.524667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.504782Z","title":null,"venue":null,"work_id":"fc186d04-c9f2-468a-b3b3-43e5988ba856","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.097483Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:cc4e26b0a6956d4e5f105a6da9799c6dc32a32bc3bb6a66146526717e11933f2","observation_id":"025ee99f-bf04-4c1a-8815-8403751cdee9","resolution":{"observed_at":"2026-08-15T21:22:16.509317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.490853Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"6d8a1a0b-a94d-467d-88e0-d96e3715a057","year":2015},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.101493Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:a8c5c49609974bb2547a5a36c7f7c42f32a970a6f5edf6a10bf8566e3b0e8f2a","observation_id":"ec5d5ed8-4726-4d1c-9841-38627c19163a","resolution":{"observed_at":"2026-08-15T21:22:16.495285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.479000Z","title":null,"venue":null,"work_id":"496a8d53-8997-4fc0-b5ca-f28d54b59388","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.105223Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:dc215ca47089be98207887cb4286031b2daaedab89b6b16a5444ddeb7ca9bd52","observation_id":"64f485e8-b01e-4701-920a-784e9f60904f","resolution":{"observed_at":"2026-08-15T21:22:16.482776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.467732Z","title":null,"venue":null,"work_id":"c18066b3-e8ee-4f67-9809-19da150e553e","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.108784Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:55e9ab8d8325dcdebbcdd917ce5851cada0a63ff1d8ea1c7f6a33e2feb26964f","observation_id":"a70fdaaa-dbaa-4077-8426-192db4bd1d41","resolution":{"observed_at":"2026-08-15T21:22:16.471536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.456025Z","title":null,"venue":null,"work_id":"345d27de-b219-43d1-a26f-71b2b6ca538e","year":2024},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.112415Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:2fca3c6bd8be2c028d4bd2db038b064225439d2f6bca73c3b778cbd9c3d0fd87","observation_id":"a7fcff16-5fc5-4c26-b633-f1415e2fb63c","resolution":{"observed_at":"2026-08-15T21:22:16.459767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.444780Z","title":null,"venue":null,"work_id":"9c357817-bfbe-4210-b70d-9f1e8be78c9f","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.116289Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:c5d3dbcb9dc8f1ac625a8455eaa94e90ce4d4a0dca7ef349ed6165ab2c469939","observation_id":"cb935178-fb0f-49c7-ba51-0d90fc1509b6","resolution":{"observed_at":"2026-08-15T21:22:16.448195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.431995Z","title":null,"venue":null,"work_id":"b6a81b5d-dbaf-4db4-8fb1-a3dca0d33cf0","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.120356Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:4783411cc719addf6742efeca9cc23d5fd53660b6b9cb693e461b3028944cc60","observation_id":"b66207bb-fb2d-4838-8d5e-a1fd8d87745b","resolution":{"observed_at":"2026-08-15T21:22:16.435659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.419972Z","title":null,"venue":null,"work_id":"02c85ecf-fb3a-4b67-af64-b602d2c931fe","year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.124410Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:60baeb4b574e87c303db9d59fecbd56772386a8222ab5d2e3d079daae3250236","observation_id":"4fa7d640-1e1e-4212-a640-568bcda5038b","resolution":{"observed_at":"2026-08-15T21:22:16.423658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.407512Z","title":null,"venue":null,"work_id":"86120e58-6956-4aa5-a40e-f96430e74acd","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.128254Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:a8423a56aee0d2cb5efafbb9b448bf0da04a6d0f4218a0121563197b737954f9","observation_id":"382496c0-982f-41d6-89d9-1fea6ff90427","resolution":{"observed_at":"2026-08-15T21:22:16.412018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.396401Z","title":"and Imai, M","venue":null,"work_id":"f26be40e-ec59-4cda-b59b-41273f69b449","year":2022},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.131975Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:e4dc9d69854f69fc821139d34751768f04e0be1c4e79d583501164930b052c86","observation_id":"3d8398ea-a741-4f95-91b4-cf08a8b3e681","resolution":{"observed_at":"2026-08-15T21:22:16.400282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.384848Z","title":null,"venue":null,"work_id":"f54e54a7-5482-4267-9ec5-a76be641c0cf","year":2016},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.135578Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:bc3e600cad04da1270b6626b6826c87ae7fd3870456212b759fe758ca13a9581","observation_id":"e87c4343-e529-4f5d-8a4c-3350f45b347c","resolution":{"observed_at":"2026-08-15T21:22:16.388736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.373211Z","title":null,"venue":null,"work_id":"5f84ab1d-2992-46ff-a9a6-50d38d5d6317","year":1998},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.139088Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:e74c373f2e73f85fd7bd63c93b6ce656b8e4de806191503453be6073b2eec8c0","observation_id":"17cb33e6-ab13-435d-9b11-20f67caed28f","resolution":{"observed_at":"2026-08-15T21:22:16.377232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-20T08:13:02.541942Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-15T21:22:16.142589Z","title":"P., and Riedmiller, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.142589Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:6536d68842a72a07b9a1ca2e99f020171103e83b28f64c2e72d637d33b57593f","observation_id":"90bb5f1d-81a0-4d9e-96e5-70bce867cb92","resolution":{"observed_at":"2026-08-15T21:22:16.142589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.362078Z","title":null,"venue":null,"work_id":"2fd7e46a-dacd-44bd-840a-55c761c4c946","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.146475Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:430f04e30572ad58d96373aa491c577b89bc978328496b5f0b20af5d7553a01c","observation_id":"1b8cb69c-cc35-4fb9-8883-49224d9074c9","resolution":{"observed_at":"2026-08-15T21:22:16.365666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.350861Z","title":null,"venue":null,"work_id":"ba8c2389-8ecb-4aa8-9c01-aaf9bec54dc4","year":2012},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.150059Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:f8b8fe4cbe768fa94dfc5aa6cd1372a266a5f8347acfb3f1d58a855b6758c2a1","observation_id":"86f042a2-61b4-46bc-b98f-60c9518aa83d","resolution":{"observed_at":"2026-08-15T21:22:16.354348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T21:22:16.153736Z","title":"LLaMA 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.153736Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:eda78408b775b7562dcda3f876348d67dfff12268c0daa58ad179f2f3fcc305c","observation_id":"b8782f6f-d863-4a1e-9c44-4a8f007b87cb","resolution":{"observed_at":"2026-08-15T21:22:16.153736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.336977Z","title":"u l c ehre, C ., Wang, Z., Pfaff, T., Wu, Y., Ring, R., Yogatama, D., W \\","venue":null,"work_id":"50b43e1f-7fa9-49b4-bb21-dc31beac6dd5","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.157590Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:13eea2a288e055558c80db1b4d29ce3332f9fe30dd6a008b40a48bba17b29513","observation_id":"59e916c3-6eb9-4bb5-b523-1141e99c4ea8","resolution":{"observed_at":"2026-08-15T21:22:16.342220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.324412Z","title":null,"venue":null,"work_id":"3f9dc493-eb49-4bf0-9ea0-5d20c77155c9","year":2025},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.161170Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:79501f74e372112de13d51dbe2497967d6bbeac94d93e6b16aac1b2c32b0786d","observation_id":"c505a9b7-d739-4e54-841f-f139b136a954","resolution":{"observed_at":"2026-08-15T21:22:16.328383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.312008Z","title":null,"venue":null,"work_id":"9e59689c-bf87-498e-983e-f10fb04abc43","year":2025},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.164868Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:cb759b0d22c5dca3a57ea7c59e3c9911da83560ec6490df80f797829e56e1b44","observation_id":"64a4fd18-9ab7-4fe3-ba58-00b244f03700","resolution":{"observed_at":"2026-08-15T21:22:16.316619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.300434Z","title":null,"venue":null,"work_id":"e923f5d9-c5f8-473b-bd89-6457f25e4329","year":2021},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.169209Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:d84f8e27cd8bffd84d71884c741dac16f3bf8004aa7ea3f5119f70d29cd4b659","observation_id":"b6ddf42e-850a-4238-bdcb-9ea23f47d81f","resolution":{"observed_at":"2026-08-15T21:22:16.304331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.288338Z","title":null,"venue":null,"work_id":"9bf47853-c917-46cf-b177-ffc814a65f46","year":2019},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.173285Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:df9ba6b7e6dafa48c89edb93c632e20e816b0f002de4f95942b1d639bc16844a","observation_id":"102ddb5d-2b6a-4e60-9c83-7ce77da78c77","resolution":{"observed_at":"2026-08-15T21:22:16.292240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:22:16.274703Z","title":"Y., Levine, S., Finn, C., and Ma, T","venue":null,"work_id":"2bf9eec5-3245-4926-aa7b-9b6aeaeaa1f9","year":2020},"citing_paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T21:22:16.177487Z"},"links":{"citing_paper":"/paper/2505.10010"},"observation_digest":"sha256:143627150cbdf64412568a190f3ebde1bf2ec558526a3107fc7f6ecb512aeb22","observation_id":"04a14512-33bb-4c32-82e7-0e19e3871de5","resolution":{"observed_at":"2026-08-15T21:22:16.279666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10010","last_updated":"2025-05-15T06:45:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T12:02:34.741857Z","submitted_at":"2025-05-15T06:45:37Z","title":"ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2505.10010."}