{"as_of":"2026-08-14T17:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb3a5cf734dad30df700880c91714806d3fae619708543a190895f20c69dcea3","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:42:59.722920Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.21655/citation-record","integrity":"/paper/2607.21655/integrity","json":"/paper/2607.21655/citation-record.json","paper":"/paper/2607.21655"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:53.688937Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:53.688937Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:7909606593162b82733aaf9efab020ff12a1280f9963b1e1f764d0f0d1a911a9","observation_id":"87a26fa1-ecf1-4d67-aaaa-6eb0c6c3518b","resolution":{"observed_at":"2026-08-01T09:42:53.688937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:53.731458Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:53.731458Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9c7db35bfe2544f1ade7e1602389bd35a9853c4b52407869926acc1c49963a65","observation_id":"12338c29-8366-4507-ad44-a56bc822dd26","resolution":{"observed_at":"2026-08-01T09:42:53.731458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:53.826023Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:53.826023Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:6739c6197cfa39fcec4024658ee738c001c7f9d48b7f335a80089ce77587c239","observation_id":"11275480-e455-42d8-82c5-1ea07d0cc1cb","resolution":{"observed_at":"2026-08-01T09:42:53.826023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:53.902928Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:53.902928Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:c0d8e64d2965a8c3cda822fe041b761cb9755c1c871b32a94518a450d38bbc85","observation_id":"2b062e4c-b0cd-48ad-9444-5423b190dd84","resolution":{"observed_at":"2026-08-01T09:42:53.902928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:53.975971Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:53.975971Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:768159cc6d2e1589326cf924d6e661585794ebf9c913dd1c6b396fc8fb26d08d","observation_id":"af3669d2-a651-423d-999e-0518b4a51276","resolution":{"observed_at":"2026-08-01T09:42:53.975971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.061329Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.061329Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:706279d0d5771b8c37c8b5d0882efb6030826e26e76beee244c7d464fecd2a32","observation_id":"335eaedc-2d3f-41ea-95b9-dc2d7f796a2c","resolution":{"observed_at":"2026-08-01T09:42:54.061329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.116620Z","title":"arXiv preprint arXiv:2512.23703 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.116620Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:b5d2499a188a74609ae5040a399b9439ed3b7926791ea2fd2f69636491ffcd5b","observation_id":"1e7c1eb3-c836-4776-b50d-b80bef7d6e32","resolution":{"observed_at":"2026-08-01T09:42:54.116620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.209517Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.209517Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:430f848ce4f2dba9ad7b36497aa3481a479bdfa0b572776de3ed703c9eae7ad0","observation_id":"8daa4eb7-654d-4023-8445-94527812af02","resolution":{"observed_at":"2026-08-01T09:42:54.209517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.311738Z","title":"arXiv preprint arXiv:2509.17321 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.311738Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:de61bafab87ea2de299a35b06d7af21a80fcba6f8c359278f6406684a415dd98","observation_id":"3c7946d5-2387-4b82-8409-74c4cb5031a0","resolution":{"observed_at":"2026-08-01T09:42:54.311738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.406687Z","title":"arXiv preprint arXiv:2509.15937 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.406687Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9bf705ba9d0df71b2cbdc66fb074e92a62afe6c0c87bc832e5ccddbf5b1e2d6f","observation_id":"55888780-f4c7-483b-b397-2f4b8e65f0a1","resolution":{"observed_at":"2026-08-01T09:42:54.406687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.490768Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.490768Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:520530c90ae8bb19c48a7dde4632ba8a9ca29bdf2ccbf25f41aafb652d76bb7a","observation_id":"52a126e1-0a22-44b5-ae44-22a91dc99b30","resolution":{"observed_at":"2026-08-01T09:42:54.490768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.542844Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.542844Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:6369549ce8d8e8133c62cd29af04831fd820cc77e89268126e39662fcdefc9f2","observation_id":"842f08c8-1528-4ab6-817e-27359f6cdc14","resolution":{"observed_at":"2026-08-01T09:42:54.542844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.618060Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.618060Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:1c839588d43c43936d18f9f992f9166fd507acdd58caa97181b82141816fc2fb","observation_id":"5c491f7c-edce-4113-8136-7bd306797fe6","resolution":{"observed_at":"2026-08-01T09:42:54.618060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.692327Z","title":"2025 , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.692327Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:47428b7c8aad29fb61beb48167fca3d9a6bba775b172450ab3b68c8700375705","observation_id":"21d766fb-70a0-4a5d-a5c9-ae47dd09bf7b","resolution":{"observed_at":"2026-08-01T09:42:54.692327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.767348Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.767348Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:183f2bd79b212d5511159c6b742564a0feaeb3ed798d5160a13865de5af4cdbd","observation_id":"25e2043a-c04a-4a3b-ba71-d8e659a16486","resolution":{"observed_at":"2026-08-01T09:42:54.767348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.836479Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.836479Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:a999e258bc26793dfba7d91a065769fc3cdc4fad748192a2e0191f91ce5573ba","observation_id":"49640ffc-b9c7-42a3-8b4c-0553eb578515","resolution":{"observed_at":"2026-08-01T09:42:54.836479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.916576Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.916576Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:68c85cbd379e4cc4678bf749ea8afcbe4b8c871f80f4540869318f741517d940","observation_id":"e9b26648-018c-4240-94b6-fe65edb03c8c","resolution":{"observed_at":"2026-08-01T09:42:54.916576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:54.976902Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:54.976902Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:beeec8736b0b2b67facafebf07bdd29bbd3729b7caee77c8877e5f2c7e250185","observation_id":"8eea190b-38c2-416d-ace1-fc3ff7dfcce8","resolution":{"observed_at":"2026-08-01T09:42:54.976902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.046588Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.046588Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:14bcc40122aff86953e7230d51925e2af9484a8f0c95073d6d602bfd68cf9c0e","observation_id":"e1f744cf-81dd-4a27-b8a5-286661a0c6f9","resolution":{"observed_at":"2026-08-01T09:42:55.046588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.163468Z","title":"Proceedings of the 41st International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.163468Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:66b18c34850fe7d903b5d00a0f750a6bd0b82160cb7a81253273dc82428d5b50","observation_id":"a767fb5f-e975-430e-8517-455d66437135","resolution":{"observed_at":"2026-08-01T09:42:55.163468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.279345Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.279345Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:dfee9af25eba3b0cba239c857577e408967a62e84fc37344323c7542cfb6d66a","observation_id":"1629c731-6266-42c1-abc6-894b6abb5cb6","resolution":{"observed_at":"2026-08-01T09:42:55.279345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.395401Z","title":"Video Prediction Models as Rewards for Reinforcement Learning , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.395401Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:e0b7b5abbe6a0608ec15e7f98f471e1f95cfab57f340fe51a98bd910744a3b5e","observation_id":"56ef3d28-9f6a-4278-b694-f58a05e2a2f9","resolution":{"observed_at":"2026-08-01T09:42:55.395401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09187","last_updated":"2024-07-12T21:14:32Z","snapshot_observed_at":"2026-08-13T14:21:04.495579Z","submitted_at":"2023-12-14T18:06:17Z","title":"Vision-Language Models as a Source of Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09187","snapshot_observed_at":"2026-08-01T09:42:55.547292Z","title":"arXiv preprint arXiv:2312.09187 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.547292Z"},"links":{"cited_paper":"/paper/2312.09187","citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:fe08fcab65aeaadca2f115c6e4b0e6fca87fdff2e47286401a6c5decf2bffd5d","observation_id":"f7291943-708c-4944-9fe9-03b5eeb91fad","resolution":{"observed_at":"2026-08-01T09:42:55.547292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.656943Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.656943Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:7e3eb4e47cd9ca36cd4310b528f00d9845d463b4b86c9944052c2375d2f0398b","observation_id":"1b03f664-a448-45cc-8f53-50b283aac434","resolution":{"observed_at":"2026-08-01T09:42:55.656943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.777935Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.777935Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:7722b9b7c19bfb4bb47abe55183bf8c7557e9ee1874dc60c3487ee805a9b7edc","observation_id":"ff5eb1c3-2301-477b-8bfd-260f387d4ce1","resolution":{"observed_at":"2026-08-01T09:42:55.777935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:55.920374Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:55.920374Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:d9502dd8d301bf2a1ff1abe0311f81973a5d29ae9db014914f9e7aba5aa57ceb","observation_id":"a11625f6-5cbe-4fab-981b-8f7dcc9ce4d8","resolution":{"observed_at":"2026-08-01T09:42:55.920374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.004052Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.004052Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:0e3d8fe9e2d4ee175f1ae5b7474a260c3f8617551ec2ca1df3105f8b544820d9","observation_id":"d24b17f3-1b19-4d2d-9455-69586d611906","resolution":{"observed_at":"2026-08-01T09:42:56.004052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.171831Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.171831Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:f2f1ff735d12f5efc5e013e4f4d84d0d06087f223e9b9d6ef2b38ebc3e87437b","observation_id":"bdbe127a-12df-408d-b497-9da39eb32410","resolution":{"observed_at":"2026-08-01T09:42:56.171831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.336448Z","title":"2023 , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.336448Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:4e9a2f1773973c4606d62a6c61dce2b799c3c5984b869a223c041f25d411a235","observation_id":"2dbd5720-5b05-4a97-8f09-4fb45fd02356","resolution":{"observed_at":"2026-08-01T09:42:56.336448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.435173Z","title":"2023 , editor=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.435173Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9ca60b72ce9d21563779e9a5aad0245c30b462f50a263250aa1114ab54dd7f60","observation_id":"f6d2c968-2f4f-46b2-959c-8114909fec82","resolution":{"observed_at":"2026-08-01T09:42:56.435173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.488557Z","title":"Proceedings of The 7th Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.488557Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:e414e5e41605e437081fbef6b032d97a7dbbf6a2bfb576a0cfecdfe4fff7d430","observation_id":"03dc9f89-b755-4f7f-8953-606d1db2827e","resolution":{"observed_at":"2026-08-01T09:42:56.488557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.547466Z","title":"2024 , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.547466Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:a47bc07b89b29966d742f62426d2ea9b41ff8dac08d56df1b616cf8f69b3e3ec","observation_id":"2761d320-5a9c-47b9-be0f-ea77985e8014","resolution":{"observed_at":"2026-08-01T09:42:56.547466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.642170Z","title":"Proceedings of The 2nd Conference on Lifelong Learning Agents , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.642170Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:924043172a061453ca34c4821781a6e8b871b73c8948acf6dbb967c5c332a760","observation_id":"c4969328-e16c-4c32-a991-cec88351d7e5","resolution":{"observed_at":"2026-08-01T09:42:56.642170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.717755Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.717755Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:c6dfe1a909d12884f0e580c7a1a257dce8313383cca5a288ab28f0d4b46b0f9c","observation_id":"a935f140-6d3f-43e6-bfcb-e51ca71d5fca","resolution":{"observed_at":"2026-08-01T09:42:56.717755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.783497Z","title":"Proceedings of the 39th International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.783497Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:f20571f68be7ef28b78656ad50eba22fe3191644d2a91a2cd8e5901df6d77bcc","observation_id":"ad4152b9-a8c1-4f20-9b2c-33d04406a344","resolution":{"observed_at":"2026-08-01T09:42:56.783497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.838997Z","title":"Proceedings of The 4th Annual Learning for Dynamics and Control Conference , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.838997Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:3440ccd964c9a39749bd7649a1426f42d6b72d5743f5743618281ce620b0b708","observation_id":"5c04cbb5-b3c2-43d9-9d2b-781e04f3b173","resolution":{"observed_at":"2026-08-01T09:42:56.838997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:56.931841Z","title":"Generalizable Imitation Learning from Observation via Inferring Goal Proximity , url=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:56.931841Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9f23fa45d71ff44983b7c1caf9f96efdb7e5f4670ff43fbaf2ff78e468cf04be","observation_id":"02317693-c487-446d-b414-3693fbd812d1","resolution":{"observed_at":"2026-08-01T09:42:56.931841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.009969Z","title":"Proceedings of the 5th Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.009969Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:4573e1d98e4028674779f6ac00e23e07179700f4bda363f72f6be8ce17c885c9","observation_id":"86c71d88-fd2b-4287-8e16-fe5c9c9ebb6f","resolution":{"observed_at":"2026-08-01T09:42:57.009969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.073873Z","title":"In-The-Wild","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.073873Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:55c6dd654ef5db80a625dfc77711df68c6c709671c240d3a0654ae6b744b6549","observation_id":"43051c59-21a9-4cdb-866f-fe8e3ededae0","resolution":{"observed_at":"2026-08-01T09:42:57.073873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.168438Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.168438Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:41cf1c40fb39ebba55dd9cbbc65e5aa267e3dacc4125404e4b4b311308bdfcf8","observation_id":"502ceac5-2c32-4a0e-8077-d2b9456e6f1e","resolution":{"observed_at":"2026-08-01T09:42:57.168438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.242858Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.242858Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:3b2d47df3cb909d2389b0aa335fc7285f436277c25e5b4f37d8627435b12c26c","observation_id":"abb5f25a-77c7-4c6d-863d-64e4f78d4798","resolution":{"observed_at":"2026-08-01T09:42:57.242858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.294208Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.294208Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:90ae54adc527dd28a5ca75e60c11d074143a7fe59f493c0ac6a5985e9fc6fa8d","observation_id":"308eb37e-3cb5-465b-8c53-0c2342078804","resolution":{"observed_at":"2026-08-01T09:42:57.294208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.386922Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.386922Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:cdc3694544f278067a9194d90f844748eb599f530e193dc6f99b363c19112b6f","observation_id":"87fefff8-d995-4a64-8971-8b6542490e05","resolution":{"observed_at":"2026-08-01T09:42:57.386922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.421634Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.421634Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:67b47962aa34f1f1b61fbbf6f0c1663652e316d811e3fe9f72880fad1446c237","observation_id":"b2e38af2-5810-4ef4-bf27-f3df0b19763b","resolution":{"observed_at":"2026-08-01T09:42:57.421634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.445830Z","title":"GarmentLab: A Unified Simulation and Benchmark for Garment Manipulation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.445830Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:ab0830bfe861653019e089f4e7e0a4710c95804cda5d7d42dc4dd60e71e985ac","observation_id":"43f800ba-f8a8-4a66-bae4-bfad16b56bef","resolution":{"observed_at":"2026-08-01T09:42:57.445830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.615681Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.615681Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:56f3a5ced0267a500510a30afe8804cda09d29270642edd8657a4a0324cd97e5","observation_id":"77bc49db-4a63-4bd5-9f22-045f898a9f3f","resolution":{"observed_at":"2026-08-01T09:42:57.615681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.817149Z","title":"Neural Dynamics Augmented Diffusion Policy , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.817149Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:91083e46ab91b20e11967a1eaecbee188fa03e8ea7de61fa1ed278e625ca92ca","observation_id":"8ab60631-904a-4f6a-b232-6deaf9c0c085","resolution":{"observed_at":"2026-08-01T09:42:57.817149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:57.991473Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:57.991473Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9e56fe56bb43adbe22341e0696521861e95487a6897967dc35d47fc486c3b703","observation_id":"2f5fa1f6-f471-4adc-9d21-8bb9c29d36c8","resolution":{"observed_at":"2026-08-01T09:42:57.991473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:58.204576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:58.204576Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:f698f6ef247d80db062985153dc6b74f890076c2b8c80e1c2c8351334b66834f","observation_id":"bc6c5e60-e3cd-4733-be39-39212986434f","resolution":{"observed_at":"2026-08-01T09:42:58.204576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:58.359798Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:58.359798Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:caeda9cc1c97650aa63c4c52ee9c5fdeb2f77508dd3f33b5a0f313c4e878b459","observation_id":"b0645049-e279-4089-aa3d-62027a53aae4","resolution":{"observed_at":"2026-08-01T09:42:58.359798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:58.537253Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:58.537253Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:207e2d0acaa06966e5f02939c98094e80ffcfdb9c17f482ff3ee23b96da1498b","observation_id":"b75dcce5-f99f-447c-8dc5-e14d959f8915","resolution":{"observed_at":"2026-08-01T09:42:58.537253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:58.706162Z","title":"2026 , url=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:58.706162Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:6e6d0688e7fda6c9e4d29fdaa3d545d518698967cacbb6b2238bfd9d56ff46d4","observation_id":"a05f9b32-af83-4a78-9602-a9a001c5e355","resolution":{"observed_at":"2026-08-01T09:42:58.706162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:58.870811Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:58.870811Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:6c2b125ff5500dc7e82d6b13f0fffc1718ce5ca89fec7da68260ba20694c5a75","observation_id":"eca7360b-ce74-47a0-8ef0-76e8e38b7fd1","resolution":{"observed_at":"2026-08-01T09:42:58.870811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:59.000875Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.000875Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:1077ada59be6303543ae07530512427384051f52a811b5525b4484f92f376731","observation_id":"68723f6c-addc-4202-b4fd-776468b99af0","resolution":{"observed_at":"2026-08-01T09:42:59.000875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:59.180051Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.180051Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:67d30857dc6212cab542d8807e4db94ac53555e558f68bd0655862fac2a2d2d0","observation_id":"02a6f949-1d7c-4f20-b3c8-4dc8647ff067","resolution":{"observed_at":"2026-08-01T09:42:59.180051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04434","last_updated":"2026-07-05T17:58:02Z","snapshot_observed_at":"2026-08-13T01:18:42.931884Z","submitted_at":"2026-07-05T17:58:02Z","title":"RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04434","snapshot_observed_at":"2026-08-01T09:42:59.279636Z","title":"arXiv preprint arXiv:2607.04434 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.279636Z"},"links":{"cited_paper":"/paper/2607.04434","citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:9e4637da53a8bbde3f8a06929c08bae493b675b6000185087421f62a95b39c65","observation_id":"80372b9a-4a07-4bed-a3d3-e8175d9e8026","resolution":{"observed_at":"2026-08-01T09:42:59.279636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-01T09:42:59.379470Z","title":"arXiv preprint arXiv:2506.18088 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.379470Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:e893edc5f9987a7d30379a5bb1325664e5d9a3cc4b17ad9a0ea264c62424f7e0","observation_id":"3a84247b-02e3-43bd-8dce-c8a96d1a9a09","resolution":{"observed_at":"2026-08-01T09:42:59.379470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:59.488148Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.488148Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:274eafa7833b638e7f4b7d7421a8b2c0fcef2b661b17a1c64e2646edf25340a0","observation_id":"912cbfba-dbc2-4084-b964-8b8fb4bf09a9","resolution":{"observed_at":"2026-08-01T09:42:59.488148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:59.621689Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.621689Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:5249977984afc484017cb0a1d3e65721afb87741aefe9581590ddc7576748226","observation_id":"45c6aea9-999d-4054-ab91-8ee005b4ea0c","resolution":{"observed_at":"2026-08-01T09:42:59.621689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:42:59.722920Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T09:42:59.722920Z"},"links":{"citing_paper":"/paper/2607.21655"},"observation_digest":"sha256:95f21d610826ce1f681ddce62c65064d68e44b761c47ca6a6c39b68012cacf86","observation_id":"4193009f-e714-4c36-9a82-e3efec87e1d6","resolution":{"observed_at":"2026-08-01T09:42:59.722920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.21655","last_updated":"2026-07-22T19:29:52Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T10:08:55.073442Z","submitted_at":"2026-07-22T19:29:52Z","title":"Progress Reward Modeling for Robotic Learning: A Comprehensive Survey"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2607.21655."}