{"as_of":"2026-08-18T22:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3cd8af25fc6cdca012f0cb7dee977832673c76331d24359e52a2faacc7673ccf","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:21:34.060079Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13026/citation-record","integrity":"/paper/2608.13026/integrity","json":"/paper/2608.13026/citation-record.json","paper":"/paper/2608.13026"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.453641Z","title":"2026 , eprint=","venue":null,"work_id":"f39938be-4dc3-41fc-8816-f081305412e6","year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.676420Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:b5f2e8dca2a360a723da35092a001915a2013cc6e8126f1bb3a931a4696d8e91","observation_id":"869da127-0603-4a4c-ab34-7203f8d9e544","resolution":{"observed_at":"2026-08-15T18:21:35.458290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.435640Z","title":"2025 , eprint=","venue":null,"work_id":"5f91c990-c88b-4cb7-8c57-a51d4a55b619","year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.694079Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:63c073d31a06193c9996c2d464033136c34448686a6c57cf8908956d818c02cf","observation_id":"a65ec208-8e12-4bb8-b13e-7542844a638f","resolution":{"observed_at":"2026-08-15T18:21:35.442159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.412382Z","title":"2025 , eprint=","venue":null,"work_id":"3aa884af-202b-4ac3-a33c-e9347ca7fc8a","year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.708722Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:6b63bb3938f499a97816b71a611ba0b95a2e642ae886910f7e7d7e0c07bcba53","observation_id":"edf3e6e3-82cb-4d7f-8356-2fbacf0a710c","resolution":{"observed_at":"2026-08-15T18:21:35.418731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.717518Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.717518Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:722994b4f60b9a2faa1d1c4afb7e17bd58a097f7e56a60fb18ecac9b864333d0","observation_id":"3a46a949-f91e-4bc1-b018-29db7b10cf98","resolution":{"observed_at":"2026-08-15T18:21:33.717518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.732528Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.732528Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:fb179eac2366da8d931508387387e09790df73948db6bc0f3ebb5ae91a08c38a","observation_id":"9d75a46c-61e7-41d8-af41-bbd2cc248713","resolution":{"observed_at":"2026-08-15T18:21:33.732528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.748196Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.748196Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:507694b62000594932198a79b3d81cc49d859433d3e83481078923307857a094","observation_id":"8c46405b-e01b-4803-a7fb-eff70999bb0b","resolution":{"observed_at":"2026-08-15T18:21:33.748196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.310807Z","title":"2024 , eprint=","venue":null,"work_id":"5ba3f488-14b7-4dbe-a24b-ac2b96ed21e5","year":2024},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.758361Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:9a69377abdc4da005919a63116a6cf81f1b00e546f55f19279879cf965003cfa","observation_id":"8b708809-6225-4c7f-8ff2-b9e994a6bd60","resolution":{"observed_at":"2026-08-15T18:21:35.318982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.770823Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.770823Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:6a95af96b1ca536428ea5503f8a5d0649a1a37d411c3e3f0b91a9e3763ec349f","observation_id":"682b361c-f657-4973-8262-36bfb41fcbbf","resolution":{"observed_at":"2026-08-15T18:21:33.770823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.783172Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.783172Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:8e918536d2be75e90879b2cc0cf1fdc28bfc474aeb0a46d5f243d69c24ca43a9","observation_id":"a5f7eb8f-9713-4f83-b856-48b733bc1ed5","resolution":{"observed_at":"2026-08-15T18:21:33.783172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.796752Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.796752Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:ae8299bbe0d447eec0d1f496d6b7132c736ec55774ba09cb57a9a1db123dd04f","observation_id":"1d69bc32-d0ce-410f-bea8-2561a50cf2eb","resolution":{"observed_at":"2026-08-15T18:21:33.796752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.802821Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.802821Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:27f57dcee6761ec18f10aa147c9cc8e93d67ec0564bb02c183e8e5009e93d05f","observation_id":"f7669d75-4a38-44d6-b00f-fa8d48395e8c","resolution":{"observed_at":"2026-08-15T18:21:33.802821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.812967Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.812967Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:713a44f3c2aaa2854f27ca55e02d15344c7697ab36741103acb37f458829f542","observation_id":"afb8e98f-fbc7-4cd6-bd49-cc06cdef7786","resolution":{"observed_at":"2026-08-15T18:21:33.812967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.139002Z","title":"2026 , eprint=","venue":null,"work_id":"fc132b75-6094-465d-904a-b5f72893169f","year":2026},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.826957Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:072dae340a279a4151ab383d63de3bab449a6d43e89e2793373432f53dbd51b6","observation_id":"ad7425d2-83b8-4f67-86a0-1c4309d05b77","resolution":{"observed_at":"2026-08-15T18:21:35.147811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-15T18:21:33.843856Z","title":"arXiv preprint arXiv:2406.09246 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.843856Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:fe4cc24164514c0a4ea41eb84bcf360876a4da6a894048955cbf6efd8e9459d8","observation_id":"434ab39b-75c8-4f47-98cf-9971e41f8b79","resolution":{"observed_at":"2026-08-15T18:21:33.843856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07395","last_updated":"2025-05-12T09:48:03Z","snapshot_observed_at":"2026-08-16T20:05:19.058376Z","submitted_at":"2025-05-12T09:48:03Z","title":"ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07395","snapshot_observed_at":"2026-08-15T18:21:33.850650Z","title":"arXiv preprint arXiv:2505.07395 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.850650Z"},"links":{"cited_paper":"/paper/2505.07395","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:5abc0d5347f65974793ad07b99b08678db33247af1d5e6f8b66722116fa1f623","observation_id":"899c45df-f990-45da-8988-4ce91fb96a9d","resolution":{"observed_at":"2026-08-15T18:21:33.850650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-15T18:21:33.858488Z","title":"arXiv preprint arXiv:2509.09674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.858488Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:30fc13586d2395167e9b6fcbd45feae45ab23777d4eb736722d7860fc4ef3d8d","observation_id":"ddecd92c-4332-4e6e-96a4-82b697484ac0","resolution":{"observed_at":"2026-08-15T18:21:33.858488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.867217Z","title":"arXiv preprint arXiv:2511.09515 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.867217Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:0621dfac3bf9c93d25144d7853349dfdc4d9e6bd920682bb377c03977d5a4aea","observation_id":"7ab6a76f-501a-484c-9f1f-5cd8834cc9ca","resolution":{"observed_at":"2026-08-15T18:21:33.867217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.877681Z","title":"arXiv preprint arXiv:2510.00406 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.877681Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:0a805b2fdb1a29fa10aca9a6e57280ac7ffc067b19fe1b5384c73a9377d3c9f5","observation_id":"ab3ebb63-bbb8-4840-8d38-a33ff3daeb17","resolution":{"observed_at":"2026-08-15T18:21:33.877681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.889487Z","title":"arXiv preprint arXiv:2511.00091 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.889487Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:0d15520948cff1a93ce0887b4e28d4e5a162d7babf7ab450d2ae49db57e55a34","observation_id":"ff355e59-c5f4-4dee-a610-8c75c9d1ce71","resolution":{"observed_at":"2026-08-15T18:21:33.889487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.00037","last_updated":"2026-07-27T06:20:18Z","snapshot_observed_at":"2026-08-17T18:50:10.943129Z","submitted_at":"2025-09-26T14:42:23Z","title":"RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.00037","snapshot_observed_at":"2026-08-15T18:21:33.899884Z","title":"arXiv preprint arXiv:2510.00037 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.899884Z"},"links":{"cited_paper":"/paper/2510.00037","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:fde3812cff0335aa98919a56b8369c7ffebe855325c81abc2aa7391f6354bf2d","observation_id":"463ffd35-cc7a-4d8a-9694-0c890eb33c4d","resolution":{"observed_at":"2026-08-15T18:21:33.899884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-08-17T15:25:05.328906Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-08-15T18:21:33.909439Z","title":"arXiv preprint arXiv:2505.17016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.909439Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:3708d9e90dcd2dab2d11e36c5c9e596aecc13f411b5f21b920f9cb7fa92a68a2","observation_id":"f9f1cae7-c5cd-4a06-ab10-9b978c160cc7","resolution":{"observed_at":"2026-08-15T18:21:33.909439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.927727Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.927727Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:e1fcb4648a2430ef7aef89c04fc2c9498ad17b2ffb4603f669756b61009ea713","observation_id":"7c113e5e-74d7-4871-9a54-1e942ab25433","resolution":{"observed_at":"2026-08-15T18:21:33.927727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.069485Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"75f59436-1353-42d7-8ece-6d920b3eca95","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.947351Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:bc8b617f1fd55af6c42eb41f58da603b7289bf94194193fdc142833314f73753","observation_id":"a3b986ed-abf6-4da0-bb13-9bb623b6c8ef","resolution":{"observed_at":"2026-08-15T18:21:35.079596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14108","last_updated":"2022-06-28T18:39:18Z","snapshot_observed_at":"2026-08-16T18:04:33.227548Z","submitted_at":"2020-09-29T15:48:02Z","title":"Align-RUDDER: Learning From Few Demonstrations by Reward Redistribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14108","snapshot_observed_at":"2026-08-15T18:21:33.953684Z","title":"arXiv preprint arXiv:2009.14108 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.953684Z"},"links":{"cited_paper":"/paper/2009.14108","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:052a0193288b3c0eafa178e12b21167d62ea845f29b0417ed71e94146af8eb5c","observation_id":"d60282f9-1343-48c8-9ff0-4e97a6bd045a","resolution":{"observed_at":"2026-08-15T18:21:33.953684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:35.040695Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"746d9f91-e88b-49cb-aa2f-bbd920fb01a9","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.964464Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:d1317794493bd8b94b551580497c60a0e4dbc3164916b20de556e8d32a758134","observation_id":"cad20952-1a16-4d52-b11c-c675fbc8d1ff","resolution":{"observed_at":"2026-08-15T18:21:35.053161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01876","last_updated":"2025-06-17T17:54:41Z","snapshot_observed_at":"2026-08-17T22:25:12.546901Z","submitted_at":"2025-02-03T23:08:42Z","title":"Reinforcement Learning with Segment Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01876","snapshot_observed_at":"2026-08-15T18:21:33.975739Z","title":"arXiv preprint arXiv:2502.01876 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.975739Z"},"links":{"cited_paper":"/paper/2502.01876","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:cccf4edf4bed92053b3a21c40fc3d21fafbc254c1af0207a0427bc4932450994","observation_id":"e5a35949-7b26-4bf3-b165-64b8ebb71333","resolution":{"observed_at":"2026-08-15T18:21:33.975739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:33.989588Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:33.989588Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:ecbbdf802f2844ad796f0691d73813c5c0a46b1cfa6544213cca16fbe5f82c85","observation_id":"79542b24-c7f5-4ec2-b3f4-de899a5c6fe8","resolution":{"observed_at":"2026-08-15T18:21:33.989588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25358","last_updated":"2026-04-27T02:56:51Z","snapshot_observed_at":"2026-08-14T22:38:01.270858Z","submitted_at":"2025-09-29T18:07:54Z","title":"SARM: Stage-Aware Reward Modeling for Long Horizon Robot Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25358","snapshot_observed_at":"2026-08-15T18:21:34.003593Z","title":"arXiv preprint arXiv:2509.25358 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.003593Z"},"links":{"cited_paper":"/paper/2509.25358","citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:594cf560343e56be419f4ffabaa2314623476b189640f56e719c3b7bb62f353a","observation_id":"0395fe38-777a-41f1-8c98-d990af966289","resolution":{"observed_at":"2026-08-15T18:21:34.003593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.966254Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"0dc0a15d-d341-49d3-9434-8527b1a709fe","year":2018},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.015049Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:9483b1b28555f911726e88532f63433345e6e0f7bfd02fde208c9bd543bdd9c1","observation_id":"189c229c-13e8-4f0b-a5f7-f05ecb87fa2e","resolution":{"observed_at":"2026-08-15T18:21:34.971063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.923108Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"cf365eaa-0d8a-4684-8244-24831cb5b0bf","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.023324Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:d19f582e5fff30b2653b17f90641a1859ae9a5648dd174cde957b222d2958332","observation_id":"6b6b3e3d-3f48-404e-9d3f-d6cb41d27881","resolution":{"observed_at":"2026-08-15T18:21:34.930931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.884025Z","title":"Conference on Robot learning , pages=","venue":null,"work_id":"2936439b-897e-4536-bbba-8c733af76cfe","year":2020},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.029391Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:c1932d627ddfbb7e96a7e7e2f8894f11ff3ee79fe96c759f68fe6a16f5e49d9f","observation_id":"05e21ac1-ce4c-4a78-a8e7-e3e48570d794","resolution":{"observed_at":"2026-08-15T18:21:34.891557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.842643Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":"820fb84f-3d10-4a24-b32d-b44c27ffcd0b","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.040918Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:27af2ff1ce3aace4e5b241439971e5f085392ba483520ee67c974315339ff45a","observation_id":"86dd38a3-2008-47c8-ac77-b67ebdc99271","resolution":{"observed_at":"2026-08-15T18:21:34.855099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.806903Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":"52402711-cbf6-4e02-bd3e-ca6d95af2118","year":2023},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.048526Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:0b13673f31e0f2f1719dc8b17dafcc890e9cb1754eca1060db23db99e15ee4a5","observation_id":"1b351643-2240-4a64-a884-054ec0cd7cd7","resolution":{"observed_at":"2026-08-15T18:21:34.816203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:21:34.772482Z","title":"8th Annual Conference on Robot Learning , year=","venue":null,"work_id":"d76a580f-9585-416a-88c0-a66cc66d546e","year":null},"citing_paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:21:34.060079Z"},"links":{"citing_paper":"/paper/2608.13026"},"observation_digest":"sha256:8626decf08f176beb0e59021cf9c4cf279119898b81721d9e818811192ac4a11","observation_id":"b4367387-7bd3-45b6-988d-1b16a760ed11","resolution":{"observed_at":"2026-08-15T18:21:34.780841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13026","last_updated":"2026-08-13T09:54:14Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T10:59:38.876278Z","submitted_at":"2026-08-13T09:54:14Z","title":"Temporal GRPO: Beyond Trajectory-Level Credit in Vision-Language-Action Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.13026."}