{"as_of":"2026-08-21T18:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e48a412c9232d104fe8283d5489612e44a42e571ac62be104c0892e1389ec7c","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:34:16.621055Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T00:23:04.763773Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T23:37:27.637033Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2508.11049","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.11049","snapshot_observed_at":"2026-07-02T23:37:27.637033Z","title":null,"venue":null,"work_id":"0df04160-e20c-4653-9275-a0090b10df58","year":2025},"citing_paper":{"arxiv_id":"2605.24934","last_updated":"2026-05-28T10:10:45Z","snapshot_observed_at":"2026-08-21T06:21:14.301440Z","submitted_at":"2026-05-24T08:26:41Z","title":"HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T01:02:58.035784Z"},"links":{"cited_paper":"/paper/2508.11049","citing_paper":"/paper/2605.24934"},"observation_digest":"sha256:8ee113a9926d7832abf834a99f6ec3abf383a79c391025bd6cf2b4c8a310c149","observation_id":"6e638db2-5f31-415b-b615-fc95019e14fd","resolution":{"observed_at":"2026-07-01T15:45:48.690090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2508.11049","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.11049","snapshot_observed_at":"2026-07-02T23:37:27.637033Z","title":null,"venue":null,"work_id":"0df04160-e20c-4653-9275-a0090b10df58","year":2025},"citing_paper":{"arxiv_id":"2606.08828","last_updated":"2026-06-07T20:45:47Z","snapshot_observed_at":"2026-08-11T00:16:31.280930Z","submitted_at":"2026-06-07T20:45:47Z","title":"Video2Sim2Real: Full-Stack Autonomous Dexterous Skill Acquisition from a Single Human Video","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T18:05:27.871988Z"},"links":{"cited_paper":"/paper/2508.11049","citing_paper":"/paper/2606.08828"},"observation_digest":"sha256:d3dc95be48b8d9793574fe276d1e3b305317bb82197bd0d74bb674733c181262","observation_id":"4e1ef823-aea7-4996-bf5f-564dc17c4738","resolution":{"observed_at":"2026-07-02T23:37:27.638497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11049","snapshot_observed_at":"2026-07-12T00:23:04.763773Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03723","last_updated":"2026-07-04T06:11:03Z","snapshot_observed_at":"2026-08-13T06:29:46.604899Z","submitted_at":"2026-07-04T06:11:03Z","title":"OmniTacTune: Policy-Agnostic Real-World RL for Tactile Residual Adaptation of Visual Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T00:23:04.763773Z"},"links":{"cited_paper":"/paper/2508.11049","citing_paper":"/paper/2607.03723"},"observation_digest":"sha256:203c35874d402790372821a47913ba62b81dcc65e84901e8166c93524e4e5704","observation_id":"47379a3c-ab9a-44b6-871f-a182c7fcfbed","resolution":{"observed_at":"2026-07-12T00:23:04.763773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.11049/citation-record","integrity":"/paper/2508.11049/integrity","json":"/paper/2508.11049/citation-record.json","paper":"/paper/2508.11049"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.624565Z","title":"Exploration by random network distillation, 2018","venue":null,"work_id":"12272d2a-a756-4419-9dde-245f170b40ba","year":2018},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.327098Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:48c7d867f6e9ae7dc5019b7f95cb7e2e8f8671241d21ce9ddea47eaa3a251927","observation_id":"eb2d25f2-b3f1-4378-8b1e-bf33b484f530","resolution":{"observed_at":"2026-08-15T17:34:17.629157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.608560Z","title":"Karen Liu","venue":null,"work_id":"249f478b-059c-4a3a-bb37-e19aa587c0c0","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.332419Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:784cd8c944d592a3ebd05a951d5dcc3e2ae65a8268312b75ab1768c40bd465da","observation_id":"02bb7123-ae58-4b66-a5ac-cc5741486ca3","resolution":{"observed_at":"2026-08-15T17:34:17.613563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.592302Z","title":"Diffusion policy: Visuomotor policy learning via action dif- fusion, 2024","venue":null,"work_id":"18a76104-edf3-471e-8444-2e754f2f25fb","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.337801Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:3dcbbf8ad48ce046edea3459d9af43e2dabe48450739287536c7acb187191fbc","observation_id":"7f77e170-a143-4b33-ab06-9268e4548b52","resolution":{"observed_at":"2026-08-15T17:34:17.597041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.574871Z","title":"Tapir: Tracking any point with per-frame initialization and temporal refinement, 2023","venue":null,"work_id":"9efbca6d-9c0a-4c95-90e4-1274cd1d1950","year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.343217Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:18ca40223e0e6c10baab9f3dbde80687ff68f3c5b0d709d519c1d143f767036f","observation_id":"9e65b646-b51f-457b-b5f3-586943d30094","resolution":{"observed_at":"2026-08-15T17:34:17.580743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-14T18:47:26.721223Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-15T17:34:16.348711Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.348711Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:3d5c2844d0426625ea20d07d78cfd86edfaa0a0c98cd84804b27a814d27e714b","observation_id":"5a1fb9ea-0913-42c0-a6d9-e209ba345f62","resolution":{"observed_at":"2026-08-15T17:34:16.348711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.554997Z","title":"Video prediction models as rewards for reinforcement learning","venue":null,"work_id":"98296a47-a070-4ffa-93d9-0da706b917f5","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.353796Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:eef6ab60f0f48d8da332b4290701814b3479ad134e54e5df3d1a56449891ede2","observation_id":"d327a378-c4da-4f6c-9a93-8af49c59be55","resolution":{"observed_at":"2026-08-15T17:34:17.561330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09841","last_updated":"2021-06-23T16:07:21Z","snapshot_observed_at":"2026-08-20T07:25:09.293308Z","submitted_at":"2020-12-17T18:57:28Z","title":"Taming Transformers for High-Resolution Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09841","snapshot_observed_at":"2026-08-15T17:34:16.359323Z","title":"Tam- ing transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.359323Z"},"links":{"cited_paper":"/paper/2012.09841","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:3a1002c109bcabccde9cca2bc42ad06ef8c16dc9cf2f2ba555e30996fea7803e","observation_id":"fb2bc097-3094-477a-a969-00460b62d0a9","resolution":{"observed_at":"2026-08-15T17:34:16.359323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.537593Z","title":"Learning robust re- wards with adversarial inverse reinforcement learning, 2018","venue":null,"work_id":"f74c1448-3b99-4448-880e-e2bc1c824876","year":2018},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.364114Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:a4f97fc123bb5f1a2a44b33bf97bbff1b523155ec94755643241406802ecca5d","observation_id":"6a4e0bf5-ae17-4c69-9644-64a00ab25a60","resolution":{"observed_at":"2026-08-15T17:34:17.542728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.518063Z","title":"FLIP: Flow-centric generative planning for general-purpose manipulation tasks","venue":null,"work_id":"5240d1ca-d20f-4b29-ac83-cf8778ed52d7","year":2025},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.368562Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:9396f950985814f4cf16c0710f5602af056d90f96007ec9e336325d387a4d4f4","observation_id":"1c2bee6e-15a7-42cd-8a1a-8db6bd2f101a","resolution":{"observed_at":"2026-08-15T17:34:17.524137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.500257Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning, 2024","venue":null,"work_id":"6641a5cf-173d-41ef-80c6-6f71fd3559eb","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.372825Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:b65cb4e1b3e0c2e1a2d3a514b87e9ed68480e594555602db90e86adfe0c910e4","observation_id":"74de8419-f25a-4f31-aa5c-28e0aa8e6ec8","resolution":{"observed_at":"2026-08-15T17:34:17.506127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.483940Z","title":"Bridging the human to robot dexterity gap through object-oriented rewards, 2024","venue":null,"work_id":"d53ec227-d1e3-4c68-9408-43e099fd70a7","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.377188Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:44b97014b7609c4ffa6c4a05efdbf7cc01c548919d842c3af7afd83b9b8afaa0","observation_id":"1ab73b7d-863e-4310-a367-5ec3857c99b7","resolution":{"observed_at":"2026-08-15T17:34:17.489017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.468728Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor, 2018","venue":null,"work_id":"50b8d326-35db-436a-b5c0-12c5e28163ca","year":2018},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.382620Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:7bc8a8bee29a880d6bef783f4508821b7c3641d8752d6d2249c4567a22ca4219","observation_id":"755eda83-2570-4ea8-8c70-f123ec868fb3","resolution":{"observed_at":"2026-08-15T17:34:17.473662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.453008Z","title":"Learning prehensile dexterity by imitating and emulating state-only observations, 2024","venue":null,"work_id":"77764f8a-adf4-4b64-b0d7-be433d2f1398","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.387510Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:b240e700975d06a4a67af56df5ac7431e0bb93a6363d99d36c966e2ca42b0563","observation_id":"71b8bf93-f9da-4f17-884b-7e4573cd9d4b","resolution":{"observed_at":"2026-08-15T17:34:17.457944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.437805Z","title":"Generative adversarial im- itation learning, 2016","venue":null,"work_id":"ae3fabf7-2578-4405-a05b-1661f4fbde52","year":2016},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.392736Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:185f4f08aa15543e503b2b2717dfa189e3dae1b69cc57a8efba41aa423ec0f2d","observation_id":"c0f37dad-f589-47ef-970d-286462bf8537","resolution":{"observed_at":"2026-08-15T17:34:17.442799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.397189Z","title":"Video dif- fusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.397189Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e950f6095d1e1591cf49248e05852dbfb27026768aee98d46c7aa08d37498f83","observation_id":"53cffb84-2d3e-4673-a4be-afb0e93b9945","resolution":{"observed_at":"2026-08-15T17:34:16.397189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.411477Z","title":"Spot: Se(3) pose trajectory diffusion for object-centric manipulation, 2024","venue":null,"work_id":"53f28ccc-1a80-4382-9418-acfc0b90eff0","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.402298Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:87c331143d5dd2246a978117bbffab37a07378266bc47171fc59e0c4316cd6a1","observation_id":"67133045-aa3c-4be8-ae70-32133e3b1f59","resolution":{"observed_at":"2026-08-15T17:34:17.416386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.395119Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"ddee18af-0aaa-43c9-b9ee-facd0d81bbb5","year":2021},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.406924Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:2c541b802dca0a8c06b85e2babce60bf57ce40256ff9a6f7b3608aa56b3f0190","observation_id":"8e9f7e31-8c0e-46b5-81f7-7dbdcd7b3d10","resolution":{"observed_at":"2026-08-15T17:34:17.400210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.378683Z","title":"Ardup: Active region video diffusion for uni- versal policies","venue":null,"work_id":"0945ab0a-e053-44f6-9f49-c6ca80ffa15d","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.412141Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:74fd7929fd1ec98cef4ded0cb63f7db0b0dde0e63d45821f9f9ea22a45dda6dc","observation_id":"c1901959-e516-461e-ade2-eece8f923d41","resolution":{"observed_at":"2026-08-15T17:34:17.384137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.363203Z","title":"Dif- fusion reward: Learning rewards via conditional video dif- fusion","venue":null,"work_id":"ff4098cc-f009-4f72-8888-fa91df8ac97f","year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.416753Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:2f314ec7213fff976c182c8f60278a7c389f5f493108aadcdf7bb5c6f549dc9f","observation_id":"2b4bed6e-67ea-4ba6-b186-795b74d0c7a1","resolution":{"observed_at":"2026-08-15T17:34:17.368295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.347775Z","title":"Rekep: Spatio-temporal reasoning of rela- tional keypoint constraints for robotic manipulation","venue":null,"work_id":"bf746b4e-f1b3-4f18-8fd8-783709549495","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.422668Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:66b278f00db3a83f155cd23c567bc462d2272c832225232f0da29c2d6ffd15f9","observation_id":"64b6d281-e425-4718-8a89-b27b2fd796ef","resolution":{"observed_at":"2026-08-15T17:34:17.352656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22325","last_updated":"2024-10-30T03:33:08Z","snapshot_observed_at":"2026-08-16T13:04:51.127094Z","submitted_at":"2024-10-29T17:58:13Z","title":"Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22325","snapshot_observed_at":"2026-08-15T17:34:16.427277Z","title":"Robots pre-train robots: Manipulation-centric robotic representation from large-scale robot datasets","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.427277Z"},"links":{"cited_paper":"/paper/2410.22325","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e421e813b843923cd9143e7e130106e34f82d9dee8385e0288e283a2c794d07c","observation_id":"5879df8a-510b-4c6d-9c63-ca4fd7a97cff","resolution":{"observed_at":"2026-08-15T17:34:16.427277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.332182Z","title":"Co- Tracker: It is better to track together","venue":null,"work_id":"49d58c67-ab43-43f6-baf7-6c39d49c2783","year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.433002Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e6097735f311a01017eacbcfe7ac7def68957813c5aa3f0fc7904d460f39b5a2","observation_id":"d9624034-9316-4472-a1a6-bac8f2f26a5c","resolution":{"observed_at":"2026-08-15T17:34:17.337050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.316368Z","title":"Egomimic: Scaling imitation learning via egocentric video,","venue":null,"work_id":"a8072f9b-7b0f-4551-8354-48c3099ff001","year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.438063Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:81b29f7a443119c8058fa69ddc4fe0d520392001c81b7fde459cf4336ffc3c4c","observation_id":"0a19b6a7-893d-4102-9426-4e7c40def128","resolution":{"observed_at":"2026-08-15T17:34:17.321492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-15T17:34:16.444312Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.444312Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:297d06f6e3ac39d9e78fa02968f823136e771c1fc00a33af544eaec716171d3d","observation_id":"8566e63f-2d86-4358-92a6-528c114ceee0","resolution":{"observed_at":"2026-08-15T17:34:16.444312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08576","last_updated":"2023-10-12T17:59:23Z","snapshot_observed_at":"2026-08-16T14:52:35.031233Z","submitted_at":"2023-10-12T17:59:23Z","title":"Learning to Act from Actionless Videos through Dense Correspondences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08576","snapshot_observed_at":"2026-08-15T17:34:16.449552Z","title":"Learning to Act from Actionless Videos through Dense Correspondences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.449552Z"},"links":{"cited_paper":"/paper/2310.08576","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:1812de24fc9cd12cea1442dd48c433b7bc25c8274446e13e76bd8a241036d011","observation_id":"31d82e04-ad2a-45e3-b24f-79c6f16855b4","resolution":{"observed_at":"2026-08-15T17:34:16.449552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.301563Z","title":"Learning hand-eye coordination for robotic grasping with large-scale data col- lection","venue":null,"work_id":"c3544a35-ac61-4e83-bed7-4d5a72defbb1","year":2016},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.454931Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:1be6c0cf40e6ab01fe79c570dd45146d60f8c1f56899e667c34616a067e70bd2","observation_id":"f3946725-2d7f-4ec8-ab43-b38349dbf675","resolution":{"observed_at":"2026-08-15T17:34:17.306340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-08-21T15:57:22.153221Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T17:34:16.459990Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.459990Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:041725846914d63cb09acecee4b1c3bd4d76840397fa0dfce7e8d061f4c8821d","observation_id":"943040e0-5092-4bc6-bc61-03e27eea92df","resolution":{"observed_at":"2026-08-15T17:34:16.459990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.285526Z","title":"P3-po: Prescriptive point priors for visuo- spatial generalization of robot policies, 2024","venue":null,"work_id":"ddd7c0d8-19ef-4d3d-8dd1-cb6f931897f6","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.465128Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:853748955e79201da74ea952453b69d4bc8544ec38aad7aac9926ec6d167c62d","observation_id":"3e4a506c-8e99-45fe-9511-56b2e7f0abf8","resolution":{"observed_at":"2026-08-15T17:34:17.290798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.269049Z","title":"LEAGUE++: EMPOWERING CONTINUAL ROBOT LEARNING THROUGH GUIDED SKILL ACQUISITION WITH LARGE LANGUAGE MODELS","venue":null,"work_id":"05b33e18-c1f6-491c-8029-f8c9e0732861","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.469530Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:9faa4ab21c5c65e5626ef26deb94a553c044b4aebc5de5a3163cc252645ceeab","observation_id":"72be033c-8922-431d-b58e-8dd05173c27e","resolution":{"observed_at":"2026-08-15T17:34:17.274212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07753","last_updated":"2023-05-25T03:50:11Z","snapshot_observed_at":"2026-08-21T12:10:42.882805Z","submitted_at":"2022-09-16T07:17:23Z","title":"Code as Policies: Language Model Programs for Embodied Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07753","snapshot_observed_at":"2026-08-15T17:34:16.474395Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.474395Z"},"links":{"cited_paper":"/paper/2209.07753","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:99ed24ee2b154d2f041ccfd52aea3f0c26d5c5378ea9e23f1f9886fea7da3a66","observation_id":"77d08b0a-44bb-468a-bc25-65087bfc8a0b","resolution":{"observed_at":"2026-08-15T17:34:16.474395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-08-18T10:36:28.197890Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-15T17:34:16.479752Z","title":"Dreamitate: Real-world visuomotor policy learn- ing via video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.479752Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e2a7a09b7462fb63feb5a1fb04f369d9dcea43ad3aa05a673bb5c59423e008fb","observation_id":"982eec53-54ac-4390-9dbe-77f9028ebe5b","resolution":{"observed_at":"2026-08-15T17:34:16.479752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.253650Z","title":"Flowretrieval: Flow-guided data retrieval for few-shot imitation learning","venue":null,"work_id":"113d77bd-f59a-4be7-84bb-0b7a3c148e59","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.484598Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:fe91792a58a1f20455bd497e103767b75a4da367a96888ae6f21b6c1d944751a","observation_id":"74e115f8-588c-4583-9384-d92df23dc8e4","resolution":{"observed_at":"2026-08-15T17:34:17.258689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.238238Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"c0e47d07-702c-44b3-8e06-27e71cfd7f82","year":2025},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.489147Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:b65685309e4ab96166a755854e78cbd3d9e951a49a9313cf1eb73542d1f5d300","observation_id":"fd085c73-15cd-4159-af43-f8ff9b4a736a","resolution":{"observed_at":"2026-08-15T17:34:17.243468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.223008Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":"4af849e0-dfae-467c-9a99-b30cd951973e","year":2019},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.493811Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:ca82f4f45d9b4ea659fcece35b98d691d79bed6114575a6028c057471df0b927","observation_id":"3f39f1da-1f17-4387-ac31-cb60afa4ae0e","resolution":{"observed_at":"2026-08-15T17:34:17.228096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.207446Z","title":"Liv: Language-image representations and rewards for robotic control, 2023","venue":null,"work_id":"fd49b363-db58-424b-8ead-eea37a496ae6","year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.498506Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:bf01afadbff128cdd67a981d9abe5bd5b41fb0c45472a561a38e9560b8884aac","observation_id":"4a5b35cd-5124-43bd-a251-fcbc8cda5b1b","resolution":{"observed_at":"2026-08-15T17:34:17.212375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-15T17:34:16.503192Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.503192Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:1126eacd8cc64925e5cf2d08a2379a7249df11a4d2405f476eb213d570483c26","observation_id":"e0b60559-47d9-410f-b2f2-97e0a36bb506","resolution":{"observed_at":"2026-08-15T17:34:16.503192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.192380Z","title":"A real-to-sim-to-real approach to robotic manip- ulation with vlm-generated iterative keypoint rewards, 2025","venue":null,"work_id":"81019f37-43c9-45f9-8713-04f051491b13","year":2025},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.508100Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:3b2c21e81fdd8c8667915a922de90c7b7792efbec6ff560886d04e7b3f0a650c","observation_id":"345bf1f2-5844-4758-9904-187156968881","resolution":{"observed_at":"2026-08-15T17:34:17.197318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.176907Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":"15b8e160-8fec-40c3-8a75-38ce8c2fff98","year":2021},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.512656Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:23f3ed0302867528748682cdd79fc2961b55eca57ee3077262608ee7805dd004","observation_id":"b36f2b0f-2fa0-4b35-8506-e177db68e7a8","resolution":{"observed_at":"2026-08-15T17:34:17.181916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.159946Z","title":"High-resolution image syn- thesis with latent diffusion models, 2022","venue":null,"work_id":"5f639041-5931-43d5-9f6c-b59c07b029b2","year":2022},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.517825Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:7cd3fb08ef72d42336299dd9a944f7516ee107c276bcf922e83eb36ceac6ae10","observation_id":"00c4cd89-31f7-4178-a6f3-0cb205ac52fb","resolution":{"observed_at":"2026-08-15T17:34:17.165278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.143348Z","title":"Proximal policy optimization algo- rithms, 2017","venue":null,"work_id":"eea2a3ae-4b00-4d0e-9f75-4ae4b6c35052","year":2017},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.522265Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:c64e2c426b0250c1b4513e1ba3832f9633bcc15a9e0c77cd1c06a8ad8d56277f","observation_id":"16d9d283-2a4c-4d8f-b784-09d8c44b1401","resolution":{"observed_at":"2026-08-15T17:34:17.148342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.127489Z","title":"Motion before action: Diffusing object mo- tion as manipulation condition, 2025","venue":null,"work_id":"f792554c-7c41-4bb3-953c-69bdb2da28c1","year":2025},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.526550Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:9ab920e30bfa14419202bd551605793812c68768124733d52a5be3c1dae8517b","observation_id":"0f15d7e8-70d5-4f9b-8e39-0b4927fcdc11","resolution":{"observed_at":"2026-08-15T17:34:17.132851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.110123Z","title":"Embodiment-agnostic action plan- ning via object-part scene flow, 2024","venue":null,"work_id":"b382ae80-9c60-4175-a3e1-c5fe0fce22ea","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.531538Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:68eb64d020d21cb7916a8e645499dd7130105eccace47bcff3f791a47c37ce9a","observation_id":"be256581-29cf-4e5a-9002-1ac67f0860ca","resolution":{"observed_at":"2026-08-15T17:34:17.115537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.091865Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":"92834a8c-a866-4351-b885-4b55e3bb7c64","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.536460Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:06bc1fce924adb5c9c1785d79f83a64d3357ceb1770fd7a4ef636653fe9877eb","observation_id":"416383d9-8976-4fcf-8936-ff22d02b25dc","resolution":{"observed_at":"2026-08-15T17:34:17.097535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.074669Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"25d9fecc-5c21-47c1-a2b7-c43fb483a186","year":2012},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.541453Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e250779cc744c6a723586e45574ea9d93beaf068ee910c24e8315ae44d7bb7d4","observation_id":"049b3a01-4d59-4fef-8492-df1a31f4ec8c","resolution":{"observed_at":"2026-08-15T17:34:17.080485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.546041Z","title":"Llama: Open and efficient foundation lan- guage models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.546041Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:cfec052e538ad7c847f75e2cc4b1af40d2f3f0ecadb537121d7edda5284ab31a","observation_id":"e5fdc360-2d92-4ea1-be5e-e7b4fad60523","resolution":{"observed_at":"2026-08-15T17:34:16.546041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05530","last_updated":"2025-05-18T04:20:01Z","snapshot_observed_at":"2026-08-16T13:36:21.355035Z","submitted_at":"2024-07-08T00:28:41Z","title":"This&That: Language-Gesture Controlled Video Generation for Robot Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05530","snapshot_observed_at":"2026-08-15T17:34:16.551453Z","title":"This&that: Language-gesture controlled video generation for robot planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.551453Z"},"links":{"cited_paper":"/paper/2407.05530","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:d324fdce6a3a641cf74f842523380be69d4c5672dd10a3b108e3fc7639334961","observation_id":"16fc3d5a-1d4c-4210-9798-f7ff9dc399a8","resolution":{"observed_at":"2026-08-15T17:34:16.551453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.046027Z","title":"Rl-vlm-f: Rein- forcement learning from vision language foundation model feedback, 2024","venue":null,"work_id":"ed93108d-661b-405c-acf8-0fa1a71042f5","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.557041Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:f43df5e545a0c1a86446ac9ca6f8d20c16eca831236e467e21c2b5101948f0a5","observation_id":"fbfd0454-a140-49a1-8c8b-070157e6256b","resolution":{"observed_at":"2026-08-15T17:34:17.051643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.028588Z","title":"ivideogpt: Interactive videogpts are scalable world models","venue":null,"work_id":"ec14dadc-acf5-419d-97ac-deb6733e4df3","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.562107Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:76a42f4ecd203f240327c2644490ec19eba5b404168f8554b68aacae3033351b","observation_id":"111b3318-2c11-4155-be3a-463b9ffbde6c","resolution":{"observed_at":"2026-08-15T17:34:17.034198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:17.001447Z","title":"Text2reward: Reward shaping with language models for re- inforcement learning, 2024","venue":null,"work_id":"6aa234e5-5998-4ccb-9777-9a861b0602f9","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.567009Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:394a8c152740a48d97b413e20ab5644c5377128c07f00dcdd0be7ad5535cf168","observation_id":"9cdfc636-5d5c-4231-9b8f-0ec7a361df0b","resolution":{"observed_at":"2026-08-15T17:34:17.006797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.984789Z","title":"Learning by watching: Physical imitation of manipulation skills from human videos","venue":null,"work_id":"636728de-6f45-4309-a7d2-fee062c8adc1","year":2021},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.572001Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:64a6838139ec56ca6a97229a0c45ea4f6e6e6f64a50d31bff41c882a8bf0bbd2","observation_id":"d7a2141d-d51b-4901-856f-ab3e77ebc146","resolution":{"observed_at":"2026-08-15T17:34:16.990550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.967331Z","title":"Flow as the cross-domain manipulation interface, 2024","venue":null,"work_id":"572a0c0b-d762-4699-98bd-6a09299e6f48","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.576641Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:deabe10abdeef0290372c6afdd4335955447b95669a961c9544f664d406109b3","observation_id":"538cc65c-f21d-47c6-bbcd-1ea8730901f5","resolution":{"observed_at":"2026-08-15T17:34:16.972680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.581174Z","title":"Videogpt: Video generation using vq-vae and trans- formers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.581174Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:10fc9b7efc43f757eee36e582571bd43ba506e58d6b881aedb1a8f7b91a4a419","observation_id":"ee421b08-1027-43ba-86b9-674f42207e33","resolution":{"observed_at":"2026-08-15T17:34:16.581174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.937870Z","title":"Rank2reward: Learning shaped reward functions from passive video","venue":null,"work_id":"37fee784-b1bf-4703-9566-f2147841c317","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.586250Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:e6146307efa506e7d81a41937aa8eadb4a12fca48f8bd56d2e892c00d2e63778","observation_id":"065c43ce-3d36-4f1f-a82d-94c11e170b46","resolution":{"observed_at":"2026-08-15T17:34:16.943647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.918832Z","title":"Mastering visual continuous control: Improved data- augmented reinforcement learning","venue":null,"work_id":"25c4b6ce-b6e7-4aeb-8e5c-6e0261d4eaf7","year":2022},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.591117Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:64776bb95c27560e5f2ef3b52c2365cc5a623a174dffeb4679af52be025a276e","observation_id":"d8fcf0c8-a946-4fd2-9e59-c666925803dd","resolution":{"observed_at":"2026-08-15T17:34:16.925332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.902007Z","title":"Mimictouch: Leveraging multi-modal human tactile demonstrations for contact-rich manipulation","venue":null,"work_id":"c7eb1510-ead8-413d-b5f8-5ad465ed4325","year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.595434Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:04a65c3499f2167e1ef3a4d0438ea6b800cf61f1610595206608cbb6699eea16","observation_id":"27a6d6c5-8097-4dfa-a4c2-8861cc628179","resolution":{"observed_at":"2026-08-15T17:34:16.907420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.884918Z","title":"Sketch-to-skill: Bootstrap- ping robot learning with human drawn trajectory sketches,","venue":null,"work_id":"7b46b6d0-255b-40a8-88a8-d7787ae06137","year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.599988Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:dcf3e84f304fb83be1cfbb9b06d02a84c3705081b80a508c1c485685b502d86a","observation_id":"c09db6e3-57b8-4626-a817-38dc89209adb","resolution":{"observed_at":"2026-08-15T17:34:16.890128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.868449Z","title":"Meta-world: A benchmark and evaluation for multi-task and meta reinforce- ment learning, 2021","venue":null,"work_id":"73cba603-0178-4345-a23b-b3057f7c6359","year":2021},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.605621Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:2a263fa4df890984a45a9be83530a073a4ddec5d0e7bfa60206ec199f41f4529","observation_id":"5d9a7c67-f249-4403-9341-d4437bd7d581","resolution":{"observed_at":"2026-08-15T17:34:16.873795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11439","last_updated":"2024-09-23T08:22:04Z","snapshot_observed_at":"2026-08-18T19:41:40.971251Z","submitted_at":"2024-01-21T09:39:11Z","title":"General Flow as Foundation Affordance for Scalable Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11439","snapshot_observed_at":"2026-08-15T17:34:16.610116Z","title":"General flow as foundation affordance for scalable robot learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.610116Z"},"links":{"cited_paper":"/paper/2401.11439","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:b1d52b2c5002a42ff8e4c77b4fc2749b88cd755c6cac1a4dde34f1645550ffef","observation_id":"2e9e7cc1-fbca-4fc3-b507-efb8227213f3","resolution":{"observed_at":"2026-08-15T17:34:16.610116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-15T17:34:16.615001Z","title":"Tracevla: Visual trace prompting enhances spatial-temporal awareness for generalist robotic policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.615001Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:a19398a9fc52e9f9ac93d7f12474783a26c921fee795c964bbb62e53d8efc1f0","observation_id":"1197e062-09bd-4a73-b38d-aacb2df96217","resolution":{"observed_at":"2026-08-15T17:34:16.615001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:34:16.849156Z","title":"Same as the Im2FLow2Act [51], we encode the object flow into a latent space and train the generative model based on it","venue":null,"work_id":"6d0a6251-aa28-48ed-8e5b-393d0000550e","year":null},"citing_paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:16.621055Z"},"links":{"citing_paper":"/paper/2508.11049"},"observation_digest":"sha256:87e18b262bdd76655199a5d451ca38497aa6974fc7371f04d1b308ca7d7af8a6","observation_id":"54776263-f9c2-40e8-bfb8-79538158b79a","resolution":{"observed_at":"2026-08-15T17:34:16.857087Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.11049","last_updated":"2025-08-14T20:19:20Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T19:42:15.884388Z","submitted_at":"2025-08-14T20:19:20Z","title":"GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":44},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 3 inbound Pith citation observations for arXiv:2508.11049."}