{"as_of":"2026-08-09T17:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:916c24649c524b892dfa2195af5def5db98f90655d7e48d6f4b92a4c82623669","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T01:01:49.974319Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T14:10:34.574895Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:59:51.729563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2503.00200","last_updated":"2025-04-24T20:02:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-28T21:38:17Z","title":"Unified Video Action Model","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T17:50:29.675358Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2503.00200"},"observation_digest":"sha256:3fed5f741430c8660bccf5e0bcea8c0e55de5a885cc97e4eda12b1e247531c1e","observation_id":"7f7333b1-494a-4b1c-8d7b-fbd50c2d75de","resolution":{"observed_at":"2026-05-13T17:50:29.726268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2507.01925","last_updated":"2025-07-02T17:34:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T17:34:52Z","title":"A Survey on Vision-Language-Action Models: An Action Tokenization Perspective","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-17T14:08:34.893876Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2507.01925"},"observation_digest":"sha256:b9d6331b96726d6633479f0346e96274874d3ed2130f7dbca97023ddd6737fcc","observation_id":"bbf130cc-cd4c-4411-b480-00ad422c9fe4","resolution":{"observed_at":"2026-05-17T14:08:35.211207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2507.16815","last_updated":"2025-09-18T16:26:53Z","snapshot_observed_at":"2026-08-03T17:16:24.219569Z","submitted_at":"2025-07-22T17:59:46Z","title":"ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T03:18:14.655384Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2507.16815"},"observation_digest":"sha256:e8b81bcd1dcc8b181b72eab58e8c90c3a8f109833753e39452029a5e18be96ab","observation_id":"9497d1bb-dfc6-4d99-aff4-6494de561241","resolution":{"observed_at":"2026-05-19T03:22:00.945930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2508.13998","last_updated":"2026-04-06T03:29:44Z","snapshot_observed_at":"2026-08-03T11:31:47.613184Z","submitted_at":"2025-08-19T16:50:01Z","title":"Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T22:04:34.235731Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2508.13998"},"observation_digest":"sha256:3fdad84637009e241e1a49454b8759c91699fd3ce385a1c721cc5817cc9559fb","observation_id":"466848f2-5f09-4f83-9535-b64459d65651","resolution":{"observed_at":"2026-05-18T22:06:51.756606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2510.13778","last_updated":"2025-10-15T17:30:05Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-15T17:30:05Z","title":"InternVLA-M1: A Spatially Guided Vision-Language-Action Framework for Generalist Robot Policy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T20:09:39.677347Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2510.13778"},"observation_digest":"sha256:7b9a33934e3d3b951b950deb05ce7c47eb530e981ad9c3b6f2ab326f7a76a756","observation_id":"e51f694f-44e9-45f0-bee4-99b9c275e3d5","resolution":{"observed_at":"2026-05-14T20:09:39.752113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-08-03T14:10:34.574895Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.21430","last_updated":"2026-06-03T18:06:11Z","snapshot_observed_at":"2026-08-03T15:13:16.061241Z","submitted_at":"2025-12-24T21:36:34Z","title":"EVE: A Generator-Verifier System for Generative Policies","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T14:10:34.574895Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2512.21430"},"observation_digest":"sha256:e69c5b7a264de3cc9157b1cd83105d78fd06a2fecd428e8a592b0a10978bba19","observation_id":"1a66ca93-337e-40fa-9579-b45c991ee445","resolution":{"observed_at":"2026-08-03T14:10:34.574895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2601.16046","last_updated":"2026-04-26T10:16:39Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T15:23:35Z","title":"DextER: Language-driven Dexterous Grasp Generation with Embodied Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T12:05:08.804472Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2601.16046"},"observation_digest":"sha256:0ef299f9b56d6c75ab56434f549daef05354fe5aeac24d465e49ea62ec534520","observation_id":"dbe47202-02eb-4d7a-882b-6be5f0985860","resolution":{"observed_at":"2026-05-16T12:07:50.708488Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2602.08167","last_updated":"2026-05-16T05:42:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-09T00:10:17Z","title":"Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-21T14:03:48.795572Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2602.08167"},"observation_digest":"sha256:b6039307504dbedcc53f1a14311274a928686699bf47e10fad700deaae0aa864","observation_id":"0c65971f-8e63-446e-869a-3685a8da7f2a","resolution":{"observed_at":"2026-05-21T14:04:12.020682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-09T20:48:01.461993Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2605.00078"},"observation_digest":"sha256:e119adee4eb2c676ea8059a383f15c5626f032a3704d5cc4ba4b61f43936218c","observation_id":"0b121d8b-640a-4222-9e37-e31526ad429a","resolution":{"observed_at":"2026-05-11T15:01:04.463189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2606.00110","last_updated":"2026-05-27T03:38:15Z","snapshot_observed_at":"2026-08-06T22:19:24.528783Z","submitted_at":"2026-05-27T03:38:15Z","title":"General Covariant Action Modeling: Constructing Generalized Manifolds via Spatio-Temporal Decoupling","version":1},"reference_index":172,"source":"arxiv_source","source_observed_at":"2026-06-29T13:33:03.368006Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2606.00110"},"observation_digest":"sha256:33e31c3f2f1968ee60b244f48328eaa6a029cbb8b1379393138612e0d4d202f6","observation_id":"0f7201f9-47f2-43ee-829b-e7533768b225","resolution":{"observed_at":"2026-06-29T13:33:27.812663Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2606.20999","last_updated":"2026-06-19T00:19:53Z","snapshot_observed_at":"2026-08-02T02:39:42.396834Z","submitted_at":"2026-06-19T00:19:53Z","title":"Inductive Generalization for Robotic Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T14:52:15.202629Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2606.20999"},"observation_digest":"sha256:37ff4c54afdd93245c20e2dc379ba0e75ee7184b1ee01352f643a178591e5577","observation_id":"d78408a6-583f-4203-8340-4805407b16c7","resolution":{"observed_at":"2026-07-04T06:09:36.780941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":"2502.03729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-04T13:59:51.729563Z","title":"Action-free reasoning for policy generalization","venue":null,"work_id":"b8b54b1e-cfc3-4e73-8709-c46a6d960728","year":2025},"citing_paper":{"arxiv_id":"2606.27268","last_updated":"2026-06-25T16:50:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-25T16:50:21Z","title":"E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T04:48:28.868562Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2606.27268"},"observation_digest":"sha256:8b9ac5a20f18b015ad8ceabab72efdea09375ade1639a32598b641981ff98020","observation_id":"852296ab-c7b1-4484-8a88-cf81b5aa8f09","resolution":{"observed_at":"2026-07-04T13:59:51.730989Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03729","snapshot_observed_at":"2026-07-31T23:29:11.330797Z","title":"arXiv preprint arXiv:2502.03729 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23969","last_updated":"2026-07-30T13:06:27Z","snapshot_observed_at":"2026-08-03T18:36:45.105550Z","submitted_at":"2026-07-27T03:36:45Z","title":"LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-31T23:29:11.330797Z"},"links":{"cited_paper":"/paper/2502.03729","citing_paper":"/paper/2607.23969"},"observation_digest":"sha256:2cbed6ed94f05c525b99de20af5a2cad7175d990bed7fad6c44847c1cefdc065","observation_id":"a0a6036c-4741-403c-8cff-b6b1e00e4028","resolution":{"observed_at":"2026-07-31T23:29:11.330797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03729/citation-record","integrity":"/paper/2502.03729/integrity","json":"/paper/2502.03729/citation-record.json","paper":"/paper/2502.03729"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:49.843796Z","title":"Human-to-robot imitation in the wild","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.843796Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:149b8b12da98ede45701ea722c32d8b687a765feb30aad84239297e80d856dc0","observation_id":"7c10afc7-109c-42e7-b5f0-217610d33c02","resolution":{"observed_at":"2026-08-09T01:01:49.843796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.476866Z","title":"RT-H: Action hierarchies using language","venue":null,"work_id":"ae52cadb-b551-436a-8b5e-4d1b385bb4e5","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.848419Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:5424e2921c19681d4b756719e903fc5c65110fcd6a0d95a63b01801525b7f081","observation_id":"3ec32a28-bf75-421b-a986-b6cb62529f8c","resolution":{"observed_at":"2026-08-09T01:01:50.480154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16283","last_updated":"2024-09-24T17:57:33Z","snapshot_observed_at":"2026-07-06T19:21:20.826877Z","submitted_at":"2024-09-24T17:57:33Z","title":"Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16283","snapshot_observed_at":"2026-08-09T01:01:49.852178Z","title":"Gen2act: Human video generation in novel scenarios enables generalizable robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.852178Z"},"links":{"cited_paper":"/paper/2409.16283","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:5676b6142898143495e7b9035167ff05ee2f7c55970d91fa65764a8dd77dfefb","observation_id":"1196c8a2-20f6-4e8f-bee7-86fc9bf40b2f","resolution":{"observed_at":"2026-08-09T01:01:49.852178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01527","last_updated":"2024-08-08T23:18:08Z","snapshot_observed_at":"2026-08-08T06:39:10.434686Z","submitted_at":"2024-05-02T17:56:55Z","title":"Track2Act: Predicting Point Tracks from Internet Videos enables Generalizable Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01527","snapshot_observed_at":"2026-08-09T01:01:49.856050Z","title":"Track2act: Predict- ing point tracks from internet videos enables di- verse zero-shot robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.856050Z"},"links":{"cited_paper":"/paper/2405.01527","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:5ba7b92b61b6414cc78c55fcb5351c066937c809bf6538a04e31017994bd2bc4","observation_id":"7afab238-206a-41e5-9afa-a899fd7f78b7","resolution":{"observed_at":"2026-08-09T01:01:49.856050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.467406Z","title":"Rt-1: Robotics transformer for real- world control at scale","venue":null,"work_id":"49d2bca3-bffa-4a94-a7c1-986357b10ff8","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.860020Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:d04f8063c0a29fe8af32466e6b67146c2bfdcd258a4284735b14a0f7a8163dd6","observation_id":"5c452dce-0d7d-4c02-90da-faa45139d75d","resolution":{"observed_at":"2026-08-09T01:01:50.470795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.458642Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","venue":null,"work_id":"5c03d579-c373-4f3e-b477-52337c24af6f","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.863309Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:d588d5c61526e21937e9b7123101e456275ca737d269ecdb85e33e02480543a4","observation_id":"fd19da2f-2295-49f6-9846-6218f8d5d0ef","resolution":{"observed_at":"2026-08-09T01:01:50.461775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.450372Z","title":"Do as I can, not as I say: Grounding language in robotic affordances","venue":null,"work_id":"a6bb5083-f630-4a75-899e-b94d4f9aeae3","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.866709Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:8a1f1788eab1e6d46f887cdbfff23cca0c6729807b9e1a8090b3428fe722f26a","observation_id":"697c9481-c569-48ef-ba4e-5fad8602815e","resolution":{"observed_at":"2026-08-09T01:01:50.453246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.442389Z","title":"Learn- ing generalizable robotic reward functions from” in-the- wild” human videos","venue":null,"work_id":"fb7f4bd3-ffd3-4877-a669-0fe583830bb3","year":2021},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.869595Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:8c8c1f78eaa6e7a1c9aa5e99348e01edd169539176f5a741fba4cbb188f45a0e","observation_id":"283914fc-2250-47ef-92eb-d7c8055de650","resolution":{"observed_at":"2026-08-09T01:01:50.445235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.433334Z","title":"Pali-x: On scaling up a multilingual vision and language model","venue":null,"work_id":"218dbe39-0828-4051-a496-32d429b7717e","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.872572Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:7e018bf4a22d224051fb53744f1634e79627abbd6add116a8b13de6590e120eb","observation_id":"4a1b7643-635e-4fbf-9cf9-cdd4ff0c1fa1","resolution":{"observed_at":"2026-08-09T01:01:50.436567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.424361Z","title":null,"venue":null,"work_id":"ee243940-c8f4-4450-b940-62b264456a8a","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.875157Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:87e61cd1235708168b278cea3520766357488b340192d7fe5e09cfcef2d17406","observation_id":"19d01e41-d142-478f-88f0-bd6dc707b3a7","resolution":{"observed_at":"2026-08-09T01:01:50.427463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.415492Z","title":"Inner monologue: Embodied reasoning through planning with language models","venue":null,"work_id":"02987837-53cc-4af7-a700-9d9ae7701cae","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.878427Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:924cb267cfc8cde455d8a2364e48d1d3317a5776279fe53c656c6fa4f227a0f8","observation_id":"87433e58-0417-48c1-880f-ff521bf7c8b6","resolution":{"observed_at":"2026-08-09T01:01:50.418640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12943","last_updated":"2024-08-27T23:15:11Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:47:37Z","title":"Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12943","snapshot_observed_at":"2026-08-09T01:01:49.881280Z","title":"Vid2robot: End-to-end video-conditioned policy learn- ing with cross-attention transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.881280Z"},"links":{"cited_paper":"/paper/2403.12943","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:84b48b2d845049d15eacf968c9328ff9f1657b137452f2ec30498920044a5f00","observation_id":"1b1f8b56-47d3-4cda-b77d-f2bcf6e103a9","resolution":{"observed_at":"2026-08-09T01:01:49.881280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.405731Z","title":"BC-Z: Zero-shot task generalization with robotic imitation learning","venue":null,"work_id":"6e42a04b-30c8-4944-bf1c-38fd6bd3f872","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.884665Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:2d4269bb3b38aaf400cee936a5ab4d102835148ee4813bcb11dd343babd9d269","observation_id":"f1f31623-e5a2-4bde-a354-a9b6d93e00d7","resolution":{"observed_at":"2026-08-09T01:01:50.409261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12766","last_updated":"2023-02-24T17:29:31Z","snapshot_observed_at":"2026-08-09T00:25:43.898202Z","submitted_at":"2023-02-24T17:29:31Z","title":"Language-Driven Representation Learning for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12766","snapshot_observed_at":"2026-08-09T01:01:49.887737Z","title":"Language-driven representation learning for robotics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.887737Z"},"links":{"cited_paper":"/paper/2302.12766","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:af971b37d153a537402ea2e628817b487c4a7291cdf0b74b4392b22f49999794","observation_id":"6e69431c-ff56-4461-b921-0a225ac967b2","resolution":{"observed_at":"2026-08-09T01:01:49.887737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-09T01:01:49.890945Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.890945Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:00161f497082b8a39a13dcce751cbe85674c5a4fd8edfc21d653f277b7d39d73","observation_id":"2fc4f02c-68d6-467d-98e6-b82cae80cf17","resolution":{"observed_at":"2026-08-09T01:01:49.890945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.396666Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":"86fbefa6-ba1b-4456-8751-f9ac1b3292c7","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.894481Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:db159e35e923295a509db3af11c8be9f34eb401e7d707df24dd9d1c7e192fe1c","observation_id":"eb13efc7-6cc7-4513-996c-35a5bf8cbc05","resolution":{"observed_at":"2026-08-09T01:01:50.400005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.387386Z","title":"Shadow: Leveraging segmentation masks for cross-embodiment policy transfer","venue":null,"work_id":"296e701e-f87f-4704-b349-feb3a1abd846","year":null},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.897459Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:37e80c86a9b15358f18d4180e7605e277007426778819c42dc58c61ce706aec8","observation_id":"51090eba-6513-440e-83d2-71b0a99d92da","resolution":{"observed_at":"2026-08-09T01:01:50.390935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.378449Z","title":"DexVIP: Learning dexterous grasping with human hand pose priors from video","venue":null,"work_id":"24f03027-bdb8-452e-992d-8d3afeb9bbcc","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.900585Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:134baae29f149e938d269ba1a460e777c28cc9e224bab5eb67c9179ab5c1e30d","observation_id":"b6065f1e-3897-42b7-a4a4-fedc9a10f403","resolution":{"observed_at":"2026-08-09T01:01:50.381670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.368939Z","title":"R3m: A universal visual representation for robot manipulation","venue":null,"work_id":"326ffbc9-555a-49b3-a57a-f07812ee8d38","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.903931Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:0bc44ffb1cb3dc8ce03d76a7ccf6a9d823796e291b8465e21ad5bb21037526bc","observation_id":"6254cd7a-5948-40d9-bf10-2734898daece","resolution":{"observed_at":"2026-08-09T01:01:50.372508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-09T01:01:49.906971Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.906971Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:025b46417678880b366c6de175648c3dd250155e798339f2b43ba7adf8dffc3d","observation_id":"393c55de-d637-4acc-8fad-b258e3d4eb78","resolution":{"observed_at":"2026-08-09T01:01:49.906971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-09T01:01:49.910250Z","title":"R+ x: Retrieval and exe- cution from everyday human videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.910250Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:33922dc019cc22f9a2573e3214e00bcd28b660e2bee3d977578f8ed6b412a0f1","observation_id":"ac5adba8-2315-48cd-b46a-546601ffd4d6","resolution":{"observed_at":"2026-08-09T01:01:49.910250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.359121Z","title":"Reconstructing hands in 3D with transformers","venue":null,"work_id":"f304f525-0940-4bf4-8a4b-26f6165b5938","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.913567Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:edcde68230356463f5433732c0b6bcace46946cd3517ca7c33d79c9a59185927","observation_id":"125beafb-7003-4c0e-812b-400be42b2934","resolution":{"observed_at":"2026-08-09T01:01:50.362488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.349262Z","title":"DexMV: Imitation learning for dexterous manipulation from hu- man videos","venue":null,"work_id":"db68925f-5e0a-461a-addb-5433d7953700","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.916435Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:9104611eef823f1a40d3a540854f449c99705d0b87b59c6fb802372897af7553","observation_id":"aaed7300-6395-44a3-ba80-9bdf9eaa4ffe","resolution":{"observed_at":"2026-08-09T01:01:50.352694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:49.919599Z","title":"Motion tracks: A unified representation for human-robot transfer in few- shot imitation learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.919599Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:e41e5ea6a4b643974fb8568ba713ded829d7026dc919d66fdc269d52f3b8cec3","observation_id":"abbb311f-b639-4c23-a4a5-abcb2db612e7","resolution":{"observed_at":"2026-08-09T01:01:49.919599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.339285Z","title":"Concept2Robot: Learning manipu- lation concepts from instructions and human demonstra- tions","venue":null,"work_id":"4acafbe8-5da0-4dd3-bff9-6f25978399a5","year":2021},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.922739Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:e07c47238049298426467e69abcf5700df5c16dd64719e247849f4e7fdec08a4","observation_id":"fe51c429-69f1-4b49-98c3-af90a287bd69","resolution":{"observed_at":"2026-08-09T01:01:50.342666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.329374Z","title":"Third-person visual imitation learning via decoupled hi- erarchical controller","venue":null,"work_id":"37fb470a-b835-4559-bfb2-d669ba2d7144","year":2019},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.925919Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:f2ce6d4383e278f80053dd44de4fb80e19fa792c21bc383b8877a75b200d85eb","observation_id":"202a83e9-4508-4a82-96f8-16f76362cf1b","resolution":{"observed_at":"2026-08-09T01:01:50.332907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.320642Z","title":"Videodex: Learning dexterity from internet videos","venue":null,"work_id":"3a77f73c-c603-4bd8-869b-c89a5dcae778","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.929161Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:6ea36eaeaeaac93d9f9ff52cd44a7aef8a914202f829df3d46ae5b8496bcdd94","observation_id":"5fcc7e38-c9d0-41b7-acf8-f8ddc012ba07","resolution":{"observed_at":"2026-08-09T01:01:50.323481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.311897Z","title":"Yell at your robot: Improving on-the-fly from language corrections","venue":null,"work_id":"1286a61f-68f9-4d1e-9b83-272fbf0bb762","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.932187Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:5c7cc8b556a896eb8dc16e2c5a3918e1b3b50ab69500c6eeef5182f8077e46f9","observation_id":"c9ad0274-7654-4f22-88fc-65344ac6b535","resolution":{"observed_at":"2026-08-09T01:01:50.314984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.303432Z","title":"Avid: Learning multi-stage tasks via pixel-level translation of human videos","venue":null,"work_id":"e978f8d3-6784-43d1-8cef-1d9f2de421e6","year":2019},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.935303Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:7728f40afd87351810e08d5f6506038c6cd6c8edf77e2468af61e75c8922a368","observation_id":"42585c46-2840-4319-865d-4c25297cfdd2","resolution":{"observed_at":"2026-08-09T01:01:50.306405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.294415Z","title":"Language- conditioned imitation learning for robot manipulation tasks","venue":null,"work_id":"1844cb41-cbfc-470a-a67d-382365a2b4d3","year":2020},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.938321Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:670dcd0be3fa9e12e33d84e2e0d16e6157c17abee18d844740a3ef2f1b4fafa3","observation_id":"eba0a6cf-763b-43fa-bc8c-f9c631992260","resolution":{"observed_at":"2026-08-09T01:01:50.297708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.284655Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":"b7125820-ca0c-40ee-9480-03a7bda14a7d","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.941429Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:37fac25cb2f773b64adaac48f5762770f4116adebd0ba56ae466f7d91707f27b","observation_id":"c89fd22a-bec1-413b-806f-dcda23f18c28","resolution":{"observed_at":"2026-08-09T01:01:50.288080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-09T01:01:49.944359Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.944359Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:e5ca5c7ea767654682d79ea210115a560d2f8c5d2a59d652b8ca0ebfe62490bd","observation_id":"fe5b29df-a8f8-435f-8d25-ebdc54624e39","resolution":{"observed_at":"2026-08-09T01:01:49.944359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T01:01:49.947681Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.947681Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:94400f2aafd578b1f281fd78e1dee942ad7e8d948dff72e744384048eef53c10","observation_id":"1ee75a18-9ea4-47d1-8dad-32653ed2cba4","resolution":{"observed_at":"2026-08-09T01:01:49.947681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:49.951083Z","title":"Bridgedata v2: A dataset for robot learning at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.951083Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:47a1b152783ba2fcb70b82def79ff9f09b4702bc65d8a56ee4bd380096826497","observation_id":"143d1d2b-8cd7-4c8a-a502-9ac8696f5084","resolution":{"observed_at":"2026-08-09T01:01:49.951083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.268741Z","title":"Mimicplay: Long-horizon imitation learning by watching human play","venue":null,"work_id":"cc3f30ac-daab-4fe7-a309-efc81aa07af0","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.954430Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:96ca5b4195a90c23a43b98616b1e164cf7fdfbb8c77aedadcba0f27b446a2283","observation_id":"940a116a-217b-4003-af20-510740ecf4c7","resolution":{"observed_at":"2026-08-09T01:01:50.272373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.257759Z","title":"Masked visual pre-training for motor control","venue":null,"work_id":"a9d25577-576e-4f6e-9099-e59c7c490de2","year":2022},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.957593Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:0c6d1127f00293de61ade38cf9007a0ba7010f4e1f300a67d4ec55b4a21ea029","observation_id":"4e6361f5-d930-4e80-8a44-e5220e249522","resolution":{"observed_at":"2026-08-09T01:01:50.261547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.247305Z","title":"Learn- ing by watching: Physical imitation of manipulation skills from human videos","venue":null,"work_id":"b75c8f2f-1c7e-46a7-aabe-8889bfc335da","year":2021},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.960581Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:1555570a567ed5ba3d360dafd16a11235acdfe9986f11c41b1bdd3e21926ab07","observation_id":"f835077d-e7dc-47a5-a4e9-a8cd1722ae6c","resolution":{"observed_at":"2026-08-09T01:01:50.250840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.237224Z","title":"Xskill: Cross embodiment skill dis- covery","venue":null,"work_id":"a8e6a68f-7647-4543-9607-1143b08f840c","year":null},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.963245Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:ec6aa066040cf381b625c71a5222da2544c9190094ac4764b54b5fb7af972071","observation_id":"8c1b8c1c-c728-4a9d-bfeb-c7f8792642f2","resolution":{"observed_at":"2026-08-09T01:01:50.240786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11758","last_updated":"2025-05-15T12:13:37Z","snapshot_observed_at":"2026-07-06T19:33:57.090585Z","submitted_at":"2024-10-15T16:28:09Z","title":"Latent Action Pretraining from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11758","snapshot_observed_at":"2026-08-09T01:01:49.966102Z","title":"La- tent action pretraining from videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.966102Z"},"links":{"cited_paper":"/paper/2410.11758","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:4ead02509bea40bdd6a4e669858e33bbad65d5de86b55c703958a1f4e607d85f","observation_id":"4531c6e2-3966-4968-9122-7e65e878acbc","resolution":{"observed_at":"2026-08-09T01:01:49.966102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.227441Z","title":"Robotic control via embodied chain-of-thought reasoning","venue":null,"work_id":"5bf39d9d-4d5c-45a0-82e8-3aa4c58cdbd5","year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.968969Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:d7a9acd0c0df3da65d9478454293271d3611017ccecbd87b1e5c5aed6bf2f48d","observation_id":"21cdefbe-0096-4da6-a65a-2d4b0c982094","resolution":{"observed_at":"2026-08-09T01:01:50.230827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.217755Z","title":"stop”, “move forward","venue":null,"work_id":"c707baf5-23f6-49b7-a344-353681fa5d9a","year":2023},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.971611Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:622b0a97231f13dc3693f9bbbabf3ab38d26bc381c9861d0bca91ee3d35a28ac","observation_id":"b569a891-c9c1-47e4-a0fc-ee0a614d43ba","resolution":{"observed_at":"2026-08-09T01:01:50.221096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T01:01:50.204774Z","title":"Where is the robot hand in the image?","venue":null,"work_id":"4371a96e-b451-4bc5-98d2-cda075bedc76","year":null},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.974319Z"},"links":{"citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:8741bf2ee84204ceee493a944817a98aede95d1d2ff418f3a8ff36b2223c884c","observation_id":"b809ad56-0c44-4f7e-acaf-1710d0752317","resolution":{"observed_at":"2026-08-09T01:01:50.210160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 13 inbound Pith citation observations for arXiv:2502.03729."}