{"as_of":"2026-08-17T17:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b597cb92968aba8fa54d8d8db14cef14f3c22d50656a77af764e95522e4292f","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T15:28:10.101325Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08857/citation-record","integrity":"/paper/2607.08857/integrity","json":"/paper/2607.08857/citation-record.json","paper":"/paper/2607.08857"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Ahn et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:13934549d8e2cfc31b93fbe812d6bfbe316b15d20c1087dbfd32adee093b14b2","observation_id":"caca4b6d-fdb7-474d-bdf2-dfc359f17ff9","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Balasubramanian, A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:95a019c3aeeb53663cad71ec5fa421179548c0285c6641a09e9d75fca5f14d25","observation_id":"294ea4b6-96cf-4959-bd0c-38cded95c8b6","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Brohan et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:9d0baa133a52e906d090a42a849533daf222509b83d358a7ea701ad69bc99b18","observation_id":"c845bafa-e4cd-4f81-a53d-4fd6fe489674","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Damen et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:0e5e13918b086a0f5cd799190394e17b00a04c2c7ebcd713d93d57dfc8767d5a","observation_id":"aa80efaa-086f-457a-a1f8-bf541dd187ab","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Driess et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:c44972cf5f01ccbe706bae95b49f5f8aec9303b7c8e8997f464d96f9b7f1deb9","observation_id":"cc3f82ea-b8da-48cc-a046-7d4c051513b8","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Hoque, P","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:8b0f8045ec5240e41a07b3069d215bf566fc788a6cf0c78bff156f6de8e7940d","observation_id":"9ecfd9cd-04c0-468e-aa38-3bc2d7dff4dc","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-17T09:42:08.942018Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Huang et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:20c5da43a401007e4eb6964fe0e3bf05d50574f18bf634a00d3118808f10cd99","observation_id":"00e8bfa3-7141-4ead-9fe6-39b7751ecfad","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:fff28fb71dede18b71d09e537054a42911950c881ec7c015aad1737c2d0d6036","observation_id":"ef8532d2-722e-40c9-ae28-f99531b82463","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Lepert, J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:67a85cc9f29eac6f9eb8f05c4a0d5c79f20957de43c04b0ea0b57267ba289193","observation_id":"a7a5a482-11fa-4570-8e40-8be14b69efd2","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Li, C.-Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:ce7a6223cb6e95dec2c1d7c755f71dc852c138f07bdad4fd058741be9a114edd","observation_id":"9eb618eb-1bc7-40cd-93f6-8ec95d80668b","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03637","last_updated":"2026-05-05T11:09:41Z","snapshot_observed_at":"2026-08-11T15:47:39.031148Z","submitted_at":"2026-05-05T11:09:41Z","title":"Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03637","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2605.03637","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:2d11528e7d30fa5db3489b8f9fd94d0ab802329dcd63354caa6231ac38478fbe","observation_id":"7f584892-e9a6-4ada-ba96-5c55b2067267","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.12604","last_updated":"2026-06-10T19:01:40Z","snapshot_observed_at":"2026-08-05T03:29:41.720044Z","submitted_at":"2026-06-10T19:01:40Z","title":"EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.12604","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2606.12604","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:a1c84f45e16a2d089fa9c3ff7f23a8e89d4c4a9d52298b8092b68e2dfbd2ec25","observation_id":"d0d6288d-002c-4cf1-b18b-b44aa0bd3395","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Milgram and F","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:7a393143b170eb255f27e3e3286e6c8ec1531b1b4a7c63dc358258a9e68d9d7a","observation_id":"8c97ee51-e09c-4495-b736-bbe76c24e1f5","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:bf0ceaec733c1f0d68ebd0f6c001082d23e617a2b3a78251486c5336ea0e43bf","observation_id":"0d944f99-72a4-4a73-a777-77ca8f1605e8","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10631","last_updated":"2024-12-14T01:07:06Z","snapshot_observed_at":"2026-08-14T17:00:31.410085Z","submitted_at":"2024-12-14T01:07:06Z","title":"ARMADA: Augmented Reality for Robot Manipulation and Robot-Free Data Acquisition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10631","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Nechyporenko, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2412.10631","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:98b34f6b08c7dfeaf5177d8250f51e636f7966eab347ed1e7eaec2049a1f90ae","observation_id":"04070f7f-31c8-4951-a08e-50a3e1301236","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"O’Neill, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:6b86fc6ed55ce068fb8968691ec6350d8b1c3f0da12479957a15b74472c71dff","observation_id":"493479e1-2f3b-4cab-a5f0-011fc89e274d","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.19333","last_updated":"2026-06-17T17:57:34Z","snapshot_observed_at":"2026-08-12T21:11:47.095223Z","submitted_at":"2026-06-17T17:57:34Z","title":"Do as I Do: Dexterous Manipulation Data from Everyday Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.19333","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Paliwal, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2606.19333","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:2b37ebfa1a38386c61ec9aedb02f69d47cc10472316f96e513f4ab2afd3a86a8","observation_id":"f57cd92d-28a3-45e6-99e0-4187a4029f4b","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Pavlakos, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:dd675a89994670180e4a8df29e756f2738798a10485b2898802e6d3c26c02768","observation_id":"fcf8a8a7-6530-4170-a75e-f3583d9671ae","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:12121c091f32cfab014f8fc34bd4dd3851995fa52cbb82c200e1a09a70c40e4f","observation_id":"4a747f45-175c-4278-9a53-ffb23f9c08e8","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Ravi et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:e944e9728fe5bd3369b6f91e2517f73b6e0a2b8b088dafb26ecaea59d0f5817e","observation_id":"8765f132-da3c-4e07-8c64-5b67b887f489","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Todorov, T","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:3b9e5fb8d480be090e54a7e6303bb74611c2e6da6b40afa222c2b5bbf4560c03","observation_id":"0dba31a9-e34c-4e9c-9d08-204cf4296ce7","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:2ea1827767bfb61827bd11f6f4c4265ca396e4c11c708aed790a87b18856bd08","observation_id":"f1e7db8d-9647-40ad-ab2e-44ac972a80ae","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12090","snapshot_observed_at":"2026-07-14T15:28:10.101325Z","title":"Wang et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T15:28:10.101325Z"},"links":{"cited_paper":"/paper/2605.12090","citing_paper":"/paper/2607.08857"},"observation_digest":"sha256:baea652c4f6a20bd7cd022739dad4c10968249a80266a6afff89d9ec3d1a33de","observation_id":"03d8e224-f0d7-4545-ba45-66109aef3b19","resolution":{"observed_at":"2026-07-14T15:28:10.101325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08857","last_updated":"2026-07-13T16:37:13Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T16:59:56.226441Z","submitted_at":"2026-07-09T18:27:41Z","title":"AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.08857."}