{"as_of":"2026-08-19T03:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97005b2cdc40c21574e3877cdcca6d07c4e16f10341f95040f8830d755c2e234","coverage":[{"denominator":217,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:00:58.278097Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06253/citation-record","integrity":"/paper/2506.06253/integrity","json":"/paper/2506.06253/citation-record.json","paper":"/paper/2506.06253"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.937513Z","title":"The mirror-neuron system,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.937513Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:54b1038d9e80a87d871a20db6220ac98d432d324adcc184892523048c2441938","observation_id":"936e0d61-9597-417e-8eb3-ff9699f36e00","resolution":{"observed_at":"2026-08-07T06:00:57.937513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.941767Z","title":"Actor and observer: Joint modeling of first and third-person videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.941767Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:d5158b3ba5de44d61bdb85b6848b1c46eb9e3e5e401f1673abf9f5703b0a9fae","observation_id":"a46cdc3e-0f5f-4c40-b329-428badfc7d0e","resolution":{"observed_at":"2026-08-07T06:00:57.941767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.945418Z","title":"The epic-kitchens dataset: Collection, challenges and baselines,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.945418Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:4ebc9ec374df144cdb10b5fec584e6b7a4cd1ad64a92fea8c3594df903bc2c33","observation_id":"eef15a68-8533-46bc-add3-3fae6159ffdc","resolution":{"observed_at":"2026-08-07T06:00:57.945418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.950055Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.950055Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f98c811016b2ff3ae772129c363392ff7673391a14467a1802d71806e97fda62","observation_id":"ecf9de69-8d48-42d1-951b-9519252b3488","resolution":{"observed_at":"2026-08-07T06:00:57.950055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.953778Z","title":"Ego4d goal-step: Toward hierarchical understanding of procedural activities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.953778Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:144f5d1198157ddc2d7e2d5da9e6220b64b355a9b93183a67cb4bee42dbadcd2","observation_id":"8cf59410-1b86-4f2b-b0cc-1412dbc29967","resolution":{"observed_at":"2026-08-07T06:00:57.953778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.957357Z","title":"Ego-humans: An ego-centric 3d multi-human benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.957357Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:8a8f5ddd7a4fcea023dc32d42c67e9b1fea4c7b95b9a43125db1d155175b0529","observation_id":"6db3b688-d5ab-4eaf-83be-b5373fe0cb03","resolution":{"observed_at":"2026-08-07T06:00:57.957357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.961301Z","title":"Identifying first-person camera wearers in third-person videos,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.961301Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:341b1a26fe2e74d3151d7f619787f118b4e3439bb3eea2f330621e8fd689e1cc","observation_id":"89acd176-e975-4680-acfb-385917579547","resolution":{"observed_at":"2026-08-07T06:00:57.961301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.964740Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.964740Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ef59fe4158a5f8ec9713b8af3ff452e00274d11fa560a6f7e121fd4c211fcd5d","observation_id":"a376c9c3-f15f-473a-8933-ad2d52899f5e","resolution":{"observed_at":"2026-08-07T06:00:57.964740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.968286Z","title":"Hd-epic: A highly-detailed egocentric video dataset,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.968286Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:e6e0c91669d19b58091caceba3d5930a556366e9101fdeb78a9320764fb7ae34","observation_id":"f7fb05c9-dc3c-4966-831f-553e512d7b26","resolution":{"observed_at":"2026-08-07T06:00:57.968286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.971502Z","title":"Egocentric video-language pretraining,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.971502Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0f1a30eca9d2c7d12344e2a31072a713b9229d42fd2e76a1a6cbb3dbe267893d","observation_id":"09e3ffab-c965-470c-b02d-2a48821ae325","resolution":{"observed_at":"2026-08-07T06:00:57.971502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.974748Z","title":"Egovlpv2: Egocentric video-language pre-training with fusion in the backbone,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.974748Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:09618ed351c7284a84735c5e6f77ffb280b21974586e6d01074792db6bffa1d9","observation_id":"04325e27-be12-4155-a9b6-1c40a107243d","resolution":{"observed_at":"2026-08-07T06:00:57.974748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.978003Z","title":"Helping hands: An object- aware ego-centric video recognition model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.978003Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:5d6308566fb60d2c16f8b9fc85c6a65f2154a28748ada3abecf0260f8f63bf88","observation_id":"de2ca9f6-359d-4189-b4b6-b0a3b34ef1ba","resolution":{"observed_at":"2026-08-07T06:00:57.978003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09529","last_updated":"2022-11-17T13:45:06Z","snapshot_observed_at":"2026-08-16T16:15:24.262456Z","submitted_at":"2022-11-17T13:45:06Z","title":"InternVideo-Ego4D: A Pack of Champion Solutions to Ego4D Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09529","snapshot_observed_at":"2026-08-07T06:00:57.981041Z","title":"Internvideo-ego4d: A pack of champion solutions to ego4d challenges,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.981041Z"},"links":{"cited_paper":"/paper/2211.09529","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f901b219955fb5d9daab1c7ae7894cc11fbca43df7d699194fab7f8b3a16e27f","observation_id":"3409fdc2-855c-4f6d-873a-a1ce0e977652","resolution":{"observed_at":"2026-08-07T06:00:57.981041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18070","last_updated":"2024-07-01T02:44:11Z","snapshot_observed_at":"2026-08-16T13:39:33.398967Z","submitted_at":"2024-06-26T05:01:37Z","title":"EgoVideo: Exploring Egocentric Foundation Model and Downstream Adaptation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18070","snapshot_observed_at":"2026-08-07T06:00:57.984840Z","title":"Egovideo: Exploring egocentric foundation model and downstream adaptation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.984840Z"},"links":{"cited_paper":"/paper/2406.18070","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b670df3dd89ca669756ebf09f3feeefac7b864167d5b767d81a326c182a091c9","observation_id":"f9983feb-a51c-41c1-af03-335802655d06","resolution":{"observed_at":"2026-08-07T06:00:57.984840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00986","last_updated":"2025-03-02T18:49:48Z","snapshot_observed_at":"2026-08-16T19:26:09.525900Z","submitted_at":"2025-03-02T18:49:48Z","title":"Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00986","snapshot_observed_at":"2026-08-07T06:00:57.988600Z","title":"Modeling fine-grained hand-object dynamics for egocentric video representation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.988600Z"},"links":{"cited_paper":"/paper/2503.00986","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:9d06934f2bc865afedd4e1b65857bb0a474e69d9dbc7cb668d1036136cf458c1","observation_id":"a16b1666-ec09-4126-8ef0-97f72df90039","resolution":{"observed_at":"2026-08-07T06:00:57.988600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.992273Z","title":"Howto100m: Learning a text-video embedding by watching hundred million narrated video clips,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.992273Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b467225b19f05312df62076ad86a577d2d12bffe868e503646ddf4747a0305df","observation_id":"e245f29f-a38d-4fb5-a726-5b3c49bc8707","resolution":{"observed_at":"2026-08-07T06:00:57.992273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:57.995391Z","title":"Ava: A video dataset of spatio-temporally localized atomic visual actions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.995391Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:4a56ce1eb895929843cd8bdd23c4321790d963a802d0a684348b9e263ea66003","observation_id":"ae568efc-fef9-44c0-ad5e-d9697f50e110","resolution":{"observed_at":"2026-08-07T06:00:57.995391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T06:00:57.998824Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:57.998824Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:d748ed238f4cb9d10cc63fa31773a4216a9848ac9dea58214e16564f834d87f1","observation_id":"54cea94a-2052-4f2d-b744-36d2c658f2fe","resolution":{"observed_at":"2026-08-07T06:00:57.998824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.002334Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.002334Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:083cf29bf11adba801287f0d6afc4434c0cb8e4586366c8fe53d6f7146153d0a","observation_id":"3293467d-cc92-4031-90c4-4363fc75fb64","resolution":{"observed_at":"2026-08-07T06:00:58.002334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-07T06:00:58.005525Z","title":"Internvid: A large-scale video-text dataset for multi- modal understanding and generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.005525Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b8ada11d669ee69f38eebe7cd9f84f90043297ebe20b66ed5abfc4db58b66eea","observation_id":"dea69658-9404-4c83-ad71-b20e3413cc57","resolution":{"observed_at":"2026-08-07T06:00:58.005525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12075","last_updated":"2024-12-16T18:46:45Z","snapshot_observed_at":"2026-08-17T01:38:26.232918Z","submitted_at":"2024-12-16T18:46:45Z","title":"CG-Bench: Clue-grounded Question Answering Benchmark for Long Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12075","snapshot_observed_at":"2026-08-07T06:00:58.009101Z","title":"Cg-bench: Clue-grounded question answering bench- mark for long video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.009101Z"},"links":{"cited_paper":"/paper/2412.12075","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:146af35eaa79f81e31d43b3e213184a36980a5d327ec5dbd11b965561ba36c05","observation_id":"e150c5ae-358f-4b63-a745-006588ae60ac","resolution":{"observed_at":"2026-08-07T06:00:58.009101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.012293Z","title":"Two-stream convolutional networks for action recognition in videos,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.012293Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:03eeb9fa1750b18061928d6f6d6e3ff36b8da5155584df9527ab9bc4af43f0d8","observation_id":"bdfa705d-938d-45c6-9bc3-c78c4b6e0ac1","resolution":{"observed_at":"2026-08-07T06:00:58.012293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.015848Z","title":"Vivit: A video vision transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.015848Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:e9bc1332b425df4d4b1ce72774bd6889d2988f8dc7440006f15cb5cf2a78e1c2","observation_id":"7bfa6351-5b3f-4431-a2f0-739e95a31788","resolution":{"observed_at":"2026-08-07T06:00:58.015848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.018962Z","title":"Is space-time attention all you need for video understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.018962Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:580aa192aaaa58ef4a7986dd75a5842c4da1a4d7a94d0581ac2bb80e8d08754d","observation_id":"97186545-2b64-47b6-95a5-98518ac64d8f","resolution":{"observed_at":"2026-08-07T06:00:58.018962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.022165Z","title":"Dcan: improving temporal action detection via dual context aggregation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.022165Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0229146c715887ddc5b45e3d45e2ef05a3f506b34d1134337e1f99d939f640d3","observation_id":"7181832f-85af-4603-a126-31da2985b6f7","resolution":{"observed_at":"2026-08-07T06:00:58.022165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09626","last_updated":"2024-03-14T17:57:07Z","snapshot_observed_at":"2026-08-16T14:09:43.089136Z","submitted_at":"2024-03-14T17:57:07Z","title":"Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09626","snapshot_observed_at":"2026-08-07T06:00:58.025335Z","title":"Video mamba suite: State space model as a versatile alternative for video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.025335Z"},"links":{"cited_paper":"/paper/2403.09626","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:4d99f0e55f0554494134a2389b3bf040a2cd4e6b1c4b9564e25b9e8d0b133709","observation_id":"cf1f094d-3f3e-4ddf-9bdd-4c11961e0a0c","resolution":{"observed_at":"2026-08-07T06:00:58.025335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.028962Z","title":"Memory-and- anticipation transformer for online action understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.028962Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:25bbfd54d81663b684f38f1cbdfe6018bd40c3022f545444691d88cffb834a38","observation_id":"915a13eb-1e08-46e8-9069-5e97781bc6bb","resolution":{"observed_at":"2026-08-07T06:00:58.028962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.032105Z","title":"Video super-resolution based on deep learning: a comprehensive survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.032105Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:983d87315ed430599d2ef58ac2bdc83a5d39dffc134c54765642171fe2bf9c7b","observation_id":"9f4eedf7-f0d6-42f6-953c-6e24f3001aa4","resolution":{"observed_at":"2026-08-07T06:00:58.032105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15106","last_updated":"2025-05-06T08:18:58Z","snapshot_observed_at":"2026-08-12T14:27:13.430982Z","submitted_at":"2024-11-22T18:09:27Z","title":"About Time: Advances, Challenges, and Outlooks of Action Understanding","version":2},"cited_work":{"arxiv_id":"2411.15106","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15106","snapshot_observed_at":"2026-08-07T06:00:59.305563Z","title":"About Time: Advances, Challenges, and Outlooks of Action Understanding","venue":"cs.CV","work_id":"defded38-034e-4b3d-ab08-2d4765b82c4a","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.035211Z"},"links":{"cited_paper":"/paper/2411.15106","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:a86f82d68478e31aa02b4cba89c0c89f9349bdbf6bcdfa3213c9422478314901","observation_id":"5a28b631-ac4a-443e-b08a-e0d2eeca33c8","resolution":{"observed_at":"2026-08-07T06:00:59.308901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.038552Z","title":"New generation deep learning for video object detection: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.038552Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:744cbdba6f68f645c1723cff502e81b60d5ad1cb3e60b0cd0e3f67da77b629a2","observation_id":"71659575-57df-46b6-9c4a-500e7dd6e53b","resolution":{"observed_at":"2026-08-07T06:00:58.038552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.041980Z","title":"A survey of single- scene video anomaly detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.041980Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:99d150205690ecb36aae3dda3ab7880b1b4842ad14a72f6f9792828256f473b8","observation_id":"acd52d00-f69c-4cf3-9f83-d24fa743bccb","resolution":{"observed_at":"2026-08-07T06:00:58.041980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.045209Z","title":"An outlook into the future of egocentric vision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.045209Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:8e6a51a5a8771594968910320254e6f15666000c5a647db99bf256acd3eb31cd","observation_id":"dc61d0e5-4136-43ce-978c-7980e4faa733","resolution":{"observed_at":"2026-08-07T06:00:58.045209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.048387Z","title":"Samsung’s new smart fridge lets you check in on its contents through internal cameras,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.048387Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:c9a9f2672771c161eddd4cdbf43ea2331f65c025c1410e689236e494277f07be","observation_id":"6b424aeb-f922-4e13-84c6-ed4c82bb3bd7","resolution":{"observed_at":"2026-08-07T06:00:58.048387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.051608Z","title":"June oven,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.051608Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:1b725eb1ba12ec9bb23bd410f656555021284688b56751b828371c82c332c0f9","observation_id":"d4d9fff8-edce-4580-81bd-5de72267a17e","resolution":{"observed_at":"2026-08-07T06:00:58.051608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.054917Z","title":"Sportvu stats can be helpful, overwhelming,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.054917Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:9647f4e4d0f84b1184d8dc58ea712220599c84659bf4c2f7e98f66eb63a13384","observation_id":"4d5c1a09-a4d5-4c8b-b919-939e2ecd6b6a","resolution":{"observed_at":"2026-08-07T06:00:58.054917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.061562Z","title":"Hawk-eye’s eagle eye on wimbledon tennis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.061562Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:8a8e8ccece8a55d62f95e7fb5b1cc4a3b6f0fc0c6de1fff72f70754192143e4c","observation_id":"24f81924-18cf-4309-b36e-ac5932aaac65","resolution":{"observed_at":"2026-08-07T06:00:58.061562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.064884Z","title":"Super bowl li preview: Inside fox sports’ “be the player","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.064884Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:21916fdcbd0309a46f6824b34fed641dde7c0ac35c74581d1d738f56bd513f98","observation_id":"e6bfa8ee-0baf-443c-bead-c91e7cd873ed","resolution":{"observed_at":"2026-08-07T06:00:58.064884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.068469Z","title":"Smart glasses in hospitals: Viewing care delivery through a new lens,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.068469Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ae0227a4d8d906f3e8d98bed05551cb65ec60de6461e8ef51eb9aa091b2b3d74","observation_id":"5de14c67-5967-4cf1-aff1-6e59da29ac88","resolution":{"observed_at":"2026-08-07T06:00:58.068469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.071838Z","title":"Here’s how asean’s first 5g smart hospital is using ai to usher in a new era of healthcare,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.071838Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:e569943e7ac353aca1526572b37e95602511d06e30822dbc9b259b2694f2a430","observation_id":"577419d3-bd46-4d22-926f-97dc14ef7958","resolution":{"observed_at":"2026-08-07T06:00:58.071838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.074984Z","title":"Cameras could be installed in classrooms in these states,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.074984Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:6f5e433d6d1d54db4140f414b142838a46f3ff0fb99dd8d7519bd848cdbee702","observation_id":"3983f22a-70ec-43d9-a8ca-83410529d160","resolution":{"observed_at":"2026-08-07T06:00:58.074984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.078203Z","title":"Classroom camera: Transform education,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.078203Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ddc97026807655101bfaabd1251cae764b539e51a0fe417f619c6902447b69d4","observation_id":"65b08378-531d-45bc-a8c5-aff8a16dcc38","resolution":{"observed_at":"2026-08-07T06:00:58.078203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.081425Z","title":"3d surround view system,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.081425Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:1a34a0d7bafeab942d2bf12439eb1bc5f29ded6a2ad7007cbe4e79b3a4615e9b","observation_id":"b1d90ad4-e52b-4d45-8f36-cd6afa463302","resolution":{"observed_at":"2026-08-07T06:00:58.081425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.084697Z","title":"Nauto launches real-time driver behavior learning platform for fleets,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.084697Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:20aef8a1920daebfe7f54b6a5a806a0b5cc9377ab2974063fd56e2c14b5a119e","observation_id":"62673f6e-7fae-45aa-b282-99a206bfde99","resolution":{"observed_at":"2026-08-07T06:00:58.084697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.087814Z","title":"Vision-centric semantic occupancy predic- tion for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.087814Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:51664176469047c0f6b4b5efd5115a78ec801df880557afc61794314bc369070","observation_id":"bc843e9e-a9a9-4fff-9e67-24e1af70df43","resolution":{"observed_at":"2026-08-07T06:00:58.087814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.091110Z","title":"Top 10 applications of robotics in 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.091110Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:3faead8f13536adebdc1e3a1465d40074e6eab5ecf9b0301c3e67d38e133ef27","observation_id":"0fe28c67-baf9-4f03-a1e2-05fc02096c67","resolution":{"observed_at":"2026-08-07T06:00:58.091110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.094500Z","title":"Research on body-worn cameras and law enforcement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.094500Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:04da1dae4d9da6b419a13e39c1b512bc808636db6e8aad468be6f170890cf768","observation_id":"a42b6b65-3bda-429b-aa84-da2bbb7ac7b3","resolution":{"observed_at":"2026-08-07T06:00:58.094500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.097876Z","title":"Over 1,000 people saved with drone search and rescue: Dji,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.097876Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f4375056153ca6f06d93d5b65535adf9d50c231b73ba46d1ddf19be2c64238f6","observation_id":"1cc0eb82-b4b6-4142-b305-ebcfa8f50887","resolution":{"observed_at":"2026-08-07T06:00:58.097876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.101197Z","title":"Empowering health & safety monitoring in manufacturing - fogsphere,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.101197Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b8a3bc43dd907de05000652087f20250f210106384c2544ecc87a09331acd7ed","observation_id":"addc3cda-efd2-4c17-952b-5db184283315","resolution":{"observed_at":"2026-08-07T06:00:58.101197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"video/5513158","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:59.290931Z","title":"A vision-guided robotic system designed to grab any object,","venue":null,"work_id":"ce5f6e28-bc4b-4021-a7e6-e1aae99efabd","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.104347Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:13b7c735b24602ac99a11cb685b67e723838638bee885fbb4aae2392f1993ce7","observation_id":"02ea3cd7-7687-448d-8fb2-f871add5d081","resolution":{"observed_at":"2026-08-07T06:00:59.297265Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.107673Z","title":"How visual ai transforms assembly line operations in factories,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.107673Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:1ec0a19deeb825adf20190f576537e58207a8c2189e851d155e609fd973ee5ff","observation_id":"ffde47f3-fbb6-4375-a167-6d5e42bd7f6d","resolution":{"observed_at":"2026-08-07T06:00:58.107673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.114185Z","title":"Ego-exo: Transferring visual representations from third-person to first-person videos,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.114185Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:97228ce55e88cffde0af5b2266eb168476f27fbe657f75c43d585b1810fc37d5","observation_id":"f74c630f-865b-4615-8c44-e66d1d69b905","resolution":{"observed_at":"2026-08-07T06:00:58.114185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15699","last_updated":"2024-08-26T14:39:33Z","snapshot_observed_at":"2026-08-16T15:29:55.085145Z","submitted_at":"2023-05-25T04:14:49Z","title":"Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective","version":3},"cited_work":{"arxiv_id":"2305.15699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15699","snapshot_observed_at":"2026-08-07T06:00:59.222829Z","title":"Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective","venue":"cs.CV","work_id":"db69f928-ce3a-4e39-99ec-2021f8a0a644","year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.117536Z"},"links":{"cited_paper":"/paper/2305.15699","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:7b09be2fa09f9aa1530a6eb4857730e078612d5790fff462321728b3e4e9148b","observation_id":"e6dda2a3-13ea-4e11-9218-d2113a640920","resolution":{"observed_at":"2026-08-07T06:00:59.226029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03567","last_updated":"2024-08-07T06:10:45Z","snapshot_observed_at":"2026-08-16T13:28:03.319961Z","submitted_at":"2024-08-07T06:10:45Z","title":"Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning","version":1},"cited_work":{"arxiv_id":"2408.03567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03567","snapshot_observed_at":"2026-08-07T06:00:59.211224Z","title":"Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning","venue":"cs.CV","work_id":"4c14643c-63af-47e2-b1aa-cd879833a028","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.121129Z"},"links":{"cited_paper":"/paper/2408.03567","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b90962e8e3ce40f1f4ef0f3379cfd844270ca98ed524718f3154c7546018d40e","observation_id":"25f3ba48-67e8-4cca-8675-f3c337fa1bc1","resolution":{"observed_at":"2026-08-07T06:00:59.214483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.124780Z","title":"Holographic feature learning of egocentric-exocentric videos for multi-domain action recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.124780Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:da176800d89bf14ae4249270e43f395eed1fd80913a78329bf52be8eea75e7bd","observation_id":"11d6b3fe-c6d4-47ed-9228-5d7b79c9663c","resolution":{"observed_at":"2026-08-07T06:00:58.124780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02638","last_updated":"2024-07-16T11:27:04Z","snapshot_observed_at":"2026-08-16T14:37:33.248044Z","submitted_at":"2023-12-05T10:24:43Z","title":"Synchronization is All You Need: Exocentric-to-Egocentric Transfer for Temporal Action Segmentation with Unlabeled Synchronized Video Pairs","version":3},"cited_work":{"arxiv_id":"2312.02638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.02638","snapshot_observed_at":"2026-08-07T06:00:59.198629Z","title":"Synchronization is All You Need: Exocentric-to-Egocentric Transfer for Temporal Action Segmentation with Unlabeled Synchronized Video Pairs","venue":"cs.CV","work_id":"80243fc1-3d1b-455b-914a-08125e84211c","year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.127930Z"},"links":{"cited_paper":"/paper/2312.02638","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:407c2bc45314ac9b4ca3fff00ca9e71107558317bd3a14e0f181f3a135d15090","observation_id":"dc40f899-1f76-402e-95db-2869aa8fc009","resolution":{"observed_at":"2026-08-07T06:00:59.202009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.131385Z","title":"Action recognition in the presence of one egocentric and multiple static cameras,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.131385Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f7082ccf78c68e5fe74b52b0084b392d698a3dd58df48bf2709f6191ffc631b8","observation_id":"140734d6-cf53-4b6b-acc3-4f9d4c64fa65","resolution":{"observed_at":"2026-08-07T06:00:58.131385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.134575Z","title":"Cross-view exocentric to egocentric video synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.134575Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:79a25905cc198dc5b14f17fe7802dca447a76a83f41bc7c5421cb99ca0c1e220","observation_id":"e2456166-a86e-44c4-843d-18dea8412d75","resolution":{"observed_at":"2026-08-07T06:00:58.134575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.137626Z","title":"4diff: 3d-aware diffusion model for third-to-first viewpoint translation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.137626Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ee477db61522a01ba9b414337f23dd643b00d7c50229d944ddfe3aabfeb61fd2","observation_id":"d56c156e-72fd-4ba5-8176-2cab56abf638","resolution":{"observed_at":"2026-08-07T06:00:58.137626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16444","last_updated":"2024-12-09T05:49:01Z","snapshot_observed_at":"2026-08-16T14:39:48.270925Z","submitted_at":"2023-11-28T02:51:13Z","title":"Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos","version":4},"cited_work":{"arxiv_id":"2311.16444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16444","snapshot_observed_at":"2026-08-07T06:00:59.186649Z","title":"Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos","venue":"cs.CV","work_id":"65cbbadb-c1f7-4a38-beff-b9e26ff617b2","year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.140709Z"},"links":{"cited_paper":"/paper/2311.16444","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:cf22315db65459d2287fdc023f6b65da133194cf3449192f535c6e224fe8d560","observation_id":"f79303a0-545e-4b92-a0a6-a32e67981693","resolution":{"observed_at":"2026-08-07T06:00:59.190129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.144387Z","title":"Retrieval-augmented egocentric video captioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.144387Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f95ddf4ce634a2289767091784f3e121e9765990d0cf7932e3a9d2b9e6b315df","observation_id":"8a2aa8ca-f4f5-45ee-ac02-4ea499e89066","resolution":{"observed_at":"2026-08-07T06:00:58.144387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.150933Z","title":"Enhancing egocentric 3d pose estimation with third person views,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.150933Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:5fe9b564aa2ae3e1e894b2b36820a94efe7b345a13f90c49434b883d88a7a468","observation_id":"ab9a92df-dc05-4ea3-8bc0-0431341bc318","resolution":{"observed_at":"2026-08-07T06:00:58.150933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.154021Z","title":"An exocentric look at egocentric actions and vice versa,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.154021Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:43168b0c4d7f2a4baa0d519e387a5fbdbe11868d8770a81f3dfcd69072c51ce4","observation_id":"37af7a27-8e63-4a7f-8205-916e7d16caf5","resolution":{"observed_at":"2026-08-07T06:00:58.154021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.157034Z","title":"Learning fine-grained view-invariant representations from unpaired ego-exo videos via temporal alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.157034Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:a16986f428f00da2b49d0e1cf254b40ebfb68f85a40c3d5ddc009183810722f1","observation_id":"2433b63b-39b6-4c9c-99a6-3754812b2047","resolution":{"observed_at":"2026-08-07T06:00:58.157034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.159972Z","title":"Camera selection for occlusion-less surgery recording via training with an egocentric camera,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.159972Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:dea0f4fd72f8c080c6143b0af8f2de4d28dcb1afee0594a9e80599cd47a15f59","observation_id":"d09cedb1-d1fe-4384-abb3-e3c9d72d3d5e","resolution":{"observed_at":"2026-08-07T06:00:58.159972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03535","last_updated":"2025-04-10T17:23:33Z","snapshot_observed_at":"2026-08-16T15:35:20.022117Z","submitted_at":"2023-05-05T13:42:19Z","title":"Next-generation Surgical Navigation: Marker-less Multi-view 6DoF Pose Estimation of Surgical Instruments","version":3},"cited_work":{"arxiv_id":"2305.03535","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.03535","snapshot_observed_at":"2026-08-07T06:00:59.174230Z","title":"Next-generation Surgical Navigation: Marker-less Multi-view 6DoF Pose Estimation of Surgical Instruments","venue":"cs.CV","work_id":"f788b4aa-fb40-44b7-affd-4833e9cb38f6","year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.163216Z"},"links":{"cited_paper":"/paper/2305.03535","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:a8e4b8c0793647a1c8c7e6371977e70bdf9ea5e616190e6c62fbef47e2750694","observation_id":"ef1689f6-ad6b-4a2d-8bdd-bce1b670d1a2","resolution":{"observed_at":"2026-08-07T06:00:59.177659Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.166601Z","title":"Look both ways: Self-supervising driver gaze estimation and road scene saliency,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.166601Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0a4d721c12562a617bc870727a3bbbb8dd686bf53068d3f3343ab09a13c3a93d","observation_id":"44c25448-911f-4803-8710-81ac086c3e4a","resolution":{"observed_at":"2026-08-07T06:00:58.166601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.169764Z","title":"Aide: A vision-driven multi-view, multi-modal, multi- tasking dataset for assistive driving perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.169764Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:c09cf25257392b49cc419b28de79797b3615614c8dc13f21a61a481d6584431c","observation_id":"4eea8dc4-92bc-4a2b-86bd-d0437b3b1e2f","resolution":{"observed_at":"2026-08-07T06:00:58.169764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12677","last_updated":"2022-03-15T18:46:18Z","snapshot_observed_at":"2026-08-18T03:07:13.776995Z","submitted_at":"2022-03-15T18:46:18Z","title":"Vision-Based Manipulators Need to Also See from Their Hands","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12677","snapshot_observed_at":"2026-08-07T06:00:58.173472Z","title":"Vision-based ma- nipulators need to also see from their hands,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.173472Z"},"links":{"cited_paper":"/paper/2203.12677","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:583c9dc2b1bb3a68e18d16450fda7e24d1ec71198e0eabcad583dc5c8d3ea1bf","observation_id":"937c04e3-f2b9-40ee-b865-0127a5deb6b9","resolution":{"observed_at":"2026-08-07T06:00:58.173472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.177155Z","title":"Look closer: Bridging egocentric and third-person views with transformers for robotic manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.177155Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0e82854306a050f669ec526a7a7b965416eab7e96d1a47a8b9a6f0ec69b7ede8","observation_id":"b43bca28-9b7c-4f80-93bf-30385c25b8bf","resolution":{"observed_at":"2026-08-07T06:00:58.177155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.180196Z","title":"Self-supervised disentangled representation learning for third-person imitation learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.180196Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:d496310a9e133c41c5563d5734103427cbceeb9abfde063bf1e93db3b42f70cd","observation_id":"d3a44871-7bf7-4fb0-8dff-f3fe6e07a5f9","resolution":{"observed_at":"2026-08-07T06:00:58.180196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.183279Z","title":"Visual-policy learning through multi-camera view to single-camera view knowledge distilla- tion for robot manipulation tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.183279Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:612c8783140612dc3ca63656859e8c3c70e81cdd31a8072bb0c90b59baf5ba99","observation_id":"1d300de4-a682-4ffb-b6e9-9e11078a2af4","resolution":{"observed_at":"2026-08-07T06:00:58.183279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.186411Z","title":"Third-person visual imitation learning via decoupled hierarchical controller,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.186411Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:44122bedec9e71f635819ab6604e2649f1d11c291cdab49f76e8aae4fe722ea9","observation_id":"cd3940bd-5c8d-4ecd-a52a-fddbecfe00f8","resolution":{"observed_at":"2026-08-07T06:00:58.186411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14064","last_updated":"2024-06-21T14:12:54Z","snapshot_observed_at":"2026-08-17T13:40:33.650178Z","submitted_at":"2024-04-22T10:21:41Z","title":"Multi-view Disentanglement for Reinforcement Learning with Multiple Cameras","version":2},"cited_work":{"arxiv_id":"2404.14064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.14064","snapshot_observed_at":"2026-08-07T06:00:59.153367Z","title":"Multi-view Disentanglement for Reinforcement Learning with Multiple Cameras","venue":"cs.LG","work_id":"e444a0c4-64ec-44dc-af79-ae3f3de1cdd0","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.189434Z"},"links":{"cited_paper":"/paper/2404.14064","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b5fbcb5f4ecec43ead87a5b1b9dec5cef4efd6b29a51d68d0e8294e3ad339dfc","observation_id":"f59ffdf4-bb3e-4afd-b68a-0ada4b235f2d","resolution":{"observed_at":"2026-08-07T06:00:59.156984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.192678Z","title":"Multi-view masked world models for visual robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.192678Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:6914e57a4ef151d824b1370b86a21730fe282b26d4df369d4f0d20683b824269","observation_id":"1931acb4-4c06-4387-aeba-1c96d0adba4d","resolution":{"observed_at":"2026-08-07T06:00:58.192678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.01316","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:59.138489Z","title":"Learning fused state representations for control from multi-view observations,","venue":null,"work_id":"d19a4adb-ea52-42f1-b081-f64340f7efff","year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.195943Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:724ed272c2a3f2ed7493d583cc07f3a5418c5fb712e9d3f348b735420b8d0d9b","observation_id":"f60daab0-2fbf-42b8-aa39-28cb18789396","resolution":{"observed_at":"2026-08-07T06:00:59.144346Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05603","last_updated":"2024-04-08T15:22:38Z","snapshot_observed_at":"2026-08-16T14:02:41.284094Z","submitted_at":"2024-04-08T15:22:38Z","title":"Self-Explainable Affordance Learning with Embodied Caption","version":1},"cited_work":{"arxiv_id":"2404.05603","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.05603","snapshot_observed_at":"2026-08-07T06:00:59.067766Z","title":"Self-Explainable Affordance Learning with Embodied Caption","venue":"cs.CV","work_id":"db64ebfc-8505-49a6-88bb-8495e3cd8afb","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.199398Z"},"links":{"cited_paper":"/paper/2404.05603","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:64e38cc0225c040f1a35edc544fa0078a88eb3bb0a306f58b53a2df813956d0a","observation_id":"1d382b46-5e47-4bb9-a930-9a0df140e584","resolution":{"observed_at":"2026-08-07T06:00:59.071229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00614","last_updated":"2025-07-19T14:17:38Z","snapshot_observed_at":"2026-08-16T13:38:26.243982Z","submitted_at":"2024-06-30T07:42:57Z","title":"Learning Granularity-Aware Affordances from Human-Object Interaction for Tool-Based Functional Dexterous Grasping","version":2},"cited_work":{"arxiv_id":"2407.00614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.00614","snapshot_observed_at":"2026-08-07T06:00:59.055788Z","title":"Learning Granularity-Aware Affordances from Human-Object Interaction for Tool-Based Functional Dexterous Grasping","venue":"cs.RO","work_id":"bb4fa8a9-a4a2-4a50-9bf9-20334a3ca265","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.202712Z"},"links":{"cited_paper":"/paper/2407.00614","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ff21d9a8bdd8d8aad78e31e960716bd63020e4576408a8f9dd43c3ddb31a4316","observation_id":"02878028-fd34-40c7-ae60-6a83205e3e99","resolution":{"observed_at":"2026-08-07T06:00:59.059184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.206236Z","title":"Towards third-person visual imitation learning using generative adversarial networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.206236Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0bd4c88b52f2f97c85b62529275d5a4484ca16148fe213468726cca2cfcb051e","observation_id":"0a6e9195-7f1a-466f-b17b-b54de67e5944","resolution":{"observed_at":"2026-08-07T06:00:58.206236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07735","last_updated":"2024-10-04T14:03:45Z","snapshot_observed_at":"2026-08-16T14:01:45.283162Z","submitted_at":"2024-04-11T13:30:03Z","title":"Diffusing in Someone Else's Shoes: Robotic Perspective Taking with Diffusion","version":2},"cited_work":{"arxiv_id":"2404.07735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07735","snapshot_observed_at":"2026-08-07T06:00:59.043583Z","title":"Diffusing in Someone Else's Shoes: Robotic Perspective Taking with Diffusion","venue":"cs.RO","work_id":"2ef211d2-b90f-4eea-bd08-5cfe7c634e92","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.209297Z"},"links":{"cited_paper":"/paper/2404.07735","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:634bb7c60b8c1c7453d1127e2ff91d5d868f1b1f15cab28e652221fcbf1afce0","observation_id":"62ad559d-c1c7-4bac-9f8e-7ebe6b3821cd","resolution":{"observed_at":"2026-08-07T06:00:59.047019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00848","last_updated":"2026-05-23T18:13:20Z","snapshot_observed_at":"2026-08-18T05:06:21.125798Z","submitted_at":"2024-06-30T22:53:44Z","title":"EgoExo++: Integrating On-demand Exocentric Visuals with 2.5D Ground Surface Estimation for Interactive Teleoperation of Underwater ROVs","version":7},"cited_work":{"arxiv_id":"2407.00848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.00848","snapshot_observed_at":"2026-08-07T06:00:59.030928Z","title":"EgoExo++: Integrating On-demand Exocentric Visuals with 2.5D Ground Surface Estimation for Interactive Teleoperation of Underwater ROVs","venue":"cs.RO","work_id":"9ff23484-4f64-46e5-b488-e016d97d895b","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.212604Z"},"links":{"cited_paper":"/paper/2407.00848","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:68f71e4635203714443764836b2ee8c4990c0d78f49e412ad8e610df83cbd43c","observation_id":"b9fd2273-5029-4c54-8ccd-f5ae02b870be","resolution":{"observed_at":"2026-08-07T06:00:59.034635Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.216093Z","title":"Spatial assisted human-drone collabo- rative navigation and interaction through immersive mixed reality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.216093Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:5e97f2b23e4f3bf1f5b695d659c191517c12ae58e2b1302a32e81ae404a19f2c","observation_id":"f7b932ca-3b18-45bb-beba-744dc97096dd","resolution":{"observed_at":"2026-08-07T06:00:58.216093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.219093Z","title":"Yowo: You only walk once to jointly map an indoor scene and register ceiling-mounted cameras,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.219093Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:d5ac9042c04e1eb2d6612a8a48192c845861f540b6ca581c5bec02a352bedd34","observation_id":"ec39af18-7de1-4e8b-8fcd-9f7ad427a5b8","resolution":{"observed_at":"2026-08-07T06:00:58.219093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.222230Z","title":"Fourth- person captioning: Describing daily events by uni-supervised and tri- regularized training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.222230Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ff8abeb7f8dce10a9696851cd2ef6b663369b366e02469daf86051024e244480","observation_id":"68f4feeb-d9b5-4d08-af6a-c10d7d2847eb","resolution":{"observed_at":"2026-08-07T06:00:58.222230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.225408Z","title":"Put myself in your shoes: Lifting the egocentric perspective from exocentric videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.225408Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:0050e80ba64e6a8f3a7780a7e29940df78fa86b643b11a75ab9d2dd1df2fef69","observation_id":"fe3d313e-9a0f-462c-8c99-f2ca53c167cb","resolution":{"observed_at":"2026-08-07T06:00:58.225408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.228822Z","title":"Animate any- one: Consistent and controllable image-to-video synthesis for character animation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.228822Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:9d13c24c110256202cde3d0a3f097d916c70d2cd2d91cc960774bc1f3dd8e9e3","observation_id":"3b35bfd2-c0f7-408b-ad22-2cc003f47a95","resolution":{"observed_at":"2026-08-07T06:00:58.228822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T06:00:58.231968Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.231968Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f59b7f165edfb7ce5e3208a462e54fe0e0190d6004bbf43db0a78c48547199b6","observation_id":"f5b5f75f-9f0d-438e-97a6-4702d6cbff61","resolution":{"observed_at":"2026-08-07T06:00:58.231968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T06:00:58.235038Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.235038Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:eb70621c1af66114f406b7eea2c621d325441b30720d54744cb18d59160bb3da","observation_id":"75f0171b-f9c4-4b81-8127-fa0ed9e1f258","resolution":{"observed_at":"2026-08-07T06:00:58.235038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.238355Z","title":"Structure and content-guided video synthesis with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.238355Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:3c87e565559336d56e604300e1cf3414ac3eac8cbbe961c527d5cdd18614bd08","observation_id":"7d0eda2d-c1f1-41e5-8449-1376b9b0623e","resolution":{"observed_at":"2026-08-07T06:00:58.238355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-07T06:00:58.241506Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.241506Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:76335c146a05d360ab1f89679b0bdb820483b09baaf8df7dfae6299e0d868189","observation_id":"df15d463-3536-4f1f-a74d-4ba63406f21c","resolution":{"observed_at":"2026-08-07T06:00:58.241506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09194","last_updated":"2024-03-17T13:28:32Z","snapshot_observed_at":"2026-08-16T14:09:54.739067Z","submitted_at":"2024-03-14T09:07:31Z","title":"Intention-driven Ego-to-Exo Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09194","snapshot_observed_at":"2026-08-07T06:00:58.245042Z","title":"Intention-driven ego-to-exo video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.245042Z"},"links":{"cited_paper":"/paper/2403.09194","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:50cb31530e91200ac34ebcac7851c34b03e95807c40aedfb36c320312b05f4c1","observation_id":"0601648e-41cd-4ab2-ab00-8bc51e7b26fa","resolution":{"observed_at":"2026-08-07T06:00:58.245042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05711","last_updated":"2026-07-07T18:04:35Z","snapshot_observed_at":"2026-08-16T13:07:36.008294Z","submitted_at":"2025-01-10T05:01:58Z","title":"From My View to Yours: Learning Egocentric Cues from Exocentric Video using Privileged Egocentric Supervision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05711","snapshot_observed_at":"2026-08-07T06:00:58.248363Z","title":"From my view to yours: Ego- augmented learning in large vision language models for understanding exocentric daily living activities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.248363Z"},"links":{"cited_paper":"/paper/2501.05711","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:b340553b8ef343b49aa8a75f43f1a9c8ef39488792efbff367c7d7da2d2d2663","observation_id":"8ddf5007-f84d-4fab-b0ee-a35a16af8f09","resolution":{"observed_at":"2026-08-07T06:00:58.248363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.252084Z","title":"Viewbirdiformer: Learn- ing to recover ground-plane crowd trajectories and ego-motion from a single ego-centric view,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.252084Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:2d7c7f7bc4b7fb311497cd7d556a314708c2a0f4c156f11e8d7b8235ed75f95c","observation_id":"09db81fe-8ff0-40e8-a31f-5867478076fc","resolution":{"observed_at":"2026-08-07T06:00:58.252084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.255169Z","title":"View birdification in the crowd: Ground-plane localization from perceived movements,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.255169Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:5c21161e776a547f3c7b8ef1eb02150e3a3f22f684136e1b5156aa5b89a20ec7","observation_id":"0a973ba5-269a-4c2f-a09f-36b53698d0be","resolution":{"observed_at":"2026-08-07T06:00:58.255169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09534","last_updated":"2023-03-16T17:51:02Z","snapshot_observed_at":"2026-08-16T15:47:37.069198Z","submitted_at":"2023-03-16T17:51:02Z","title":"InCrowdFormer: On-Ground Pedestrian World Model From Egocentric Views","version":1},"cited_work":{"arxiv_id":"2303.09534","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.09534","snapshot_observed_at":"2026-08-07T06:00:58.977026Z","title":"InCrowdFormer: On-Ground Pedestrian World Model From Egocentric Views","venue":"cs.CV","work_id":"ebc647d2-237c-4315-a00b-127eca549926","year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.258291Z"},"links":{"cited_paper":"/paper/2303.09534","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:5137af39bfb2e4be420d4edcb50bd988aa4b6a696e92b1f8b2e11a4f79dc0469","observation_id":"e1d597c8-95f2-4e33-9896-89d3f280fcbf","resolution":{"observed_at":"2026-08-07T06:00:58.980923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.261783Z","title":"Fastllve: Real-time low- light video enhancement with intensity-aware look-up table,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.261783Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:006d6e6b71c44ffe34841b614a3868211ab51b10458c99a9da02258e36cf3963","observation_id":"56f5fc95-63dc-497f-95b5-82b19c3dc241","resolution":{"observed_at":"2026-08-07T06:00:58.261783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.265081Z","title":"Flow-guided sparse transformer for video deblurring,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.265081Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:64f3e4eb781d2cbf30b4ce912761792d450aa4c231bf4ad23dc829a6632d7f44","observation_id":"36ed3ad2-5798-4a0f-8f57-ead9ce7eca35","resolution":{"observed_at":"2026-08-07T06:00:58.265081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.268216Z","title":"Blur interpolation transformer for real-world motion from blur,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.268216Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:9898d062e80420ffd28be3a3fc0a08eefa7c5c24ac4c15faae59d4de2ebe1300","observation_id":"903fb85e-f9b9-49e2-9343-20b758b08f86","resolution":{"observed_at":"2026-08-07T06:00:58.268216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.271464Z","title":"Surgery recording without occlusions by multi-view surgical videos,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.271464Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:c738ba6c4c1e6b2b7d02abe9a9ccea23540044d1bc4c04fbb61410d511596ab3","observation_id":"8d11faf2-e7f8-47f8-ba6c-9ce53d2708bd","resolution":{"observed_at":"2026-08-07T06:00:58.271464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:58.274656Z","title":"Deep selection: A fully supervised camera selection network for surgery recordings,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.274656Z"},"links":{"citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f44c2528b5f699afc19d37b0adea204ac6d96b59333c0d868eb8f83d5264307a","observation_id":"8d3167d9-a6e2-4cf3-9965-0112fcb1ab5b","resolution":{"observed_at":"2026-08-07T06:00:58.274656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00104","last_updated":"2018-12-01T00:10:03Z","snapshot_observed_at":"2026-08-14T17:50:18.113950Z","submitted_at":"2018-12-01T00:10:03Z","title":"From Third Person to First Person: Dataset and Baselines for Synthesis and Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00104","snapshot_observed_at":"2026-08-07T06:00:58.278097Z","title":"From third person to first person: Dataset and baselines for synthesis and retrieval,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.278097Z"},"links":{"cited_paper":"/paper/1812.00104","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:49e15994b61867a342bd396e46310571c6648926ad4e0d81900288a6cb9cc91c","observation_id":"34d9fb10-5a77-412f-9cc1-fd228049a69e","resolution":{"observed_at":"2026-08-07T06:00:58.278097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T22:43:09.609365Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":14,"verified_fuzzy":0},"total_outbound_references":217},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 217 outbound references and 0 inbound Pith citation observations for arXiv:2506.06253."}