{"as_of":"2026-08-23T15:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e4e49fb020132fe67738dce6dc13179510f56b2864869ffc04f61b44f0b3441","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:45:38.580328Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:27:16.709927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T06:00:58.830819Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18386","snapshot_observed_at":"2026-08-12T21:27:16.709927Z","title":"Switch-a-view: Few-shot view selection learned from edited videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08753","last_updated":"2025-04-10T02:02:49Z","snapshot_observed_at":"2026-08-20T02:42:43.971083Z","submitted_at":"2024-11-13T16:31:08Z","title":"Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T21:27:16.709927Z"},"links":{"cited_paper":"/paper/2412.18386","citing_paper":"/paper/2411.08753"},"observation_digest":"sha256:cbe3f386a5515d3c11d9c21b5585cddf00b994e7a95c4293eb0bd266104fe34c","observation_id":"a9ae5bc4-44f2-43e1-b13f-e77415b31e02","resolution":{"observed_at":"2026-08-12T21:27:16.709927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"cited_work":{"arxiv_id":"2412.18386","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18386","snapshot_observed_at":"2026-08-07T06:00:58.830819Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","venue":"cs.CV","work_id":"92c30ec4-75ee-4783-91d4-f57009591326","year":2024},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-20T07:24:18.191697Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":188,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.559413Z"},"links":{"cited_paper":"/paper/2412.18386","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:ccfeb37857f395dccee5a5e08074fe4418d2d344a4dfd2c1ac5a3cee6f928c70","observation_id":"4797b74f-9155-47ed-84a9-277a0af256dd","resolution":{"observed_at":"2026-08-07T06:00:58.834429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18386/citation-record","integrity":"/paper/2412.18386/integrity","json":"/paper/2412.18386/citation-record.json","paper":"/paper/2412.18386"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.582982Z","title":"A dataset for developing and benchmarking active vision","venue":null,"work_id":"1110831a-8c9f-406f-802c-b23885e89752","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.291451Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:7e42e20bf637e7321da0b6f7f0528b65d3b3679de9982f239d4228897b0c7126","observation_id":"64959c63-0154-46d7-b7f5-969def484dc7","resolution":{"observed_at":"2026-08-11T04:45:39.587961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.568090Z","title":"Automatic editing of footage from multiple social cameras","venue":null,"work_id":"864dcd27-b267-4c83-8d03-5278575aa89f","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.296643Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:7e0feb391c4d44e8b5e28e597b4b56d5300726fff254bcdee60b86a358ab6a43","observation_id":"c4e0d9cd-a624-4119-b945-b64fa50a35d6","resolution":{"observed_at":"2026-08-11T04:45:39.573058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.553262Z","title":"Video-mined task graphs for keystep recognition in instructional videos","venue":null,"work_id":"60a93863-dba9-4044-b619-ead5eb21f3db","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.302713Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:761f2d3d76e2cd7928726f075b0fa77bbf57bd14d8399708d3189ed7be9e28af","observation_id":"2eb52fd6-db00-46b0-a2ce-cf1d2e572a28","resolution":{"observed_at":"2026-08-11T04:45:39.558244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.538407Z","title":"Contrastive learning for unsupervised video highlight detection","venue":null,"work_id":"70b46c9b-0e48-4d19-9253-33bcc0c75ad1","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.307900Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:8f115fd940c6328a3ac9709087a33644a71923b09e1d7d8da6cd0fd127270bda","observation_id":"6b6f8818-2662-495e-89a2-097f7ee5bedf","resolution":{"observed_at":"2026-08-11T04:45:39.543322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.523457Z","title":"Pyscenedetect","venue":null,"work_id":"f8a091e1-12df-4ff0-b55d-d74793602895","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.312803Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d0930c22f02752127cfe08b583df9c5b88ed11047b13cee3fd9c3088ad67b5a9","observation_id":"172c3994-fee2-4760-9e4e-989073a25180","resolution":{"observed_at":"2026-08-11T04:45:39.528537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.507275Z","title":"Enhanced interactive 360° viewing via automatic guidance","venue":null,"work_id":"70c64c0d-72c2-4052-a574-e409f01e5044","year":2020},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.317427Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:d0195c2393433d77249d40414275361a63737781edcc83d53b21e1307ea98e94","observation_id":"e8cd8aaf-4b3c-4a1f-952c-e4cbc88341cb","resolution":{"observed_at":"2026-08-11T04:45:39.512829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.492030Z","title":"Learn- ing sports camera selection from internet videos","venue":null,"work_id":"47331305-ef89-4674-87b5-200172e504a3","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.322157Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:6d4cc181e2c0c0af55ca383fba0062bc4703ae11c9ca007d8252106367c001af","observation_id":"e83fcaf9-c70b-40dc-b425-cf5236eabb52","resolution":{"observed_at":"2026-08-11T04:45:39.497577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.476528Z","title":"Geometry-aware recurrent neural networks for active visual recognition","venue":null,"work_id":"53b35d7e-73b5-4933-bb3c-2d58bf975084","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.327418Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:146b2a32a04148892751c526cd64e5f818bc545f3517e5cb5107870f911c63b7","observation_id":"f0755c91-8814-4c12-aad0-2113fe5e3e8c","resolution":{"observed_at":"2026-08-11T04:45:39.481439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08664","last_updated":"2017-11-23T12:06:20Z","snapshot_observed_at":"2026-08-14T20:10:45.548598Z","submitted_at":"2017-11-23T12:06:20Z","title":"Self-view Grounding Given a Narrated 360{\\deg} Video","version":1},"cited_work":{"arxiv_id":"1711.08664","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.08664","snapshot_observed_at":"2026-08-11T04:45:38.726925Z","title":"Self-view Grounding Given a Narrated 360{\\deg} Video","venue":"cs.CV","work_id":"bff20ab2-e2a7-443f-b94e-91c2dacbfbde","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.332092Z"},"links":{"cited_paper":"/paper/1711.08664","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:bdf49ac5588fbb23b4cc68915b06096783716e0b6b324444529eb1c05c1277ed","observation_id":"3d547111-4c61-4fbe-ae1d-9b1fa17a62d2","resolution":{"observed_at":"2026-08-11T04:45:38.734482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.461066Z","title":"Video co-summarization: Video summarization by visual co- occurrence","venue":null,"work_id":"7b0ab431-0ce8-437e-8c3d-c8ba983cb5e9","year":2015},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.337075Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c660483ec0575ea09782f05b05713030fb61289adfaad93debf9c9c812085a1b","observation_id":"942680e6-327f-422c-b288-2529a3bd7ca2","resolution":{"observed_at":"2026-08-11T04:45:39.465739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.446364Z","title":null,"venue":null,"work_id":"e8d37ccc-e79a-4222-8827-4da5d82a174d","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.341521Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:afb2091c1dd0ee110a75d85e4903796fd570d5c1ea6c316f07d47f42597d4724","observation_id":"8e6920c8-be44-440b-ac3f-0dc795573c71","resolution":{"observed_at":"2026-08-11T04:45:39.451035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.431668Z","title":"Multi-view active fine- grained visual recognition","venue":null,"work_id":"002207df-0443-45d9-b985-d2f65af434e8","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.346175Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:592bdf3187cc25b15bab2d9dacfbf26dc437d7476fdf183d011840c4d8f5a293","observation_id":"5409d61a-89cd-43c9-aa35-881cfa294e47","resolution":{"observed_at":"2026-08-11T04:45:39.436541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.416778Z","title":"Multi- stream dynamic video summarization","venue":null,"work_id":"5df5515b-a0c2-46bc-8f59-8ea5c715c088","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.350663Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b0f1807b83d76efc6420a06a7d72c91d6821cf83742474275090b3d9bd44a5f7","observation_id":"170e58b2-cd15-4daa-866c-653a343f2495","resolution":{"observed_at":"2026-08-11T04:45:39.421366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.401792Z","title":"Slowfast networks for video recognition","venue":null,"work_id":"4eaceaef-99eb-4d07-b30d-4188e520e6ea","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.354969Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:6d33db670cd70fa9371f45a95041fd03751070826df9961c7a91db424c3fed7f","observation_id":"bf86aa3d-3d00-4cb7-8405-9c276d472ec2","resolution":{"observed_at":"2026-08-11T04:45:39.406584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.359513Z","title":"Masked autoencoders as spatiotemporal learners","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.359513Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:9ca8eb2ff991bc514087e1a2b8106885580b99d4aab756d1d38f203d9879ad2c","observation_id":"d241242a-4f11-4770-9f15-1e5fb6b9a2a5","resolution":{"observed_at":"2026-08-11T04:45:38.359513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.377121Z","title":"Foote and D","venue":null,"work_id":"31759d34-4b59-4b5c-8a75-c78637ddd248","year":2000},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.364044Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:cbef16e1f108c0af64df6e37c0d3ec0cd93c9e5f5cbd798ea45dc41928960ee4","observation_id":"99f89d8a-7f91-44fe-be7f-77e1397e2478","resolution":{"observed_at":"2026-08-11T04:45:39.381626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.363057Z","title":"Towards virtual videog- raphy (poster session)","venue":null,"work_id":"fe702b4a-6aa0-461c-a0c3-ed9866fad8ec","year":2000},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.368480Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:812546e848095937ca789de08d7a6d6038b6fb52bcb8ef69d50f8314ee192fdf","observation_id":"bf500d37-7011-4d4d-8e29-ff073dcbea60","resolution":{"observed_at":"2026-08-11T04:45:39.367644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.345950Z","title":"Diverse sequential subset selection for supervised video sum- marization","venue":null,"work_id":"df01077a-8687-40f2-ab69-5772f9c234ad","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.372909Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:2e177a97e92bd213ef1b6e971097ff6db0fac966924f955f7c12f28425811e18","observation_id":"65d67ff1-1f17-46d0-bac8-c347134eb0c3","resolution":{"observed_at":"2026-08-11T04:45:39.352633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18259","last_updated":"2024-09-25T21:55:38Z","snapshot_observed_at":"2026-08-22T07:03:23.139842Z","submitted_at":"2023-11-30T05:21:07Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18259","snapshot_observed_at":"2026-08-11T04:45:38.377505Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.377505Z"},"links":{"cited_paper":"/paper/2311.18259","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:9904eef4f5b41b44f0f56c8b38efa332ee1fed40c62afb8e97f80369ffe95fc2","observation_id":"40e9cb03-c4a9-4446-b201-15841017118b","resolution":{"observed_at":"2026-08-11T04:45:38.377505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.331428Z","title":"Creating summaries from user videos","venue":null,"work_id":"7a7fa733-fd01-4df7-a2a2-8e2ee266cc5a","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.382729Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e45e9b34f26d2e773ccdc897a0089e2b0d05f880f559122f9953ee948f730559","observation_id":"8d00574a-2683-476e-9098-d27b27319123","resolution":{"observed_at":"2026-08-11T04:45:39.336203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.315429Z","title":"Align and attend: Multimodal summarization with dual contrastive losses","venue":null,"work_id":"b02e981a-e520-408c-9adb-f25dc0ab87fa","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.386769Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:28c18fc7a9cc1f6f354363b9bbb14430d05b9e26061a55520d95b91f8f66aab5","observation_id":"f7beef42-a4ac-416a-888c-e91cc2123812","resolution":{"observed_at":"2026-08-11T04:45:39.320195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.301228Z","title":"Virtual videography","venue":null,"work_id":"39d9ea3f-87bd-4571-b9ad-6b6cde206565","year":2006},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.390861Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:5813415f5a2854fcfe61fc7ba6a6cf9da4fd9c63b40ad01e125d71bc709ae872","observation_id":"77b75100-b675-4ed8-a9f1-afe08bc6530e","resolution":{"observed_at":"2026-08-11T04:45:39.305649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.285971Z","title":"Deep 360 pilot: Learn- ing a deep agent for piloting through 360deg sports videos","venue":null,"work_id":"84901977-e34e-4ed6-8c40-8b56cc809359","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.394904Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:845732da6adb40dc82cd313ae8060c673c42aa0a5f10a9fa6261ec98a338b1a1","observation_id":"d20baaf3-d5a4-4d1a-8246-8581798b6c0b","resolution":{"observed_at":"2026-08-11T04:45:39.290999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.271920Z","title":"End-to-end policy learning for active visual categorization","venue":null,"work_id":"7b92ee17-182f-4a56-a58d-33b828b87b93","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.399043Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:70fc857dc42946a3c53c2efc0eb0ac38fb19d87c78ff1a11de9587ee8907e896","observation_id":"0c91de0b-dd0d-41c7-baaf-f52dd0939813","resolution":{"observed_at":"2026-08-11T04:45:39.276690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.258805Z","title":"Matsushita, Xiaoou Tang, and Xue-Quan Chen","venue":null,"work_id":"b4dc2841-14a8-446d-b7d3-161e12bc4d66","year":2006},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.403340Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:83a9c456fa1564d416588c68d594258555c30bc1aab40f33792c5bfe153e8fdb","observation_id":"9d80bcb7-397f-4b3b-8285-1ad8c4f8932a","resolution":{"observed_at":"2026-08-11T04:45:39.262867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-20T22:03:51.775198Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T04:45:38.407479Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.407479Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:93d65ceb9fa7b82d3e37eb2c0986c0d3a16da7e944935fbb7460ac81aaab3d8c","observation_id":"69ac8b99-ec3e-497d-b179-95fc419abde4","resolution":{"observed_at":"2026-08-11T04:45:38.407479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.242454Z","title":"The measurement of observer agree- ment for categorical data","venue":null,"work_id":"5dcff161-0eab-43ba-849e-06c2b8166e17","year":1977},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.412080Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:f69b26f1d0509ba02668531aeb14d6c3090b5da434444409f76f0e9de1f82173","observation_id":"85a58ab5-35e5-4d02-a993-9bdbb8202843","resolution":{"observed_at":"2026-08-11T04:45:39.247034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.227741Z","title":"How local is the local diversity? reinforcing sequential deter- minantal point processes with dynamic ground sets for super- vised video summarization","venue":null,"work_id":"2d30317a-53a3-46e6-867c-48711b9a20fc","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.416463Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b481a1fbb623b65a99a0fab5cde4a1fd335143a2d1a3227749cc666343130829","observation_id":"00e36341-22ea-40d5-8bba-8e45a3007e2e","resolution":{"observed_at":"2026-08-11T04:45:39.232664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.211697Z","title":"Ego-exo: Transferring visual representations from third- person to first-person videos","venue":null,"work_id":"1473be4b-5874-4a6a-9376-902bff71eafb","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.421252Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:3f623a22fb77ef08557c70a5ed43e16a65d7d94b9288877afe85868933d15e1d","observation_id":"dc79eb1d-376d-4970-b09a-cb1c195b9fc8","resolution":{"observed_at":"2026-08-11T04:45:39.217044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.196714Z","title":"Learning to recognize procedural activities with distant supervision","venue":null,"work_id":"0af9d120-1479-4e12-8a67-ae5f27b51f7e","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.425145Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:704f3bb2e35e1087bc1f511a11eb741b46f1860eb6f9ed7f23b1e57577d574c2","observation_id":"695b4b7a-8c21-450f-89ad-84b5ac109db0","resolution":{"observed_at":"2026-08-11T04:45:39.202108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T04:45:38.429299Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.429299Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:c0e1fc61e365f6c6486f9e34c2ef1da80cda543581ceaad8651435c8c1c114cd","observation_id":"f28b5899-7d4e-469c-8aa6-c4fd557c96af","resolution":{"observed_at":"2026-08-11T04:45:38.429299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.182027Z","title":"Story-driven summarization for egocentric video","venue":null,"work_id":"182e272e-eedf-4d31-a821-006f5dd55047","year":2013},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.433533Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:610f2ca737d4983665e0834215c9e0f0705476ba70868d213e419825b383b6ba","observation_id":"891de21f-ec13-4572-95ee-43168288f3cb","resolution":{"observed_at":"2026-08-11T04:45:39.186564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.168028Z","title":"X-clip: End-to-end multi-grained con- trastive learning for video-text retrieval","venue":null,"work_id":"70a1bcca-fc65-448a-bb2f-487224bfbec0","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.437315Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:35d5bda58ea5049e0503fe8be5cfab4c059835bc4755e0ae3b7517a5f4153cc7","observation_id":"7282ff56-e643-4ea7-8463-b431c64cfc81","resolution":{"observed_at":"2026-08-11T04:45:39.172638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08753","last_updated":"2025-04-10T02:02:49Z","snapshot_observed_at":"2026-08-20T02:42:43.971083Z","submitted_at":"2024-11-13T16:31:08Z","title":"Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08753","snapshot_observed_at":"2026-08-11T04:45:38.441181Z","title":"Which viewpoint shows it best? language for weakly supervising view selection in multi- view videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.441181Z"},"links":{"cited_paper":"/paper/2411.08753","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:33cca30c139923997dd317ecdc5993389b21438b282b37cce6cafc7ee24975f5","observation_id":"6cd707ae-c6d6-4b32-b3a1-eec071956336","resolution":{"observed_at":"2026-08-11T04:45:38.441181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.152187Z","title":"Which viewpoint shows it best? language for weakly supervising view selection in multi-view videos","venue":null,"work_id":"42fe4e37-047a-45f8-8124-247663c49b7d","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.445420Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:a286aae4b363dffa22678cb284dffc14654c1615983cb6144cd1090760ae229e","observation_id":"c2bdd9ec-1cb6-468d-b573-16fa47bf731b","resolution":{"observed_at":"2026-08-11T04:45:39.157639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.137537Z","title":"Learning to ground instructional articles in videos through narrations","venue":null,"work_id":"af5aff0b-7654-4101-849c-a90abbe76296","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.449878Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e1fee05cccab229dbfdce985037018c701b156c05031cbcc01f685cdaa314ef2","observation_id":"b563e8e4-be47-43e1-a297-8a664fd6071a","resolution":{"observed_at":"2026-08-11T04:45:39.141745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.122577Z","title":"Howto100m: Learning a text-video embedding by watching hundred mil- lion narrated video clips","venue":null,"work_id":"cd62266c-97b2-4797-9f11-04c886f6b742","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.454179Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:1d2a6b4f725b28d501d0eed4f64183763693c362cecb5b465620aa62f59dc47e","observation_id":"e0045961-888f-4944-acff-dcc268355981","resolution":{"observed_at":"2026-08-11T04:45:39.127490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.107149Z","title":"Tl; dw? summarizing instructional videos with task relevance and cross-modal saliency","venue":null,"work_id":"56f726cf-8b8c-4662-81a7-913ca4da7c03","year":2022},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.458455Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:33e1cf5d32737999de773b15180939b9b3e06706d74ecaba9b1051ca46df6bbe","observation_id":"da6c7d48-ccd6-4e6c-96dd-96b4e51b6dfc","resolution":{"observed_at":"2026-08-11T04:45:39.111579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T04:45:38.462840Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.462840Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:6407f57b5f175cc280fe2a791f0ebadb11613d4a2747a9386a594875a27541c1","observation_id":"3445b630-9241-4389-946d-f9a648bccac7","resolution":{"observed_at":"2026-08-11T04:45:38.462840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.093176Z","title":"Collaborative summarization of topic-related videos","venue":null,"work_id":"6de5e2ba-8d24-4d41-ae79-47ceb34e3278","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.467272Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:71852b6c76092d9f44b959f712e3033cc10e7b0a09e4ec8772a7ae9a3faa9176","observation_id":"99e98174-1800-4762-a9f9-4fa92ab59507","resolution":{"observed_at":"2026-08-11T04:45:39.097512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.078773Z","title":"Category-specific video summarization","venue":null,"work_id":"7d03915d-ecec-49f8-bc9d-7ead1a0acfbe","year":2014},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.471747Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:947ee77b34ada2c3439024597f471b398101adcaf5c825a0fc9344d6168b1546","observation_id":"4ff8016f-68e2-4eae-8dbb-95f44c2c9b9a","resolution":{"observed_at":"2026-08-11T04:45:39.083334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.054899Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"ce6f3350-b637-4b2c-9617-d76dcc805207","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.480337Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:3c77a0b415c9f230a772c4a97e91967aa27ffca0475d88cb74a35052dfce200a","observation_id":"5fec6bd5-38f3-47d0-8dc2-82921d33016e","resolution":{"observed_at":"2026-08-11T04:45:39.059302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.040899Z","title":"Emergence of exploratory look-around behaviors through active observation completion","venue":null,"work_id":"b91c1ea9-a4c5-4158-9f9e-7f58a004bc1e","year":2019},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.484752Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:34d929f0b3b6b96567716c51f060b2535d3b22bfeeacc8b6c641caac697459f5","observation_id":"4b2171b6-6ad3-43d6-8e1d-d34f541708f8","resolution":{"observed_at":"2026-08-11T04:45:39.045848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.026028Z","title":"Video sum- marization using fully convolutional sequence networks","venue":null,"work_id":"6c7d2d3f-2cf8-402c-87c7-d5efa7927b64","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.489210Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:4e77eed2400abff87dcfc951608dd1b439ed0625bc008a0818228d237a1f042a","observation_id":"c073d3ed-268b-4a50-bd6b-d0adc4bbba6b","resolution":{"observed_at":"2026-08-11T04:45:39.031283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:39.010778Z","title":"Adaptive video highlight detection by learning from user history","venue":null,"work_id":"e1126b51-0d2e-4928-ba46-243a8310cb6d","year":2020},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.493706Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:06a4349324c1e9dfa530005599fe9d372d55c7d1dd0642bffbaa8bb18eca6410","observation_id":"893ff574-dd29-42e0-8106-f797cf532c4f","resolution":{"observed_at":"2026-08-11T04:45:39.015778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.994677Z","title":"Chowdhury","venue":null,"work_id":"53b68a7c-4fd8-4873-9dc0-188cfe84dbc4","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.498003Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:a60a15990a78265d2b1f8e1f08717ad422afd91840ffdc5a79b1016cd41bce3f","observation_id":"183401fd-1ed4-4f30-8cbd-1b59eebb45e8","resolution":{"observed_at":"2026-08-11T04:45:39.000262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.979466Z","title":"Attend and segment: Attention guided active semantic segmentation","venue":null,"work_id":"5b9e7733-b101-4c8e-9b95-03fce6f13b5f","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.502701Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:8a296f30fb6ff34d9e30bfd698a4bc6985217093d6ad34f7b471ac8b8aaaf6f3","observation_id":"6deadb2a-02ff-4c02-b7df-03a41ba09a82","resolution":{"observed_at":"2026-08-11T04:45:38.984416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.963961Z","title":"Glimpse- attend-and-explore: Self-attention for active visual explo- ration","venue":null,"work_id":"a2126054-d33b-4a25-bc24-7feeabb323ad","year":2021},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.507178Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:2efa2ba813c9e82aa143edc6738647546457e191b822385c05d21b0d6020df24","observation_id":"cd0d29b3-45a8-44ee-b574-8945f76e6e0c","resolution":{"observed_at":"2026-08-11T04:45:38.968911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.947460Z","title":"Actor and observer: Joint mod- eling of first and third-person videos","venue":null,"work_id":"de494a2b-04aa-4614-9236-9318de0add7b","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.511510Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:a0f7f06d77e950f6e26a76838260075a5576a2e1bba9165c46ed30ba7dfdffd5","observation_id":"9496558d-5977-4288-9852-97e83e3968e4","resolution":{"observed_at":"2026-08-11T04:45:38.952569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09626","last_updated":"2018-04-30T16:57:00Z","snapshot_observed_at":"2026-08-14T19:22:02.247619Z","submitted_at":"2018-04-25T15:30:27Z","title":"Charades-Ego: A Large-Scale Dataset of Paired Third and First Person Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09626","snapshot_observed_at":"2026-08-11T04:45:38.515942Z","title":"Charades-ego: A large-scale dataset of paired third and first person videos","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.515942Z"},"links":{"cited_paper":"/paper/1804.09626","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:498e074b20d62d0fe06e8b41437350b90410e6408e9a0e4ff6bb029d2855e32d","observation_id":"248d8f1a-60f0-45cc-ac4d-bba43709a442","resolution":{"observed_at":"2026-08-11T04:45:38.515942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.932512Z","title":"Video skimming for quick browsing based on audio and image characterization","venue":null,"work_id":"704a838d-fddd-4649-a922-e4e47745dd01","year":1995},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.520968Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:0c386c0b56f4b9a0fc70938e170875a5e894d8e596d10d1e401f80bdc18686db","observation_id":"e5ec38e7-a8bc-489f-99c3-67f48092fe04","resolution":{"observed_at":"2026-08-11T04:45:38.937314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.917210Z","title":"Tvsum: Summarizing web videos using titles","venue":null,"work_id":"be6814e6-2960-400c-a571-6c804bfab341","year":2015},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.525341Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:ca247cbbb89e3f5c899dc716f66c2a40a4229180a68c63eebcc61bbc0d4caa68","observation_id":"df7ec7ca-b5b9-4f6a-9954-48cd9f40242d","resolution":{"observed_at":"2026-08-11T04:45:38.922045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.902476Z","title":"Pano2vid: Automatic cinematography for watching 360 10 videos","venue":null,"work_id":"7621b0c5-9e5e-40f8-a311-c84750c273ab","year":2016},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.530022Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b606a0ca6b1ea074ee3fef9dcb9d1836d68877c8c4a12dfae871d824300cf316","observation_id":"9d7f9bc6-1371-4a73-8778-c1c4e7d0b8b4","resolution":{"observed_at":"2026-08-11T04:45:38.907197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.888432Z","title":"Foote, D","venue":null,"work_id":"7b40ae75-c87e-4ffc-865f-deb15f704404","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.534644Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:51627770a08a6c7e24facf627ce749afb8ecde8055d3134dd401d1b1bb04a189","observation_id":"30376112-72e8-4a77-b535-6f527e6ef36c","resolution":{"observed_at":"2026-08-11T04:45:38.892805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.538720Z","title":"Coin: A large-scale dataset for comprehensive instructional video analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.538720Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:0390f727abfca2fe07775b8c86157c6a7d65a8698f690a7c0fc361369cc1a7d3","observation_id":"10379f0d-71c6-4d45-b595-7bd70f676ae1","resolution":{"observed_at":"2026-08-11T04:45:38.538720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T04:45:38.542833Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.542833Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:5f59545622d2218daa2bb0c0eadc26e358b47dce899856a48017dbadc5635214","observation_id":"4bbcaa26-43c9-4c57-b38a-004442ce4163","resolution":{"observed_at":"2026-08-11T04:45:38.542833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.864250Z","title":"A closer look at spatiotemporal convolutions for action recognition","venue":null,"work_id":"9903fa31-eea1-4af9-843b-0b80dca95903","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.546893Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:464fd8411100a27ca7a5080862bfc31351e31bb0898b1ca08534d73b8c4c444c","observation_id":"2d364283-4996-4fa9-bd66-977e9d31f4dc","resolution":{"observed_at":"2026-08-11T04:45:38.868928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.849781Z","title":"Attention is all you need","venue":null,"work_id":"0d721bd2-dc63-423e-8ced-88974518c27e","year":2017},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.550868Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b15e87a8ccfc2f3741512b54ca0aaebbcede26f6eecf52063be0a3678407ac24","observation_id":"6851d7c8-228d-4771-abe5-10f23bfb59fb","resolution":{"observed_at":"2026-08-11T04:45:38.854520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.833771Z","title":"Internvideo2: Scaling foundation models for mul- timodal video understanding","venue":null,"work_id":"24327a4f-bc67-47e7-91b2-afbe3798b818","year":2024},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.555224Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b5759b8a1aac33c7be831135c5159a3fb0e1bc4f4c9361d08d291c81dadf69da","observation_id":"340d896e-2f61-49da-b820-1fa9938bf79c","resolution":{"observed_at":"2026-08-11T04:45:38.839264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.818402Z","title":"Snap angle prediction for 360° panoramas","venue":null,"work_id":"189945ee-7791-42cf-a1d0-696dac077822","year":2018},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.559414Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e0941131485dc20a9110f0369c1899486149bb87afd27d98e5a2575d06fc3709","observation_id":"6670a0f9-8674-4eb7-ba73-a9ad3d8ec245","resolution":{"observed_at":"2026-08-11T04:45:38.823638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.801991Z","title":"An au- tomated end-to-end lecture capture and broadcasting system","venue":null,"work_id":"368eba68-9b46-4ee5-a4b0-5e8256ddf829","year":2008},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.563461Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b8a0f86ce14d380f946207622c8859820b9e4e64ed41579be458d39e8ff5632b","observation_id":"daf8168b-5995-4576-b39e-633773dec8c9","resolution":{"observed_at":"2026-08-11T04:45:38.807267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.787171Z","title":"Summary transfer: Exemplar-based subset selection for video summarization","venue":null,"work_id":"d71ed157-87f9-4467-b34b-f175b70ffc7d","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.567925Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:e423b8bdfcecf2c4dfcadc1f91f9ef63a8d27496e53bd01ee1e53a99bdb2ec00","observation_id":"1954ef1f-6365-4c69-84b1-48bcdd080ec6","resolution":{"observed_at":"2026-08-11T04:45:38.791989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.773184Z","title":"Learning procedure-aware video represen- tation from instructional videos and their narrations","venue":null,"work_id":"77f1e8e0-15d4-465d-a8d2-c897ced091ec","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.572278Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:011e9ba9126e61ff61d29148f10b306f22766dc0db6e53f63b59ae5d3e9c6b5d","observation_id":"f28b4b55-d3e5-4bbe-921f-d46a8f33b90b","resolution":{"observed_at":"2026-08-11T04:45:38.777370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.758502Z","title":"Procedure-aware pretraining for instructional video understanding","venue":null,"work_id":"948c68b6-44e4-4cff-9054-310d6ad6a251","year":2023},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.576335Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:b1b467928297501f1da94238348d0a0d44216b5f735da9e665d709e03c074273","observation_id":"2f82d15f-d141-4d46-b673-269d50af8776","resolution":{"observed_at":"2026-08-11T04:45:38.762898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.744956Z","title":"closeup\" and “wide","venue":null,"work_id":"294e07e6-b774-4843-9748-88e25564f58c","year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.580328Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:cedac3f566b218d678ce10a050182414377808d979a72b446d4479acacf0677c","observation_id":"eb4d8ab4-31bd-4faa-b530-6d88cb3ebba9","resolution":{"observed_at":"2026-08-11T04:45:38.749403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:38.475995Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.475995Z"},"links":{"citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:ffe154fc49d922fa586daf558f0ed71a18fa330a384ee6ce9c3f1a4be9b3b950","observation_id":"be92e6fb-f080-42ed-ad94-28a7dd3aba51","resolution":{"observed_at":"2026-08-11T04:45:38.475995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T18:46:03.314468Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":54},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 2 inbound Pith citation observations for arXiv:2412.18386."}