{"as_of":"2026-08-09T19:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:435edabd42db8cddd99acbfe35911dbffd4d2c24bd1aac469e9c86e6a3b1f304","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:23:43.243274Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.21785/citation-record","integrity":"/paper/2506.21785/integrity","json":"/paper/2506.21785/citation-record.json","paper":"/paper/2506.21785"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.16715","last_updated":"2023-08-18T07:56:32Z","snapshot_observed_at":"2026-08-09T14:05:19.967194Z","submitted_at":"2023-07-31T14:34:49Z","title":"UniVTG: Towards Unified Video-Language Temporal Grounding","version":2},"cited_work":{"arxiv_id":"2307.16715","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16715","snapshot_observed_at":"2026-08-06T22:23:44.255560Z","title":"UniVTG: Towards Unified Video-Language Temporal Grounding","venue":"cs.CV","work_id":"19098a11-cec9-4ba7-8075-c085bd912d3f","year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.171290Z"},"links":{"cited_paper":"/paper/2307.16715","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:e9f405b34a3b67e60fde30016bdaca26958daad4bef7b1a42ce151d0a0f42df0","observation_id":"9c8b10c0-3408-4d37-b3b5-e2fca4dcb349","resolution":{"observed_at":"2026-08-06T22:23:44.366891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11816","last_updated":"2024-06-17T17:55:32Z","snapshot_observed_at":"2026-08-02T08:01:10.902033Z","submitted_at":"2024-06-17T17:55:32Z","title":"VideoLLM-online: Online Video Large Language Model for Streaming Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11816","snapshot_observed_at":"2026-08-06T22:23:41.274752Z","title":"VideoLLM-online: Online Video Large Language Model for Streaming Video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.274752Z"},"links":{"cited_paper":"/paper/2406.11816","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:542fe8f62ae284e82369c6967463fc985e47e97d96b1ce55494d8fc31b8b53a3","observation_id":"90c0f3b1-5916-4edf-8bfe-b087c15b290a","resolution":{"observed_at":"2026-08-06T22:23:41.274752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-09T16:15:46.707979Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T22:23:41.396361Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.396361Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:b551ca39c8fd443801788212488fe1b2f207b50a3e9d94b633073733830a8bd0","observation_id":"60fd24f9-7f8e-4d8d-bade-a4d8a55cc9a8","resolution":{"observed_at":"2026-08-06T22:23:41.396361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T22:23:41.495758Z","title":"Mamba: Linear-time Sequence Modeling with Selective State Spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.495758Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:eec757aab0ec6f4e6396518fb8638694063f6abedbe7c3610777119e147c4a47","observation_id":"bdf647d9-3f6f-4ac8-bb9d-c1c7908b92a9","resolution":{"observed_at":"2026-08-06T22:23:41.495758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-08-08T08:05:04.282318Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-06T22:23:41.597659Z","title":"Is Space-Time Attention All You Need for Video Understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.597659Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:60bcffe1e24e07aa005522609b9fa93d8958b3a753dd40e2f2eaafb00873e2d4","observation_id":"bd7e80c6-f1a6-4542-be12-6e0b683c42a7","resolution":{"observed_at":"2026-08-06T22:23:41.597659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18259","last_updated":"2024-09-25T21:55:38Z","snapshot_observed_at":"2026-08-08T17:40:49.067743Z","submitted_at":"2023-11-30T05:21:07Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18259","snapshot_observed_at":"2026-08-06T22:23:41.740633Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.740633Z"},"links":{"cited_paper":"/paper/2311.18259","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:eb5b239e78bf4a6b80e9cdb19cd9fb2a828f26b4ce461b0d0970965520943b81","observation_id":"3ae6917d-ea86-4819-bad3-0222acd15ed4","resolution":{"observed_at":"2026-08-06T22:23:41.740633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20648","last_updated":"2024-10-21T08:52:10Z","snapshot_observed_at":"2026-08-09T12:28:47.055813Z","submitted_at":"2024-05-31T07:30:24Z","title":"Shotluck Holmes: A Family of Efficient Small-Scale Large Language Vision Models For Video Captioning and Summarization","version":2},"cited_work":{"arxiv_id":"2405.20648","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.20648","snapshot_observed_at":"2026-08-06T22:23:43.978120Z","title":"Shotluck Holmes: A Family of Efficient Small-Scale Large Language Vision Models For Video Captioning and Summarization","venue":"cs.CV","work_id":"578d0d33-a8a3-4465-9752-a96bc066a8ad","year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.864051Z"},"links":{"cited_paper":"/paper/2405.20648","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:634415c0379b2cb2b1ea9503710862b0807170e69bc55024a5b770778d7ba2bb","observation_id":"248d10b3-b2d1-4c0d-b58e-6c6220c682b4","resolution":{"observed_at":"2026-08-06T22:23:44.044371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10300","last_updated":"2025-02-05T09:57:59Z","snapshot_observed_at":"2026-07-06T17:03:56.263404Z","submitted_at":"2023-12-16T03:17:30Z","title":"Shot2Story: A New Benchmark for Comprehensive Understanding of Multi-shot Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10300","snapshot_observed_at":"2026-08-06T22:23:41.969901Z","title":"Shot2Story20K: A New Benchmark for Comprehensive Understanding of Multi-shot Videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.969901Z"},"links":{"cited_paper":"/paper/2312.10300","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:8418cc8e239152ddd333ff8409d35d0c11d4b875fcf37f2cd016b6706ef11f84","observation_id":"e5aed2b2-69a5-42fe-87bd-b4dce7efe8ad","resolution":{"observed_at":"2026-08-06T22:23:41.969901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10337","last_updated":"2022-07-08T08:46:43Z","snapshot_observed_at":"2026-07-06T12:10:16.997623Z","submitted_at":"2021-11-19T17:36:01Z","title":"Advancing High-Resolution Video-Language Representation with Large-Scale Video Transcriptions","version":2},"cited_work":{"arxiv_id":"2111.10337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.10337","snapshot_observed_at":"2026-08-06T22:23:43.796125Z","title":"Advancing High-Resolution Video-Language Representation with Large-Scale Video Transcriptions","venue":"cs.CV","work_id":"b4214fa2-b6f1-40ec-95b1-450b50854a3f","year":2021},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.126947Z"},"links":{"cited_paper":"/paper/2111.10337","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:c0e16f5528b768618a881e2cfe8d768b836c15d0c87e87856204acbd66db338c","observation_id":"5e87f939-0cdb-4a1c-bef7-4e88cf736c47","resolution":{"observed_at":"2026-08-06T22:23:43.860557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.04838","last_updated":"2020-08-11T16:37:59Z","snapshot_observed_at":"2026-08-07T21:35:40.193492Z","submitted_at":"2020-08-11T16:37:59Z","title":"TransNet V2: An effective deep network architecture for fast shot transition detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.04838","snapshot_observed_at":"2026-08-06T22:23:42.246470Z","title":"Transnet v2: An effective deep network architecture for fast shot transition detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.246470Z"},"links":{"cited_paper":"/paper/2008.04838","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:175154e46970dfd0aecaaf44ecd0c011e4c7c38e479b1a7ff5cac001526a7865","observation_id":"504e0a5d-bbdc-46a6-9602-16acb08fd1e5","resolution":{"observed_at":"2026-08-06T22:23:42.246470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07058","last_updated":"2022-03-11T19:40:26Z","snapshot_observed_at":"2026-07-06T11:57:42.646453Z","submitted_at":"2021-10-13T22:19:32Z","title":"Ego4D: Around the World in 3,000 Hours of Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07058","snapshot_observed_at":"2026-08-06T22:23:42.360607Z","title":"Ego4D: Around the World in 3,000 Hours of Egocentric Video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.360607Z"},"links":{"cited_paper":"/paper/2110.07058","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:d9853fd5ad28e38046ba281b70c95c449edbd8b3db764277d558a6e435d6e38b","observation_id":"0335ffe1-ba69-4b56-90af-e15f5577fc2e","resolution":{"observed_at":"2026-08-06T22:23:42.360607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04269","last_updated":"2023-09-08T11:31:08Z","snapshot_observed_at":"2026-07-06T16:16:07.182657Z","submitted_at":"2023-09-08T11:31:08Z","title":"From Sparse to Dense: GPT-4 Summarization with Chain of Density Prompting","version":1},"cited_work":{"arxiv_id":"2309.04269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.04269","snapshot_observed_at":"2026-08-06T22:23:43.578087Z","title":"From Sparse to Dense: GPT-4 Summarization with Chain of Density Prompting","venue":"cs.CL","work_id":"5082c16e-427a-4757-94dd-24249e6e66ca","year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.496883Z"},"links":{"cited_paper":"/paper/2309.04269","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:0115f55da7d5239d778640c75c2e737e2bf0142a5ea4efe12f466f10deeb3bce","observation_id":"2f91c3c5-a537-41c3-a653-86e22eebc81f","resolution":{"observed_at":"2026-08-06T22:23:43.644497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T22:23:42.657182Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.657182Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:cf4d281af3308a01a697db8390f14f174970cc94c34a616265a70f736b7f84d1","observation_id":"ece7af2f-5675-4b0a-8fb9-4d57d673dfd8","resolution":{"observed_at":"2026-08-06T22:23:42.657182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04511","last_updated":"2024-04-06T05:55:14Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T05:55:14Z","title":"Cluster-based Video Summarization with Temporal Context Awareness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04511","snapshot_observed_at":"2026-08-06T22:23:42.816049Z","title":"Cluster-based Video Summarization with Temporal Context Awareness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.816049Z"},"links":{"cited_paper":"/paper/2404.04511","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:2196d928ea9561a70ae80ddfff906bac2804084c33644bf4c6c66bfbc8e9d03f","observation_id":"998b9a53-fd36-4a54-a714-cae86b08c33a","resolution":{"observed_at":"2026-08-06T22:23:42.816049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:42.917546Z","title":"Creating Summaries from User Videos","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.917546Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:c7b857ceb3b751d9b6f4014096d87da9dce785a2a341ede6621be6efa4803969","observation_id":"a2d84fed-fae2-4413-bc87-bb203fad4ccf","resolution":{"observed_at":"2026-08-06T22:23:42.917546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-06T22:23:42.985153Z","title":"Sigmoid Loss for Language Image Pre-Training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.985153Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:b4023421323d3e68d8adcea95159618f6a09320344c4826b341acf1705d09ed3","observation_id":"9d10f3e3-ba32-4d81-88d6-3cf103de00d9","resolution":{"observed_at":"2026-08-06T22:23:42.985153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:43.101087Z","title":"BIRCH: An Efficient Data Clustering Method for Very Large Databases","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.101087Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:ea4128e286d2493144a705a4012c91134ae2c1b47b6b01cdcb04a073e28714f6","observation_id":"e64a774c-1eea-46ea-987e-18ebdce0fd69","resolution":{"observed_at":"2026-08-06T22:23:43.101087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T22:23:43.159750Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.159750Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:cedbb5e4a27deb2518ae97365a1dcff67497914b5f83702fa1d1d27bb30c89e7","observation_id":"46b74914-c675-4384-9cba-1e2f60511c7d","resolution":{"observed_at":"2026-08-06T22:23:43.159750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:44.509718Z","title":"Nov 4, 2024, https://build.nvidia.com/nvidia/video-search-and-summarization 13","venue":null,"work_id":"29b0086d-daec-4164-bb49-90668291acde","year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.243274Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:1e4363476d0034b17bd3b44809da87227bfd6c7f2d8d85b69e04f58b75c3528d","observation_id":"6b7f6f11-5185-4657-9eca-d3c950b1ec78","resolution":{"observed_at":"2026-08-06T22:23:44.649217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:05:02.791667Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.21785."}