{"as_of":"2026-08-10T07:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:09165d22a6892a5afa23d53b03c3234703b3c111cc96c771d0456129bb621263","coverage":[{"denominator":120,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:41:54.365165Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T14:53:56.693464Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23952","snapshot_observed_at":"2026-07-14T14:53:56.693464Z","title":"arXiv preprint arXiv:2505.23952 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09876","last_updated":"2026-07-10T18:09:41Z","snapshot_observed_at":"2026-08-08T22:35:43.209590Z","submitted_at":"2026-07-10T18:09:41Z","title":"Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T14:53:56.693464Z"},"links":{"cited_paper":"/paper/2505.23952","citing_paper":"/paper/2607.09876"},"observation_digest":"sha256:ca6e5520844fc54687f6d3d6a6ea81fa7695b0bcda937dc9b2fb1229a708e471","observation_id":"1b832b2c-9da7-4d57-867e-52ebe882d8a1","resolution":{"observed_at":"2026-07-14T14:53:56.693464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23952/citation-record","integrity":"/paper/2505.23952/integrity","json":"/paper/2505.23952/citation-record.json","paper":"/paper/2505.23952"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.193547Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.193547Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:52b34feccc78b8935f76ed529f984eac347d348b8369033f6a722714a6d31936","observation_id":"647bca41-7507-488d-bd97-a9d64607efe3","resolution":{"observed_at":"2026-08-07T12:41:45.193547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.290627Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.290627Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:0e8b534797d468577bc48e4d568ef50f5760e86e1bf08f1d606c68f3c505af7a","observation_id":"f25eb248-ee5b-44d7-8a27-87e1e8c888bb","resolution":{"observed_at":"2026-08-07T12:41:45.290627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.427908Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.427908Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:d1d919abe4aa4b361c202b4a05788e1313ba20a07ff45500aff6910e6d6eed40","observation_id":"05b57cf4-128c-4331-a92c-89b07a2d30db","resolution":{"observed_at":"2026-08-07T12:41:45.427908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.557964Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.557964Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:00acbcfccac2039eb5ece095bcea958085466fe81e2c872b001e010630f4dfe3","observation_id":"91fbae2c-91b7-4de6-a332-5a86b7ef6d0a","resolution":{"observed_at":"2026-08-07T12:41:45.557964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.693708Z","title":"Boggust, Rameswar Panda, Brian Kingsbury, Rogério Feris, David Harwath, James R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.693708Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:bfa5cb80c6d77c1fd33b95348ac0584c9fef54925b5eb987ec34d94bd3de66eb","observation_id":"edadf0e5-b1fa-4d1f-9e07-9da1542fb1db","resolution":{"observed_at":"2026-08-07T12:41:45.693708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.825407Z","title":"Chen and William B","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.825407Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:f7eb37493c3603e60c972b0c8b340af7aae2003b8d571a2d1d58227fac6799ee","observation_id":"f5ae175a-fda1-434d-82a6-1dd4f334974c","resolution":{"observed_at":"2026-08-07T12:41:45.825407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:45.948156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:45.948156Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:f1a6f7092e07c5a719ca22d1a7c6f6c8255ba8af8ba0352b55bb1ccf067c12d8","observation_id":"76b1303b-de62-4330-8d18-1623b2c7bc84","resolution":{"observed_at":"2026-08-07T12:41:45.948156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.060066Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.060066Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:92f757c1d29cb0512f763d8090892c6bf90c0cabd960a013c0a8a3a58b8ea494","observation_id":"628013fc-12dc-453f-9d5a-b092e5808e97","resolution":{"observed_at":"2026-08-07T12:41:46.060066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.145623Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.145623Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:27fe4f6fb7eb8a77ce8f02983e545c80bdab220796896ea1722e2e1131a4ce58","observation_id":"13af7ff9-873d-4612-8729-2ab66577cff6","resolution":{"observed_at":"2026-08-07T12:41:46.145623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.335458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.335458Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:ed25808dfd9cceb915e1cf569be6589d7b97e4d70c1e248d8d03b99d1c512047","observation_id":"6f74c9eb-33be-414f-b940-511cec95ab02","resolution":{"observed_at":"2026-08-07T12:41:46.335458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04290","last_updated":"2021-11-22T09:35:30Z","snapshot_observed_at":"2026-08-09T21:40:39.573851Z","submitted_at":"2021-09-09T14:10:43Z","title":"Improving Video-Text Retrieval by Multi-Stream Corpus Alignment and Dual Softmax Loss","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.04290","snapshot_observed_at":"2026-08-07T12:41:46.455487Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.455487Z"},"links":{"cited_paper":"/paper/2109.04290","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:707d3bfbc352d7bcef70fc5920516e4af73cb406e2577699619eebce489ad398","observation_id":"87e83368-c242-4fc3-bae2-17c0f6ba70ab","resolution":{"observed_at":"2026-08-07T12:41:46.455487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-07T12:41:46.640284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.640284Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:b932e56021570acd8f003e0459870e58e4e3c581f97a1e66479ed862769a7ef3","observation_id":"5da62733-e518-4ebd-9472-702e7b0b9de9","resolution":{"observed_at":"2026-08-07T12:41:46.640284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.783422Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.783422Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:eeef5d68ce9fd9e416048099fa36c66ddaa4542d488005259ae0f1e3daf6c4d1","observation_id":"5cf0c650-963b-4684-9334-f74cbfb46f1a","resolution":{"observed_at":"2026-08-07T12:41:46.783422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.889686Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.889686Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5aaec4effd38f7e7ba6a5b5a773f0364bdfa8f8a857185ed8963995d3030d54d","observation_id":"d029fa5a-093c-4da2-9e91-15b24bf69598","resolution":{"observed_at":"2026-08-07T12:41:46.889686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:46.951281Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:46.951281Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:72be206a0ca813706d7bbb70c51944e0eee46a2770f16e1a15354f8305230ae2","observation_id":"4259a725-ca1d-44aa-b4f7-058813721cc9","resolution":{"observed_at":"2026-08-07T12:41:46.951281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.130203Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.130203Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:1e76ff96ca4526d871f74aa61454f121eeb227bf464d934433026b07af372e5c","observation_id":"b02dbbea-848e-4970-829b-68a0ff1464e2","resolution":{"observed_at":"2026-08-07T12:41:47.130203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.244065Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.244065Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a2c40f2e270fb6b1ecc8130d8d091cc848e2e12ca12c201ab8d805a2378deb7a","observation_id":"832121c0-60e2-4b6d-b140-2ea890130984","resolution":{"observed_at":"2026-08-07T12:41:47.244065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.310244Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.310244Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:6c2bda72fd94e21c7faff3b29460840b57e3c5407b967f5a37cea2c932ccf7d3","observation_id":"0d693613-8dfd-4902-8f7c-c2fd1ba8ede2","resolution":{"observed_at":"2026-08-07T12:41:47.310244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.427808Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.427808Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:193e9894a82bb726e2b77983ccf7dce2580319197d371f6fd323849410a6eaa9","observation_id":"d7eaf395-0e4f-4682-8a57-8f1656aefa45","resolution":{"observed_at":"2026-08-07T12:41:47.427808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:41:47.490952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.490952Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:62772e7f63a0b811dffd99fafa3f7f2b0561673a1564713ea3249f393223aa47","observation_id":"7d4c2338-c027-4825-863d-e6010c3e4365","resolution":{"observed_at":"2026-08-07T12:41:47.490952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.607220Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.607220Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:c2b8b05cb044b7fbacb331c609a809d2f84beb753b9a3a3bed4f3c1db5827cbf","observation_id":"2b02404e-6786-4977-95cc-b26d674c48f1","resolution":{"observed_at":"2026-08-07T12:41:47.607220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.670847Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.670847Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:9332d3a1f5d35ec137005b7c97074aa7c7ea43a5bc67c4f79f6808d81b2da8d2","observation_id":"52516978-675a-4b94-8f2c-cd84e4688d27","resolution":{"observed_at":"2026-08-07T12:41:47.670847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.787552Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.787552Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5cc8f5ac9c21b6e981a4307f88025f60f0201cb45ad46c8270b86dfa8656cfb6","observation_id":"aeb1fc10-69f7-49ee-b599-635cb7eea57b","resolution":{"observed_at":"2026-08-07T12:41:47.787552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:47.902107Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:47.902107Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:1cac785ed0e8c5e850d34cc9b7208d0afddce5073655706721c8d9f18b59265e","observation_id":"76fabe2d-361a-40b5-9b42-2bcf3dcdd200","resolution":{"observed_at":"2026-08-07T12:41:47.902107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.026282Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.026282Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:430db2cbe70f3b96f10edfda7e4e5585a096296d211e98ed8d9eb5b6dee2c1c9","observation_id":"b19ee67b-5cd3-4c29-b58b-e2240d0778e7","resolution":{"observed_at":"2026-08-07T12:41:48.026282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.103434Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.103434Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:0005ab99519810fb2645ce2661f879fd956cf015453508a5473696f8ee950dce","observation_id":"653010e4-1c70-40b1-beab-fc9e451b19a4","resolution":{"observed_at":"2026-08-07T12:41:48.103434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.195200Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.195200Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:0d06a283b66f54ca175f3ee5085d658de411bf6f029fd7cdf1a022de36e5536d","observation_id":"6225f1d4-8378-429e-b29d-1e27d983b3d3","resolution":{"observed_at":"2026-08-07T12:41:48.195200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.290899Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.290899Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:cb41ca3a8b5a2e1c5ee499a12a694286105fb543e121c3efdfddde3fd9f4ebe3","observation_id":"0899c91f-82d7-42de-b29f-407b555e4893","resolution":{"observed_at":"2026-08-07T12:41:48.290899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.332385Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.332385Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:3b6153e04752d00244021703d1b9b282948ec2d59d80042f448d66e3e7ea2be8","observation_id":"bf99fe39-2dba-46cf-8ca1-b2c102c58129","resolution":{"observed_at":"2026-08-07T12:41:48.332385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.420142Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.420142Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a4b70be234b5f0f92df7191b3e395b01f9cde8b07d8c01d546fca321e3d05ad8","observation_id":"92ff11b0-7c17-4534-b0fa-cc2107f80784","resolution":{"observed_at":"2026-08-07T12:41:48.420142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.492459Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.492459Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:ec3080b79cb2877ff3c77c0d9de5c7f99962a258e34c438ea4ac927ecc8a102a","observation_id":"7960144c-0da5-4439-9b8c-1a0411e877b2","resolution":{"observed_at":"2026-08-07T12:41:48.492459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.599026Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.599026Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:6c9ed03039a7f44e6f0dccc94883bd5b371bef4a7fa1922c89e03e8ad0f6c36f","observation_id":"9aac3de4-7c6d-4235-96c9-639b6708ad33","resolution":{"observed_at":"2026-08-07T12:41:48.599026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.674798Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.674798Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:e417c76332150f0dd7c3e9cd9a5cca13d23dd772554ddedf718a2cae505b6162","observation_id":"81cb1cc7-96d9-4746-852b-d17039803f44","resolution":{"observed_at":"2026-08-07T12:41:48.674798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.784645Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.784645Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:ce3cc96434155264ecb0be41ab25adfc2ec1705ec9ae97d02a696ec248ddb15c","observation_id":"e56a8c10-fe41-415f-8683-14ea48de401e","resolution":{"observed_at":"2026-08-07T12:41:48.784645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.887535Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.887535Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:dea5de7006053aae7a13c56b11f08abfd3483080a6598b00d2feca7abe00d891","observation_id":"b04144b9-dc53-4e8b-a39b-9f5da3eef926","resolution":{"observed_at":"2026-08-07T12:41:48.887535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:48.997129Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:48.997129Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:d7d35eb47dfe3c43d8b505b94b136bdd4fa867b8818b180dab26f6fc5d427fe5","observation_id":"f24d3181-4c54-4f1b-8c08-48d2f9c99806","resolution":{"observed_at":"2026-08-07T12:41:48.997129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.087233Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.087233Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:ae89ac81bec54ae77073e0db447d83a231d7ea77b35c8214cf5f86650ca38aa6","observation_id":"a94605bf-60b9-40c0-a004-c931f212a1cf","resolution":{"observed_at":"2026-08-07T12:41:49.087233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.176923Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.176923Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:9cb80359088b42e02ac54ee85a194e345486b2cdc33baf6b3391ed8206ff4f59","observation_id":"afb696c7-2e72-476d-8a7b-e4f50f0db53f","resolution":{"observed_at":"2026-08-07T12:41:49.176923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.257649Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.257649Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:55ceee9ebda39a506efcac6249ac00e5befb4012f83a7dc387a95258400ce9cd","observation_id":"a0e5507d-2781-454b-b8ef-c19ffd0cfd1b","resolution":{"observed_at":"2026-08-07T12:41:49.257649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11341","last_updated":"2025-07-12T04:28:35Z","snapshot_observed_at":"2026-07-06T15:44:27.766505Z","submitted_at":"2023-06-20T07:19:36Z","title":"MSVD-Indonesian: A Benchmark for Multimodal Video-Text Tasks in Indonesian","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11341","snapshot_observed_at":"2026-08-07T12:41:49.352478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.352478Z"},"links":{"cited_paper":"/paper/2306.11341","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:fcf867daa12878daf68b95c31c129f67cad4f462e14d71362d0e15c1b012eaef","observation_id":"d2299c99-9c83-4ecd-b3cb-1826c5522eeb","resolution":{"observed_at":"2026-08-07T12:41:49.352478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.432371Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.432371Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:2e1f6f77e83e8e34347422993ac6fb1e9ce6bd016a7a19ffe4205aa6bf3428a9","observation_id":"8e3a488c-a832-41bf-a81c-4947885e35ab","resolution":{"observed_at":"2026-08-07T12:41:49.432371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.506630Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.506630Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:971c3756a13e7934d16e55f5e997c9f0185ff301a677433e44451110d4c76e27","observation_id":"8667c9c7-983d-435b-ad68-f8b7e65f4e80","resolution":{"observed_at":"2026-08-07T12:41:49.506630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:49.600016Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.600016Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:023a23ae83d523d5ceb5cc0d0e1f3a9861efca8314da45a785a2745e5977c5e9","observation_id":"5dab85d1-ee54-4a85-82ad-7ecbd6fe6296","resolution":{"observed_at":"2026-08-07T12:41:49.600016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:06.498165Z","title":null,"venue":null,"work_id":"c0704c1e-15ab-4d60-80f5-42876f1c9bde","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.699576Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:41ba273f5537bb1febae34689d3c777ef0310faf13c34d8b1a382207452fe96b","observation_id":"4fdd44c3-3da7-47e3-b6d1-2c3100bfe35e","resolution":{"observed_at":"2026-08-07T12:42:06.566677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:06.335622Z","title":null,"venue":null,"work_id":"884648d3-10cd-4885-8032-c1e3722f4ca1","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.787208Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4ea775c06ec3551a3235a9f61a9546ecb6ea7a62d8de7afb691cf8424bbea3ac","observation_id":"42d96e72-755a-4142-94be-4411e0afd2dc","resolution":{"observed_at":"2026-08-07T12:42:06.421645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:06.166172Z","title":null,"venue":null,"work_id":"7b35b7ad-bf67-44e5-b131-7042e5d22f4d","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.836792Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:3eed1eea675ff415c93696127d304481453c01a471f8455e51b08eadc952610b","observation_id":"7cfb3b8a-89f5-4ac5-a727-87bae72702e2","resolution":{"observed_at":"2026-08-07T12:42:06.257724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:06.060104Z","title":null,"venue":null,"work_id":"84928996-c6f5-4a65-9b64-641184870281","year":2017},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:49.940056Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:616a2583162049840917c305176e8079ef8289d2e6f89811cfe065369662e825","observation_id":"3a4df54a-efb7-420b-88c9-85cbcc5a4866","resolution":{"observed_at":"2026-08-07T12:42:06.126297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07086","last_updated":"2022-03-14T13:15:09Z","snapshot_observed_at":"2026-08-04T22:29:26.674330Z","submitted_at":"2022-03-14T13:15:09Z","title":"MDMMT-2: Multidomain Multimodal Transformer for Video Retrieval, One More Step Towards Generalization","version":1},"cited_work":{"arxiv_id":"2203.07086","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.07086","snapshot_observed_at":"2026-08-07T12:41:56.380246Z","title":"MDMMT-2: Multidomain Multimodal Transformer for Video Retrieval, One More Step Towards Generalization","venue":"cs.CV","work_id":"1785a236-8847-4ca6-8c19-fb3207e71e92","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.075596Z"},"links":{"cited_paper":"/paper/2203.07086","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5151bb4088cf4df9450783b387b9afb371c5fdd467278d17982b1362f5342f6c","observation_id":"fb00e998-237f-4ab0-ac03-62ed122d3378","resolution":{"observed_at":"2026-08-07T12:41:56.464976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.873718Z","title":null,"venue":null,"work_id":"7515ae2a-637b-4a7f-a6d4-ba01b8942d3f","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.152770Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:902bb66e2b1bb850b26d01c4f4c93c6dd6e75552a72a4b55af86c5aca69f9049","observation_id":"80e7fe5f-03ed-49c4-b134-4c585feb3815","resolution":{"observed_at":"2026-08-07T12:42:05.961327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.791562Z","title":null,"venue":null,"work_id":"529efe59-cd04-47a3-9b67-bb8ebec47d18","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.252285Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:87d2454c1035c8fcab8e1f991755905d179c913c2bb5a2e9178702f0e6b82f6b","observation_id":"76f8d7fb-4a78-4437-9d53-20613a1ed632","resolution":{"observed_at":"2026-08-07T12:42:05.822419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:50.320829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.320829Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4f6cafa9cbd47d6b5331e809ad94795546ec72760331bc1474cdaeb4a1bc570f","observation_id":"83685582-ed1f-4b5b-b9aa-ec1a38158fb4","resolution":{"observed_at":"2026-08-07T12:41:50.320829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.588614Z","title":null,"venue":null,"work_id":"400db7cd-840e-4850-b397-33729ad0814e","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.404361Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a58d6a9b33f108070397995fbbee70674e8ba5325a257b7e601084e05fbef498","observation_id":"7b389ce3-6e70-4e4b-9ecb-4d5558f08db8","resolution":{"observed_at":"2026-08-07T12:42:05.679229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.457666Z","title":null,"venue":null,"work_id":"f10f12c0-d315-4c97-8691-491cfdf86489","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.513928Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:1045cb2bc85822274b7c1991d7327b3bc5c17d2bde7ee5c0f262ec41468b8465","observation_id":"62b92087-f90d-42c1-a568-bc845c12c3fe","resolution":{"observed_at":"2026-08-07T12:42:05.500886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.440577Z","title":null,"venue":null,"work_id":"ea668857-5649-4bf4-9bb5-4963c4ec8e57","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.619026Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a6f1e37b8a37ca980d8e3204e08f6f656eee090705b920f1ff45887ca20b3f8b","observation_id":"82f5ccc0-4c2e-4eb0-a4ee-5a90be4e26b3","resolution":{"observed_at":"2026-08-07T12:42:05.449585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.283935Z","title":null,"venue":null,"work_id":"42e990aa-8357-4fff-a0ba-517455fb2ef8","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.693028Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a3b7c25b6eca6f05693201454d8285a9ad7dad039207ef4b03053109223878fc","observation_id":"bc582805-94f8-4e8d-8f4f-6a81be8551e9","resolution":{"observed_at":"2026-08-07T12:42:05.357095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.149929Z","title":null,"venue":null,"work_id":"6c3bd387-c81b-4e01-a74c-e7d74bc89db6","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.802963Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:632d1f44519739e52d2ccc487f269431c622895634d5c4db14545feb0046b950","observation_id":"8b440732-f269-4f7f-9d10-4776237ce08a","resolution":{"observed_at":"2026-08-07T12:42:05.219203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:05.054380Z","title":null,"venue":null,"work_id":"9f6cd2fc-99d7-4815-9cac-05dd256047c0","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:50.908551Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:c894b42e1c9594f93ea7b964f0de288334275e2e1b9adef2b9c19e5a40dc2538","observation_id":"34922b72-2ebc-4394-a2c7-02cc617dd02a","resolution":{"observed_at":"2026-08-07T12:42:05.118291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.837077Z","title":null,"venue":null,"work_id":"f37164df-d18f-473e-9988-b1d5d6d326c6","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.003812Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:c9785214cb3b77f347ee5ffd16d60e97c1a3b94a221460ba47b9313f60d4b909","observation_id":"09f14aa1-42f2-4905-937d-0a5c228528f8","resolution":{"observed_at":"2026-08-07T12:42:04.939232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.695768Z","title":null,"venue":null,"work_id":"602862b7-9f60-4574-adde-450d9a94b9a7","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.079925Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:27372b3bd5a47502cc145a027fc73e7f735a26db4ca8013b22384982e3fddd0b","observation_id":"6f5d6e19-1328-4f22-8cd4-5cdb556d5e40","resolution":{"observed_at":"2026-08-07T12:42:04.762540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.562031Z","title":null,"venue":null,"work_id":"775b2915-f2be-4083-b074-5c44d4384767","year":2019},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.121159Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:bcf3638ebe810dfb9e02737730ae7404b8c0cbb16ae32869eadb7c20b9c16218","observation_id":"7f1ea6f5-8ada-48aa-a624-0cae5469d5d1","resolution":{"observed_at":"2026-08-07T12:42:04.617528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.449097Z","title":null,"venue":null,"work_id":"bde57ccb-8234-4823-8e73-8ea6e5dabd66","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.214155Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:8e36d0d4e9cc2cc3b2aa2407a962f0e827e613a540b023a9f5721fb6602e9326","observation_id":"4c571f9d-8839-47c0-b3c9-9fe9d3f3bdb2","resolution":{"observed_at":"2026-08-07T12:42:04.500883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03770","last_updated":"2024-05-06T18:09:48Z","snapshot_observed_at":"2026-08-08T03:33:14.622766Z","submitted_at":"2024-05-06T18:09:48Z","title":"Foundation Models for Video Understanding: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03770","snapshot_observed_at":"2026-08-07T12:41:51.313475Z","title":"Rawat, and Thomas B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.313475Z"},"links":{"cited_paper":"/paper/2405.03770","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:6e4f6d2f847d53e50131338d6c8a05911101a54fe8933f2c3eb21fd552a51824","observation_id":"a0f8d93c-3dd1-4fe1-99ee-bb4195847a37","resolution":{"observed_at":"2026-08-07T12:41:51.313475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.337840Z","title":null,"venue":null,"work_id":"ceabde1b-2b2a-4f56-a052-123103aea320","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.401275Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:e53b8c77f4f72a615c46d43cf767bba990c1101008e06b032fc08c20c63d329f","observation_id":"79a3b5c8-5025-4564-9ffc-9af6104967cd","resolution":{"observed_at":"2026-08-07T12:42:04.389385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.221684Z","title":null,"venue":null,"work_id":"6a2c2d3e-0bdf-4337-bb07-23eba321a890","year":2020},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.492270Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:b77fd46ec20d266cf094cdbe2fb6b668ba675632c6a7aa8e083bf4d5bcbe8ec6","observation_id":"b7de8bff-9567-425c-8fa5-3463e9fd1018","resolution":{"observed_at":"2026-08-07T12:42:04.281493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02516","last_updated":"2020-01-16T13:18:58Z","snapshot_observed_at":"2026-08-09T15:40:37.180579Z","submitted_at":"2018-04-07T06:59:45Z","title":"Learning a Text-Video Embedding from Incomplete and Heterogeneous Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02516","snapshot_observed_at":"2026-08-07T12:41:51.586700Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.586700Z"},"links":{"cited_paper":"/paper/1804.02516","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:301af54fed9f682cc9717efe7c923457c486c8c6cf6d73ff9ef01ae003721f7f","observation_id":"2b6eac4a-d29e-4b4d-85cc-ea42bfca7299","resolution":{"observed_at":"2026-08-07T12:41:51.586700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.125347Z","title":null,"venue":null,"work_id":"6a2ded3e-b4e3-44e0-a027-428489e0cdc1","year":2019},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.663344Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:3d60bcb1cd23cc4cec5c4eea563c975b1233abccf39fea5ddfc5722658253cfe","observation_id":"b0664405-c582-4bc6-9a40-740a3617c5d5","resolution":{"observed_at":"2026-08-07T12:42:04.166133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:04.016913Z","title":null,"venue":null,"work_id":"ac4e5dca-425f-497e-86a4-efeeb21507ce","year":null},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.749222Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4f94d5a5ab06aaa4d6a5bb4f3b26622450e8ae7d6ce7c9b164127fedf8fc3f84","observation_id":"070c8c3e-f004-44cf-9ee4-87cc0592f941","resolution":{"observed_at":"2026-08-07T12:42:04.065350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.793450Z","title":null,"venue":null,"work_id":"5a1d010f-d141-4ee2-8af5-21f365d54a3b","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:51.912116Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a6074e63db0fb5a9249a7733ec668e68db6b92a2bfead945cb6d75e8f8026684","observation_id":"2eb0ee8f-a1ed-468c-85b3-640958a92a87","resolution":{"observed_at":"2026-08-07T12:42:03.847360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1205.1641","last_updated":"2012-05-08T09:27:29Z","snapshot_observed_at":"2026-07-06T02:47:43.315475Z","submitted_at":"2012-05-08T09:27:29Z","title":"Content based video retrieval systems","version":1},"cited_work":{"arxiv_id":"1205.1641","doi":null,"metadata_source":"pith","pith_arxiv_id":"1205.1641","snapshot_observed_at":"2026-08-07T12:41:56.242855Z","title":"Content based video retrieval systems","venue":"cs.MM","work_id":"6bdef105-a68e-4838-9d0d-712c2f0cb7ad","year":2012},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.015082Z"},"links":{"cited_paper":"/paper/1205.1641","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4d208426b46a0c9ff9fe9e81d6bb19271d20385d1d57c9fd0cb6a929d4fb049f","observation_id":"375ee6a6-dc59-498c-a20b-460d3858432a","resolution":{"observed_at":"2026-08-07T12:41:56.280744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.628876Z","title":"Hauptmann, João F","venue":null,"work_id":"1a32a152-5bba-435f-b025-d73fd62e7734","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.093025Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:ed011f873b14960ba030a53160ccfc6104a6096103a89ceacfd3f95123018861","observation_id":"9247929c-8abf-4268-9565-31ead6e83b07","resolution":{"observed_at":"2026-08-07T12:42:03.717904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.456996Z","title":null,"venue":null,"work_id":"4e0c8657-4623-41d9-8993-fa2373d87398","year":2018},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.155931Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:cf75155ea61f911352f6ccf8cb685eadbd1bd9d94c56f19435621bb2a05bd1c4","observation_id":"1a2bc6cc-7dd7-4b87-be6f-edd5bb62079c","resolution":{"observed_at":"2026-08-07T12:42:03.531412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.292327Z","title":null,"venue":null,"work_id":"0db6a5ff-eb42-413a-a31a-5e21085dce0e","year":2015},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.240333Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:9457e40c69980713562a185c49781ec30039c4637c7936afede778d92e3d8c51","observation_id":"aae5b12e-41a9-47b8-89e5-2ed4d0f4202d","resolution":{"observed_at":"2026-08-07T12:42:03.381400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:03.116398Z","title":null,"venue":null,"work_id":"9152b063-c883-412b-bef6-468d74ab15a7","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.315770Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:91b58dde689cf97076d612343275faf23a5112466a235713672f53673b31bc91","observation_id":"ed97aa30-71c3-4913-8544-f1f317192eff","resolution":{"observed_at":"2026-08-07T12:42:03.177598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.932300Z","title":null,"venue":null,"work_id":"db4c040b-ec30-4a13-9448-d92923469dba","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.419516Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4308d603df474ba6f1b7fddc38e9c0fdc8f0c138faafc32429dd33de5964377f","observation_id":"3a947953-3d6d-4f9e-8611-3cb2a03f4de4","resolution":{"observed_at":"2026-08-07T12:42:03.012199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.745708Z","title":"Glass, and Hilde Kuehne","venue":null,"work_id":"0e19d0b1-dba6-479f-95db-b112abdd62ac","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.499597Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a9cd1454855e168634f44341839067d2a529b622e493de6edcd55c01f8c8301e","observation_id":"0b92fbcc-350b-4f77-b560-832a4809ac7a","resolution":{"observed_at":"2026-08-07T12:42:02.851220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.562092Z","title":null,"venue":null,"work_id":"9ed68b47-984e-460c-9362-c1591dff4ce2","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.605641Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5bc7814f4dd9d2242e2ddb610968271a957ade6ac3ed82de119d45d376a8d322","observation_id":"4d7fcbd5-f7b9-4eef-a4d3-f0cf49dbe964","resolution":{"observed_at":"2026-08-07T12:42:02.655683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.345183Z","title":null,"venue":null,"work_id":"69d72e33-510d-4942-b020-a0ab2eae52fd","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.709617Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:6fc624663859a7ab88cd2f982fea6b24a86b1fabc7ce848c0d37744d8902eee8","observation_id":"88fbd092-8586-46ed-b1ee-afd52bfba3df","resolution":{"observed_at":"2026-08-07T12:42:02.456263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.187061Z","title":null,"venue":null,"work_id":"d1cd862a-4b5b-4c4a-a7a7-966dc35d4881","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.795824Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:63ad90664bab7b616f34ac15b09c692c88e827dacc03adc85a6fd50c9f3f4fbd","observation_id":"649d7535-82d3-46f2-a4cf-93636b7e4dab","resolution":{"observed_at":"2026-08-07T12:42:02.272735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:02.034195Z","title":null,"venue":null,"work_id":"1c1cf900-b31b-4e1a-8126-f79aa86993db","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.884016Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:3e95d00678dfc7087da9be97bf6faad35d8e8cf0ddc0f05a4da122469b35af6b","observation_id":"425dfecd-a24b-49d3-9c8e-f30f2e81cbda","resolution":{"observed_at":"2026-08-07T12:42:02.085717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:41:52.962640Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:52.962640Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:2a6ccc1756ceb79e65f7397fe147f572b9389a05516739dfe1b2ad88a6d48534","observation_id":"f9bf792a-7d66-44e4-835e-686761d5263f","resolution":{"observed_at":"2026-08-07T12:41:52.962640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:41:53.026214Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.026214Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:c63e000ea397f59074348aeb7ef9f86122936a596b89bc745123df03147da005","observation_id":"adebee84-ef38-4c18-919c-5c561ae73166","resolution":{"observed_at":"2026-08-07T12:41:53.026214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.898768Z","title":null,"venue":null,"work_id":"7884f01f-e38e-44b4-9fcf-31c6c6403c33","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.078808Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:37c1f848835728ca07271ba9b9eb42e8703170c40f769b85b0200504d49c4cd8","observation_id":"a389a0ac-7a05-4258-8a5d-017431f77e78","resolution":{"observed_at":"2026-08-07T12:42:01.956311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.748549Z","title":null,"venue":null,"work_id":"ca963f92-a2d7-4571-9b7d-c4d939959da2","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.182721Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:f5cdc314f592e4facf5469d53fc1c169dd4cb02bcec76cac2667df190d6bd10e","observation_id":"a213c325-cb76-44cb-b52d-7d6998f5ed25","resolution":{"observed_at":"2026-08-07T12:42:01.809948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.589239Z","title":null,"venue":null,"work_id":"8015a60f-89b2-40a3-a3c6-dcee5140d304","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.250158Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5e79be8cf250ef5a30293d82d65010f15319b11728d89ee58c5a537d44dc3b8d","observation_id":"75e1951f-6991-4c86-b6df-08f9d67bda5d","resolution":{"observed_at":"2026-08-07T12:42:01.651589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06215","last_updated":"2016-07-21T07:20:44Z","snapshot_observed_at":"2026-08-03T01:54:39.800123Z","submitted_at":"2016-07-21T07:20:44Z","title":"A Comprehensive Survey on Cross-modal Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06215","snapshot_observed_at":"2026-08-07T12:41:53.341139Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.341139Z"},"links":{"cited_paper":"/paper/1607.06215","citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:10cc15f28992f2c5e9b728d9806a35aa73189994887ed59a5ced64e4d399fb8e","observation_id":"667bb589-61da-45c1-807c-6d1cb42a3d3a","resolution":{"observed_at":"2026-08-07T12:41:53.341139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.456109Z","title":null,"venue":null,"work_id":"20dd6d1b-c03c-4ffc-908a-99f099f4ea90","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.433579Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:5c6dd9a64cb000cc39a75ede1195d91d9ad63eb039b94be7d6d8e0a4f158333e","observation_id":"990f6d62-bbe3-4c88-9ebb-b75f5d31c926","resolution":{"observed_at":"2026-08-07T12:42:01.519462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.300003Z","title":null,"venue":null,"work_id":"71f90d0f-e063-49a7-a223-3bf27ff70e2a","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.524922Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:776a85bc5f3d3ccdf9b05833197e9a4bb8a487a609911e432556bf9566251099","observation_id":"d4fc24eb-bcd1-4aa7-90a9-51131fb42257","resolution":{"observed_at":"2026-08-07T12:42:01.376118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.166262Z","title":null,"venue":null,"work_id":"9b7442df-c544-499a-8975-67139f8dbd8d","year":2019},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.616249Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:4c220ff30a1adce71e71dab51d7675167353f392e2fceb7e034b00b29291f018","observation_id":"50a61ac5-e8eb-4f9b-b618-9207c48bea79","resolution":{"observed_at":"2026-08-07T12:42:01.230127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:01.034030Z","title":null,"venue":null,"work_id":"aeab8660-c24e-4a40-9ce1-737d249e60f7","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.697033Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:45349c29f71df112898c7dbabe6cc1e11cb9d8d7c61091f2c293d86cad2d17e7","observation_id":"6eb4d787-2c23-444b-bc61-805d0fa0ff46","resolution":{"observed_at":"2026-08-07T12:42:01.095742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.891250Z","title":null,"venue":null,"work_id":"f161922e-1467-416c-abe6-8d6ce8917407","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.791806Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:3e46ebabe9b33954d7ae700fb7e8bd40cd16684f487f45bd7a9ef2411b110fd2","observation_id":"311b9fb0-152f-4f90-9711-c65e3b3bc41c","resolution":{"observed_at":"2026-08-07T12:42:00.951512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.752416Z","title":null,"venue":null,"work_id":"2295c456-e328-40e3-a951-7083938804f4","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.883234Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:66df8d1e8cb0c38675dfafcb8dec5a9a159023f25ab69e3e201a518bcb9ed37d","observation_id":"f87c3059-0e05-4160-93a4-2a64cde32589","resolution":{"observed_at":"2026-08-07T12:42:00.821285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.592531Z","title":null,"venue":null,"work_id":"82bfddbf-8aeb-4519-bcdd-046546f1598b","year":2022},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:53.974621Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:9d19522317f2bdc25ff976e5cfba537b28a72f1c3d16e7fa5e275cb65ceef36c","observation_id":"b11d0dd7-e466-415f-a4cd-607be16cd35c","resolution":{"observed_at":"2026-08-07T12:42:00.662176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.435147Z","title":null,"venue":null,"work_id":"c911ebb9-b70c-4f24-9263-388f1db059e1","year":2019},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.058661Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:1f33be4df117ab49565b1b73bfa5ed23e70e3af0b43bbfb2b86819c31fc3bb5e","observation_id":"4797480b-91fe-45f7-abbb-2d22289421b3","resolution":{"observed_at":"2026-08-07T12:42:00.508983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.307286Z","title":null,"venue":null,"work_id":"5715b1e5-cea7-483a-8b89-bcd2693aa9ae","year":2021},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.088551Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:8c5ba9f71953cdc08f9ce1d316dcdc9f3e9667e2e22d9e3f892f645131652a96","observation_id":"7f5d99d7-f7c1-44cc-bfc4-86042f3f0bfe","resolution":{"observed_at":"2026-08-07T12:42:00.377690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:00.154944Z","title":null,"venue":null,"work_id":"de38d230-eda0-4479-a841-c9b227daed23","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.152716Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:87b381ba084fa4dab301211c7e5f0f499ccac50e42120b12cceb55c63cc82b85","observation_id":"79687750-8328-4e0a-a972-f6b2a8524223","resolution":{"observed_at":"2026-08-07T12:42:00.209033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:59.949130Z","title":null,"venue":null,"work_id":"7af02949-b192-43bb-9358-ca42ef49a4d6","year":2023},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.219812Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:dda5abb4ea839fb05932bba89f458b4d7fc0fd22c28de35a3d0c86b39ea8e4fb","observation_id":"57ed6d9d-4e6f-4c40-a5e8-013d8b69fc18","resolution":{"observed_at":"2026-08-07T12:42:00.044039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:59.779501Z","title":null,"venue":null,"work_id":"2aeb8055-90ae-49b8-945e-49922bb97ba8","year":2025},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.290932Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:a02ddb8e17c6dd740e6d2178ce081940bdfd72a9b56e3528f1ee8fce1234c663","observation_id":"101f1740-e133-4038-9906-047750093c2b","resolution":{"observed_at":"2026-08-07T12:41:59.850150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:59.594197Z","title":null,"venue":null,"work_id":"1f77b74a-ae80-40de-bd09-4c37b617f0a5","year":2024},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.356392Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:041e6b4150b928dc8c2edde5c37408783bae797eec440b7f4fea7bc1202ffdfe","observation_id":"7d5529b3-48ff-43b5-a6c7-1ec6ecb899d3","resolution":{"observed_at":"2026-08-07T12:41:59.677102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:59.425574Z","title":null,"venue":null,"work_id":"ef2615c8-65e8-4ea1-8fd5-d7f45022cc70","year":2016},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.360650Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:6703ea5fa0aa09df5b6e45fd92dc7e451be2f020f2d08356f445d58f7d4523b2","observation_id":"fc29e21c-0c2e-4516-aa9c-703320b37c40","resolution":{"observed_at":"2026-08-07T12:41:59.517546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:41:59.227631Z","title":null,"venue":null,"work_id":"a67093cd-40df-4b2b-847c-c297f59fe788","year":2015},"citing_paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:54.365165Z"},"links":{"citing_paper":"/paper/2505.23952"},"observation_digest":"sha256:060d62fa2249cebbb0aae78129819f11fbcacd026a753120a8dac33366f01f63","observation_id":"0b364af1-f388-4fd3-b813-6ae087c77a3b","resolution":{"observed_at":"2026-08-07T12:41:59.313976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23952","last_updated":"2025-05-29T19:02:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:35:45.450197Z","submitted_at":"2025-05-29T19:02:48Z","title":"Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":96,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":120},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 120 outbound references and 1 inbound Pith citation observation for arXiv:2505.23952."}