{"as_of":"2026-08-11T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e8a98fd78903ddd93f5e4791db8719bd02fb9337cd1aa183591059b792ce226","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:56:37.569807Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T10:48:12.855049Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-08-10T15:56:37.569807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.569807Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:3f9f913590df435310b744345ac59aa49795ff6906ca6f2f7acf7cbade19932b","observation_id":"11511695-2036-4371-bb90-7c06e4173f08","resolution":{"observed_at":"2026-08-10T15:56:37.569807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":"2407.15047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2407.15047 , year =","venue":null,"work_id":"788a342d-907e-46c6-8730-322349dc75cd","year":2024},"citing_paper":{"arxiv_id":"2512.08410","last_updated":"2026-04-09T06:44:08Z","snapshot_observed_at":"2026-08-10T21:26:08.856126Z","submitted_at":"2025-12-09T09:40:20Z","title":"Towards Effective Long Video Understanding of Multimodal Large Language Models via One-shot Clip Retrieval","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T00:10:01.596422Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2512.08410"},"observation_digest":"sha256:26cbaff4dc13f11cb175182d61fcfe8f3214725b145ecfb1edfd601a3ddd9dd9","observation_id":"c5b6ce89-4f84-4b2b-bdbd-d2ca24eee092","resolution":{"observed_at":"2026-05-17T00:11:23.171904Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":"2407.15047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2407.15047 , year =","venue":null,"work_id":"788a342d-907e-46c6-8730-322349dc75cd","year":2024},"citing_paper":{"arxiv_id":"2603.22911","last_updated":"2026-04-12T14:01:49Z","snapshot_observed_at":"2026-08-03T01:43:21.251112Z","submitted_at":"2026-03-24T08:01:16Z","title":"ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:47.841355Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2603.22911"},"observation_digest":"sha256:4a21baba994f1788b8a63ca3383189e44e98b2fe5d79afa85fbbfe52c3135a81","observation_id":"ec4b263b-f997-4731-b04d-6a7916ed4723","resolution":{"observed_at":"2026-05-15T00:58:25.539956Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":"2407.15047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2407.15047 , year =","venue":null,"work_id":"788a342d-907e-46c6-8730-322349dc75cd","year":2024},"citing_paper":{"arxiv_id":"2605.00444","last_updated":"2026-05-01T06:24:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T06:24:40Z","title":"Scaling Video Understanding via Compact Latent Multi-Agent Collaboration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T20:11:11.410051Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2605.00444"},"observation_digest":"sha256:e8fefa340d141d8e9e00c6ba942727d2603d2119ede5ca4c711867cc071bb7b4","observation_id":"005c2245-a687-447f-985f-a480817be04c","resolution":{"observed_at":"2026-05-11T15:21:09.542544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":"2407.15047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2407.15047 , year =","venue":null,"work_id":"788a342d-907e-46c6-8730-322349dc75cd","year":2024},"citing_paper":{"arxiv_id":"2605.19075","last_updated":"2026-05-18T20:01:05Z","snapshot_observed_at":"2026-08-02T00:47:04.600117Z","submitted_at":"2026-05-18T20:01:05Z","title":"CRAFT: Critic-Refined Adaptive Key-Frame Targeting for Multimodal Video Question Answering","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-20T10:45:46.597723Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2605.19075"},"observation_digest":"sha256:6118939eb2c3d3a0065862055486fef4be578cf14ceee6d26c3783b3bc880709","observation_id":"b08716df-c478-4c33-97e5-9bd74edc60af","resolution":{"observed_at":"2026-05-20T10:48:12.856768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.15047/citation-record","integrity":"/paper/2407.15047/integrity","json":"/paper/2407.15047/citation-record.json","paper":"/paper/2407.15047"},"outbound":[],"paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2407.15047."}