{"as_of":"2026-08-11T07:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c63ee6680df569a5de399c99bd512bff5cdc7bef7465f35f8b283e21debd6857","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:56:37.724527Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T08:41:42.061219Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T20:31:13.232755Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"cited_work":{"arxiv_id":"2501.13536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13536","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasvqa: Advancing videoqa with imperfect reasoning process","venue":null,"work_id":"dd1e2fe8-516c-4015-9a6e-82dc00f0c315","year":2025},"citing_paper":{"arxiv_id":"2604.23145","last_updated":"2026-04-25T05:07:43Z","snapshot_observed_at":"2026-08-03T01:16:00.979324Z","submitted_at":"2026-04-25T05:07:43Z","title":"UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T08:41:42.061219Z"},"links":{"cited_paper":"/paper/2501.13536","citing_paper":"/paper/2604.23145"},"observation_digest":"sha256:cdfa8305285a941d3c800333306c563137f979746d8106dfaba40be3b72782ed","observation_id":"01e44a6c-0e25-4767-8e5c-d8a24044eaa7","resolution":{"observed_at":"2026-05-11T20:31:13.241769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13536/citation-record","integrity":"/paper/2501.13536/integrity","json":"/paper/2501.13536/citation-record.json","paper":"/paper/2501.13536"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.461721Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.461721Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:aa89ec3985ff67b54a9a0bf49e96929d3740a289f390a37b3b2ba825a073ff54","observation_id":"103f0773-f570-48e7-9c7e-43551732205d","resolution":{"observed_at":"2026-08-10T15:56:37.461721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.466925Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.466925Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:1571b67aa8ac6eb9591683ef9cc159b8011d3e7cc4be8bc6d968d125d053a09c","observation_id":"d97a0c5d-25eb-4d79-bb3f-5a98fba825ad","resolution":{"observed_at":"2026-08-10T15:56:37.466925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T15:56:37.472150Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.472150Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:22a0709816c5674b436462de888335e8e79a21466a9b5524211c342937913210","observation_id":"5000d212-7411-4a5d-b9ec-b093d18c425e","resolution":{"observed_at":"2026-08-10T15:56:37.472150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.603310Z","title":null,"venue":null,"work_id":"e716e0de-7453-448b-ae73-885e41f06f98","year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.477137Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:fe8f6d50b3f54990cd27c8679d853ae0f15a9631efa96343793dac5a6b632292","observation_id":"8af6f80b-a6cc-4673-ac76-cc6d891c13e2","resolution":{"observed_at":"2026-08-10T15:56:38.607461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-10T15:56:37.481829Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.481829Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:1e1ed3f926ebe6be5ac7efcf1dd0a0462a0fe0eb4d084a0dc813d0f677189821","observation_id":"bac53c5e-9102-445e-8ae6-712ca7c2f130","resolution":{"observed_at":"2026-08-10T15:56:37.481829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.590109Z","title":null,"venue":null,"work_id":"2c7eb74e-4964-4dd9-aab7-5c6a1b82bde0","year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.486484Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:0de715b7676667528e26aca6e73b3f7dc9d4e79617abcb8963982255efe12a00","observation_id":"d03b8133-3f3c-4762-abf1-6f994969b149","resolution":{"observed_at":"2026-08-10T15:56:38.594407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-10T15:56:37.490893Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.490893Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:af46810e81e380e0fcc53871bfd063344d106937d92ef6b0f6e436b8c5bd7ed6","observation_id":"0b6f75a8-bf87-45d3-a196-fc88f5f83e45","resolution":{"observed_at":"2026-08-10T15:56:37.490893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.495678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.495678Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:b0970a85116352ea4cbe92abcfda0cf0169f533a7f036a636851cd73a577b7d7","observation_id":"747c9769-151d-407b-91a4-a70b03007982","resolution":{"observed_at":"2026-08-10T15:56:37.495678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.500397Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.500397Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:1b6b7de062874da70f7ae1519ae9d326a8aa895e7081b98d7abc621e0c55f489","observation_id":"24f42aa9-b3ca-4aee-b955-6b1921e13b58","resolution":{"observed_at":"2026-08-10T15:56:37.500397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-10T15:56:37.504589Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.504589Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:2367c57a59247d282227b26c9fab9779c1f42b04b475eb38e1ef612b413d5619","observation_id":"c9ab447a-122a-48e0-9c8c-2ffd3d05255e","resolution":{"observed_at":"2026-08-10T15:56:37.504589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.509542Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.509542Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:b1be6d1f4951f8ff9367c19aaaefcfafe15c657a096cb18a69c392e4cb1dc725","observation_id":"21d25fe0-07ce-45e0-9148-017abd6cb279","resolution":{"observed_at":"2026-08-10T15:56:37.509542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.513678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.513678Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:18439e5c49e53953c71d443f08b0f7ea86845ab3d62ee78f92f9506f7d195e21","observation_id":"251999dc-c36f-413e-8f78-3d4ae4b3b27c","resolution":{"observed_at":"2026-08-10T15:56:37.513678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.542594Z","title":null,"venue":null,"work_id":"7156aa7a-f79f-41be-93c8-a8d371bf9516","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.517764Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:5cd3ad5d14f4130f99256f30f2f94b4d1b0ab67e6e69f42f61086ff9f56c3463","observation_id":"31114ffb-8ed3-4549-a67f-66d019e3525a","resolution":{"observed_at":"2026-08-10T15:56:38.547240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.521905Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.521905Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:96c294c48f87e8fad86b20097b4fcce6176a7dd4067c0bd3e66513df08da8e26","observation_id":"50fc9d1d-3198-4562-a618-01e40ef2d47c","resolution":{"observed_at":"2026-08-10T15:56:37.521905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T15:56:37.526189Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.526189Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:d65a218762219103e7a10d1ddd962b1303aaa420df2fa1bcbe7373d2863e3afc","observation_id":"67e4080b-872d-4d61-86c6-b647d5b723e9","resolution":{"observed_at":"2026-08-10T15:56:37.526189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.530174Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.530174Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:93354217f798fc935f267ea8fc36cb72a81754836ee6b466f217c36dbce19fd5","observation_id":"270efb7c-d013-402a-a46f-c659d1ecb5ff","resolution":{"observed_at":"2026-08-10T15:56:37.530174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14622","last_updated":"2024-12-20T15:06:14Z","snapshot_observed_at":"2026-08-10T16:52:41.065205Z","submitted_at":"2024-03-21T17:59:35Z","title":"Language Repository for Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14622","snapshot_observed_at":"2026-08-10T15:56:37.533803Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.533803Z"},"links":{"cited_paper":"/paper/2403.14622","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:9cd5ff41235f2c2ceeab91b0c6c936220d8683842d7a0d5dfaeae421c6edc5bd","observation_id":"bc972c75-5884-407d-9b57-524c466e2845","resolution":{"observed_at":"2026-08-10T15:56:37.533803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14095","last_updated":"2020-10-27T06:34:14Z","snapshot_observed_at":"2026-08-06T09:04:13.865739Z","submitted_at":"2020-10-27T06:34:14Z","title":"MMFT-BERT: Multimodal Fusion Transformer with BERT Encodings for Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2010.14095","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.14095","snapshot_observed_at":"2026-08-10T15:56:38.186888Z","title":"MMFT-BERT: Multimodal Fusion Transformer with BERT Encodings for Visual Question Answering","venue":"cs.CV","work_id":"85173972-f574-40eb-b256-4b5f1e174693","year":2020},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.537886Z"},"links":{"cited_paper":"/paper/2010.14095","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:d00ac7d5ea660ffb67c07a50835339328a1e9ddfb3883d06d0410b09100f3681","observation_id":"8d0d1d35-ec78-425b-87c0-8de80ccb1b09","resolution":{"observed_at":"2026-08-10T15:56:38.191072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.512781Z","title":null,"venue":null,"work_id":"e82cce7a-61c1-4c2e-88e4-ba15510f0e01","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.541863Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:fb0cd394ef4dfff3e40f99d3895aa555aa51dd242851f8a5f043637f4843ec7d","observation_id":"79863cc2-a533-4e23-a8ea-229b9b0ff947","resolution":{"observed_at":"2026-08-10T15:56:38.516618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.545565Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.545565Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:fc9b30105a134197537a3ba9e38fe483d252327fd2815954c3f81ac975bb972f","observation_id":"e198c2f7-17e4-4ae4-8c97-c02d43046e06","resolution":{"observed_at":"2026-08-10T15:56:37.545565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.492866Z","title":null,"venue":null,"work_id":"367fca92-c4d9-4461-b342-770dd16e392f","year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.549074Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:ff7551170626e523fe892b0910f209e5a5e0c5dba37097c18ca09cc5a204f58e","observation_id":"be242202-5772-4d9c-86f9-df3ed0c2e2ed","resolution":{"observed_at":"2026-08-10T15:56:38.496463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-10T15:56:37.552702Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.552702Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:784f4e80ef2d74ef5c87c4dd456627dbf34ccdc91f4c4a96499a26bd5a9c5273","observation_id":"bfd974dc-4d90-4fbd-adb7-e120ae28f162","resolution":{"observed_at":"2026-08-10T15:56:37.552702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.480619Z","title":null,"venue":null,"work_id":"e3baac74-8910-49aa-ac76-0564adeec755","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.557041Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:71696364970d8273a271c17a1f8780391cbaa4ef34bce9d20cfb86133683c6ec","observation_id":"f3f7b40f-8339-44d3-9da6-78951b0eeb9c","resolution":{"observed_at":"2026-08-10T15:56:38.484421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-10T15:56:37.561246Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.561246Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:7a9766a1a6a74bfe4026c6d310995a3b9c7a3539c880d294d38ee91c51c7d092","observation_id":"8c7a8423-3473-4d45-b52f-5efaab4bd9a8","resolution":{"observed_at":"2026-08-10T15:56:37.561246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-10T15:56:37.565527Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.565527Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:cdb97a72624d97889a5032ad1d5bda0c05ad2ca058a8c6e54a35b3c7cd95906a","observation_id":"74613560-8f9d-42b4-8ac0-78b3b5004867","resolution":{"observed_at":"2026-08-10T15:56:37.565527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15047","last_updated":"2024-07-23T14:56:22Z","snapshot_observed_at":"2026-08-09T03:13:18.201471Z","submitted_at":"2024-07-21T04:09:37Z","title":"End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15047","snapshot_observed_at":"2026-08-10T15:56:37.569807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.569807Z"},"links":{"cited_paper":"/paper/2407.15047","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:3f9f913590df435310b744345ac59aa49795ff6906ca6f2f7acf7cbade19932b","observation_id":"11511695-2036-4371-bb90-7c06e4173f08","resolution":{"observed_at":"2026-08-10T15:56:37.569807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T15:56:37.574555Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.574555Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:a003cdf55cf42e883a2792ee5992bcd3ab71e57e1a639138d5bb14ae0cfc76d8","observation_id":"dbf18237-3e65-4508-87ed-ab6cd4006c78","resolution":{"observed_at":"2026-08-10T15:56:37.574555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-10T15:56:37.578901Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.578901Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:d078748efa127b1f8dd9564197c35f9af8912d4590515746b98c402db8d52f3c","observation_id":"ff8397f5-2f47-4771-b11e-d26b85aba25a","resolution":{"observed_at":"2026-08-10T15:56:37.578901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.583204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.583204Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:d7f2d6b9117f5f27610ea583e4a03bd49e17dfd6653451c8e6e72ca1f170805a","observation_id":"936e38e7-3d19-4afe-9278-d241b7b85883","resolution":{"observed_at":"2026-08-10T15:56:37.583204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.587280Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.587280Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:1df531d561079b193caa2b35cd25c164af98be84b5d9aaa2644e25534fb47722","observation_id":"a0eef894-cd8e-411d-acd4-2021e76b9c20","resolution":{"observed_at":"2026-08-10T15:56:37.587280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.451529Z","title":null,"venue":null,"work_id":"d31f4653-8210-4dd4-867b-d80ea23f7305","year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.591539Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:637022b9b4b5fa8ae377035850fb653944b2a098f2a67377d5380cb977550fdb","observation_id":"3b5198bd-da2f-4296-8026-cef6de150576","resolution":{"observed_at":"2026-08-10T15:56:38.455290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.438928Z","title":null,"venue":null,"work_id":"8b748d0a-c202-40f3-9197-ab0a58b4369f","year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.595756Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:bc2a1eeb8484f578acdab734552aa56085f56eab16dd4ae0f88636af5ecc7022","observation_id":"d06d8146-7df2-4db8-a9a0-2bf07b8955bf","resolution":{"observed_at":"2026-08-10T15:56:38.442962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.599851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.599851Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:8dec41ff10b17003f842106187748c1b603f9b74d4bbdf004bc0f3579241c100","observation_id":"02dea2f3-98c2-48f5-ac1f-d7c9b86b797e","resolution":{"observed_at":"2026-08-10T15:56:37.599851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11732","last_updated":"2023-06-15T20:56:20Z","snapshot_observed_at":"2026-08-09T18:50:50.538190Z","submitted_at":"2023-06-15T20:56:20Z","title":"Retrieving-to-Answer: Zero-Shot Video Question Answering with Frozen Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.11732","snapshot_observed_at":"2026-08-10T15:56:38.088828Z","title":"Retrieving-to-Answer: Zero-Shot Video Question Answering with Frozen Large Language Models","venue":"cs.CV","work_id":"a682654a-5587-42cb-8ee1-7e1b9984c4be","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.604004Z"},"links":{"cited_paper":"/paper/2306.11732","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:16c9caa37c9d77062a2496ae961f1b70be0e812a749a73bcba8381dec18079a0","observation_id":"1a4b43cc-d494-446c-8fb1-b75fa54fcc52","resolution":{"observed_at":"2026-08-10T15:56:38.093073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.608958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.608958Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:d98e22e1bbcc886d551fea1a985a1ee00541d97e267a0df1885366f2fa2c175b","observation_id":"6e99d465-0389-41ff-8728-b0bc724cba41","resolution":{"observed_at":"2026-08-10T15:56:37.608958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.417878Z","title":null,"venue":null,"work_id":"b68f0447-26eb-467f-a963-b84b64d897ac","year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.613402Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:5959666efbf024e1e297aaca8604db1e134567009fc2eac4835429f23ea6109e","observation_id":"8a822566-375a-4a02-9e43-167e3887711a","resolution":{"observed_at":"2026-08-10T15:56:38.421770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10698","last_updated":"2024-07-21T00:42:15Z","snapshot_observed_at":"2026-08-03T19:02:22.254717Z","submitted_at":"2024-02-16T13:59:07Z","title":"Question-Instructed Visual Descriptions for Zero-Shot Video Question Answering","version":2},"cited_work":{"arxiv_id":"2402.10698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10698","snapshot_observed_at":"2026-08-10T15:56:37.935051Z","title":"Question-Instructed Visual Descriptions for Zero-Shot Video Question Answering","venue":"cs.CV","work_id":"82066e75-e5b3-4adc-90ef-c00cf77639a6","year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.617733Z"},"links":{"cited_paper":"/paper/2402.10698","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:6455bc24f4795c7c26feaa51e71d9b8cfa934b91f0a8a3575b85d823d7cdd2fc","observation_id":"6a824be7-691e-4ac4-bb92-11c4b11b12ca","resolution":{"observed_at":"2026-08-10T15:56:37.940672Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-10T15:56:37.622068Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.622068Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:47d8164a0495e345620b7aa20ff1c66cec65c5882b08f0942676b9e71d7dcdab","observation_id":"d3d3cb77-2dab-459c-8e2a-5be2ba4af39b","resolution":{"observed_at":"2026-08-10T15:56:37.622068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T15:56:37.626944Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.626944Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:60bd5b116a262904e6ae347c8d12d6b68c6872ff38f9276176f5ed465a34013e","observation_id":"0a8a613a-c7fe-440a-b4f7-c80010e7fcb3","resolution":{"observed_at":"2026-08-10T15:56:37.626944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-10T15:56:37.631123Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.631123Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:43d84afcfc079873ca32eb26b58f3abf8319096b489f1232540297c992d8b432","observation_id":"9833c366-9302-42f2-9593-2bcf309b39be","resolution":{"observed_at":"2026-08-10T15:56:37.631123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.405086Z","title":null,"venue":null,"work_id":"2922ea0a-86f5-4a7d-9124-5fdafdd13d75","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.635622Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:2e44fd8f7f637057f1c48be2a5d522d2b01394f0b2b4cbf7e4923761d90577e7","observation_id":"e1b762e2-9003-432a-8408-35883bfbdad0","resolution":{"observed_at":"2026-08-10T15:56:38.409170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13627","last_updated":"2024-07-13T22:10:57Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T17:44:24Z","title":"Vamos: Versatile Action Models for Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13627","snapshot_observed_at":"2026-08-10T15:56:37.639822Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.639822Z"},"links":{"cited_paper":"/paper/2311.13627","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:09f7b2896f0e873289ff9555d3f8ae4740061869a16e54f9d9cfb83ec0a5ae16","observation_id":"b8709316-07c9-4af0-b0a3-e3818bc7fb56","resolution":{"observed_at":"2026-08-10T15:56:37.639822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.391985Z","title":null,"venue":null,"work_id":"f4b5bf01-1ecc-4b13-8682-2f0720bb8dc2","year":2025},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.644676Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:9e2934cb9e37baf7fe84298cb1f5a5f153b3a09ff713b8be8dc61e924864340d","observation_id":"b3c3f9c5-49a1-4875-b4db-3b4129bbcff2","resolution":{"observed_at":"2026-08-10T15:56:38.395962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08367","last_updated":"2024-10-01T10:11:14Z","snapshot_observed_at":"2026-07-06T17:01:13.998131Z","submitted_at":"2023-12-13T18:58:15Z","title":"ViLA: Efficient Video-Language Alignment for Video Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08367","snapshot_observed_at":"2026-08-10T15:56:37.648819Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.648819Z"},"links":{"cited_paper":"/paper/2312.08367","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:4206b2745b08f52d3291c7dfd8a9dccf87545bc2179fb4380677436afc0c2a12","observation_id":"f4a0924f-dbad-4f48-a827-a192d9653db3","resolution":{"observed_at":"2026-08-10T15:56:37.648819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-10T15:56:37.652779Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.652779Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:82c855871c319570de4853f81a03a23ce269dffc854044ee328a98012383dfea","observation_id":"40bfc913-d32a-4cab-a4e5-0d3ff48a970b","resolution":{"observed_at":"2026-08-10T15:56:37.652779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03191","last_updated":"2022-12-07T12:20:55Z","snapshot_observed_at":"2026-07-06T14:27:34.639236Z","submitted_at":"2022-12-06T18:09:49Z","title":"InternVideo: General Video Foundation Models via Generative and Discriminative Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03191","snapshot_observed_at":"2026-08-10T15:56:37.656464Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.656464Z"},"links":{"cited_paper":"/paper/2212.03191","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:3bb5ab4cc6e46c934d6aa34ba6d396ec5d3466dc2d8b5e060044369b71ceff1d","observation_id":"d55281f1-d88e-46cc-a9fb-13cecc4bdc98","resolution":{"observed_at":"2026-08-10T15:56:37.656464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16050","last_updated":"2024-10-03T09:24:56Z","snapshot_observed_at":"2026-08-05T03:05:38.218384Z","submitted_at":"2024-02-25T10:27:46Z","title":"Efficient Temporal Extrapolation of Multimodal Large Language Models with Temporal Grounding Bridge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16050","snapshot_observed_at":"2026-08-10T15:56:37.660307Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.660307Z"},"links":{"cited_paper":"/paper/2402.16050","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:7df4b1a4cb9beaecb9934b39615467c6b8059777603ea6806d08b954a6dc0e25","observation_id":"4fdb710f-0d26-4602-aedb-0b9db4c9d6fa","resolution":{"observed_at":"2026-08-10T15:56:37.660307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.664119Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.664119Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:3694d550585d30a083f02286afebae30ddffa723385e8298a0dabbd8a76571bd","observation_id":"f2db5ab1-70d7-49e2-b66d-b2e242cd3a71","resolution":{"observed_at":"2026-08-10T15:56:37.664119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.371286Z","title":null,"venue":null,"work_id":"75b8941b-3f62-4c03-8ff1-215e000725a6","year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.667733Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:dab25f4f5bc5ce453ad72dcc41bd2398338290bfd13cfd2d8daccaa6f9d88297","observation_id":"fe7e54d7-1f64-46a8-8316-3175db5b68e8","resolution":{"observed_at":"2026-08-10T15:56:38.375330Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.671977Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.671977Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:f747c1855cc10a5a34da175fb015695210fd81771d77f36e4ec8054bb6101382","observation_id":"62ab7403-c8ee-4185-adc5-a459da6c2deb","resolution":{"observed_at":"2026-08-10T15:56:37.671977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.350248Z","title":null,"venue":null,"work_id":"4001c4da-0fca-435b-92e1-aa6a8bd5267c","year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.676710Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:125f8316501d847b3948b842631c72fcdbe159e8e18dfd79022c613a6563e4be","observation_id":"b437adb0-49fe-46d1-80eb-e75c26799c22","resolution":{"observed_at":"2026-08-10T15:56:38.354165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.337250Z","title":null,"venue":null,"work_id":"3bd32bdc-f3d3-426f-a734-6917b3bfb5fa","year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.681069Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:961a9c4813c82642ac516b0b886d241408708e0363bdb30630923aa9a538e559","observation_id":"128cb612-b798-4553-99c4-a608fcf41338","resolution":{"observed_at":"2026-08-10T15:56:38.341481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.685506Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.685506Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:ea9e54e55c0ae7aebe60d814d2263673b393b958c40594a38b6e58b405c10723","observation_id":"4c3cc50f-6ab2-4d28-becd-0c92e33b7ad3","resolution":{"observed_at":"2026-08-10T15:56:37.685506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2023/582","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.754882Z","title":null,"venue":null,"work_id":"c8d32c4e-da68-4b18-b7b7-87ddfb003003","year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.689494Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:ee04629d59050330a92a4997af536f71e33efe19b519c10d972db7a8768c5a22","observation_id":"1e569a1a-4318-45c2-8252-ab120cf1ac61","resolution":{"observed_at":"2026-08-10T15:56:37.761012Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.316434Z","title":null,"venue":null,"work_id":"d3cc5cd5-dafb-4b3b-ab71-6f206923623d","year":2021},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.693954Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:4f2ed837a31fcb418950ef0f9bb959015ba2e3448f786a855bf604479aaff90f","observation_id":"130f60fe-fab0-48b1-8368-32d25f25cb39","resolution":{"observed_at":"2026-08-10T15:56:38.320691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.303053Z","title":null,"venue":null,"work_id":"6cf62ad4-4f7b-4d24-9da4-66cddb5ca920","year":2020},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.698176Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:56a1058eb19893931573c4e2d7d78e488235b686a86ca25c089cd55934fd4599","observation_id":"3a6b98be-c9b4-4ac2-b19c-5f0264a83e01","resolution":{"observed_at":"2026-08-10T15:56:38.307189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:37.702351Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.702351Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:77c214fad172496a95acd49da4ffbe6f30e53b2d76fbe8bbd7309f946e632680","observation_id":"a7b07d37-6f63-40a1-a8d0-93c629e2ffd4","resolution":{"observed_at":"2026-08-10T15:56:37.702351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06988","last_updated":"2023-11-29T21:24:35Z","snapshot_observed_at":"2026-08-01T23:38:14.619200Z","submitted_at":"2023-05-11T17:23:00Z","title":"Self-Chained Image-Language Model for Video Localization and Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06988","snapshot_observed_at":"2026-08-10T15:56:37.706498Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.706498Z"},"links":{"cited_paper":"/paper/2305.06988","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:b678bf712733e12a2eaaecbf3998449936409341dca967422a821480504eaa90","observation_id":"f97690b8-ccdb-4431-9aae-c11b6571bf89","resolution":{"observed_at":"2026-08-10T15:56:37.706498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00598","last_updated":"2022-05-27T17:52:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-01T17:43:13Z","title":"Socratic Models: Composing Zero-Shot Multimodal Reasoning with Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00598","snapshot_observed_at":"2026-08-10T15:56:37.711383Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.711383Z"},"links":{"cited_paper":"/paper/2204.00598","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:1a468deecac471e904c58c2a79ae235067264aeba5eb82755837129f2f6a24cf","observation_id":"ecbaedbe-9bb4-436b-8035-af5cae4bb06f","resolution":{"observed_at":"2026-08-10T15:56:37.711383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-08-10T11:57:05.068914Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-10T15:56:37.715901Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.715901Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:8bdd95308e05a3dcaeb343bf6b57f21faac123dfe358ee5d1ba3b15a8a712cf6","observation_id":"1cb44e77-97b8-4fcd-b2cd-d5a96f89ddfb","resolution":{"observed_at":"2026-08-10T15:56:37.715901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-11T00:52:12.225793Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-10T15:56:37.720184Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.720184Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:43346d1aa1aaa9463e5553824c8e460f9b67483c2a7f6d414eb693785ca2c4be","observation_id":"fd001719-9fbf-4d76-995e-17b2e333cd62","resolution":{"observed_at":"2026-08-10T15:56:37.720184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:56:38.280887Z","title":null,"venue":null,"work_id":"c55d7ebd-2606-4a7a-aebf-b28efa7a7e8c","year":2022},"citing_paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T15:56:37.724527Z"},"links":{"citing_paper":"/paper/2501.13536"},"observation_digest":"sha256:2609f67743cd08e0eb6f05fc279402b9d12e56a83a8e82716b5dd69da4fd14c0","observation_id":"668779e4-fab6-45b4-b17c-0a7c8b568400","resolution":{"observed_at":"2026-08-10T15:56:38.285896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.13536","last_updated":"2025-01-23T10:35:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T15:49:26.456054Z","submitted_at":"2025-01-23T10:35:22Z","title":"ReasVQA: Advancing VideoQA with Imperfect Reasoning Process"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2501.13536."}