{"as_of":"2026-08-09T18:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6485d203812a56ea1a3a5bf41512d41e5ab5a21d36c1f80cc827ea7d73f5c8b3","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:14:48.103490Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:06:42.932373Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03301","snapshot_observed_at":"2026-07-31T23:06:42.932373Z","title":"Sagaqa: A multi-hop reasoning benchmark for long-form narrative understanding in tv series,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24082","last_updated":"2026-07-27T07:23:22Z","snapshot_observed_at":"2026-08-06T03:54:26.893671Z","submitted_at":"2026-07-27T07:23:22Z","title":"Towards High-Level Semantic Intelligence","version":1},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-07-31T23:06:42.932373Z"},"links":{"cited_paper":"/paper/2606.03301","citing_paper":"/paper/2607.24082"},"observation_digest":"sha256:78aa789369db1239600cf651feabbb011bde8e8617e7eb33bdffac1b2e510089","observation_id":"f05796e2-0daf-42be-a12e-21fe7d01cda4","resolution":{"observed_at":"2026-07-31T23:06:42.932373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.03301/citation-record","integrity":"/paper/2606.03301/integrity","json":"/paper/2606.03301/citation-record.json","paper":"/paper/2606.03301"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":"2405.21075","doi":"10.1609/icwsm.v17i1.22209","metadata_source":"pith","pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","venue":"cs.CV","work_id":"77fd5ac9-ae98-4846-9d83-e9c73c8f2a52","year":2024},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:df2c0229db8c62623f2c272053fc125c272b9f1c793b557bd9012e1bbe79d717","observation_id":"d8d0ebed-3d85-4a41-9c8d-c98ac677e338","resolution":{"observed_at":"2026-07-02T03:16:33.467725Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06943","last_updated":"2026-05-18T06:58:21Z","snapshot_observed_at":"2026-08-02T18:32:02.969277Z","submitted_at":"2026-01-11T15:07:37Z","title":"Watching, Reasoning, and Searching: A Video Deep Research Benchmark on Open Web for Agentic Video Reasoning","version":2},"cited_work":{"arxiv_id":"2601.06943","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.06943","snapshot_observed_at":"2026-07-02T03:16:33.483450Z","title":"Watching, reasoning, and searching: A video deep research benchmark on open web for agentic video reasoning","venue":"cs.CV","work_id":"be21837f-384d-44a4-a424-696e73217008","year":2026},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2601.06943","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:ce4d87853914629b7cdd73bb4d268fe9b29f25fe59f3c48c69a4245b22e9fba3","observation_id":"a5a57e6b-4f29-490f-bd21-52016d29d6df","resolution":{"observed_at":"2026-07-02T03:16:33.485305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:af9b07e03e02d6490b9daa3941d39e178260e29fdc9523338da62fadfca5ae1e","observation_id":"b60799c6-dca0-4064-ba53-0f9dadb55b1c","resolution":{"observed_at":"2026-07-02T03:16:33.464096Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.01546","last_updated":"2025-08-03T02:09:54Z","snapshot_observed_at":"2026-08-06T05:33:21.293261Z","submitted_at":"2025-08-03T02:09:54Z","title":"E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":"2508.01546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.01546","snapshot_observed_at":"2026-07-03T15:28:33.975112Z","title":"E-vrag: En- hancing long video understanding with resource- efficient retrieval augmented generation","venue":null,"work_id":"2dbb2ab3-0565-47b9-8c88-908657d34d95","year":2025},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2508.01546","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:20530b1b458b6eef5c4e0909a1436564570366196f743e6f64840771930bf267","observation_id":"f7f43c79-4062-49b3-a78e-b0175fbb6a0a","resolution":{"observed_at":"2026-07-02T03:16:33.473907Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10857","last_updated":"2025-08-04T09:11:48Z","snapshot_observed_at":"2026-08-08T13:30:57.844783Z","submitted_at":"2025-06-12T16:17:17Z","title":"VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos","version":2},"cited_work":{"arxiv_id":"2506.10857","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10857","snapshot_observed_at":"2026-07-04T00:49:17.495045Z","title":"Vrbench: A benchmark for multi-step reasoning in long nar- rative videos","venue":null,"work_id":"5ff34ad0-8179-49bb-9f70-4b2cd18b4aa8","year":2025},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2506.10857","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:fb07a73b9ec1c82360661bb64bbbf8995d527f18078b576725d04443b8430e1c","observation_id":"8827aa6c-7368-48d9-bb61-1f90ba55de1a","resolution":{"observed_at":"2026-07-02T03:16:33.477641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:48:45.413342Z","title":"Videodeepresearch: Long video understanding with agentic tool using","venue":null,"work_id":"49d7c349-79d2-4f20-8551-6d1168613cfd","year":2025},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:c428af837bf61080b7f51a4edcfa87ee6a0e74145bfb7e0d0484caa45a004145","observation_id":"6065c94d-2ade-4761-b48c-0a8e144a8396","resolution":{"observed_at":"2026-07-02T03:16:33.470813Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04471","last_updated":"2025-04-06T13:03:34Z","snapshot_observed_at":"2026-08-09T17:07:13.716381Z","submitted_at":"2025-04-06T13:03:34Z","title":"VideoAgent2: Enhancing the LLM-Based Agent System for Long-Form Video Understanding by Uncertainty-Aware CoT","version":1},"cited_work":{"arxiv_id":"2504.04471","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04471","snapshot_observed_at":"2026-07-04T09:39:46.773095Z","title":"Videoa- gent2: Enhancing the llm-based agent system for long- form video understanding by uncertainty-aware cot.ArXiv, abs/2504.04471","venue":null,"work_id":"f48dcbfc-f27c-4341-b378-8cb620ec9344","year":2025},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"cited_paper":"/paper/2504.04471","citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:92bc00045ce81cf1fcefef3eb37c7105079803c08a92687820e71b26e13075e4","observation_id":"f6717910-b0a6-45b5-aab0-a00dfcb494e7","resolution":{"observed_at":"2026-07-02T03:16:33.481200Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:dcc7db05d6c576bed9f0490976ce34b1e81e55daf9cb065ec6e95df359942b69","observation_id":"ac32ab65-3a01-409d-9c36-c1ef3f5e3755","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"(Hop 3) Her children, Parker and Liberty, mistook these for soda, drank them, and became drunk","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:1db6a0bec782003e8a0a56d122ee955fb7139e9b6fcae7b9eb32a75f8e122215","observation_id":"0e710f70-5228-450b-bf79-02323f650615","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:a501a184f84c2b651cc715b54097a37f229128164ed9dd3fd56fc70f7a209e4e","observation_id":"b311a2a3-589f-497c-b783-7df53bca4f0f","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:e5fe5e43b05f6581b956f45d7aaa8d10296fa1962929c667d327e3d6486d400f","observation_id":"451fb566-3247-4027-8a2e-431f922c125c","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:b7b897617567b935d9e1e77410fa1714c0d5e6b9d0d61efaf30e58037bd6f8e9","observation_id":"232b5644-ff66-4ea0-ac2f-0c01ee52fb8b","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:b329504a4b24fcdfdec6c86f8455207e8109f816dcdeb6da92c40c5e147cf6ea","observation_id":"fb1f066e-889c-4c15-af8d-c2c9cbe76a21","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:f47014535cce8b141508f4e2ed6efa30bc942f1ddaabb1a6d57f937aaa985410","observation_id":"0d1f97dd-a233-4735-b150-4904c3cb9f1e","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Example 6 January 2003, ...:","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:e0e10f13396691028f9bec5ae51e63f835a1dca503e131c965a91a433da18a3f","observation_id":"fa370db7-fe71-476e-b7b6-f42f9bce2b6c","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:55745f8a9017ce3a1243ab7d743815da3db77aba5260cebe7a96bf3535c42e8f","observation_id":"f45e5643-e4fc-401f-8ce7-a29d15656c11","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:14701e95f8ca99dae0640fdde0e6e01da8e77d1c02fd1035eebfb476bfe74cdd","observation_id":"82d08d07-1cdf-4a0c-b2b8-c50b14aa38e7","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Midnight Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:38c8d3db2470a04ccd2eb25b355b93c7aea5bf3e35dea96c13293e25c097a3e7","observation_id":"a5da8bae-6538-44bc-8b47-94e47b812df8","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Midnight Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:c696e2ab7f61672bf9ca5db50d00c2d49246d400d179c0a88a8fcac84231a5b9","observation_id":"a17d439d-07f3-4336-b713-ce1921926724","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Mid- night Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:414c88d80a2bd560695239d7a8b1ee0850e6651350b6311ee651d081720fa0b1","observation_id":"73c694cd-017a-4b44-8881-0191d3dcfafc","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"visual presence of the product samples","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:1bc9a78a71b558ec404105ab8034d2abc70075dc6257f914aed8bdbe03793c8a","observation_id":"8724a16d-7aa2-4318-a0cc-2848b2e1f528","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Mid- night Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:b93c70fd0d8e10919a5228247d16a04d4f274acde6dcad00d8894965729cdc0d","observation_id":"8c2c337b-556c-4aa9-bb8b-2b55d950ff2c","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:2a1d29cb2a1d3b8ebf758f097c8af61e81e224675331b084462b1fb2c6de68f7","observation_id":"15daff68-3861-4b5a-b1b7-2f315acb3bf6","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Midnight Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:ce90694775fb032a31848f93ce219d9665dcbb1d0d16e0e23d68aa25dc544c2c","observation_id":"7592a342-a001-41af-af50-a59d38e6b084","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"The prompt is given to Qwen3-30B- thinking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:b7414d67d4a1bac69df08cb722f4f7889e4c3cbe9d2db2abc51a5279cc73a823","observation_id":"f6d4f55e-9e9f-4b67-a6b7-6c6361ab71ef","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:a12727e78a7f8400d59ececbf6e6db818659aed1357149bab03c0ef64ebee8ec","observation_id":"b9a1b7ce-67db-4720-981b-210afc0d175c","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"(b) The Hops can be part of the same narrative You can compare the pros and cons and pro- vide your final justification and answer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:a647b35c0dd0aae6c79220d8f90153134c05365de32b059425b1af7d66883fbf","observation_id":"413be20a-b86b-4209-bafe-af2cc4595cca","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Order the keywords from the easiest to match to a unique scene or video moment to the least easy to match: Ordered Keywords List:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:566f5560407f490882d41da61a66d2dbfe916d109697dbfbbe2dcc6199461da8","observation_id":"3b04d1d0-bc3b-4510-8027-a76cac3677ca","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Group the keywords together","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:4ea76074864ddd0e32d8b92edda9ce6031e5fad169f81281c398218ef1a39949","observation_id":"5afffb4d-e027-459f-ba1d-a4d5ea922d5c","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"This title is later used as a query to the Vide- oRAG","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:b1c664a463422dea987fe1084c10d7cf91a0be77ec285b03f9d592584ade2c91","observation_id":"07603d99-a3ec-45ea-b49c-1747ca2afe7f","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:3d3936fd1633601f5b07e7b89b9068c917e7f55823c340068833b71d1afa9354","observation_id":"111e3347-b510-4847-ba80-57944e03b33d","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Do not over decompose the queries in too specific","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:ea6f5cb97f19d6aafb56dae0cecb9def73b6a5a73f58cbb221620c1e4412374f","observation_id":"f5bf5519-f440-478b-b181-39977e96cc6a","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:ec8337eb73f036378b48198a5bee2221ab71e18359f09d2fe061e2a86d95c44f","observation_id":"15b6553c-5982-4d09-99a6-f3d40caf4933","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:db5f7ebf08d04e7567d5c023663d2bf3fc20a67cbd95796d2836ec0154ee0c07","observation_id":"11a86413-0162-4dbc-83ed-b73e146a9dc0","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"I need to break down the last query into subqueries as the last query is too com- plex)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:1b81d4a1f873c88080ad2c68914ade91f707ac2c0767cd502a7eb9ef82ee8593","observation_id":"c229f798-eac6-4fbe-a34c-10ef330b421d","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"the answer to the last query is satisfying and we can move on to the next query or we decide to move on after too many un- successful attempts to answer the last query)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:7cd64bd977a5da2d358f4eb63451839450c8a0bf19a50f2db7e5ff5058dbfce6","observation_id":"85972a99-3738-46c3-9015-e4e92bdbfedd","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:fa89de36de72843c9ffd56f0058ecd3d24263033b4adfd337e07cdf52fe80ef5","observation_id":"47e3b566-6d3e-4f8c-a720-2a048262f3da","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Do not make up any new informa- tion not already present within the ques- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:4c7bab437f2ac91ecb35a3d45eb85db2d5449cc7b501d904e1beec1c354e32c3","observation_id":"dac2b819-9626-4fec-91e5-1c04629c98b8","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:ed5b0c704b74ed2675a52e6b20255bbe6dc08efcca2cf5d79e4b2179443041a6","observation_id":"2afcff70-10f7-4d1e-83eb-af5c3654aefb","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:48.103490Z","title":"Answer in the following way: Justification:","venue":null,"work_id":null,"year":1924},"citing_paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:48.103490Z"},"links":{"citing_paper":"/paper/2606.03301"},"observation_digest":"sha256:61ce5e3525f68fa46b8e9db60a8ff03cb12181cc30c16748984e82f3e60a2525","observation_id":"af9d1c68-9fe5-43c6-9aea-a125e2e872ea","resolution":{"observed_at":"2026-06-28T10:14:48.103490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.03301","last_updated":"2026-06-02T08:14:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-31T12:31:45.258722Z","submitted_at":"2026-06-02T08:14:01Z","title":"SagaQA: A Multi-hop Reasoning Benchmark for Long-form Narrative Understanding in TV Series"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":33,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2606.03301."}