{"as_of":"2026-08-10T11:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:da805fb690c56b0a06cd60159b348a19252f184bb50498454584804c8b7ebdf5","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:52:06.520392Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:52:39.441018Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:39:57.778113Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-06T18:52:39.441018Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07105","last_updated":"2025-07-09T17:59:19Z","snapshot_observed_at":"2026-08-09T16:42:39.231594Z","submitted_at":"2025-07-09T17:59:19Z","title":"4KAgent: Agentic Any Image to 4K Super-Resolution","version":1},"reference_index":268,"source":"pdf_text","source_observed_at":"2026-08-06T18:52:39.441018Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2507.07105"},"observation_digest":"sha256:ef9918efda6364010179f2d6a0d6f09765fa3262b8d07ce2a7b88cf5d2e67a0e","observation_id":"3a4df78e-d045-4809-9b5e-907452d9e57a","resolution":{"observed_at":"2026-08-06T18:52:39.441018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-06T12:21:30.770642Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding.arXiv preprint arXiv:2506.01300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-07T08:25:25.968013Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.770642Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:699993887addcbff5dd3f22e217be7702348a57bb9501ee42ddebe8bf7c3108b","observation_id":"ea46245c-9613-4a23-86d7-d7331fac33fa","resolution":{"observed_at":"2026-08-06T12:21:30.770642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-05T12:53:04.377414Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01161","last_updated":"2025-09-01T06:34:53Z","snapshot_observed_at":"2026-08-09T11:10:14.193729Z","submitted_at":"2025-09-01T06:34:53Z","title":"Multi-Modal Machine Learning Framework for Predicting Early Recurrence of Brain Tumors Using MRI and Clinical Biomarkers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T12:53:04.377414Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2509.01161"},"observation_digest":"sha256:8609565b7bb6f2c2e6acd0640e6a1e3e0e9d2a08f2f3795ba82c3f95cc2890c3","observation_id":"495ed2be-70c7-4bb2-9c66-9c8f48b5db12","resolution":{"observed_at":"2026-08-05T12:53:04.377414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-05T12:53:15.065485Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01164","last_updated":"2025-09-01T06:37:20Z","snapshot_observed_at":"2026-08-07T08:25:18.827191Z","submitted_at":"2025-09-01T06:37:20Z","title":"A Multimodal Deep Learning Framework for Early Diagnosis of Liver Cancer via Optimized BiLSTM-AM-VMD Architecture","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T12:53:15.065485Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2509.01164"},"observation_digest":"sha256:4d24ed7f944c97c62363e6f0a7dbfcdfcca68d8841230c31bdd38a0b6d17f6ba","observation_id":"7ff03557-9f3d-4582-b7f2-a9e28202df8a","resolution":{"observed_at":"2026-08-05T12:53:15.065485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2509.14933","last_updated":"2026-05-12T02:57:02Z","snapshot_observed_at":"2026-08-02T04:45:44.136735Z","submitted_at":"2025-09-18T13:14:10Z","title":"DAG: A Dual Correlation Network for Time Series Forecasting with Exogenous Variables","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-18T15:30:20.060374Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2509.14933"},"observation_digest":"sha256:46fc6c89aeb295a6a84fa3721e512eaf1e36669ef521c5241566a5307edb412e","observation_id":"e6b80ed8-feae-4fbf-bb1c-b69d507d9c7f","resolution":{"observed_at":"2026-05-18T15:31:33.406292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2509.23668","last_updated":"2026-05-09T07:30:25Z","snapshot_observed_at":"2026-07-06T22:31:00.843452Z","submitted_at":"2025-09-28T06:13:55Z","title":"Hermes: A Multi-Scale Spatial-Temporal Hypergraph Network for Stock Time Series Forecasting","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-18T12:33:46.039899Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2509.23668"},"observation_digest":"sha256:99d01aef65fb1cc9fe9536ae3918ac993bb2a7aac15f46c2763499bad48b3716","observation_id":"1771a2f9-43da-462e-bac9-3a53fa1657a0","resolution":{"observed_at":"2026-05-18T12:36:22.633218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2604.05076","last_updated":"2026-04-06T18:21:32Z","snapshot_observed_at":"2026-07-06T22:53:55.926521Z","submitted_at":"2026-04-06T18:21:32Z","title":"GLANCE: A Global-Local Coordination Multi-Agent Framework for Music-Grounded Non-Linear Video Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T19:13:30.400059Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2604.05076"},"observation_digest":"sha256:59084b234732132b54c0c2415cac5a3014c4a298208a55867bef252a3aa7a4f4","observation_id":"7bb90a75-89c5-41aa-874e-7cffd7629122","resolution":{"observed_at":"2026-05-10T23:20:51.103089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2604.21444","last_updated":"2026-04-23T09:04:32Z","snapshot_observed_at":"2026-08-06T20:54:24.378597Z","submitted_at":"2026-04-23T09:04:32Z","title":"HiCrew: Hierarchical Reasoning for Long-Form Video Understanding via Question-Aware Multi-Agent Collaboration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T21:55:35.699057Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2604.21444"},"observation_digest":"sha256:8bd41d1b34e79ad0e8b4ef2c699a09ccfea7a921a131a36a569b7a2981d1c9b0","observation_id":"b3921a8d-93da-49c9-9b9f-542e6e097ea7","resolution":{"observed_at":"2026-05-11T14:26:02.242836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2606.24649","last_updated":"2026-06-25T01:22:24Z","snapshot_observed_at":"2026-08-02T19:44:07.766639Z","submitted_at":"2026-06-23T14:44:04Z","title":"Agentic Collaborative Cognition for Zero-Shot 3D Understanding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-26T00:22:06.082183Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2606.24649"},"observation_digest":"sha256:7e5c6ab9d4731fc1088099d06bfde08a770afa8a6aaefa4cd250983021e43ad5","observation_id":"67121b98-4b0d-41c1-99b7-5b3181bee725","resolution":{"observed_at":"2026-07-04T16:39:57.779695Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2606.24649","last_updated":"2026-06-25T01:22:24Z","snapshot_observed_at":"2026-08-02T19:44:07.766639Z","submitted_at":"2026-06-23T14:44:04Z","title":"Agentic Collaborative Cognition for Zero-Shot 3D Understanding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-26T05:37:41.407624Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2606.24649"},"observation_digest":"sha256:81cc575045c5b76d4f2e2a225db9e1a662cbde1d62684334814b20295d8106b9","observation_id":"70a1566f-46d7-4825-b7de-c0e186576dab","resolution":{"observed_at":"2026-07-04T12:59:52.640164Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2606.28938","last_updated":"2026-06-27T14:20:26Z","snapshot_observed_at":"2026-07-07T00:02:57.622708Z","submitted_at":"2026-06-27T14:20:26Z","title":"EVLA: An Electro-Aware Multimodal Assistant for Physically-Grounded Driving Reasoning and Control","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-30T09:57:12.402737Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2606.28938"},"observation_digest":"sha256:83934b76c62c90bbf2cf59c76369d643e657b884292e53d601fe6ce26ea2a607","observation_id":"73db7383-415f-4ca2-9be8-7d65c81c02a8","resolution":{"observed_at":"2026-06-30T10:04:36.295073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2606.28943","last_updated":"2026-06-27T14:30:43Z","snapshot_observed_at":"2026-07-31T16:02:13.460407Z","submitted_at":"2026-06-27T14:30:43Z","title":"A3M: Adaptive, Adversarial and Multi-Objective Learning for Strategic Bidding in Repeated Auctions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T09:54:05.683478Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2606.28943"},"observation_digest":"sha256:2e74694a85afcb91cc4d43fc8617491489c6f5c7f8002bbb98f67c30a96f4bd8","observation_id":"105f4180-394b-4e53-990c-2e7c1b0159e6","resolution":{"observed_at":"2026-06-30T09:54:34.421694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":"2506.01300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-04T16:39:57.778113Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding","venue":null,"work_id":"33e29e9c-dbd8-4c25-b6e6-177561281b8f","year":2025},"citing_paper":{"arxiv_id":"2607.01581","last_updated":"2026-07-02T01:26:09Z","snapshot_observed_at":"2026-07-07T00:07:08.919017Z","submitted_at":"2026-07-02T01:26:09Z","title":"Beyond Skepticism: Evaluating LLMs Pedagogical Intent Reasoning with the Adaptive Pedagogical Vigilance Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T15:26:40.974564Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2607.01581"},"observation_digest":"sha256:b713f6619a293ec8ef03b973f67f5b316cf8d2a7da4c24f10150c322edacd3f9","observation_id":"2bad20b2-32ca-4641-8968-6c61e4ae1166","resolution":{"observed_at":"2026-07-03T15:28:33.596585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-07-14T17:36:18.728469Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding.arXiv preprint arXiv:2506.01300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09695","last_updated":"2026-06-20T04:02:49Z","snapshot_observed_at":"2026-08-08T18:20:26.208499Z","submitted_at":"2026-06-20T04:02:49Z","title":"FedCausal-Dyn: A Causal-Dynamic Paradigm for Federated Learning under Dynamic Feature Drift","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T17:36:18.728469Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2607.09695"},"observation_digest":"sha256:5ae3bb940727582720dae39f2931412cbad4083cd1808a332cca0b88727cfa12","observation_id":"98e38a82-915f-4527-a8f8-5882a6c71685","resolution":{"observed_at":"2026-07-14T17:36:18.728469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-01T13:14:48.090658Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22715","last_updated":"2026-07-21T15:29:39Z","snapshot_observed_at":"2026-08-09T07:34:13.128921Z","submitted_at":"2026-07-21T15:29:39Z","title":"Child-Oriented AIGC Video Risk Reviewing: A Benchmark and Knowledge-Supported Iterative Reasoning Framework","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T13:14:48.090658Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2607.22715"},"observation_digest":"sha256:11dd763be92c90e3f637f4b69275f44194d40f82df7320fc3218125a97ead1e1","observation_id":"94a0d757-191e-49df-9044-6f0de5e6aec7","resolution":{"observed_at":"2026-08-01T13:14:48.090658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01300/citation-record","integrity":"/paper/2506.01300/integrity","json":"/paper/2506.01300/citation-record.json","paper":"/paper/2506.01300"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:57.632772Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:57.632772Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:0881ea97d3d1723f4b8f6eaadb63a2aa0dd5bcddee82aa9246661ed57d8edb27","observation_id":"1be81308-c01c-4042-be40-b5813409f28b","resolution":{"observed_at":"2026-08-07T11:51:57.632772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T11:51:58.310770Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:58.310770Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:40a6bac562dab86a0bddae48c06051707927ec7fd173ef48ae8b56a0921e9371","observation_id":"a0f71f7c-9b15-4464-a25f-8382a351b257","resolution":{"observed_at":"2026-08-07T11:51:58.310770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-07T11:51:59.026187Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding.arXiv preprint arXiv:2308.14508, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:59.026187Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:c6627fe5627aa32a3451b7f14c0d86ccbde393925105e6c8f97637c626915104","observation_id":"102253c2-96a0-417c-b972-7db43a0eb69c","resolution":{"observed_at":"2026-08-07T11:51:59.026187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.236952Z","title":"Sharegpt4video: Improving video understanding and generation with better captions.Advances in Neural Information Processing Systems, 37:19472– 19495, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:59.236952Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:d5e3a65ef695509b6c2207acf3200df8e072340e488b1401b5e804c33c27236c","observation_id":"fb54b947-ccfe-448b-aab7-7f1a68fcba3c","resolution":{"observed_at":"2026-08-07T11:51:59.236952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T11:51:59.500410Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling.arXiv preprint arXiv:2412.05271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:59.500410Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:019cc2851bae1f953c10cc3d952c9458db635dd9ff6469c7338c0d13b8454b32","observation_id":"b65b9093-4a76-49dc-8d33-1b46a11cc01e","resolution":{"observed_at":"2026-08-07T11:51:59.500410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.788980Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:59.788980Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e01af071120f3593f249650a2bda9a727ea43b878a1b4c63bccb2b3710858323","observation_id":"4b433ea6-da38-41d7-b39f-4361c179682e","resolution":{"observed_at":"2026-08-07T11:51:59.788980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.848153Z","title":"Supervised learning","venue":null,"work_id":"7bb0d254-a1be-4e69-83ed-bd67c95e2e2e","year":2008},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:00.071530Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:991354512464380bc32b81c10c7137d39ad70324998be8450c8a1ba73c3e66ca","observation_id":"39ca27fe-336c-4bf1-9fee-22ced1e2a5ba","resolution":{"observed_at":"2026-08-07T11:52:09.878162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.765581Z","title":"A long video caption generation algorithm for big video data retrieval.Future Generation Computer Systems, 93:583–595, 2019","venue":null,"work_id":"1775c3f1-549a-49bf-bc89-e482661be419","year":2019},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:00.521486Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:67ab64b377724438abeacc2ac8f7df641b6951b79774a99d55a91193cb68eeef","observation_id":"df18337e-b269-4427-8dc4-c5eb2a5fbe45","resolution":{"observed_at":"2026-08-07T11:52:09.791899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:01.205243Z","title":"Videoagent: A memory-augmented multimodal agent for video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:01.205243Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:91445d56ad473d061193b0b619353b85ddc65c6ae04b1486ac96ecda93a85e25","observation_id":"6a1f81c9-dcca-470c-b5b3-8940cb5b5fc6","resolution":{"observed_at":"2026-08-07T11:52:01.205243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-07T11:52:01.830424Z","title":"Video-r1: Reinforcing video reasoning in mllms.arXiv preprint arXiv:2503.21776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:01.830424Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:acbd0c0f049dd11f91a90ae80029b379b70f55fdfc822da1c1cceee4f7813ea6","observation_id":"c72fa3eb-90b6-481b-a9bb-877c4d8f6149","resolution":{"observed_at":"2026-08-07T11:52:01.830424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T11:52:01.912701Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis.arXiv preprint arXiv:2405.21075, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:01.912701Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:a66dc069fec02162bfb1bc432e0beb6eb8f0dc4dc42680821c814fb95bf477b6","observation_id":"3c70e8a3-ab42-4577-8f51-b5a8019f0ec3","resolution":{"observed_at":"2026-08-07T11:52:01.912701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.632106Z","title":"Visbench: A framework for remote data visualization and analysis","venue":null,"work_id":"180e96e9-946b-4fdc-9f63-cca9713977d6","year":2001},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:01.997840Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:45091ba99ed6a0252d8c3acdb89b4f16d2a9f46e16e7c700b68b98862b06b996","observation_id":"87f08290-4877-431a-9c5c-8291479b2dd4","resolution":{"observed_at":"2026-08-07T11:52:09.687894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13826","last_updated":"2025-01-23T16:51:47Z","snapshot_observed_at":"2026-07-06T20:25:03.950783Z","submitted_at":"2025-01-23T16:51:47Z","title":"Video-MMMU: Evaluating Knowledge Acquisition from Multi-Discipline Professional Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13826","snapshot_observed_at":"2026-08-07T11:52:02.095752Z","title":"Video-mmmu: Evaluating knowledge acquisition from multi-discipline professional videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.095752Z"},"links":{"cited_paper":"/paper/2501.13826","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:addef6ffa71fdf1c51537190de445bce0a5eccf844c7c95c8f757b7dd49edcc5","observation_id":"69b421ce-8c08-4917-abe0-bdfc3944b2de","resolution":{"observed_at":"2026-08-07T11:52:02.095752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:52:02.191523Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.191523Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:b346e4075b7f5eb658841fb794b940c857631df7e032cae77810ff2a5c2ed3bd","observation_id":"81e2ba49-0023-467d-b944-61d8f8bb5ca1","resolution":{"observed_at":"2026-08-07T11:52:02.191523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09590","last_updated":"2025-03-13T17:14:31Z","snapshot_observed_at":"2026-08-07T17:09:25.628961Z","submitted_at":"2025-03-12T17:57:32Z","title":"BIMBA: Selective-Scan Compression for Long-Range Video Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09590","snapshot_observed_at":"2026-08-07T11:52:02.288427Z","title":"Bimba: Selective-scan compression for long-range video question answering.arXiv preprint arXiv:2503.09590, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.288427Z"},"links":{"cited_paper":"/paper/2503.09590","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:1dba6a2c1f0866713355d0626b907466d3e5e9e3fa0b6e6c14e2a01c9c72cfb9","observation_id":"eaa67c7e-0c46-4022-aae0-986774e0a664","resolution":{"observed_at":"2026-08-07T11:52:02.288427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05874","last_updated":"2025-05-28T18:14:55Z","snapshot_observed_at":"2026-08-06T20:37:11.586885Z","submitted_at":"2025-01-10T11:17:15Z","title":"VideoRAG: Retrieval-Augmented Generation over Video Corpus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05874","snapshot_observed_at":"2026-08-07T11:52:02.359068Z","title":"Videorag: Retrieval- augmented generation over video corpus.arXiv preprint arXiv:2501.05874, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.359068Z"},"links":{"cited_paper":"/paper/2501.05874","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:60736dc51fb725082dd6dcf9a571a9ad93e1afa5f74af95ed419642301b8f706","observation_id":"d46fa311-2b27-4b04-a6ab-e182a8e94d36","resolution":{"observed_at":"2026-08-07T11:52:02.359068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.568466Z","title":"New generation deep learning for video object detection: A survey.IEEE Transactions on Neural Networks and Learning Systems, 33(8):3195–3215, 2021","venue":null,"work_id":"c25f82e8-2e51-467a-8df3-7e767b581bd1","year":2021},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.435864Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:af66341cec792e723c7dc1bc2af49a826e3a8e5303fefd9778a2aaf0cbd404e4","observation_id":"36d9ab6b-be07-4308-a478-66bfb3688a3a","resolution":{"observed_at":"2026-08-07T11:52:09.593435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.510242Z","title":"A survey of frontiers in llm reasoning: Inference scaling, learning to reason, and agentic systems.arXiv preprint arXiv:2504.09037, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.510242Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:8d3027019a9ac3b3889d0ebc3223057b1ead62b69ca2d3a35007d498f563e6d5","observation_id":"a3e5b1a5-cb95-48c0-a050-f451effb1163","resolution":{"observed_at":"2026-08-07T11:52:02.510242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18358","last_updated":"2024-05-28T16:55:41Z","snapshot_observed_at":"2026-08-03T17:33:50.716704Z","submitted_at":"2024-05-28T16:55:41Z","title":"MMCTAgent: Multi-modal Critical Thinking Agent Framework for Complex Visual Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18358","snapshot_observed_at":"2026-08-07T11:52:02.616703Z","title":"Mmctagent: Multi-modal crit- ical thinking agent framework for complex visual reasoning.arXiv preprint arXiv:2405.18358, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.616703Z"},"links":{"cited_paper":"/paper/2405.18358","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:ce7db3a63244d1ba12846290e239840977592bfbe706d7fa1128c48be9e90c41","observation_id":"a34bbc0b-9c8c-4d91-afb5-192bdfcb2f23","resolution":{"observed_at":"2026-08-07T11:52:02.616703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15807","last_updated":"2025-03-20T02:50:57Z","snapshot_observed_at":"2026-08-07T16:50:14.724220Z","submitted_at":"2025-03-20T02:50:57Z","title":"Video-VoT-R1: An efficient video inference model integrating image packing and AoE architecture","version":1},"cited_work":{"arxiv_id":"2503.15807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.15807","snapshot_observed_at":"2026-08-07T11:52:07.079711Z","title":"Video-VoT-R1: An efficient video inference model integrating image packing and AoE architecture","venue":"cs.AI","work_id":"725d1f54-8088-4d3a-9faf-34f9dd1eed26","year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.710479Z"},"links":{"cited_paper":"/paper/2503.15807","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:f544adbb2cdc2906533a4fb71622a68b31cb096e606fb1b9cad909d36160f41b","observation_id":"bb3419ea-c525-44aa-a585-17c074f8fe92","resolution":{"observed_at":"2026-08-07T11:52:07.114887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T11:52:02.781775Z","title":"Videochat: Chat-centric video understanding.arXiv preprint arXiv:2305.06355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.781775Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:10c6b8ae9656bcabfde5b7f8c8d6d31bb4cb1359c59340ceac54db36ed2848b7","observation_id":"096c6815-5245-45ce-baca-b8e6e4d6cf63","resolution":{"observed_at":"2026-08-07T11:52:02.781775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.885116Z","title":"Mvbench: A comprehensive multi-modal video understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.885116Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:80ec0363a143a57002474696e6eb6da890ce8239d52a4611c3ef1286b7bb8f6e","observation_id":"55ee274d-81e6-4e95-a5d6-69c51ded5163","resolution":{"observed_at":"2026-08-07T11:52:02.885116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.486776Z","title":"Evaluating real-world robot manipulation policies in simulation","venue":null,"work_id":"84d7bbab-9de9-4c12-bfe9-53eaf4c9c7ae","year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:02.975337Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:2a1de65ef1df23ff5a89d87699b71f1ad3d5ed227be3b61054f50e43d3dc1421","observation_id":"cd6432c5-199f-41a0-9fae-5001b5a82a24","resolution":{"observed_at":"2026-08-07T11:52:09.515158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-07T11:52:03.037638Z","title":"Video-llava: Learning united visual representation by alignment before projection.arXiv preprint arXiv:2311.10122, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.037638Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:793763a8bab01ede15810f06ed4dec1c22df3704b30df252908afd17665177f3","observation_id":"5250ca97-04eb-43ec-904f-4ead60e8f0b5","resolution":{"observed_at":"2026-08-07T11:52:03.037638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15542","last_updated":"2024-08-28T05:34:14Z","snapshot_observed_at":"2026-07-06T19:06:54.428910Z","submitted_at":"2024-08-28T05:34:14Z","title":"Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15542","snapshot_observed_at":"2026-08-07T11:52:03.120334Z","title":"Kangaroo: A powerful video-language model supporting long-context video input.arXiv preprint arXiv:2408.15542, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.120334Z"},"links":{"cited_paper":"/paper/2408.15542","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:94ea7d58f80ea6a0ab74607e2287ef69fb099ab2b458104d658a6325b7bfb670","observation_id":"82c0dd4b-7efa-417e-8b24-09987e4f0f69","resolution":{"observed_at":"2026-08-07T11:52:03.120334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.155199Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.155199Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:fc4cd9c47e77bf3527c6162febc16c06244caf28cd0738f62e7bf23b072737a7","observation_id":"f1ce3282-74b9-42a5-b4c9-2734a3a1c058","resolution":{"observed_at":"2026-08-07T11:52:03.155199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00476","last_updated":"2024-06-03T04:13:39Z","snapshot_observed_at":"2026-08-04T21:17:37.211833Z","submitted_at":"2024-03-01T12:02:19Z","title":"TempCompass: Do Video LLMs Really Understand Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00476","snapshot_observed_at":"2026-08-07T11:52:03.280995Z","title":"Tempcompass: Do video llms really understand videos?arXiv preprint arXiv:2403.00476, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.280995Z"},"links":{"cited_paper":"/paper/2403.00476","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e66ae6be3f81869b271003095459a8315fa2502858271b99738d8b99ac2b23ae","observation_id":"b29f277b-80b9-4b11-910f-aad6dfaa8894","resolution":{"observed_at":"2026-08-07T11:52:03.280995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.403830Z","title":"Inference-time scaling for generalist reward modeling.arXiv preprint arXiv:2504.02495, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.403830Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:90ea5017e148d3a3394ad509920eb22993710c16ae49de7dd5f6718dc57c003b","observation_id":"c4c20478-b9f1-41a2-ba72-350cd53df1a5","resolution":{"observed_at":"2026-08-07T11:52:03.403830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.385220Z","title":"A real- time object detection algorithm for video.Computers & Electrical Engineering, 77:398–408, 2019","venue":null,"work_id":"3cc7895a-819e-43d9-bef3-b32b0b27bb5c","year":2019},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.501662Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:b64c690bdf7054aab101ccf039474db4d78541ef29673515bd8e7ec8d7d0c14d","observation_id":"3c1b2c95-f32a-47b8-95cd-374e42339c39","resolution":{"observed_at":"2026-08-07T11:52:09.431241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.589894Z","title":"Video-rag: Visually-aligned retrieval-augmented long video comprehension.arXiv preprint arXiv:2411.13093, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.589894Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:2f7ea599b502bfc7c98df75effaa1a245d167be4c4b08d6d52b49fa8beb3c79e","observation_id":"4cd63c2f-cde4-4503-afa9-3c2302e4b9e3","resolution":{"observed_at":"2026-08-07T11:52:03.589894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.678829Z","title":"Egoschema: A diagnostic benchmark for very long-form video language understanding.Advances in Neural Information Processing Systems, 36:46212–46244, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.678829Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:a79a360609fe30fa4e33e73b86c78958a17005b703b2b215c1f4d190cdc022b9","observation_id":"36ba2adb-1ec1-4c2a-9c3b-025e15b9efbb","resolution":{"observed_at":"2026-08-07T11:52:03.678829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.260112Z","title":"Optical character recognition.International journal of recent technology and engineering (IJRTE), 2(1):72–75, 2013","venue":null,"work_id":"a06a2e2b-c194-4b2c-bdae-253745890cdf","year":2013},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.791377Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:6f55d14564719dcc544a96e0e7a62623aaa5980ae205e4fe10204b10add6a70b","observation_id":"f2f78580-1bad-4ff0-b88a-2871da22b966","resolution":{"observed_at":"2026-08-07T11:52:09.302660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.906958Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:03.906958Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:2f46b613ebb4d55e03b49bc64a0dcbfdb3fd57107f511818edda0e30271ad098","observation_id":"9589d168-a2a1-46b3-b59d-a0d5b52b5068","resolution":{"observed_at":"2026-08-07T11:52:03.906958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T11:52:04.012050Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.012050Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:127796091cd5ec78d71d2a1033367c6fbf47b8526309b3d1d6fb6276125d8c1d","observation_id":"2e517384-bf4b-4127-930a-623522809703","resolution":{"observed_at":"2026-08-07T11:52:04.012050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.092255Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36:8634–8652, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.092255Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:4b6359cc6659157ce0eb3533971fa2d7f145d7947cffcb61111792d98431e1c2","observation_id":"7d5c8bf3-a6c2-4477-8364-6639b3871b1a","resolution":{"observed_at":"2026-08-07T11:52:04.092255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.111678Z","title":"Clip4caption: Clip for video caption","venue":null,"work_id":"228c5a2a-1883-4480-bfc3-46be4c6ff833","year":2021},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.203180Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:3e5b36f670456e9ed67c112bd51a174889b2c02ee945e1a635bb68dbee7b6187","observation_id":"8a5c5170-2b8f-4c5f-ad9d-c6bff655e472","resolution":{"observed_at":"2026-08-07T11:52:09.161153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T11:52:04.282750Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.arXiv preprint arXiv:2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.282750Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:fc6ec7c029d11b3f3b29de7f5736e3ab434dbfa1af98b668942175b683d30053","observation_id":"b492a32e-b99c-42d9-b9d9-f75137683fc1","resolution":{"observed_at":"2026-08-07T11:52:04.282750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T11:52:04.407610Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.407610Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:4e38abd7dd432720a5d3c099fe8918e09db537b52cb753a52d13c1ef46e33602","observation_id":"6c873815-9fe0-4a56-9899-af6e692d1f15","resolution":{"observed_at":"2026-08-07T11:52:04.407610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08035","last_updated":"2025-08-09T10:54:59Z","snapshot_observed_at":"2026-08-08T19:38:26.415599Z","submitted_at":"2024-06-12T09:36:52Z","title":"LVBench: An Extreme Long Video Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08035","snapshot_observed_at":"2026-08-07T11:52:04.486784Z","title":"Lvbench: An extreme long video understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.486784Z"},"links":{"cited_paper":"/paper/2406.08035","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:12a240fdd18c6dd5ec25869a15c6375a3e01b3289f1f7da7ec38cf72f7ab7919","observation_id":"694b2ea1-a581-4bfd-9043-d45c68d63642","resolution":{"observed_at":"2026-08-07T11:52:04.486784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.606785Z","title":"Videoagent: Long-form video understanding with large language model as agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.606785Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:cfca39d3203588ee8f6042486a2b935cac1049205456a153aa71a918446f837c","observation_id":"4f7ade44-8bbf-4824-abaa-b9180d64e2d9","resolution":{"observed_at":"2026-08-07T11:52:04.606785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.621903Z","title":"Longllava: Scaling multi-modal llms to 1000 images efficiently via a hybrid architecture.arXiv preprint arXiv:2409.02889, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.621903Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:64729a0c8528f4c7f7e7e3d5263f2e46ea1a674c00e1b11e70f3fb8812aa4fb3","observation_id":"b0cfdf22-0f13-436f-a2cb-c0ff9ef1f06c","resolution":{"observed_at":"2026-08-07T11:52:04.621903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07934","last_updated":"2025-05-30T15:53:16Z","snapshot_observed_at":"2026-08-07T16:06:46.096701Z","submitted_at":"2025-04-10T17:49:05Z","title":"SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07934","snapshot_observed_at":"2026-08-07T11:52:04.646937Z","title":"Sota with less: Mcts-guided sample selection for data-efficient visual reasoning self-improvement.arXiv preprint arXiv:2504.07934, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.646937Z"},"links":{"cited_paper":"/paper/2504.07934","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:84b5478abeb0f69b6e945fb0afe50a842ae554d8cf4b477448effbe4e2fcb112","observation_id":"f9d85935-da37-4c4a-a56d-c37c6088d6a0","resolution":{"observed_at":"2026-08-07T11:52:04.646937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:09.029034Z","title":"Reinforcement learning.Adaptation, learning, and optimization, 12(3):729, 2012","venue":null,"work_id":"77687463-f370-4909-a4bf-1e5f77934736","year":2012},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.713331Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:ad323aa083856842f0f2063a3667fb98e1c9104e87b657073b022db22690f96d","observation_id":"b6da2d5e-de29-42e3-966d-b14c05c59e11","resolution":{"observed_at":"2026-08-07T11:52:09.069209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02686","last_updated":"2025-06-12T16:39:09Z","snapshot_observed_at":"2026-08-07T15:56:21.414821Z","submitted_at":"2025-05-05T14:33:49Z","title":"Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02686","snapshot_observed_at":"2026-08-07T11:52:04.806540Z","title":"Sailing ai by the stars: A survey of learning from rewards in post-training and test-time scaling of large language models.arXiv preprint arXiv:2505.02686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.806540Z"},"links":{"cited_paper":"/paper/2505.02686","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:6d663f56f3fb4b4f59e689bfdd5e089ce74b7db40bf461745e0f1157186fc640","observation_id":"af4c72b2-bc22-40cc-85b2-9cb08932bbd9","resolution":{"observed_at":"2026-08-07T11:52:04.806540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.896434Z","title":"Next-qa: Next phase of question- answering to explaining temporal actions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.896434Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:0b402017f3f3b6baae0c7c4435290f312442de143cf89831fc58493de2e85a68","observation_id":"b4ec8324-c20b-496c-b5d9-2db4aa971f94","resolution":{"observed_at":"2026-08-07T11:52:04.896434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T11:52:04.983800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:04.983800Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:3f420cfd59aa591953975dda19082e13957f470fc32b0f97b1abab6724417148","observation_id":"a764790d-75e9-40b8-92e1-412508e6e4e9","resolution":{"observed_at":"2026-08-07T11:52:04.983800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.855710Z","title":"Vid2seq: Large-scale pretraining of a visual language model for dense video captioning","venue":null,"work_id":"7b5eba48-b4c4-48e6-bc6b-e66651daba9c","year":2023},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.081211Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:c841892c063d39a7b5bbbb4724988988c7d689f4269a0619cf7df2aae5453b1b","observation_id":"90e8c85e-ca08-4738-bf48-0c7e041833a7","resolution":{"observed_at":"2026-08-07T11:52:08.930996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10471","last_updated":"2025-03-10T03:35:16Z","snapshot_observed_at":"2026-07-06T20:06:48.183096Z","submitted_at":"2024-12-12T23:39:54Z","title":"VCA: Video Curious Agent for Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10471","snapshot_observed_at":"2026-08-07T11:52:05.146191Z","title":"Vca: Video curious agent for long video understanding.arXiv preprint arXiv:2412.10471, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.146191Z"},"links":{"cited_paper":"/paper/2412.10471","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:3432a03a79f9fe8b2f991dbf4c23ad6bdb422246e01388dd2c0d4bc9b808e178","observation_id":"1e00a398-26eb-43cb-8fe3-3094f39cb71d","resolution":{"observed_at":"2026-08-07T11:52:05.146191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02259","last_updated":"2025-08-25T02:57:46Z","snapshot_observed_at":"2026-08-07T18:21:41.515675Z","submitted_at":"2025-04-03T04:03:10Z","title":"T*: Re-thinking Temporal Search for Long-Form Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02259","snapshot_observed_at":"2026-08-07T11:52:05.217519Z","title":"Re-thinking temporal search for long-form video understanding.arXiv preprint arXiv:2504.02259, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.217519Z"},"links":{"cited_paper":"/paper/2504.02259","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:8bf4c55a7721dfd604aa694c5acf3e9f6045d83d105aac3a513c06f8b1c210cf","observation_id":"4fec2d96-4ea0-4ee6-83dd-722aeaa204ae","resolution":{"observed_at":"2026-08-07T11:52:05.217519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.789517Z","title":"Springer, 2016","venue":null,"work_id":"6d8e7ccb-c4e9-49d0-9a62-c3e2389874d2","year":2016},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.233294Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:7cc03d7efb4f0d2a847c46471a8890f031fd4619ff1c93fc2512af53d00481c9","observation_id":"1d2cc1b7-310b-4135-8c15-ef95429627c8","resolution":{"observed_at":"2026-08-07T11:52:08.810813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.702724Z","title":"Merlot: Multimodal neural script knowledge models.Advances in neural information processing systems, 34:23634–23651, 2021","venue":null,"work_id":"18537e9b-1e62-40ad-8ab9-d156972a1b4d","year":2021},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.243564Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:b58faed0cfffaed389b60ec82d1eb6b212214303e0c41d9e1a2e3bb6670f8052","observation_id":"a656f6a0-36b8-455c-b943-f2498f93a962","resolution":{"observed_at":"2026-08-07T11:52:08.744429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16620","last_updated":"2024-11-12T10:02:12Z","snapshot_observed_at":"2026-08-09T06:58:39.313268Z","submitted_at":"2024-06-24T13:05:39Z","title":"OmAgent: A Multi-modal Agent Framework for Complex Video Understanding with Task Divide-and-Conquer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16620","snapshot_observed_at":"2026-08-07T11:52:05.252358Z","title":"Omagent: A multi-modal agent framework for complex video understanding with task divide-and-conquer.arXiv preprint arXiv:2406.16620, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.252358Z"},"links":{"cited_paper":"/paper/2406.16620","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e27510fb8ca783def9461fe03e67123d36454581a1a36ba9ba2d63668995d6bb","observation_id":"9fb880f2-dc92-4e74-840c-74ba33e7b7f9","resolution":{"observed_at":"2026-08-07T11:52:05.252358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-09T19:59:05.401223Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-07T11:52:05.260604Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization.arXiv preprint arXiv:2402.17574, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.260604Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:17b8ec058cc8d27c75d10b86d035f86c17f48d8cd6057cd8a02ec1467e6f0f0b","observation_id":"1037613c-34e7-4cf4-993a-c89ec1469acc","resolution":{"observed_at":"2026-08-07T11:52:05.260604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09641","last_updated":"2025-04-13T16:32:49Z","snapshot_observed_at":"2026-08-08T07:14:04.916356Z","submitted_at":"2025-04-13T16:32:49Z","title":"TinyLLaVA-Video-R1: Towards Smaller LMMs for Video Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09641","snapshot_observed_at":"2026-08-07T11:52:05.300590Z","title":"Tinyllava-video-r1: Towards smaller lmms for video reasoning.arXiv preprint arXiv:2504.09641, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.300590Z"},"links":{"cited_paper":"/paper/2504.09641","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:784587912e25fd1c24bf08233c7bfa509b610c04af4cc3ecbb5bd20760a55229","observation_id":"4afaad58-44d7-4e64-8e01-b8477d86472e","resolution":{"observed_at":"2026-08-07T11:52:05.300590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:05.389434Z","title":"Llava-next: A strong zero-shot video understanding model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.389434Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:197557676969a31a5c3e9450207d9fa95c9050aa0f23cac1bf720da3b511d2d7","observation_id":"750e3829-9bd7-499d-a53f-33291ba92b22","resolution":{"observed_at":"2026-08-07T11:52:05.389434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-07T11:52:05.475245Z","title":"Video instruction tuning with synthetic data.arXiv preprint arXiv:2410.02713, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.475245Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:97759d24a8d1096ed459aaa42fd14939de0b288278d66d303ce61a5861a1d98e","observation_id":"759fd701-e7b1-4f1a-86f2-762e8626f470","resolution":{"observed_at":"2026-08-07T11:52:05.475245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.621353Z","title":"GRAPE: Generalizing robot policy via preference alignment","venue":null,"work_id":"2505de49-4e74-480d-91e2-9f3b25160af0","year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.542812Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:3bb7b07d4cef5a69b06689c16ad4bb8d28efb8eff7b3dce80f3dedc5efaddd47","observation_id":"7c6129e4-3d2e-4edd-b340-313df9e42b50","resolution":{"observed_at":"2026-08-07T11:52:08.646448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12380","last_updated":"2025-01-21T18:56:18Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:56:18Z","title":"MMVU: Measuring Expert-Level Multi-Discipline Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12380","snapshot_observed_at":"2026-08-07T11:52:05.618855Z","title":"Mmvu: Measuring expert-level multi-discipline video understanding.arXiv preprint arXiv:2501.12380, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.618855Z"},"links":{"cited_paper":"/paper/2501.12380","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:a805d18e19585383c073ed41933a4c6d96bd6a77c648c954ff8a7aab8bff9a12","observation_id":"3ec4580c-f95e-4276-833e-804df956f725","resolution":{"observed_at":"2026-08-07T11:52:05.618855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04264","snapshot_observed_at":"2026-08-07T11:52:05.694478Z","title":"Mlvu: A comprehensive benchmark for multi-task long video understanding.arXiv preprint arXiv:2406.04264, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.694478Z"},"links":{"cited_paper":"/paper/2406.04264","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e51eae71521a929c2af2bc16322ea02ba344b0bfd0821f3450cbbfb279f007b0","observation_id":"e7957743-e946-4247-b3f0-3d91b93f9cdd","resolution":{"observed_at":"2026-08-07T11:52:05.694478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T11:52:05.786594Z","title":"function","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.786594Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:5929326b4c04c7bc05125d219c7c4f04d16342c0ec68ca6f5e1d405e7ed2cbf9","observation_id":"27221795-aa84-426e-8810-dc44697e6c62","resolution":{"observed_at":"2026-08-07T11:52:05.786594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.529904Z","title":null,"venue":null,"work_id":"a6c346ce-a4b6-42b5-9f6e-bd44a4e7e496","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.855492Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e133f39035e6d3e0224168d176229fd4c6c364e6911e930a4b1054ce131f7597","observation_id":"60af8306-df46-48fa-b256-7449baec38fa","resolution":{"observed_at":"2026-08-07T11:52:08.575739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.457394Z","title":null,"venue":null,"work_id":"33d2d512-549a-4640-8c33-cddba0ec9e8c","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.875636Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:e8a3f9ad98c5c6fe4b87d00c7bcef8fa89064340a8c0dbb1649dd0b7172d0bc2","observation_id":"cbf29bb9-eb39-41a8-8929-c98c1dc62353","resolution":{"observed_at":"2026-08-07T11:52:08.484882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.379415Z","title":null,"venue":null,"work_id":"04582b3b-fb92-44cd-81e0-73cb261c360c","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.881469Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:34dbd664214a7f06b15fd18a1bed1649b2e76fde63a4fa2e05ad179bae1ed6f4","observation_id":"2526a2cf-926f-4e6f-91f2-4837c46a85c5","resolution":{"observed_at":"2026-08-07T11:52:08.415386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.313902Z","title":"final_answer","venue":null,"work_id":"a4e6ad18-fe0e-41b3-a1e5-540b6f7c1049","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.889587Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:80d55e20b28bc25e2942b86dec09700162acb211ba080744710b3ef58944423e","observation_id":"4fca7a39-865d-4986-a0e4-ea0c49908c0a","resolution":{"observed_at":"2026-08-07T11:52:08.336877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.250819Z","title":null,"venue":null,"work_id":"ce020920-ca1a-4e40-aa57-dd2666f7809c","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.929450Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:9da48a3acd7b348394e9d31ccab6e764bb92d66803aa064ade4eb7b8e378c90d","observation_id":"e867ee9b-fdb4-4ed4-b918-dd808f59b5e0","resolution":{"observed_at":"2026-08-07T11:52:08.271741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.185564Z","title":null,"venue":null,"work_id":"bbebfe2a-5441-40d1-b4ec-56c41d4503dd","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.028957Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:a17cade3f158d59a8d0ebebd2a158f735a23b6afac491202cae98fd4344422c6","observation_id":"8ba41646-316e-41d8-9685-c1db615163a4","resolution":{"observed_at":"2026-08-07T11:52:08.208571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.113348Z","title":null,"venue":null,"work_id":"ef995524-ec3e-4b8f-af63-c5711efc2034","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.106668Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:06f7419167c3466bec9c537c746520645cdbb7e1a0693c44f33e89d5889743df","observation_id":"6f519e9a-0846-43cc-8fc4-5572ce1cd1bf","resolution":{"observed_at":"2026-08-07T11:52:08.151703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:08.021559Z","title":"final_answer","venue":null,"work_id":"d8f9cf54-7359-4c6a-80f4-86e479a572b2","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.173820Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:a3e616961a85711780f15cd90beb08bc921caf0754eb2e8bb3f73bec7c14629f","observation_id":"7e859022-84ce-4c5c-a1e8-b94fa7b6e6b4","resolution":{"observed_at":"2026-08-07T11:52:08.067744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.941641Z","title":null,"venue":null,"work_id":"86a62a8f-2d45-4419-9f5d-f99aa29b092d","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.240410Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:1d53fd33eeefb208e139b4f992e7e701088791f22e7d42c3f4ca47330d78e9af","observation_id":"20ad729e-21f9-4a82-b3a3-3256ece21e10","resolution":{"observed_at":"2026-08-07T11:52:07.975166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.864807Z","title":null,"venue":null,"work_id":"82752190-aaef-42df-973d-e670767fe4ad","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.309906Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:03355bf18325a72e6d00f2b6797b57588f050a2ccb639f5ece0c15570c235824","observation_id":"da03baae-7c04-4766-9244-e4359eaf489c","resolution":{"observed_at":"2026-08-07T11:52:07.894057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.781707Z","title":null,"venue":null,"work_id":"6a36a599-2567-47d2-946a-04eded9b6611","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.375025Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:2dc812c42f00505d97e66b7a9de7532bb207ba78f601c01355b75b3a86b705fa","observation_id":"0f5f08f1-18c0-40c1-a535-d8c5f4ea15b1","resolution":{"observed_at":"2026-08-07T11:52:07.821986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.673238Z","title":"canine” = “dog","venue":null,"work_id":"bf8aee07-070e-444a-b966-6f9942ca5bff","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.440832Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:91a22420f12cd76bbbe050fad9c07cd30ee65c97a9b8e1ef93002d3374a1ca36","observation_id":"39ceaa36-4aa4-47b5-877e-7ea413dc8402","resolution":{"observed_at":"2026-08-07T11:52:07.725231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.592650Z","title":null,"venue":null,"work_id":"e5c869c1-8d79-4504-b34c-9668df38daa7","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.475059Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:8e89044598611c13053c3c28018b2b1697e65a8b91eaab54c5baedd340a18f14","observation_id":"33859cb0-8896-4928-ac80-402e402f787e","resolution":{"observed_at":"2026-08-07T11:52:07.631729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.494315Z","title":null,"venue":null,"work_id":"7b389de2-1e41-4a17-83ea-f1f1a1cbf1ab","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.487611Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:c7876fc16dbc9b98d92357b210a4f14705e76269d7dece5ac05dacaa1c177950","observation_id":"1d5a6fe0-6ccc-431e-b8cc-84d455415f74","resolution":{"observed_at":"2026-08-07T11:52:07.537346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.408259Z","title":null,"venue":null,"work_id":"dc2a8a62-66be-475c-887a-75023b3dc364","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.507204Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:b136d27e174dcb22ba4745057eef635a13f68eff2cc19a3f673b46afe05112ae","observation_id":"366c6bcd-9312-482f-9bf6-2dc94b70f5e1","resolution":{"observed_at":"2026-08-07T11:52:07.445401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:07.365812Z","title":"What”, “Where","venue":null,"work_id":"6252ebfb-5a02-42ec-adc1-0818b75aa799","year":null},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:06.520392Z"},"links":{"citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:714662c374cedb84b80942186eb59423156684e47f0180cba5654c6f6af66835","observation_id":"70d8f986-230c-46ed-8267-0690b04d910e","resolution":{"observed_at":"2026-08-07T11:52:07.382681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T02:09:49.837338Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 15 inbound Pith citation observations for arXiv:2506.01300."}