{"as_of":"2026-08-16T16:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27dd95c44a007a54440f40c6d64f2a922283e12a5d3e1bd6b7d040227a96d891","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:24:11.284215Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19125/citation-record","integrity":"/paper/2505.19125/integrity","json":"/paper/2505.19125/citation-record.json","paper":"/paper/2505.19125"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.648928Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:06.648928Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:8c410189b64b49f2596fac84896658fc109f3589cf0565804cd406c89c4e944a","observation_id":"f354cb3c-3e3f-4a0b-ba81-053c2b4377bc","resolution":{"observed_at":"2026-08-07T14:24:06.648928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.715934Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:06.715934Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:54c68f9a915665e5d8d53306e57c8689ba9c153fbd7cc4057e05b95cbc7067e9","observation_id":"7e10ed64-a8dc-4094-9dd8-09feba5b392a","resolution":{"observed_at":"2026-08-07T14:24:06.715934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:24:06.799559Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:06.799559Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:c5cc5a96f551e646ab764f53c5712e53ca7f8a1044913a492a966de9bf61c74a","observation_id":"6eb5bd4d-662f-429b-a2e4-35317c9c4fcf","resolution":{"observed_at":"2026-08-07T14:24:06.799559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.748980Z","title":null,"venue":null,"work_id":"b5136d67-5d22-4910-859f-f2cebc0c602f","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:06.908520Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:33f3d3164f6bba387d4559fefdc73377bd767257b665206702fed6436ca2d5b9","observation_id":"c7c5ed6c-da5e-4dfc-93a9-ce1c2b5e8e0d","resolution":{"observed_at":"2026-08-07T14:24:14.864933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T14:24:06.998767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:06.998767Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:281a0405f66d2cdcd991209e6948e2b8b7ab01f749647982b9c216536730f66e","observation_id":"41713be4-a540-44bb-a213-342ba97b5e0a","resolution":{"observed_at":"2026-08-07T14:24:06.998767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:24:07.055036Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.055036Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:9e53f00e2f6fe5c930062aa059f25097e40aa245b1e2f7ab0d56a3bc6498a8fe","observation_id":"e5b6d6f0-9465-4211-b3be-7027337459b4","resolution":{"observed_at":"2026-08-07T14:24:07.055036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.564890Z","title":null,"venue":null,"work_id":"4aad046b-f7fc-4c4d-8e80-77c8c8d12264","year":2021},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.116452Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:f55e743c357481e45bc6b98896ff117186487f8b49623e6a4fc5ae46354d900a","observation_id":"a5ee71f1-1723-45ef-aa53-609948a08879","resolution":{"observed_at":"2026-08-07T14:24:14.646200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10818","last_updated":"2024-10-15T17:55:46Z","snapshot_observed_at":"2026-08-16T13:09:28.872428Z","submitted_at":"2024-10-14T17:59:58Z","title":"TemporalBench: Benchmarking Fine-grained Temporal Understanding for Multimodal Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10818","snapshot_observed_at":"2026-08-07T14:24:07.209929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.209929Z"},"links":{"cited_paper":"/paper/2410.10818","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:a343793b510b76ea7b87b5bf17f9a359b228cccf18aad6fd656fbf194db98906","observation_id":"a6bc6d7e-b309-427f-aa28-fe817f779cc3","resolution":{"observed_at":"2026-08-07T14:24:07.209929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.281007Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.281007Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:575e48e227a8ce5ef85d786a4a7b31d94b91760d07ef81e946da19d2414cd599","observation_id":"f1840094-9d8c-4965-9153-2158a31c6f7f","resolution":{"observed_at":"2026-08-07T14:24:07.281007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.384169Z","title":null,"venue":null,"work_id":"38dc6f6e-cc5e-495a-8f02-549bea35c3e5","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.339065Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:787b65569063962c23fe9458ee5ba1b3f50bbb101f305238aabb759e26ac2f5f","observation_id":"cf81589b-3ec4-4b34-9a12-581b7f8a5e24","resolution":{"observed_at":"2026-08-07T14:24:14.452710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:24:07.427201Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.427201Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:e1efcc293a8d54ea77039e7e9ac7a6e26c533c46b2f1a2a65c98b9942d5e032a","observation_id":"b50eab3f-1690-424b-8534-fd578d300fa0","resolution":{"observed_at":"2026-08-07T14:24:07.427201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.214429Z","title":null,"venue":null,"work_id":"d660a629-2f63-4f7a-ad48-5728dbd65edb","year":2022},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.488962Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:2652b2f8b0cccf3f24d7cf67180a04e7b3d6380ee973652f44699b0a848586f3","observation_id":"78d4ce35-38ed-47a6-adf8-fcaa24f9f065","resolution":{"observed_at":"2026-08-07T14:24:14.305138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T14:24:07.591158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.591158Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:f96d0c78c591bb8efc3bce093f3f6560dd434e029f6c764d33e314d50ff378d3","observation_id":"11e79b97-5cb5-44f4-a22d-9a19c506af9f","resolution":{"observed_at":"2026-08-07T14:24:07.591158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.055282Z","title":null,"venue":null,"work_id":"fe5a46b1-963f-464e-af1d-372e812dc46d","year":2021},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.694490Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:fb535d349fcbac7b7abc5487c85678178eea0c5cf377a4bec6eb22b4dd343e73","observation_id":"2657cbe5-f20e-46e2-b6cf-cdda8edf812a","resolution":{"observed_at":"2026-08-07T14:24:14.102384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.773017Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.773017Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:7bde786c4c28da3a6222d70b005c55d9c84942af31158c73ccb283dfceb50bbe","observation_id":"24c7c188-2a97-4bcf-abf4-ee1dc0315e52","resolution":{"observed_at":"2026-08-07T14:24:07.773017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18406","last_updated":"2024-03-27T09:48:23Z","snapshot_observed_at":"2026-08-16T14:05:58.376161Z","submitted_at":"2024-03-27T09:48:23Z","title":"An Image Grid Can Be Worth a Video: Zero-shot Video Question Answering Using a VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18406","snapshot_observed_at":"2026-08-07T14:24:07.878207Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.878207Z"},"links":{"cited_paper":"/paper/2403.18406","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:1aa15dbd706a6de2301138b122cd9a3dba842c98120eddde1e43720ff016f6a9","observation_id":"1697f5ac-2c46-4d4c-be1a-f72ab08548b7","resolution":{"observed_at":"2026-08-07T14:24:07.878207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.955756Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:07.955756Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:30c7cc65a32fd7937568e29772b7b03c19d2bda898b27e46eb010856b208f8ef","observation_id":"a8a29a7a-8a5c-47c0-8029-993578b16b6a","resolution":{"observed_at":"2026-08-07T14:24:07.955756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03428","last_updated":"2022-06-07T16:28:30Z","snapshot_observed_at":"2026-08-13T15:28:34.090569Z","submitted_at":"2022-06-07T16:28:30Z","title":"Revealing Single Frame Bias for Video-and-Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03428","snapshot_observed_at":"2026-08-07T14:24:08.054008Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.054008Z"},"links":{"cited_paper":"/paper/2206.03428","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:5d257cf75f163e8c0f58c26a74c4f8702767fa69f2a293847c58f89690387e92","observation_id":"4e4bce62-752d-4272-ab3f-e477d18fe4a4","resolution":{"observed_at":"2026-08-07T14:24:08.054008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.867771Z","title":null,"venue":null,"work_id":"e7ee7d29-8bcd-4589-9bf0-7b85acf4df4d","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.156221Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:539f1e6bf30ba8221d7c7ba8d5270bc7efe109e97a080ed7491c4aa60e9cc373","observation_id":"c8222395-89ff-4c08-a824-3c7460e93788","resolution":{"observed_at":"2026-08-07T14:24:13.947021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.228181Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.228181Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:9ab4db05fa11ac032fc17f23c7b880dae13e195a43b9891c6b0502eb0cdda0ee","observation_id":"a6f4e835-f286-40f4-b0d0-f4fa2f1c8205","resolution":{"observed_at":"2026-08-07T14:24:08.228181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T14:24:08.311582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.311582Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:35cc7f8cf7f8c05320172a564fd0062b8086ff503a1b7d8e50c84855394afdbc","observation_id":"8de95b1e-1fd5-40ea-b53d-1fe02be8f7fa","resolution":{"observed_at":"2026-08-07T14:24:08.311582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.368803Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.368803Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:9c680b2831621738340cef8591003c5f7628f6947fdf8d62419287fb561712a2","observation_id":"60faf53d-d1a3-4d1e-be89-958a8f09759b","resolution":{"observed_at":"2026-08-07T14:24:08.368803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.657114Z","title":null,"venue":null,"work_id":"89312d0b-4d5c-45c7-8b5d-326eb473d37d","year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.432854Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:36c3733e6d2812278f6768b184ca6a4802f9ad44cc4b362dd791a43e47951a10","observation_id":"9a11c943-b42d-4813-9188-efbc7b0cb30c","resolution":{"observed_at":"2026-08-07T14:24:13.758487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17404","last_updated":"2024-09-21T14:59:07Z","snapshot_observed_at":"2026-08-16T14:39:22.570075Z","submitted_at":"2023-11-29T07:15:34Z","title":"VITATECS: A Diagnostic Dataset for Temporal Concept Understanding of Video-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17404","snapshot_observed_at":"2026-08-07T14:24:08.500461Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.500461Z"},"links":{"cited_paper":"/paper/2311.17404","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:0d737bf5d6bfbc84e9fb06340cf72af6db60801ec97f837f0f51fa562b166279","observation_id":"0db68e14-2a3e-477c-bb32-eed69fd73537","resolution":{"observed_at":"2026-08-07T14:24:08.500461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.513333Z","title":null,"venue":null,"work_id":"4dc2fe55-0ab9-4ed1-a29d-e40b5fdb08ea","year":2025},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.574355Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:e7c3cea124ff8e3dde27c7af976692160a5408162b1b5d739c109053438864fa","observation_id":"2be721c9-b7b7-4b0c-a0da-14d668cb5f33","resolution":{"observed_at":"2026-08-07T14:24:13.572269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-07T14:24:08.657753Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.657753Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:2e5fec9eb522019fb371b0117c58dc235eaae8644b1602d756d441b1325d0ad6","observation_id":"344aeab2-797b-4786-91dc-3f7f198aba8c","resolution":{"observed_at":"2026-08-07T14:24:08.657753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T14:24:08.722879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.722879Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:baf9998c4c2cd0e0605f7bb46881cce382049193a72ad31eb165760f47228792","observation_id":"6735b6aa-40f5-4bd4-887d-bcf2a432cc2e","resolution":{"observed_at":"2026-08-07T14:24:08.722879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.829116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.829116Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:66b9ddb40eb1ba97d0a87c552d383a0d6df86209487fa17dccac849e19927694","observation_id":"e77d3ce6-9655-4edd-a5c5-bea00adc250f","resolution":{"observed_at":"2026-08-07T14:24:08.829116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.909586Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:08.909586Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:172b3ec05e29ca1a32c8cba78b5ebd9a47674b5db625503e872c3a253238a6d9","observation_id":"913c8b84-ff62-4740-b447-225b17c1989d","resolution":{"observed_at":"2026-08-07T14:24:08.909586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.310559Z","title":null,"venue":null,"work_id":"9bf6a274-b7ef-48e8-a2fa-265e684c7e56","year":2022},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.026681Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:fefa2d312e2ebf681cab65e0b4b9a6281a95c539df2fdb01b0ae6da25a9db78f","observation_id":"f60cf0b2-5f45-422d-ad8e-1c44a3aa7522","resolution":{"observed_at":"2026-08-07T14:24:13.386687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.182135Z","title":null,"venue":null,"work_id":"157d84ed-485f-41b4-b52d-4a465bbad4d3","year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.111330Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:774e88918c4b0659ac57684a246d4e0d0b98a2bf9c8b78215561937af67c6188","observation_id":"e82dc4d5-0e13-47b5-9e76-2df04684cd12","resolution":{"observed_at":"2026-08-07T14:24:13.249510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.018560Z","title":null,"venue":null,"work_id":"9f5c9fd2-0dee-4df3-8f5d-89f54aacef32","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.201092Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:78894c55a235fcb26f47c02f2f5b1682f0b84da27dff9f4ac3692edff341a1df","observation_id":"3f686e2a-40f1-4632-8f3a-103ce1080e4a","resolution":{"observed_at":"2026-08-07T14:24:13.073263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.280437Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.280437Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:2b4e981a82b6530037014665894292d2e5d27a91e37f8c6adf90ccd65c0fdfd0","observation_id":"d6a715eb-1583-481a-9628-400d351dbe75","resolution":{"observed_at":"2026-08-07T14:24:09.280437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.835876Z","title":null,"venue":null,"work_id":"585b0605-f7eb-4040-a735-15fda74109c4","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.366935Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:45b6ab04bdd6e21203cb2b696d2a8e8fdf288577695cd0fc86c27a769811ce75","observation_id":"33184fe7-794a-462d-ba08-f9b60ae23875","resolution":{"observed_at":"2026-08-07T14:24:12.918895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.578985Z","title":null,"venue":null,"work_id":"6dcbb817-db4f-4a1d-bec2-b16b54f0bc43","year":2022},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.469091Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:c24a7a318e8802758587812d6b84650e38e50d6868c2829f31b18bd21b8c02a2","observation_id":"59a05c31-6d1c-4786-92a1-2bda26747288","resolution":{"observed_at":"2026-08-07T14:24:12.703744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.323751Z","title":null,"venue":null,"work_id":"0baa115d-5542-4ea5-bb5d-3738283ed474","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.546938Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:1dbb32edd06007c5c011c2821477deb459b2a6634e650984134d8a559a3e66dc","observation_id":"3e3f55de-0015-48be-9257-c7ba675f4bb4","resolution":{"observed_at":"2026-08-07T14:24:12.442125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.132497Z","title":null,"venue":null,"work_id":"fb8345ef-72ac-47f8-8720-82f4987d6f2f","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.640056Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:e9fda33bd6e021bacaccf291b610f70aff48e6bc6fd47caf6411ebccc526ecb1","observation_id":"99a19a75-c8d1-4022-b9ed-9312b2e43aa1","resolution":{"observed_at":"2026-08-07T14:24:12.189913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.714410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.714410Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:82dc44555c9f7106856343ca7ea3bbc591e55fed225af91d4e06d2c812c439ce","observation_id":"cdd029d8-7f75-4aab-afe1-61a14eeb69e2","resolution":{"observed_at":"2026-08-07T14:24:09.714410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.811424Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.811424Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:3f417d94d81bd504ea76b036f1e604c9bb237dbefefc4c736a2c98c26489c546","observation_id":"16107e49-9a8f-467c-a791-1968499f2f75","resolution":{"observed_at":"2026-08-07T14:24:09.811424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.926277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:09.926277Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:e1f7f7919f305faf1b2834b936e8ce638b30c92ac0d4f7551a85ada4b177b581","observation_id":"9a398bc2-9f2c-4da6-a54b-51f167c75a6d","resolution":{"observed_at":"2026-08-07T14:24:09.926277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16355","last_updated":"2023-05-25T04:16:07Z","snapshot_observed_at":"2026-08-14T10:09:12.476133Z","submitted_at":"2023-05-25T04:16:07Z","title":"PandaGPT: One Model To Instruction-Follow Them All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16355","snapshot_observed_at":"2026-08-07T14:24:10.039871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.039871Z"},"links":{"cited_paper":"/paper/2305.16355","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:3e2608cb1961714a841039a1784eb79e0a8594f666620952e984ecd7dfd25961","observation_id":"be354a3f-2d47-48f4-8a0b-43211a550dc5","resolution":{"observed_at":"2026-08-07T14:24:10.039871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T14:24:10.149228Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.149228Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:32dcda97cea5715d6510be6ea86e27c1fd6f7a9439812031c50d142c79ea217b","observation_id":"47126011-4768-40de-ad29-108e1b073775","resolution":{"observed_at":"2026-08-07T14:24:10.149228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.889412Z","title":null,"venue":null,"work_id":"900a5edb-62d2-46ef-9abd-090233996e6a","year":2019},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.258834Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:87733d7a0d69c2c4f7cc08bd93639aadfb82392d1098b24e8956acb406bfabf0","observation_id":"bb2540d8-3eb0-4e3b-ba11-8dc51933243c","resolution":{"observed_at":"2026-08-07T14:24:11.997462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15377","last_updated":"2024-08-14T14:31:50Z","snapshot_observed_at":"2026-08-16T14:07:15.383552Z","submitted_at":"2024-03-22T17:57:42Z","title":"InternVideo2: Scaling Foundation Models for Multimodal Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15377","snapshot_observed_at":"2026-08-07T14:24:10.374002Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.374002Z"},"links":{"cited_paper":"/paper/2403.15377","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:99d1dff51da02782fc82a010ecf61078aae34970e19b25183f9ab57e44c54e0c","observation_id":"fbc88a1a-335d-41cc-9183-f0aab1822dcd","resolution":{"observed_at":"2026-08-07T14:24:10.374002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-15T10:03:23.497428Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T14:24:10.493646Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.493646Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:cb9b58c378ce540358a4499dfee739ca3ef38c35abbc4d50fdada9f26fb0211e","observation_id":"f59323ca-8c38-46d4-bc83-0f10cb838b56","resolution":{"observed_at":"2026-08-07T14:24:10.493646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07798","last_updated":"2024-06-10T13:55:21Z","snapshot_observed_at":"2026-08-16T13:53:09.169390Z","submitted_at":"2024-05-13T14:42:13Z","title":"FreeVA: Offline MLLM as Training-Free Video Assistant","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07798","snapshot_observed_at":"2026-08-07T14:24:10.632113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.632113Z"},"links":{"cited_paper":"/paper/2405.07798","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:0d559cff8ea8fe3cc03d1cace48e293d94745542bb0760a5b668473410f75960","observation_id":"24df6144-50da-4065-a92f-4d77e9c50331","resolution":{"observed_at":"2026-08-07T14:24:10.632113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.773373Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.773373Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:fc35ef948d3f4375a6ce94e5bc30f62cc26b73cce784511f54fdcfe291d079e1","observation_id":"ab647581-e470-45f4-a86b-65d1f634fc29","resolution":{"observed_at":"2026-08-07T14:24:10.773373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.907305Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:10.907305Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:37c3037a4b5c6d1f4ab7c054345d305bc612dea2f9316d3dd09f1660d7a900a6","observation_id":"9a9e48e6-e6bb-484d-9ab8-4890de5c12e6","resolution":{"observed_at":"2026-08-07T14:24:10.907305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-08-13T15:50:38.254753Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-07T14:24:11.049431Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:11.049431Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:f3424990d0e66b21d718f0144632a1c3fc7dd18e34de703bb768461436fdb94c","observation_id":"396b0b2f-608d-46ee-886a-af09f0fbe805","resolution":{"observed_at":"2026-08-07T14:24:11.049431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.628794Z","title":null,"venue":null,"work_id":"3a4badfd-7d83-4c09-91d6-62a214bc8a1e","year":2024},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:11.166737Z"},"links":{"citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:9fe1c4f5773b6b5c5b3a642b0f3e4da0c8fc889226fe347a7abd01bd9039153b","observation_id":"72997c4a-c47b-4dd1-b2d0-7fa816d43797","resolution":{"observed_at":"2026-08-07T14:24:11.730513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T14:24:11.284215Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:24:11.284215Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.19125"},"observation_digest":"sha256:319d1c46cb054c8587ce3416930d6aa84ce9918a6a506f799004a7a323276058","observation_id":"3c7a674c-92aa-4228-8d01-9680c8b59c9d","resolution":{"observed_at":"2026-08-07T14:24:11.284215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19125","last_updated":"2025-05-25T12:44:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T18:56:51.896690Z","submitted_at":"2025-05-25T12:44:12Z","title":"RTime-QA: A Benchmark for Atomic Temporal Event Understanding in Large Multi-modal Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.19125."}