{"as_of":"2026-08-14T01:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27a50986a314f2a217fe3970f1bd39638c1ffa06dfea5c9c9e3b25d581922bfd","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:36:57.791208Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10415/citation-record","integrity":"/paper/2506.10415/integrity","json":"/paper/2506.10415/citation-record.json","paper":"/paper/2506.10415"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:55.842851Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.842851Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:a9cca94cc0356042189042a29b3e823169a94d13e7ca76b322589b9c864a027b","observation_id":"31c65fd3-40c8-4b8d-858a-08d5bda3d075","resolution":{"observed_at":"2026-08-07T04:36:55.842851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:55.910445Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.910445Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7f1884f90ae55d1c380bd97c68747194d703c1976f02772fee54280e25ced3ae","observation_id":"b5e898a2-cd89-4029-b420-8c86610052cf","resolution":{"observed_at":"2026-08-07T04:36:55.910445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T04:36:55.968362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.968362Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:d366e4252e75cc099204fdc3e764a74e8d5a5005beb8ee14f0356f86decf5532","observation_id":"90da2a9b-2ad0-4a37-81c4-fcba53e4aa8d","resolution":{"observed_at":"2026-08-07T04:36:55.968362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:36:56.005935Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.005935Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:c571eda3c17a0b574aca71effb37d7a80bdcebc3c3bc74fcd4e76becb7452cff","observation_id":"aa144632-b19d-4ee2-892e-12eaceb40209","resolution":{"observed_at":"2026-08-07T04:36:56.005935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.093486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.093486Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:34615c1aa980c6973abacc6c5b8cc388d9b4be58586464eaa42f3f0d662f6474","observation_id":"d384cc06-f01b-4501-9b84-265165211a64","resolution":{"observed_at":"2026-08-07T04:36:56.093486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.87","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"f5aabdb2-979e-4567-ad9e-7cbb7adef165","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.141937Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:3e097c35e75b5ed65a2231232d2f83f8f7bf75bc1ba3278cfb2537696b51f0eb","observation_id":"26f63b4d-6496-40e8-924d-82df3d97b04a","resolution":{"observed_at":"2026-08-07T04:36:57.849183Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.303173Z","title":null,"venue":null,"work_id":"2a33239c-db47-4869-9736-65b10bf5c56b","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.185800Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7546ae3fe5883a20ce1ca6c2e39255601af102274db43d07d81be6b5860094c4","observation_id":"a4ed913e-e0ba-4396-8743-f4378946d707","resolution":{"observed_at":"2026-08-07T04:36:58.306506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.228030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.228030Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:90c348e406b9e892252157cf6065dccf2eee60282be82c50e90684befcfd7baf","observation_id":"19f9dbbe-8ed9-411c-bb04-0d4f57fc7fb6","resolution":{"observed_at":"2026-08-07T04:36:56.228030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.286373Z","title":null,"venue":null,"work_id":"d6947d30-c294-4524-99ef-cb73a24b2a33","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.267735Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:69c614ce8bac76ddecaccef94baa20e27fb2ba845f0c25ca9067959a925b10bf","observation_id":"fb374256-0dd1-4b4d-a3ca-c07e0744ebe3","resolution":{"observed_at":"2026-08-07T04:36:58.290223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T04:36:56.303597Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.303597Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:ad06b84e06888163142f2a8e19c3f60888a91720c7686bfac761a32cf82e9038","observation_id":"d4690e8f-a6ff-4b89-af78-e6dd86db56b8","resolution":{"observed_at":"2026-08-07T04:36:56.303597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.352974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.352974Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:8cc4ee47b6abe73d04893537c4bd646bde0f9a101a4c3d3aecd8d2dd64af8241","observation_id":"7166f125-6432-4892-9b2b-cf08503f23c5","resolution":{"observed_at":"2026-08-07T04:36:56.352974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T04:36:56.418189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.418189Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:40f7576978ae618bc5dfe88a0b542fff1482a1bc18914933a104db4d8d97b3cc","observation_id":"3d591363-7b61-4c01-b648-91b2e7daa879","resolution":{"observed_at":"2026-08-07T04:36:56.418189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.271490Z","title":null,"venue":null,"work_id":"5eb89b22-7c95-46dc-a5e6-e937e1cdd255","year":2018},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.484181Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:57dbd3861fefbab7b931d99f1329c2d3b1696ac5f28db42e04a7a82abbc8e20e","observation_id":"9a505477-76a1-41a3-bd06-4a82bd59794f","resolution":{"observed_at":"2026-08-07T04:36:58.274288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.262595Z","title":null,"venue":null,"work_id":"947e074a-0b9d-417b-93fe-639c66ca4217","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.552826Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:2b36a7aab086abf984948b59aa80e9e416092c90e9b2c7bd6aed192c749a84a6","observation_id":"f6ca50f9-4f86-4913-9064-40a506cc1344","resolution":{"observed_at":"2026-08-07T04:36:58.265367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.586973Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.586973Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:dd400e7c768c870e6aa3c45f9df03a29975d382948f75ddcbe3df8cc000d94ab","observation_id":"554cc7f2-cfbf-4f4f-a6e6-a6711c45b3ac","resolution":{"observed_at":"2026-08-07T04:36:56.586973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.247665Z","title":null,"venue":null,"work_id":"3d43fec3-3661-4d77-b876-308427805855","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.623691Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:4ef7fe5cc1698fc995daecabfc0b01de8eb2f2a1fcea60c9a53975f24d1843df","observation_id":"851cadbf-3692-4203-9ab4-74d172aada91","resolution":{"observed_at":"2026-08-07T04:36:58.251177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.239075Z","title":"Ku, Qian Liu, and Wenhu Chen","venue":null,"work_id":"ba572085-d8ac-4817-9ca5-978201f42d79","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.689422Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:17f70663cfe95afea8ab94ab7f321b9186cd4a0ef236941502f1cbdc1f1a4b85","observation_id":"6357a1b2-4a06-4e72-ae96-19caa511c722","resolution":{"observed_at":"2026-08-07T04:36:58.241963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.756183Z","title":null,"venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.756183Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:990b582d1c8a28a63b0b4049eb1297a8152acf000c962b1f0acc296171cfb3ea","observation_id":"61e8e627-bce3-4b03-b763-7090f19bff57","resolution":{"observed_at":"2026-08-07T04:36:56.756183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T04:36:56.800127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.800127Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:cf3db6add29b105ddc23819baf0216370cd673e1df40b1c648264fbf6e3135f9","observation_id":"ee18bd61-5898-473d-b604-74072ed4d97b","resolution":{"observed_at":"2026-08-07T04:36:56.800127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.871215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.871215Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:1baf7c28bdc74338770c520aeb9f33cc6b92844569552380f6a4d3fea43741c7","observation_id":"9cbdcc6f-eed7-49c7-b3ef-b58c46889f77","resolution":{"observed_at":"2026-08-07T04:36:56.871215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-07T04:36:56.903250Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.903250Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:c58dc2d3a8d781ac34f34eae6f4cef8173911e4d1fe7f3c11fb37b5d47b8ba93","observation_id":"aec1934d-55f9-4823-b709-84fa00b75b98","resolution":{"observed_at":"2026-08-07T04:36:56.903250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08632","last_updated":"2024-09-06T11:20:13Z","snapshot_observed_at":"2026-08-12T23:02:42.757635Z","submitted_at":"2024-08-16T09:52:02Z","title":"A Survey on Benchmarks of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08632","snapshot_observed_at":"2026-08-07T04:36:56.960671Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.960671Z"},"links":{"cited_paper":"/paper/2408.08632","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:04dbbd5755a2e9ed934eb030522591a418e0517a2736edeffaae62b2f661947a","observation_id":"b3b66b49-a8e3-45ae-99c4-5c84ace87e7b","resolution":{"observed_at":"2026-08-07T04:36:56.960671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.218663Z","title":null,"venue":null,"work_id":"7c266a63-d5cc-41c0-88cf-eb7736827b1f","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.035431Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:9cee9244bf29e8753adf7faa7d2e5b154aa359ed2f9a9e744558074f118bb617","observation_id":"38f2f181-a075-4453-b6d4-6c11922694ef","resolution":{"observed_at":"2026-08-07T04:36:58.221435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.209984Z","title":null,"venue":null,"work_id":"8218c432-d41c-49df-a0ef-36b5e491ac90","year":2019},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.083977Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:acccafac46dca23f0c7987ecc6af7e261b0c7e605286aadc39fb80cf394d8053","observation_id":"84c2d7c2-8b62-4e08-8ebc-ea82b2ad1476","resolution":{"observed_at":"2026-08-07T04:36:58.212845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.201017Z","title":null,"venue":null,"work_id":"1036077f-a63e-4663-b191-5347a4b21e61","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.178525Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:79a6f5ef0cac3e182092e600c53c4cfa1461bc568cc490cd98715713956551fc","observation_id":"b565f4d8-0151-4476-b5da-228d5d773e7e","resolution":{"observed_at":"2026-08-07T04:36:58.203854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.191752Z","title":null,"venue":null,"work_id":"10e29586-939d-443c-a581-4c172af34498","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.223584Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:8765e1fa0601e77b8808796741c4a43cd0d6b3459c6ae8a075e8897d08890a2c","observation_id":"2382cdb4-0975-4350-b76c-b6060a36dc1b","resolution":{"observed_at":"2026-08-07T04:36:58.195026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.182038Z","title":null,"venue":null,"work_id":"dbc17cd1-66c2-4fbe-9e56-881e32562fc3","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.312487Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:baa2d22e205affc93cbe0993eb77e443802d246ff09872e5a93da3db05666cdb","observation_id":"a3a0c202-9922-420b-9427-584464a29986","resolution":{"observed_at":"2026-08-07T04:36:58.184983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.172699Z","title":null,"venue":null,"work_id":"58f71529-047a-494e-9ea6-5d8dcf44cf9a","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.355871Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:cbcc45ca0db669ed0f78b42936ee90f282913a4aa974b51c0948f768270d5ea6","observation_id":"2a5ac443-47a1-4cc5-9b78-d33bc962200b","resolution":{"observed_at":"2026-08-07T04:36:58.175717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.162732Z","title":null,"venue":null,"work_id":"08816ccb-92b2-4056-b2e0-8501908b892b","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.406025Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:1d6c5d1a8f0bfb8fb9f0f0cd42a50fe589045fc52ae2f882d6804b47aaf2ba06","observation_id":"9f40534c-5146-4bc6-bf49-8f471341bfa3","resolution":{"observed_at":"2026-08-07T04:36:58.165973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.152979Z","title":null,"venue":null,"work_id":"09e6cf13-882d-4bad-aa22-2f3028863ef2","year":2022},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.493936Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:9a71128218a33537ebd9e280b1ee10a4d462d248e75a75db2cdcff0127c7e597","observation_id":"a779e404-8c5e-4802-935e-36120f0f9bea","resolution":{"observed_at":"2026-08-07T04:36:58.156334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.143842Z","title":null,"venue":null,"work_id":"0876c9fa-0d62-49f0-98ee-0de12010f5ea","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.529318Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:2c8593aaa4371d150bcf62104596b2591b62418eadbcd6d40d5156a8da873a11","observation_id":"cfa1177c-7f38-4a46-a26e-1c46c67e3bdd","resolution":{"observed_at":"2026-08-07T04:36:58.146711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.614358Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.614358Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:60f497841a7a3681c7df7bd5f2afd4a94e31c6c5b82b5a30fa9e31e13af99b4a","observation_id":"6f3ec60e-cef3-4ab6-ac1b-2abc939dcfe2","resolution":{"observed_at":"2026-08-07T04:36:57.614358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.127699Z","title":null,"venue":null,"work_id":"025b261b-82b8-4624-b8bb-6ab9af46b33a","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.660424Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:0d8c5e251db25c101fc4f4ab16a3f2ff45a629eeeb9d04c59c50fb3dc516f62c","observation_id":"d5b9b921-0af2-411c-99ba-ff972055fb86","resolution":{"observed_at":"2026-08-07T04:36:58.130607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.119049Z","title":null,"venue":null,"work_id":"0d4f8995-fe55-4140-8b4a-eab7c1f4d333","year":2003},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.724102Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:ddc4fb32db6ee211054f7e8d013eceae15703ce44bde1aefbf23fc18dd7bd3f9","observation_id":"fb57719b-1494-4abc-8166-e03811368756","resolution":{"observed_at":"2026-08-07T04:36:58.121927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.109906Z","title":null,"venue":null,"work_id":"d9c42750-a230-47a7-8ad4-4a8bf8f9d77c","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.745924Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:aad5c02f962c8a953cd71336088ef0a370027e7fb8085d73f9925a5bf82c3068","observation_id":"315654a7-0260-4135-a85d-a0d4189a2a95","resolution":{"observed_at":"2026-08-07T04:36:58.113028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.101017Z","title":null,"venue":null,"work_id":"100c8863-065b-444f-91ef-9da10ba805df","year":2019},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.749772Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:5566d698c563e1be82ad03989a105df587214b268340800a09e3cae1d380b146","observation_id":"75cecedd-f28b-458e-8c73-a1db0c65008d","resolution":{"observed_at":"2026-08-07T04:36:58.103796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T04:36:57.752458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.752458Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:5e6caa37787550cc344e310813cbe6e31b566133ec40973be7e8bb2dea4e5db7","observation_id":"7e92028f-d1cf-455d-b143-4a5abba33883","resolution":{"observed_at":"2026-08-07T04:36:57.752458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.092137Z","title":null,"venue":null,"work_id":"8e92282c-cf2e-431a-b8fa-0072b38428ca","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.755306Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:96d710a19aac7ebad4f06991fad267b6840aacb829d1514f994c9d9e82f24853","observation_id":"dca4467a-b6e6-4873-a438-5a406bf2eba0","resolution":{"observed_at":"2026-08-07T04:36:58.094986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T04:36:57.758726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.758726Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:304ec75dc64b0e61743ba45b4aee1ae4202926887222b0083132c850b171b735","observation_id":"7a6459ba-220b-4ae5-9fed-9da86d444cbf","resolution":{"observed_at":"2026-08-07T04:36:57.758726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.761786Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.761786Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:fd4c2cb89b6a13f2296d614763ab77a3381caca7b8a2de5f4d10a92bf74320ed","observation_id":"1d00e8dc-26b0-4a19-b456-da1fac3709de","resolution":{"observed_at":"2026-08-07T04:36:57.761786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.764923Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.764923Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:bca04e431788e98e6f81828c412cd571438568bf8ae38f37056c4e2597a7c557","observation_id":"a7b68da8-5e05-4361-96a0-b382231b5f3a","resolution":{"observed_at":"2026-08-07T04:36:57.764923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T04:36:57.768267Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.768267Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:60dfb03f66833a42ee7a292936e597387622953e6401e9374d62fee7842d48ca","observation_id":"60289f6a-c095-4d0f-8598-7e7a8d5c3156","resolution":{"observed_at":"2026-08-07T04:36:57.768267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.075038Z","title":null,"venue":null,"work_id":"1fff6f26-b321-4be6-8026-167bf3b1c1a8","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.771470Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:408eac9983173fd2cd28afa940e18bc23e2b00deb9b6b45933de983415c42282","observation_id":"ea391491-2233-462b-99df-43c0d61d2dd6","resolution":{"observed_at":"2026-08-07T04:36:58.078067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.774458Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.774458Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:1fd197fe1468adfa8a743c20d03f164628be9502b1d6d30c590b75a96f72ef17","observation_id":"ae19ed72-386f-4706-9dd8-fc22b2680059","resolution":{"observed_at":"2026-08-07T04:36:57.774458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T04:36:57.778449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.778449Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:a9c3b9a2b86dc45972f8bcda651f6f519ad5f2ad1c02c3e7b79566facf410ade","observation_id":"48c77cfe-290f-4270-adb6-2b1adcf3f0d6","resolution":{"observed_at":"2026-08-07T04:36:57.778449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.782456Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.782456Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:e61a6a22d44833eee7d8b3f0dce589f5e7afaf512a92678e5c677b9d4a636dc5","observation_id":"6e1a7f37-a7c4-4c2d-9e09-8187eea79bce","resolution":{"observed_at":"2026-08-07T04:36:57.782456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.785475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.785475Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:e7bae4966e74fac21d49f722ceb15b3a7e1205bdb0dfafa764f88cffaac6c7a6","observation_id":"ac596079-51f6-453a-9ae1-83a32905c794","resolution":{"observed_at":"2026-08-07T04:36:57.785475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.046838Z","title":null,"venue":null,"work_id":"96fef079-6103-4278-99e6-c5e5269af1af","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.788190Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:8d7cd57affb85112fd38fc3526106f5d7dcff33d098b39264378de490f81dfea","observation_id":"7632a9aa-e197-41da-a670-197147fc38e5","resolution":{"observed_at":"2026-08-07T04:36:58.050574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"pubmed/9522683","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.948568Z","title":"Zwaan and Gabriel A","venue":null,"work_id":"80f0d504-e2f7-44ae-992e-fb027394ba75","year":1998},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.791208Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:6c0ff0714aa3c1a83a525c910ddb84694bc93ed22704c8829e5df42edda1a0b1","observation_id":"a3890a0f-9ccd-4788-a921-54571984658d","resolution":{"observed_at":"2026-08-07T04:36:57.954724Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T07:42:00.940330Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2506.10415."}