{"as_of":"2026-08-10T08:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8fbfa2ae66413cad51b7752a450d45732bc36d978ac88e6e0923e3bb0e75ced1","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:04:17.463194Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.09459/citation-record","integrity":"/paper/2508.09459/integrity","json":"/paper/2508.09459/citation-record.json","paper":"/paper/2508.09459"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:14.432566Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.432566Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:4e132c6aa957e3a7e88b12db980b8ef31c592b25fe0dba8d622e91bb95876d7d","observation_id":"3d4c54ed-54c7-4c2a-a625-18e65f0679ef","resolution":{"observed_at":"2026-08-05T21:04:14.432566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:14.509694Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.509694Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:79b031587c7d109f7bcc2537ec56d88049340594a8905ed6c59b813286496b06","observation_id":"8745c38e-2acb-482d-b5dc-6a1830a7c14b","resolution":{"observed_at":"2026-08-05T21:04:14.509694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.414171Z","title":null,"venue":null,"work_id":"a7c7a52f-426f-4258-9330-2079acc35e87","year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.596071Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:1ea77a25eea40a4f874b5f445d69e143779a42db4d6800e5927c2ae9e4cf5c4c","observation_id":"406e2d81-b5f1-499b-9fb5-022c9eaf7a03","resolution":{"observed_at":"2026-08-05T21:04:19.417275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:14.688759Z","title":"G.; Kirillov, A.; and Girdhar, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.688759Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:5ffaed295336687d37dd9b5101ad63832f98a7f9299c0d800c6854363219d2a0","observation_id":"05549229-c01c-4e84-83dd-84f0c366f9b6","resolution":{"observed_at":"2026-08-05T21:04:14.688759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.397274Z","title":"H.; and Bai, S","venue":null,"work_id":"65a12edb-68e6-442d-8757-12cb9b81a10f","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.789083Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:28beb31dbaa19cbcd35a535454828ff92e2d9ac6be35f2f370469c10278b4bf3","observation_id":"71639267-11ed-4335-9949-754777c3a13b","resolution":{"observed_at":"2026-08-05T21:04:19.402119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.388206Z","title":null,"venue":null,"work_id":"478e7a54-5512-46f6-b839-0c5f74e15268","year":2013},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.833007Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:5fa4427a8d642717b17fa39fb8ad113125259b5e7a9f8da111fc5d7f32046cd2","observation_id":"ce49106e-0e96-478b-af56-0e7237fa51a7","resolution":{"observed_at":"2026-08-05T21:04:19.391335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T21:04:14.951950Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:14.951950Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:cb7f2d556a1b4a0df2b6ad0308956088a8a7ee805d176ea2cdd77adb04cfb376","observation_id":"362f16f8-8e6d-4575-bba1-ef49c031d912","resolution":{"observed_at":"2026-08-05T21:04:14.951950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.378586Z","title":"N.; Delgado, A.; Zhou, D.; Kheyrkhah, T.; Smith, J.; and Fiscus, J","venue":null,"work_id":"2ce98ca8-fc4a-4e7e-bc55-170004ca6ee2","year":2019},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.023881Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:d4caba231a4fa411714d7ea3de1797008b127dae8c9f645db0b06e14cad149cb","observation_id":"ffca7179-de22-4a1f-8528-06365a23da57","resolution":{"observed_at":"2026-08-05T21:04:19.382079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.369500Z","title":null,"venue":null,"work_id":"90ad6a62-0d2a-44c5-b18b-a4b0fa82d52d","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.074619Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:4f4a04df36eee199c6948a595987badfff3f51032095cd5fd7dec041f98836e4","observation_id":"0438caa7-8e80-4ebc-b0b6-1b0cb0f31c93","resolution":{"observed_at":"2026-08-05T21:04:19.372698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.360102Z","title":null,"venue":null,"work_id":"4c2474a8-3a99-4a56-b936-bda2c81efc00","year":2006},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.147029Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:75c1d5b0e7391080648b86ba9fcc9b596ba4f8c2641063a5ea6caaa4c38653ec","observation_id":"4cab5990-17d1-4842-81b8-afdd7b3ce8ca","resolution":{"observed_at":"2026-08-05T21:04:19.363878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:15.219817Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; Chen, W.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.219817Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:8e85cb6c924786d69f31a65c2b9462c355064edeb06aae0faeb63e1f2cda1dfd","observation_id":"7de840ac-d8fe-4243-a6d0-8efb25dade9c","resolution":{"observed_at":"2026-08-05T21:04:15.219817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.344401Z","title":null,"venue":null,"work_id":"df1a9eb2-4978-4aa9-a5c0-777a39da00a5","year":2019},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.283873Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:05c34d3ce193e0411d14b8a2ee38f0c0e515c8be8d3bd68c4f1ed3e6658fbc13","observation_id":"06b6e796-8286-4477-b828-24b622f27463","resolution":{"observed_at":"2026-08-05T21:04:19.347552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.334578Z","title":null,"venue":null,"work_id":"d9faeef8-64ef-4fab-84fe-d04e64ee48fc","year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.374011Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:ac83f03c3543fc5db97d9ba8c05dee0263df8e6963686cd75b51c38fc0489e97","observation_id":"f6a22a39-ff73-4f0d-b463-d2630c89e9f5","resolution":{"observed_at":"2026-08-05T21:04:19.337728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.324076Z","title":null,"venue":null,"work_id":"d5d74d3c-6e4e-451c-b3b2-21d57847a59e","year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.459341Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:3b4541c1cdabf9f0219fae06fbf63d83fc45b5312e10249830195d4c0bb89098","observation_id":"464f31c3-7ffd-4d25-9b1e-e1ec2c2da03e","resolution":{"observed_at":"2026-08-05T21:04:19.327952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.314539Z","title":null,"venue":null,"work_id":"8fef3a7b-8414-4c39-a3b9-de3fa2b46c1e","year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.517174Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:a12442da6f83928f0f68f28e9bec8abbadcc9c813afedc88b6528357f8984ca9","observation_id":"68ec810d-c27b-4c69-a9d7-3f12718962f8","resolution":{"observed_at":"2026-08-05T21:04:19.317662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.305363Z","title":null,"venue":null,"work_id":"fd71e6c2-5ebc-4775-9a2f-0a633ce9f948","year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.590110Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:8e9efcf30e7c9d3cc654974f15ae43ebf8568980d96c3aa8c6b58b9fa1c7e943","observation_id":"003951fb-b704-44e1-aca0-e7cd2cc0d5e2","resolution":{"observed_at":"2026-08-05T21:04:19.308221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-05T21:04:15.661989Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.661989Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:0cd6d32257a86f0cddf7511819ed96bbed21143bc7fcc1bc3963373859c89754","observation_id":"d44c7c9d-b53d-490e-853a-48cbfc63704f","resolution":{"observed_at":"2026-08-05T21:04:15.661989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T21:04:15.738287Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.738287Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:d998363ffa25979f680e8e05a3de5637f74b061744fbd51d33665c99e24e3734","observation_id":"26eb40a7-c2e7-4040-9a69-a55d13463431","resolution":{"observed_at":"2026-08-05T21:04:15.738287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13576","last_updated":"2024-06-19T14:08:58Z","snapshot_observed_at":"2026-08-03T12:56:18.868888Z","submitted_at":"2024-06-19T14:08:58Z","title":"Trusted Video Inpainting Localization via Deep Attentive Noise Learning","version":1},"cited_work":{"arxiv_id":"2406.13576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13576","snapshot_observed_at":"2026-08-05T21:04:18.081610Z","title":"Trusted Video Inpainting Localization via Deep Attentive Noise Learning","venue":"cs.CV","work_id":"774a0773-656c-4b5a-b71a-28ecf3beb7f6","year":2024},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.825384Z"},"links":{"cited_paper":"/paper/2406.13576","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:d4bbcd773a1c6277bad6710a0c33739c8e19562f6a6d1c6cf3de28706e2942fe","observation_id":"02023df7-4952-4551-90e3-a8f565d012f5","resolution":{"observed_at":"2026-08-05T21:04:18.090355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.295253Z","title":null,"venue":null,"work_id":"e70b5aba-30be-46ad-93ed-1893146e3e95","year":2025},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.897284Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:f864480cf46400eba8d9c6aa3543375e23e688cd560c969eff59ea4ac8868482","observation_id":"9c313eed-575f-47fb-955c-0b85d3f2d6e1","resolution":{"observed_at":"2026-08-05T21:04:19.298528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.285386Z","title":null,"venue":null,"work_id":"dd083072-ab4b-4506-9c85-1ab01b7be3a0","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:15.976722Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:19efbd65e974262d8d4b417310b29f8d3d8ba45c9d579f508920e4b73ffe5722","observation_id":"b25535e1-e968-4a50-9362-a4c34cfe58dc","resolution":{"observed_at":"2026-08-05T21:04:19.288470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.275199Z","title":null,"venue":null,"work_id":"de05acee-4ea2-4c1a-80f8-af42fbf5d298","year":2024},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.007390Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:12c359abc8d6a9886d6aa5ca7547d07dda0f28cd98cc2d6a1f623f2c4aeef24b","observation_id":"3f42d307-1a4e-4aa1-bac6-8e2fc8799c5e","resolution":{"observed_at":"2026-08-05T21:04:19.278480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.264974Z","title":"D.; Fang, S.; and Stamm, M","venue":null,"work_id":"08a23082-592d-4afa-a75b-c321d4d0cbf6","year":2024},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.069362Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:4ac03cc7e9b0f4f4d468c68a743ebd9479199b5900ccd75c05f376f3094fd798","observation_id":"26b8e230-7107-4e72-b7a6-0f224a87b015","resolution":{"observed_at":"2026-08-05T21:04:19.268624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.255380Z","title":null,"venue":null,"work_id":"f19d6d68-c8da-4f20-aa49-894a4704dc8f","year":2020},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.157889Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:74aead83576ee1f1bc1a0d32568b70fab8864eb7a94e209355a5ddc17e489493","observation_id":"d311e908-be1e-4a2d-84a7-4de8599f06ce","resolution":{"observed_at":"2026-08-05T21:04:19.258440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.244781Z","title":"W.; Lee, S.; Lee, J.-Y.; and Kim, S","venue":null,"work_id":"776717ed-8ba6-47b7-85a9-b58340030dfd","year":2019},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.230413Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:2fdd0a5aa1067d549f05a33744853aef92e1ce550d092bd50148c56ab0ebb795","observation_id":"5243fb95-d898-439c-b5f1-550e1d01f3da","resolution":{"observed_at":"2026-08-05T21:04:19.248622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16126","last_updated":"2024-09-05T04:48:35Z","snapshot_observed_at":"2026-07-06T16:24:42.336000Z","submitted_at":"2023-09-28T03:13:09Z","title":"UVL2: A Unified Framework for Video Tampering Localization","version":2},"cited_work":{"arxiv_id":"2309.16126","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.16126","snapshot_observed_at":"2026-08-05T21:04:17.899414Z","title":"UVL2: A Unified Framework for Video Tampering Localization","venue":"cs.CV","work_id":"ed3123a1-6e38-41a5-8840-ac70da811542","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.295868Z"},"links":{"cited_paper":"/paper/2309.16126","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:e8b6e2d5630d47184f263e11821984c8e8bf48626a0b07d6cd04009f3dd70d67","observation_id":"2caafb73-e3de-419d-95a1-17792a79c468","resolution":{"observed_at":"2026-08-05T21:04:17.976054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.235146Z","title":null,"venue":null,"work_id":"9d7aba16-75d4-4465-8b38-7f2edbc939a3","year":2016},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.389254Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:7d1b05bacc180ae73cc1c594a797c3ca7947c9e386aef976f6955cd2b8215204","observation_id":"34989676-0497-4249-b707-f2d9dcdb5653","resolution":{"observed_at":"2026-08-05T21:04:19.238040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:16.426552Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.426552Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:b0f22d09d84655fe0676be7d4205ef2627616d64957691c39c91268a86531012","observation_id":"aecc56a8-344d-4075-8009-d74271975340","resolution":{"observed_at":"2026-08-05T21:04:16.426552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.219660Z","title":null,"venue":null,"work_id":"c66ed48e-2a1b-4d73-9269-327050bfe647","year":2025},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.478533Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:1ef7975e33ffc85de8395a8eae73c7784359747fcd8179d959a7042abc9927d8","observation_id":"b4b84fcc-3f02-4786-a9a6-d16a57993fca","resolution":{"observed_at":"2026-08-05T21:04:19.222482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:16.540992Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.540992Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:9a090c121a5c417a060abd2a3323169117f97ea0c4b458d9ee7b4459a6f485ed","observation_id":"8595968d-f8c1-45b3-80c5-5b46ea90d38f","resolution":{"observed_at":"2026-08-05T21:04:16.540992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.204093Z","title":null,"venue":null,"work_id":"b92fa356-25c2-4dda-8f5a-35bebcc754f3","year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.615076Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:0f55a0e96f9da048a5882a12a6e0067451c40d8e211924918a1376943a31c84c","observation_id":"d35c35b5-aeed-4225-8387-affdd7938ae1","resolution":{"observed_at":"2026-08-05T21:04:19.207001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T21:04:16.691357Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.691357Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:3c114d986d332cc36d94792768de35ca331a7f6c2807512c98e3e25ebc2d1d6c","observation_id":"708472e2-1a5c-40d2-a8f4-51e863dbce65","resolution":{"observed_at":"2026-08-05T21:04:16.691357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.147112Z","title":null,"venue":null,"work_id":"8c76c052-796b-417c-9fb8-071615aa10fb","year":2016},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.775883Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:9125312c556ba5061b49596891a6bf83a6fe5c523863c3a70c3a33b1ff274f72","observation_id":"ac751f5f-25a8-4f95-a105-185bf3eeda84","resolution":{"observed_at":"2026-08-05T21:04:19.181215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09307","last_updated":"2025-05-17T06:34:31Z","snapshot_observed_at":"2026-07-06T16:07:30.189459Z","submitted_at":"2023-08-18T05:05:30Z","title":"Rethinking Image Forgery Detection via Soft Contrastive Learning and Unsupervised Clustering","version":2},"cited_work":{"arxiv_id":"2308.09307","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.09307","snapshot_observed_at":"2026-08-05T21:04:17.699442Z","title":"Rethinking Image Forgery Detection via Soft Contrastive Learning and Unsupervised Clustering","venue":"cs.CV","work_id":"c597f0ed-fa0d-4162-ba59-3377167b16c6","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.858784Z"},"links":{"cited_paper":"/paper/2308.09307","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:57960c1cfa1481df2a62b92ddc299c3901bf2c50bc6ea8050c7305efdd7fda57","observation_id":"9ca8285b-8f5d-40b5-a632-e0d43e515c51","resolution":{"observed_at":"2026-08-05T21:04:17.772023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:19.005692Z","title":null,"venue":null,"work_id":"5aebb737-5f7b-4ba0-9172-bb5490229e52","year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.913418Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:fcc3a9659f3a34cc467ac65da0a77c4cdc5b6041175a35e2227e9c909feb028d","observation_id":"8d4dff03-0440-40b7-8374-45994440cbe7","resolution":{"observed_at":"2026-08-05T21:04:19.075151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.911533Z","title":null,"venue":null,"work_id":"39b8566f-80a9-4a1a-833c-0e8b4fa14f8c","year":2022},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:16.999245Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:c953421f5c0c60cce149796f8ed848bd47e3c218d66d975bc223920e05a6ac67","observation_id":"76e818d0-02d8-49b3-b370-89d521358e9a","resolution":{"observed_at":"2026-08-05T21:04:18.976798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.750644Z","title":null,"venue":null,"work_id":"da906acd-fa2b-46c9-b4d9-97b7a9ad78f9","year":2019},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.053035Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:367f8ca75ea9934b061da844394c3530c49f76a7ff55d87c1b56098153b49e70","observation_id":"ace624a9-eecd-425e-854d-e993cad1cdf4","resolution":{"observed_at":"2026-08-05T21:04:18.820915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.641638Z","title":"M.; and Luo, P","venue":null,"work_id":"8b0ec2f9-0709-4a20-80ed-3bcba98717c5","year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.132479Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:94cafbfd60416b69764aafdd5842abc4b3a800357871893a2c81999cdcc1a3a5","observation_id":"21300461-1688-48a6-9d8d-75bbe1841cd9","resolution":{"observed_at":"2026-08-05T21:04:18.686451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00641","last_updated":"2021-07-01T17:56:09Z","snapshot_observed_at":"2026-08-10T03:12:30.956293Z","submitted_at":"2021-07-01T17:56:09Z","title":"Focal Self-attention for Local-Global Interactions in Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00641","snapshot_observed_at":"2026-08-05T21:04:17.197463Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.197463Z"},"links":{"cited_paper":"/paper/2107.00641","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:9c814ffe99a72abc1187f3338d2b6c1b20aacf24b943e14d8133efa59fcb6606","observation_id":"50ffbd01-c296-4531-bcc3-489afd507a6c","resolution":{"observed_at":"2026-08-05T21:04:17.197463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.542477Z","title":null,"venue":null,"work_id":"ded95406-0b32-467f-b407-a79939a1437e","year":2020},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.253105Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:9e9f1ab0913adf578b2ae5ab68c60617b10ba08b5f4401d776d5324f269d1ab7","observation_id":"a058ab3a-449e-4ad0-9e48-c91f8951deff","resolution":{"observed_at":"2026-08-05T21:04:18.594566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.302992Z","title":"Y.; and Feng, W","venue":null,"work_id":"4de077ce-88c7-474c-ae29-f3173855578d","year":2023},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.292090Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:136d3eab6b1fc82cd80612c49cdca4306dc6c11e59fe415bbe8f35b0dcf4d629","observation_id":"257d14e7-3ca0-4c0f-b67b-0cf0d1374655","resolution":{"observed_at":"2026-08-05T21:04:18.386992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.11080","last_updated":"2021-01-26T20:53:49Z","snapshot_observed_at":"2026-08-10T06:52:41.798293Z","submitted_at":"2021-01-26T20:53:49Z","title":"Deep Video Inpainting Detection","version":1},"cited_work":{"arxiv_id":"2101.11080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.11080","snapshot_observed_at":"2026-08-05T21:04:17.574781Z","title":"Deep Video Inpainting Detection","venue":"cs.CV","work_id":"daa6f057-57aa-4185-8645-fcb6b3364199","year":2021},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.378546Z"},"links":{"cited_paper":"/paper/2101.11080","citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:3b00e3308b69c9ad9c218e3dab86bbb309d731e65bf39f31cdba9aa19478c6bd","observation_id":"ccd33a18-9ed9-4ec6-a06e-227225c9a7dc","resolution":{"observed_at":"2026-08-05T21:04:17.617136Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:04:18.127141Z","title":null,"venue":null,"work_id":"b44a6c2c-3028-4688-98ad-c8ea2392ac93","year":2025},"citing_paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T21:04:17.463194Z"},"links":{"citing_paper":"/paper/2508.09459"},"observation_digest":"sha256:9f5357afc78daf641fcb4c7998e93df436a81b217586e4c160170936a64eaeb6","observation_id":"17700c35-f59b-45d2-8ed2-bb041623838a","resolution":{"observed_at":"2026-08-05T21:04:18.247555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.09459","last_updated":"2026-06-10T07:16:46Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T03:14:20.580266Z","submitted_at":"2025-08-13T03:35:28Z","title":"RelayFormer: A Unified Local-Global Attention Framework for Scalable Image and Video Manipulation Localization"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":33,"verified_exact":3,"verified_fuzzy":6},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2508.09459."}