{"as_of":"2026-08-19T11:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24cf8af78b3d4a9899f24d785bb8a4a81e0052c0f7a1f6e9020dc1e456d0b174","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:00:38.614780Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:17:54.452860Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:17:54.868705Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"cited_work":{"arxiv_id":"2505.03261","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03261","snapshot_observed_at":"2026-08-05T11:17:54.868705Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","venue":"cs.CV","work_id":"f3922ed0-0f5b-4ff9-bbbb-677469d3b818","year":2025},"citing_paper":{"arxiv_id":"2509.02969","last_updated":"2025-09-03T03:14:23Z","snapshot_observed_at":"2026-08-11T01:48:11.931449Z","submitted_at":"2025-09-03T03:14:23Z","title":"VQualA 2025 Challenge on Engagement Prediction for Short Videos: Methods and Results","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:17:54.452860Z"},"links":{"cited_paper":"/paper/2505.03261","citing_paper":"/paper/2509.02969"},"observation_digest":"sha256:c205902dff271b083868839660b21f5af886e9559109f970b4c417b3aa8c7394","observation_id":"ee3f365f-b592-4237-a8e0-5a7805617b04","resolution":{"observed_at":"2026-08-05T11:17:54.873690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03261/citation-record","integrity":"/paper/2505.03261/integrity","json":"/paper/2505.03261/citation-record.json","paper":"/paper/2505.03261"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.637661Z","title":"Vivit: A video vi- sion transformer","venue":null,"work_id":"ef459a62-ac92-48cc-a7c7-db2995dca747","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.304545Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:fbc3ae89b00e675d4b4e09dd7e8f2013a587c6fa71da2c01f069ab9a4a66b30b","observation_id":"9cf9c392-92c7-4cbc-93ff-7a153b2479a9","resolution":{"observed_at":"2026-08-16T00:00:39.642180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.621811Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"b798c747-a9bf-4db5-816c-678e537efd0b","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.309504Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:fbcd3a53c1a14b071f345fe256431ec87dcf535adcc2b198f24d8387b618385a","observation_id":"408af9a4-5537-403e-b6cf-980bcedded37","resolution":{"observed_at":"2026-08-16T00:00:39.626583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.606879Z","title":"Learning generalized spatial-temporal deep feature representation for no-reference video quality as- sessment","venue":null,"work_id":"5c2674f6-6aff-4622-96a1-3efef82069d9","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.314160Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:ef76dfe2988443862d08608672572a3cffa0458f372a0a02d81654c1b345707e","observation_id":"f002d58b-dcc3-45a3-80b9-d5cf7a0b8c8e","resolution":{"observed_at":"2026-08-16T00:00:39.611688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13134","last_updated":"2025-06-01T18:49:00Z","snapshot_observed_at":"2026-08-19T01:12:37.240358Z","submitted_at":"2025-01-22T08:06:48Z","title":"UniRestore: Unified Perceptual and Task-Oriented Image Restoration Model Using Diffusion Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13134","snapshot_observed_at":"2026-08-16T00:00:38.318533Z","title":"Unirestore: Unified perceptual and task-oriented image restoration model using diffusion prior","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.318533Z"},"links":{"cited_paper":"/paper/2501.13134","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:5941bff2547cb6a18af55dbd5dbe7c826106d8241a642b9db5b9a44bfdf4825f","observation_id":"d3eb5eb7-614c-4160-a4a5-8350bef4925f","resolution":{"observed_at":"2026-08-16T00:00:38.318533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.591967Z","title":"Con- trolstyle: Text-driven stylized image generation using diffu- sion priors","venue":null,"work_id":"98cc1279-1b4c-462a-a09a-d912a03c94c1","year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.323285Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:a91688952ec2eee674bf71f4a5b7ae04ede0da1079f699c305aff778f22d3ff5","observation_id":"dc479f3b-a255-4818-bca9-3c13f312e98c","resolution":{"observed_at":"2026-08-16T00:00:39.596834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-08-15T13:36:27.756066Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-16T00:00:38.327925Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.327925Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:c025c1fa99f0e44554ae6d08ae06083a1c5e56e3ce1c166ea438d15c0f1c678b","observation_id":"ad2e2b10-de08-4022-99ad-5f61064d7f51","resolution":{"observed_at":"2026-08-16T00:00:38.327925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-16T00:00:38.333210Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.333210Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:135dc8d268cc38ac15b3fa787007614a5fe0e64691eed97fe64560f941b54449","observation_id":"d8a81e36-988d-4666-9eaa-25c119d3c068","resolution":{"observed_at":"2026-08-16T00:00:38.333210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.577293Z","title":"Konvid-150k: A dataset for no-reference video qual- ity assessment of videos in-the-wild","venue":null,"work_id":"90d030d2-bb16-4d3b-9e1e-55047a29d381","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.338113Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:da23cb557c89d9998973c026544de04ab325a1cb8c06097003784c7409000529","observation_id":"40c68812-079c-464b-9bb9-b6adfa16d519","resolution":{"observed_at":"2026-08-16T00:00:39.582091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T00:00:38.342258Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.342258Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:ed9286866bbc5c72cb2c43701fe551389c173af5563cf0665931bf275f764af6","observation_id":"747c9606-31ec-41f3-9569-18525f340da0","resolution":{"observed_at":"2026-08-16T00:00:38.342258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-16T00:00:38.346999Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.346999Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:79f962e4b4b23f33fe83c57635a98bf72295f2cbf29e76175c3a0e82fd36d247","observation_id":"84979348-d816-4555-b378-cc93effd75cf","resolution":{"observed_at":"2026-08-16T00:00:38.346999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.560935Z","title":"Combining recurrent, convolutional, and continuous-time models with linear state space layers","venue":null,"work_id":"05acec36-dd94-4228-a4d0-78717ecce2d8","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.351863Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:d97c478d022959963b5a799a850b7e61ae8ee260a072f16da2a2e8d6d1a0f0e3","observation_id":"bf64fa4e-4f4b-492a-9618-8c42681cfbf3","resolution":{"observed_at":"2026-08-16T00:00:39.565879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.356572Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.356572Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:331239c06ddc9c975379dec0cace39bdcf3f58f11d30428393e7a182d078621f","observation_id":"c75c85a4-84d9-4e27-9860-c393ba6472bd","resolution":{"observed_at":"2026-08-16T00:00:38.356572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10145","last_updated":"2024-08-19T16:42:58Z","snapshot_observed_at":"2026-08-16T13:25:27.535191Z","submitted_at":"2024-08-19T16:42:58Z","title":"Multi-Scale Representation Learning for Image Restoration with State-Space Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10145","snapshot_observed_at":"2026-08-16T00:00:38.360844Z","title":"Multi-scale representation learning for image restoration with state-space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.360844Z"},"links":{"cited_paper":"/paper/2408.10145","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:de0e078e879265417798c9ace139dcb0071f5db760cf5b59603ae761cd407dbc","observation_id":"1378c596-8db9-4603-9c80-d3a74281a529","resolution":{"observed_at":"2026-08-16T00:00:38.360844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.537337Z","title":"Pvqm–a perceptual video quality measure","venue":null,"work_id":"4f30481e-0b56-466e-9229-0c7b71dbef3d","year":2002},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.365581Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:2a6bf02602bcb747369dceb1f2f5f10288d4d3c5320bdaaa131fece3ee35042d","observation_id":"5cb5daee-54e1-49c9-9cf9-167dd80f4d36","resolution":{"observed_at":"2026-08-16T00:00:39.542054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.12261","last_updated":"2019-03-28T20:56:37Z","snapshot_observed_at":"2026-08-15T10:34:34.836991Z","submitted_at":"2019-03-28T20:56:37Z","title":"Benchmarking Neural Network Robustness to Common Corruptions and Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.12261","snapshot_observed_at":"2026-08-16T00:00:38.370658Z","title":"Benchmarking neu- ral network robustness to common corruptions and perturba- tions","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.370658Z"},"links":{"cited_paper":"/paper/1903.12261","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:25b66fd0b3be8307966dfb33cd9c46cfd7e0726c3ca86f64238e40b9b1609329","observation_id":"b7083395-3086-4070-9212-c737b35107b5","resolution":{"observed_at":"2026-08-16T00:00:38.370658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.522510Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":"d5705291-f3ae-436d-adce-6377cef95ee1","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.375259Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:b56bef69a748dc566b4392715b82b13ae790e4c50bd8ecbb2168b95793d791a2","observation_id":"b8e9176b-626b-41a1-958e-0f270f7f5bd0","resolution":{"observed_at":"2026-08-16T00:00:39.527367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.507618Z","title":"The konstanz natural video database (konvid-1k)","venue":null,"work_id":"b3c5071a-8675-41be-9bfa-cc640fa6a822","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.379720Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:f50ef6d56be50c7dd90c6cde83f1768117e2d56f754c0567d60e385e8e4309ef","observation_id":"4cb82dbb-877e-4ce5-9fb9-ca1d8146508b","resolution":{"observed_at":"2026-08-16T00:00:39.512371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.492357Z","title":"Squeeze-and-excitation net- works","venue":null,"work_id":"c07ea7a7-a5f6-49f3-a788-ce4590159e6a","year":2018},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.384170Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:4e17af624dba34055cc0ca9af4e4f2b2b8c534f0708f238bf83e9e33851eb846","observation_id":"016b9234-ceb6-43d6-8aaf-22dfb3e291c8","resolution":{"observed_at":"2026-08-16T00:00:39.497184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.388799Z","title":"A new approach to linear filtering and prediction problems","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.388799Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:ec886b230cf3b955e7488545179df3bc642ada2db7aad0f802dab0d70d557144","observation_id":"2cb69318-cb03-44c6-92f3-7dc4835bb4fd","resolution":{"observed_at":"2026-08-16T00:00:38.388799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-16T00:00:38.393482Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.393482Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:9e8ad78e02fe51faee32e98b4b95599bd5f91015d393a3fcd82195ce5a2123b0","observation_id":"7e82366e-c170-4489-994b-a45a1e49dea3","resolution":{"observed_at":"2026-08-16T00:00:38.393482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02907","last_updated":"2017-02-22T09:55:36Z","snapshot_observed_at":"2026-08-17T10:49:36.026134Z","submitted_at":"2016-09-09T19:48:41Z","title":"Semi-Supervised Classification with Graph Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.02907","snapshot_observed_at":"2026-08-16T00:00:38.397911Z","title":"Semi-supervised classi- fication with graph convolutional networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.397911Z"},"links":{"cited_paper":"/paper/1609.02907","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:ebefc0fbd34fc0aebfc25401ac2319fd06c3476ed8311d5d07e7b861c75b0d87","observation_id":"509d2a83-32ab-483b-ad85-3bcca951cc92","resolution":{"observed_at":"2026-08-16T00:00:38.397911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.469253Z","title":"Two-level approach for no-reference con- sumer video quality assessment","venue":null,"work_id":"e55d4c78-d1eb-4b4d-b692-b33ef0b56bb4","year":2019},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.402225Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:718575f8c3834eefc3eaa76bb414d80426aa05f64ed0db1c2c3634ce3b8af199","observation_id":"b0c2b259-cab3-491d-92f6-515994ec92db","resolution":{"observed_at":"2026-08-16T00:00:39.473555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.455190Z","title":"Blind natural video quality prediction via statistical temporal features and deep spatial features","venue":null,"work_id":"a4d76553-0628-48dc-bc52-d31c7bbc43b8","year":2020},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.406451Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:41a6bde576433896d7ebcff3e98bb8df7483943dced714c93439893bb335c1cf","observation_id":"670faf29-96d8-4e95-90af-e8801ae7cc68","resolution":{"observed_at":"2026-08-16T00:00:39.459689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.440856Z","title":"Blindly assess quality of in-the-wild videos via quality-aware pre-training and motion perception","venue":null,"work_id":"6c329f23-853b-426f-9c5a-be268001ad6c","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.410630Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:22eb275c38d624cd083d953342c39440db7cac3bfb38c4f51b1fe3caab9fa81c","observation_id":"99899262-2c03-44d3-895c-8861faf81f9d","resolution":{"observed_at":"2026-08-16T00:00:39.445918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.426130Z","title":"Quality as- sessment of in-the-wild videos","venue":null,"work_id":"5a9fa3c3-d9c9-461f-a804-b90b88e714a0","year":2019},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.414716Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:3c19dbbb898c47825546a9c11e0366e6d8732295398224907e605a6c71642bc1","observation_id":"ab3acd20-3ee4-47e0-8c8b-d86f504abffe","resolution":{"observed_at":"2026-08-16T00:00:39.431039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.411566Z","title":"Unified qual- ity assessment of in-the-wild videos with mixed datasets training","venue":null,"work_id":"790ec65c-c5b9-4e64-8846-f4bc5ff2286f","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.419490Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:687ba4de00e28e6b3ec945857e9dc8e8cd38316bf55a5049c92e6c7f69524107","observation_id":"9fcd444e-9029-4fc7-9983-dec06dda27b7","resolution":{"observed_at":"2026-08-16T00:00:39.416374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.396946Z","title":"Which has better visual quality: The clear blue sky or a blurry animal? TMM, 2018","venue":null,"work_id":"75c84310-0829-4394-b94e-2736b0d642c2","year":2018},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.424156Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:325b281022416fb7a3597ccc00753b174ff6e17c28cbee83eeb6b71caa5cffdb","observation_id":"57cf1249-719d-4b42-8793-3414d43970fa","resolution":{"observed_at":"2026-08-16T00:00:39.401532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.380733Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":"5f46bac2-5944-4bdf-a02c-37f7ac8d2ee3","year":2024},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.428896Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:7f74efce77289fbac7b1d7bb6206b1fb461825e02740f0738a9b16042a2c79a4","observation_id":"5197f6ca-a4a4-4d43-8b1d-798606e64e5c","resolution":{"observed_at":"2026-08-16T00:00:39.385396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.366571Z","title":"Exploring the ef- fectiveness of video perceptual representation in blind video quality assessment","venue":null,"work_id":"7ab859ef-c0f7-4187-9b37-fc92c79e4382","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.433009Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:42508a2e84db05b3cb5affcf8aa0ca7ac4568c38969dd037868d0e7d6c18dabf","observation_id":"353660cc-5110-4abd-a33e-f6b42065b29d","resolution":{"observed_at":"2026-08-16T00:00:39.371154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.351762Z","title":"Diff- bir: Toward blind image restoration with generative diffusion prior","venue":null,"work_id":"9d5cee3e-c856-4104-82c6-2f1582038128","year":2024},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.437339Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:9375f6272878c909e0760faed4fecc237300cdbce1f849f47d713093e5ad2527","observation_id":"374cfd9c-688f-4261-ba69-6c09feee11ee","resolution":{"observed_at":"2026-08-16T00:00:39.356560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.335986Z","title":"Scaling and masking: A new paradigm of data sampling for image and video quality assessment","venue":null,"work_id":"36269034-f671-4b3b-970a-6535bdcf134c","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.441483Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:c41c85c05d596d32365b0a749bf4e002c58e39ba72563ecd750705d5a3d0885d","observation_id":"bddcfce5-d465-4924-b64e-ea82f8cb0064","resolution":{"observed_at":"2026-08-16T00:00:39.341522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-08-17T14:56:56.233298Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-16T00:00:38.445947Z","title":"Vmamba: Visual state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.445947Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:e0d74e4713d3a2bacc13ecaf12ce72dac657d3935258f2f4e1623a8823a1bd12","observation_id":"b3ba7889-809c-4f0c-9419-fdf4e7a6b534","resolution":{"observed_at":"2026-08-16T00:00:38.445947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19006","last_updated":"2024-11-13T10:56:14Z","snapshot_observed_at":"2026-08-16T13:39:09.383109Z","submitted_at":"2024-06-27T08:45:31Z","title":"Snakes and Ladders: Two Steps Up for VideoMamba","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19006","snapshot_observed_at":"2026-08-16T00:00:38.451151Z","title":"Videomam- bapro: A leap forward for mamba in video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.451151Z"},"links":{"cited_paper":"/paper/2406.19006","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:1da2c4eb5819c9f37303f199e5acdff025172c96ef69ab027ae393caf8342c13","observation_id":"5327d881-3b29-4f9b-b7b8-4a5fe8d0602c","resolution":{"observed_at":"2026-08-16T00:00:38.451151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.320955Z","title":"Kvq: Kwai video quality assessment for short-form videos","venue":null,"work_id":"f07c5ff5-b443-4ca7-a915-16514c450b5c","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.455792Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:28228df6d7de612f35223d9f62017d4c2ac186702f9faa04de1aad38527d1ec2","observation_id":"db06c707-e024-4870-92b3-8edd837a1b35","resolution":{"observed_at":"2026-08-16T00:00:39.325906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.306565Z","title":"Clif-vqa: Enhancing video quality assessment by incorporating high-level semantic information related to human feelings","venue":null,"work_id":"a996c076-5731-420c-914e-0df6386e8997","year":2024},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.460433Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:de035dca2b2e154db216239ac36937492bc3a1851e101df7f1a38755919ab00a","observation_id":"2abc2a47-f735-4728-a101-09171e174501","resolution":{"observed_at":"2026-08-16T00:00:39.311652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.291478Z","title":"No-reference image quality assessment in the spa- tial domain","venue":null,"work_id":"c129a98f-4d40-4f78-b67c-1045926760ce","year":2012},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.464726Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:6d5fda887d380b791ad934034d5a3469f546e793f7fda5d99c17fef6fc0742d7","observation_id":"bf05e8af-66de-4327-9d20-d685d4a0b5d8","resolution":{"observed_at":"2026-08-16T00:00:39.296262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.276220Z","title":"A com- pletely blind video integrity oracle","venue":null,"work_id":"52f7ac0b-fcb6-44df-8dbf-6e0630c99595","year":2015},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.469395Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:5c4109c0513ddfdd4e88eddbbeca774e4b861fae53cc57cea357a0d4fa5151e7","observation_id":"cd2b8e34-5cad-4679-bb3a-d0aeebe4fa6a","resolution":{"observed_at":"2026-08-16T00:00:39.280885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.261222Z","title":"completely blind","venue":null,"work_id":"5ad0fa79-b7f5-4658-bee2-7152b2f28a11","year":2012},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.473624Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:b0d2d09d01207cd6822ed0186697d627b555b3c82a32cc59cf72acaccfde01ec","observation_id":"450c1529-41bc-424f-90f8-e8203effbc6e","resolution":{"observed_at":"2026-08-16T00:00:39.265863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-16T00:00:38.477939Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.477939Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:13b0042cf0de4696a33abfaa7e471b0826fed075c877459b2c0cd9bc396880d9","observation_id":"221590fc-8ec8-4135-a05d-3df21c18f823","resolution":{"observed_at":"2026-08-16T00:00:38.477939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.246296Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":"049398b7-9688-4457-9b26-3e3dc6e8f8d1","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.482244Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:1e6b2619198663b1854759961b6859e366565e409acb61a73f35acb8ae09ba3a","observation_id":"2c0faf3f-77af-4a94-ab3a-5e2ee8b8dfb3","resolution":{"observed_at":"2026-08-16T00:00:39.251000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.231701Z","title":"Discrete-time control systems","venue":null,"work_id":"058d6552-5e76-4658-93f9-220d45ea4143","year":1995},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.486533Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:e1b05c4152d04deaf2984d51a1342c6a5990e22c39e0e004b61a9407ec920c57","observation_id":"797990a9-a224-4447-a2ab-ab90beaf8218","resolution":{"observed_at":"2026-08-16T00:00:39.236223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.216348Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"2cd01aa9-aa2f-478f-857b-fe678bd43197","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.490958Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:fbdd8bee329fa65421c7419f04e190d8e16723be0633c50c988ed40c36eb9d46","observation_id":"aa3b1d4d-38bd-44f8-a685-391cfcadda36","resolution":{"observed_at":"2026-08-16T00:00:39.221067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.495415Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.495415Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:e6a90aa3ffa414335de746dd16348e166baa4210842e4fa6ff1bee2fb535747b","observation_id":"143237db-db06-412c-a0f6-d8f47d7acc7f","resolution":{"observed_at":"2026-08-16T00:00:38.495415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.192299Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"707d678d-e4c0-431d-809a-39164ac54c5a","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.499867Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:2d00b9a71f4ba78f2ffef3fa8711f798f58982b43a6b09015bc3496d973045ab","observation_id":"1bc32ece-6d5b-4e66-9377-0e43343ae8c0","resolution":{"observed_at":"2026-08-16T00:00:39.197483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.504353Z","title":"Palette: Image-to-image diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.504353Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:26684fd3ccf5e6b44773a272f01b44d35597f19385d9c7fb4528be89f372f756","observation_id":"5a30372b-a221-4f1f-bd2b-1ea305a6da71","resolution":{"observed_at":"2026-08-16T00:00:38.504353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.168733Z","title":"Bidirectional recurrent neural networks","venue":null,"work_id":"86f0d195-ce8a-4ad5-bb06-30c116eafa66","year":1997},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.508775Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:7fdc0644dd8d3029afb218056eb1ccd51db1b5a761c9c7d5abe8b34a90a7eb0a","observation_id":"178688a5-39b8-4573-9dd2-99103481f8c9","resolution":{"observed_at":"2026-08-16T00:00:39.173259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06446","last_updated":"2024-02-09T14:48:20Z","snapshot_observed_at":"2026-08-16T14:19:52.706544Z","submitted_at":"2024-02-09T14:48:20Z","title":"ControlUDA: Controllable Diffusion-assisted Unsupervised Domain Adaptation for Cross-Weather Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06446","snapshot_observed_at":"2026-08-16T00:00:38.513094Z","title":"Controluda: Controllable diffusion- assisted unsupervised domain adaptation for cross-weather semantic segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.513094Z"},"links":{"cited_paper":"/paper/2402.06446","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:36c7b6d84ab73950166d076d6336a2f6ee041365a4b4045fe911cd89a4a69324","observation_id":"1ee4a2d1-e700-431d-9129-174c60b5675f","resolution":{"observed_at":"2026-08-16T00:00:38.513094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04933","last_updated":"2023-03-03T18:35:28Z","snapshot_observed_at":"2026-08-13T08:14:01.416880Z","submitted_at":"2022-08-09T17:57:43Z","title":"Simplified State Space Layers for Sequence Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.04933","snapshot_observed_at":"2026-08-16T00:00:38.517739Z","title":"Simplified state space layers for sequence modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.517739Z"},"links":{"cited_paper":"/paper/2208.04933","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:961a9866424dff78c4538baa3f88c9bbc06d3750b050f02b27de03b7b0d932ae","observation_id":"0a2f2875-f61c-482b-a849-4bf14730fdc9","resolution":{"observed_at":"2026-08-16T00:00:38.517739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.522347Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.522347Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:bc7ccad84f52144a6b1eebc058d4a5e04d4b3619a2e74311acc6b8b7a1a05d8d","observation_id":"756666ec-8a94-4232-8c08-1757bee7cccc","resolution":{"observed_at":"2026-08-16T00:00:38.522347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.144270Z","title":"Adapool: Expo- nential adaptive pooling for information-retaining downsam- pling","venue":null,"work_id":"0e7f0a08-b95e-4b1d-9958-3bfd0e8d4216","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.526644Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:f64801b6595608325ea63b1aa6b9556ab80005981816e759efed150430c5c79e","observation_id":"f1da58ba-2e37-4465-afd3-a9a2bf6ed640","resolution":{"observed_at":"2026-08-16T00:00:39.148880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.129531Z","title":"A deep learning based no-reference quality assessment model for ugc videos","venue":null,"work_id":"19485d2d-b06b-4815-9234-eacadad4bb7e","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.531386Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:97d48c71985063c4abc27de9fd7b26950e6191e16155210fbceee5c3af6155ed","observation_id":"06b13543-b476-4e21-9490-b137d8669d35","resolution":{"observed_at":"2026-08-16T00:00:39.134326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.113410Z","title":"Ugc-vqa: Benchmarking blind video quality assessment for user generated content","venue":null,"work_id":"c9a3d198-e51c-4ded-b450-2fa6c66cd7c5","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.535753Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:d3ece90a84d246b5e22911275cb0eb7457a89b17e0827230c748e49585ca2fd0","observation_id":"1f58703c-5774-4174-a92c-af5061c5a527","resolution":{"observed_at":"2026-08-16T00:00:39.118870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.097821Z","title":"Rapique: Rapid and accurate video quality prediction of user generated content","venue":null,"work_id":"32b2190a-034d-44fc-b0b1-90206d394e71","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.540133Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:8944bb3667d680ed2cfd398ed0dabc4c6abacb6042fbf2553146d8602d9ff108","observation_id":"acba265f-c5ce-40d5-a899-2240554709b0","resolution":{"observed_at":"2026-08-16T00:00:39.103326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.083129Z","title":"Youtube ugc dataset for video compression research","venue":null,"work_id":"aa0b28f9-16c4-463d-923d-63136d33ec72","year":2019},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.544393Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:8cb71484188af99b44a5eb4587a817142cf1f78cea317120ae943e2f82146de3","observation_id":"13967863-4f08-459c-989f-c4ccbc7505ff","resolution":{"observed_at":"2026-08-16T00:00:39.088135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.068350Z","title":"Rich features for perceptual quality assessment of ugc videos","venue":null,"work_id":"d461239d-43bc-4280-85b8-a883952412cc","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.548719Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:08ce226aa3e7b57d9c13d41a911be0e9558b424fc7c26440c33bc9a432cf8d36","observation_id":"20258de5-1051-45f9-b13d-a6f0975772ff","resolution":{"observed_at":"2026-08-16T00:00:39.073496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.053350Z","title":"Cbam: Convolutional block attention module","venue":null,"work_id":"5eb63c00-79ec-4436-adab-73c461b5af93","year":2018},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.552923Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:599f03c1c51e501296ee616914120e721b70508f398ab9d9e8d5fbf90112ed39","observation_id":"7abea99f-308c-48d5-96a2-5db71f21fe99","resolution":{"observed_at":"2026-08-16T00:00:39.058062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.037286Z","title":"Fast- vqa: Efficient end-to-end video quality assessment with frag- ment sampling","venue":null,"work_id":"d50ca39b-ddea-419e-bf1c-9b506b65053b","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.557539Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:df74bf0c8ac07a3b507d285d25cbd5c047d8f5cb413ecce828f3a1f23573c72a","observation_id":"29f8a30d-e396-4801-8460-8dfafb57f0eb","resolution":{"observed_at":"2026-08-16T00:00:39.041999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.022145Z","title":"Discovqa: Temporal distortion-content transformers for video quality assessment","venue":null,"work_id":"72c69ebc-9b68-4e05-9ba9-0ac70f65e8a9","year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.562079Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:7c637e03e04ad960998101389f282ce7f2231192afc70ae52c951ab356212e70","observation_id":"a1a565c7-df1a-4ced-bb78-576f98fef62d","resolution":{"observed_at":"2026-08-16T00:00:39.027023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04894","last_updated":"2023-03-07T08:25:24Z","snapshot_observed_at":"2026-08-16T16:17:29.407210Z","submitted_at":"2022-11-09T13:55:50Z","title":"Exploring Video Quality Assessment on User Generated Contents from Aesthetic and Technical Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.04894","snapshot_observed_at":"2026-08-16T00:00:38.566658Z","title":"Dis- entangling aesthetic and technical effects for video qual- ity assessment of user generated content","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.566658Z"},"links":{"cited_paper":"/paper/2211.04894","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:30d63a3ffbfa76c607f8f1fdb14870639af810b26663086e9771bfe2615730c6","observation_id":"5d09a27d-f75a-4cf7-886f-97d9d3d87ff0","resolution":{"observed_at":"2026-08-16T00:00:38.566658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:39.006897Z","title":"Exploring opinion-unaware video quality assessment with semantic affinity criterion","venue":null,"work_id":"01a8ac84-00ed-47dd-a75c-703e62d43277","year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.571163Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:2badc1f97c2c970f060a015f0322d559c1ceb2229de979b9f0ac180d4ca42fe2","observation_id":"d3d41e22-e23c-443c-a295-cd3181dab1ad","resolution":{"observed_at":"2026-08-16T00:00:39.012063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.992443Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":"1a5816a2-fc5d-4959-bc9f-fac8bb13c0db","year":null},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.575392Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:4d004542820b8d09bfaa93bcf2fad820f9f2796726e2a26b4e3956e7e555c52b","observation_id":"3bdb0b11-4b09-46b2-879c-cc03a0b75dd7","resolution":{"observed_at":"2026-08-16T00:00:38.997092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.977462Z","title":"Towards explainable in-the-wild video quality assess- ment: a database and a language-prompted approach","venue":null,"work_id":"c069088d-d9eb-4a71-80cb-d1e15341090e","year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.579821Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:b8f08887c95527ce2044c1adf653eaf57e974636dcb5d0084b15a4e9eb3e6e17","observation_id":"4ddce787-a77f-4283-a17b-ef11997da18d","resolution":{"observed_at":"2026-08-16T00:00:38.982189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-08-16T00:00:38.584086Z","title":"Q-align: Teaching lmms for visual scoring via discrete text-defined levels","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.584086Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:5f66e3412329223fc52974db5fad58d27aac3f6304469d671de3d4bfeba7d07a","observation_id":"f7a3c975-1d85-4326-b26b-bf89c28d868a","resolution":{"observed_at":"2026-08-16T00:00:38.584086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.588808Z","title":"Harnessing the spatial- temporal attention of diffusion models for high-fidelity text- to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.588808Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:285aa31fbe6123c9cd1bbd7780fccdcbec6692c56b8c1a0eed880da45dc7b863","observation_id":"f78d4499-588f-4b31-9bdd-64ce27ffc9a8","resolution":{"observed_at":"2026-08-16T00:00:38.588808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.953157Z","title":"Diffir: Efficient diffusion model for image restoration","venue":null,"work_id":"71fa125e-555c-4e3c-80d7-da0690eb84b3","year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.593099Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:9cfb39e60903daf20106e6ce49b7d225466e16ea5badf7c6e0462c62cf09b46a","observation_id":"c9a80532-11f6-49bd-8b57-64a595344566","resolution":{"observed_at":"2026-08-16T00:00:38.957726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.939081Z","title":"Patch-vq:’patching up’the video quality problem","venue":null,"work_id":"2fbe82fd-ca8f-409b-b64a-c2847b40282f","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.597496Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:69461d19edb2127fe8793a5d3fa95bd84babc28b4943ca36b9dc696f11c19cdb","observation_id":"a406d1e7-9c14-463f-a830-35aaf78e042d","resolution":{"observed_at":"2026-08-16T00:00:38.943728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.923993Z","title":"Long short-term convolutional transformer for no-reference video quality assessment","venue":null,"work_id":"b87398fb-2836-4595-a1ea-bd456b2cc9a8","year":2021},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.601965Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:d98b5a373c3e842d2e7574683df9ca22b6a692f3843033f6175d5738f8e49f8d","observation_id":"c651ed7d-17ab-4498-b46c-1cc571debfe0","resolution":{"observed_at":"2026-08-16T00:00:38.928916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.606373Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.606373Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:df710cb6ca90b8cca755e48ad0adc52c0c0b5c989787e2d8b2829a4050106cb6","observation_id":"f47a0e7e-1d18-49ab-a3f9-e245b886fe86","resolution":{"observed_at":"2026-08-16T00:00:38.606373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:38.898082Z","title":"A completely blind video quality evaluator","venue":null,"work_id":"5718c051-3dd2-4e24-a851-d2b4f7d79139","year":2022},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.610528Z"},"links":{"citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:e36293415509384d5fbd404cd6d335d6812ac28ca8292c2a8ca5aad238978def","observation_id":"2b02efa0-e0aa-4b3c-89cc-b9a08d9b19e6","resolution":{"observed_at":"2026-08-16T00:00:38.904415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-08-14T11:12:31.002605Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-16T00:00:38.614780Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:38.614780Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2505.03261"},"observation_digest":"sha256:68467c9e7bf8d62b375e45693ff95f7e7aac9d17ff920420f25fc685fb748a21","observation_id":"fdd4ac62-84a7-4288-87c0-45cc23d4797e","resolution":{"observed_at":"2026-08-16T00:00:38.614780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.03261","last_updated":"2025-05-06T07:42:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T02:04:31.343634Z","submitted_at":"2025-05-06T07:42:24Z","title":"DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 1 inbound Pith citation observation for arXiv:2505.03261."}