{"as_of":"2026-08-16T12:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e558c27dfabe34525cf12e5c7ee411db8bd41d0bc0537dad7fcbb53d54161838","coverage":[{"denominator":294,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:52:56.969627Z","state":"measured"},{"denominator":108,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":108,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:39:55.440555Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:56:59.273069Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-08-12T13:58:09.460692Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15798","last_updated":"2024-12-25T09:01:45Z","snapshot_observed_at":"2026-08-13T07:15:23.971691Z","submitted_at":"2024-11-24T11:56:59Z","title":"M3-CVC: Controllable Video Compression with Multimodal Generative Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:09.460692Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2411.15798"},"observation_digest":"sha256:a64133fd780d8d4223a80f4c9e1aa6bedde4b89b501965e422a3cd0191509ec8","observation_id":"9c8c29d6-0280-47da-bca8-a1408da96901","resolution":{"observed_at":"2026-08-12T13:58:09.460692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-08-06T18:52:39.433586Z","title":"Video quality assessment: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07105","last_updated":"2025-07-09T17:59:19Z","snapshot_observed_at":"2026-08-09T16:42:39.231594Z","submitted_at":"2025-07-09T17:59:19Z","title":"4KAgent: Agentic Any Image to 4K Super-Resolution","version":1},"reference_index":265,"source":"pdf_text","source_observed_at":"2026-08-06T18:52:39.433586Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2507.07105"},"observation_digest":"sha256:ccbb093c12041e6332baea0aca8a43f8d75140839d72542581f0681da4d7f21d","observation_id":"00422675-e8e5-4af3-a435-45462a2acd24","resolution":{"observed_at":"2026-08-06T18:52:39.433586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-08-15T17:39:55.440555Z","title":"Video quality assessment: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08700","last_updated":"2025-08-16T15:16:50Z","snapshot_observed_at":"2026-08-15T17:31:03.089921Z","submitted_at":"2025-08-12T07:42:56Z","title":"Subjective and Objective Quality Assessment of Banding Artifacts on Compressed Videos","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-15T17:39:55.440555Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2508.08700"},"observation_digest":"sha256:5e070fb6a556f591059367f110676d8ed2cad88376b44a78d0d8f7c35a8e33eb","observation_id":"e84eccf6-9d66-42fd-a31c-91fba92e2783","resolution":{"observed_at":"2026-08-15T17:39:55.440555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2412.04508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-07-02T13:56:59.273069Z","title":"Zheng, Y","venue":null,"work_id":"10bc0dc3-0cc2-4c8c-9b76-1941b6b321a9","year":2024},"citing_paper":{"arxiv_id":"2604.11156","last_updated":"2026-04-13T08:17:56Z","snapshot_observed_at":"2026-08-11T16:54:27.387922Z","submitted_at":"2026-04-13T08:17:56Z","title":"rPPG-VQA: A Video Quality Assessment Framework for Unsupervised rPPG Training","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T16:44:01.445069Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2604.11156"},"observation_digest":"sha256:92aa278520792b08ef76265e6472623ff922befc4c488d8a37dca6c51257acc5","observation_id":"381581f9-4533-492f-bf9a-702e9d6d4a69","resolution":{"observed_at":"2026-05-11T08:20:57.506602Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2412.04508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-07-02T13:56:59.273069Z","title":"Zheng, Y","venue":null,"work_id":"10bc0dc3-0cc2-4c8c-9b76-1941b6b321a9","year":2024},"citing_paper":{"arxiv_id":"2604.12813","last_updated":"2026-04-14T14:40:23Z","snapshot_observed_at":"2026-08-11T19:05:59.537453Z","submitted_at":"2026-04-14T14:40:23Z","title":"DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:09.488578Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2604.12813"},"observation_digest":"sha256:b125f24eb7e2708eccef792b9ef2d3fe428cb182b988bd96c5c9613dd2f0bb39","observation_id":"532eedb5-6244-42c6-8f35-983575a854c2","resolution":{"observed_at":"2026-05-11T09:16:01.270518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2412.04508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-07-02T13:56:59.273069Z","title":"Zheng, Y","venue":null,"work_id":"10bc0dc3-0cc2-4c8c-9b76-1941b6b321a9","year":2024},"citing_paper":{"arxiv_id":"2605.13525","last_updated":"2026-05-13T13:38:54Z","snapshot_observed_at":"2026-08-01T21:46:20.713005Z","submitted_at":"2026-05-13T13:38:54Z","title":"Beyond VMAF: Towards Application-Specific Metrics for Teleoperation Video","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T18:11:14.402194Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2605.13525"},"observation_digest":"sha256:c37140965014212668da46b2ca83c44333f5220d62883d980408596872feae91","observation_id":"a97f36b9-e5b1-4f65-85cc-2064f7e7ef9c","resolution":{"observed_at":"2026-05-14T18:12:33.126003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2412.04508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-07-02T13:56:59.273069Z","title":"Zheng, Y","venue":null,"work_id":"10bc0dc3-0cc2-4c8c-9b76-1941b6b321a9","year":2024},"citing_paper":{"arxiv_id":"2607.01086","last_updated":"2026-07-01T15:40:42Z","snapshot_observed_at":"2026-08-03T23:25:20.619368Z","submitted_at":"2026-07-01T15:40:42Z","title":"LongVQUBench: Benchmarking Long-Term Video Quality Understanding of Vision-Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-02T13:49:53.016586Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2607.01086"},"observation_digest":"sha256:0522244c10055ceacb5be6515c398c29b09a71cdfaedf831b2527a676f44cafa","observation_id":"121380fe-21a3-4ddb-8e78-7d00742d5164","resolution":{"observed_at":"2026-07-02T13:56:59.274685Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04508","snapshot_observed_at":"2026-07-12T02:06:24.212795Z","title":"Video quality assessment: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03494","last_updated":"2026-07-03T17:03:45Z","snapshot_observed_at":"2026-08-15T02:38:33.152607Z","submitted_at":"2026-07-03T17:03:45Z","title":"Towards Standardized Light Field Quality Assessment: Hybrid Subjective Benchmarking and Objective Metric Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T02:06:24.212795Z"},"links":{"cited_paper":"/paper/2412.04508","citing_paper":"/paper/2607.03494"},"observation_digest":"sha256:bb127c188d075d560cf4559e401554d288380c95794d21b06434c52f93613d2e","observation_id":"97c3aba8-edbf-43c7-a1b6-935952a18dac","resolution":{"observed_at":"2026-07-12T02:06:24.212795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04508/citation-record","integrity":"/paper/2412.04508/integrity","json":"/paper/2412.04508/citation-record.json","paper":"/paper/2412.04508"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.558682Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.558682Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e3654e63fbebf9e5c01994b920ed597036cc7cb1d566168f714406b9799d0563","observation_id":"8dee1c2c-b02b-4a6d-afa0-5674d691049d","resolution":{"observed_at":"2026-08-11T22:52:56.558682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.564213Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.564213Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:082fa5bb45f5c31d3ce1c73096c814d59a50390264f3514af927e5a04c1d62f5","observation_id":"8fecc169-c72f-4806-8c19-6b26e5e6524b","resolution":{"observed_at":"2026-08-11T22:52:56.564213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.568112Z","title":"Deep convolutional neural models for picture-quality prediction: Chal- lenges and solutions to data-driven image quality assessment,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.568112Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e1ce853f2ab536b6b4ad4edf4053efb6bae4c426c581a52f00f27bba4c90207f","observation_id":"7a665c6b-53e7-4b9c-8083-2a377195ddee","resolution":{"observed_at":"2026-08-11T22:52:56.568112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.578744Z","title":"Patch- VQ:’patching up’ the video quality problem,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.578744Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:15115e0bed702f926a19df100e22f9f8ca90799fe0a0d3f1555dccc973dc3145","observation_id":"e6e23843-38e3-4b71-b5b6-eaf042494348","resolution":{"observed_at":"2026-08-11T22:52:56.578744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.583267Z","title":"YouTube UGC dataset for video compression research,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.583267Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0726a1d2559c3e06a3c3e2cfc486bb2ebf89edc0246aff44aa7cd5ba0b0f8ffe","observation_id":"f5efa720-4ea1-4997-978b-dc344349e88a","resolution":{"observed_at":"2026-08-11T22:52:56.583267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.586945Z","title":"Study of subjective and objective quality assessment of audio-visual signals,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.586945Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:918bdab736c130d0f5120a2cfde4cd3e0cd03dc333b989edc283c7d2af3d25cc","observation_id":"3522874a-a477-4d7f-a9c9-116de25313d1","resolution":{"observed_at":"2026-08-11T22:52:56.586945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.591478Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.591478Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:888478799829e479427859bd00d567ceb38a3b242ae8568c9473e7fb919ef40f","observation_id":"aeb19738-721b-451f-b2ab-b664eb6de3ee","resolution":{"observed_at":"2026-08-11T22:52:56.591478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.595259Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.595259Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:04cdec42195398e32e8af87be659df6835317485c1e77ac21719443d4ceaa163","observation_id":"6b149c16-30cd-4402-86eb-13619fa74124","resolution":{"observed_at":"2026-08-11T22:52:56.595259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.598591Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.598591Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a2184e2f62cd77c719e646119b2650e104a47f6525dc7a6e00d45c5df9d4b86b","observation_id":"14384ab6-0d66-49cb-a040-d3599a447552","resolution":{"observed_at":"2026-08-11T22:52:56.598591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.601708Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modality collaboration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.601708Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:7fe893b0514c97603ad1e2c68df0cc7f96d23193199fc1af26f22253481739e6","observation_id":"5f9e01b6-fb76-4e19-bf13-4a9a8e4e9166","resolution":{"observed_at":"2026-08-11T22:52:56.601708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.604808Z","title":"Q-instruct: Improving low-level visual abilities for multi-modality foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.604808Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:02668b9d053c6374d68a47c44e1764180b2bc613047edf3044245a201a3a74d1","observation_id":"c5da508d-4b38-42a6-84d8-b9b50e7cf5a7","resolution":{"observed_at":"2026-08-11T22:52:56.604808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.611171Z","title":"Multiscale structural sim- ilarity for image quality assessment,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.611171Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:56a89f422d2a943206224bba3d96330eb950affcd6692a151b54866aa596e3c7","observation_id":"d4870486-951d-4e52-9b07-927481bf7b7e","resolution":{"observed_at":"2026-08-11T22:52:56.611171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.614314Z","title":"Complex wavelet structural similarity: A new image similarity index,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.614314Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:7954ac31bdb8096f88047d921d9f0caff59a1106614c078ca6063c9929e75eb8","observation_id":"b89a922a-2cff-4454-8df6-d65f5fc58232","resolution":{"observed_at":"2026-08-11T22:52:56.614314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.617488Z","title":"Information content weighting for perceptual image quality assessment,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.617488Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:31faa2f1d65f7b79e9e8b877a2703a87235bfa928a902b95b562fc9ae56d1fbb","observation_id":"b53d6006-cc7e-4b31-bb09-0c27107dda0f","resolution":{"observed_at":"2026-08-11T22:52:56.617488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.620387Z","title":"Edge strength similarity for image quality assessment,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.620387Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:7abf507b2be5c6c2545523fda2f1190c0a0a445965b94b6213712c939eb291af","observation_id":"3b30bad5-3902-4aff-a79e-776670c29791","resolution":{"observed_at":"2026-08-11T22:52:56.620387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.624157Z","title":"Gradient magnitude similarity deviation: A highly efficient perceptual image quality index,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.624157Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:704d4d89f934eb0c54204dcd8c33e11b85162ca53a1c21553386e4fb511e495c","observation_id":"f1754f40-f0d0-4782-b970-cb80b0a58d75","resolution":{"observed_at":"2026-08-11T22:52:56.624157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.627938Z","title":"Image quality assessment based on gradient similarity,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.627938Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a70a10facac10f4e7b2189ddcc6d32c61906e4641de8ef88405073a4ee65021b","observation_id":"9002fac4-7eaf-4224-bd76-44db6faf20bf","resolution":{"observed_at":"2026-08-11T22:52:56.627938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.631810Z","title":"FSIM: A feature similarity index for image quality assessment,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.631810Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:724e15287e1addd23d5f4137ea667134e5cfebe8388ae7e3d5b4b79484ec6324","observation_id":"b55afdca-9426-4b86-9d8c-2cc0ea16c581","resolution":{"observed_at":"2026-08-11T22:52:56.631810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.635663Z","title":"VSI: A visual saliency-induced index for perceptual image quality assessment,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.635663Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:90f61edb3a967070858b65562eb8b0f97d7c1c5675fe2bb15997266e1fafc07e","observation_id":"6a0f5948-9df2-4137-a6b1-3056687236c8","resolution":{"observed_at":"2026-08-11T22:52:56.635663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.639447Z","title":"A perceptual image quality index based on global and double-random window similarity,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.639447Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:92904a83c4a83208ffffd9a8e76ccab72eeb1ddd73383b99d59aa5f477cab0de","observation_id":"f3d6b1db-09a2-40ff-af2e-61fcb68bc9de","resolution":{"observed_at":"2026-08-11T22:52:56.639447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.642804Z","title":"Video quality assessment based on structural distortion measurement,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.642804Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e9f43a768f023e10c0398cdff782eb6b9adfa7f2e4b8c686e1e63e5a395f063c","observation_id":"35d9ac03-24d7-485b-858d-0dad9924e4e9","resolution":{"observed_at":"2026-08-11T22:52:56.642804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.647258Z","title":"A structural similarity metric for video based on motion models,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.647258Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e1fb109fe6cf00f93d99049c9bea292d4a40717df555358677a81c7e79ee1d1c","observation_id":"9ab51b06-2726-4b39-bf5c-610b553fca48","resolution":{"observed_at":"2026-08-11T22:52:56.647258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.650655Z","title":"An optical flow-based full reference video quality assessment algorithm,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.650655Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:eac0d83980b8774adcede8626323151486eb8083d0fe54c5e1dc1965384bef51","observation_id":"9d266d7f-dd76-4706-8548-3cdf7841f58d","resolution":{"observed_at":"2026-08-11T22:52:56.650655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.654291Z","title":"Image quality assess- ment: Unifying structure and texture similarity,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.654291Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:4c5ce84fb28e5273c6bc06ae25a24e9b9fd621dac5b61cb91139d9af0f0108d5","observation_id":"21acf142-f0aa-4c76-a231-cb57fb8c3655","resolution":{"observed_at":"2026-08-11T22:52:56.654291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.657951Z","title":"Locally adaptive structure and texture similarity for image quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.657951Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:9a6c11688e722e683600506fcbc7f265956b42c2f54e79fa71ff8404b43b65c0","observation_id":"cdeb8419-0be1-46ce-bf03-b33005467de9","resolution":{"observed_at":"2026-08-11T22:52:56.657951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.661647Z","title":"Deep learning based full- reference and no-reference quality assessment models for compressed UGC videos,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.661647Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:f1c562d0fab9937c9afa832b6819f14f80d3b84886d85ca2fc5d7a65c7bb8e29","observation_id":"d9f7ef6e-4817-49ad-a86a-69e66cbc103e","resolution":{"observed_at":"2026-08-11T22:52:56.661647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01704","last_updated":"2017-03-03T14:53:13Z","snapshot_observed_at":"2026-08-14T21:31:48.981018Z","submitted_at":"2016-11-05T21:39:53Z","title":"End-to-end Optimized Image Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01704","snapshot_observed_at":"2026-08-11T22:52:56.665037Z","title":"End-to-end Optimized Image Compression,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.665037Z"},"links":{"cited_paper":"/paper/1611.01704","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0ade4c449249f687431d936860ff8cf7ee75a88f17bdedba0337c9a4de55bf9b","observation_id":"9d99eff0-a1ba-4eca-8307-2eddb8d96d78","resolution":{"observed_at":"2026-08-11T22:52:56.665037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.668348Z","title":"Learning to compress videos without computing motion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.668348Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:27307b44387c1186e5efcd03f80d01724ce7c8e8670b338afc49edf58db7ac83","observation_id":"24661f19-1970-490a-9b88-e9929ad3a9c0","resolution":{"observed_at":"2026-08-11T22:52:56.668348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.671312Z","title":"Metamers of the ventral stream,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.671312Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a4f1e851ca360cae72162ae2db5856cb66516a48a15ed3f3d9dc8166f7f62d88","observation_id":"a43b4c72-71a9-4bd0-8139-3334486d6976","resolution":{"observed_at":"2026-08-11T22:52:56.671312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.675336Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.675336Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6fad6433f7d2d7d49d05a460c43819b8eaddf1a87a1495246ad4235b46fc9b71","observation_id":"7ca6217e-6709-4089-b071-e9a7eb895e07","resolution":{"observed_at":"2026-08-11T22:52:56.675336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.680185Z","title":"Design of linear equalizers optimized for the structural similarity index,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.680185Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:57cfe05ce672dae9820be654c7e0916afbeb171cb819af796be9a0c71c237755","observation_id":"c360995b-71e5-4bcd-aa55-c3e8d3e7d265","resolution":{"observed_at":"2026-08-11T22:52:56.680185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"file/9446185","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:58.778110Z","title":"Mcvd - masked conditional video diffusion for prediction, generation, and interpolation,","venue":null,"work_id":"4b30744b-2c63-48e6-a3ba-eec32f2afa01","year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.683771Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:4dab3a2375dfa588b89ee51b74d5d537ab6e4f9952dc468a10cf9b6e1116747d","observation_id":"593dbdda-ebab-4872-bd7f-e27627c6aee9","resolution":{"observed_at":"2026-08-11T22:52:58.783751Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.689735Z","title":"High-fidelity generative image compression,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.689735Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:46b0b96eda1ac2ee9557af45f1c53396aab78993a5f1ac0e13c6a6e406b5cc07","observation_id":"ce2c933e-77c1-4d0f-af26-7869b8d3bb03","resolution":{"observed_at":"2026-08-11T22:52:56.689735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.695929Z","title":"Lossy image compression with conditional dif- fusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.695929Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:bae2eef27c1ac4ce7357e7563ec27d18946ce83c5704fc96fef11163225ec9a7","observation_id":"130950fa-d2c4-4b36-b984-1c6c050f3725","resolution":{"observed_at":"2026-08-11T22:52:56.695929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.699809Z","title":"The level weighted structural similarity loss: A step away from mse,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.699809Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a417e64b97e9a34effcc5de63b73f837045a23112804304a7a821d4baa19b224","observation_id":"8e19ff67-0975-4b31-aed2-38740902a84b","resolution":{"observed_at":"2026-08-11T22:52:56.699809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.702845Z","title":"Deep generative adversarial compression artifact removal,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.702845Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c4ab052c151dac7203d250b8453e4c62b4b50bb8859f4435ce15cdd7c2dbdafb","observation_id":"91420fe4-5864-4aa5-8be7-8879dc3ec437","resolution":{"observed_at":"2026-08-11T22:52:56.702845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.707147Z","title":"Loss functions for pose guided person image generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.707147Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0dda8f0012e051b61c70b2dc3b11e8979d418d6d26369bd3021dfe7b41f6347e","observation_id":"9729858d-2f49-43bf-a27b-40c2c0cfdb49","resolution":{"observed_at":"2026-08-11T22:52:56.707147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.710596Z","title":"The statistics of natural images,","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.710596Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:31bf25e7c2057eea1e69ae7be0f7641f07403a38f8f445865b40cd36c4ffcee5","observation_id":"14145361-ebc5-47c4-8419-99a00c08a664","resolution":{"observed_at":"2026-08-11T22:52:56.710596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.714137Z","title":"Image information and visual quality,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.714137Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:93b559ef8de2954d821c44d9b6db77c8476700bc02a18429ff1f474c2f71c33a","observation_id":"521f3593-d6c0-42c8-9ccb-51777bcee59d","resolution":{"observed_at":"2026-08-11T22:52:56.714137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.718140Z","title":"Distributions of the Two-Dimensional DCT Coefficients for Images,","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.718140Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:de68186914c5143fc2da4ff08bce0bffb512f02b6884963e2398566014c13466","observation_id":"206e7648-f5de-43ad-95c5-8cf5a5ae924f","resolution":{"observed_at":"2026-08-11T22:52:56.718140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.721232Z","title":"A theory for multiresolution signal decomposition: the wavelet representation,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.721232Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:5c5e81af5cc073ecfd5e12ba5cb3ae5cfec1cca779d3bfd272ea1df607bffb46","observation_id":"8fb8f351-68c0-4cbd-8858-4d4ddb9621f6","resolution":{"observed_at":"2026-08-11T22:52:56.721232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.724475Z","title":"Scale mixtures of gaussians and the statistics of natural images,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.724475Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:ca2164d14e3e640eb6132f3f72c850e2b2faa67f93f9319a88e98834d9b64c65","observation_id":"d746ed88-d8d6-4a29-877b-b9fe5c9ce603","resolution":{"observed_at":"2026-08-11T22:52:56.724475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.727814Z","title":"VMAF: The journey continues,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.727814Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6524968ae276e759e26c9aea3cf53adec86ef218b32170a3f4c2781c812b5eed","observation_id":"cdf6242a-53c7-4d85-b2ee-8763ea24dcd4","resolution":{"observed_at":"2026-08-11T22:52:56.727814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.730994Z","title":"RAPIQUE: Rapid and accurate video quality prediction of user generated content,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.730994Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:82a7cc941c8c0d345ad765690981e3d41f599db701216d96e02cd13e603fbd83","observation_id":"82311eb6-8e70-41cb-98f5-400fa0e1fafa","resolution":{"observed_at":"2026-08-11T22:52:56.730994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.734188Z","title":"No-reference quality assessment of variable frame-rate videos using temporal band- pass statistics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.734188Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:928a26ab8d91f1c7fcedb9cb043a43065982542d8286d1fa22589c1ad299abe9","observation_id":"18557c1c-9a3b-40f8-9b35-96c5a8ff8be9","resolution":{"observed_at":"2026-08-11T22:52:56.734188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.737297Z","title":"Making a “completely blind","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.737297Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:69f7917665fbcc0c88e2eb04cfb7bd66a85189fb643913ec3f689795e96353c5","observation_id":"95262522-37a6-40ae-ade7-1189545de7f0","resolution":{"observed_at":"2026-08-11T22:52:56.737297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.740216Z","title":"No-reference image quality assessment in the spatial domain,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.740216Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:8c071b71912854f5e94656162f27cf62a2ec619ef5e7e23823a9df93f6724e48","observation_id":"4f3496f7-760f-476c-9729-2af149c153a1","resolution":{"observed_at":"2026-08-11T22:52:56.740216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.743359Z","title":"Blind image quality assessment using joint statistics of gradient magnitude and laplacian features,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.743359Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a37b13426df5c8a067c2d81d5137552d15797cc88c22c5dd6ebcfc0778d257ba","observation_id":"f73c80f3-fbd5-4f7f-a286-cfdb7b0dc4c6","resolution":{"observed_at":"2026-08-11T22:52:56.743359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.746270Z","title":"A completely blind video quality evaluator,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.746270Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:d16dd2a673b5830ead32b546efff96be3952437fa4a63efb753dcc1d248fc85b","observation_id":"594f22f4-2123-4dec-94b6-a32ec0015fcc","resolution":{"observed_at":"2026-08-11T22:52:56.746270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.749200Z","title":"No- reference quality assessment of tone-mapped HDR pictures,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.749200Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0485555d1357484c7037aeac868201981b47a9d5c1c17b0b6da848b400601578","observation_id":"113544b8-3455-43ea-aaeb-e2c724655731","resolution":{"observed_at":"2026-08-11T22:52:56.749200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.752157Z","title":"Perceptual quality prediction on authentically dis- torted images using a bag of features approach,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.752157Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:2b6dc381860ec6cac912bdb4a24a3f520ecad85b40a81be8a037322c01f32524","observation_id":"80037957-89e8-460e-8834-fb21b5cc2a4c","resolution":{"observed_at":"2026-08-11T22:52:56.752157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.755029Z","title":"Blind video quality assessment via space-time slice statistics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.755029Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:3da14406c29abab3902b08e71a5011f1e9ba78a9cd2d9c13ef537b74a1113aff","observation_id":"19a41fe2-8547-4eb7-9f0f-bda3d7dfc4b9","resolution":{"observed_at":"2026-08-11T22:52:56.755029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.758604Z","title":"Blind prediction of natural video quality,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.758604Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:f84d02b1a00953f51dcc2ad9c7151518ad708197552e44f66f23c5372b69e09f","observation_id":"f816015f-33ed-4934-ac72-aac9f6f461ba","resolution":{"observed_at":"2026-08-11T22:52:56.758604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.762262Z","title":"Spatiotemporal statistics for video quality assessment,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.762262Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c21758c98c43f95feeb88d1b16ca38ff46192305b6ad785e5b77f49b6fff9423","observation_id":"e3a29fb2-d6a8-433d-a053-bfd93cb7f392","resolution":{"observed_at":"2026-08-11T22:52:56.762262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.766148Z","title":"Hastie, R","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.766148Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:edb75d7586a0a9ff2e80426feca76021655fa07fbe199102c2f8bd92bec1e808","observation_id":"dd4ce51a-f883-410f-b181-d558a392218a","resolution":{"observed_at":"2026-08-11T22:52:56.766148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.770163Z","title":"Deep video quality asses- sor: From spatio-temporal visual sensitivity to a convolutional neural aggregation network,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.770163Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:fd442d52402c847fefd5e2c832cc8a780c6f9a65bf79487e7dd7a1093ffd9319","observation_id":"3c2ae740-b067-4f2c-974d-547536b9d106","resolution":{"observed_at":"2026-08-11T22:52:56.770163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.774280Z","title":"C3dvqa: Full-reference video quality assessment with 3D convolutional neural network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.774280Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:fb0dbebf0abdc994d43cafb6b80fd44cf8d275b5b8ffe079fa311cc16d97fb64","observation_id":"42836acf-188c-4abd-88f1-2a842b90d1a2","resolution":{"observed_at":"2026-08-11T22:52:56.774280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08595","last_updated":"2023-11-20T10:37:01Z","snapshot_observed_at":"2026-08-13T16:39:11.195414Z","submitted_at":"2022-02-17T11:22:58Z","title":"RankDVQA: Deep VQA based on Ranking-inspired Hybrid Training","version":3},"cited_work":{"arxiv_id":"2202.08595","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.08595","snapshot_observed_at":"2026-08-11T22:52:58.704860Z","title":"RankDVQA: Deep VQA based on Ranking-inspired Hybrid Training","venue":"eess.IV","work_id":"fc61479c-22b8-4f37-b9c7-4edb3d5c8662","year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.779978Z"},"links":{"cited_paper":"/paper/2202.08595","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0423ec6d6b59c135469ca279fdb188ca46a11f1922c0603131ba30c3f779167f","observation_id":"88ad5d66-4d53-4c2d-959d-9546359639c8","resolution":{"observed_at":"2026-08-11T22:52:58.709030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.785804Z","title":"No-reference video quality evaluation by a deep transfer CNN architecture,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.785804Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:3a0b2bb9115f965857465aa77a990a2e22c5b766e4def67f0c61f3c84752031a","observation_id":"2611e236-0ee7-45fc-b24a-cda402078c31","resolution":{"observed_at":"2026-08-11T22:52:56.785804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14047","last_updated":"2022-10-20T07:26:06Z","snapshot_observed_at":"2026-08-13T15:53:20.955856Z","submitted_at":"2022-04-29T12:45:21Z","title":"A Deep Learning based No-reference Quality Assessment Model for UGC Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14047","snapshot_observed_at":"2026-08-11T22:52:56.789780Z","title":"A deep learning based no- reference quality assessment model for UGC videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.789780Z"},"links":{"cited_paper":"/paper/2204.14047","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:461662a3df27b59a0b6bec6d9485f96d5bedc6ad49c379c35faa259df3178339","observation_id":"73054bf1-506a-4c4d-b789-aa5bfdd6f7f2","resolution":{"observed_at":"2026-08-11T22:52:56.789780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.794140Z","title":"Deep neural networks for no-reference video quality assessment,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.794140Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:44b3480462e519d814135e06ceb1e40305bfa44e8257a018f06e27c9754cd462","observation_id":"d8ebd3fb-d3f1-42e8-86b0-25f08300151f","resolution":{"observed_at":"2026-08-11T22:52:56.794140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.798241Z","title":"No-reference video quality assessment with 3d shearlet transform and convolutional neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.798241Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:9401f1517b421ea615286815253fdb8989e32fbf1adc420537b1359ff7490d18","observation_id":"5d2766a5-11bb-459c-b982-82c7bc834fa8","resolution":{"observed_at":"2026-08-11T22:52:56.798241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.801603Z","title":"Blind video quality assessment with weakly supervised learning and resampling strategy,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.801603Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:68d68464e13c66ee39cf1aa2bf7275c911b7e41b023c262ec11c1e5b2fd46d68","observation_id":"4df24ebd-89f8-444f-9259-71c57d9159b9","resolution":{"observed_at":"2026-08-11T22:52:56.801603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07104","last_updated":"2021-11-13T12:24:08Z","snapshot_observed_at":"2026-08-13T17:34:40.739732Z","submitted_at":"2021-11-13T12:24:08Z","title":"A strong baseline for image and video quality assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07104","snapshot_observed_at":"2026-08-11T22:52:56.808582Z","title":"A strong baseline for image and video quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.808582Z"},"links":{"cited_paper":"/paper/2111.07104","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:5d14db1cede993032ccffaa301f22db1bcf3d0513c54acc2d81a48ee271a40a3","observation_id":"2538d2d8-a790-404e-a30e-e53a3a7a0e17","resolution":{"observed_at":"2026-08-11T22:52:56.808582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.811791Z","title":"End-to-end blind quality assessment of compressed videos using deep neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.811791Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a766528e63be6bb8e7df619ee98aaa5adfa5298827aeafcde5fad56e24a24f26","observation_id":"2e9f5a5c-3027-4b80-adb6-00fe922a7f15","resolution":{"observed_at":"2026-08-11T22:52:56.811791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.815081Z","title":"No-reference video quality assessment based on the tempo- ral pooling of deep features,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.815081Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c4fee145563e2e95bb6112861e28e14ea0e938272d5b315776aa50f2aa859f56","observation_id":"18adf7aa-1657-4f52-b4ce-8574eeb50bf0","resolution":{"observed_at":"2026-08-11T22:52:56.815081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.818060Z","title":"Semantic information oriented no- reference video quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.818060Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:bc41485f30caa984d9fec50362126de93d1fd8e617f71905e7aa50f10bc934d7","observation_id":"a72e211c-08b7-433b-9c77-6a4dcb2fab0d","resolution":{"observed_at":"2026-08-11T22:52:56.818060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.821102Z","title":"No-reference video quality assessment using multi-pooled, saliency weighted deep features and decision fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.821102Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e18a1fcc767fd4e77d428657f050423a9a9cec7d615d506555f987a6257ab6b3","observation_id":"877dd246-38b5-42c5-835c-f8b4753f07cb","resolution":{"observed_at":"2026-08-11T22:52:56.821102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.825018Z","title":"Blind natural video quality prediction via statistical temporal features and deep spatial features,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.825018Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:5132e0fba15a7eecb3eb2209a06e0ca285405b795cc7c694e305e36b1f35c289","observation_id":"60d99355-e4cf-432b-9220-17ce63175050","resolution":{"observed_at":"2026-08-11T22:52:56.825018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.07966","last_updated":"2021-03-01T14:25:17Z","snapshot_observed_at":"2026-07-06T08:45:03.591439Z","submitted_at":"2019-12-17T12:26:32Z","title":"KonVid-150k: A Dataset for No-Reference Video Quality Assessment of Videos in-the-Wild","version":2},"cited_work":{"arxiv_id":"1912.07966","doi":null,"metadata_source":"pith","pith_arxiv_id":"1912.07966","snapshot_observed_at":"2026-08-11T22:52:58.661563Z","title":"KonVid-150k: A Dataset for No-Reference Video Quality Assessment of Videos in-the-Wild","venue":"cs.MM","work_id":"b9a15e7b-7d10-47e8-ba0b-731ee8c5db75","year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.830127Z"},"links":{"cited_paper":"/paper/1912.07966","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:3e0c5f2d660d8595f20785bac7122d3b8c73bf1b2adc8d64d541d6e4d05d9595","observation_id":"5c0d4e43-f88d-4498-bc9a-f39713c46576","resolution":{"observed_at":"2026-08-11T22:52:58.665462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.834212Z","title":"No-reference video quality assessment via pretrained cnn and lstm networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.834212Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:8e2a700f4f433beb1708ad01d511c99c534a6afb466dd4d149df7bad438b5183","observation_id":"db6b73fb-62ef-428e-993b-f68785517e0e","resolution":{"observed_at":"2026-08-11T22:52:56.834212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.838824Z","title":"Quality assessment of in-the-wild videos,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.838824Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:58a49877bfca226ca70fd8c6ddbcdfdd69898bbf25694089704dc71c4eb73573","observation_id":"cc336c0e-05f3-479b-b1c6-ea32c6d7be4b","resolution":{"observed_at":"2026-08-11T22:52:56.838824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.842159Z","title":"Rirnet: Recurrent-in- recurrent network for video quality assessment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.842159Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:f1951dc8f0c0747c789347de00fc369a3a804a24c7358f97cc3414dd7d372785","observation_id":"1294f4e6-06e0-49f4-899c-92267145f1c4","resolution":{"observed_at":"2026-08-11T22:52:56.842159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.845778Z","title":"Blindly assess quality of in-the-wild videos via quality-aware pre-training and motion perception,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.845778Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6243e5ca46bf1ef2cef145e94498cb1a7e1a62572886d0eb8e11e00d9386d238","observation_id":"1556586e-f49d-49a5-aea6-68edac495edd","resolution":{"observed_at":"2026-08-11T22:52:56.845778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.849659Z","title":"Study on no-reference video quality assessment method incorporating dual deep learning networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.849659Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0a3d43a5f4c341285146fedaf49ccfcd095d038f3367a8840a10650e2d8408ce","observation_id":"4ebf3c79-e97d-4164-96cc-5fd8dc958c1f","resolution":{"observed_at":"2026-08-11T22:52:56.849659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.861745Z","title":"Deep neural networks for end-to-end spatiotemporal video quality prediction and aggregation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.861745Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:3b81b604027bbe3111e43cc24ade55871f856b72315d7b0085119c16c9d971c6","observation_id":"16876726-9e9c-4f30-b664-9f84886b51b7","resolution":{"observed_at":"2026-08-11T22:52:56.861745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.873449Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.873449Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:2977217dc5c9d872dc8d55d663e5c2b6f48a0e7b038d84c72329d5466402c1e9","observation_id":"9cb429bb-29bc-4a1e-ba76-670cd9b3c92e","resolution":{"observed_at":"2026-08-11T22:52:56.873449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.878951Z","title":"Why are deep repre- sentations good perceptual quality features?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.878951Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:5c1c52c4b7e7f758697aa8cffaf4507340c63e7b61a95bd5e0a3a1de457a716a","observation_id":"d8d873a0-672b-401b-ab2e-19a33dd96233","resolution":{"observed_at":"2026-08-11T22:52:56.878951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.08119","last_updated":"2023-06-22T12:51:58Z","snapshot_observed_at":"2026-08-14T08:45:33.992199Z","submitted_at":"2022-07-17T09:07:33Z","title":"FloLPIPS: A Bespoke Video Quality Metric for Frame Interpoation","version":2},"cited_work":{"arxiv_id":"2207.08119","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.08119","snapshot_observed_at":"2026-08-11T22:52:58.642403Z","title":"FloLPIPS: A Bespoke Video Quality Metric for Frame Interpoation","venue":"eess.IV","work_id":"4a4a9b45-3c54-4793-8844-f2a526850b72","year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.887702Z"},"links":{"cited_paper":"/paper/2207.08119","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:9253d79c97bf962c2b67ea62ed680f5bd689e79b74891b4161acbf594f195df3","observation_id":"565afe34-530b-4646-9476-c5ec4a4cf0c5","resolution":{"observed_at":"2026-08-11T22:52:58.646674Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.893052Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.893052Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:f350059afd8b6dcca41a457d08b60cf65f1f87399ec8dcef6b4ba68211992211","observation_id":"c8359fd8-324f-417b-b55a-c1e8db27f2c6","resolution":{"observed_at":"2026-08-11T22:52:56.893052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.898139Z","title":"Gate-variants of gated recurrent unit (GRU) neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.898139Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:85fd59d2a38e41f7e717f42796023adda44480c8833c86c6018960691a39e1cd","observation_id":"329b2444-194f-4cb3-96cc-af5ffd1d2ba0","resolution":{"observed_at":"2026-08-11T22:52:56.898139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14774","last_updated":"2023-10-27T19:54:45Z","snapshot_observed_at":"2026-08-16T10:22:37.768711Z","submitted_at":"2022-08-31T11:20:20Z","title":"2BiVQA: Double Bi-LSTM based Video Quality Assessment of UGC Videos","version":3},"cited_work":{"arxiv_id":"2208.14774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.14774","snapshot_observed_at":"2026-08-11T22:52:58.624512Z","title":"2BiVQA: Double Bi-LSTM based Video Quality Assessment of UGC Videos","venue":"eess.IV","work_id":"7f6a4597-e490-4c87-b688-baf5edd8f8c9","year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.902279Z"},"links":{"cited_paper":"/paper/2208.14774","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c8503c839d86ee0e02c6d8227c7e3695a6854116ef3950f73f63e72eadc3f011","observation_id":"03457aa7-91dc-49c9-8262-848309dde54a","resolution":{"observed_at":"2026-08-11T22:52:58.629443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.905983Z","title":"Cbam: Convolutional block attention module,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.905983Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0902d958668c2e2219b3f8c4c8a5b007e371e715462a3a0904942150cf5272de","observation_id":"f0f5b289-c517-4616-beff-f975c7603cbd","resolution":{"observed_at":"2026-08-11T22:52:56.905983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.910401Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.910401Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c3cf4062a23e400dc2af9cb3c13499f65a71e4d8a7807f3838a265f7d32f2757","observation_id":"0dfb98bb-2621-483d-99cf-e92f2e7d4e41","resolution":{"observed_at":"2026-08-11T22:52:56.910401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.914982Z","title":"Attention based network for no-reference ugc video quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.914982Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6a71a257397188ff4733af1237ae2db51909f00a005579b6f1d735da9cdeb157","observation_id":"5f916328-08d7-4307-bf3d-8e2e0ef5932f","resolution":{"observed_at":"2026-08-11T22:52:56.914982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.918422Z","title":"Learning gen- eralized spatial-temporal deep feature representation for no-reference video quality assessment,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.918422Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:df7708e5c24fe300d920f55ec177205125c199aab4d3cfeff811cfcbb8320b29","observation_id":"a3f2967e-d441-43a0-b036-0658ce1e95bd","resolution":{"observed_at":"2026-08-11T22:52:56.918422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T22:52:56.921489Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.921489Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6d4098fa21a065e137db6289d12e56f90a74d9e382985401b41e9753f48de9af","observation_id":"63178da1-8992-4837-a74e-03db224497cc","resolution":{"observed_at":"2026-08-11T22:52:56.921489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.925013Z","title":"Swin transformer: Hierarchical vision transformer using shifted win- dows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.925013Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:8a528365d0fa893432f32874932436588edf28a4757fc2d5826812a2461a9494","observation_id":"59c8e90e-2a0f-4686-bdae-2c2fb50451ff","resolution":{"observed_at":"2026-08-11T22:52:56.925013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.928261Z","title":"Long short-term convolutional transformer for no-reference video quality assessment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.928261Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:c556b0fecace0f7bd269be7d937817afacc248d8549029feba671a2af2544051","observation_id":"f1a686c5-285c-4042-af71-8ac27c8fe9d5","resolution":{"observed_at":"2026-08-11T22:52:56.928261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09635","last_updated":"2021-08-22T04:53:02Z","snapshot_observed_at":"2026-07-06T11:40:26.963934Z","submitted_at":"2021-08-22T04:53:02Z","title":"StarVQA: Space-Time Attention for Video Quality Assessment","version":1},"cited_work":{"arxiv_id":"2108.09635","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.09635","snapshot_observed_at":"2026-08-11T22:52:58.591152Z","title":"StarVQA: Space-Time Attention for Video Quality Assessment","venue":"cs.CV","work_id":"445fc394-7306-442c-93b9-2190220b6213","year":2021},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.931987Z"},"links":{"cited_paper":"/paper/2108.09635","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:6bdca244605563c347e518cf2018304590c97c401e31c1ecf0b7141e9121dc88","observation_id":"0c3669f7-1c31-4871-a14a-9bf9ed6e9641","resolution":{"observed_at":"2026-08-11T22:52:58.596012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09853","last_updated":"2022-06-20T15:31:27Z","snapshot_observed_at":"2026-08-13T15:53:25.723505Z","submitted_at":"2022-06-20T15:31:27Z","title":"DisCoVQA: Temporal Distortion-Content Transformers for Video Quality Assessment","version":1},"cited_work":{"arxiv_id":"2206.09853","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.09853","snapshot_observed_at":"2026-08-11T22:52:58.572612Z","title":"DisCoVQA: Temporal Distortion-Content Transformers for Video Quality Assessment","venue":"cs.CV","work_id":"501f0385-ed16-4cdb-b68d-b28a55c1b70a","year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.935914Z"},"links":{"cited_paper":"/paper/2206.09853","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:f51d96c7695158d16780df0f8b547968147fea838367453dbc14d2ef63815bd1","observation_id":"d195751d-d3d9-4345-8484-488b83328342","resolution":{"observed_at":"2026-08-11T22:52:58.578501Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02595","last_updated":"2022-07-06T11:11:43Z","snapshot_observed_at":"2026-08-14T12:55:17.482199Z","submitted_at":"2022-07-06T11:11:43Z","title":"FAST-VQA: Efficient End-to-end Video Quality Assessment with Fragment Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02595","snapshot_observed_at":"2026-08-11T22:52:56.939874Z","title":"Fast-VQA: Efficient End-to-end Video Quality Assessment with Fragment Sampling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.939874Z"},"links":{"cited_paper":"/paper/2207.02595","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:a2526070a98c02974acf60c6db4d3480959601733beb899073ab5fec396f4893","observation_id":"c9bda320-c56b-4441-91c8-8f007d8eca9c","resolution":{"observed_at":"2026-08-11T22:52:56.939874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15367","last_updated":"2025-01-24T19:51:48Z","snapshot_observed_at":"2026-08-14T00:05:34.405270Z","submitted_at":"2023-05-24T17:22:39Z","title":"SAMScore: A Content Structural Similarity Metric for Image Translation Evaluation","version":2},"cited_work":{"arxiv_id":"2305.15367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15367","snapshot_observed_at":"2026-08-11T22:52:58.542607Z","title":"SAMScore: A Content Structural Similarity Metric for Image Translation Evaluation","venue":"cs.CV","work_id":"19b8f8b2-f699-451b-a0af-ffcd5eed71bd","year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.943439Z"},"links":{"cited_paper":"/paper/2305.15367","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:3fb13315ac413e964fff370a5492373c0869401cca6f5b95840e0a42006aee59","observation_id":"10b4bcf8-740e-4e48-8efa-68fc309e3e44","resolution":{"observed_at":"2026-08-11T22:52:58.547752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04455","last_updated":"2023-07-10T10:07:11Z","snapshot_observed_at":"2026-08-13T10:59:10.684022Z","submitted_at":"2023-07-10T10:07:11Z","title":"SAM-IQA: Can Segment Anything Boost Image Quality Assessment?","version":1},"cited_work":{"arxiv_id":"2307.04455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.04455","snapshot_observed_at":"2026-08-11T22:52:58.524599Z","title":"SAM-IQA: Can Segment Anything Boost Image Quality Assessment?","venue":"cs.CV","work_id":"977f7ec3-f4d1-444e-80a6-a30659c1ee6e","year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.946668Z"},"links":{"cited_paper":"/paper/2307.04455","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:0fb0efea0f72a92c71969c15b32f306730926c3fbd7243eb59a4d8173db39e13","observation_id":"09be8b34-399d-49ca-bcb2-2c570dc6b9e3","resolution":{"observed_at":"2026-08-11T22:52:58.529228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.951636Z","title":"Cover: A comprehensive video quality evaluator,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.951636Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:fbdb6d3fc7007075d14c91ce1d5c0cbc3424d7f901dd7ff945122f101dde474a","observation_id":"05498416-7ec3-4bbd-8c15-1c2f0091fc90","resolution":{"observed_at":"2026-08-11T22:52:56.951636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.955326Z","title":"Ptm-vqa: Efficient video quality assessment leveraging diverse pretrained models from the wild,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.955326Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:de0b5d01c0e1de2452b8e367be9c59da40fdf08f8d3b0e4c8c408854357c8c1c","observation_id":"48b54bb5-df20-4270-8c66-1da99852e69a","resolution":{"observed_at":"2026-08-11T22:52:56.955326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.958731Z","title":"Exploring clip for assessing the look and feel of images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.958731Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:ee79eecae425efac387ca3fcef6da0304f9786b0efbede785298faa0b63f5d56","observation_id":"e3e7bbb0-bb8a-495b-9701-d1353ea3148a","resolution":{"observed_at":"2026-08-11T22:52:56.958731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13269","last_updated":"2023-02-26T08:46:07Z","snapshot_observed_at":"2026-08-13T12:37:25.343685Z","submitted_at":"2023-02-26T08:46:07Z","title":"Exploring Opinion-unaware Video Quality Assessment with Semantic Affinity Criterion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13269","snapshot_observed_at":"2026-08-11T22:52:56.962620Z","title":"Exploring opinion-unaware video quality assessment with semantic affinity criterion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.962620Z"},"links":{"cited_paper":"/paper/2302.13269","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:765f12203d34ec1a1d7b0909b999c704a2f3f0a67134318951a7949e81e6e80a","observation_id":"6d2fbf5a-7958-4da8-b0e9-39b04c681c02","resolution":{"observed_at":"2026-08-11T22:52:56.962620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:52:56.966362Z","title":"Towards explainable in-the-wild video quality assessment: a database and a language-prompted approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.966362Z"},"links":{"citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:82713b7f85f713f3dce7b52215f7c20541c9186b0697fc8a7e1679305508ac2a","observation_id":"2dbc6b5e-6164-41b0-b996-75a480c94931","resolution":{"observed_at":"2026-08-11T22:52:56.966362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14181","last_updated":"2024-01-01T14:48:48Z","snapshot_observed_at":"2026-08-14T19:50:32.713529Z","submitted_at":"2023-09-25T14:43:43Z","title":"Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14181","snapshot_observed_at":"2026-08-11T22:52:56.969627Z","title":"Q-bench: A benchmark for general-purpose foundation models on low-level vision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:56.969627Z"},"links":{"cited_paper":"/paper/2309.14181","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:b1c33cdc14784b72ddb31339a53bb1f8eb33cd629768f72699cc309c3c342ba6","observation_id":"b43f0a02-66a8-49f5-a8e7-2bb071b663f6","resolution":{"observed_at":"2026-08-11T22:52:56.969627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-13T02:24:06.564478Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":91,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":294},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 294 outbound references and 8 inbound Pith citation observations for arXiv:2412.04508."}