{"as_of":"2026-08-16T05:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c81dcad8861f92073a2143ee168beb8044e746b25862c62332e4711999234078","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:12:19.566619Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.05309/citation-record","integrity":"/paper/2505.05309/integrity","json":"/paper/2505.05309/citation-record.json","paper":"/paper/2505.05309"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.542568Z","title":"https://vcgit.hhi.fraunhofer.de/ jvet/VVCSoftware_VTM","venue":null,"work_id":"ba51328b-6079-4a12-9852-b2d9780155bd","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.272093Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:56b6b076823b37f8e907f3dd72184ea5c2160c65f0d75954b7bf9041a370d89c","observation_id":"f5be6fdc-47f5-4f36-b6e7-f7e1347bdcca","resolution":{"observed_at":"2026-08-15T23:12:20.547417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.527886Z","title":"https://github.com/sanghyun- son/bicubic_pytorch","venue":null,"work_id":"ddbe6015-744c-4b30-b227-eb2906cc6db8","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.277881Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:8f2eaaeb949958a7331ba6d207c7f7307c10f3da9ded79d7af49f1ff712d4b03","observation_id":"a82b10f6-4d0a-4bd1-925d-11702910cf29","resolution":{"observed_at":"2026-08-15T23:12:20.532515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.282552Z","title":"Scale-space flow for end-to-end optimized video compression","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.282552Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:34eacb936f1348757aac626374361fbb1536d18549b309e49d16d21249f450c6","observation_id":"65ea18e4-d9a6-4b22-b7b8-1875374a3b96","resolution":{"observed_at":"2026-08-15T23:12:19.282552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.504810Z","title":"Hierarchical B-frame Video Coding Using Two- Layer CANF without Motion Coding","venue":null,"work_id":"9007e8a2-931e-4c5d-a274-a48207237798","year":2023},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.287475Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:47948bd19e0121c8df77b8a566c168d2a6ad6367e4fc0854685c56c1f9e43d50","observation_id":"692a5bff-2969-459d-8b93-62509d0a34f8","resolution":{"observed_at":"2026-08-15T23:12:20.509309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.490778Z","title":"Variational image compres- sion with a scale hyperprior","venue":null,"work_id":"9b650683-3e9d-47b3-8942-c738f0931820","year":2018},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.292613Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:d0065111735a420ee9bf09a337790f6ceff961268557775363b9cb2e00c3cc51","observation_id":"76f2c1fa-b8c4-4508-838d-a659b9a4f784","resolution":{"observed_at":"2026-08-15T23:12:20.495438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.477049Z","title":"LSSVC: A Learned Spatially Scalable Video Coding Scheme","venue":null,"work_id":"266d867d-0a75-4a3e-aae5-6d0211c64520","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.297411Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:93d39d878129df124d240e16c41e84142a61f92ad7921345d0e5aa7d0c05e6bb","observation_id":"1a740624-38bc-4055-80ef-2f5cbd7e9123","resolution":{"observed_at":"2026-08-15T23:12:20.481519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.462719Z","title":"Common test conditions and software reference configurations","venue":null,"work_id":"4f790717-f5b8-4ca8-8432-5d1b11cbfaab","year":2013},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.302333Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:d748e9e5b8770903e35b247be0551ff77de6f61c906c3cebcae52690b09cd763","observation_id":"2c7c9007-5baa-4895-9e05-1f38c845e7ed","resolution":{"observed_at":"2026-08-15T23:12:20.467124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.447427Z","title":"Overview of SHVC: Scalable Extensions of the High Efficiency Video Coding Standard","venue":null,"work_id":"3306e48f-0d33-47dd-9ee0-0bf16e68ae59","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.307289Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:34f30ac1ef504366670720e999dba80dfd117a86cafabdc8ebc5d2fb209f7022","observation_id":"5af12c11-f4ee-4a6d-8da5-fffeabb38677","resolution":{"observed_at":"2026-08-15T23:12:20.453265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.433378Z","title":"Overview of the Versatile Video Coding (VVC) Standard and its Applica- tions","venue":null,"work_id":"d0338fbd-4a42-4f5a-8bb2-31b8253176d3","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.311701Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:bea58adc03d925a0f7051c8a71b2ed3cad00a98c63513ddb3822c9630c3e2199","observation_id":"4ac9454a-17de-4420-aab4-1ceab17ddf28","resolution":{"observed_at":"2026-08-15T23:12:20.438135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.418311Z","title":"BasicVSR: The Search for Essential Components in Video Super-Resolution and Beyond","venue":null,"work_id":"8b712da5-e2a1-4bfb-9ba7-975d6a6a39ea","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.315979Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:2cae6ac8ff9a0692232100914d0f12a0606e4de4c94ce92f3c8d8fb3e708b1d7","observation_id":"5ba9cac8-e6bb-4740-b3bb-85f027e30d91","resolution":{"observed_at":"2026-08-15T23:12:20.423722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.403186Z","title":"BasicVSR++: Improving Video Super- Resolution with Enhanced Propagation and Alignment","venue":null,"work_id":"cc9e1172-26b6-4de6-acd7-c1d116ab20f1","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.320507Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:a1cc545397140ca2b93563df4685491eb4d56a67afee03c6149a617e74e65170","observation_id":"0316c155-0fc2-4765-aca9-3ef45bf6cbfe","resolution":{"observed_at":"2026-08-15T23:12:20.408740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.389746Z","title":"NeRV: Neural Representations for Videos","venue":null,"work_id":"6cbeeb68-9ccd-4e08-a70c-ad133a189b17","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.325347Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c1de77d127d22e5fcb5dc340809cec4666e25aace427c937131844807c415c38","observation_id":"3eefac5b-5c19-4ce9-8423-6728764e1efe","resolution":{"observed_at":"2026-08-15T23:12:20.394191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.375705Z","title":"HNeRV: A Hybrid Neural Representation for Videos","venue":null,"work_id":"181307ab-4c39-43bc-998a-c901c39d012f","year":2023},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.329718Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:194b0cae29f66d8360150463f2e2d43f2012ed8171f98670741eb239a7ed9963","observation_id":"6320173e-d0da-408c-a765-6012084d06f7","resolution":{"observed_at":"2026-08-15T23:12:20.380108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.361242Z","title":"Elements of information theory","venue":null,"work_id":"829a5563-cedd-4f84-b123-595d4c478299","year":1999},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.334033Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:3d720eb0a8a7ea3f7ab6a8a96f655613f13b90941a3c6385c683b07ad3c58826","observation_id":"aa57be26-a314-4633-bdf3-3a2af628109c","resolution":{"observed_at":"2026-08-15T23:12:20.366214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.347748Z","title":"Neural Inter-Frame Com- pression for Video Coding","venue":null,"work_id":"b6b7918b-2c9e-4ec0-9f2e-3ad0e0765714","year":2019},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.338417Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c962edeb7d7e0bd574e618d9dfd6d54f7a2655b67dacf118bf723801b9cc1a0b","observation_id":"71c0a0da-a077-4c22-8709-373c756131e0","resolution":{"observed_at":"2026-08-15T23:12:20.352202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.333249Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":null,"work_id":"17d52044-58fa-47b3-a348-139685914533","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.342532Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:23472107bf9d815ef70abf498abd055d76609417c4548439aba866abe8393261","observation_id":"19bc951b-8083-4242-8032-e426076dbf9e","resolution":{"observed_at":"2026-08-15T23:12:20.338709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1311.2540","last_updated":"2014-01-06T11:35:10Z","snapshot_observed_at":"2026-08-14T23:55:44.550657Z","submitted_at":"2013-11-11T19:21:53Z","title":"Asymmetric numeral systems: entropy coding combining speed of Huffman coding with compression rate of arithmetic coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1311.2540","snapshot_observed_at":"2026-08-15T23:12:19.346776Z","title":"Asymmetric numeral systems: entropy coding combining speed of Huffman coding with compression rate of arithmetic coding","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.346776Z"},"links":{"cited_paper":"/paper/1311.2540","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:faa550408400a3ca3b6fd37d42a1f12a1e34a34d2767e33670b3da49b4e4a3d6","observation_id":"4afd99ce-a4f4-4ba9-ba01-dcbcbaa19cec","resolution":{"observed_at":"2026-08-15T23:12:19.346776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.318993Z","title":"Comparison of the H.263 and H.261 video compression stan- dards","venue":null,"work_id":"0e4fa92d-d773-43b4-b490-96bb54eab25b","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.351471Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:4185bbc4a4e8fbbff0c736b108f18765645be69f093e324414b1ea42fc783049","observation_id":"209ef616-aa01-467d-8fbc-564c2e686b2e","resolution":{"observed_at":"2026-08-15T23:12:20.324106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.305344Z","title":"CANF-VC: Conditional Augmented Normalizing Flows for Video Compression","venue":null,"work_id":"865b2437-a0fc-49af-8b1c-ab364ae67713","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.356579Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:27432ce7be823253527eec9d860f3bacc30665b28fc0818ba4516887198e5b33","observation_id":"114799ce-13e0-44b7-8a5d-ccb9177b720b","resolution":{"observed_at":"2026-08-15T23:12:20.309762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.291064Z","title":"FVC: A New Framework towards Deep Video Compression in Feature Space","venue":null,"work_id":"17422a07-ce95-4dcd-85fd-b3352bda509c","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.361923Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:ac41912384d81d69d0bf33c2db4413d7cf3ab04aefd2e91d7382bdb81f7397d7","observation_id":"79ff0354-444c-4063-91ca-443e817101f5","resolution":{"observed_at":"2026-08-15T23:12:20.296317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.275950Z","title":"Coarse-to-fine Deep Video Coding with Hyperprior-guided Mode Prediction","venue":null,"work_id":"ba932187-0013-45f7-9908-e740ea921c63","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.366331Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:9f7b5497f13b218220a22a43aa11387eddc92de624e13e63982dca2a2b93a802","observation_id":"4a141127-099a-43ae-8f0c-01fe48eca5d7","resolution":{"observed_at":"2026-08-15T23:12:20.281608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15752","last_updated":"2024-12-20T10:14:12Z","snapshot_observed_at":"2026-08-13T23:08:49.901437Z","submitted_at":"2024-12-20T10:14:12Z","title":"Sparse Point Clouds Assisted Learned Image Compression","version":1},"cited_work":{"arxiv_id":"2412.15752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15752","snapshot_observed_at":"2026-08-15T23:12:19.677197Z","title":"Sparse Point Clouds Assisted Learned Image Compression","venue":"cs.CV","work_id":"b265d096-9c92-4ae4-bdbe-b7cc82049824","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.370834Z"},"links":{"cited_paper":"/paper/2412.15752","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:af861ef3825397241029e5e170feb4604e334763e2e0bf561b0a9ff40a10d739","observation_id":"b377aafd-ef1b-4942-87c3-9796c61dd5b1","resolution":{"observed_at":"2026-08-15T23:12:19.682234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.261552Z","title":"Video Super-Resolution With Con- volutional Neural Networks","venue":null,"work_id":"9f77c1a7-a69c-45af-958f-4ebbe4471538","year":2016},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.375478Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:e97e44d8f4b0c5ea1c8225ae15f7743debb7dc0d777c0605f4037963823e0c62","observation_id":"35911563-c4b7-4c5b-bfa2-3c15710ca373","resolution":{"observed_at":"2026-08-15T23:12:20.266670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.247370Z","title":"Optical Flow and Mode Se- lection for Learning-based Video Coding","venue":null,"work_id":"f9a5c507-24d3-472e-bda5-0c2ca584598b","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.379750Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:259d0cf9180899d1969a85d875913ad87a4adad7e091289dd093f7c36913a3c2","observation_id":"650c8aef-ac9a-424b-850f-7233d51c706a","resolution":{"observed_at":"2026-08-15T23:12:20.252082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09103","last_updated":"2021-04-20T09:28:17Z","snapshot_observed_at":"2026-08-13T19:37:41.424906Z","submitted_at":"2021-04-19T07:48:55Z","title":"Conditional Coding and Variable Bitrate for Practical Learned Video Coding","version":2},"cited_work":{"arxiv_id":"2104.09103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.09103","snapshot_observed_at":"2026-08-15T23:12:19.655690Z","title":"Conditional Coding and Variable Bitrate for Practical Learned Video Coding","venue":"cs.NE","work_id":"e41ea4d5-dcbb-4444-aa87-15322d4b09b0","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.385183Z"},"links":{"cited_paper":"/paper/2104.09103","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:78758a85d1e2312e7f1c3f0b65f82c82c8decbb86088794af632ca3b5c8dd8c9","observation_id":"526c548f-6f6b-4bac-a323-f1b347b62e26","resolution":{"observed_at":"2026-08-15T23:12:19.661392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.232459Z","title":"Deep Contextual Video Com- pression","venue":null,"work_id":"fb10d8ae-cef4-424c-8597-68c241e21300","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.390519Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:7cb6aaae7b357e8c2da0252276906b20a27772b5af4bcd4d1ff022bf0c878608","observation_id":"fc46316b-6364-47fd-8127-bb2c7c449e14","resolution":{"observed_at":"2026-08-15T23:12:20.237144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.217554Z","title":"Hybrid Spatial-Temporal En- tropy Modelling for Neural Video Compression","venue":null,"work_id":"c0c8211f-5314-4cba-8d45-8d01aa53ade9","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.394674Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:98ce3864e348beec2b66195afeb5751b6f09038f077855d3b08d8cdb556df876","observation_id":"05b33dbc-2f63-4b6c-894a-d010eedfe5d9","resolution":{"observed_at":"2026-08-15T23:12:20.222917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.202782Z","title":"Neural Video Compression with Diverse Contexts","venue":null,"work_id":"55d6d483-cf8c-4868-b143-62b7ad319332","year":2023},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.399075Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:d4d9e00e55fc3dce25881299d1d48cb41273204a72110f0818aceac0877af980","observation_id":"54205dc4-fc1c-4b16-8f27-4dd771d95d72","resolution":{"observed_at":"2026-08-15T23:12:20.207252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.187996Z","title":"Neural Video Compression with Feature Modulation","venue":null,"work_id":"86106910-e77c-41c0-ae21-426cf857f639","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.403624Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:069b06295d4d8007a0402f879abef0857142be34014bb515800b2e6981f5a93e","observation_id":"b3354968-12fc-4373-a756-380cd513c104","resolution":{"observed_at":"2026-08-15T23:12:20.192715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.172362Z","title":"E-NeRV: Expedite Neural Video Representation with Disentangled Spatial-Temporal Con- text","venue":null,"work_id":"44ea4d5a-dea6-4f57-b3dc-469905f527e3","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.408116Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:448b9557abc95f8b723fc2eb53268ab26f93ff7e601cf4f616f76c5f1fa16136","observation_id":"2f1dac79-91eb-485c-92f9-ba2bbf9e0beb","resolution":{"observed_at":"2026-08-15T23:12:20.177217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11541","last_updated":"2024-07-21T12:58:00Z","snapshot_observed_at":"2026-08-12T23:21:16.456268Z","submitted_at":"2024-07-16T09:46:29Z","title":"Uniformly Accelerated Motion Model for Inter Prediction","version":2},"cited_work":{"arxiv_id":"2407.11541","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11541","snapshot_observed_at":"2026-08-15T23:12:19.632544Z","title":"Uniformly Accelerated Motion Model for Inter Prediction","venue":"eess.IV","work_id":"fe58d749-c5d8-4170-8361-6924b535dddb","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.412394Z"},"links":{"cited_paper":"/paper/2407.11541","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:f18244642327a424cf3c01cd6554a9a11d1ffbe1a1315b99773c8d996af217bc","observation_id":"013abcf9-34c7-4d2d-8dcb-bd8b006a222a","resolution":{"observed_at":"2026-08-15T23:12:19.639454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08481","last_updated":"2025-03-16T02:09:46Z","snapshot_observed_at":"2026-08-12T22:45:51.152102Z","submitted_at":"2024-09-13T02:13:11Z","title":"USTC-TD: A Test Dataset and Benchmark for Image and Video Coding in 2020s","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08481","snapshot_observed_at":"2026-08-15T23:12:19.417030Z","title":"USTC-TD: A Test Dataset and Benchmark for Image and Video Coding in 2020s","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.417030Z"},"links":{"cited_paper":"/paper/2409.08481","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:b69541a4d54930bad8efc4b6a117ad2cc3615e984809dcff2e9fe5fddfdfd6a9","observation_id":"6dea1424-63ba-4cf6-9e5e-7a16161fec6e","resolution":{"observed_at":"2026-08-15T23:12:19.417030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.158101Z","title":"Object Segmentation-Assisted Inter Predic- tion for Versatile Video Coding","venue":null,"work_id":"581b0751-3b75-457c-aec8-b3977317c95a","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.421795Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:3a1c88edd769effd67e6c4286a5f032c6ee0ac2600bb1bc48911014d86d8a5fe","observation_id":"b3454c5f-c0f2-4a3b-8c27-ea12b51bd217","resolution":{"observed_at":"2026-08-15T23:12:20.162662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.143888Z","title":"SwinIR: Image Restoration Using Swin Transformer","venue":null,"work_id":"6b6af0bf-6bfa-4893-aa77-3b6f6595f803","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.426576Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:b3de805b4533ea2013b14d95960813236628d7d513b3f69b6680ef21a717127c","observation_id":"2b4232dc-bcb5-4cd8-bb69-dd04c72cdb1b","resolution":{"observed_at":"2026-08-15T23:12:20.148360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.129052Z","title":"M- LVC: Multiple Frames Prediction for Learned Video Com- pression","venue":null,"work_id":"1b1b701b-5019-4fb1-92c6-6c1b3a5f4eb8","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.430727Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:7e8ea23b80129d17a47695433fc68f1726d1e8aef0382aeaeeb3d905fdfaa7ad","observation_id":"80b8e21e-9751-4dad-a823-8212097217bd","resolution":{"observed_at":"2026-08-15T23:12:20.133808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.115020Z","title":"Neural Video Coding using Mul- tiscale Motion Compensation and Spatiotemporal Context Model","venue":null,"work_id":"dc7ff5e7-d638-412c-a3a5-4e6e0744498b","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.435299Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:6ea13f1c8dd6edcdfd2211ef08c920f937af65d02b2316dd25c63b0e29379e56","observation_id":"2496b2dc-3ecb-40eb-be8f-5aacc2255cae","resolution":{"observed_at":"2026-08-15T23:12:20.119527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.100787Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","venue":null,"work_id":"139b0045-40e8-4cff-b83c-c84ac9567eea","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.439637Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:dc7394d8d0796e1b53b49850ec566eb1898cd7cd96f1408a00a774e90584eadd","observation_id":"c8686921-ae06-42f3-88d0-a5fae152e73a","resolution":{"observed_at":"2026-08-15T23:12:20.105684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.086325Z","title":"DVC: An End-to-end Deep Video Compression Framework","venue":null,"work_id":"b83db59a-d01c-4cfa-be1b-8c754d1787f0","year":2019},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.443910Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:0d4895df1732429c85e048b6843e8bc3e78225cc3e667a43543c5612a29c639d","observation_id":"614e1d67-a378-4ca6-8430-9e851e45dff4","resolution":{"observed_at":"2026-08-15T23:12:20.091145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.071782Z","title":"An End-to-End Learning Framework for Video Compression","venue":null,"work_id":"748d2656-2693-4d0e-b9f4-df4f7a469682","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.448156Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:78e620563cb2a7329000bc329687215a4e70b27166d3281d1f4caeaed7045cc3","observation_id":"1c518c32-497a-4c69-b579-385e7be24eb5","resolution":{"observed_at":"2026-08-15T23:12:20.076484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.057160Z","title":"Don’t Blame the Elbo! A Linear Vae Perspec- tive on Posterior Collapse","venue":null,"work_id":"c7e993fe-20df-4182-80e9-cebd023094bd","year":2019},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.452989Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c4e0fbe6b6071ee5c1ba9cf5b4154235b42d54135b0f6d2ab95bc2f655e6239f","observation_id":"17d2090f-746b-409a-a527-ab6e0a026beb","resolution":{"observed_at":"2026-08-15T23:12:20.061975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.042323Z","title":"Uncertainty-Aware Deep Video Compression With Ensembles","venue":null,"work_id":"b3416633-3e31-4151-b219-2863ecdd2d6a","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.458160Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:efdad8f0eafc20aa589339566ebd987be9bcaa796f4163633ab4356279751aaf","observation_id":"f024ee4e-52e1-4516-9783-fd30791dc0f6","resolution":{"observed_at":"2026-08-15T23:12:20.046847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.028532Z","title":"Spatial scalability with VVC: coding performance and complexity","venue":null,"work_id":"9ad38f15-6d93-4514-8791-cb002558d7f4","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.462552Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:7ad30ab20580ebcc7a214dae807885b2590308255c2c265426b1ea3df795ca74","observation_id":"1344266b-da1b-488b-8ca6-a045bca80eab","resolution":{"observed_at":"2026-08-15T23:12:20.033112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07307","last_updated":"2022-10-12T09:01:27Z","snapshot_observed_at":"2026-08-14T09:19:20.153315Z","submitted_at":"2022-06-15T05:31:32Z","title":"VCT: A Video Compression Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07307","snapshot_observed_at":"2026-08-15T23:12:19.466658Z","title":"VCT: A Video Compression Transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.466658Z"},"links":{"cited_paper":"/paper/2206.07307","citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:6f573408e77f3c84b7262f49ed4eb3beb9b3816f6f16c039569ef147cbe4c6b2","observation_id":"24b73ca6-d7a9-4ef5-b1ce-754d7dccdc60","resolution":{"observed_at":"2026-08-15T23:12:19.466658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.014536Z","title":"UVG Dataset: 50/120fps 4K Sequences for Video Codec Analysis and Development","venue":null,"work_id":"baea8a02-13ed-4be8-b4b7-b111da19536a","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.471525Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c20e7cfb906daa0e58d8ffe1fd1c858caee4d0dcbc288c78ecec6092466a6408","observation_id":"43e75db1-3d10-4c6a-9d50-0aeba74cbca7","resolution":{"observed_at":"2026-08-15T23:12:20.019204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:20.000400Z","title":"Optical Flow Estima- tion using A Spatial Pyramid Network","venue":null,"work_id":"3d8e0a58-c95e-4758-b146-caf13273d1fc","year":2017},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.475906Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:b2f3d8020d7620fd34c3b3048738c92b5d6f8e51dc1e8c72c714b0cac4cefeab","observation_id":"7efc977d-a6bb-4d56-92f7-045a00921d17","resolution":{"observed_at":"2026-08-15T23:12:20.005191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.984780Z","title":"H.263: Video coding for low-bit-rate commu- nication","venue":null,"work_id":"bb05e565-4127-4151-9436-ebeb5113e677","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.480468Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c00c37a727b1441780555ca4c9318c7b97e21871af13b5c3c7b9b30d82cc87ea","observation_id":"5503b0e2-daa3-4587-ab79-7aa76851ef49","resolution":{"observed_at":"2026-08-15T23:12:19.990724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.969571Z","title":"Learned Video Compression","venue":null,"work_id":"95f4852b-bd90-4643-bf69-befe903dfc73","year":2019},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.485339Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:08f5962943ff5e5f1d0d6cccf56a921b2569fda1b178c297c32e330cadb06216","observation_id":"896d1c82-f750-4b1d-bd9b-9689557054d9","resolution":{"observed_at":"2026-08-15T23:12:19.974847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.954998Z","title":"ELF-VC: Effi- cient Learned Flexible-Rate Video Coding","venue":null,"work_id":"f45ad561-09ae-409f-902d-c20dadbb358d","year":2021},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.489987Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:73ff88a844ab2ad03ec820bf71232ebdfb3290563af336c14f0c9c8e5667a3e9","observation_id":"f9be8127-4b1f-42c8-9907-4e96fb34e13a","resolution":{"observed_at":"2026-08-15T23:12:19.960114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.939644Z","title":"Overview of the Scalable Video Coding Extension of the H.264/A VC Standard","venue":null,"work_id":"d0264114-0cb7-4d68-adb9-21e53310d791","year":2007},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.494267Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:4dbb9cee3eeb71d2b7c7802bddb5971d82c93e87f9d53d2bf92a73ec0f87cc28","observation_id":"8c6fd938-f1d7-48ec-a1a1-d24e30c1dcb2","resolution":{"observed_at":"2026-08-15T23:12:19.944308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.924355Z","title":"Temporal Context Mining for Learned Video Compression","venue":null,"work_id":"06294825-f455-4a2d-8e0d-6a22901eaf90","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.498537Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:f834b24431505f082d5f5f57bf0a27680b613b082a81925bd78330245be70e43","observation_id":"a6e929dd-8743-410c-aa16-2eb7bdf2110f","resolution":{"observed_at":"2026-08-15T23:12:19.929393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.910406Z","title":"Spatial De- composition and Temporal Fusion Based Inter Prediction for Learned Video Compression","venue":null,"work_id":"758e2760-4687-4863-b72b-9d0ea64d2005","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.502772Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:829eaa0d21727688ee6c10b84dc0e133fa4d7f685fc8673f2a29be300dba5f62","observation_id":"6247ff5d-d264-483a-b3a4-a68824aca581","resolution":{"observed_at":"2026-08-15T23:12:19.915125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.894964Z","title":"Rethinking Alignment in Video Super-Resolution Transformers","venue":null,"work_id":"fd448e69-ad52-432a-b735-a4d13b828aa3","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.507377Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:495f430ef9d6c288ae17960e658bc089a108f76ebe08adde4e549e271b3dc269","observation_id":"7a9de99e-5f1f-4925-bab1-0b3a2ddd9b1e","resolution":{"observed_at":"2026-08-15T23:12:19.899576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.880309Z","title":"Real-Time Single Image and Video Super-Resolution Using an Efficient Sub-Pixel Convolutional Neural Network","venue":null,"work_id":"b831bd58-2900-4bac-a452-7b3d19247f82","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.512858Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:541fb4c5ac0d4a994b7224f9f57e58483ecccff0029e4fd5abe0cce84bdb8e52","observation_id":"eeb7bb96-c308-4bc7-82a6-a9d6f899778b","resolution":{"observed_at":"2026-08-15T23:12:19.885203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.866210Z","title":"Overview of the High Efficiency Video Coding (HEVC) Standard","venue":null,"work_id":"79e743fd-00e1-4214-8010-ac07480b41b5","year":2012},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.517269Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:42d5cb3551fc7b4968fe77861cb1915002c322fb5421cc62ae1564e2e6594e97","observation_id":"a16c9a58-f500-4b51-83bc-5e5302572883","resolution":{"observed_at":"2026-08-15T23:12:19.870983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.851922Z","title":"Standardized Exten- sions of High Efficiency Video Coding (HEVC).IEEE Jour- nal of selected topics in Signal Processing, 7(6):1001–1016,","venue":null,"work_id":"92938614-94a2-4faf-81ea-9a707d0aed46","year":null},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.521597Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:d5f8ca46c37bea123a7f1ea1f41e3261f2585c4eb02bdcf220b6a080c1d16db4","observation_id":"589348f1-b924-42a4-8ce4-3ed9d01c4d08","resolution":{"observed_at":"2026-08-15T23:12:19.856797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.837535Z","title":"Offline and Online Optical Flow En- hancement for Deep Video Compression","venue":null,"work_id":"24919f63-8c7c-45b9-b851-d400a3081d49","year":2024},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.525886Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:3b6f9236fd0e2d4f7129e08b3584376b1c2bb8c443176d7c35b53084c5fe71a5","observation_id":"1badcf88-7923-464a-bed1-197f51279aa0","resolution":{"observed_at":"2026-08-15T23:12:19.842661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.823140Z","title":"RAFT: Recurrent All-Pairs Field Transforms for Optical Flow","venue":null,"work_id":"bc207f67-f09a-45b7-ae00-428b41a89623","year":2020},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.530338Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:c818d77805d8f54e7f820bb46f10241a57b889e99847c0845d9f5fdfa9a811e2","observation_id":"6ce95b65-5e67-402c-8e2a-8460a4c9776c","resolution":{"observed_at":"2026-08-15T23:12:19.827890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.809509Z","title":"Attention is All You Need","venue":null,"work_id":"585ec059-fcff-413c-b96b-5af3cee85e86","year":2017},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.535602Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:93cfd131f2f45c9409c5f9b4cc5a0169ced63665755b35bc2671057539fb2bae","observation_id":"bb0ce853-c192-4f17-870f-49022c9400f5","resolution":{"observed_at":"2026-08-15T23:12:19.813797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.795198Z","title":"MCL-JCV: a JND-based H.264/A VC video quality assessment dataset","venue":null,"work_id":"08652f29-a609-49c4-9042-cc2456f032ad","year":2016},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.539941Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:eeea854a8a4f28ceb1fd6b04b55065b496c6abc996d833622581adf7a2b860c9","observation_id":"a9e8d388-51ce-4972-8eb2-d2d4bda81ef6","resolution":{"observed_at":"2026-08-15T23:12:19.799856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.779825Z","title":null,"venue":null,"work_id":"9bdf74db-da2b-4bba-bed6-34be573ca46f","year":1996},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.544878Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:8a3e640cdc72484064b6e4f7734cd112ab55f68ad8c152c143f3b4cffe82a3f4","observation_id":"445dc14b-79d5-4d11-88a6-6623a126d6e2","resolution":{"observed_at":"2026-08-15T23:12:19.784808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.764600Z","title":"Overview of the H.264/A VC Video Coding Standard","venue":null,"work_id":"369c5561-d9af-4ba7-805f-7bbce5380e02","year":2003},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.549136Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:b2a9749d03466a08793a597c4a4793dff0cb7c197648c17e84dce559126b0905","observation_id":"b64f03b2-021b-49ff-a8df-833bd2374109","resolution":{"observed_at":"2026-08-15T23:12:19.769450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.750488Z","title":"Affine Multipicture Motion-compensated Prediction","venue":null,"work_id":"6cbed1ce-cf98-4b02-9e76-c9256ddd1d02","year":2005},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.553548Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:d073b9a32e2df36afcde70f035bc9831717ba30988c5feddff3f6c6efc1f5358","observation_id":"a1715c50-47b6-409d-871a-46c6b65ccf5a","resolution":{"observed_at":"2026-08-15T23:12:19.755325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.736460Z","title":"Video Enhancement with Task-oriented Flow","venue":null,"work_id":"8bbe5bef-adad-480d-9abf-2cde22438a53","year":2019},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.558245Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:15d83fa23af698945c217a3cfb253ce9af2488f60a334e9d9b4236df0f4ce227","observation_id":"a1840ce5-d148-464b-b37a-1e9ff28998d6","resolution":{"observed_at":"2026-08-15T23:12:19.741048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.722011Z","title":"Learned Low Bitrate Video Compres- sion with Space-time Super-resolution","venue":null,"work_id":"a7f269e7-ea16-4f94-aea6-62298b719c37","year":2022},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.562463Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:0e25500ac060b9b70393210cd0aaeaac745c436fcf9527699601392070c42b80","observation_id":"30b982e0-a677-4188-bf4a-0d49656a2eee","resolution":{"observed_at":"2026-08-15T23:12:19.726683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:12:19.706578Z","title":"DNeRV: Model- ing Inherent Dynamics via Difference Neural Representation for Videos","venue":null,"work_id":"2241e008-2de1-4c10-902e-2148e51cacf2","year":2023},"citing_paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T23:12:19.566619Z"},"links":{"citing_paper":"/paper/2505.05309"},"observation_digest":"sha256:0e9e4b4181b26887fd45197f6388c3e45677f1f740edb098713e6ba066f9e1d4","observation_id":"5ef5e6a6-3a0a-4aa3-a229-4cef06aafec2","resolution":{"observed_at":"2026-08-15T23:12:19.711857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05309","last_updated":"2025-05-08T14:57:52Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-15T23:04:49.341885Z","submitted_at":"2025-05-08T14:57:52Z","title":"Augmented Deep Contexts for Spatially Embedded Video Coding"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":3,"verified_fuzzy":57},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2505.05309."}