{"as_of":"2026-08-14T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48b85e3aabfc3502dbf433c08dc33399128c959fa96faed7e7f428d050ba81a1","coverage":[{"denominator":85,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":85,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:13:27.045307Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04912/citation-record","integrity":"/paper/2412.04912/integrity","json":"/paper/2412.04912/citation-record.json","paper":"/paper/2412.04912"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.419950Z","title":"python.org/3/library/zlib.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.419950Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:eda720e1ae374d5239b44058e50ac830668bf22d96359eff07c1bf9cec6b6f95","observation_id":"4251caac-0dc1-49cd-85bc-31cf1ba83c1a","resolution":{"observed_at":"2026-08-11T21:13:24.419950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.464928Z","title":"Multimodal biomedical ai","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.464928Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:54927849d545a7e5928291ddcc33290c74dab9cb66fa59270a064e1e069e3ade","observation_id":"a66e6286-bb08-4874-abe1-d9a79aa8d628","resolution":{"observed_at":"2026-08-11T21:13:24.464928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.528726Z","title":"Ntire 2017 challenge on single image super-resolution: Dataset and study","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.528726Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:a4f8153a9f3eebd61986dc70571744ca2ca6eee8bd9efc927a48d6506977ecbf","observation_id":"08f7ee30-dbb7-42e9-8c3c-800e24ebfb3f","resolution":{"observed_at":"2026-08-11T21:13:24.528726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.542528Z","title":"Generative adversarial networks for extreme learned image compression","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.542528Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:0359bf535cb819b3f84f7264c2ae8d34ab4886342b96b4c4e6261ebe1042ea86","observation_id":"f3231723-9838-45aa-8eb9-351f00f4cb8d","resolution":{"observed_at":"2026-08-11T21:13:24.542528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.570050Z","title":"Spatext: Spatio-textual representation for con- trollable image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.570050Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:55248de6bf27804c38007d785a9c830aa6500d102a83b4682e6abad1d8c17d1f","observation_id":"e61b8f87-0fc7-4cbc-b40a-517147d0fd70","resolution":{"observed_at":"2026-08-11T21:13:24.570050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:30.300506Z","title":"Variational image compression with a scale hyperprior","venue":null,"work_id":"f1054eb6-9b39-40f8-b1e1-6482ec067f69","year":2018},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.643386Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:a41e618b337e7099a1ec8d85112c74fa106d850a5914f702657a6086ff464da3","observation_id":"47aa701e-c490-4b68-a6c1-2e8ec82d819f","resolution":{"observed_at":"2026-08-11T21:13:30.309849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.03029","last_updated":"2020-11-05T18:40:50Z","snapshot_observed_at":"2026-08-13T21:07:28.794743Z","submitted_at":"2020-11-05T18:40:50Z","title":"CompressAI: a PyTorch library and evaluation platform for end-to-end compression research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.03029","snapshot_observed_at":"2026-08-11T21:13:24.706709Z","title":"Compressai: a pytorch library and evaluation platform for end-to-end compression research","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.706709Z"},"links":{"cited_paper":"/paper/2011.03029","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:2f0a14b33e0a3692856b296b05bfea273c1b03870918538701d754155e3cb8e9","observation_id":"99bb05ac-adf5-4094-ad80-75e658c413c4","resolution":{"observed_at":"2026-08-11T21:13:24.706709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:30.160697Z","title":"Better portable graphics (bpg) image format","venue":null,"work_id":"ddf465f7-c817-482b-a007-0b3c1883568a","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.764897Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:48c30c4bbcda99f5ec01e570960235999f65d00336a46cf38957b015a0eded57","observation_id":"3765e156-85c4-4556-bd78-33ea9434752a","resolution":{"observed_at":"2026-08-11T21:13:30.248465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:30.096507Z","title":"Improving image generation with better captions","venue":null,"work_id":"0403d819-528b-478a-bf60-fd9f0a7995d5","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.778662Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:27e1734640aee234dfe76076865c3646e73c8d029ead0d50da2b223135a72caf","observation_id":"e425968e-4353-4a96-b9c2-de7abd7d051c","resolution":{"observed_at":"2026-08-11T21:13:30.101456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:30.084566Z","title":"The perception-distortion tradeoff","venue":null,"work_id":"5cce6411-fb8e-456d-b8f6-74bee759e39e","year":2018},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.785693Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:6ebb18394e2bec75d8cc1a9965d3a937bd08789a99f043752b395402141b9aec","observation_id":"5121fd70-a9c2-4c72-b18b-4d11910c344d","resolution":{"observed_at":"2026-08-11T21:13:30.088711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.989540Z","title":"Rethinking lossy compres- sion: The rate-distortion-perception tradeoff","venue":null,"work_id":"460ae1e1-72f9-41fb-9010-81c0729237d9","year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.813703Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:f3b5070326313857120fad62ab4bdb139c429a87a795ea3820bdc178a1d0d3f7","observation_id":"9b43fd1d-418f-4b02-8749-8bdf3a67aa9b","resolution":{"observed_at":"2026-08-11T21:13:30.045192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:24.854512Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.854512Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:10d0417e8cb2f279fd31cd6960f064c904cc6cfb555372d4cb0aa636f7e2d0c7","observation_id":"401901b5-8710-42e5-856d-757bbe58e98a","resolution":{"observed_at":"2026-08-11T21:13:24.854512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.859054Z","title":"Overview of the versatile video coding (vvc) standard and its applications","venue":null,"work_id":"928bfb57-60bb-448d-b2d5-df27772cd6cf","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.896932Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:c4ff9ddf8a4d581abcb167d1b89a420bfe89361c208b8f9fe75c477952e1687a","observation_id":"6076dca6-fb94-40d0-970a-5ad86358b424","resolution":{"observed_at":"2026-08-11T21:13:29.897046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.823535Z","title":"Towards image compression with per- fect realism at ultra-low bitrates","venue":null,"work_id":"e58cb50e-bff4-45c1-8149-ea83fa51d544","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.912158Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:ca1cab2efca2f96f775a3fecf825ee2a9f095d6c43975b1fa55b1e65b36fc82c","observation_id":"202f70ea-71c5-4204-acf8-916daac9fc7c","resolution":{"observed_at":"2026-08-11T21:13:29.827339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.811688Z","title":"Thousand to one: Semantic prior modeling for conceptual coding","venue":null,"work_id":"6ec31146-1dda-427a-bb8c-1064d055baac","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.926040Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:63c4eea386295a64fa0e39b69cf8ccd274bcdd305e3089f8e2c3eb35b736f8a5","observation_id":"c7495f6c-334f-4479-82da-7ec40306378f","resolution":{"observed_at":"2026-08-11T21:13:29.816085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.798751Z","title":"Learned image compression with discretized gaussian mixture likelihoods and attention modules","venue":null,"work_id":"783ac0d3-5cf5-4de9-816d-429dc26e658d","year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.933830Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:a17e0622259b1bb568cab1562f789fff31054d8bb59ca7e6ab4007e7f7023b48","observation_id":"7e6f876d-3ae8-4554-ba9b-738cf570a320","resolution":{"observed_at":"2026-08-11T21:13:29.802735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.786927Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"afac8831-2399-466c-ae35-7556674be65c","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:24.972013Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:9728e0f9b5d9b8808fa4071caa732c566b8dbfb0a9d4b365f638242c172f2ee8","observation_id":"38f1a579-f840-48f0-8ab5-f0b3e104c75c","resolution":{"observed_at":"2026-08-11T21:13:29.791112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-11T21:13:25.019549Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.019549Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:065e93b6a09b579343e05e034199e2923a909f5716940f6eb44bd62d074cd81b","observation_id":"33f7e817-142e-4b57-a4f8-1a1a56816b77","resolution":{"observed_at":"2026-08-11T21:13:25.019549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.772920Z","title":"Semantically structured image compression via irregu- lar group-based decoupling","venue":null,"work_id":"bf4efcab-f335-4545-b2c2-d7df186ac130","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.060511Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:168a93c613f365b1923e6bbf2e0363e2f79371241a5531ec72625860a4491e06","observation_id":"071d7350-4d2a-4dce-99be-b1e927b09a8c","resolution":{"observed_at":"2026-08-11T21:13:29.779090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.761854Z","title":"Nvtc: Nonlinear vector transform coding","venue":null,"work_id":"9d5bd4aa-ce36-46c4-b2c7-cd9d4703b239","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.075347Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:104e0802daa578d77894b9bfd82fd60c0d1c10179b505b800eb8bcb818ce91a8","observation_id":"2f1bb918-df36-4408-98ab-82e445c51c69","resolution":{"observed_at":"2026-08-11T21:13:29.766145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.751171Z","title":"Rate-distortion optimization for cross modal com- pression","venue":null,"work_id":"767047ab-2ad2-4e7f-83c7-0d653a7ea620","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.091966Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:1b9864fc7f5da513dd89ca8073884ddf51ade28240a0112ac5df1a741ec7edd5","observation_id":"6f9a4818-e72a-4f89-a955-9f47f0b30818","resolution":{"observed_at":"2026-08-11T21:13:29.755271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05489","last_updated":"2023-03-29T16:13:22Z","snapshot_observed_at":"2026-08-13T13:04:50.841109Z","submitted_at":"2023-01-13T11:27:26Z","title":"A Residual Diffusion Model for High Perceptual Quality Codec Augmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05489","snapshot_observed_at":"2026-08-11T21:13:25.130270Z","title":"A residual diffusion model for high perceptual quality codec augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.130270Z"},"links":{"cited_paper":"/paper/2301.05489","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:c934430cab4ea3f2275949486782b081d31d97b69092025650b16a4844fcbbf7","observation_id":"0720b1aa-9893-4eb7-9654-2c9607d838b2","resolution":{"observed_at":"2026-08-11T21:13:25.130270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:25.187346Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.187346Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:ee3c95062385a5301bcb07d42f4de6dd508d2028d5157a9e010663784423c101","observation_id":"d3669b34-b3a9-4a4e-99d0-f443d6efe431","resolution":{"observed_at":"2026-08-11T21:13:25.187346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.679282Z","title":"Theoretical foundations of transform coding","venue":null,"work_id":"7ee533fa-f012-42b4-aef4-bc9040340e57","year":2001},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.259876Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:c93e00d135132c4c0b183969c65e7d65baafd00b4d80bb338268509d7bd234be","observation_id":"45442bbf-a07e-4331-afe8-2658bf50dfe9","resolution":{"observed_at":"2026-08-11T21:13:29.706533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.638289Z","title":"Causal contextual prediction for learned image compression","venue":null,"work_id":"19163041-f011-4118-9124-956c761d1d66","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.301744Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:34b3c23499da55a4466549a4e968cf23b143425e48f78c34cf605565bf089332","observation_id":"04c84504-28e8-49df-85be-eda22c361e75","resolution":{"observed_at":"2026-08-11T21:13:29.642571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.625539Z","title":"Soft then hard: Rethinking the quantization in neural image compression","venue":null,"work_id":"258ab01e-08fc-45f4-a444-933a6f75e6ba","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.307630Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:80825bb8cf97849bfffc5ec148d5ceb64d48182385059c2ae122dcca21597b39","observation_id":"d67f04bd-1fb6-4006-88fa-69aecc59602a","resolution":{"observed_at":"2026-08-11T21:13:29.630387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.608976Z","title":"Minimal random code learning: Getting bits back from compressed model parameters","venue":null,"work_id":"4da129b4-7557-4943-b9d7-55ceb3e90edb","year":2019},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.312397Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:7ff3253908e85b435841d99a5eed70830eb1e3756d29fa1e3df90cd469790e08","observation_id":"e724fd50-8e2d-4bee-9608-8f699e8da2db","resolution":{"observed_at":"2026-08-11T21:13:29.617980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.567572Z","title":"Elic: Efficient learned image com- pression with unevenly grouped space-channel contextual adaptive coding","venue":null,"work_id":"320e139a-ddb2-41ab-91cf-1f19f3a2201e","year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.319086Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:6f7957d2b8648b76b85cc6a23d480065974339c6a1afee7b76ddc8b21ffe4024","observation_id":"8fef64d7-4bf5-4127-8496-03d499ea6af7","resolution":{"observed_at":"2026-08-11T21:13:29.585385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:25.371095Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.371095Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:b5a8fd15a7a339b3b4a657711c22cb87e0e80f1d49f63da00e29b4f333e5ec34","observation_id":"b825709d-2b6b-4c2d-ac5a-2af5028b72e4","resolution":{"observed_at":"2026-08-11T21:13:25.371095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:25.431241Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.431241Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:129907d731093533a9e2711b194ff58d567c4ed977df8c0ece042a28c205ef56","observation_id":"4295e50b-1498-45b4-9e34-dc92489a3131","resolution":{"observed_at":"2026-08-11T21:13:25.431241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:25.477778Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.477778Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:4c5571a63cf6b336c51f61e649d34314d80b072ded37dafd0529c2c44fce2760","observation_id":"e64f46f1-4402-42e7-9237-fddcbed65b39","resolution":{"observed_at":"2026-08-11T21:13:25.477778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18231","last_updated":"2024-03-07T20:28:54Z","snapshot_observed_at":"2026-08-13T11:32:13.630428Z","submitted_at":"2023-05-26T17:16:16Z","title":"High-Fidelity Image Compression with Score-based Generative Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18231","snapshot_observed_at":"2026-08-11T21:13:25.534312Z","title":"High-fidelity im- age compression with score-based generative models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.534312Z"},"links":{"cited_paper":"/paper/2305.18231","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:cc84c38772468aeff4965edd1172d0e80207ea0972736c7132e0c53fd047484a","observation_id":"7f4af578-b1ac-41bc-b95e-fc657c21ba86","resolution":{"observed_at":"2026-08-11T21:13:25.534312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.02703","last_updated":"2024-12-16T23:42:56Z","snapshot_observed_at":"2026-08-13T16:46:44.223995Z","submitted_at":"2022-02-06T04:18:45Z","title":"Multi-modal Sensor Fusion for Auto Driving Perception: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.02703","snapshot_observed_at":"2026-08-11T21:13:25.580217Z","title":"Multi-modal sensor fusion for auto driving perception: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.580217Z"},"links":{"cited_paper":"/paper/2202.02703","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:4fc43ab5afa70b765020774ce192c1fe1edcf9ed8f6e3dddf8044c3caf11f2a4","observation_id":"b97b1de7-8df7-4794-a97c-fb1ebf7617da","resolution":{"observed_at":"2026-08-11T21:13:25.580217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.500055Z","title":"Multi-modality deep network for extreme learned im- age compression","venue":null,"work_id":"d52a587f-ccc3-43c5-8377-db3887ae9cd7","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.589698Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:ed01e568f0a4afb0e164f6f3323f2f0ac033b729a4ebd56859d6f008ef81db07","observation_id":"72c51e24-b4e0-4963-b6d1-e92ab40129f6","resolution":{"observed_at":"2026-08-11T21:13:29.537274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T21:13:25.595260Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.595260Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:cc6616cbdfef9224f47e7300f4c14eca639ef765b63d66cf9dc0bc79ed571323","observation_id":"0ba99e9d-0a2e-41d2-83cd-3fa66966eaa9","resolution":{"observed_at":"2026-08-11T21:13:25.595260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.487775Z","title":"The open im- ages dataset v4: Unified image classification, object detection, and visual relationship detection at scale","venue":null,"work_id":"30affdd7-269a-437a-96f2-35a77c2edc01","year":1956},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.605787Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:ba23c6e74be996995e5423a0305812e99d74b0e0ca09fa294a875b5b16e39c7c","observation_id":"9150e0f6-8903-4310-8f4f-f6ff2fd9a52e","resolution":{"observed_at":"2026-08-11T21:13:29.492868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02944","last_updated":"2024-05-22T03:57:41Z","snapshot_observed_at":"2026-08-13T04:03:05.486528Z","submitted_at":"2024-03-05T13:15:01Z","title":"Neural Image Compression with Text-guided Encoding for both Pixel-level and Perceptual Fidelity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02944","snapshot_observed_at":"2026-08-11T21:13:25.627541Z","title":"Neural image compression with text-guided encoding for both pixel-level and perceptual fidelity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.627541Z"},"links":{"cited_paper":"/paper/2403.02944","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:1b09c68fabe77cfbbd7031887185ddcc0a28948ba7d50480ae4f48a9dd714632","observation_id":"626774d3-641f-419a-92cc-c0b0fc76e02d","resolution":{"observed_at":"2026-08-11T21:13:25.627541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.475582Z","title":"Text + sketch: Image compression at ultra low rates","venue":null,"work_id":"de23f0c9-553e-437b-987c-cd4ced9f13c0","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.649272Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:377abef37bbe6b1933daab4d039e03681e9a4ec948cb277fb0aba488bcfc846c","observation_id":"da066dc8-9d14-44c4-bbb4-fcc9fdfc536c","resolution":{"observed_at":"2026-08-11T21:13:29.479552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16749","last_updated":"2024-04-17T14:06:28Z","snapshot_observed_at":"2026-08-14T06:50:13.760258Z","submitted_at":"2024-02-26T17:11:11Z","title":"MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16749","snapshot_observed_at":"2026-08-11T21:13:25.687995Z","title":"Misc: Ultra-low bitrate image semantic com- pression driven by large multimodal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.687995Z"},"links":{"cited_paper":"/paper/2402.16749","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:6e62df1ff92c471c8fa0815b4a6d21a28fdf0845315bfbd29e2d31fcad819a9b","observation_id":"aedd2b2f-7d38-423d-aede-f3e28d453051","resolution":{"observed_at":"2026-08-11T21:13:25.687995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.460280Z","title":"Cross modal compression: Towards human- comprehensible semantic compression","venue":null,"work_id":"62dd4e98-19e5-4c50-9ab7-9e8b93401a4a","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.739857Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:155a4c30b03e1e7a84bdc4daa0bc9500fb185808e3a970fc390500856bcc11a7","observation_id":"6552919e-e980-46d4-b9fe-05688ef75875","resolution":{"observed_at":"2026-08-11T21:13:29.466282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.361191Z","title":"Task-driven semantic coding via reinforcement learning","venue":null,"work_id":"ab758a22-fdbb-4f53-b7d8-707951f9dfdd","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.763146Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:ebff4adbabc66b8a747caccd0ad195373f60d23ec21c0f65ab228f1607d85fd2","observation_id":"bce8f969-700f-439c-9993-714e662ae768","resolution":{"observed_at":"2026-08-11T21:13:29.411102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:25.772533Z","title":"Diffusion models for image restoration and enhancement–a comprehensive sur- vey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.772533Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:0950bb8abe07fb518824dbc91927c14c9a29c8fe867b52abae3235f81732f226","observation_id":"461f4076-82c2-4160-ab7e-b23b19dc14f0","resolution":{"observed_at":"2026-08-11T21:13:25.772533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.275657Z","title":"Ucip: A universal framework for compressed image super-resolution using dynamic prompt","venue":null,"work_id":"2f278b85-c121-4dad-8366-0e6a0717b5a8","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.807858Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:9385cd878ce7022590645099c90478df496a9ce649bd4b322873b4a0ea9f38f3","observation_id":"d9b5ca05-0d13-4d9c-9075-0f987fc2d196","resolution":{"observed_at":"2026-08-11T21:13:29.304014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.196172Z","title":"Learned image compression with mixed transformer-cnn architectures","venue":null,"work_id":"ce0d5efb-4e09-48e9-ab2b-a3fb3d37f5dd","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.865216Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:14871cd2f9d13861339795a4c9e17dece1ac63e8371b027cde181ece23f96e9b","observation_id":"39a599f7-0752-4f48-8306-6652859902a8","resolution":{"observed_at":"2026-08-11T21:13:29.226952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.183061Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":"ebe9dd1e-f3c8-45cf-a5e3-bc205d7ba34c","year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.938770Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:5b9f8988c4a5fee56a81c7ec0250ce06df773d742cb6a6595601104f62177ed6","observation_id":"755d7078-f8a6-4346-bfc0-d791efaa9395","resolution":{"observed_at":"2026-08-11T21:13:29.187726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-08-13T05:49:42.133862Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-11T21:13:25.986979Z","title":"Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:25.986979Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:25d4e34a448f8fa96849829740927e3fc7ad35a4f496534d8c180b0f74981ef9","observation_id":"5c87af18-5d88-4f17-8c09-cc1b45ab8aa2","resolution":{"observed_at":"2026-08-11T21:13:25.986979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-11T21:13:26.007217Z","title":"Latent consistency models: Synthesizing high- resolution images with few-step inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.007217Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:4a3eb554a27083fefe83ac026a19579c03c9dc3b50302b7ce36ee32fbbb113f3","observation_id":"303b3c54-48d0-4571-98c2-e65280debb4b","resolution":{"observed_at":"2026-08-11T21:13:26.007217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.171955Z","title":"On distillation of guided diffusion models","venue":null,"work_id":"e263ba8f-bb4f-42fc-b6a0-4703d47b206a","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.055887Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:21e56d717851372660fd61c12db7141d6eed6bf55ae846d7e9a889e7aa6ae97e","observation_id":"f1fc9451-92ab-48b2-a170-0398857808c5","resolution":{"observed_at":"2026-08-11T21:13:29.175865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09965","last_updated":"2020-10-23T08:55:23Z","snapshot_observed_at":"2026-08-09T19:14:28.119046Z","submitted_at":"2020-06-17T16:21:10Z","title":"High-Fidelity Generative Image Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09965","snapshot_observed_at":"2026-08-11T21:13:26.081578Z","title":"High-fidelity generative image compres- sion","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.081578Z"},"links":{"cited_paper":"/paper/2006.09965","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:bb5cc3f9a93f9f9f30e86fec5d1e0f5e303df736eca51a1d9f4a5d519e025dbc","observation_id":"3e9c1f1e-edcc-4002-b112-7facc248bca1","resolution":{"observed_at":"2026-08-11T21:13:26.081578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.159945Z","title":"Channel-wise autoregres- sive entropy models for learned image compression","venue":null,"work_id":"7dfa0e3d-1206-499b-a9c4-d7a74823bfa2","year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.117181Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:010cc3f4aabd679a9b895d3ef58a940867bbe394af5e0b57336abcb92dda8172","observation_id":"f57e0915-3a4c-45a1-8da6-cbff6812f879","resolution":{"observed_at":"2026-08-11T21:13:29.164355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.149709Z","title":"Joint autoregressive and hierarchical priors for learned image com- pression","venue":null,"work_id":"c81f93d7-3393-4580-8fde-16b50e11074e","year":2018},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.138482Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:3e8c408f80e3354c811c8e813780b5bd9caa7412cb51370a2fafc9e124a853d6","observation_id":"98ee129c-887e-4366-9034-d7e69c480b1f","resolution":{"observed_at":"2026-08-11T21:13:29.153366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.138164Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"bf267adc-7926-4af2-88cb-739e051a9946","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.141804Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:c7d9be5b8a12044b6153c824ec1500bfa8b8c797b46d12689d702a2dd30beb76","observation_id":"fb9a472f-f740-4933-badc-0bfbba853a73","resolution":{"observed_at":"2026-08-11T21:13:29.142203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.112064Z","title":"Neuralcompres- sion","venue":null,"work_id":"0700e678-fa56-459d-877c-b1b29dbda39a","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.145310Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:8782ce07d006db125bc0e5744c7d43cc57055da26a892fdc3c034fddf88c19fb","observation_id":"7acc4f72-2987-4955-9a26-3c2300b07bc0","resolution":{"observed_at":"2026-08-11T21:13:29.124056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:29.054597Z","title":"Improving statistical fidelity for neural image compression with implicit local likelihood models","venue":null,"work_id":"14a08e16-8d38-4cb1-a1ac-fac3ebb6ffae","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.148407Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:2135b9f90ca850543618a69da707d34c762ada4e665b5149500f320bfd27bc20","observation_id":"e5c42c43-05f6-4d0a-8ac6-36d38a454ab7","resolution":{"observed_at":"2026-08-11T21:13:29.086739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07793","last_updated":"2022-11-14T22:54:19Z","snapshot_observed_at":"2026-08-13T13:42:58.252242Z","submitted_at":"2022-11-14T22:54:19Z","title":"Extreme Generative Image Compression by Learning Text Embedding from Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07793","snapshot_observed_at":"2026-08-11T21:13:26.151690Z","title":"Extreme generative image compression by learning text embedding from diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.151690Z"},"links":{"cited_paper":"/paper/2211.07793","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:26d1525690c874293fa2727a384e27569ba586b2d76a85e187da70389ec65d64","observation_id":"80d9ad71-65f6-401d-b5d9-6e515640959c","resolution":{"observed_at":"2026-08-11T21:13:26.151690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13847","last_updated":"2023-11-28T14:49:54Z","snapshot_observed_at":"2026-08-13T05:19:12.248663Z","submitted_at":"2023-11-23T08:31:11Z","title":"Perceptual Image Compression with Cooperative Cross-Modal Side Information","version":2},"cited_work":{"arxiv_id":"2311.13847","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.13847","snapshot_observed_at":"2026-08-11T21:13:27.194173Z","title":"Perceptual Image Compression with Cooperative Cross-Modal Side Information","venue":"cs.CV","work_id":"ab6c35f9-e2a2-4d00-b9b7-4e1c00e986fa","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.155630Z"},"links":{"cited_paper":"/paper/2311.13847","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:6231c93f118d09ac9ef36d8dd4a84df5ecd553ca881405943e68d45816db12ef","observation_id":"59f62691-0d29-41e1-9a12-5bf406b89aa8","resolution":{"observed_at":"2026-08-11T21:13:27.200526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.942304Z","title":"An overview of the jpeg 2000 still image compression standard","venue":null,"work_id":"763e346a-3724-42f9-ab16-fca37d061d2b","year":2000},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.196582Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:3544227af209aaea862a22ca48e48124c2e92ce5da15260957bf81c00334ad3c","observation_id":"44e8a880-8997-4006-9587-69d083f0e5df","resolution":{"observed_at":"2026-08-11T21:13:28.996172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.928425Z","title":"Moe-diffir: Task- customized diffusion priors for universal compressed image restoration","venue":null,"work_id":"49508e60-a962-4340-bc2f-619e1355dc55","year":2025},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.268341Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:cda5a4eb593bd84b58bef3098cd8b78305946d02149c1e57ac0bd267b88b33fc","observation_id":"d81df0e4-3655-4d8b-b35f-f59572552dce","resolution":{"observed_at":"2026-08-11T21:13:28.934172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.879716Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"7575932b-c692-47c7-9bb3-de743f28d8e9","year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.290976Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:fe78fb0503406a89bb7c3b8a84247af7751d2feba4c9300f78d3ea8112939ee1","observation_id":"8fe6bb94-fc87-4498-b0bb-6ae917e2bdd2","resolution":{"observed_at":"2026-08-11T21:13:28.902110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-12T01:14:44.484432Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-11T21:13:26.301771Z","title":"Progressive distillation for fast sampling of diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.301771Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:a3855b29f5f6dbfaf9e45d5e14f834955a3aa1dee09848ec0f098cae2c7b0f35","observation_id":"ab964374-d937-4919-86dc-1b91ef8892e6","resolution":{"observed_at":"2026-08-11T21:13:26.301771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:26.320886Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.320886Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:78460791068e56a6a983604b9850e2474499811dac7803613dd6dc72bb485b0e","observation_id":"1fe5ffee-2ddc-4e9a-8d95-d36211553cbd","resolution":{"observed_at":"2026-08-11T21:13:26.320886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.794755Z","title":"Denoising diffusion implicit models","venue":null,"work_id":"041ea4f8-3636-4503-a9c8-0d906a862ad7","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.385200Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:63d4056dda3d712edfeeacd8e2e9ff509dafebcf5365c4c4a38898e3ae64a3f2","observation_id":"32bda420-5ed1-44e0-9a47-0f419a02e79f","resolution":{"observed_at":"2026-08-11T21:13:28.835434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-11T21:13:26.444154Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.444154Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:606a3b1c7938f09a90d94f218da2ff3ec090a72ea5671ccf38dbaf80badb820a","observation_id":"28d62ffe-3669-4f3f-a164-55a1d027ae4d","resolution":{"observed_at":"2026-08-11T21:13:26.444154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-08-14T04:45:59.072029Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01469","snapshot_observed_at":"2026-08-11T21:13:26.507534Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.507534Z"},"links":{"cited_paper":"/paper/2303.01469","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:0e7e8428dce89e23f9861735d7250b11e96065a26617d05b396916afef54c786","observation_id":"2d4ad8ee-265a-43a3-a370-4069507a7e85","resolution":{"observed_at":"2026-08-11T21:13:26.507534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.689553Z","title":"Overview of the high efficiency video coding (hevc) standard","venue":null,"work_id":"04e8879f-6251-475d-88da-62cee2ea00cc","year":2012},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.512068Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:c74a6ac94b6fb1abe7cc6af8716ab14ac663af9ab4e9d5b686c10d59b44d555a","observation_id":"8b3cfde7-3eae-4608-b9ed-cf1af612e49c","resolution":{"observed_at":"2026-08-11T21:13:28.752298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.544975Z","title":"Semantic structured image coding framework for multiple intelligent applications","venue":null,"work_id":"84d0d6e2-89a9-4cf2-861e-2f621373a151","year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.525516Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:378b0d5b8caffb4f9dc9f8556e3c1123de3506f1db489a9dd1c82592e46021ee","observation_id":"279c09cc-0a47-493c-b401-db7c5a36437d","resolution":{"observed_at":"2026-08-11T21:13:28.609073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.523610Z","title":"Algorithms for the communication of samples","venue":null,"work_id":"439c9c2a-9688-4a0f-9aaa-d9ac64e1e55a","year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.533211Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:a1f7d96280a2937faea58cce580dd6916e256e13c8cde3a68a411dba9dd299b2","observation_id":"6f0b1173-6671-4bc0-a152-8b9f9431ad94","resolution":{"observed_at":"2026-08-11T21:13:28.536134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08889","last_updated":"2022-12-31T13:56:37Z","snapshot_observed_at":"2026-08-13T15:21:54.762328Z","submitted_at":"2022-06-17T16:46:31Z","title":"Lossy Compression with Gaussian Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08889","snapshot_observed_at":"2026-08-11T21:13:26.537000Z","title":"Lossy compression with gaussian diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.537000Z"},"links":{"cited_paper":"/paper/2206.08889","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:1c94b3a3cf8210ad215948807cda6561316b3ff16e5f1d315ca7c147a7e148ee","observation_id":"f05e289c-aade-4a7a-9a5e-a7c564da91f4","resolution":{"observed_at":"2026-08-11T21:13:26.537000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.437827Z","title":"Workshop and challenge on learned image compres- sion (clic2020), 2020","venue":null,"work_id":"2f5e96bf-fe36-40f7-be2b-87a8decd2a4a","year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.540433Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:5510555dbc321aec0c69f5f5e6be154079cdddcfa25598c69595e2a5e503cf00","observation_id":"814edff2-95cb-4631-bc6a-f18e4b5172c7","resolution":{"observed_at":"2026-08-11T21:13:28.488510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:26.545006Z","title":"Multimodal research in vision and language: A review of current and emerging trends","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.545006Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:47ed76c0f44890f8046c4ac02104ba04621ffc27321ca1ede5e8fe8db018b161","observation_id":"7dd15b80-3e3c-4e0e-b5b7-866032f21df3","resolution":{"observed_at":"2026-08-11T21:13:26.545006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.323678Z","title":"The jpeg still picture compression stan- dard","venue":null,"work_id":"23c92c0e-087e-4fe7-ae84-1e6f7b18da66","year":1992},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.573533Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:dcb3a3266cdec1a95df8fad756c1743836bcfaf897322c3eca6ef085d73d38b8","observation_id":"e9a85f44-5c3d-4db1-a98b-fe75fd4a264f","resolution":{"observed_at":"2026-08-11T21:13:28.389284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.243886Z","title":"Chan, and Chen Change Loy","venue":null,"work_id":"a2c4e448-8b25-4eb6-a4a4-26eee8b7f817","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.640751Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:f7674fc8482ad117324388b92ea6b1fd0482daf4d50e26028734b5df78fe40c5","observation_id":"60bc2ac1-fa0f-4a2b-8a8b-6972ac48d2bb","resolution":{"observed_at":"2026-08-11T21:13:28.248391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.228519Z","title":"Cogvlm: Visual expert for pretrained language models, 2023","venue":null,"work_id":"ec11405c-8ff3-4b0a-a07c-406ffba2f3fd","year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.710897Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:dd5d0a733c0a89599a4df589922dd96b3322dbb67dc884df6d97b5877ac5605d","observation_id":"a1ea33d4-6686-4bb4-8bb1-1d0970d42fbc","resolution":{"observed_at":"2026-08-11T21:13:28.235813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.214689Z","title":"Learned block-based hybrid image compression","venue":null,"work_id":"61268745-62c4-4a64-b0c2-f773d3ceae61","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.760081Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:9062f04590057a9ab0af0a46feca8dc9dd8a58d6a0ffd9d906a3596c18352449","observation_id":"707dd02a-ba30-405f-a032-7bc59d076fe7","resolution":{"observed_at":"2026-08-11T21:13:28.219890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.124072Z","title":"Idempotence and perceptual image compression","venue":null,"work_id":"4faab6b5-5029-4341-beea-f9421cd2abf9","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.803767Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:4ce6b08802af9721a69480c5e04c3fa387794d665b774abfda7720ba5867d7c3","observation_id":"c3979568-48ea-4055-8361-0c7bb1c2141f","resolution":{"observed_at":"2026-08-11T21:13:28.177256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:28.050168Z","title":"On perceptual lossy compression: The cost of perceptual reconstruction and an optimal training framework","venue":null,"work_id":"62688d70-6571-4c3a-9beb-c545fb8219f6","year":2021},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.817565Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:3b11440ea514f9fae0cbcb5deacfd8b005d28d683655bbeac7d550ad31d23b90","observation_id":"a45b2888-8455-4f40-a594-07411635d2f7","resolution":{"observed_at":"2026-08-11T21:13:28.084440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.943107Z","title":"Lossy image compres- sion with conditional diffusion models","venue":null,"work_id":"3593c766-5fb3-4e9a-8856-485a1bdc5f76","year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.836951Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:0e8e0b17e0b53b883ef94867edb243a037d1d839539b9057c0a7407abda4ba44","observation_id":"94365feb-efe9-4a9e-a182-61c9f8bd5855","resolution":{"observed_at":"2026-08-11T21:13:27.990068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.859469Z","title":"Improving inference for neural image compression","venue":null,"work_id":"850abdac-f096-4367-97b4-488c55ba3a5e","year":2020},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.856138Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:8d944de990d10a4eea453682032930f8d528343268288261e129205a93409989","observation_id":"5c3ec119-d1a3-4bbd-b007-3ee9d550d3ae","resolution":{"observed_at":"2026-08-11T21:13:27.900044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13627","last_updated":"2024-04-03T08:12:08Z","snapshot_observed_at":"2026-08-13T04:35:20.730665Z","submitted_at":"2024-01-24T17:58:07Z","title":"Scaling Up to Excellence: Practicing Model Scaling for Photo-Realistic Image Restoration In the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13627","snapshot_observed_at":"2026-08-11T21:13:26.873757Z","title":"Scaling up to excellence: Practicing model scaling for photo-realistic image restoration in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.873757Z"},"links":{"cited_paper":"/paper/2401.13627","citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:8c462cde5422bf1a468f0ff139525512f8d8782c8e6425ffc18c6aa23cf2e5ce","observation_id":"b3a17977-f9dd-433d-b2d2-f8f85be226b7","resolution":{"observed_at":"2026-08-11T21:13:26.873757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:26.914813Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.914813Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:27505da908b4ff046c8e07c225397fc13f63be7a44b3f3039b703fee9946bb2d","observation_id":"3b2de55f-0d79-44be-b328-3ecdbcdbd0cd","resolution":{"observed_at":"2026-08-11T21:13:26.914813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:26.934797Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.934797Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:6a053e76773810bfb6e49da5579b0ac6fa1fdc56ba169830e0e6e44fde7fcaa6","observation_id":"ccec8ea1-db89-481b-8f60-5ef0e2f93f66","resolution":{"observed_at":"2026-08-11T21:13:26.934797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.774858Z","title":"Transformer-based transform coding","venue":null,"work_id":"7d9e329c-e0f9-4c68-bdfb-ae17b4acc977","year":2022},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.948797Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:d4a2309067b7c332b427e859e50d03bc5cbaa89a414dbb5e59bd8963e1a14ede","observation_id":"da179623-2141-4e85-bef5-a5316369335c","resolution":{"observed_at":"2026-08-11T21:13:27.816447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.650860Z","title":"The devil is in the details: Window-based attention for image compression","venue":null,"work_id":"194feeab-fcd3-4c36-8dd3-5d654b663bbb","year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.973564Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:dd8111bca5f73afd9d3a8ff8f7974ee920fc07d69413f7aaf55dd6cf73f958d0","observation_id":"392bed9a-6bac-4d42-b2e3-1a57e0620a45","resolution":{"observed_at":"2026-08-11T21:13:27.702151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.602262Z","title":"Further Experimental Details Implementation Details","venue":null,"work_id":"d8887190-5493-4126-8106-4933502bf859","year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:27.045307Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:93a5c50f27de8ea423e7aecfbf06f986f2d05607db6ffe6fc6ad92c52469897a","observation_id":"4f847e62-f488-48d5-8140-fe87efe6fceb","resolution":{"observed_at":"2026-08-11T21:13:27.620402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:13:27.634938Z","title":"This includes the further experi- mental details, additional experimental results","venue":null,"work_id":"622f1b33-1c11-4b1f-b49d-0a3fab4269bb","year":null},"citing_paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T21:13:26.988759Z"},"links":{"citing_paper":"/paper/2412.04912"},"observation_digest":"sha256:b2ad095a7711fb68a28d457780514db8cd33f9f15a62ac9a3d998ef450be8c65","observation_id":"d9b4f4a8-655c-49d2-a34b-46355e6f5f9d","resolution":{"observed_at":"2026-08-11T21:13:27.640873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.04912","last_updated":"2024-12-09T09:50:00Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-11T22:00:47.110812Z","submitted_at":"2024-12-06T10:08:55Z","title":"UniMIC: Towards Universal Multi-modality Perceptual Image Compression"},"reference_resolution":{"displayed":85,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":52},"total_outbound_references":85},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 85 of 85 outbound references and 0 inbound Pith citation observations for arXiv:2412.04912."}