{"as_of":"2026-08-09T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbca373413d129f61fb477e4ea346524dbd6262c16e78cc4148f767a26edb16f","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:26:40.101386Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T23:27:57.034391Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T15:47:06.420541Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"cited_work":{"arxiv_id":"2601.03112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03112","snapshot_observed_at":"2026-07-02T15:47:06.420541Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","venue":"eess.IV","work_id":"d3c56b82-8975-4d20-a7fe-5715d466b892","year":2026},"citing_paper":{"arxiv_id":"2606.06273","last_updated":"2026-06-04T15:14:31Z","snapshot_observed_at":"2026-08-07T16:10:54.746687Z","submitted_at":"2026-06-04T15:14:31Z","title":"Adapting Diffusion Language Models for Lossless Pixel-Level Image Transmission","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T23:27:57.034391Z"},"links":{"cited_paper":"/paper/2601.03112","citing_paper":"/paper/2606.06273"},"observation_digest":"sha256:6b5c3404cc9f36424d25b87907e5c1670920aeb109d031b32dd16f0f58c45f21","observation_id":"aae5ef50-3d65-4104-ad43-137bbe9f9152","resolution":{"observed_at":"2026-07-02T15:47:06.422031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.03112/citation-record","integrity":"/paper/2601.03112/integrity","json":"/paper/2601.03112/citation-record.json","paper":"/paper/2601.03112"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:35.444976Z","title":"Joint source and channel coding,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:35.444976Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:97f5496a5a838f1bfe2e288f08a70611b983957471553a246768c6a1f148e9bf","observation_id":"89ab36b1-87aa-489b-8c92-51510e16651e","resolution":{"observed_at":"2026-08-03T12:26:35.444976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:35.557828Z","title":"Deep joint source- channel coding for wireless image transmission,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:35.557828Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:a95c9c31f6c32dd52881e41a4dff5f966e885bf849ae993625f01399c1d69a58","observation_id":"1a8d79a5-9978-4a69-847d-5d830549009b","resolution":{"observed_at":"2026-08-03T12:26:35.557828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:35.662514Z","title":"Deepjscc-f: Deep joint source-channel coding of images with feedback,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:35.662514Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:eec9e4e1b4c6461cabcffee7418f803204929b62d122334bbffe45b9bed8f464","observation_id":"45291601-c12a-40b6-ac01-bc99415d660a","resolution":{"observed_at":"2026-08-03T12:26:35.662514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:35.817540Z","title":"Bandwidth-agile image transmission with deep joint source- channel coding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:35.817540Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:75d7ade0bc418e159ca289a5d97c57f718565c3479bfe21080f28c15ebfe183b","observation_id":"92335a50-7ad9-4080-8a7c-18cd9b81b4dc","resolution":{"observed_at":"2026-08-03T12:26:35.817540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:35.938727Z","title":"Swinjscc: taming swin transformer for deep joint source-channel coding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:35.938727Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:cbab42e77d4a4135f145301a0d6eb9a3792244bbd14a387d8587ec46447434b9","observation_id":"7deac8f4-b4fd-48ee-8068-6330dfee0bfd","resolution":{"observed_at":"2026-08-03T12:26:35.938727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.065995Z","title":"Nonlinear transform source-channel coding for semantic communications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.065995Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:87cbf8df9f617eeecd711568ff695b2d9d2a7106e7d263b6659cab4d069ab37b","observation_id":"e737442f-1db9-4394-8f98-db44282ff230","resolution":{"observed_at":"2026-08-03T12:26:36.065995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.186549Z","title":"Improved nonlinear transform source-channel coding to catalyze semantic com- munications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.186549Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:fb02b5a45d4ed892ba19125a57dba42220a9434ce9ddded20af8ea45e500bcf3","observation_id":"e76bb25c-e124-4efe-b048-9f4130f47aad","resolution":{"observed_at":"2026-08-03T12:26:36.186549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.235718Z","title":"Ofdm-guided deep joint source channel coding for wireless multipath fading channels,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.235718Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:79b5d6a8b76d537dae386dfc1d7502e76acfe1e03dc96c134eb61d598f65161c","observation_id":"cfd5a0ea-5a3c-4667-a86c-3c8f4443e38f","resolution":{"observed_at":"2026-08-03T12:26:36.235718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.332811Z","title":"Generative joint source-channel coding for semantic image transmission,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.332811Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:71368f2402006f880c6a2ea19f149cf28516b793dbb187271f567ce0d671ecac","observation_id":"fa90519d-8467-49cd-9397-904a410bce73","resolution":{"observed_at":"2026-08-03T12:26:36.332811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.412588Z","title":"Rate-distortion-perception controllable joint source-channel coding for high-fidelity generative semantic communications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.412588Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:ddd1f42b076d3830313a517fce3209baa19c4f64c432a447f8bfdee5aec50ccd","observation_id":"45c231a1-3419-4ea2-b000-9a9ac99ac3d5","resolution":{"observed_at":"2026-08-03T12:26:36.412588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.536756Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.536756Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:5347a6bc138cbbf6f70ba474fa9dde75a8396ccdf5b04bf3ba1273fcb089837f","observation_id":"4bcf6aa4-fddf-4423-a44d-3b4b4aabd3c5","resolution":{"observed_at":"2026-08-03T12:26:36.536756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.646359Z","title":"Image quality assess- ment: Unifying structure and texture similarity,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.646359Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:baa78d0b3456dd3f1489a5e1044b6b108aa686ce6b59e4b7e2b21e099a86ab72","observation_id":"881c266d-c4d5-47b1-b059-c44244dec153","resolution":{"observed_at":"2026-08-03T12:26:36.646359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.798413Z","title":"Learning new dimensions of human visual similarity using syn- thetic data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.798413Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:32655215467f832d9eba5bc5d914d7cd2e00840a00114f1b2934c2b1700c91eb","observation_id":"f5553520-da21-4a40-9d4a-da18e12c1a34","resolution":{"observed_at":"2026-08-03T12:26:36.798413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:36.912724Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:36.912724Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:73bf203420cf4e01511953fd7f19c35644e7e6773b457b51b6891c7bc5589606","observation_id":"104a9576-d011-4fb0-8c37-ad6d49dac2ba","resolution":{"observed_at":"2026-08-03T12:26:36.912724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.030672Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.030672Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:daad41b6bbc610085603bd60eba1ca55853a598498d74803df3476c6343853a8","observation_id":"134fe81f-4901-4cc3-aba1-2ea6d7c61da2","resolution":{"observed_at":"2026-08-03T12:26:37.030672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.152033Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.152033Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:debf6a1403c0f13b347ba735c8009b43b155a50385a4f27156b38f77a52df4dc","observation_id":"dc7a608a-f67e-4adc-acd5-841cb83c8115","resolution":{"observed_at":"2026-08-03T12:26:37.152033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.318041Z","title":"A hybrid wireless image transmission scheme with diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.318041Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:ad7411feaae6ae98575a38f8fe8a8fc243e0a98cb77af7f3a7b3489784c515ec","observation_id":"1fdc9ccc-ae83-447e-a881-9c1c3a0abfc4","resolution":{"observed_at":"2026-08-03T12:26:37.318041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.421521Z","title":"Cddm: Channel denoising diffusion models for wireless semantic communica- tions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.421521Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:945c98b123de4b210a879c6c6600c28f95973768354d942bd399ce96a63506a6","observation_id":"6cd1eb5d-2897-4616-9420-db70a486c52b","resolution":{"observed_at":"2026-08-03T12:26:37.421521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.494433Z","title":"Semantics- guided diffusion for deep joint source-channel coding in wireless image transmission,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.494433Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:53f785e30aa6ccc0e233842ec1ade5b883b17860ff150d19c35823aefadd0120","observation_id":"0748833f-8170-4146-9673-be50703aa320","resolution":{"observed_at":"2026-08-03T12:26:37.494433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17736","last_updated":"2025-03-22T00:52:41Z","snapshot_observed_at":"2026-07-06T18:06:20.657123Z","submitted_at":"2024-04-27T00:12:13Z","title":"Diffusion-Aided Joint Source Channel Coding For High Realism Wireless Image Transmission","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17736","snapshot_observed_at":"2026-08-03T12:26:37.604901Z","title":"Diffusion-aided joint source channel coding for high realism wireless image transmission,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.604901Z"},"links":{"cited_paper":"/paper/2404.17736","citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:6ea02ad1719d7c208f7dd79c9df8cf65560b2a9ad239ad888f038af6f75d9d56","observation_id":"70c2bbc2-ed21-4b12-9f7a-2cc17d3ca131","resolution":{"observed_at":"2026-08-03T12:26:37.604901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.747483Z","title":"Diffcom: Channel received signal is a natural condition to guide diffusion posterior sampling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.747483Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:b4118e5fba2d27b51cd9d701449d40d995292fea445c0b22806d9afcf6957ed7","observation_id":"91f3b220-7ea1-41ac-8311-f7c1f0aae9ed","resolution":{"observed_at":"2026-08-03T12:26:37.747483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.823669Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.823669Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:2a3682c7e5ce6ef86927c69cc5fa607ce4f9edccfdc2d81c6719f0d5c4cdc73b","observation_id":"60b9231a-d775-4cce-929c-e8cc07d99581","resolution":{"observed_at":"2026-08-03T12:26:37.823669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:37.902581Z","title":"Pixart-δ: Fast and controllable image generation with latent consistency models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:37.902581Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:944ff6512f501f0debf1716f845e12f579e5d90d3b140112051e516728911a78","observation_id":"cc9daac0-9b8c-4598-a531-93f2570fe2fe","resolution":{"observed_at":"2026-08-03T12:26:37.902581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.023624Z","title":"Masked au- toencoders are scalable vision learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.023624Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:14f6652cd50017f07ce69a0deea4dbd8ddf4dfdfeb2da1a2d8b72acfa41e0827","observation_id":"87d60f16-b42d-4d10-b603-b5fc898de505","resolution":{"observed_at":"2026-08-03T12:26:38.023624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.182041Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.182041Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:876d462c82132e39c521b50e703f8254c51ffbe110d497b1f9f5bf83d6b506e3","observation_id":"9054ac57-9a2e-46dd-98ac-52b562c1a559","resolution":{"observed_at":"2026-08-03T12:26:38.182041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.340208Z","title":"What matters for representation alignment: Global information or spatial structure?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.340208Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:3fc21b24719edc52928c2135ddf525139ab7229cc2b39990bef28f56a733a217","observation_id":"44f227db-5d98-4b5b-98d9-50dc7d406f38","resolution":{"observed_at":"2026-08-03T12:26:38.340208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.450576Z","title":"Rep- resentation alignment for generation: Training diffusion transformers is easier than you think,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.450576Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:59cc62d10c8a42cb4f7e25bd47dc77a25fec05c1c9dfac73108ad4c1b724fa82","observation_id":"5b82cf4c-460f-4f90-b3a1-407da3aee2b6","resolution":{"observed_at":"2026-08-03T12:26:38.450576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.579668Z","title":"Repa-e: Unlocking vae for end-to-end tuning of latent diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.579668Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:b82a22a661d7fab8b129bed050681b7f953d6b4d77111b396d9b23a51438eaee","observation_id":"a78924f7-1ab1-4d52-9d1c-a0ed040ab3ed","resolution":{"observed_at":"2026-08-03T12:26:38.579668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.700268Z","title":"Reconstruction vs. generation: Taming optimization dilemma in latent diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.700268Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:5604a27ff40159ee93ae824785fbfdf8ff1e61cffd4a2ccc6abeff8db3ee8a5e","observation_id":"72b23ccd-d7aa-437b-8df4-982b5f5ba039","resolution":{"observed_at":"2026-08-03T12:26:38.700268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.788893Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.788893Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:b7aafe15af452c47c18775386a2400bb2e5a3892e9a22dfe42e50a3fb2f76680","observation_id":"a5d95c27-cab9-4e1d-8ed9-5d41285d8743","resolution":{"observed_at":"2026-08-03T12:26:38.788893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.846579Z","title":"All are worth words: A vit backbone for diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.846579Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:f5875a8caf7919fbae49a11e0d3d5a7bd599102194202db74afc34e42b0719a8","observation_id":"732be88f-6b51-4fd8-9295-25bc39b39e7d","resolution":{"observed_at":"2026-08-03T12:26:38.846579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:38.920422Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:38.920422Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:77868e37f10e1d949db866f611ec5ed3f5dbfb4bc1ab9dfba8d39335ac060780","observation_id":"90d1e21b-ca63-4c1f-b759-0084f58a1bdb","resolution":{"observed_at":"2026-08-03T12:26:38.920422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.011167Z","title":"Scalable diffusion models with transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.011167Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:3e6d5d2b201caa9b8c95e4bfafc298b1ed42064b9033205988cc9305cbb3f16d","observation_id":"035bac7a-8fc5-4693-aa7d-69a780620258","resolution":{"observed_at":"2026-08-03T12:26:39.011167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.094395Z","title":"Rethinking lossy compression: The rate- distortion-perception tradeoff,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.094395Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:160bb97a8e362f38600fffaaa8b2c835038eb3f73ab98aa5dfdbc7376a8a4709","observation_id":"478e4218-2d09-4215-8331-c5837a6f6527","resolution":{"observed_at":"2026-08-03T12:26:39.094395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.140268Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.140268Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:c727c34d3ca8aec86f25a3075ebaf4b08a6b71f7b1d2c6defa4b49c91f4990ee","observation_id":"f793c0fc-6d6b-4e12-a163-c850cddf5abf","resolution":{"observed_at":"2026-08-03T12:26:39.140268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.191352Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.191352Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:cb0c872816637e260673aaff6ac196a8c8c9f125c0c3007d9510d917ac9535aa","observation_id":"3b338404-71e8-488f-80a4-58ce6e33f3cc","resolution":{"observed_at":"2026-08-03T12:26:39.191352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.325114Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.325114Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:6d5b17daaef2f710d4ae0ae7fe6a712827c77d84229b9f392516e120ab8000ac","observation_id":"7a0be6ab-b5a9-47ba-abc3-0d3cd846d70f","resolution":{"observed_at":"2026-08-03T12:26:39.325114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.403586Z","title":"Universal rate-distortion- perception representations for lossy compression,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.403586Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:957198222887a3e211642be7074f5ecb303d0f1be0d258d819f91f5cc3707c0b","observation_id":"e9aa3db7-c13f-43ff-a922-9e28dcfcdcf9","resolution":{"observed_at":"2026-08-03T12:26:39.403586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.479524Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.479524Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:828f0fb292ade85a537309840343eddaaaa4ef58d5bad6fc9aad3d74daadefc9","observation_id":"5aef424a-05d2-4eea-8f35-937f8c08f80c","resolution":{"observed_at":"2026-08-03T12:26:39.479524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.567108Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.567108Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:f24d8a978d5cfe541c5ac6fd1cd43d46af08b5bc2a612df6ddf3037fcf512f0d","observation_id":"666e93ec-0da2-4a3a-bb51-ca950da51037","resolution":{"observed_at":"2026-08-03T12:26:39.567108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.640037Z","title":"Design of low-density parity check codes for 5g new radio,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.640037Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:89f7215910d9ff3a8678e04c4d0ca5a0e2beef1cdfa0b0943ca157607e3e7997","observation_id":"35f0d3c3-4536-44ff-954e-ff4426002b75","resolution":{"observed_at":"2026-08-03T12:26:39.640037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.726420Z","title":"BPG image format","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.726420Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:33890fa77c50d1aa4ab6cdfc2e0acf65ce9bc932fe217c6b5b17d9164cd56ee0","observation_id":"fcccab4c-733c-4d1b-8700-342cbd8d587c","resolution":{"observed_at":"2026-08-03T12:26:39.726420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.803504Z","title":"Devel- opments in international video coding standardization after avc, with an overview of versatile video coding (vvc),","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.803504Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:f635d78faba599eb9d2e153b1acf1128c519589e9b5183a883432f10297a07eb","observation_id":"dca28e2b-de91-4f11-8e92-68cf1fe8b971","resolution":{"observed_at":"2026-08-03T12:26:39.803504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.888486Z","title":"Towards image compression with perfect realism at ultra-low bitrates,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.888486Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:30eff13ddf384545a64af9472e78f94c04c6ff93e74f1952c0df7293cae9fef3","observation_id":"8c2faa91-0049-4539-8cc0-18d52126e064","resolution":{"observed_at":"2026-08-03T12:26:39.888486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:39.945834Z","title":"Towards extreme image compression with latent feature guidance and diffusion prior,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:39.945834Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:036771db36d6284d145031a0587d57f8f42766d61d995d3512d86180ed52ef43","observation_id":"71ffafa0-00e0-4b99-8580-b9077eb7a4b3","resolution":{"observed_at":"2026-08-03T12:26:39.945834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:26:40.021852Z","title":"Seeing what a gan cannot generate,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:40.021852Z"},"links":{"citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:94486383d94bdb3887f37405ab568641d2cef7fff7b35bc51a13e10608bde33a","observation_id":"73f5336d-f69b-45ef-aa02-30b5c5db0708","resolution":{"observed_at":"2026-08-03T12:26:40.021852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-03T12:26:40.101386Z","title":"Sim ´eoni, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T12:26:40.101386Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2601.03112"},"observation_digest":"sha256:a4b50b18569c712bb1a99d087fee17dbe43bb7bc18c482f75f982fe849b17514","observation_id":"c29bb0d1-0435-47b3-a0bd-9a9c5a67934e","resolution":{"observed_at":"2026-08-03T12:26:40.101386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.03112","last_updated":"2026-06-18T07:06:52Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-06T16:39:05.098401Z","submitted_at":"2026-01-06T15:42:45Z","title":"DiT-JSCC: Rethinking Deep JSCC with Diffusion Transformers and Semantic Representations"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2601.03112."}