{"as_of":"2026-08-15T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ee531fcae9224374788032c4fe41b50ed3b572d7f42bd966355ddacad51c4cd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:02:16.499212Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02929/citation-record","integrity":"/paper/2412.02929/integrity","json":"/paper/2412.02929/citation-record.json","paper":"/paper/2412.02929"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.313479Z","title":null,"venue":null,"work_id":"cf1aa4cb-316b-443a-ba8a-a53f242bdda9","year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.000083Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:f0cfbddd6dbcc54f1c4083addc88266f2133c99d1c9b1b99cafffba1ed8dfef4","observation_id":"c31c460b-5add-45ee-b833-7e31738708ed","resolution":{"observed_at":"2026-08-11T23:02:18.322481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.277132Z","title":null,"venue":null,"work_id":"a3527983-239e-4abb-9da6-2956bda055fe","year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.012177Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:9f392f53ffe0eca5ae11fa593bbeb6982b4d70671163274b5542ce2dc07d6076","observation_id":"88cc893e-d035-4e98-953a-923af3235568","resolution":{"observed_at":"2026-08-11T23:02:18.288285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-13T04:36:44.594755Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-11T23:02:16.019599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.019599Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:b47de4863187f594115bd92b86ed2393d3eb2a52990fc6b3b105dd0d221dd2dd","observation_id":"3b50c668-e893-49fc-8d9f-0ca408a7dda1","resolution":{"observed_at":"2026-08-11T23:02:16.019599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.03126","last_updated":"2022-03-16T01:35:49Z","snapshot_observed_at":"2026-08-13T17:20:38.896092Z","submitted_at":"2021-12-06T15:55:30Z","title":"Label-Efficient Semantic Segmentation with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.03126","snapshot_observed_at":"2026-08-11T23:02:16.039278Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.039278Z"},"links":{"cited_paper":"/paper/2112.03126","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:f5dedf657e7e91d16a20035c81e5e70f92f13612de53f768120115560013acbc","observation_id":"3efdd5f4-98d6-4294-9ed0-ddd137465860","resolution":{"observed_at":"2026-08-11T23:02:16.039278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04248","last_updated":"2023-03-07T21:46:15Z","snapshot_observed_at":"2026-08-13T12:29:32.184575Z","submitted_at":"2023-03-07T21:46:15Z","title":"TRACT: Denoising Diffusion Models with Transitive Closure Time-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04248","snapshot_observed_at":"2026-08-11T23:02:16.046098Z","title":"A.; Zhai, S.; Hu, S.; Zheng, D.; Talbott, W.; and Gu, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.046098Z"},"links":{"cited_paper":"/paper/2303.04248","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:8be5911b69df4d7dec1048ebad1b434a707bca8f450abbb91602be36aa93a4b8","observation_id":"ac007b57-9c7c-494f-81f2-2b119226ea46","resolution":{"observed_at":"2026-08-11T23:02:16.046098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-13T13:40:09.134144Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-11T23:02:16.067052Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.067052Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:4b21b89a504bbe54e20939f006c55435562cc05a8cdbae86b815e542fedd34ae","observation_id":"ac375ce6-948c-480a-b0be-7e486dc5038e","resolution":{"observed_at":"2026-08-11T23:02:16.067052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:16.078493Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.078493Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:dcd1b8a3f48b2f6c98f1bc479de311e54b4f0d0390d88199dabaf99fbcc0834d","observation_id":"a858f3d0-d82e-4b58-aedd-342878ade90f","resolution":{"observed_at":"2026-08-11T23:02:16.078493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12872","last_updated":"2020-05-28T17:37:23Z","snapshot_observed_at":"2026-08-14T22:50:00.733302Z","submitted_at":"2020-05-26T17:06:38Z","title":"End-to-End Object Detection with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12872","snapshot_observed_at":"2026-08-11T23:02:16.090323Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.090323Z"},"links":{"cited_paper":"/paper/2005.12872","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ec6b70b9227cb2d3e14c1b62d0441ea07127afd3533b241cd48db0b285a47fdc","observation_id":"6d2e6071-af6b-4aed-9fb5-4c5e5f93ea0d","resolution":{"observed_at":"2026-08-11T23:02:16.090323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.211826Z","title":null,"venue":null,"work_id":"1cc60d02-0fd3-4496-b774-2e8deb3e1aef","year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.107613Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:aef397c4ef5f0f93f4e5bad2b977047e413033db72ff4725e3f58045e87e9e75","observation_id":"a9adae15-ba61-4316-8f1a-ae62906337ee","resolution":{"observed_at":"2026-08-11T23:02:18.220125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04202","last_updated":"2023-03-01T00:18:33Z","snapshot_observed_at":"2026-08-13T14:48:56.811001Z","submitted_at":"2022-08-08T15:08:40Z","title":"Analog Bits: Generating Discrete Data using Diffusion Models with Self-Conditioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.04202","snapshot_observed_at":"2026-08-11T23:02:16.120211Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.120211Z"},"links":{"cited_paper":"/paper/2208.04202","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:32969d93ba5c2eee0f83f0e736d2ba51bc4b1e67e68b5b9e20dafa125a64dc0f","observation_id":"2bb28a40-ae9a-4eb5-93b1-5c7126b9263f","resolution":{"observed_at":"2026-08-11T23:02:16.120211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.183965Z","title":"G.; Kirillov, A.; and Girdhar, R","venue":null,"work_id":"e9996daf-3adb-4a8b-9145-f5e618673579","year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.134880Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ac232208e997026eab3aead146af181bcb94699c58ce93af168b9b0656390d0a","observation_id":"15f05e15-afec-47e2-97d8-f6010aea47ae","resolution":{"observed_at":"2026-08-11T23:02:18.192262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-11T23:02:16.142664Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.142664Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:3cabdceba5c0250d4674cca5d0c427803e4ce456041f7ce6b718e3b25d22df3b","observation_id":"c1c3e792-ce05-4203-97b2-c5347f133105","resolution":{"observed_at":"2026-08-11T23:02:16.142664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13131","last_updated":"2022-03-24T15:44:50Z","snapshot_observed_at":"2026-08-13T16:15:54.920385Z","submitted_at":"2022-03-24T15:44:50Z","title":"Make-A-Scene: Scene-Based Text-to-Image Generation with Human Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13131","snapshot_observed_at":"2026-08-11T23:02:16.155084Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.155084Z"},"links":{"cited_paper":"/paper/2203.13131","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:d5e68dabbbb16b6cb8cfdb08bc8ba9a97630d22823e396e726a7063e030179f0","observation_id":"35a9d9f2-af4d-44a4-a181-5ecd624b11de","resolution":{"observed_at":"2026-08-11T23:02:16.155084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.08083","last_updated":"2015-09-27T15:10:14Z","snapshot_observed_at":"2026-08-14T22:50:25.308531Z","submitted_at":"2015-04-30T05:13:08Z","title":"Fast R-CNN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.08083","snapshot_observed_at":"2026-08-11T23:02:16.163082Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.163082Z"},"links":{"cited_paper":"/paper/1504.08083","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:cf89efcd24f21b6b365bb029fb7f16bc57e36738180c4f0d4943eeb7682eb6f6","observation_id":"b25e4795-2b40-4407-8704-2a64523c38b6","resolution":{"observed_at":"2026-08-11T23:02:16.163082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.14822","last_updated":"2022-03-03T10:49:30Z","snapshot_observed_at":"2026-08-13T17:25:22.709513Z","submitted_at":"2021-11-29T18:59:46Z","title":"Vector Quantized Diffusion Model for Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.14822","snapshot_observed_at":"2026-08-11T23:02:16.173684Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.173684Z"},"links":{"cited_paper":"/paper/2111.14822","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:8ccc515f649edef2a1cf4b360db44b4498d8bbc5714cc24b6a21b2471993def5","observation_id":"5822a77d-c2f4-42fe-900d-169e0d7d1681","resolution":{"observed_at":"2026-08-11T23:02:16.173684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06870","last_updated":"2018-01-24T07:54:08Z","snapshot_observed_at":"2026-08-14T21:10:56.758081Z","submitted_at":"2017-03-20T17:53:38Z","title":"Mask R-CNN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06870","snapshot_observed_at":"2026-08-11T23:02:16.187064Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.187064Z"},"links":{"cited_paper":"/paper/1703.06870","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:5c02865d8bde9f2d89272de6f59dab706b3f603ed76f4d29794d34adf1d30927","observation_id":"7bd73e04-4e2d-4fef-8019-88e28974dff9","resolution":{"observed_at":"2026-08-11T23:02:16.187064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T23:02:16.206928Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.206928Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ee655fa5c07caaa723774338cb47d9f5da5b9cdc0b1c91066b559ad14a25490f","observation_id":"bd231f9c-3c9f-4ea7-bf37-06913bb3fa24","resolution":{"observed_at":"2026-08-11T23:02:16.206928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-11T23:02:16.217583Z","title":"L.; and Choi, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.217583Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:1767bd8ca7aa88dbab492edc63066179692c815101b841049fa2c3d8bae0ff37","observation_id":"5a66836b-5dc7-4da0-8900-02125e3c1cad","resolution":{"observed_at":"2026-08-11T23:02:16.217583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:16.227848Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.227848Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:1665684f089f6744539da0773c13a719d7fb7f1d476e4df9e0606cf538916be0","observation_id":"c0a36c3a-218a-4767-9e75-7d66b46ee420","resolution":{"observed_at":"2026-08-11T23:02:16.227848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T23:02:16.233602Z","title":"P.; Poole, B.; Norouzi, M.; Fleet, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.233602Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:89f6ff50b92fd56023efae83def9530b8aa1c50482ffcbf8553902541158741c","observation_id":"35b69ff9-84ce-4c48-8944-7ed43c5c6f44","resolution":{"observed_at":"2026-08-11T23:02:16.233602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.119813Z","title":null,"venue":null,"work_id":"795325dd-a6bd-4ed0-9f3e-7c7d80f67f49","year":2020},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.247982Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ece7762d66942d35b0774a1016b861554ea8e5ea555348c0c82e4e39b293a077","observation_id":"db94aef3-4eb0-4099-b04c-0d54378565dc","resolution":{"observed_at":"2026-08-11T23:02:18.133359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T23:02:16.260018Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.260018Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:d2e98f2b85c5ab1c908ae5c61982d947984f67edf8afff184afae6d73f4c8052","observation_id":"b6ac713e-197c-4ce7-a4ca-51b2d7f60476","resolution":{"observed_at":"2026-08-11T23:02:16.260018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-08-14T21:59:49.734209Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-11T23:02:16.276802Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.276802Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:8440b160f4d3745086e8de1de668898c2219002cbb7e9d47d94bd55b60f05f98","observation_id":"fcd4a93b-9525-4d35-a818-df5ecec02dcd","resolution":{"observed_at":"2026-08-11T23:02:16.276802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00751","last_updated":"2019-06-13T17:48:30Z","snapshot_observed_at":"2026-08-14T17:21:55.355154Z","submitted_at":"2019-02-02T16:29:47Z","title":"Parameter-Efficient Transfer Learning for NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00751","snapshot_observed_at":"2026-08-11T23:02:16.294121Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.294121Z"},"links":{"cited_paper":"/paper/1902.00751","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:8b06a8c9c54d1186a676733080b9489ddffe5cf82746efd14e95dc65d6047034","observation_id":"79ad33f7-d72c-4cf7-b3d6-e87efc439e23","resolution":{"observed_at":"2026-08-11T23:02:16.294121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00868","last_updated":"2019-04-10T18:17:40Z","snapshot_observed_at":"2026-08-14T19:58:26.470531Z","submitted_at":"2018-01-03T00:21:31Z","title":"Panoptic Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00868","snapshot_observed_at":"2026-08-11T23:02:16.308050Z","title":"B.; Rother, C.; and Doll \\' a r, P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.308050Z"},"links":{"cited_paper":"/paper/1801.00868","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:48d48015b6bb965aae298ff2e1c3b8b9c592a851020da3f833b8ba7151e67336","observation_id":"d7539f6f-d594-4213-8070-4826f9816c4b","resolution":{"observed_at":"2026-08-11T23:02:16.308050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-11T23:02:16.319247Z","title":"C.; Lo, W.-Y.; Doll \\'a r, P.; and Girshick, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.319247Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:3f109484b6da416841dd047611d08390d980237fac00b1b1c213216ae05a125c","observation_id":"31fda55c-7b6e-44da-bba9-849bd293ca29","resolution":{"observed_at":"2026-08-11T23:02:16.319247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-11T23:02:16.328751Z","title":"L.; and Dollár, P","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.328751Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:f9d823c557a147ee58fff00846c12964a46a80011c5dbc73094024407287a68b","observation_id":"af4ea633-9f03-4067-91c7-e81d7a42a611","resolution":{"observed_at":"2026-08-11T23:02:16.328751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.067027Z","title":null,"venue":null,"work_id":"5180f5ff-0bb8-4107-aa50-8befe5cc9c25","year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.336273Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:caffbee0055a1c807ad4099ccd68bfa6b060649286101dfb38dfa6366f97793e","observation_id":"bec58eb1-74a8-44e4-a5e0-579fd8cb7aec","resolution":{"observed_at":"2026-08-11T23:02:18.076156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:18.020231Z","title":null,"venue":null,"work_id":"9472da39-92ee-4264-8f49-f06dc5b2ed2c","year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.349846Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:32de891685b40ba50193ef56e65b44ebfe6df051f680508c40fcea05fcb40cb7","observation_id":"76bd426b-1779-45ff-b1c0-5456de5382c5","resolution":{"observed_at":"2026-08-11T23:02:18.031568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01095","last_updated":"2025-05-19T07:56:56Z","snapshot_observed_at":"2026-08-15T03:10:54.042099Z","submitted_at":"2022-11-02T13:14:30Z","title":"DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01095","snapshot_observed_at":"2026-08-11T23:02:16.355967Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.355967Z"},"links":{"cited_paper":"/paper/2211.01095","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:3a0d675eac4726afb2826f5125cf1e7b80f215e565a6a2327744ab978d1662fd","observation_id":"fb74bb59-e557-4024-94df-1cecde5b20fc","resolution":{"observed_at":"2026-08-11T23:02:16.355967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-14T03:40:56.071989Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-11T23:02:16.364545Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.364545Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:777942f0e8e2db57f54aae7f05140b8e40e0c7854ce0065eafbd1f917b60bfc4","observation_id":"18c465a7-26bb-425c-806b-37e9da8736dd","resolution":{"observed_at":"2026-08-11T23:02:16.364545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-08-13T05:43:28.614772Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-11T23:02:16.370213Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.370213Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:44a27837f72f266a07efef4afd42b08f13491d2d6a90163378c7580889f8ffd8","observation_id":"69561496-08c5-4609-980b-956fc524d48b","resolution":{"observed_at":"2026-08-11T23:02:16.370213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09672","last_updated":"2021-02-18T23:44:17Z","snapshot_observed_at":"2026-08-06T00:36:41.660457Z","submitted_at":"2021-02-18T23:44:17Z","title":"Improved Denoising Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09672","snapshot_observed_at":"2026-08-11T23:02:16.381939Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.381939Z"},"links":{"cited_paper":"/paper/2102.09672","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:46d8b4e3cdbd1f758654ab940faa07d3ecb4d0f79ca5020e2443ea64e0611e6e","observation_id":"eabc4f59-33f0-4832-8d6f-733ead656708","resolution":{"observed_at":"2026-08-11T23:02:16.381939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-11T23:02:16.389772Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.389772Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:0cb8c5eac78d141ed3d26b094db9b1ef4830a1a5b126931149c89d5ebffb7396","observation_id":"88bd928d-ff98-4a93-a389-09d0bf97c754","resolution":{"observed_at":"2026-08-11T23:02:16.389772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-11T23:02:16.398212Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.398212Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:43aeb7e477c0207712888f2a5c7228486fd001c967cf522e94f1f963d8551b7c","observation_id":"8ee78838-e279-42d8-84e9-f0635eebbf52","resolution":{"observed_at":"2026-08-11T23:02:16.398212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-11T23:02:16.403050Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.403050Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:de84da0dc807ad060e8abb2b2de05f97d91f06c3043862ab7de91f88242db543","observation_id":"fd7b57a5-ab25-4bf0-875c-ad9a38e41b7f","resolution":{"observed_at":"2026-08-11T23:02:16.403050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T23:02:16.409097Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.409097Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:1d6257d03aa81e6993c27993020606ce1eb18df2b490b9f0a0d1cde19481f62b","observation_id":"d9f18862-cafd-4666-ba3a-f5f28b04ae3e","resolution":{"observed_at":"2026-08-11T23:02:16.409097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13686","last_updated":"2024-11-04T13:24:18Z","snapshot_observed_at":"2026-08-13T00:25:14.101781Z","submitted_at":"2024-04-21T15:16:05Z","title":"Hyper-SD: Trajectory Segmented Consistency Model for Efficient Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13686","snapshot_observed_at":"2026-08-11T23:02:16.415341Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.415341Z"},"links":{"cited_paper":"/paper/2404.13686","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:c660403b329637fdbf41068f0d9aab4d9476920501afaf5469694e28c016a27d","observation_id":"662192fd-169e-42b0-b27f-5552616f6b5a","resolution":{"observed_at":"2026-08-11T23:02:16.415341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-11T23:02:16.423382Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.423382Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:cb86428e529fbc15b63e676106426c8b1e28ff58563dbf2630626cf5307f8818","observation_id":"9a201378-6f0d-424d-8398-2525f27c4e1a","resolution":{"observed_at":"2026-08-11T23:02:16.423382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-11T23:02:16.429692Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.429692Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:cf4d1ad72d6fc26462e6919908f28ad40494d01b989cb50d91195d560a8ff81f","observation_id":"24016c70-76c1-4da2-a0cc-f56fe7ba3241","resolution":{"observed_at":"2026-08-11T23:02:16.429692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-12T01:14:44.484432Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-11T23:02:16.438319Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.438319Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:cae0c579f529c6fa3ecffe110c68ca5a968a035dc2fdb7cb4fde3f3034007fad","observation_id":"c5b6665e-ac74-465a-879f-4cd85df78345","resolution":{"observed_at":"2026-08-11T23:02:16.438319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-11T23:02:16.449044Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.449044Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ebfb27f13ab897aa58e4c00e1c9034e27abf18cfdfd1b1ee231c78ea8b36b0e9","observation_id":"4c8c91fb-2475-4de3-9ee5-aa18cbe7690f","resolution":{"observed_at":"2026-08-11T23:02:16.449044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T23:02:16.457103Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.457103Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:41a43e58727ace7dad1d0c056345fe9f7aa2eb554dd7bf5ef5303698db2b27f8","observation_id":"61701bb5-4ac5-4dfc-9e1a-537ffff3e519","resolution":{"observed_at":"2026-08-11T23:02:16.457103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11681","last_updated":"2024-01-21T13:35:44Z","snapshot_observed_at":"2026-08-13T12:20:08.514747Z","submitted_at":"2023-03-21T08:43:15Z","title":"DiffuMask: Synthesizing Images with Pixel-level Annotations for Semantic Segmentation Using Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11681","snapshot_observed_at":"2026-08-11T23:02:16.468739Z","title":"Z.; Zhou, H.; and Shen, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.468739Z"},"links":{"cited_paper":"/paper/2303.11681","citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:2dec3747e0afad94a39a48f5ad678690202afd2aace2ccc5405213cf562212bd","observation_id":"3521bce0-7f52-4caa-bd67-99f5b73b87e7","resolution":{"observed_at":"2026-08-11T23:02:16.468739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:17.987549Z","title":null,"venue":null,"work_id":"19c64845-e16e-4226-9b8d-871a995a72e9","year":2023},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.480450Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:ef53de74113ae7f57ea6cda627c93e8d405b799837d18272ba6046c2b0adcb3d","observation_id":"0bb42f90-569b-4d1f-a2ea-4f51cfd724ee","resolution":{"observed_at":"2026-08-11T23:02:17.994081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:16.489698Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.489698Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:d946ce9dd68422e889c2294076bcfc862ebd319fa3cbf853ad15195b25a7181e","observation_id":"b0989b31-8f89-4e87-aaca-5580d41f66fc","resolution":{"observed_at":"2026-08-11T23:02:16.489698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:02:16.499212Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T23:02:16.499212Z"},"links":{"citing_paper":"/paper/2412.02929"},"observation_digest":"sha256:0c9cb2bd8df2217117635f8ddd3ddec884f501f60236622f46158ee134888e67","observation_id":"7fbe753d-d4c9-41d4-bf8a-4cfc4af49536","resolution":{"observed_at":"2026-08-11T23:02:16.499212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.02929","last_updated":"2025-02-22T05:58:21Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T05:17:41.334885Z","submitted_at":"2024-12-04T00:42:15Z","title":"Panoptic Diffusion Models: co-generation of images and segmentation maps"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2412.02929."}