{"as_of":"2026-08-13T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1605bb1a4d75e8fc49ed2a3d90f69b1c13f22e37d60c9b2c8d9decca960f2106","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:33:37.081737Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T16:37:39.706914Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":"2403.05121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":"06dfa7a2-58e8-42bf-8ded-1ec9feb189db","year":2024},"citing_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-10T18:26:22.224924Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2408.06072"},"observation_digest":"sha256:0e2a5c8f19c2f918b086d3d817b0a62f24d3b300f2ca05767dee7d128ca3de20","observation_id":"755c6773-817d-49a2-b51c-6e579d3eb58a","resolution":{"observed_at":"2026-05-10T18:26:22.373165Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-12T13:33:37.081737Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16164","last_updated":"2024-11-25T07:40:32Z","snapshot_observed_at":"2026-08-12T13:54:34.921592Z","submitted_at":"2024-11-25T07:40:32Z","title":"Text-to-Image Synthesis: A Decade Survey","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:33:37.081737Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2411.16164"},"observation_digest":"sha256:a5c4f9fa2072dd0b6faf33c2e76e70ca6a7850e4e8049f93669c1c2a9f56333c","observation_id":"6cd1de61-ea4e-4deb-b001-b7c970360934","resolution":{"observed_at":"2026-08-12T13:33:37.081737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-12T10:46:55.052802Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18936","last_updated":"2025-03-24T19:58:03Z","snapshot_observed_at":"2026-08-12T17:18:52.805685Z","submitted_at":"2024-11-28T05:58:03Z","title":"Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T10:46:55.052802Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2411.18936"},"observation_digest":"sha256:41405b2e3eb0fc946933d6629790cc421ecbdd46a06120136c7c51e8871f64dc","observation_id":"5f1d241a-6087-4577-a6fc-1a5c6ee886a9","resolution":{"observed_at":"2026-08-12T10:46:55.052802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-11T16:58:05.615131Z","title":"Cogview3: Finer and faster text- to-image generation via relay diffusion.arXiv preprint arXiv:2403.05121, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09600","last_updated":"2024-12-12T18:59:01Z","snapshot_observed_at":"2026-08-13T06:08:40.399835Z","submitted_at":"2024-12-12T18:59:01Z","title":"Owl-1: Omni World Model for Consistent Long Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T16:58:05.615131Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2412.09600"},"observation_digest":"sha256:fb1cbb72dbeac451f5aeaee508d97c5645675d012dd7bd1d2b2224569e0623ce","observation_id":"6146ddc6-b2b9-4022-a09e-97fa9ce131df","resolution":{"observed_at":"2026-08-11T16:58:05.615131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-11T17:33:17.758804Z","title":"Cogview3: Finer and faster text-to-im age generation via relay diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09656","last_updated":"2024-12-12T02:09:04Z","snapshot_observed_at":"2026-08-13T07:23:49.890621Z","submitted_at":"2024-12-12T02:09:04Z","title":"From Noise to Nuance: Advances in Deep Generative Image Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:33:17.758804Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2412.09656"},"observation_digest":"sha256:cd57a613f72a272aa79d130c1ed595290f9dfb11116990bb0186575d8650bf27","observation_id":"d04c625c-b45c-402b-b027-90853af58386","resolution":{"observed_at":"2026-08-11T17:33:17.758804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-11T10:56:14.414958Z","title":"<s>[INST]Can you give me 50 descriptions of harmful pictures?[/INST]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16039","last_updated":"2025-05-29T12:01:59Z","snapshot_observed_at":"2026-08-11T18:48:06.077646Z","submitted_at":"2024-12-20T16:40:11Z","title":"SafeCFG: Controlling Harmful Features with Dynamic Safe Guidance for Safe Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T10:56:14.414958Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2412.16039"},"observation_digest":"sha256:bc8aa76a3bfabdbd2faa2f20fcb1d880f8332bce020bdfe683efe27b682dd19a","observation_id":"ef2769b1-060a-4613-bb64-aae6b48c1fff","resolution":{"observed_at":"2026-08-11T10:56:14.414958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-07T14:17:37.891666Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19415","last_updated":"2025-05-27T20:10:09Z","snapshot_observed_at":"2026-08-13T12:18:00.782373Z","submitted_at":"2025-05-26T02:07:24Z","title":"MMIG-Bench: Towards Comprehensive and Explainable Evaluation of Multi-Modal Image Generation Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:37.891666Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2505.19415"},"observation_digest":"sha256:83ebbac78dae4e1425022bdc4f7b472ef84ad70d13e207d0844344cfcb363245","observation_id":"1dd032ed-7d5e-43ad-9f67-9266eec42b7f","resolution":{"observed_at":"2026-08-07T14:17:37.891666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":"2403.05121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":"06dfa7a2-58e8-42bf-8ded-1ec9feb189db","year":2024},"citing_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-13T02:23:40.621810Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-11T14:08:36.801359Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2511.22699"},"observation_digest":"sha256:3d88edea5c06bf8c10e2ad46e82fccf5d8ff181b08f687d83a79511d556929e2","observation_id":"0ea1fe66-6904-44fb-9d3c-61110a361a00","resolution":{"observed_at":"2026-05-11T14:08:37.346049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-08-03T19:47:32.968338Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-13T02:23:40.621810Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-03T19:47:32.968338Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2511.22699"},"observation_digest":"sha256:2e8495f19084a7d14fbe82bbd9f6379095a9e876436195fe7f8323b95192482a","observation_id":"5cc1cd5d-82f7-4f75-8817-df4ba1599eb1","resolution":{"observed_at":"2026-08-03T19:47:32.968338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":"2403.05121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":"06dfa7a2-58e8-42bf-8ded-1ec9feb189db","year":2024},"citing_paper":{"arxiv_id":"2605.06170","last_updated":"2026-05-07T12:53:51Z","snapshot_observed_at":"2026-08-13T06:55:23.841654Z","submitted_at":"2026-05-07T12:53:51Z","title":"DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T13:54:00.141439Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2605.06170"},"observation_digest":"sha256:291da78fe423e85ee2ec57bf3293783587fda8bba121e5600ee5d21712028b95","observation_id":"b7f42422-ca9b-4d61-9356-e8e00118026e","resolution":{"observed_at":"2026-05-11T18:46:10.475551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":"2403.05121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":"06dfa7a2-58e8-42bf-8ded-1ec9feb189db","year":2024},"citing_paper":{"arxiv_id":"2605.12967","last_updated":"2026-05-13T04:01:10Z","snapshot_observed_at":"2026-08-10T22:32:32.543739Z","submitted_at":"2026-05-13T04:01:10Z","title":"ImageAttributionBench: How Far Are We from Generalizable Attribution?","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-14T19:38:41.659261Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2605.12967"},"observation_digest":"sha256:7681cdb06bed8e483ec99529c1b324560d774f9e89e59d1890a662198ac4a8a1","observation_id":"495e1f8a-d1cf-4c69-8b9a-06ab5cf47ff8","resolution":{"observed_at":"2026-05-14T19:39:23.894406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion","version":1},"cited_work":{"arxiv_id":"2403.05121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogview3: Finer and faster text-to-image generation via relay diffusion","venue":null,"work_id":"06dfa7a2-58e8-42bf-8ded-1ec9feb189db","year":2024},"citing_paper":{"arxiv_id":"2605.14876","last_updated":"2026-05-15T05:10:39Z","snapshot_observed_at":"2026-08-12T07:49:34.371249Z","submitted_at":"2026-05-14T14:22:25Z","title":"Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-19T16:35:43.166697Z"},"links":{"cited_paper":"/paper/2403.05121","citing_paper":"/paper/2605.14876"},"observation_digest":"sha256:64984f871acc699afd5b3daf34944b9549c24c571b7abaec6d451611ff42317e","observation_id":"664e705a-63c5-455d-a0bc-6feb23e7adfe","resolution":{"observed_at":"2026-05-19T16:37:39.708562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2403.05121/citation-record","integrity":"/paper/2403.05121/integrity","json":"/paper/2403.05121/citation-record.json","paper":"/paper/2403.05121"},"outbound":[],"paper":{"arxiv_id":"2403.05121","last_updated":"2024-03-08T07:32:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T00:59:30.425858Z","submitted_at":"2024-03-08T07:32:50Z","title":"CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2403.05121."}