{"as_of":"2026-08-18T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0240687cfbdecfcb3e8e9972770c5d19cfd7387236f8439e7243bf98a034aabe","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:32:37.815468Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T08:15:32.093161Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-12T14:23:52.908027Z","title":"Toker, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16725","last_updated":"2025-08-02T02:01:09Z","snapshot_observed_at":"2026-08-18T05:13:23.187385Z","submitted_at":"2024-11-23T03:54:22Z","title":"$\\textit{Revelio}$: Interpreting and leveraging semantic information in diffusion models","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:23:52.908027Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2411.16725"},"observation_digest":"sha256:fee123f256a65d02cdfb493c72439970f6dd5a9fceaf264805a92e3dde667857","observation_id":"6d5b4158-b8e8-46d2-8ce4-27410140eca6","resolution":{"observed_at":"2026-08-12T14:23:52.908027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-16T04:32:37.815468Z","title":"Diffusion lens: Interpreting text encoders in text-to-image pipelines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01104","last_updated":"2025-05-02T08:31:43Z","snapshot_observed_at":"2026-08-16T04:24:21.477835Z","submitted_at":"2025-05-02T08:31:43Z","title":"VSC: Visual Search Compositional Text-to-Image Diffusion Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:32:37.815468Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2505.01104"},"observation_digest":"sha256:561d532f2224212776273977918fc72070812ea0493b9b7a4a4cc80e6b037504","observation_id":"25ae24a8-e593-4180-a8e5-ab39b7a7fa8c","resolution":{"observed_at":"2026-08-16T04:32:37.815468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-04T15:42:39.636010Z","title":"Diffusion lens: Interpreting text encoders in text-to-image pipelines.arXiv preprint arXiv:2403.05846,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.21379","last_updated":"2026-05-29T14:42:07Z","snapshot_observed_at":"2026-08-04T15:42:31.963286Z","submitted_at":"2025-09-23T11:29:30Z","title":"SAEmnesia: Erasing Concepts in Diffusion Models with Supervised Sparse Autoencoders","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T15:42:39.636010Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2509.21379"},"observation_digest":"sha256:5aa0b125f04ec026684cb9c87ecc3544239be5fadcac6a8b2390cf8f5bb15e5d","observation_id":"bd9186d9-63b9-4944-8ce3-11b4ea1f2527","resolution":{"observed_at":"2026-08-04T15:42:39.636010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":"2403.05846","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-07-01T08:15:32.093161Z","title":"Diffusion lens: Interpreting text encoders in text-to- image pipelines.arXiv preprint arXiv:2403.05846,","venue":null,"work_id":"999c25cf-8e5f-45d7-b0ac-a96b6d9aa82e","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-16T10:31:22.339382Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:9b1e4b32982bdfe7a58c050fbc3b0bc1d1525ed547db8ae1c8cb024d11954607","observation_id":"e2a43987-5922-4288-bdc8-f45caad6ffad","resolution":{"observed_at":"2026-07-01T08:15:32.095589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":"2403.05846","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-07-01T08:15:32.093161Z","title":"Diffusion lens: Interpreting text encoders in text-to- image pipelines.arXiv preprint arXiv:2403.05846,","venue":null,"work_id":"999c25cf-8e5f-45d7-b0ac-a96b6d9aa82e","year":2024},"citing_paper":{"arxiv_id":"2606.30262","last_updated":"2026-06-29T13:09:39Z","snapshot_observed_at":"2026-08-06T12:26:22.536829Z","submitted_at":"2026-06-29T13:09:39Z","title":"Intermediate Text Representation Guided Text-to-Image Generation for Enhancing One-and-Only Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T06:04:54.816368Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2606.30262"},"observation_digest":"sha256:a0c6d1d29d19dc549f7839faa80e2d69b0b757956062175522147748e0a5eb8b","observation_id":"a9d39ef6-118c-4e50-8b8a-c7127e46451b","resolution":{"observed_at":"2026-06-30T08:24:27.112003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-01T23:15:30.835495Z","title":"Diffusion lens: Interpreting text encoders in text-to-image pipelines","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-17T09:45:46.670808Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":164,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:30.835495Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:eb24e376bb1571874bb226dab20cb971727047fa127219a6bfe1326e2c547574","observation_id":"aacfe42b-2043-47e4-a360-3023c3f11f74","resolution":{"observed_at":"2026-08-01T23:15:30.835495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-14T04:16:16.794208Z","title":"arXiv preprint arXiv:2403.05846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-17T06:56:32.154760Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.794208Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0ec4ac1e3fd4dff033eed2f1e60dfcb15de103632ca3d1adf7619a469630f627","observation_id":"693ede22-eeb3-411d-9489-7fe5acd03426","resolution":{"observed_at":"2026-08-14T04:16:16.794208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.05846/citation-record","integrity":"/paper/2403.05846/integrity","json":"/paper/2403.05846/citation-record.json","paper":"/paper/2403.05846"},"outbound":[],"paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T01:47:42.984618Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2403.05846."}