{"as_of":"2026-08-19T07:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:474fca8ecd4fc3fbdbc99f26b4a3c5e3c68eec1335552f737e4244cfaf3ad30d","coverage":[{"denominator":96,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:12:26.637584Z","state":"measured"},{"denominator":96,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":96,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.23058/citation-record","integrity":"/paper/2507.23058/integrity","json":"/paper/2507.23058/citation-record.json","paper":"/paper/2507.23058"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:25.952804Z","title":"Cognitive neuroscience of human counterfactual reasoning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:25.952804Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:827fc0f028acbbb86487bf12b970bc4a0f4667dfc1cf43dca0631bb916ee1ff6","observation_id":"f0d36c8f-b4fc-4d38-b266-05988e4efbfc","resolution":{"observed_at":"2026-08-06T11:12:25.952804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.076398Z","title":"Mental models and counterfactual thoughts about what might have been,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.076398Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ad89b799e5d4dea2b3e01d1c26165b8cc5fe2b9c741d460ea854f9cc83efa805","observation_id":"58ef9d79-3000-40fa-bc29-2b1299a4ea35","resolution":{"observed_at":"2026-08-06T11:12:26.076398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.175561Z","title":"Useful counterfactuals,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.175561Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:2c4fe9f558785f7fb73d34a78adae1afb7be8f4ad7085e25358cb29e211e8947","observation_id":"6011ce36-c271-42c7-b81b-c7e437dc73a9","resolution":{"observed_at":"2026-08-06T11:12:26.175561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T11:12:26.249434Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.249434Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3fd5c65ad5abb4c5e59b9273c64e1fc6cfdacb2a6c8f237dc34bd8d6402502aa","observation_id":"5e14c3fd-9034-4c7b-84a7-c6eb48e5de5b","resolution":{"observed_at":"2026-08-06T11:12:26.249434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.268381Z","title":"V ariational inference: A review for statisticians,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.268381Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0ce72203a5166bd7f194a0b873fed0c7eced8993917de1e2963c3d607c86b0b1","observation_id":"1173bdc6-ad6e-46b8-ae26-6c4eb08dcfa2","resolution":{"observed_at":"2026-08-06T11:12:26.268381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.273484Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.273484Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:aa044e1221b87f843d9659312208d3a6f5316303f1fa2b13e4307fa23da1a46d","observation_id":"c9364d29-0f7b-47ea-9921-962852e631dd","resolution":{"observed_at":"2026-08-06T11:12:26.273484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.278282Z","title":"Diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.278282Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:bba09766b0e87f5485e639c7bbc285bd942587b9ff43bef647ee4259514f54c3","observation_id":"132f047f-35b9-4d84-bbd3-e606599f9d32","resolution":{"observed_at":"2026-08-06T11:12:26.278282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T11:12:26.282220Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.282220Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:cf00df387fc116ce86f1baa499c9c3b7e108190a973df5f596db8c2a6b15e0af","observation_id":"a2c6d79d-8578-4039-b4fc-6b50401d783b","resolution":{"observed_at":"2026-08-06T11:12:26.282220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.286723Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.286723Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e9d1897c0abb4214b740b845e1b949fe6bfdf7d54bc2a8d37662dd3b3f2dd382","observation_id":"42ca666a-ac4c-478a-9ff2-93f516dc2736","resolution":{"observed_at":"2026-08-06T11:12:26.286723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.290796Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.290796Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:17b57f29caf90b098331309dd5ab5cc49eb9c89b4415f80ef939f7207420c405","observation_id":"459828b8-9d79-4f54-800b-4d21c66a666f","resolution":{"observed_at":"2026-08-06T11:12:26.290796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.294905Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.294905Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ff3ed4baf6fe78a744f574de789b48423effc886785a3b0ceb24fa8bdb69d83c","observation_id":"05012135-609c-4070-93e3-c3782955f4b8","resolution":{"observed_at":"2026-08-06T11:12:26.294905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.299151Z","title":"Adding conditional control to text-to-image diffusion mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.299151Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:40a5d75581c570e10a1f892d120abb7243fd29a7a70521625578326a497e4917","observation_id":"d81e5e83-2a50-4c3c-be1e-c53d6a671560","resolution":{"observed_at":"2026-08-06T11:12:26.299151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.303356Z","title":"Paint by example: Exemplar-based image editing with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.303356Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:6f35fabf9cd116ab10cb9abfb412873825b2c08b9dbe1fbfc3b4c4e94f9e2d4a","observation_id":"d9a716b6-becb-4296-a2b5-1074bc3cce44","resolution":{"observed_at":"2026-08-06T11:12:26.303356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.307384Z","title":"Mobi: Multimodal object inpainting using diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.307384Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:eaaca9581174b56e3a6dd8c88b76391eb013895acc35b99ad3c55246ad3ab653","observation_id":"7448efe1-6627-4c40-b703-991acfd80501","resolution":{"observed_at":"2026-08-06T11:12:26.307384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.311362Z","title":"Challenges in autonomous vehicle testing and validation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.311362Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d2f9d2d4a0a5e651cbfcdae4af1fe5cb6a15e989ef14135e941647437f42816e","observation_id":"4e1e0fdd-e695-4894-a4f8-f915881a5d40","resolution":{"observed_at":"2026-08-06T11:12:26.311362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-08-16T15:15:13.894611Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-06T11:12:26.315287Z","title":"Anydoor: Zero-shot object-level image customization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.315287Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0b2004e654a312918ef4101b7caebfcab5dc00381583d1c6fdb0533640116119","observation_id":"7af4da9b-6bfc-4158-bd19-62dd13255402","resolution":{"observed_at":"2026-08-06T11:12:26.315287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02489","last_updated":"2024-07-02T17:59:50Z","snapshot_observed_at":"2026-08-16T13:37:39.189532Z","submitted_at":"2024-07-02T17:59:50Z","title":"Magic Insert: Style-Aware Drag-and-Drop","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02489","snapshot_observed_at":"2026-08-06T11:12:26.319799Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.319799Z"},"links":{"cited_paper":"/paper/2407.02489","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:979e424b381f8d96b55ac5883e119a970becc5a9aff8935de90ddbddd865a5cf","observation_id":"5922b2a4-342e-4bfa-8d1f-39c288db6ded","resolution":{"observed_at":"2026-08-06T11:12:26.319799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14406","last_updated":"2023-04-27T17:59:58Z","snapshot_observed_at":"2026-08-16T15:37:09.746543Z","submitted_at":"2023-04-27T17:59:58Z","title":"Putting People in Their Place: Affordance-Aware Human Insertion into Scenes","version":1},"cited_work":{"arxiv_id":"2304.14406","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.14406","snapshot_observed_at":"2026-08-06T11:12:27.386781Z","title":"Putting People in Their Place: Affordance-Aware Human Insertion into Scenes","venue":"cs.CV","work_id":"2895f405-43ce-49d5-b0c5-032ce6806e94","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.324468Z"},"links":{"cited_paper":"/paper/2304.14406","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:cd479eb903e2c36b3ce257a9b7f0961b8cf51eead492c608a5d375e2e13e4139","observation_id":"a1948f14-8ec2-4bf1-a86b-387335ecfef8","resolution":{"observed_at":"2026-08-06T11:12:27.391303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01447","last_updated":"2023-11-02T17:56:59Z","snapshot_observed_at":"2026-08-16T14:46:26.421099Z","submitted_at":"2023-11-02T17:56:59Z","title":"CADSim: Robust and Scalable in-the-wild 3D Reconstruction for Controllable Sensor Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01447","snapshot_observed_at":"2026-08-06T11:12:26.328559Z","title":"Cadsim: Robust and scalable in-the-wild 3d reconstruc- tion for controllable sensor simulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.328559Z"},"links":{"cited_paper":"/paper/2311.01447","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:fe59af92a4b66f03c61cd9aaf56e12396d043729f025766563adcbf0ee8ce466","observation_id":"9a7c9139-a823-44bd-a296-5ac09271b015","resolution":{"observed_at":"2026-08-06T11:12:26.328559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11573","last_updated":"2024-03-20T01:13:48Z","snapshot_observed_at":"2026-08-17T15:10:50.100815Z","submitted_at":"2024-03-18T08:50:04Z","title":"Just Add $100 More: Augmenting NeRF-based Pseudo-LiDAR Point Cloud for Resolving Class-imbalance Problem","version":2},"cited_work":{"arxiv_id":"2403.11573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11573","snapshot_observed_at":"2026-08-06T11:12:27.351351Z","title":"Just Add $100 More: Augmenting NeRF-based Pseudo-LiDAR Point Cloud for Resolving Class-imbalance Problem","venue":"cs.CV","work_id":"f5fa2d62-0d8a-4ec7-bf40-9936658a9182","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.333331Z"},"links":{"cited_paper":"/paper/2403.11573","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9dc03246bc0e7c675251b9ba8cfe4643fe6aad8a5112d53bb9453d5f31372eb2","observation_id":"228664f1-99e6-4d9d-8977-9a54d8f37de9","resolution":{"observed_at":"2026-08-06T11:12:27.355989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12419","last_updated":"2025-05-01T12:58:23Z","snapshot_observed_at":"2026-08-17T08:41:06.267795Z","submitted_at":"2023-12-19T18:50:33Z","title":"Scene-Conditional 3D Object Stylization and Composition","version":2},"cited_work":{"arxiv_id":"2312.12419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.12419","snapshot_observed_at":"2026-08-06T11:12:27.330771Z","title":"Scene-Conditional 3D Object Stylization and Composition","venue":"cs.CV","work_id":"41715d31-7e6d-4469-8bf3-f4ee93aef8e1","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.337912Z"},"links":{"cited_paper":"/paper/2312.12419","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ee5af91c350be0d90913128c0b93618211a3c3cf97d44f836dd0bd856a82dc5c","observation_id":"db1e9758-cc22-4aa6-8f9a-f3fbacde59ba","resolution":{"observed_at":"2026-08-06T11:12:27.335283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.342312Z","title":"Editable scene simulation for autonomous driving via collaborative llm-agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.342312Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:436ee1ab14457d89f19bd7effbac846aaa9010e52404e7931838c50dc12d53ed","observation_id":"559b2057-ec8c-4282-a5c0-0e913c5dbdc2","resolution":{"observed_at":"2026-08-06T11:12:26.342312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.346306Z","title":"Geosim: Realistic video simulation via geometry-aware com- position for self-driving,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.346306Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b19821ffc3aff0b818c78ce4602009d7cd9e5bd599a64dbea38e686b837edad0","observation_id":"5a5db670-2e25-4909-9c2e-0b290b0eea1a","resolution":{"observed_at":"2026-08-06T11:12:26.346306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14494","last_updated":"2024-12-19T03:39:13Z","snapshot_observed_at":"2026-08-18T19:21:53.731487Z","submitted_at":"2024-12-19T03:39:13Z","title":"Drive-1-to-3: Enriching Diffusion Priors for Novel View Synthesis of Real Vehicles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14494","snapshot_observed_at":"2026-08-06T11:12:26.350171Z","title":"Drive-1-to-3: Enriching diffusion priors for novel view synthesis of real vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.350171Z"},"links":{"cited_paper":"/paper/2412.14494","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:dff8bf37a0fedac37fa0799d78179180f64722244d73b29dacf51f616089105f","observation_id":"2eea4b1e-9794-4cac-95ab-09cf3f28280a","resolution":{"observed_at":"2026-08-06T11:12:26.350171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.354700Z","title":"Multitest: Physical-aware object insertion for testing multi-sensor fusion perception systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.354700Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:40f39fccef161d95fd4b3d0a4b0b981437b27baa46a42aaf848938b4bf59bba7","observation_id":"9f3bbb6c-5b56-4fe0-9995-c55cfa8f4cb1","resolution":{"observed_at":"2026-08-06T11:12:26.354700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.358886Z","title":"Lift3d: Synthesize 3d training data by lifting 2d gan to 3d generative radiance field,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.358886Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9b81c30ce91497f651cacc63effc79b1f54328db3e1d1dd976e09fb3d6dcfb8a","observation_id":"625f83a2-6a94-4094-9881-e2a93cd6bdc3","resolution":{"observed_at":"2026-08-06T11:12:26.358886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.362945Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.362945Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:89e20efb11ddbd66bca381dea9869cee285fdf15ea938c83bde0c380316e5132","observation_id":"24e32757-cf36-43b4-837c-c17fbd85bba3","resolution":{"observed_at":"2026-08-06T11:12:26.362945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:28.018789Z","title":"Neurad: Neural rendering for autonomous driving,","venue":null,"work_id":"cccbc7f1-dc13-47c0-a7d8-66a5d81eaaec","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.366618Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:24d54eec41745cb6d3657058fa229d00dfff0d511fa2cc5e7bd1db940c7fc08b","observation_id":"7ea0bbac-69c6-4328-828d-510373633fed","resolution":{"observed_at":"2026-08-06T11:12:28.023268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:28.005203Z","title":"Unisim: A neural closed-loop sensor simulator,","venue":null,"work_id":"bf50af48-73f5-40dd-a890-dde8ababb4ca","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.370626Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:7aa71931bcb7c72b81648fee239764ff8beceeefa1b6c3aaadb45d0e0475d298","observation_id":"79a220d3-6c64-40ef-aa6d-75c60e29fb17","resolution":{"observed_at":"2026-08-06T11:12:28.009411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.991360Z","title":"Diffusion models are geometry critics: Single image 3d editing using pre-trained diffusion priors,","venue":null,"work_id":"782a878a-136a-4a5e-8157-b998f8de80c7","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.374364Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d5c73c78cd89a2c8e9bce4001b0a970de039ff85bb002e5839e0d1b46b7d3fa3","observation_id":"b7c2c19d-20a9-429d-8108-9515bfbb03f3","resolution":{"observed_at":"2026-08-06T11:12:27.996089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09292","last_updated":"2024-10-28T23:42:11Z","snapshot_observed_at":"2026-08-16T13:43:16.046812Z","submitted_at":"2024-06-13T16:29:18Z","title":"Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09292","snapshot_observed_at":"2026-08-06T11:12:26.378264Z","title":"Neural assets: 3d-aware multi-object scene synthesis with image diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.378264Z"},"links":{"cited_paper":"/paper/2406.09292","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b6d378d51334e7a009fe82bbb3dc01bf7fc3cf7304bcc9770fcd105e9c2722d1","observation_id":"2579120d-f968-4c9c-b662-4e3a319cc76d","resolution":{"observed_at":"2026-08-06T11:12:26.378264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.978286Z","title":"Image sculpting: Precise object editing with 3d geometry control,","venue":null,"work_id":"468c6faf-f312-4ca9-b87e-242850cf733c","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.382512Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:181aefa2ce8fa6da787992f5c13686a7d5189c30c0d0ac5c7cd7b5776889261c","observation_id":"50c99053-bd4e-4424-ae27-2bc61f496b46","resolution":{"observed_at":"2026-08-06T11:12:27.982419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.964150Z","title":"Diffusion han- dles enabling 3d edits for diffusion models by lifting activations to 3d,","venue":null,"work_id":"41777d23-82ea-4a4c-96b5-d8f9e32fcc2f","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.386300Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:87bec36cc1ed0e228e055346bb10dcf3bf87099afc7b05d129d5fb6f73330580","observation_id":"bb41aeed-78b1-4322-ac8a-e5af65299afb","resolution":{"observed_at":"2026-08-06T11:12:27.968558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.949676Z","title":"Object 3dit: Language- guided 3d-aware image editing,","venue":null,"work_id":"4ab52c61-894e-4fbf-a95a-8f581b375a7f","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.390702Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:500f868092b0511dd02fc6ecc701bd9e02e50ea00a620f236e8b73b6a3d912c9","observation_id":"7d0ed862-dda8-425e-a75b-efc800f68996","resolution":{"observed_at":"2026-08-06T11:12:27.953977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19784","last_updated":"2023-12-07T15:22:07Z","snapshot_observed_at":"2026-08-16T14:47:31.937225Z","submitted_at":"2023-10-30T17:50:14Z","title":"CustomNet: Zero-shot Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2310.19784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19784","snapshot_observed_at":"2026-08-06T11:12:27.210165Z","title":"CustomNet: Zero-shot Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"ea5ebae2-0c5b-4069-85bc-c4baadcd4be3","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.394512Z"},"links":{"cited_paper":"/paper/2310.19784","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4da5b944104dbbc4362ebfb4444e85c3bf8dc06b9580081fb369f78795d41a5c","observation_id":"5c87a31f-4619-46a9-a410-ad57514986d0","resolution":{"observed_at":"2026-08-06T11:12:27.215202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02601","last_updated":"2024-05-03T04:50:27Z","snapshot_observed_at":"2026-08-17T10:41:51.380790Z","submitted_at":"2023-10-04T06:14:06Z","title":"MagicDrive: Street View Generation with Diverse 3D Geometry Control","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02601","snapshot_observed_at":"2026-08-06T11:12:26.398731Z","title":"Magicdrive: Street view generation with diverse 3d geometry con- trol,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.398731Z"},"links":{"cited_paper":"/paper/2310.02601","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9c47378ebb36d4d28c098f21eb9271f225d047f5d1dc5b1a2da2f0f123a06db3","observation_id":"53e7f7a2-a707-4a1e-8fc7-d305ec38bea5","resolution":{"observed_at":"2026-08-06T11:12:26.398731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07771","last_updated":"2023-10-11T18:00:08Z","snapshot_observed_at":"2026-08-16T14:52:57.311270Z","submitted_at":"2023-10-11T18:00:08Z","title":"DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07771","snapshot_observed_at":"2026-08-06T11:12:26.402608Z","title":"Drivingdiffusion: Layout-guided multi-view driving scene video gen- eration with latent diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.402608Z"},"links":{"cited_paper":"/paper/2310.07771","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1aa27f4ad1db86b29f0ceb878997187bc59d86589085c04028c7ec4579d70292","observation_id":"0efba9dd-c046-42e9-9966-442b915e3f49","resolution":{"observed_at":"2026-08-06T11:12:26.402608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16813","last_updated":"2023-11-28T14:22:24Z","snapshot_observed_at":"2026-08-16T14:39:38.266816Z","submitted_at":"2023-11-28T14:22:24Z","title":"Panacea: Panoramic and Controllable Video Generation for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16813","snapshot_observed_at":"2026-08-06T11:12:26.406416Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.406416Z"},"links":{"cited_paper":"/paper/2311.16813","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:544fc4e6629c26ccfa0fa5a8c11c1c1a4fc78c3c66dec8b062ecd6ba7804b205","observation_id":"f5a18415-a9aa-48ee-8a5d-6340c0d6dee5","resolution":{"observed_at":"2026-08-06T11:12:26.406416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04504","last_updated":"2024-02-07T01:18:49Z","snapshot_observed_at":"2026-08-16T14:20:47.419886Z","submitted_at":"2024-02-07T01:18:49Z","title":"Text2Street: Controllable Text-to-image Generation for Street Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04504","snapshot_observed_at":"2026-08-06T11:12:26.410324Z","title":"T ext2street: Controllable text-to-image generation for street views,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.410324Z"},"links":{"cited_paper":"/paper/2402.04504","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0dd2d8bae531910d8075a3ca310c10a70cd3b8c4e27cb84a8b41fc3be82a402b","observation_id":"4da80d98-ee44-4c99-8350-590c5dcd2943","resolution":{"observed_at":"2026-08-06T11:12:26.410324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-08-17T11:56:12.119196Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-06T11:12:26.414109Z","title":"Huang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.414109Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:db63434ccabb791a66b4333131e0a109b95e5453cb4ee2f34680afeba1f43cc5","observation_id":"6fdc2024-8845-4762-9848-7265139205df","resolution":{"observed_at":"2026-08-06T11:12:26.414109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05463","last_updated":"2024-09-12T12:32:21Z","snapshot_observed_at":"2026-08-16T13:20:15.790440Z","submitted_at":"2024-09-09T09:43:17Z","title":"DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05463","snapshot_observed_at":"2026-08-06T11:12:26.418036Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.418036Z"},"links":{"cited_paper":"/paper/2409.05463","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:898164ecd4ad6adc92f363a59e343b0f0691313d6e1b2383ea4c386a8c7dc0e4","observation_id":"c6ebc59e-7e7a-4ef2-8f76-f25fb61f7b04","resolution":{"observed_at":"2026-08-06T11:12:26.418036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.935893Z","title":null,"venue":null,"work_id":"50023bce-10de-4a40-a777-8c66cb6190d4","year":null},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.422385Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d58d6a2dcc53e8a0968ae0dfa7bf13013d0a08da311ec8fd8523d80d86169513","observation_id":"7f526eea-6928-4fe3-b6aa-689e060d50f4","resolution":{"observed_at":"2026-08-06T11:12:27.940293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03954","last_updated":"2022-09-24T04:10:52Z","snapshot_observed_at":"2026-08-16T16:33:49.314799Z","submitted_at":"2022-09-08T17:58:04Z","title":"Learning to Generate Realistic LiDAR Point Clouds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03954","snapshot_observed_at":"2026-08-06T11:12:26.431130Z","title":"Zyrianov, X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.431130Z"},"links":{"cited_paper":"/paper/2209.03954","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0313a54770c0b80edb77efedcb495050213802f2a0cf0de4897e543bf703a06f","observation_id":"d873b565-0aeb-42d6-b555-45e37db95f62","resolution":{"observed_at":"2026-08-06T11:12:26.431130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10094","last_updated":"2024-09-10T03:50:09Z","snapshot_observed_at":"2026-08-16T14:09:33.572826Z","submitted_at":"2024-03-15T08:19:57Z","title":"RangeLDM: Fast Realistic LiDAR Point Cloud Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10094","snapshot_observed_at":"2026-08-06T11:12:26.435326Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.435326Z"},"links":{"cited_paper":"/paper/2403.10094","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f659079fd78ada3c5d290975e7c19f187551701a693e90166520062c4b1f506b","observation_id":"440a0825-c64f-4605-8df5-841d2e6972e6","resolution":{"observed_at":"2026-08-06T11:12:26.435326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01448","last_updated":"2023-11-02T17:57:03Z","snapshot_observed_at":"2026-08-16T14:46:26.166851Z","submitted_at":"2023-11-02T17:57:03Z","title":"UltraLiDAR: Learning Compact Representations for LiDAR Completion and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01448","snapshot_observed_at":"2026-08-06T11:12:26.439471Z","title":"Xiong, W .-C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.439471Z"},"links":{"cited_paper":"/paper/2311.01448","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a919e18d42bfc207d42566332aef72acb26bad867b0f54cda3d128ebc4d0bad4","observation_id":"31eda483-9432-4261-a742-a107abebe9fb","resolution":{"observed_at":"2026-08-06T11:12:26.439471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.443296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.443296Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:964773d2e53ca9234e37475429cf346cdefc0698d67a24b9b960146a827bba29","observation_id":"17c4b21c-7899-4f86-b94a-4089286750c2","resolution":{"observed_at":"2026-08-06T11:12:26.443296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01123","last_updated":"2024-11-02T03:52:12Z","snapshot_observed_at":"2026-08-16T13:03:37.944151Z","submitted_at":"2024-11-02T03:52:12Z","title":"X-Drive: Cross-modality consistent multi-sensor data synthesis for driving scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01123","snapshot_observed_at":"2026-08-06T11:12:26.447316Z","title":"X-drive: Cross-modality consistent multi-sensor data synthesis for driving scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.447316Z"},"links":{"cited_paper":"/paper/2411.01123","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9b649b78855d12b826b1578e40da69ab8fafcf3b6db5e02a06e3e73443d9e976","observation_id":"6fbcc043-8f52-44b9-b789-56a0e58dcb6e","resolution":{"observed_at":"2026-08-06T11:12:26.447316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10722","last_updated":"2024-06-15T19:29:01Z","snapshot_observed_at":"2026-08-16T13:42:40.267238Z","submitted_at":"2024-06-15T19:29:01Z","title":"GenMM: Geometrically and Temporally Consistent Multimodal Data Generation for Video and LiDAR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10722","snapshot_observed_at":"2026-08-06T11:12:26.451811Z","title":"Genmm: Geomet- rically and temporally consistent multimodal data generation for video and lidar,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.451811Z"},"links":{"cited_paper":"/paper/2406.10722","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b19795d5f97b923feed60993d888f24e68a1c4a89c67d4eaac190b869bacbc1c","observation_id":"ca8553f1-0d03-4bca-9373-64325d27aefd","resolution":{"observed_at":"2026-08-06T11:12:26.451811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13790","last_updated":"2022-11-11T16:07:31Z","snapshot_observed_at":"2026-08-18T15:11:42.015236Z","submitted_at":"2022-05-27T06:58:30Z","title":"BEVFusion: A Simple and Robust LiDAR-Camera Fusion Framework","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.13790","snapshot_observed_at":"2026-08-06T11:12:26.456782Z","title":"Liang, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.456782Z"},"links":{"cited_paper":"/paper/2205.13790","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:7ecb42536fb16aff0bc2a50e6870948533e396d32ea0fcdb096f88b956412aa8","observation_id":"a3256dee-8582-4f94-a8bb-af88110c72dd","resolution":{"observed_at":"2026-08-06T11:12:26.456782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.922783Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":"8d714a73-9c24-4c6e-b993-b598e560be01","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.461070Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f5f1cb40c7d686146aa97000a970dc9f65fc02ce303864559d7b40dff4acdc2c","observation_id":"aa7f6fb2-245a-47c1-9373-313e8a2afe15","resolution":{"observed_at":"2026-08-06T11:12:27.926851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14919","last_updated":"2024-05-21T16:47:13Z","snapshot_observed_at":"2026-08-16T14:32:06.971414Z","submitted_at":"2023-12-22T18:51:50Z","title":"Lift-Attend-Splat: Bird's-eye-view camera-lidar fusion using transformers","version":3},"cited_work":{"arxiv_id":"2312.14919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14919","snapshot_observed_at":"2026-08-06T11:12:26.862931Z","title":"Lift-Attend-Splat: Bird's-eye-view camera-lidar fusion using transformers","venue":"cs.CV","work_id":"56a7ff23-0178-4c95-9566-89fb89e24277","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.464921Z"},"links":{"cited_paper":"/paper/2312.14919","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:90bc745002390f44cf4b9b52ea9ada5d774807fc8ff0f23e9b33ccd6b4619be7","observation_id":"665017ff-3267-4db1-b8f0-2565070b8262","resolution":{"observed_at":"2026-08-06T11:12:26.874188Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07836","last_updated":"2017-09-08T00:29:55Z","snapshot_observed_at":"2026-08-14T21:14:50.142211Z","submitted_at":"2017-02-25T06:04:42Z","title":"Synthesizing Training Data for Object Detection in Indoor Scenes","version":2},"cited_work":{"arxiv_id":"1702.07836","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.07836","snapshot_observed_at":"2026-08-06T11:12:26.842370Z","title":"Synthesizing Training Data for Object Detection in Indoor Scenes","venue":"cs.CV","work_id":"c4726077-06ac-4513-9f02-7fde2111872a","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.469023Z"},"links":{"cited_paper":"/paper/1702.07836","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3531c98c09ae95f1f61c603b120991117a39a30f32b3499540ccd520f6bd9a91","observation_id":"b2aa490a-496d-47aa-b6e5-535070da8458","resolution":{"observed_at":"2026-08-06T11:12:26.847157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.910109Z","title":"Cut, paste and learn: Surprisingly easy synthesis for instance detection,","venue":null,"work_id":"87198cb7-4b4b-424e-8fac-fb838223f52d","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.472915Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ac7f0ed89b4049243562cf92efafaf59b624eb59ab177a767871e080e1bfe7b2","observation_id":"ea3ee91b-1320-4a49-a75b-089a231b47a3","resolution":{"observed_at":"2026-08-06T11:12:27.913865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.897476Z","title":"Simple copy-paste is a strong data augmentation method for instance segmentation,","venue":null,"work_id":"2d7e64e3-9a5a-4ea4-985f-c554f2f7dcb7","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.476547Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d278928eb0f8352a6d9c6ff98429314673e71c8388466604a5fe676d7f064063","observation_id":"2d69e29a-9118-4da6-90a9-d4442eacc424","resolution":{"observed_at":"2026-08-06T11:12:27.901440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.884440Z","title":"Pointaugmenting: Cross-modal augmentation for 3d ob- ject detection,","venue":null,"work_id":"8485aae4-a704-42ad-8d91-484827f8f647","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.480552Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9b2cf825aeda0aaa000507812129c0b292a3cc8d3a23e00d313861ce9abfe667","observation_id":"dc3edda2-1a6f-494f-8686-e4827624c36b","resolution":{"observed_at":"2026-08-06T11:12:27.888698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.870779Z","title":"Second: Sparsely embedded convolutional detection,","venue":null,"work_id":"f164f702-e5d7-4a8d-9326-ee120a886238","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.484474Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b08f5551791570721c5b011a1fe1d21c3ed8bffdbf99ceef1dcbd252c7f62582","observation_id":"13c249ba-afcc-4bf4-af9e-9d61623e935c","resolution":{"observed_at":"2026-08-06T11:12:27.874960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.857904Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features,","venue":null,"work_id":"96b75df2-ad02-4f2a-9ee7-d1af12a54a09","year":2019},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.488552Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ae13832122e4e191119b812f639d12ed5862c099ec4a5b9770430ab36ccedd9a","observation_id":"43830762-797c-4e39-8a87-4cd00f54bd31","resolution":{"observed_at":"2026-08-06T11:12:27.861937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.12741","last_updated":"2021-04-21T16:23:20Z","snapshot_observed_at":"2026-08-16T18:56:23.800610Z","submitted_at":"2020-12-23T15:23:16Z","title":"Exploring Data Augmentation for Multi-Modality 3D Object Detection","version":2},"cited_work":{"arxiv_id":"2012.12741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.12741","snapshot_observed_at":"2026-08-06T11:12:26.821912Z","title":"Exploring Data Augmentation for Multi-Modality 3D Object Detection","venue":"cs.CV","work_id":"1e13a555-4978-4e8e-8d30-71d22c12e8d6","year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.492445Z"},"links":{"cited_paper":"/paper/2012.12741","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ca7f88ac2a555ea7ad8f7542fed7faeed7b2f2ba1f6ca3f06a484342619be91b","observation_id":"1be9cc99-987f-449a-b6a2-064305cc9f69","resolution":{"observed_at":"2026-08-06T11:12:26.826848Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.844894Z","title":"Exploring geometric consistency for monocular 3d object detection,","venue":null,"work_id":"1284d545-be61-46e5-83fb-bbb07b41a492","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.496471Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:67156ca132207c425136f82e0508089379622e378a0bed9a410be96b6fc54e42","observation_id":"43cab671-8ca4-41ed-bdc8-8d15d3268c4d","resolution":{"observed_at":"2026-08-06T11:12:27.848938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-16T15:11:06.034826Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-06T11:12:26.500187Z","title":"Bevcontrol: Accurately controlling street-view elements with multi-perspective consistency via bev sketch layout,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.500187Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b02b97f68b291143d8e1612b79b410fd767067365c8b0ee07a6c2920e999142c","observation_id":"7fbf189d-9da0-47c0-ab96-6e9d69d7f778","resolution":{"observed_at":"2026-08-06T11:12:26.500187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.831760Z","title":"Synthetic lidar point cloud generation using deep gener- ative models for improved driving scene object recognition,","venue":null,"work_id":"99b92926-8f3d-4e9f-bd9c-6cf5b27b66f9","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.504328Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d9b8a6078c691d37c621bbddb3d7931018384d0efc197f9c7f2146e73ae95f85","observation_id":"172fc67f-68f3-4f05-861c-8636228c157f","resolution":{"observed_at":"2026-08-06T11:12:27.835761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.818749Z","title":"Deep unsupervised learning us- ing nonequilibrium thermodynamics,","venue":null,"work_id":"56926568-7832-4f85-aefc-00838eca2189","year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.508518Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d1ee3f90217a231ed17088ef071431d75b7a2406f5b1a5dad641b6c291ecf301","observation_id":"2e9dda35-df5c-468c-87c8-f1c459ae68b0","resolution":{"observed_at":"2026-08-06T11:12:27.822803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.805150Z","title":"Nuscenes: A multimodal dataset for autonomous driv- ing,","venue":null,"work_id":"85f1c59d-21e5-42a0-b87d-23d250c10b3c","year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.512200Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b961ab22bdc21f3dc300a63216a25b1cee1fc5b9e7000d19040f72e0b954f366","observation_id":"d7647ef1-58fd-4ad2-8392-46701237c7e8","resolution":{"observed_at":"2026-08-06T11:12:27.809154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.792099Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"1269e3b0-720c-4e2b-9954-1959b57d52b6","year":2016},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.515841Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:c999d0c0657cbe04b96c4fe07866b17102d89a911c3d323bea986d941a56f444","observation_id":"8db81fc7-e71e-470a-8fb8-ddeb48588b69","resolution":{"observed_at":"2026-08-06T11:12:27.796118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.778678Z","title":"T aming transformers for high-resolution image synthe- sis,","venue":null,"work_id":"55536fe3-b1c4-433c-8ff7-50b01ebaf285","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.519792Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:99d5ec0dde75007b41ad48bbae6060e2bded57eb59435a73fd08a58526e75830","observation_id":"0fceecea-0de9-4533-b1ea-166f849014c7","resolution":{"observed_at":"2026-08-06T11:12:27.783016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.765543Z","title":"Learning transferable visual models from natural lan- guage supervision,","venue":null,"work_id":"f5e41141-4cef-41cb-b849-8c126206eb8b","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.523387Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0c6a19a9ce809b583272b8add68f406ebce63fcb1d0b4ff6f772ee9f389e8987","observation_id":"085e34ed-1f76-41ef-8104-923420569f2c","resolution":{"observed_at":"2026-08-06T11:12:27.769742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T11:12:26.527021Z","title":"Dinov2: Learning robust visual features without su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.527021Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3dcadafafb865b2592c61be9430c710a495b74fd18bcb0bcacf54f3eb1f71109","observation_id":"7e12a163-63b7-4b69-bded-53bbc50fecb6","resolution":{"observed_at":"2026-08-06T11:12:26.527021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.751296Z","title":"Flamingo: A visual language model for few-shot learn- ing,","venue":null,"work_id":"cdb761d5-355c-4e07-a202-45f0434de2a1","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.530758Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a3470d30c3cc93e945ffe8403e799892f3fdd09ff009ba9eb8d0ec320c428663","observation_id":"5d3084c9-a1b4-421b-a10f-7d39d7c36d55","resolution":{"observed_at":"2026-08-06T11:12:27.756311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T11:12:26.534376Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.534376Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1dbdfe6fae3280bc48e68d1ad4c8c03e1087dd1aa12cee099fbdf394013b5839","observation_id":"efb2661f-ddac-4751-91af-d9be604bc133","resolution":{"observed_at":"2026-08-06T11:12:26.534376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16392","last_updated":"2024-07-12T18:19:19Z","snapshot_observed_at":"2026-08-16T14:15:24.315196Z","submitted_at":"2024-02-26T08:32:41Z","title":"Placing Objects in Context via Inpainting for Out-of-distribution Segmentation","version":2},"cited_work":{"arxiv_id":"2402.16392","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16392","snapshot_observed_at":"2026-08-06T11:12:26.756032Z","title":"Placing Objects in Context via Inpainting for Out-of-distribution Segmentation","venue":"cs.CV","work_id":"b613a4de-e99a-4359-a856-4ada26073550","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.538760Z"},"links":{"cited_paper":"/paper/2402.16392","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1bebef759c70ca478f93c618baf62d94018930d6f6744f04b8842a6bbf3abb43","observation_id":"905b1424-2e25-4b7d-a478-c8713e83b3fe","resolution":{"observed_at":"2026-08-06T11:12:26.760867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.737661Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":"5078bf96-7b46-4a26-b1c0-25b9c26f9c2e","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.542751Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:99c634bc1f1cc12ebcf5d242792755c6a66f68a6ed36d2809db84078a608b250","observation_id":"deb29c18-94b7-4a99-8328-d9f17bc7a84a","resolution":{"observed_at":"2026-08-06T11:12:27.741731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.724760Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":"53ecc9eb-66cc-4cc7-916d-2dbea6e67e9b","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.546436Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4ed76bcca2192ee93190848aacae846196753efb94b3cdbe82296782d9c87a5d","observation_id":"6ff655d4-aa70-409a-97ef-85d27f3cd555","resolution":{"observed_at":"2026-08-06T11:12:27.728921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.711619Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation,","venue":null,"work_id":"16e1cde7-dea8-4140-9447-6fc0eec8287f","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.550648Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:aa130d1c8a6713706136a05f72f3000941cae58cb2fc9d950637503761e17b08","observation_id":"349750d0-683d-4334-8223-7b67ba361d9b","resolution":{"observed_at":"2026-08-06T11:12:27.716025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.698890Z","title":"Going deeper with convolutions,","venue":null,"work_id":"c551800e-e99d-4912-b238-363be3a9c8a5","year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.554402Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:2ef381e5f7a0c5d3a75934394486b8bd3752ffc020501e6bdf5f96c4c028dd10","observation_id":"65aa90ae-2685-413e-8672-02aac098479b","resolution":{"observed_at":"2026-08-06T11:12:27.702772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.686231Z","title":"Lidar data synthesis with denoising diffusion probabilistic mod- els,","venue":null,"work_id":"ceda8962-0c6e-406c-ad01-9216c4b126b8","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.558906Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:8db72d5265129b79196ab4676cfcd7a3098a8d24366baae8837ab40deb59bf91","observation_id":"469af669-6a9f-4dbb-9e76-f69d5b8e9195","resolution":{"observed_at":"2026-08-06T11:12:27.690214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.673278Z","title":"Swin transformer: Hierarchical vision transformer using shifted win- dows,","venue":null,"work_id":"2b13ca9a-03b0-4a3a-b607-481951d37d15","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.562681Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:5cdcab87b626f8b3c15e2cd2c018c96e84d09e80659072295e1af45c9342f6b0","observation_id":"7c933eaf-22c3-4b0e-adff-a63bb847e317","resolution":{"observed_at":"2026-08-06T11:12:27.677454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.659567Z","title":"Controllable and efficient multi-class pathology nuclei data augmenta- tion using text-conditioned diffusion models,","venue":null,"work_id":"7f11539d-c3a9-4105-be51-c2c5e0e67c33","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.566803Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:43f3f9a4fde1e1766ddd7db811d0dcf987c70a6ac43cd3c41d02ce1d685f0aaf","observation_id":"6ca37b34-c9e1-43d6-8b3b-6f96d04cf904","resolution":{"observed_at":"2026-08-06T11:12:27.663788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.645953Z","title":"Prism: High-resolution & precise counterfactual medical image generation using language-guided stable diffusion,","venue":null,"work_id":"05863c96-7c89-4b1d-bd95-53985008b846","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.570319Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:40f6e0290118fa06a47f7ebd659202c0fe0bafafa4d1c584d355b888dc901175","observation_id":"03fded4e-eda5-42c6-bc66-0f536ceda224","resolution":{"observed_at":"2026-08-06T11:12:27.650104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.632116Z","title":"Denoising diffusion models for 3d healthy brain tissue in- painting,","venue":null,"work_id":"b298b173-2ade-4e7c-8bbc-56c05cb6d699","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.574048Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f4a441a37521aac94738846c825b08a56f29507a47271424cd968aea178fbc6f","observation_id":"6d95423d-e62b-4f26-a1bb-762dfe065969","resolution":{"observed_at":"2026-08-06T11:12:27.636356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.619364Z","title":"St-gan: Spatial transformer generative adversarial networks for image compositing,","venue":null,"work_id":"0968daeb-2213-4c7a-ad56-7209108ae826","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.577848Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:bed5b1b07a93438e240419438edc0ddf8504ed8686823347480703ee3abea2ec","observation_id":"e1a1fa89-0ab0-4a86-a825-9a3655f32c04","resolution":{"observed_at":"2026-08-06T11:12:27.623324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-08-16T11:06:16.881602Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-06T11:12:26.581941Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.581941Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:205e467cb4543fe1ffa5c8d712082c49b57bf59ffa72bb007805c437da365b3d","observation_id":"379f1b3d-95de-493e-b721-5fe63b4ac3dc","resolution":{"observed_at":"2026-08-06T11:12:26.581941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.606307Z","title":"Objectstitch: Object compositing with diffusion model,","venue":null,"work_id":"6d12b3db-9a65-44df-ac38-00918ebaa777","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.585965Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a9a54a2c7c1ff3bc66247d2f9c0df811250356e26566b155af9c4eb6e616524c","observation_id":"d7a5db88-607a-4f16-a4df-93464011acc8","resolution":{"observed_at":"2026-08-06T11:12:27.610701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T11:12:26.590374Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.590374Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:98fad3fc71d0dc74004b17f8d6dd8cc2522a4469ccdd0b1af1514eed50e94909","observation_id":"be048089-9c63-4a7c-996e-6e410160f944","resolution":{"observed_at":"2026-08-06T11:12:26.590374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18818","last_updated":"2024-03-27T17:59:52Z","snapshot_observed_at":"2026-08-19T00:30:49.654410Z","submitted_at":"2024-03-27T17:59:52Z","title":"ObjectDrop: Bootstrapping Counterfactuals for Photorealistic Object Removal and Insertion","version":1},"cited_work":{"arxiv_id":"2403.18818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18818","snapshot_observed_at":"2026-08-06T11:12:26.702025Z","title":"ObjectDrop: Bootstrapping Counterfactuals for Photorealistic Object Removal and Insertion","venue":"cs.CV","work_id":"a073551b-252a-489c-ac02-bf4f7e3d0034","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.594245Z"},"links":{"cited_paper":"/paper/2403.18818","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:78c5a543894cbf884960874fd75c268d1ad12431e23a3045504e0dca67401fd8","observation_id":"2d014b55-4fbc-4e30-a2c1-e6c3640e507d","resolution":{"observed_at":"2026-08-06T11:12:26.708484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.593271Z","title":"Anatomically-controllable medical image generation with segmentation-guided diffusion models,","venue":null,"work_id":"45b9a6df-d2be-46e9-a0ce-d617af73463a","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.598282Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:35c9fa6b5eaab1985e1777de2951ba89fe4045d8a47e597e22a5f951bca7649d","observation_id":"e72d13e5-0cae-4ab7-8dcd-fa19e78bb4ed","resolution":{"observed_at":"2026-08-06T11:12:27.597234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.580391Z","title":"Mededit: Counterfactual diffusion-based image editing on brain mri,","venue":null,"work_id":"dd089b05-6220-403f-befb-c5d2b459b4f3","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.602120Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:aed223df30faac4944e9d771a9081b2887fe9fab457170407c8b973f5a2833cb","observation_id":"021cb827-bbc1-499d-8add-1a63b22559df","resolution":{"observed_at":"2026-08-06T11:12:27.584464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.566697Z","title":"Diffusion models with implicit guid- ance for medical anomaly detection,","venue":null,"work_id":"34b5b923-3e2f-4e70-b551-d47ac0adc4c0","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.606232Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:8ab0740f55d0a8052e0878a5633e3e2fd47d88b2241b1d25836a2c3a7d10c30c","observation_id":"b7f5c351-5643-4289-84a2-820d19b94d8f","resolution":{"observed_at":"2026-08-06T11:12:27.571252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.553077Z","title":"Radedit: Stress-testing biomedical vision mod- els via diffusion image editing,","venue":null,"work_id":"1f4e31ef-75d4-4ac2-87cf-5702b11f31d4","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.610388Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:366ff93d2a17a2b6703040577a886559b45fec9f608eb89ba7760a4625ce7a3c","observation_id":"2bbdaeee-a54e-43e5-8bc8-d9723674d25e","resolution":{"observed_at":"2026-08-06T11:12:27.557267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.538202Z","title":"Diffusion models for counterfac- tual generation and anomaly detection in brain images,","venue":null,"work_id":"c7886381-d7df-4ad5-ad97-f8a7f4109ff3","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.614288Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4a18adf319d02cf37468a947de362ba971c720b88d2b3d30b87b8eabedfeff0f","observation_id":"cbd66750-7680-4cda-a2a9-93d5c45a761f","resolution":{"observed_at":"2026-08-06T11:12:27.543016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.521854Z","title":"Vindr-mammo: A large-scale benchmark dataset for computer-aided diagnosis in full-field digital mammography,","venue":null,"work_id":"9dac8f58-e8e6-480f-9d3e-a76d5cb6226f","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.618164Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4cbd30de5a4ffb3a1d96d5b30abe8ee242b1aeebb8c4be3e88f9a9d7fdf6988b","observation_id":"27c23e9c-332b-4c29-934f-f02ef4ac07f1","resolution":{"observed_at":"2026-08-06T11:12:27.526538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.507030Z","title":"D’Orsi, E","venue":null,"work_id":"5699d5ff-41e7-4df4-ada6-c4f16d7fca06","year":2013},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.621895Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3945834583e81738804cc1142b72ed2cb84076f6922294eaa42c3eb23fc280c1","observation_id":"d05a9d39-e769-4d5f-815b-f0ad7d0b735a","resolution":{"observed_at":"2026-08-06T11:12:27.511197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T11:12:26.625897Z","title":"An image is worth 16x16 words: T ransformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.625897Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:344b2f457d72808efba3630b4b2ac3443750c52e096b7f73b2193b7bef220f6f","observation_id":"15afb3d4-d148-4498-b428-6e2bfb523cae","resolution":{"observed_at":"2026-08-06T11:12:26.625897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.492595Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"367ab566-5c1d-4020-a5ff-7adb62deb4bb","year":2014},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.629980Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:92d86ae5f68ef85c8a874e44442aa7b1129822ecf0644438e9b9394c5f31874f","observation_id":"e07e0742-f9df-4ece-b728-c4c94ed1ea0a","resolution":{"observed_at":"2026-08-06T11:12:27.496858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.477647Z","title":"W ovogen: W orld volume-aware diffusion for controllable multi-camera driving scene generation,","venue":null,"work_id":"feeb984a-dc00-428c-97e8-93bb7fd8b02b","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.633792Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:2ffea7caf802c403c65c2339f5b18131aff717f338caa7fc7cad77eaf6e7d40c","observation_id":"298827ff-673b-42bf-a93a-248868549c05","resolution":{"observed_at":"2026-08-06T11:12:27.481979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.462827Z","title":"Simple open-vocabulary object detection,","venue":null,"work_id":"df47a152-e6a3-43ed-bb52-5f83b51011b4","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.637584Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:120def58b7afec493b52cfb217d2a59b3f827d0bbad7f523e72e6518f743815e","observation_id":"4f973538-e8ef-4dc6-9240-cadcb2efcccd","resolution":{"observed_at":"2026-08-06T11:12:27.467559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00815","last_updated":"2024-04-18T19:22:37Z","snapshot_observed_at":"2026-08-18T22:29:02.869507Z","submitted_at":"2024-03-31T22:18:56Z","title":"Towards Realistic Scene Generation with LiDAR Diffusion Models","version":2},"cited_work":{"arxiv_id":"2404.00815","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00815","snapshot_observed_at":"2026-08-06T11:12:27.096723Z","title":"Towards Realistic Scene Generation with LiDAR Diffusion Models","venue":"cs.CV","work_id":"4624c843-f716-4616-974c-4b384ce464d2","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.426578Z"},"links":{"cited_paper":"/paper/2404.00815","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4938a53035246d9b87498eb71f5ff1493650868490739a7a55a6d5b5788ad9cd","observation_id":"a26296bc-7985-4128-8edc-8eaad1a88cae","resolution":{"observed_at":"2026-08-06T11:12:27.101813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T10:49:40.975054Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation"},"reference_resolution":{"displayed":96,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":10,"verified_fuzzy":41},"total_outbound_references":96},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 96 of 96 outbound references and 0 inbound Pith citation observations for arXiv:2507.23058."}