{"as_of":"2026-08-14T16:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dd0a84d2932abbbc3be36fdc3c0485cdc78591d9642cc130a51b71c304d4515a","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:46:07.274448Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03794/citation-record","integrity":"/paper/2509.03794/integrity","json":"/paper/2509.03794/citation-record.json","paper":"/paper/2509.03794"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.545103Z","title":"Understanding hallucinations in diffusion models through mode interpolation","venue":null,"work_id":"fe9d32ca-1da5-4d52-8f53-84eef1da9cb5","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.117007Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:502b176d3ea935b7a22933bfa861243ab2b65cf25694bbbcdaa5cf2279594c91","observation_id":"3c9db626-7c35-48d8-ad3e-bcc6017f2b96","resolution":{"observed_at":"2026-08-05T10:46:09.604046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.190973Z","title":"Diffusion models in vision: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.190973Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:f1eafa87114507f18f9db35684e4845a22c451c9feb248fd04a00d345c59e47c","observation_id":"96688a5d-8167-48b3-aa55-af7481fa1fe1","resolution":{"observed_at":"2026-08-05T10:46:05.190973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.295549Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.295549Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:3d532e452d10a1b140b1709d1df77ac9696abd8b9ffaeb183a93e563e7a6ebfd","observation_id":"b046b4b5-a339-4f31-8393-7b1989b79569","resolution":{"observed_at":"2026-08-05T10:46:05.295549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02664","last_updated":"2025-02-20T06:17:25Z","snapshot_observed_at":"2026-08-14T14:13:08.369586Z","submitted_at":"2023-10-04T09:04:20Z","title":"On Memorization in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02664","snapshot_observed_at":"2026-08-05T10:46:05.359314Z","title":"On memorization in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.359314Z"},"links":{"cited_paper":"/paper/2310.02664","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:abd1863f70960c219d3e256c7b7226b5b790e81d75075f75497ab8cca7f4d510","observation_id":"f38adbd0-a521-4c2c-a06a-79802611e3f2","resolution":{"observed_at":"2026-08-05T10:46:05.359314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.405531Z","title":"Smooth diffusion: Crafting smooth latent spaces in dif- fusion models","venue":null,"work_id":"f433809c-c7ec-4926-bee6-dd4b9634f2bd","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.457509Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:79667381d37eb251da640c0aa004a7b44af25b097a027f309b4a39d565aacee5","observation_id":"39e7fe0d-f8e7-4d6a-adf7-830f104950f0","resolution":{"observed_at":"2026-08-05T10:46:09.467900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.276017Z","title":"Efficient diffu- sion training via min-snr weighting strategy","venue":null,"work_id":"7148d647-aacf-466d-924c-bab9404ed83a","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.561456Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:ed631835b954c39fb36bcc240d513504d8a1e14b992d2f6bd46ae082dba52d9b","observation_id":"5115d40a-75b2-4bdd-bd03-52f31e641877","resolution":{"observed_at":"2026-08-05T10:46:09.331784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.632768Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.632768Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:0249043e90f3a835012dcf450a3fb8739c476de3530bba6a4ee6d2bf2067c13f","observation_id":"b426a6b9-2443-4663-a6b8-bb6618d1ee5c","resolution":{"observed_at":"2026-08-05T10:46:05.632768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.132520Z","title":"All but one: Surgical concept erasing with model preservation in text-to- image diffusion models","venue":null,"work_id":"2ce3fdf6-1c7a-4381-bd4d-5280251e4ca8","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.739157Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:639c62a74f6aadbedee365f08e03568de9a432ce347b63a2a0e5b5aa721c2139","observation_id":"cade58c7-ce21-4d46-8056-d85f9f51877e","resolution":{"observed_at":"2026-08-05T10:46:09.188597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.967568Z","title":"Video diffusion models","venue":null,"work_id":"f99a8ea1-c839-41ab-8f39-2e5f1f761a6b","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.836790Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:2aac6286bd595035f5c6fb608dc3ab7be24a246cd1e7603a000a27e5c1170699","observation_id":"344f2163-2494-44d7-b8e8-f92e0d46d6a6","resolution":{"observed_at":"2026-08-05T10:46:09.068398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02557","last_updated":"2024-04-12T15:48:47Z","snapshot_observed_at":"2026-08-13T07:37:36.630169Z","submitted_at":"2023-10-04T03:30:32Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02557","snapshot_observed_at":"2026-08-05T10:46:05.951165Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.951165Z"},"links":{"cited_paper":"/paper/2310.02557","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:a00125a4ba6db7d2ab107a9781d07dfb683babd2d4296ca63c729f24cb005aa5","observation_id":"77adf2ed-9824-46a3-85f3-b2d507f73100","resolution":{"observed_at":"2026-08-05T10:46:05.951165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:06.025971Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.025971Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:42a1f532a6de5c45d76a5b3c37d5e13614ac546a127bbe1f63a46aeabd1502d3","observation_id":"035e270a-0d0b-44d7-9cc8-f78e275c987b","resolution":{"observed_at":"2026-08-05T10:46:06.025971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:06.143052Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.143052Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:e8bbfeee5968bcda1226e0f10bbea79f9ec9a4de1e83aa132773d7467100bea3","observation_id":"388716b6-f0c4-4d97-8c16-f2450f487bb3","resolution":{"observed_at":"2026-08-05T10:46:06.143052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.780514Z","title":"Mcvd: Masked conditional video diffusion","venue":null,"work_id":"681714c4-72e5-46ed-bffa-cf296a336795","year":2022},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.213334Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:b43d758ee0a733cb0c6523260136a606ccd94be91ab95f95d548dd3bd7b7967e","observation_id":"4eda1fc9-8483-4ac7-92c1-5c685df35a00","resolution":{"observed_at":"2026-08-05T10:46:08.859438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T10:46:06.346576Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.346576Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:66612d32910845a0a8657a4b25edd7a3aa027899ad57d96291e4a993edcfc426","observation_id":"c0798527-0cea-4bfe-ad41-b74d0140ba42","resolution":{"observed_at":"2026-08-05T10:46:06.346576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09027","last_updated":"2025-07-24T15:55:00Z","snapshot_observed_at":"2026-08-08T15:14:26.502885Z","submitted_at":"2025-06-10T17:53:29Z","title":"Diffuse and Disperse: Image Generation with Representation Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09027","snapshot_observed_at":"2026-08-05T10:46:06.489257Z","title":"Diffuse and disperse: Im- age generation with representation regularization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.489257Z"},"links":{"cited_paper":"/paper/2506.09027","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:21fe88b13e3988a6ef1ace4c712c7a3ccde5d0c0563a2353155f1fe92fc441a1","observation_id":"d426f7c2-0e0a-4ff9-958f-28d190ccb1cf","resolution":{"observed_at":"2026-08-05T10:46:06.489257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.501540Z","title":"Video fusion diffusion for video generation","venue":null,"work_id":"1aa44252-209c-4753-93d8-49b35a097ed3","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.653500Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:cb42f73f7a4066b1ec52c9007180a212ff7be6494756bf133a86ffa1c7a9c144","observation_id":"1fad4622-0c20-4f05-9a1c-bb396e058cc9","resolution":{"observed_at":"2026-08-05T10:46:08.667649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.219628Z","title":"Versatile diffusion: Text, images and variations all in one diffusion model","venue":null,"work_id":"5a4da0dd-3e8c-48cc-a0e6-94d262b4bdf3","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.817638Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:248e185bc1c70cf4045ec9f5c2c8008f861ad01b90442a79243fced47cafb288","observation_id":"4b68fafd-bc77-4b32-9a73-2c2998158f17","resolution":{"observed_at":"2026-08-05T10:46:08.340859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.879796Z","title":"Fasterdit: Towards faster diffusion transformers train- ing without architecture modification","venue":null,"work_id":"39d1e0f1-9742-4299-a724-4bf14bac4b01","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.952940Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:1d01ab61bb3079ba14829bee633c882e894ab324995253bed36480e5d991f6c3","observation_id":"7e8a1991-e596-4785-b60b-7cb79c6e50c4","resolution":{"observed_at":"2026-08-05T10:46:08.031567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.057693Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.057693Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:ad540df94e4ddb257f37a3e288c599bbffe31dc3ba087293cb625b346558e232","observation_id":"1b5cd88d-0dfc-47e5-9cb7-96ca82c32e4b","resolution":{"observed_at":"2026-08-05T10:46:07.057693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.629734Z","title":"Freihand: A dataset for markerless capture of hand pose and shape from single rgb images","venue":null,"work_id":"80ab8bbf-aa7c-469a-9a29-805d584c850c","year":2019},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.171252Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:5bf1c7c1696b02ae4c274f59cd94934357cdcec2de16cd5577fd3aafcbd1a71b","observation_id":"dfad6e03-a986-407f-853b-56c7ff97be25","resolution":{"observed_at":"2026-08-05T10:46:07.767154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.391258Z","title":"Contrastive representation learning for hand shape estima- tion","venue":null,"work_id":"805dcefd-3617-4fa3-879e-41e1e7a63bf1","year":2021},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.274448Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:3fcafe1aa90af3e203161758a77660aca207372a7923a49f7298cc5dbbb07973","observation_id":"221a4d76-a561-433f-8908-07dbde9c4ff4","resolution":{"observed_at":"2026-08-05T10:46:07.472351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T12:37:57.204847Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2509.03794."}