{"as_of":"2026-08-21T08:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d8f8f7d40bd4b39bfced178c6839a7a88dc43155ce4a269a9e79152cf41cf88","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:56:48.533102Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:17:29.856464Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T23:17:34.753358Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"cited_work":{"arxiv_id":"2411.10164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10164","snapshot_observed_at":"2026-08-05T23:17:34.753358Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","venue":"cs.RO","work_id":"1a87aaa4-dfe4-4de0-99f2-89e0ab89d482","year":2024},"citing_paper":{"arxiv_id":"2508.05580","last_updated":"2025-08-07T17:12:54Z","snapshot_observed_at":"2026-08-14T07:42:18.323855Z","submitted_at":"2025-08-07T17:12:54Z","title":"Follow-Your-Instruction: A Comprehensive MLLM Agent for World Data Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.856464Z"},"links":{"cited_paper":"/paper/2411.10164","citing_paper":"/paper/2508.05580"},"observation_digest":"sha256:65a1539c4c572788318534a14fa86beebe1cbd981b46cbf1a367d57caa2ea25b","observation_id":"35b1deb0-fc23-4a44-ba58-2da058bc729a","resolution":{"observed_at":"2026-08-05T23:17:34.757859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.10164/citation-record","integrity":"/paper/2411.10164/integrity","json":"/paper/2411.10164/citation-record.json","paper":"/paper/2411.10164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.232487Z","title":"kpam: Keypoint af- fordances for category-level robotic manipulation,","venue":null,"work_id":"65a0f2ee-2a8c-41b5-bed6-1b01710320e9","year":2019},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.301887Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:9c38c2b23d1481a81cf717b49768c8c304cb25ac12685c4d2eeb7b2c4772f109","observation_id":"8c211d09-f2a4-4ce4-9fb5-abbf0473a672","resolution":{"observed_at":"2026-08-12T19:56:49.238339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.215014Z","title":"Learning hand-eye coordination for robotic grasping with deep learning and large- scale data collection,","venue":null,"work_id":"daa1eeee-cba2-408c-a5a9-e795ff62a945","year":2018},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.307601Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:f2639c372ce147f8116fd03e85b5a90157db42f699076be7f613c3e001b0943a","observation_id":"266ed5e3-210a-452f-83a4-69a18fefdf70","resolution":{"observed_at":"2026-08-12T19:56:49.220311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.313285Z","title":"Interactive language: Talking to robots in real time,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.313285Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:402d0759c070d8e2401b2dbe1660119ddaa47c5a91bc3640ce1bae2319d5a5e0","observation_id":"574f4599-cb08-4da0-9748-aef6c546bf38","resolution":{"observed_at":"2026-08-12T19:56:48.313285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.183050Z","title":"Real-world robot applications of foundation models: a review,","venue":null,"work_id":"df55cd63-b4bf-4497-a581-96a79e93795a","year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.319232Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:6637a21199c4773992ea269aa7c3afe532a710635aa46355f2550dafe287eb12","observation_id":"5ecec224-d18e-4697-9d67-918fec80aebf","resolution":{"observed_at":"2026-08-12T19:56:49.188359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.329892Z","title":"A review of synthetic image data and its use in computer vision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.329892Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:e3e522da7715d684e9acd45cad467efe4fac8c8c726889ca3c90fbac4e58bb8a","observation_id":"7647efd6-8a7a-4974-a032-0fcdff07c744","resolution":{"observed_at":"2026-08-12T19:56:48.329892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.335369Z","title":"Photorealistic image synthesis for object instance detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.335369Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:fa370b1460c299cf1ae627b05e7b08b31dbe61f50a338a016ce3014c7c21b592","observation_id":"fb9385bf-87ed-4d66-a20f-9fe5a81de893","resolution":{"observed_at":"2026-08-12T19:56:48.335369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.142110Z","title":"Fake it till you make it: face analysis in the wild using synthetic data alone,","venue":null,"work_id":"134ce47a-be48-4a67-bbbf-32fbac27d1e9","year":2021},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.341937Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:435d5fbe232e19bcd787ff309da47542a5bce11cd503c5899a5bb5c52bf80f57","observation_id":"ecc9154b-b8d8-4f1c-be46-9bac15ae4a37","resolution":{"observed_at":"2026-08-12T19:56:49.147806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.122711Z","title":"replicant: a pipeline for generating annotated images of animals in complex environments using unreal engine,","venue":null,"work_id":"bfe40ceb-9437-482a-9502-ab5c77575fe7","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.347289Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:1d272c3056f353fde077c90abd44c5f6ec6f9a1b1ab75f16a3caa1bd7e8c93d1","observation_id":"c21a2b99-ffb7-40c9-85bf-086d6e5cdfcb","resolution":{"observed_at":"2026-08-12T19:56:49.128590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.352721Z","title":"Learning dexterous in-hand manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.352721Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:d004ad9facaf4aca58771a61b8b247502b6ce6258dcfb16b53f11cd8427abbd8","observation_id":"7275b7b0-6262-4ffe-9be0-a12041cdbd10","resolution":{"observed_at":"2026-08-12T19:56:48.352721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.089943Z","title":"Learning keypoints for robotic cloth manipulation using synthetic data,","venue":null,"work_id":"be74c7e1-4127-4690-9c82-916ceda754df","year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.358623Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:bfb0d6419e3c77a363643231877ff9715fd7b8e9a59e9932f15858fe397f4990","observation_id":"09e7d21a-715c-46e2-8549-bdf8e1a2ae18","resolution":{"observed_at":"2026-08-12T19:56:49.095481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.071187Z","title":"Scaling robot learning with seman- tically imagined experience,","venue":null,"work_id":"f135fb8c-c230-482b-9978-38c1441b34b8","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.365056Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:f02ffe476ef21de38d7752827b9a487a8fdb1814aa811ed8b57d5dd3e108fcbe","observation_id":"d861b94a-e8de-40ab-a689-facf08289d9f","resolution":{"observed_at":"2026-08-12T19:56:49.077726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.052161Z","title":"Genaug: Retargeting behaviors to unseen situations via generative augmentation,","venue":null,"work_id":"7699dede-3f8d-4936-9320-f1321cd907ab","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.370072Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:a3c155dbba31a4ea8173cc0ba36071fdb62651aa6f27e7648f5397aaadfe1e44","observation_id":"10ce06bf-2e5c-42e6-ba93-7c5948849fd4","resolution":{"observed_at":"2026-08-12T19:56:49.057644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09813","last_updated":"2023-03-17T07:47:55Z","snapshot_observed_at":"2026-08-16T15:47:29.720774Z","submitted_at":"2023-03-17T07:47:55Z","title":"DiffusionSeg: Adapting Diffusion Towards Unsupervised Object Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09813","snapshot_observed_at":"2026-08-12T19:56:48.375866Z","title":"Diffusionseg: Adapting diffusion towards unsupervised object discovery,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.375866Z"},"links":{"cited_paper":"/paper/2303.09813","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:89132eaf2ed9ebcb2b1843a7f363ec5d726d5b06b420442a30f8a954c5a1bc1b","observation_id":"9222dbe6-75e0-4621-b1dc-4b620e663573","resolution":{"observed_at":"2026-08-12T19:56:48.375866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.381677Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.381677Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:de78eaf4036c4e28d8592fdc734a6d75c340ebbaf0ba2a7d14ef0958b9291554","observation_id":"f6d54c85-c1cd-4f94-9c0a-23ef77eff6e1","resolution":{"observed_at":"2026-08-12T19:56:48.381677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08103","last_updated":"2024-04-03T19:16:02Z","snapshot_observed_at":"2026-08-18T06:53:01.650576Z","submitted_at":"2023-06-13T19:48:56Z","title":"Generating Images with 3D Annotations Using Diffusion Models","version":4},"cited_work":{"arxiv_id":"2306.08103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.08103","snapshot_observed_at":"2026-08-12T19:56:48.661531Z","title":"Generating Images with 3D Annotations Using Diffusion Models","venue":"cs.CV","work_id":"9ca83801-ab4e-4144-976b-2dde28fb59d6","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.386638Z"},"links":{"cited_paper":"/paper/2306.08103","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:cf4ae29cd610a6af4912d05b68750e6af3ed95b963c0582b557ccc429db3d9cc","observation_id":"31950538-b024-4968-8b9f-92dc47039c7c","resolution":{"observed_at":"2026-08-12T19:56:48.667734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.392291Z","title":"Training deep networks with synthetic data: Bridging the reality gap by domain randomization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.392291Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:b6648a4b7fe46f07e9403444b63040955113d7704d238ec7342729f8c8aa6f92","observation_id":"73289ed1-2ab0-43ce-ab67-d60fe5f2c985","resolution":{"observed_at":"2026-08-12T19:56:48.392291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:49.011887Z","title":"Retinagan: An object-aware approach to sim-to-real transfer,","venue":null,"work_id":"5ff12779-a699-4a3a-8d23-66d6933fc34a","year":2021},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.397743Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:1c4e25f59559e0be61a8fa76c2ae6723aca961e2e172e95ea72b6f2e12f0692f","observation_id":"3ffa5602-6841-4c51-8a01-80f11d34efc5","resolution":{"observed_at":"2026-08-12T19:56:49.017071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.991551Z","title":"This dataset does not exist: training models from generated images,","venue":null,"work_id":"22204084-0678-4645-8d08-8c9c58624919","year":2020},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.403328Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:95f81b66d398df0a1bdd7a15c12832b5d682e1af24ad964ef8bcb000ae111eb1","observation_id":"0027bfc6-c988-400e-956f-a1155c9bed0a","resolution":{"observed_at":"2026-08-12T19:56:48.999405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.412637Z","title":"Generative adversarial networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.412637Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:9cd7b9b6d4b0a8d267d7bb56708ca3aff69048c2d73682d7f07d4387024526fc","observation_id":"1b07152f-1011-4dd3-a91c-cd2b76e931fd","resolution":{"observed_at":"2026-08-12T19:56:48.412637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.959512Z","title":"Datasetgan: Efficient labeled data factory with minimal human effort,","venue":null,"work_id":"b9ffaa03-f598-44d4-a732-79a62d25bb74","year":2021},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.418414Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:1e182310d44bb37f0757923881c68a1fb1ee79aa15c79d13ed926e2629ac631f","observation_id":"f2391003-5859-47da-874c-93b027c393ff","resolution":{"observed_at":"2026-08-12T19:56:48.966083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.423898Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.423898Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:1205a92c6ec2f43b8d44b5caf948f862a543b255642aa0c67c85eb48599e46d3","observation_id":"adac5929-bb5f-4a5c-94c9-ab1ad0eed27e","resolution":{"observed_at":"2026-08-12T19:56:48.423898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.917087Z","title":"Effective data augmentation with diffusion models,","venue":null,"work_id":"ce6cbfb1-9ebb-4348-95a7-f30058a47bec","year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.435010Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:4167d2dd9fca4d94d74329f717a8e716d185241885e7d52cd190a9537fce2e8d","observation_id":"2500ba33-7cfd-448d-a903-096f8f64e834","resolution":{"observed_at":"2026-08-12T19:56:48.922965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.897981Z","title":"Scaling laws of synthetic images for model training... for now,","venue":null,"work_id":"7d204e5b-bef0-4add-a92e-baeb58c491a8","year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.439706Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:cdc6c4588f1c5305834b5a3eeb015550f3a6a629e793038fb424079fd53d85d8","observation_id":"5fbe0d7f-9460-4dca-bc2c-66f5790ee5e1","resolution":{"observed_at":"2026-08-12T19:56:48.903278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05184","last_updated":"2025-01-02T00:01:03Z","snapshot_observed_at":"2026-08-16T13:45:03.692847Z","submitted_at":"2024-06-07T18:04:21Z","title":"The Unmet Promise of Synthetic Training Images: Using Retrieved Real Images Performs Better","version":5},"cited_work":{"arxiv_id":"2406.05184","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05184","snapshot_observed_at":"2026-08-12T19:56:48.634640Z","title":"The Unmet Promise of Synthetic Training Images: Using Retrieved Real Images Performs Better","venue":"cs.CV","work_id":"96df51e3-ae14-4def-a0e1-11b932a68b68","year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.444608Z"},"links":{"cited_paper":"/paper/2406.05184","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:4f50260f9e29a5ab767780a78d4b857a6707e63bc2243e2067a7f6471fa64579","observation_id":"16870f1e-2738-4e2e-b700-4f34f62a9937","resolution":{"observed_at":"2026-08-12T19:56:48.642331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.450183Z","title":"Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic seg- mentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.450183Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:112c349f853d675d9771e2b4ec7428063de9a85a4fb3d5f60d614310a771a478","observation_id":"79bd0a71-212b-4061-88f2-b66ad03840a8","resolution":{"observed_at":"2026-08-12T19:56:48.450183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.869426Z","title":"Diffumask: Syn- thesizing images with pixel-level annotations for semantic segmentation using diffusion models,","venue":null,"work_id":"d801b1ca-b10d-44b7-8489-b181f50fc6a0","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.455293Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:9fdd989eb2c6dbc3397a842744a72e8933e4c925793c81f3c56c2566228a4661","observation_id":"b5fcb1bf-6940-451a-8681-a9cca86e456d","resolution":{"observed_at":"2026-08-12T19:56:48.874873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13430","last_updated":"2024-09-11T14:40:19Z","snapshot_observed_at":"2026-08-19T17:52:09.852708Z","submitted_at":"2023-03-23T16:50:19Z","title":"Medical diffusion on a budget: Textual Inversion for medical image generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13430","snapshot_observed_at":"2026-08-12T19:56:48.460316Z","title":"Medical diffusion on a budget: textual inversion for medical image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.460316Z"},"links":{"cited_paper":"/paper/2303.13430","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:750b1e88d6c55b33be468dbc31bfe50be6562aec4b28ee2f88a2858dab427307","observation_id":"052b5270-c2b3-4f93-a552-ded4b17ce806","resolution":{"observed_at":"2026-08-12T19:56:48.460316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.850551Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion,","venue":null,"work_id":"550b0180-b3e7-4477-8efb-8a0426a9d225","year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.466504Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:e001cdbbfae9b41ee49c0ee62b440fc2acf0bc3cb0f537cb5c6277001a193bc0","observation_id":"f1b30195-2b10-48ef-aed3-57c82369d44a","resolution":{"observed_at":"2026-08-12T19:56:48.856868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.471265Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.471265Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:269bf3ef16c842041465605cb1325fc48bf9c463364fce44fb7e768932c9d28b","observation_id":"626e6b06-ed70-47bf-a0d5-032c07c0336d","resolution":{"observed_at":"2026-08-12T19:56:48.471265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.475996Z","title":"Objaverse: A universe of annotated 3d objects,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.475996Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:f649dad1e9241111a949f0bd5d83c7cb87a43c67006524313b507ea3ca933ddb","observation_id":"0266a344-abcf-4f33-a37b-224f045c4e85","resolution":{"observed_at":"2026-08-12T19:56:48.475996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.818840Z","title":"Google scanned objects: A high- quality dataset of 3d scanned household items,","venue":null,"work_id":"3a1ffbea-3f0b-4820-9697-5476de4ae17d","year":2022},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.480930Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:3ef5cb4677df9af10d48e11e3c84dc976837a431bef7a6b58e30a8338cb27b98","observation_id":"c07abb21-2717-467c-9f5c-3ad9b0c6e7ef","resolution":{"observed_at":"2026-08-12T19:56:48.824832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.799221Z","title":"Blender - a 3d modelling and rendering package,","venue":null,"work_id":"10d0a567-6504-4b67-8ece-17d6b0730123","year":null},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.486145Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:f85ae545c0049ed3ba63b47ec726b68d0c21a8d848180214ed404d6fed0c4079","observation_id":"350ea83b-fa15-4799-9a26-f4630ff05232","resolution":{"observed_at":"2026-08-12T19:56:48.806396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.491206Z","title":"Diffusers: State-of-the-art diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.491206Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:f0d71a4829691ca4508dcac0e90b927eb2b502c14aafe91c93096cff2bd5ec39","observation_id":"7b826402-fa58-4c11-b9c0-38ae0f5aa30a","resolution":{"observed_at":"2026-08-12T19:56:48.491206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.763825Z","title":"S3k: Self-supervised semantic keypoints for robotic manipulation via multi-view consistency,","venue":null,"work_id":"8cc1a582-cba0-4bc6-a763-2c1285b2f28b","year":2021},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.496713Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:18bc9aa789b9c5de33f1d81f05d6fb093ffacd366d871bd733ef4bcf636ccd1a","observation_id":"590e003e-b61f-4f48-9fa3-5325dc7f5954","resolution":{"observed_at":"2026-08-12T19:56:48.772312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.07850","last_updated":"2019-04-25T16:20:02Z","snapshot_observed_at":"2026-08-14T16:45:31.678245Z","submitted_at":"2019-04-16T17:54:26Z","title":"Objects as Points","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.07850","snapshot_observed_at":"2026-08-12T19:56:48.502186Z","title":"Objects as points,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.502186Z"},"links":{"cited_paper":"/paper/1904.07850","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:0353488ca7e8ec1b90531a97c453807d0d363f52af8884ee5eae631ae5f1c7c8","observation_id":"6926c02a-556f-4037-840c-9f5793c752c0","resolution":{"observed_at":"2026-08-12T19:56:48.502186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.507878Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.507878Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:3e33ba635dbf28bb40decdb5c54c77b969d0c86e0a8343cccc5a6305fd916cb9","observation_id":"6dc93bc9-1fdc-415f-8759-22d08946d9be","resolution":{"observed_at":"2026-08-12T19:56:48.507878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.513213Z","title":"Maxvit: Multi-axis vision transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.513213Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:34394525cc0fd3d3574d8d88859357bbf47aef6f5f865a8969f091fd209dbcd9","observation_id":"931aceab-271f-42d3-b647-96ddfeeac786","resolution":{"observed_at":"2026-08-12T19:56:48.513213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.518403Z","title":"Ultralytics yolov8,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.518403Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:0bdf0e43fb4ea4b2765913a5049dabbd32a505178ceed0fcf06e8550064c2407","observation_id":"3562142e-92a3-4b8c-afdb-de83f8ed0637","resolution":{"observed_at":"2026-08-12T19:56:48.518403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.523211Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.523211Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:034be843868ca2be73833497640f26ec05595bcd5a7984f8c4c75eb0a71d5e10","observation_id":"a779b39d-d7d4-49c2-aa07-d4c91027b078","resolution":{"observed_at":"2026-08-12T19:56:48.523211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-12T19:56:48.527929Z","title":"Clipscore: A reference-free evaluation metric for image captioning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.527929Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:66220a54332991db1579bcef0bcb59179ddfb6c275c944eda48ef85c98718667","observation_id":"c0b7e64d-ae09-423b-bb5e-a07d329a571c","resolution":{"observed_at":"2026-08-12T19:56:48.527929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:56:48.533102Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T19:56:48.533102Z"},"links":{"citing_paper":"/paper/2411.10164"},"observation_digest":"sha256:cb635c11e8126ba2c02ba097bbe251253fb076aff875acfc6ff3280788a29375","observation_id":"63007d8f-2bb4-48f6-93c5-b8571b177d70","resolution":{"observed_at":"2026-08-12T19:56:48.533102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.10164","last_updated":"2024-11-15T13:12:47Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T15:06:53.093186Z","submitted_at":"2024-11-15T13:12:47Z","title":"Evaluating Text-to-Image Diffusion Models for Texturing Synthetic Data"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":18},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 1 inbound Pith citation observation for arXiv:2411.10164."}