{"as_of":"2026-08-14T22:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b41b137693b23c4962be9cac41ffd136ba78125fbc304a103eca5d5ab10e8db","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:52:09.925374Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T11:56:45.364984Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T21:08:58.160878Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"cited_work":{"arxiv_id":"2507.00006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00006","snapshot_observed_at":"2026-07-03T21:08:58.160878Z","title":"MVGBench: Comprehensive benchmark for multi-view generation models","venue":null,"work_id":"85310a4f-fa56-4f69-84eb-3ca75bc263fa","year":2025},"citing_paper":{"arxiv_id":"2605.25220","last_updated":"2026-05-24T19:09:15Z","snapshot_observed_at":"2026-07-06T23:35:11.987278Z","submitted_at":"2026-05-24T19:09:15Z","title":"Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-30T11:56:45.364984Z"},"links":{"cited_paper":"/paper/2507.00006","citing_paper":"/paper/2605.25220"},"observation_digest":"sha256:7fb965f1b934e7e87bfa605d1cd52a3686c70b76ca51cb4ab31b0a339712b1c0","observation_id":"fe79b691-35f1-4677-9a14-59bfd28e70b1","resolution":{"observed_at":"2026-06-30T12:04:39.100553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"cited_work":{"arxiv_id":"2507.00006","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00006","snapshot_observed_at":"2026-07-03T21:08:58.160878Z","title":"MVGBench: Comprehensive benchmark for multi-view generation models","venue":null,"work_id":"85310a4f-fa56-4f69-84eb-3ca75bc263fa","year":2025},"citing_paper":{"arxiv_id":"2606.18451","last_updated":"2026-06-16T20:00:12Z","snapshot_observed_at":"2026-08-12T23:35:07.018769Z","submitted_at":"2026-06-16T20:00:12Z","title":"A Cross-Model VLM-Judge Protocol for Single-Image 3D Mesh Quality (and Why Cheap Proxies Fall Short)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T00:54:57.489186Z"},"links":{"cited_paper":"/paper/2507.00006","citing_paper":"/paper/2606.18451"},"observation_digest":"sha256:84a8eecaef442b3c751058dce325e5137f94780c69e828c2a085dce263e1623d","observation_id":"fb32d20a-9f3b-4313-b653-f6660b17cede","resolution":{"observed_at":"2026-07-03T21:08:58.162599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00006/citation-record","integrity":"/paper/2507.00006/integrity","json":"/paper/2507.00006/citation-record.json","paper":"/paper/2507.00006"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:09.646944Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.646944Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4b0838d9db3c1122084e0460b01997c5a6c3f6d101b7aeb79920a229ff75fb3d","observation_id":"07f5a463-5017-4027-98f8-b203e4503215","resolution":{"observed_at":"2026-08-07T04:52:09.646944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:09.651465Z","title":"Stable zero123: Quality 3d object generation from single images.https://stability.ai/news/ stable-zero123-3d-generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.651465Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:588fdc570b0de52ecf706477fe7f7493f0522abde5caeaf2c8ed235698602da5","observation_id":"bcd34ac6-ca35-4af0-a50e-1986596537a1","resolution":{"observed_at":"2026-08-07T04:52:09.651465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:09.655543Z","title":"Met3r: Measur- ing multi-view consistency in generated images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.655543Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:c95ecd1b7ae730cfcd93f9add2efc563d0b2ea9a07a8ce963fa5a043c3823931","observation_id":"73ba107a-8723-4395-8aa7-be61328c9ed8","resolution":{"observed_at":"2026-08-07T04:52:09.655543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:16.280656Z","title":"Ten years of pedestrian detection, what have we learned?, 2014","venue":null,"work_id":"b6ffb878-00ee-4472-b14c-e4a2c541de8b","year":2014},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.659140Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:0e6321e62b3cf62bec7a5e66d64b09973ea04011a05cc1f5b78bfac00022a1d1","observation_id":"670b4cc8-a381-46f5-bb69-90a11c1eab0a","resolution":{"observed_at":"2026-08-07T04:52:16.333368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:16.153127Z","title":"Behave: Dataset and method for tracking human object inter- actions","venue":null,"work_id":"fd908714-e72d-4708-958d-e8652a6d3664","year":2022},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.662915Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1c87dd13c32d945a182c7d192819c919e7c9e61f7b3ea0293d4aca4d57c9bb56","observation_id":"bd4c3477-c936-4663-a948-8cde9b75d5ff","resolution":{"observed_at":"2026-08-07T04:52:16.195302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:16.031442Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"11e66659-f623-421a-8864-6d32901827a4","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.666711Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:0d6b2c1256b1c38806b5ac29f60bfc6d7fb45aa2086599ebddcb5bd303cd87e5","observation_id":"6666a457-195d-4002-9b35-e5e7170a5c89","resolution":{"observed_at":"2026-08-07T04:52:16.081643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-13T13:10:50.058243Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-07T04:52:09.670357Z","title":"Muse: Text-to-image generation via masked generative transformers.arXiv preprint arXiv:2301.00704,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.670357Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:bf95dec809e1d3cdc470be82b8ca7aa7c400dfec49170c76acce203321d526b5","observation_id":"e8f6cd43-d7dc-455d-a05e-11b2a34633df","resolution":{"observed_at":"2026-08-07T04:52:09.670357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T04:52:09.674558Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test- time scaling.arXiv preprint arXiv:2412.05271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.674558Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:17ffeeed6bd8a8d97590e537a39aaff108d990f896974863b1b751ac99a3c247","observation_id":"005f3a97-b634-4d49-a3f3-1e84a622873a","resolution":{"observed_at":"2026-08-07T04:52:09.674558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06738","last_updated":"2024-03-11T14:03:36Z","snapshot_observed_at":"2026-08-13T00:57:37.478128Z","submitted_at":"2024-03-11T14:03:36Z","title":"V3D: Video Diffusion Models are Effective 3D Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06738","snapshot_observed_at":"2026-08-07T04:52:09.678640Z","title":"V3d: Video diffusion models are effective 3d generators.arXiv preprint arXiv:2403.06738, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.678640Z"},"links":{"cited_paper":"/paper/2403.06738","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:e5e95fbad7a3b0616eeffef06d5649e24b4dc26cc380056b52543f224ec8290d","observation_id":"259b884b-2e60-46b3-9f00-db1fbb1f1000","resolution":{"observed_at":"2026-08-07T04:52:09.678640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-08-13T22:05:34.844117Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-07T04:52:09.682346Z","title":"Llamagen: Autoregressive large language models for visual image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.682346Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:576c28be0b212363a9e405e63f7c196363218163f9abee0c52c07190691b33f8","observation_id":"7c46d6ce-8498-401d-93ac-83103b63b85e","resolution":{"observed_at":"2026-08-07T04:52:09.682346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.937710Z","title":"Objaverse-XL: A universe of 10m+ 3d objects","venue":null,"work_id":"e393f2d3-1fa1-4cf5-b150-da62d72388e1","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.686138Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4b5beb0fefccf5f5828d2f0c4a1b6cc15e3168dfe48ef2c4b416131d4b3aaaf8","observation_id":"cead39f2-d64e-43fd-877c-3cf04050f09d","resolution":{"observed_at":"2026-08-07T04:52:15.993385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.821897Z","title":"McHugh, and Vincent Vanhoucke","venue":null,"work_id":"1e161bcf-957e-41dc-ae50-4d5c7d070ef9","year":2022},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.689613Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:eff0d72126674c774af53f012b2cb1feef62d0b0610e8019d3ea0f7a3c6736b5","observation_id":"e13e1114-0a89-4428-b1dc-6184f7e25c80","resolution":{"observed_at":"2026-08-07T04:52:15.866177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.703695Z","title":"Stable-edit: Text-based real image editing with stable diffusion models.https://github.com/ feizc/Stable-Edit, 2023","venue":null,"work_id":"d84403ef-00e4-4aba-9fa2-1d7e2d09896b","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.693112Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:14e1870151f1fe56743d01e14df6c381c19d9390fff43406b241cb7dca31b69d","observation_id":"538b89ea-e8ef-41a8-a494-0f142d705270","resolution":{"observed_at":"2026-08-07T04:52:15.749624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-08-14T17:36:27.918731Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-07T04:52:09.696118Z","title":"Barron, and Ben Poole","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.696118Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:6b1775ba8756227bb12d6d3a72f729c84637cc92ce16efc8bed577fd0cc307e4","observation_id":"98609474-f84f-4067-b4b2-9778b3d0d8fd","resolution":{"observed_at":"2026-08-07T04:52:09.696118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06614","last_updated":"2024-12-09T16:05:31Z","snapshot_observed_at":"2026-08-11T20:40:12.370722Z","submitted_at":"2024-12-09T16:05:31Z","title":"MVReward: Better Aligning and Evaluating Multi-View Diffusion Models with Human Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06614","snapshot_observed_at":"2026-08-07T04:52:09.699469Z","title":"Barron, and Ben Poole","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.699469Z"},"links":{"cited_paper":"/paper/2412.06614","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:d984b63564f88be899b848b7492cdabdb683eb00b7054714408460f1db6b811a","observation_id":"c62bcaa6-d113-4ac6-a4a3-27d880c76c30","resolution":{"observed_at":"2026-08-07T04:52:09.699469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.561482Z","title":"Bop: Benchmark for 6d object pose esti- mation, 2018","venue":null,"work_id":"1b15b7a8-486c-4f22-84ca-61b0fe97d756","year":2018},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.702791Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:5b1ea48dced8ceb3b7812cdf31dfecca1ec651c2fcd209bcb4f5658fbaf68b92","observation_id":"03b5924c-2345-480c-874c-1f1c97a482b5","resolution":{"observed_at":"2026-08-07T04:52:15.642159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.413974Z","title":"MVD-Fusion: Single-view 3D via Depth- consistent Multi-view Generation","venue":null,"work_id":"8dcb3eea-3d35-45aa-93a5-25c32c1514b8","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.705909Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:8da5f549dd8f426ddf8ac34efc31dc76d8735a022acbad82e2ca6882f9a4bd70","observation_id":"8d05ba7c-1305-456d-8180-f064355e35e8","resolution":{"observed_at":"2026-08-07T04:52:15.501622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.271737Z","title":"Turbo3d: Ultra-fast text-to-3d generation, 2024","venue":null,"work_id":"436c5000-97ea-4c24-a377-0e0d59f2e879","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.709327Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:c3eebfc67d7fcee9f2f6cf4216612ee333ef516c6fb51ccb7fde53e50160d896","observation_id":"4f4fd9e5-0efd-445d-9717-349f65904318","resolution":{"observed_at":"2026-08-07T04:52:15.360501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.138192Z","title":"2d gaussian splatting for geometrically accu- rate radiance fields","venue":null,"work_id":"deb51c61-1749-4f2d-b187-7136e41e0fbe","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.712480Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:369131ab71b1ed65fd286e4f6fecf06d88926b054017b48cd7df7d22815c50a5","observation_id":"0e7479ef-5ddf-4c76-a54b-6f6542db6b5a","resolution":{"observed_at":"2026-08-07T04:52:15.198373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:15.008363Z","title":"TeCH: Text-guided Reconstruction of Lifelike Clothed Humans","venue":null,"work_id":"45f65dce-22f2-4544-9396-ce4edc1c415b","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.715361Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:effe4215cb574188e75bad2d72215927449b6e0e5343fa38779c20270dde06df","observation_id":"fb38016d-5362-4aed-ac47-7d4315996eba","resolution":{"observed_at":"2026-08-07T04:52:15.077257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.852655Z","title":"EpiDiff: Enhancing Multi- View Synthesis via Localized Epipolar-Constrained Diffu- sion","venue":null,"work_id":"4c185f32-6857-44da-b1f6-31413e683b4c","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.718365Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:379bc16fb91d595d7432620e5d573e2c9e391077250828e1db5f8e0016e2a64b","observation_id":"087157cf-71c2-48a3-85c2-66aa2981ccce","resolution":{"observed_at":"2026-08-07T04:52:14.920282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03632","last_updated":"2024-12-04T18:48:20Z","snapshot_observed_at":"2026-08-12T16:39:36.574010Z","submitted_at":"2024-12-04T18:48:20Z","title":"MV-Adapter: Multi-view Consistent Image Generation Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03632","snapshot_observed_at":"2026-08-07T04:52:09.721506Z","title":"Mv-adapter: Multi-view consistent image generation made easy.arXiv preprint arXiv:2412.03632, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.721506Z"},"links":{"cited_paper":"/paper/2412.03632","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:82a6ea4820d3b1315ae75b56b4e38e1f1da5b1d332814513c938bf58a0f09c5f","observation_id":"0e6ed58c-8801-4987-8cae-0b6bac3ae97e","resolution":{"observed_at":"2026-08-07T04:52:09.721506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.734251Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"ed30568c-c2f1-4fa6-9934-59bdfd2cb8ac","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.724777Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:69f614601890a031086c99028dce491cb0949190a4bd420d7afaa1353665ebc3","observation_id":"0375ac5d-5b64-440c-a248-9f13531cefe7","resolution":{"observed_at":"2026-08-07T04:52:14.792697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.571005Z","title":"Re- thinking fid: Towards a better evaluation metric for image generation","venue":null,"work_id":"b7e7fc6d-28b7-4238-a98c-ecc6662fa172","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.727987Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:571130541c895840f5f533eaa699d85fb66912cc90bd7a86e85cca9aa9a12d8c","observation_id":"11f7a9cf-0d8a-4607-bdc0-b409369d6bb1","resolution":{"observed_at":"2026-08-07T04:52:14.624539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.469940Z","title":"NVS-Adapter: Plug-and-Play Novel View Syn- thesis from a Single Image, 2024","venue":null,"work_id":"1c605a48-0502-402e-bb8f-a3e88787b568","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.731292Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:7fc1216c962d14d67655b4b1bb567866cc7a00f2e1af961d5d60bfe255df29b8","observation_id":"9cab5f26-9bda-458a-bf33-aa419ed0c4bc","resolution":{"observed_at":"2026-08-07T04:52:14.524507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.337740Z","title":"SPAD: Spatially Aware Multi-View Diffusers","venue":null,"work_id":"c4cc9f0c-882d-4808-90df-e3bef8935bc5","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.734290Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:0db0bc587a52f66d365bb28e24e8838261b83e212df6dd5a735e2a3b23b0c3c5","observation_id":"3cca4f19-daa1-4749-ba32-6e3f570bb49e","resolution":{"observed_at":"2026-08-07T04:52:14.395498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.216137Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics, 42 (4), 2023","venue":null,"work_id":"12e9b178-d3ca-4f2f-90a6-7e2f8706a966","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.738088Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:e212925701c24c31dbcb31710024c20d30235b2364acdcd07cbd3cef4632c574","observation_id":"a626a081-26ec-49f5-8a0e-f3338a8cba3d","resolution":{"observed_at":"2026-08-07T04:52:14.295274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:14.089112Z","title":"EscherNet: A Generative Model for Scalable View Synthesis","venue":null,"work_id":"601e868e-947d-4a9b-bacc-b75909a0a667","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.741188Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:e632bf9306bbeea8ff620278567d7c0aaf766ac2d6f5522b4d03a4fd151ce4a7","observation_id":"d987eec7-311b-4b1a-96b2-4f71aab75c4f","resolution":{"observed_at":"2026-08-07T04:52:14.142232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.928084Z","title":"Imagenhub: Standardiz- ing the evaluation of conditional image generation models","venue":null,"work_id":"15834a24-df37-4156-9aeb-82999cc2d748","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.744233Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1e2fb18fe6d47c6829ef40c3889185fb3ed49ac5b1914e8b56863d76d744ddb2","observation_id":"a668254a-5a51-4fee-b73d-efeac63360c5","resolution":{"observed_at":"2026-08-07T04:52:14.000971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.788309Z","title":"ViVid-1-to-3: Novel View Synthesis with Video Diffusion Models","venue":null,"work_id":"fbafae20-20b5-4fe2-a668-800a1297c688","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.747245Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:87c0de179d344ed387ec910afa932f181dd2e4c0eff0f9016a2ad893dc34edff","observation_id":"356b43e8-c7a0-48a0-9ca0-ab786857543e","resolution":{"observed_at":"2026-08-07T04:52:13.858495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.646244Z","title":"Nvcomposer: Boosting generative novel view synthesis with multiple sparse and unposed images, 2024","venue":null,"work_id":"73727f1a-7f23-40e4-a724-7af3e515ae68","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.750406Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:08dfe0c2a4d53d060b9183087ca2d6ea2b02a7cdbd077f6a23f19c6e63074e2e","observation_id":"14bf7651-0e7a-448f-b7cb-d20986a55cda","resolution":{"observed_at":"2026-08-07T04:52:13.738195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11616","last_updated":"2024-11-27T15:01:08Z","snapshot_observed_at":"2026-08-14T03:10:58.503119Z","submitted_at":"2024-05-19T17:13:16Z","title":"Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11616","snapshot_observed_at":"2026-08-07T04:52:09.753634Z","title":"Era3d: High-resolution multiview diffusion using efficient row-wise attention.arXiv preprint arXiv:2405.11616, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.753634Z"},"links":{"cited_paper":"/paper/2405.11616","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:d0cfdb7d2c71ca145bfe26408731c4257df1750ae3df6f834e0ef6aba7aa5fb7","observation_id":"ce0e91ef-158e-43e9-9cfc-29f202a77391","resolution":{"observed_at":"2026-08-07T04:52:09.753634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.490991Z","title":"Evaluation of text-to-video generation models: A dy- namics perspective.Advances in Neural Information Pro- cessing Systems, 37:109790–109816, 2024","venue":null,"work_id":"6f6d2ff8-b790-4eda-bfc2-eaf32ffe0d6e","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.757342Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:016d32e955a9b8696edd36123404b8cfb94bf3bb69f6aaa7c4c5364923677c4d","observation_id":"d8307f31-22ea-4072-b617-624e62537a44","resolution":{"observed_at":"2026-08-07T04:52:13.525261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.355051Z","title":null,"venue":null,"work_id":"afe32532-33c6-4d7a-8ea6-f8c02f511632","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.760544Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:59f3bcbd6ae6b189fd9381f16a61b7f0ee217a58c440c780264a72e487629b19","observation_id":"aa8011e9-cd77-465a-807f-49295eba958d","resolution":{"observed_at":"2026-08-07T04:52:13.395020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.225995Z","title":"Stylerf: Zero-shot 3d style transfer of neural radiance fields","venue":null,"work_id":"c5ad2bbb-5177-4cff-bbec-b6a297e9e939","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.763883Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:b2b5bfd0f856b8cff210854470af3157f68724859041befd7b5c6d7bc99b6341","observation_id":"4aa29018-1af6-4bae-a609-701f8d552568","resolution":{"observed_at":"2026-08-07T04:52:13.307798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.106180Z","title":"One-2-3-45: Any Single Im- age to 3D Mesh in 45 Seconds without Per-Shape Optimiza- tion","venue":null,"work_id":"04de5c8b-babc-4480-9327-e03a3d5d308e","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.767008Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:b0ac3189e87e57acf304f2eb13e71618358f5ef5e06407a3f5015764a53f71c6","observation_id":"ff6e5c52-2520-42df-ab38-29ae10dadb34","resolution":{"observed_at":"2026-08-07T04:52:13.157230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:13.029571Z","title":"Zero-1-to-3: Zero-shot one image to 3d object, 2023","venue":null,"work_id":"408f95c5-fdd6-4e33-8333-6ca940ade436","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.770064Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:a33af74dae9b2d4933710093caa2c8e1b6253cce8cda13b4816f8db60e608432","observation_id":"29a15dc2-dc23-4864-9473-f8615db6d384","resolution":{"observed_at":"2026-08-07T04:52:13.085464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-07T04:52:09.773092Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age.arXiv preprint arXiv:2309.03453, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.773092Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:c20863257f135f016237e00e410d4dc93d1a0a7c860c63b3aee79c81107fe51c","observation_id":"96c411e3-cb43-42ed-9506-1aa433a61ff0","resolution":{"observed_at":"2026-08-07T04:52:09.773092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15008","last_updated":"2023-11-08T16:50:08Z","snapshot_observed_at":"2026-08-13T05:43:03.738000Z","submitted_at":"2023-10-23T15:02:23Z","title":"Wonder3D: Single Image to 3D using Cross-Domain Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15008","snapshot_observed_at":"2026-08-07T04:52:09.776354Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion.arXiv preprint arXiv:2310.15008, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.776354Z"},"links":{"cited_paper":"/paper/2310.15008","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:d2856614199596710ff79ba24174f1681d89497ce8bd329095b6c33efd069d8e","observation_id":"f76af625-eb5f-4fa7-918f-1a87fbb6f14a","resolution":{"observed_at":"2026-08-07T04:52:09.776354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.883465Z","title":"Direct2.5: Diverse text-to-3d generation via multi-view 2.5d diffusion.Computer Vision and Pattern Recognition (CVPR), 2024","venue":null,"work_id":"40ade0a5-bab8-478a-90f6-24c7eecea11e","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.779651Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:574b4049377075cf3538db1ed6b1efbac9b6512fd0e59b37c8a5f3e61c245a23","observation_id":"3f5c1d3d-a0f7-464b-90a8-0da21d4a60a6","resolution":{"observed_at":"2026-08-07T04:52:12.941074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.769200Z","title":"Taming 3dgs: High-quality radiance fields with limited resources","venue":null,"work_id":"4a305c98-c3fd-4909-8de8-76be79005c23","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.782769Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:2619140cd596347d2ba0f4b9bee017c4cf5f5c5c222184e745b88325ca1ae7f3","observation_id":"6431dcbc-9ea4-4218-af09-bb19a203ec9d","resolution":{"observed_at":"2026-08-07T04:52:12.805101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.638927Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":"8572c119-f161-4931-84f8-17fe8456d619","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.785999Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:98801e3c6947a4a2bd7ce94ace8159dc2aef4a5a7e258536cc00b12a176dd9c7","observation_id":"a9cd3ca1-d5d9-4a36-a55b-e12c2fad14bd","resolution":{"observed_at":"2026-08-07T04:52:12.679596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:09.789142Z","title":"Barron, and Ben Milden- hall","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.789142Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:18ae7e6ff0b9d69bf64eee37f83f86dd60d4498d44bf54a69497840625712f69","observation_id":"3cc043e4-7a97-4516-af77-0f3a3dc3db06","resolution":{"observed_at":"2026-08-07T04:52:09.789142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.536449Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0893f903-641c-4069-af55-d1a2408b97c7","year":2021},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.792374Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4d297277729469ec14c64c91ff27ffbd5e6b209408ae28470961879137da9f10","observation_id":"52a8560c-7913-4209-8e26-68f87cd61309","resolution":{"observed_at":"2026-08-07T04:52:12.592403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.447810Z","title":"Com- mon objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"442bee22-caa7-4566-a372-146042e0125f","year":2021},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.795648Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:c8e24739b68cb1ac37cc707cd4b8f025a85f13e5820bdba19e880d5df0caa5e5","observation_id":"450b60b1-2c2a-46fe-9af6-594c35db8076","resolution":{"observed_at":"2026-08-07T04:52:12.496250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.363773Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":"2132b923-241c-49c1-8cd7-ba73d58cc103","year":2021},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.799008Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:3186ea773312093bb44dcd95b9c33e7832b5187e50cd65bd9f752dc81d6adfbb","observation_id":"fcd27e52-1447-4323-ab09-616e431ae853","resolution":{"observed_at":"2026-08-07T04:52:12.398911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.279271Z","title":"Stable diffusion 3.5: High- resolution image synthesis with latent diffusion models.Sta- bility AI, 2024","venue":null,"work_id":"513fc47f-5f85-4e68-a6d3-1263aa71ff26","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.802102Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:cb80e2776abb3f0514edeb8ed68c1f3c15787a2926c72df02929bf44d5288786","observation_id":"bfda15ec-31e6-48f0-bacb-3d0e45f248c7","resolution":{"observed_at":"2026-08-07T04:52:12.320946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.230002Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model, 2023","venue":null,"work_id":"890b5b08-df60-448d-b4a9-635aba36263d","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.805449Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:12b60a8df2fd6bb1fe26627ee944b932089e9efb87a5a535b548fa17ea07fe80","observation_id":"623a4dd5-9200-4af5-a902-587c876a1f95","resolution":{"observed_at":"2026-08-07T04:52:12.250246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-14T19:33:54.756989Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-07T04:52:09.808682Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration.arXiv:2308.16512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.808682Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:05afc8ec6434d03a9ebe63efc97241e2fab08a2f4eeb749ff14e47904151fbe0","observation_id":"3b15a5e3-5a06-49b0-b33c-f6ea7814e8f7","resolution":{"observed_at":"2026-08-07T04:52:09.808682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14435","last_updated":"2024-04-07T18:04:04Z","snapshot_observed_at":"2026-08-13T11:09:35.760655Z","submitted_at":"2023-06-26T06:04:09Z","title":"DragDiffusion: Harnessing Diffusion Models for Interactive Point-based Image Editing","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14435","snapshot_observed_at":"2026-08-07T04:52:09.812158Z","title":"Dragdiffusion: Harnessing diffu- sion models for interactive point-based image editing.arXiv preprint arXiv:2306.14435, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.812158Z"},"links":{"cited_paper":"/paper/2306.14435","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1b9bc7d1492eecebbc7738293bc6482e192cc81757ca8cf0e0f4b308aa7eac51","observation_id":"6c0ac041-8d5a-4234-bfd8-7cfac9729f00","resolution":{"observed_at":"2026-08-07T04:52:09.812158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.144046Z","title":null,"venue":null,"work_id":"db4e53d2-1f38-4560-8386-6d72e308ebd2","year":2010},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.815698Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:310f198f552c4eff623724d94489585628aca7cee7a66baa89b3c8e76658477a","observation_id":"6ff5f4fd-08c7-48cb-9bdf-06843f543fee","resolution":{"observed_at":"2026-08-07T04:52:12.183406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05054","last_updated":"2024-02-07T17:57:03Z","snapshot_observed_at":"2026-08-13T04:24:03.548014Z","submitted_at":"2024-02-07T17:57:03Z","title":"LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05054","snapshot_observed_at":"2026-08-07T04:52:09.818903Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation.arXiv preprint arXiv:2402.05054, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.818903Z"},"links":{"cited_paper":"/paper/2402.05054","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:8b8343942e87db75d730557645a8e138d8c335531fe7c732eb38a321a2cde2a9","observation_id":"a4baefa7-6a03-4357-8ebb-ca21f60aff70","resolution":{"observed_at":"2026-08-07T04:52:09.818903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:12.069523Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":"56af3079-c27a-46c5-b3c5-4cf0dbc7a027","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.822473Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1a7e03d1f70646072905f3233a1a4ad8ab189a03b898995c30f929ffe51fc701","observation_id":"18734df5-21af-4423-b611-b1de76025f01","resolution":{"observed_at":"2026-08-07T04:52:12.093788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.977948Z","title":"SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using La- tent Video Diffusion, 2024","venue":null,"work_id":"b0e65c2d-db3c-4443-ba42-79cb11c7456d","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.825753Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:616e942adda8f8da84338e92b175d65d9873c5299c8717f738c40fb6cea41790","observation_id":"757d9280-66da-4579-b2a4-2662484b9058","resolution":{"observed_at":"2026-08-07T04:52:12.022023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07015","last_updated":"2024-06-28T17:14:13Z","snapshot_observed_at":"2026-08-13T11:44:15.816952Z","submitted_at":"2023-05-11T17:55:25Z","title":"Exploiting Diffusion Prior for Real-World Image Super-Resolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07015","snapshot_observed_at":"2026-08-07T04:52:09.828918Z","title":"Exploiting diffusion prior for real-world image super-resolution.arXiv preprint arXiv:2305.07015, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.828918Z"},"links":{"cited_paper":"/paper/2305.07015","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:223bda6d284b8cc38856aa87b88e2a92e89e38555b7aeb25415b6816b2373636","observation_id":"3063b065-80ae-431c-99fe-b3de3affb767","resolution":{"observed_at":"2026-08-07T04:52:09.828918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-13T05:11:47.980346Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-07T04:52:09.832371Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation.arXiv preprint arXiv:2312.02201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.832371Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:ae0e08b3c9a2630ad48c63004feb254ed0b066428546f302fa4e54caedc91326","observation_id":"5dbbb5b0-97ab-4c2e-93cf-71a65e1a0a76","resolution":{"observed_at":"2026-08-07T04:52:09.832371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16213","last_updated":"2023-11-22T07:34:38Z","snapshot_observed_at":"2026-08-14T12:46:11.893653Z","submitted_at":"2023-05-25T16:19:18Z","title":"ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16213","snapshot_observed_at":"2026-08-07T04:52:09.835866Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distilla- tion.arXiv preprint arXiv:2305.16213, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.835866Z"},"links":{"cited_paper":"/paper/2305.16213","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:3a485fef0a162d305189a97b08c856a8f3e31ea356c3e6b5085137a37422ce34","observation_id":"bb30b1cb-b8af-4a00-be0f-e100caf1e709","resolution":{"observed_at":"2026-08-07T04:52:09.835866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.912339Z","title":"Novel View Synthesis with Diffusion Models,","venue":null,"work_id":"f477985a-23bf-43d3-83ac-4493ff075119","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.839385Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:afa5418e68ab247d4e080282e657d9a8dece87f27580533bbccd6bbb14ed2040","observation_id":"b641f6fa-3065-4124-84a1-8f8940de0515","resolution":{"observed_at":"2026-08-07T04:52:11.941707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00808","last_updated":"2023-01-02T18:59:31Z","snapshot_observed_at":"2026-08-13T13:10:44.128375Z","submitted_at":"2023-01-02T18:59:31Z","title":"ConvNeXt V2: Co-designing and Scaling ConvNets with Masked Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00808","snapshot_observed_at":"2026-08-07T04:52:09.842949Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders.arXiv preprint arXiv:2301.00808, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.842949Z"},"links":{"cited_paper":"/paper/2301.00808","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:bc67260029a2b00b1f10d2055a7efa415dd54a2b5f97f97a691c5d7f501e2713","observation_id":"d6bbc16f-a727-4250-a1f4-4c74e3d8f231","resolution":{"observed_at":"2026-08-07T04:52:09.842949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.822316Z","title":"Direct and explicit 3d generation from a single image, 2024","venue":null,"work_id":"761accaa-2e63-4b31-810d-d850c06071d9","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.846303Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:6df58a22bf991e0d0f6f533507de3480dc28e66eb2eacd977e1eee5af87c5a17","observation_id":"2e7b8d2f-22e0-413c-a415-390573312455","resolution":{"observed_at":"2026-08-07T04:52:11.863510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.770784Z","title":"Direct and Explicit 3D Generation from a Single Image,","venue":null,"work_id":"2f9aa540-75da-4a9d-a65d-35fd7fa52bbe","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.849412Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:f7f6edca6c59007304f1fb10f01310bc5e059cf5cc83286025eb2bdc63ba8877","observation_id":"c5d91cb0-e327-4d7d-9416-8baf96ab28c7","resolution":{"observed_at":"2026-08-07T04:52:11.799702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08177","last_updated":"2024-10-24T12:32:10Z","snapshot_observed_at":"2026-08-13T00:24:01.213258Z","submitted_at":"2024-06-12T13:10:31Z","title":"One-Step Effective Diffusion Network for Real-World Image Super-Resolution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08177","snapshot_observed_at":"2026-08-07T04:52:09.852582Z","title":"One-step effective diffusion network for real-world image super-resolution.arXiv preprint arXiv:2406.08177, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.852582Z"},"links":{"cited_paper":"/paper/2406.08177","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:927a9b0b0fc61bf8d675141f0b71385ba299b3c37b20a170c3f549f88333714f","observation_id":"581c67f5-561b-4fc6-8546-2f7f96329e79","resolution":{"observed_at":"2026-08-07T04:52:09.852582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.660499Z","title":"Omniobject3d: Large-vocabulary 3d object dataset for realistic perception, reconstruction and generation","venue":null,"work_id":"950fbe26-324c-412c-a1f9-7ec97716c369","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.855997Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:ce429d1464bce450387a64c9c66dc053fbbf8c5dcb85b4625439a745f16fd1ed","observation_id":"1d5d7b8a-e8e2-4a8a-abcd-12b6f943b309","resolution":{"observed_at":"2026-08-07T04:52:11.701333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.577829Z","title":"Gpt- 4v(ision) is a human-aligned evaluator for text-to-3d genera- tion","venue":null,"work_id":"d9d2b4f7-381a-41ae-a831-393d5fb19e71","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.858951Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:5b564b8110993eb2a07cd4dcfa53526823b554fbfd29d2997cb5a3637d86c5d5","observation_id":"2d00a9ea-9850-43f2-9231-d8b072561aea","resolution":{"observed_at":"2026-08-07T04:52:11.623596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.486273Z","title":null,"venue":null,"work_id":"272ca072-dfdb-4487-9b66-11f836b2d675","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.862161Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:3396d969c93d3c7fdde8301275d4aa347800513b27c4f2db3489d7538b61f6cb","observation_id":"44a2b431-ba72-435f-84b9-c372032fe419","resolution":{"observed_at":"2026-08-07T04:52:11.525398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12190","last_updated":"2023-11-27T13:36:04Z","snapshot_observed_at":"2026-08-13T05:46:49.160520Z","submitted_at":"2023-10-18T14:42:16Z","title":"DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12190","snapshot_observed_at":"2026-08-07T04:52:09.865277Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors.arXiv preprint arXiv:2310.12190, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.865277Z"},"links":{"cited_paper":"/paper/2310.12190","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1ea3d090efa39f242c980aa93edecf09a452879bc37f721e0f23aba741e56957","observation_id":"d1489c1e-691b-4614-86c3-0d641f638c28","resolution":{"observed_at":"2026-08-07T04:52:09.865277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.396737Z","title":"CamCo: Camera- Controllable 3D-Consistent Image-to-Video Generation,","venue":null,"work_id":"f28d2ca5-ae11-4793-a3a1-de27cc737a12","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.868914Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4750c864ffc7292858b35a14b1ef3c9c492d1e2962abb7b08886e4980e426608","observation_id":"8a6e81b5-b1f5-45b8-b034-e4ea3d3eabba","resolution":{"observed_at":"2026-08-07T04:52:11.438073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.345407Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"693561c3-8cd3-44c4-abcc-845ca5d2e10e","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.872035Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:8a5c678d51590bfb396dc0fe2dcbb7a1e5956746cf6c4253aada90e747e6826f","observation_id":"ccf0ee6c-a93f-4c58-a0d3-999fa66bb047","resolution":{"observed_at":"2026-08-07T04:52:11.385790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-08-13T18:57:44.379289Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-07T04:52:09.875547Z","title":"Instantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruction models.arXiv preprint arXiv:2404.07191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.875547Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4cc8bed2523b3a3bc3808aea496febd46d3f5c500a0eee783d45051f64c98ab8","observation_id":"c671bd5d-f928-46cd-bd47-fb6494221f90","resolution":{"observed_at":"2026-08-07T04:52:09.875547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.212925Z","title":"Pons-Moll","venue":null,"work_id":"9a1de386-934d-4256-a023-eaa9224e5c3e","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.879656Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:db67e714c89e1a87b9311cc1ef0799f1ebbabcfbda503388081ca3817b535599","observation_id":"4e4585dc-c58a-4e32-b7a2-2e7d5575d75f","resolution":{"observed_at":"2026-08-07T04:52:11.278225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:11.060311Z","title":"Human 3diffusion: Realistic avatar creation via explicit 3d consistent diffusion models","venue":null,"work_id":"d3f38abf-4ec7-461f-89b1-3db93e2c5687","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.883043Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:f76d427f8169a239d15c3994e8419e924850c592ff998800893d160677e48ec2","observation_id":"dfa1ac66-f9b8-4a5f-8621-22cfb00fb023","resolution":{"observed_at":"2026-08-07T04:52:11.129402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.940508Z","title":"Hi3d: Pursuing high- resolution image-to-3d generation with video diffusion mod- els","venue":null,"work_id":"75888e5f-e756-401c-b67f-aea37bd3ce10","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.886560Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:c0fa9a3cadeae9eb4a44637502a2c91f97f05cdc935cbfaa6237ec7a71224019","observation_id":"2cb2042f-4034-400d-a5f2-031ddc129da9","resolution":{"observed_at":"2026-08-07T04:52:10.988577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14469","last_updated":"2024-07-09T14:18:01Z","snapshot_observed_at":"2026-08-13T10:25:53.136864Z","submitted_at":"2023-08-28T10:15:57Z","title":"Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14469","snapshot_observed_at":"2026-08-07T04:52:09.890080Z","title":"Pixel-aware stable diffusion for realistic image super-resolution and personalized stylization.arXiv preprint arXiv:2308.14469, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.890080Z"},"links":{"cited_paper":"/paper/2308.14469","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:2138786618fa8ae06a967112f80894ce774c076e74759a6af0af07594eefb3ed","observation_id":"a37b35df-19e9-401d-b99e-ab7feea9bc07","resolution":{"observed_at":"2026-08-07T04:52:09.890080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.799287Z","title":"ViewFusion: Towards Multi-View Consistency via Interpolated Denoising","venue":null,"work_id":"9ffb2db7-f129-4135-a565-f88d3cdfaed3","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.893860Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:9a19ec4fcad0629db97b8aef58f90eddb62a0b688c4cbeafa66661cae83843ef","observation_id":"c01b3e0f-8041-4d66-be67-f9998173d727","resolution":{"observed_at":"2026-08-07T04:52:10.855156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.651562Z","title":"Mvimgnet: A large-scale dataset of multi-view images","venue":null,"work_id":"ee0884b9-f0ed-43e0-89c9-9a95bdf02c55","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.897441Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:d730902438f5e3efaabf7305c0018e391f7420c9c0ff8d7e19a1773bc63da168","observation_id":"21ab38a3-16b1-4d93-8797-94ca4f500fef","resolution":{"observed_at":"2026-08-07T04:52:10.705759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.490757Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":"2b4cb41c-ed3e-4afc-94d1-28a685cc8cdb","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.900944Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:d9fca0d3c289adceee9e97aadc45992b55b49d1ccdcca9e5d3dfa9de7b52d659","observation_id":"30cd5c4f-1d09-4905-ab74-343b89edac5f","resolution":{"observed_at":"2026-08-07T04:52:10.551298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10772","last_updated":"2024-09-11T08:53:27Z","snapshot_observed_at":"2026-08-13T00:28:53.100737Z","submitted_at":"2024-04-16T17:57:19Z","title":"Gaussian Opacity Fields: Efficient Adaptive Surface Reconstruction in Unbounded Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10772","snapshot_observed_at":"2026-08-07T04:52:09.904581Z","title":"Gaussian opacity fields: Efficient high-quality compact surface recon- struction in unbounded scenes.arXiv:2404.10772, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.904581Z"},"links":{"cited_paper":"/paper/2404.10772","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:a67d33fd65502682ff0c3a2df24113d033cc3025e3994527f7b1435fe33f0132","observation_id":"89eb2374-384a-4aa0-b34d-2915985249d0","resolution":{"observed_at":"2026-08-07T04:52:09.904581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-14T19:07:37.876970Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-07T04:52:09.908083Z","title":"Adding conditional control to text-to-image diffusion models.arXiv preprint arXiv:2302.05543, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.908083Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:6557aef378258b202322578c1898ff6a24766dc4baebe317e9e84e5a27532a79","observation_id":"3c3a7a24-0d06-4d5d-85bc-d7f4ac5714d9","resolution":{"observed_at":"2026-08-07T04:52:09.908083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.361532Z","title":"Diffcollage: Parallel generation of large content with diffusion models","venue":null,"work_id":"40e6a8ff-ef1f-462b-8236-09cdec025a12","year":2023},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.911635Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:daf7f7418af9dc2f990da67522d7423008fddf8138b4705d08689a2923c86e3b","observation_id":"c3749e16-4b46-4bde-95da-7fa30fe20c55","resolution":{"observed_at":"2026-08-07T04:52:10.400823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.250627Z","title":"Free3D: Consis- tent Novel View Synthesis Without 3D Representation","venue":null,"work_id":"dcd1f0a6-5a65-45a1-ae2b-9846e884064b","year":2024},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.914897Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:1994a8330817a0a01f59c04d0f2b706a7a31866b694b696371619e9d9a11521c","observation_id":"cb396a53-5c5f-4c99-955b-48bda98cfde1","resolution":{"observed_at":"2026-08-07T04:52:10.306310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.203790Z","title":"What is the main color(s) of this object? simply answer the color(s), summarize to less than 4 colors","venue":null,"work_id":"c2213b9f-f37f-433c-8447-0eda2867f65c","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.918159Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:e15c90d1e6b561e289b0fb52321c5d7020a791cbade02484a8b3867f9b4d1bc7","observation_id":"9d22cab8-edfc-4106-a008-f20df7948df5","resolution":{"observed_at":"2026-08-07T04:52:10.209316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.185019Z","title":"6 (GSO [12]), Tab","venue":null,"work_id":"3ea54276-75ae-4a6a-b200-fbe99cabad8a","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.921716Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:9676b259bd17bcc131efb6343f7481762b907d24c76d5c23f5a49fbf13844ea7","observation_id":"860b3992-1b4d-4081-ac05-1fa9928cc169","resolution":{"observed_at":"2026-08-07T04:52:10.191905Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:52:10.163601Z","title":"Despite robust to various settings, there are still limita- tions of our benchmark","venue":null,"work_id":"3032ef60-bb5d-49f8-ad5a-3392175fa8ab","year":null},"citing_paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:09.925374Z"},"links":{"citing_paper":"/paper/2507.00006"},"observation_digest":"sha256:4c243943595e8bb136dd6d35332b7eb3815d1672e3d7c8e8d0038fdafbd8f887","observation_id":"ce03becb-ce71-45c7-9176-e05e2c6bc21d","resolution":{"observed_at":"2026-08-07T04:52:10.173704Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.00006","last_updated":"2025-06-11T08:02:40Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-14T05:06:51.012921Z","submitted_at":"2025-06-11T08:02:40Z","title":"MVGBench: Comprehensive Benchmark for Multi-view Generation Models"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 2 inbound Pith citation observations for arXiv:2507.00006."}