{"as_of":"2026-08-14T14:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca364358e70e5810d39fde5243e78663d760c2e4068f5b1656d7e7fac3eae06d","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:45:45.014848Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:45:40.424131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07410","snapshot_observed_at":"2026-08-01T09:45:40.424131Z","title":"arXiv preprint arXiv:2507.07410 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20660","last_updated":"2026-07-22T18:38:20Z","snapshot_observed_at":"2026-08-06T14:13:50.227938Z","submitted_at":"2026-07-22T18:38:20Z","title":"Axolotl3D: a Unified Framework for Faithful 3D Shape Completion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T09:45:40.424131Z"},"links":{"cited_paper":"/paper/2507.07410","citing_paper":"/paper/2607.20660"},"observation_digest":"sha256:01c52262cb93c25e61d64695b0ad2879d0420ff14c7395bf41d1f250b0e456f9","observation_id":"38d9f368-78df-4ff9-839e-9bb281f875f2","resolution":{"observed_at":"2026-08-01T09:45:40.424131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07410/citation-record","integrity":"/paper/2507.07410/integrity","json":"/paper/2507.07410/citation-record.json","paper":"/paper/2507.07410"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.876742Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"78d35cf4-cf3a-4d7f-bf01-1560e9e3a9aa","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.737640Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:11604555405d0c76595b6238abf6d3b76844ae8f57543b7b1150041d9540f3e0","observation_id":"5982a2d7-50eb-4d66-9d12-0cf6949dfa4d","resolution":{"observed_at":"2026-08-06T18:45:45.880363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.865484Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"33c3f851-51b8-43c6-8789-f0441ee5fe8d","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.741950Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:0b2911bf56615c0ce9ac1f7a5b5a43bbcbc641754c2d000b108cd4e998131044","observation_id":"251c4f17-0142-4acc-9c35-a9a45339c8be","resolution":{"observed_at":"2026-08-06T18:45:45.869350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.853628Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"5eb2c677-e850-4834-bd94-b1aabf664356","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.745291Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:d651c7bf6c03053816225bcdffa15739024c4bff2fa6eb687504b33ce884fb7f","observation_id":"62c2b497-f1d0-49c4-9848-cdf56d1bcd24","resolution":{"observed_at":"2026-08-06T18:45:45.857619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03421","last_updated":"2025-03-31T13:42:34Z","snapshot_observed_at":"2026-08-13T00:37:46.079900Z","submitted_at":"2024-04-04T12:58:46Z","title":"Gen3DSR: Generalizable 3D Scene Reconstruction via Divide and Conquer from a Single View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03421","snapshot_observed_at":"2026-08-06T18:45:44.748589Z","title":"General- izable 3d scene reconstruction via divide and conquer from a single view","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.748589Z"},"links":{"cited_paper":"/paper/2404.03421","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:72c309e1eb42ffe9bf42b32996c1ddcf48fe64b1aa552b5fa1dde9e404ae9020","observation_id":"5833b1a2-399c-4f07-bda2-afeed8348df6","resolution":{"observed_at":"2026-08-06T18:45:44.748589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.842921Z","title":"Google scanned objects: A high- quality dataset of 3d scanned household items","venue":null,"work_id":"8b16bb56-9fc1-4d28-baf2-0e314c644852","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.753526Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:89ecf0275cb30a94f13e9e174a4719df86acf4df9d7fa2ebcf7c78a2628489cb","observation_id":"e3f1d415-0126-48e2-82fa-f13d523de10b","resolution":{"observed_at":"2026-08-06T18:45:45.846383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-08-13T12:17:17.748027Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T18:45:44.758445Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.758445Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:ce5dc03b973f0d079d4c211a5e5c140ad8eccc90ba75acefbf84326664e2a353","observation_id":"bd805cc5-1ac4-4910-ac5d-10bdbab896af","resolution":{"observed_at":"2026-08-06T18:45:44.758445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.831023Z","title":"Instruct-nerf2nerf: Edit- ing 3d scenes with instructions","venue":null,"work_id":"da23d030-5d4e-4849-b1bd-c4fbaf555697","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.762441Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:72df64125086737285de7df67c3e546a49346ba39e76f27dc7a8ecccaf70dabd","observation_id":"afd1f6aa-543e-44eb-89f0-feb1814c5b0d","resolution":{"observed_at":"2026-08-06T18:45:45.835340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.765751Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.765751Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:2905d9f926f70a1ff3535abee2e3da8f8737b49fb978cf50d6205a5f2d957383","observation_id":"8a8d7fc6-fc16-44fe-804f-0db7d82f1b5b","resolution":{"observed_at":"2026-08-06T18:45:44.765751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.769404Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.769404Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b3cf10817d7450f036e0a9b46903d6a939e7cb69376da30844b5ed91272cdb71","observation_id":"6d4905c8-8c3c-4565-90e1-475d8ec35814","resolution":{"observed_at":"2026-08-06T18:45:44.769404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T18:45:44.772359Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.772359Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:2902165159d5295c31e8939e0bceda17f518745e15e36c3345e735cc21da6b9b","observation_id":"2b2d8f3f-13b2-4cb9-a797-4724f5d69e0c","resolution":{"observed_at":"2026-08-06T18:45:44.772359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.802463Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"4dcfc726-54ac-4a21-8e1d-db4fa462ce07","year":2020},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.776119Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:0267c5668efe0c4ead56fd0f8b943aeb3a11a033a9004ef90a496d8e9a04059b","observation_id":"00b41334-84db-47a9-9780-2470e0e1a713","resolution":{"observed_at":"2026-08-06T18:45:45.806326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-06T18:45:44.780179Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.780179Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:51803f85ef41b469bfd914eb566d083d04facccc069833f1a0f9ad79fe1c81eb","observation_id":"1c15f1fc-5998-4d31-bdec-dda7904d6f63","resolution":{"observed_at":"2026-08-06T18:45:44.780179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.789773Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":"966d8909-bff5-412d-b2fc-771cd9d2682e","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.784055Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:0c54d89bd09c2fd3cf26c4c700ffaf78bad413d7ae2492f856520240896cce70","observation_id":"833cfe3b-7b53-4389-b54c-846072044da6","resolution":{"observed_at":"2026-08-06T18:45:45.793939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.778300Z","title":"Shapo: Im- plicit representations for multi-object shape appearance and pose optimization","venue":null,"work_id":"e2861268-8fa0-4d57-9ce2-b6d7131345b0","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.787516Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:027cf7a26790de5465dbf2cdbc2be7387b026913cb25c4b5a1800f2b4fbf39ed","observation_id":"82a2841e-a228-4a39-8379-714411c8a512","resolution":{"observed_at":"2026-08-06T18:45:45.782398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.767323Z","title":"Neo 360: Neural fields for sparse view synthesis of outdoor scenes","venue":null,"work_id":"4bc3a0d8-85e6-42ce-8dde-bf8e0cd65ebb","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.792347Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:d2d548c4bad5888f901bce402401856f57e13b9386b0a542068f1ba1f34bbcb0","observation_id":"db567bd0-3909-4b67-ae03-d408bce8c8d9","resolution":{"observed_at":"2026-08-06T18:45:45.770944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20220","last_updated":"2024-10-26T16:26:41Z","snapshot_observed_at":"2026-08-12T22:14:37.372121Z","submitted_at":"2024-10-26T16:26:41Z","title":"Neural Fields in Robotics: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20220","snapshot_observed_at":"2026-08-06T18:45:44.796004Z","title":"Neural fields in robotics: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.796004Z"},"links":{"cited_paper":"/paper/2410.20220","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:06068af97bb36c0dfdfcc31fdc838059e925170af6a92df9a0461223b7107ef8","observation_id":"93f25457-0a35-4dff-ae5c-89ff509e9546","resolution":{"observed_at":"2026-08-06T18:45:44.796004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.753698Z","title":"Nerf-mae: Masked autoencoders for self-supervised 3d representation learning for neural radiance fields","venue":null,"work_id":"4880f4b3-7519-45d7-b657-9472ad1d18ed","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.799875Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:f8f58f521a71a2533ffaff744a7a52a5c18d12c2136502c9e8ee664046d80eaa","observation_id":"f650789f-9d06-4726-b1c9-365fa68b5c15","resolution":{"observed_at":"2026-08-06T18:45:45.759049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.737095Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":"43109d15-5930-4c6a-b466-93fc8e53d9d1","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.804322Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:c362e885218d5e2b42aa0fea489edcfcd4b51047e2c1b0f0cb0a10c00e67c376","observation_id":"4cfdf420-16ee-4556-976d-f52909d1b4c6","resolution":{"observed_at":"2026-08-06T18:45:45.742694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.808504Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.808504Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8ed0f60175362db835ca31893c8d569a05718ab2acd5e0ffe49147cfac3ad438","observation_id":"e52055cf-ab51-47cd-89ba-a9b0e6d0047d","resolution":{"observed_at":"2026-08-06T18:45:44.808504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.812264Z","title":"Lerf: Language embedded radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.812264Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:a73ad45e7d4efcb481654ef0714af74800f6d917bd9de0943d4c85f1edf682f3","observation_id":"67dd98b3-d29d-41a6-ae8e-465b5006deec","resolution":{"observed_at":"2026-08-06T18:45:44.812264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T18:45:44.816138Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.816138Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8086d35475624a7fb167c54040e819432264baad46b6c8195f235ca33ff4d24b","observation_id":"c96bbdc2-1997-40f0-a032-31a4b97db436","resolution":{"observed_at":"2026-08-06T18:45:44.816138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.819708Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.819708Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:5b245adc3646dce57c810d39236cfe4cdff0c4420fd0a2046564032b6b56c7d2","observation_id":"d3d6551b-20d8-420d-850c-0e3331a5da5a","resolution":{"observed_at":"2026-08-06T18:45:44.819708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.697297Z","title":"Eschernet: A genera- tive model for scalable view synthesis","venue":null,"work_id":"69a7c29e-d7a6-4ee8-afa3-35bbc04cefc4","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.823315Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:9727985bf1bee4986c99ac8a2f3832f8974e1587ce351c1867f7a9c9edb64ee2","observation_id":"4e328ef1-4a99-4bf6-bcc5-d1e90dab544b","resolution":{"observed_at":"2026-08-06T18:45:45.702308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.682613Z","title":"Neroic: Neural rendering of objects from online image collections","venue":null,"work_id":"592a7f40-57bc-41a0-8100-3716202eb83f","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.826638Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:375f2e1d439b2104002b5ccd6694e91cdb09c8df169f3a88d4c5c4e2c458708f","observation_id":"a71bf3f6-2aba-4c0c-9754-f84e19bdfe48","resolution":{"observed_at":"2026-08-06T18:45:45.686889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.670974Z","title":"Neural scene flow fields for space-time view synthesis of dy- namic scenes","venue":null,"work_id":"53bb92ca-05ab-4d1f-9904-7bf9b638b1e0","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.829825Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:6b58e52c46341c9ab313c370e977f7d26f620254e6f94cb932345e6f0f14660b","observation_id":"bb38538c-5f32-4949-a2eb-2893f4c97d0b","resolution":{"observed_at":"2026-08-06T18:45:45.674817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.658756Z","title":"Neuralangelo: High-fidelity neural surface reconstruction","venue":null,"work_id":"941a6417-d315-4c48-99cf-f3c625f762df","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.834161Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:58fe6f409e2bc6498378bf24bdf8f54027b21b69b58a58ce09e83dd2c5c3207b","observation_id":"d9231480-b492-4ffa-b2b0-a638f30453c9","resolution":{"observed_at":"2026-08-06T18:45:45.662905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.642770Z","title":"One-2-3-45++: Fast single im- age to 3d objects with consistent multi-view generation and 3d diffusion","venue":null,"work_id":"928d21b4-edaf-4527-9e81-f31d1c1d2a43","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.837981Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:98ce8d62997e3db41d932b99e92754d493ed7abb87eafd2ab425235f7d0d3b84","observation_id":"6a001eaa-48cf-4d1b-8530-c264a87694da","resolution":{"observed_at":"2026-08-06T18:45:45.646892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.628392Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":"a9ef8b6c-ad35-4d5e-85d1-79de280d696f","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.841875Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:bc0d3ac3025fe02b0c61e7940e7a9d470e6b303cd896b38d2702f4646e755814","observation_id":"f812f917-c32c-42c3-84de-6e801b59e50a","resolution":{"observed_at":"2026-08-06T18:45:45.634208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-06T18:45:44.845971Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.845971Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:69d72eb8e0bf86a8b9fa893227b4ef51218d5165cc264d348455afda6bace8b0","observation_id":"fd345102-e6c0-475f-82d6-c445ff0d7995","resolution":{"observed_at":"2026-08-06T18:45:44.845971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.615830Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":"01d09f0e-36d6-43e5-bc1c-1f5b747652bd","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.850770Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:856fce7bda1152efb9ef35c662ad9b3c92f8533d7dd168b6a57307de2a455ce6","observation_id":"d4a22a02-1016-4794-8d89-1565be2503a5","resolution":{"observed_at":"2026-08-06T18:45:45.620022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.601815Z","title":"Fsd: Fast self-supervised single rgb-d to categorical 3d objects","venue":null,"work_id":"dc2824ea-dfe8-473e-a53a-b2d340838180","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.854045Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8ac22bde0fbf6e55ad9b4d5f2c505b19d3e83aa715a482d49b9befad837dfe0d","observation_id":"b29dbe4f-086a-455e-a4d0-96f5d7205d8f","resolution":{"observed_at":"2026-08-06T18:45:45.606078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.584488Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"ad3d2819-6eb9-407e-b568-83861edfc247","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.857962Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b9ace9a6c1c77d0ab8d6fbb9f8f163f23525c4d0b445eaa1aad8da3be16c423a","observation_id":"9af950d9-c2c7-4f7f-a2b7-8b9f7206b8a3","resolution":{"observed_at":"2026-08-06T18:45:45.588696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.572026Z","title":"Instant neural graphics primitives with a mul- tiresolution hash encoding","venue":null,"work_id":"66fbf808-cd6c-4913-b4d4-d3134d07e0d0","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.861044Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:284b25671f4018d9010b965faca29cfbc7315819a5a4b75df2656c64740e281b","observation_id":"afe0c98b-cdf6-45c2-bc73-933abece65af","resolution":{"observed_at":"2026-08-06T18:45:45.576720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11141","last_updated":"2024-02-17T00:15:09Z","snapshot_observed_at":"2026-08-13T04:17:11.861611Z","submitted_at":"2024-02-17T00:15:09Z","title":"Semantically-aware Neural Radiance Fields for Visual Scene Understanding: A Comprehensive Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11141","snapshot_observed_at":"2026-08-06T18:45:44.864862Z","title":"Semantically-aware neural radiance fields for visual scene understanding: A comprehensive review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.864862Z"},"links":{"cited_paper":"/paper/2402.11141","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:11901133fb494ca53e1924ea060ee13a782b0dbb87adc30d332be973bbd27be6","observation_id":"e7d79a86-3908-4ea0-94e9-574a519eddce","resolution":{"observed_at":"2026-08-06T18:45:44.864862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.561369Z","title":"pix2gestalt: Amodal segmentation by synthesizing wholes","venue":null,"work_id":"72d6e041-ee9d-4dbd-96ca-aa0fe1de638d","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.868863Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8898851759e547f74b205fc023766ca784287cb3074e7b3525109437b30fa7de","observation_id":"3dd0c2b9-5bfd-482f-9606-7a3d07f2687a","resolution":{"observed_at":"2026-08-06T18:45:45.565029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.873377Z","title":"Masked autoencoders for point cloud self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.873377Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:cc48ee0084b9c107ac2f760888ab8a7eaaeadfedc1db72c0054aea64be4ac391","observation_id":"2a852ab7-8347-4aba-85b9-1d0b994b6c3f","resolution":{"observed_at":"2026-08-06T18:45:44.873377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T18:45:44.878163Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.878163Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:8854ceef77a732544c4647be7f586700fb7c0b6a43f39e799c2d2e301ffaa67b","observation_id":"98ded6ef-c107-48ea-8f31-1590c19c6850","resolution":{"observed_at":"2026-08-06T18:45:44.878163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.543678Z","title":"High quality entity segmentation","venue":null,"work_id":"d3fa4896-d1d0-43a4-84b7-8d6502b87575","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.882836Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:bd2747363fea89c6c64044e95bef2a4784bc7e34e806fb3911a3b2ef0df95c92","observation_id":"8654b8cb-05e6-4e3b-92c3-861fe583182e","resolution":{"observed_at":"2026-08-06T18:45:45.547052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.888250Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.888250Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:44a7d4823031737c8d46aeeee326bbb6516b7e20ed54fb816a6f400da2f21723","observation_id":"6c5a1b06-66a8-406a-b8ef-b5091c8608c7","resolution":{"observed_at":"2026-08-06T18:45:44.888250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.894502Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.894502Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:9621964d97e2d09d6f1f896196bce72ad3ce79bf817171760eb6af7139ffa9ee","observation_id":"abe0020b-8a7a-45d3-a7d5-839b143c7f5e","resolution":{"observed_at":"2026-08-06T18:45:44.894502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.518343Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"7c60d48e-993e-481d-abed-45a1c7efaa0c","year":2015},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.900196Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:718346df214d3d0dee69fd0d13769f56ae4809682f7cf1f656f508426720c788","observation_id":"938708e6-7c09-405a-aa1e-2440ade91de3","resolution":{"observed_at":"2026-08-06T18:45:45.521847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-08-14T04:20:52.010119Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-06T18:45:44.904032Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.904032Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:90da6ac5390bc3fd51101e45a2cdc274baabe82c86aa73053ec935415bdc5107","observation_id":"ada14fd0-6eef-412e-967b-d889f881a030","resolution":{"observed_at":"2026-08-06T18:45:44.904032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.907826Z","title":"Panoptic lifting for 3d scene understanding with neural fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.907826Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:678a666f2d9abf1f1ede5f739fc93cd0b6199ce3083bdfaba5bbba60cbb082ef","observation_id":"37d7c1b1-8c43-4921-9a86-d3e5e36c3b99","resolution":{"observed_at":"2026-08-06T18:45:44.907826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T18:45:44.911772Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.911772Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:fe0041bee6c79c66d85e2f01cfd844709e38595a75cfb41b785ded1da2ce8855","observation_id":"af9a080c-97d3-4468-945b-4612c455d68e","resolution":{"observed_at":"2026-08-06T18:45:44.911772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T18:45:44.915857Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.915857Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b14b6e6b51a6e54f1f619f2cd3e50eac3f59ceabbcbd847bf6b60d11bc8dfaad","observation_id":"9b34c774-7456-430c-b5be-3a1daa7f6693","resolution":{"observed_at":"2026-08-06T18:45:44.915857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.499610Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation","venue":null,"work_id":"0a7f3b0d-b6df-4044-bb5d-836cd2b2b506","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.919781Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:418a458dce6248059f7a78c4d7a73df3f6a1ae5f855e887f2af6d9ab55c6fca9","observation_id":"bbf2dc5f-3729-4811-b0a4-d437cb1f9e65","resolution":{"observed_at":"2026-08-06T18:45:45.503480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.487940Z","title":"Mvdiffusion++: A dense high- resolution multi-view diffusion model for single or sparse- view 3d object reconstruction","venue":null,"work_id":"79f32695-0c8d-4ee5-a161-dc9f12d4fa63","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.923867Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:c0543e8022b68d65255db269d5c87e5c98553eb36be05b011051f1798ad5a6bc","observation_id":"f2aad46d-6310-41f1-9dfe-467d5107b53b","resolution":{"observed_at":"2026-08-06T18:45:45.491921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07058","last_updated":"2022-10-25T01:44:56Z","snapshot_observed_at":"2026-08-13T15:44:06.582623Z","submitted_at":"2022-05-14T13:15:32Z","title":"RTMV: A Ray-Traced Multi-View Synthetic Dataset for Novel View Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07058","snapshot_observed_at":"2026-08-06T18:45:44.927814Z","title":"Rtmv: A ray-traced multi-view synthetic dataset for novel view syn- thesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.927814Z"},"links":{"cited_paper":"/paper/2205.07058","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:729f0922129d3d4f0832888775973508772d1ac3036d0d663eaafb340301d234","observation_id":"4fff3516-0062-4a2d-95af-bb5265be1a40","resolution":{"observed_at":"2026-08-06T18:45:44.927814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.931753Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.931753Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:c6e16916c747957404cb1ab95502a2974c7434498ce9114fdc1a4968a1fdcef4","observation_id":"72ff3a3b-caf5-4789-b125-300cc5be23c0","resolution":{"observed_at":"2026-08-06T18:45:44.931753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.469950Z","title":"Mcvd-masked conditional video diffusion for prediction, generation, and interpolation","venue":null,"work_id":"12412c9c-de42-4c4d-8aad-2c303cb7bb01","year":2022},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.935722Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:565d9606e17fde38ff43d1bb027505c07ff22ec83beae7c9c701528ce8db6f12","observation_id":"c9e7b1c9-d5bc-48de-98dd-2bc5fa29e6c8","resolution":{"observed_at":"2026-08-06T18:45:45.473380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.459551Z","title":"Sv3d: Novel multi-view syn- thesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":"d1d84ee6-e366-4337-9a24-a9ae424773f6","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.939215Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1eed28328624b1de27fe5b33a168a6a06d23ff06c020351e8eeb8a0d840e7c09","observation_id":"73ab1b2f-32e1-4e7c-864a-25b472e83d2a","resolution":{"observed_at":"2026-08-06T18:45:45.463218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-13T05:11:47.980346Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-06T18:45:44.943140Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.943140Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:e1ed0343cc56fccccb3965cecdf7a926bce28fe309fc0cca05150c0d08a2103c","observation_id":"eed6d10b-6271-4c23-b0aa-a7bac91a0191","resolution":{"observed_at":"2026-08-06T18:45:44.943140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10689","last_updated":"2023-02-01T06:00:21Z","snapshot_observed_at":"2026-08-02T09:26:48.635481Z","submitted_at":"2021-06-20T12:59:42Z","title":"NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10689","snapshot_observed_at":"2026-08-06T18:45:44.947561Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.947561Z"},"links":{"cited_paper":"/paper/2106.10689","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:ab36cad6a153e9850969e213f95ce8de395c0460b3c00409b302f4bfb2ac1849","observation_id":"8175b070-ece9-4495-b824-1f73bb13b4bb","resolution":{"observed_at":"2026-08-06T18:45:44.947561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.951642Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.951642Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:65607b08eef75289d274ef66b6f31fc66df7928f926a5939eb47c0ba2fa0e75f","observation_id":"22a40b51-9083-41cd-8ce5-8960847ef905","resolution":{"observed_at":"2026-08-06T18:45:44.951642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.442448Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"aafd47b0-5b87-4b61-90b5-5d64121a8975","year":2023},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.955348Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:68eefd36ea4063fb44039a9f50e6c15550ff749c22973a695d109d45a3b52020","observation_id":"5c12b858-6aa0-4c1c-97fe-f8a337bff54f","resolution":{"observed_at":"2026-08-06T18:45:45.446215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.959464Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.959464Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:787cba8f0daf0a3ccf6a84025e28c76fcdc48007e2c2e28268c1f84dbef1c756","observation_id":"24b3c0c6-9dde-4b24-a635-f0800ad67cc4","resolution":{"observed_at":"2026-08-06T18:45:44.959464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.423359Z","title":"Sparp: Fast 3d object reconstruction and pose estimation from sparse views","venue":null,"work_id":"06dfb088-f652-49ab-8860-231f9b80fbbd","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.962926Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:4859e8014335346e7038207461ebd2bca30379a5a27229ccecc0ccad904ca9d6","observation_id":"4ebddc3f-aeeb-4fa2-a9bf-c02aa0c60603","resolution":{"observed_at":"2026-08-06T18:45:45.427205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-08-13T18:57:44.379289Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-06T18:45:44.966614Z","title":"Instantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruction models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.966614Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:a36e7180557c7fe2a4acb71ff07654a16d94ffb0b128a1e0b3a1e9844af20e84","observation_id":"3ab908a6-6dfe-4d97-bdd2-1ed91582cff5","resolution":{"observed_at":"2026-08-06T18:45:44.966614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.411418Z","title":"Amodal com- pletion via progressive mixed context diffusion","venue":null,"work_id":"2ea33347-4031-4a91-876d-51a5fce55083","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.970975Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:f79bc6d77fdd56f416dd9ab1e96d754405b7617e6b9710922109db7bd8cdd189","observation_id":"86367e6b-c854-41a0-927c-dee5570be828","resolution":{"observed_at":"2026-08-06T18:45:45.415839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.974579Z","title":"Gaussian grouping: Segment and edit anything in 3d scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.974579Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:91d88016652e2d683a4920415155c929d130616c27fa1b4d8a9306ef28a1ede8","observation_id":"8268d52d-21be-4fcd-8570-f287141e4b04","resolution":{"observed_at":"2026-08-06T18:45:44.974579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.391168Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"6704de23-012c-44cf-93bb-b4d3f249c0a7","year":2021},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.980208Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b2340dc734116e2102a56bf95260893516ce78de44610ac1036380835c405a28","observation_id":"c775f8ad-63d6-45fa-a6b3-5b26dfc9ac30","resolution":{"observed_at":"2026-08-06T18:45:45.394951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.379685Z","title":"Ir- shad, and Ken Goldberg","venue":null,"work_id":"870c1da5-e4ef-4501-b7ad-160e5a6c56a6","year":2025},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.983922Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:35821c6a18707a25256bf3d1c443a42c8befa203611373445a09afe34b9af373","observation_id":"fb4d9298-c708-4332-b2b1-29dcf45603cf","resolution":{"observed_at":"2026-08-06T18:45:45.383955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.367761Z","title":"Amodal ground truth and completion in the wild","venue":null,"work_id":"80a8421b-b951-4dd0-a3f5-999470cfeac7","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.987149Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:b115054ec2ac00089172d5a226ac9f0b80338cf1b779ff34f579c589185b4efd","observation_id":"1cd85960-db66-4aec-9d79-ce9614e45baa","resolution":{"observed_at":"2026-08-06T18:45:45.371902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:44.990524Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.990524Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:80793e06474c30daf90eb353d067c76d8e43d2a918a0b53ce690794d5ef9be14","observation_id":"ead789d9-8ae6-47be-a171-443a2e919b3f","resolution":{"observed_at":"2026-08-06T18:45:44.990524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.347072Z","title":"Free3d: Consistent novel view synthesis without 3d representation","venue":null,"work_id":"f45a38c2-acd5-4b19-ad94-373a4d05d102","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.995249Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:728152f898de576d09b316fb9b8a501838dd543d20e870ed0a1bc615d9dd1aa2","observation_id":"f702ce00-c23b-41ed-abb3-fa27639a2f9c","resolution":{"observed_at":"2026-08-06T18:45:45.350943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.333899Z","title":"3d gaussian splatting in robotics: A survey,","venue":null,"work_id":"77cca4d9-e6fd-4079-8538-427e8a967d07","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.999214Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:1626bd3f5f8cb425cd45b6a647ffeb5c9d241fa56e158ad68c8f2834d9250bcb","observation_id":"54db729b-4b16-4ab0-aa15-dd9b275976c0","resolution":{"observed_at":"2026-08-06T18:45:45.338403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.320714Z","title":"Triplane meets gaussian splatting: Fast and generalizable single-view 3d reconstruction with transformers","venue":null,"work_id":"7866f586-a858-4c81-a94e-1a64a01420f5","year":2024},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.006370Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:e96375c9e3469992f8a39b5e791f1cf574ac879e95ae621e93f020f5ad257be2","observation_id":"f24ac62f-0ceb-474f-b12d-b18daf2f33e7","resolution":{"observed_at":"2026-08-06T18:45:45.325447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.306956Z","title":"Zero123++ is designed to generate 6 fixed views of an object with rel- ative azimuth rotations and absolute elevations","venue":null,"work_id":"5ba8c998-78f7-4120-8993-ec1a3c145c90","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.010512Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:6a2c7ca5e607009deff1f451ccac2a90b94a3c5a3ecfd53754329de9e1804d65","observation_id":"f6e33139-fcaf-4152-b811-642e7e7c4e08","resolution":{"observed_at":"2026-08-06T18:45:45.311600Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:45:45.287486Z","title":"This is evident in the first two rows of Fig","venue":null,"work_id":"38f321bb-ebe7-4e3e-92f3-f36239a24576","year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:45.014848Z"},"links":{"citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:467624577d2b7bd3974007568db50f1d72f99be26043284a1eeed07c0816333e","observation_id":"527fd9bf-48aa-4d34-97ef-683480633c7b","resolution":{"observed_at":"2026-08-06T18:45:45.294587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T12:26:08.140792Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":38},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2507.07410."}