{"as_of":"2026-08-23T03:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dac391cccf376a24496445f4490078e4135808d6949f582ee13423f0317e90f1","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T15:29:14.328745Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08765/citation-record","integrity":"/paper/2607.08765/integrity","json":"/paper/2607.08765/citation-record.json","paper":"/paper/2607.08765"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Qwen3-vl technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:21df10c465df1d716cc38f1074ccdc1fb95484fec0922df8e06077e191788252","observation_id":"b5a99d9a-d9e6-49bd-a287-8f5a9a8c7dd8","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Loosecontrol: Lifting controlnet for generalized depth conditioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:aedb41459f2fc62c8a7b1022c4cd6520a1cf2c54d815a89270152a0d1e403f30","observation_id":"641a5f36-da02-4e81-ab43-97e94b3baf92","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Black Forest Labs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:d6849318ac7fcbecbc010a1cdc5eaba4f36fadc1adebae61e1bddc9f9ba3bf18","observation_id":"9d8e7c98-39d3-42fa-848f-a1dba4c639b8","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Angel Chang, Angela Dai, Thomas Funkhouser, Maciej Halber, Matthias Niessner, Manolis Savva, Shuran Song, Andy Zeng, and Yinda Zhang","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:3432fedb201c1d5e5a1aba696f208b7e5e340b6acf77c027570539be7ffb4bd6","observation_id":"1b48b7ad-7540-4d41-97e2-56b41b29b817","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Hao Chen, Yuqi Hou, Chenyuan Qu, Irene Testini, Xiaohan Hong, and Jianbo Jiao","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:f829dd36c3f381b1bb2bede66c43b133b5b6cd9f4fa6ab89b63b21a960bca823","observation_id":"ab905c23-9f22-48ca-b4d1-828c341277f1","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-17T01:11:44.872398Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:ec9fd6fcc271badc31d329dccd9152b07f1580f8bb767778081e3be331cc406d","observation_id":"bd1a9969-48e5-4093-b1d3-68ba4edf874e","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Dit360: High-fidelity panoramic image generation via hybrid training.arXiv preprint arXiv:2510.11712,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:0dc1207919d909f7ddc40880217b8eb6c25c1bdcc6b951cbc43651656ecc00d1","observation_id":"529699de-0d43-41b8-b5ee-be715c145614","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13447","last_updated":"2025-05-19T17:59:42Z","snapshot_observed_at":"2026-08-17T11:34:19.285953Z","submitted_at":"2025-05-19T17:59:42Z","title":"Mean Flows for One-step Generative Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13447","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Mean flows for one-step generative modeling.arXiv preprint arXiv:2505.13447,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2505.13447","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:82cf48a2c886b316d77cccfc0c95d6279f0980242b3b81a9417a51da4b63b544","observation_id":"8f19c390-12e1-4de0-8e60-04760d185ea7","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Nano banana","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:0a04b6fb08a06bfeb4d72fa576e8d7f31a78343623d1df5f8007120dbb53aa94","observation_id":"7ffa78f0-b589-4b60-8c95-4d9b7749f2ef","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Unityvideo: Unified multi-modal multi-task learning for enhancing world-aware video generation.arXiv preprint arXiv:2512.07831, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:5114253aa0c1c61a0f793299b46f54340cc7b9ad18efbe6c97851062cd14b744","observation_id":"9547670e-23e1-4f51-906e-b05a008a9039","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:3cd65e558486d5ba0da8b00d79c90efeb0551978d6bd63ed10ae6b2151f93f1e","observation_id":"a30e540a-bdb3-428b-b2c3-38d85fbabc91","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Thinking with camera: A unified multimodal model for camera-centric understanding and generation.arXiv preprint arXiv:2510.08673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:96eba165e9f6d54132af57dfaf5ee06d70ac72b90756b196e37eedd477c3f9eb","observation_id":"0bfaa171-341d-4a84-a3f1-8126741a3810","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Depth any panoramas: A foundation model for panoramic depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:31de6f1b63b20c2f77536637b9bac2d580408706a24830f01fb9d3638cf1cffb","observation_id":"1dc7cf5c-5453-4023-8983-d88914eab23f","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:7e060a499c790699fd7dcb8d0a6a155e568d820d6675829f30a9d223b50826e6","observation_id":"8ed9fc5e-fb51-4af5-a36a-f67c00fb9273","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-08-15T10:26:22.896514Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:fb3960955ef89c97a2ac9272d7231876645c6c158156cf67a85a9fc8d13daf72","observation_id":"202e2816-caa6-4cc4-b25c-8f45a1e32562","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Minho Park, Taewoong Kang, Jooyeol Yun, Sungwon Hwang, and Jaegul Choo","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:df397c494536dabb8181ddc730d8e8dced977db70f4c1a87fef0e293addec92d","observation_id":"3aecc7fb-7f55-40b9-a3c8-2891b4380313","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Masked depth modeling for spatial perception.arXiv preprint arXiv:2601.17895,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:c81d887b6fb5498abe5d963b3fe4ba849fead375a60cb65d336b58e7479ce5c7","observation_id":"b4a3007e-0e4b-4fcb-9a7d-e8088f91ab30","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:d7d27b3efa3d92b196790b1eaf536875c8b708f7179f3012a4703bb7bbf3953c","observation_id":"e642d2bb-8430-4ad3-ac04-e871e5b3f240","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-08-18T21:48:45.801096Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Qwen-image technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:4bbf244b75ec0b42dc32359cabd3c98c8e2e18797b18efe2b1e5a2f077745ed8","observation_id":"99c72666-a016-4009-a436-18496c91dd25","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06347","last_updated":"2023-10-10T06:32:24Z","snapshot_observed_at":"2026-08-16T14:53:34.650219Z","submitted_at":"2023-10-10T06:32:24Z","title":"JointNet: Extending Text-to-Image Diffusion for Dense Distribution Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06347","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Jointnet: Extending text-to-image diffusion for dense distribution modeling.arXiv preprint arXiv:2310.06347, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2310.06347","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:dd4b0669fcfa75faa6ab748747439acc329670ffe8cf1cf311062079939839d0","observation_id":"a5f93c06-e9d7-494b-a586-a40b9851fd21","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Inversion-based style transfer with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:e4784a35603ab53d20adcd5f4637e1b588948ad1af3e7af13ca42d0207256fe9","observation_id":"c15c7cc7-11bd-4ec9-bf32-6fd614e8e832","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"In contrast, the model trained with depth supervision produces more coherent depth structures and better cross-view consistency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:70d5307b96b6d50fb8e8269a86dfeca414ac12479742f3e5afd76447127f8a4a","observation_id":"fd4c6384-ad65-406f-aaa9-c97bbdd11f02","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1010.0063","last_updated":"2010-10-01T04:48:27Z","snapshot_observed_at":"2026-08-15T05:07:17.336323Z","submitted_at":"2010-10-01T04:48:27Z","title":"Oscillatory processes in solar flares","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1010.0063","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"We use a constant learning-rate schedule with a 10% warmup (by steps) and set the training guidance scale to 1.0","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/1010.0063","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:1c798512f236d567b9a64f1d3fc26458260ba58c7a47ec6d5a5edb2f5e504d71","observation_id":"40a4818f-a6bd-4019-8a62-77ffa7883c60","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:86331ec6dcee922685c2993c30f1a2505e63020d91f037c58f6d358ebaa91e09","observation_id":"5510b9c9-8d03-4293-8ce5-25c7c7039396","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"We report CP (Content Preservation), SR (Style Resemblance), and OV (Overall Vision)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:974105ce9c2f5347a9521dd4f924fb8a370de18939c70eb5877bb205def9b3bd","observation_id":"d62b75f5-b481-40fa-97be-5aa302e5a1d9","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Across both inpainting and outpainting, our method achieves the best results on all three metrics, yielding lower LPIPS and FAED as well as higher PSNR than all baselines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:6e112910b2182b95b4e443fede7659a383a15aa89a3b963ea52680e712c62f44","observation_id":"996475c3-6701-4ce9-9618-8f8b2f13ff7f","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:08:43.029005Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.08765."}