{"as_of":"2026-08-13T23:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea2b1d1f1c17a153cc6b71dfcc52947a3f5a179488582ac574699061237ed564","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T16:06:20.797660Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.05127/citation-record","integrity":"/paper/2601.05127/integrity","json":"/paper/2601.05127/citation-record.json","paper":"/paper/2601.05127"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.08113","last_updated":"2023-02-16T06:28:29Z","snapshot_observed_at":"2026-08-13T12:43:37.464753Z","submitted_at":"2023-02-16T06:28:29Z","title":"MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation","version":1},"cited_work":{"arxiv_id":"2302.08113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08113","snapshot_observed_at":"2026-07-07T12:53:50.466635Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":"cs.CV","work_id":"1a06e9b7-e97f-4665-ba6e-55301822d3b6","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.08113","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:87a66988748058f83e535c21086788cf735327807592eba59c601bfd7091f8a1","observation_id":"87a7010e-2579-4236-b8c0-cc52465936c7","resolution":{"observed_at":"2026-05-16T16:08:04.474452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux, https://github.com/black-forest- labs/flux","venue":null,"work_id":"69afefa5-2adf-4b05-b672-ea241a24d5bb","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:a30e9008a2c8b3f79da1706398a723a7b6977a782060fc3eb148e948706ce161","observation_id":"abcd5e32-dfde-447f-803b-7731d50a20c0","resolution":{"observed_at":"2026-05-16T16:08:05.043599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa8d185f-3106-4caa-b5b3-f2d8a10e7949","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:7946ce54604422240c67571828d49129ccaedc16ca44fedccbb90087892f8cbd","observation_id":"ccd57db5-cc3f-4c7c-8554-7e34fbee4431","resolution":{"observed_at":"2026-05-16T16:08:05.114221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03373","last_updated":"2023-11-29T10:21:48Z","snapshot_observed_at":"2026-08-13T12:07:44.909746Z","submitted_at":"2023-04-06T21:00:00Z","title":"Training-Free Layout Control with Cross-Attention Guidance","version":2},"cited_work":{"arxiv_id":"2304.03373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.03373","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"5ea06d90-eff5-4c72-a3ee-8f6e8fefba4d","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2304.03373","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:89fcbcbfa6f70201ffc3b00b970656641b0dd307ed1ff0a10dd14b8f58cbcacc","observation_id":"7803b524-5caa-4ce3-8bca-24bd8db3d9c1","resolution":{"observed_at":"2026-05-16T16:08:04.460743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"07e736bb-10d3-4aae-b771-f026c7b7fbf5","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:476a0d1150a0e7e7dc4bbbfba4be177fd7d3731c63c6fd604686777567652793","observation_id":"db10892c-b12c-4793-aadf-180b6ef6a256","resolution":{"observed_at":"2026-05-16T16:08:05.137711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02938","last_updated":"2021-09-15T04:03:34Z","snapshot_observed_at":"2026-08-13T18:33:10.202093Z","submitted_at":"2021-08-06T04:43:13Z","title":"ILVR: Conditioning Method for Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":"2108.02938","doi":"10.48550/arxiv.2108.02938","metadata_source":"arxiv_reference","pith_arxiv_id":"2108.02938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ilvr: Conditioning method for denoising diffusion probabilistic models","venue":"arXiv (Cornell University)","work_id":"cfb1b920-fb4e-4617-b335-ddfe3d6f7f84","year":2021},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2108.02938","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:e4dd2ebdfc20ce82374a4a89e538fd82820500f78bb0e59e6dd19425afafd9ec","observation_id":"f506409d-84fa-4b02-8ac6-e6a17f64e2cb","resolution":{"observed_at":"2026-05-16T16:08:04.447208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dovenet: Deep image harmonization via domain verification","venue":null,"work_id":"fd7d2d9e-1f6b-4bba-bbb7-c9dea8b2201b","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:af221f6a0c411c08a44005a72c8a87d118b65b93ec4989fd987976b645dd7a73","observation_id":"9f847f01-7f2b-47a6-9d27-b1cc5b9d7404","resolution":{"observed_at":"2026-05-16T16:08:05.109026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving the harmony of the composite image by spatial-separated attention mod- ule.IEEE Transactions on Image Processing, 29:4759– 4771","venue":null,"work_id":"0b460853-7724-4674-b9ab-afbba6e3d2a8","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:5050c7e8cec41b62e3746d47133640afdb524f6baecfc86082b7c19c40abefd5","observation_id":"b23dd311-7e97-4167-9549-b71dacda7542","resolution":{"observed_at":"2026-05-16T16:08:05.102776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Be yourself: Bounded attention for multi-subject text-to-image generation","venue":null,"work_id":"eb7952b6-f991-499c-a08b-0fe52153eaf0","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:59985387c17400c04392c12b3201fb14a92b0d342d83015cafe9b19275ae6bba","observation_id":"6b33ede4-d697-4b3c-9c63-15d8c8fe8f2e","resolution":{"observed_at":"2026-05-16T16:08:05.098379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Be decisive: Noise-induced layouts for multi-subject generation","venue":null,"work_id":"49aa12f6-bfb4-4849-878d-75b75479bd39","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:65293fdb28dbe5102ec597943a17ed180eaac9cfc1d8581a24528fdd449120c8","observation_id":"7a8a76f1-ced2-4130-b3c0-5bf2ec6050dc","resolution":{"observed_at":"2026-05-16T16:08:05.100527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"6c6ad6b9-3d29-43bb-9033-ace8100f4d76","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:21184f0844a98c577bf6866592c8d1cbb990d71c342af6c6f66cf464f70b39f6","observation_id":"dd1e5bd7-b589-4d35-9126-b5af68d406d9","resolution":{"observed_at":"2026-05-16T16:08:05.111634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing Gemini 2.5 Flash Im- age, our state-of-the-art image generation and editing model.https://developers.googleblog.com/ en/introducing- gemini- 2- 5- flash- image/","venue":null,"work_id":"ff245614-ecc0-41cc-8420-0cab8a2c988e","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d8616cd9a7b795313d3cd4987e8de4b3bd4a9d403c191a72dfdf323945d153c0","observation_id":"c3de6222-70ba-4da7-ae25-ff2c0a469e10","resolution":{"observed_at":"2026-05-16T16:08:05.088902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"71e6ea35-b749-4068-8383-9f05a9f2caa9","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2163dedfac47018a802df595860a8b4e991c7fce10fe2c23a371f71f8c95efeb","observation_id":"0f11723b-4f04-4abb-86c6-0df4bf6ede3a","resolution":{"observed_at":"2026-05-16T16:08:05.057390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swapanything: Enabling arbitrary object swapping in personalized image editing.ECCV","venue":null,"work_id":"8f0384f2-1ae1-474a-8e9c-6fd4524cd3b7","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:36d612b9c7518dc1fd722d216f1998a49a1dca9df0376f660e78929ee76fa417","observation_id":"630e604d-f748-448b-b981-88f8ac31def9","resolution":{"observed_at":"2026-05-16T16:08:05.086331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10167","last_updated":"2023-05-25T06:30:04Z","snapshot_observed_at":"2026-08-13T12:40:42.144472Z","submitted_at":"2023-02-20T18:54:04Z","title":"Cross-domain Compositing with Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.10167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.10167","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-domain compositing with pretrained dif- fusion models","venue":null,"work_id":"df617c79-a945-4ad6-b90c-ca6773e4c5cd","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.10167","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:53444b341d13adf070cfd553008f41ab7ad4707a63f49f8f3c88088dca8e8be7","observation_id":"eae82c75-b1d3-4042-9010-45c07f0cd853","resolution":{"observed_at":"2026-05-16T16:08:04.439806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rotary position embedding for vision transformer","venue":null,"work_id":"e3b1f538-59c7-4363-a6a2-3bb5c623e914","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:0a95521f5ec1e74b417071630fea2236d2efa211b6d138b07bc1a3d0db0f33ee","observation_id":"e0e64fef-3b60-4da2-9b34-e5af596801e7","resolution":{"observed_at":"2026-05-16T16:08:05.065189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":"94169321-fe1d-420a-a737-30a59d858f2a","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:fa5dc2d2eebf016e054a3b2f463ec6e89b7c7ad637af568543fc6857da391dec","observation_id":"765f70ae-0f8a-4f30-8ad3-ee75546a18b3","resolution":{"observed_at":"2026-05-16T16:08:05.067339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"cfb58744-5a97-48a8-98c4-b0537e59990c","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2f8d3c30f486ddbecd6af95fbe3004498b7365bf767747da24b383d348f10d31","observation_id":"7dd2d886-a044-4f8f-b525-e4d193c68e90","resolution":{"observed_at":"2026-05-16T16:08:05.118727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.01929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:45.495563Z","title":"Image generation from contextually- contradictory prompts.arXiv preprint arXiv:2506.01929","venue":null,"work_id":"b03b9a89-e090-435e-9b29-b315c47642a5","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:82bd56da631d9103cd0f221c0260e5999cfe598fca2f3fe4227e2f111a91471e","observation_id":"a4bc4304-0fde-42e8-82c0-323538c23aed","resolution":{"observed_at":"2026-05-16T16:08:04.454251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ssh: A self-supervised framework for image harmonization","venue":null,"work_id":"aa23d512-b69c-419a-9d99-355d691a8c12","year":2021},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:405daf51dae608fc6df0f789b2c77d5d768906bb258a260b47d334c4783a13ab","observation_id":"d3ca717c-99b4-4ac2-86d3-bca040e1dbc5","resolution":{"observed_at":"2026-05-16T16:08:05.071492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"7ef8602a-ec0c-401e-9175-ba4c91edf500","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:a9dfa6c90c4c08a6907b3171eefcb245ed3e591ac1fc178440759607064d138d","observation_id":"231c3fdd-1b2c-4f6e-909e-5c74e81e4d55","resolution":{"observed_at":"2026-05-16T16:08:05.125312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:55:40.451482Z","title":"Flux.1 kontext: Flow matching for in-context image generation and editing in latent space","venue":null,"work_id":"68e284f0-a6c3-4a14-b75f-ac624b920c19","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:ddf9f10fa32f1333e3c758564730815cf743ba8a6cc14f839ef01637f2ead8b1","observation_id":"45e133de-de52-4afd-badb-3f565eb2876a","resolution":{"observed_at":"2026-05-16T16:08:05.055137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":"2301.12597","doi":"10.48550/arxiv.2301.12597","metadata_source":"pith","pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","venue":"cs.CV","work_id":"63d03f4d-15f4-4583-8286-913c19f02294","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:0d31608f73924e95d562530b70a6003ecd997276fe50816eab9419867d77d9dd","observation_id":"f034111c-8aba-44f7-9b75-ccf5da5a5883","resolution":{"observed_at":"2026-05-16T16:08:04.435944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"992280d0-7c29-4581-bd40-2165df3b2a79","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:dc4552c32fb12d9de4bb7d7a3e3cdea1b997f64982bce3061c126a222f1d7303","observation_id":"7397afed-4c9c-4c4d-a5f7-eb85d8db9755","resolution":{"observed_at":"2026-05-16T16:08:05.045719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tf-icon: Diffusion-based training-free cross-domain image composi- tion","venue":null,"work_id":"392e9928-24c7-42bf-9fee-fcf737163e3c","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:91da9fc81a3686522e87be7823a4f317646e05dc3d6113d69c23eec765983b8c","observation_id":"0e4d3851-8e57-464f-85e9-bfabc3feb931","resolution":{"observed_at":"2026-05-16T16:08:05.135257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-08-13T05:43:28.614772Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.08453","doi":"10.48550/arxiv.2302.08453","metadata_source":"pith","pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"2337b26e-9ca1-4157-be2a-438971c5fef3","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:c10f26cbf2d599c7bdb08a9afd3500444503ee640b8a4f15cfae0b2485a9031b","observation_id":"b5d5235a-565a-40b7-b218-ec267c9d1a96","resolution":{"observed_at":"2026-05-16T22:47:50.630300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12036","last_updated":"2024-03-18T17:59:40Z","snapshot_observed_at":"2026-08-13T00:51:00.135177Z","submitted_at":"2024-03-18T17:59:40Z","title":"One-Step Image Translation with Text-to-Image Models","version":1},"cited_work":{"arxiv_id":"2403.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12036","snapshot_observed_at":"2026-07-04T02:59:25.755505Z","title":"One-step image translation with text-to-image models","venue":null,"work_id":"2195f713-f393-41e9-b1d8-0e3b7cbf5536","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2403.12036","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:f48fb6ee608357cdef7ccc7372a29bf2e5a09641a83e77a90ff80858488ede38","observation_id":"a490ab2a-a7cf-410a-948a-fb4ab0618c73","resolution":{"observed_at":"2026-05-16T16:08:04.464433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"65c0f981-db9c-4072-b77f-8152952f55ee","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d1e1a24dc5b9723003cd3c5a42b3e86d35809188f18d80c46fe68f3ca5c15aee","observation_id":"e38e2d11-da34-4ac9-8a2f-785c20828035","resolution":{"observed_at":"2026-05-16T16:08:05.062897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Poisson image editing","venue":null,"work_id":"eafa9ed4-6dcb-4780-9773-2fa5eb83774e","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:88c7ab5ac2b638e6d9c89d4809b036b5be0446f5953d61dc484db9932c3a77a5","observation_id":"98a539ca-c796-43dc-8682-a077be2d5b51","resolution":{"observed_at":"2026-05-16T16:08:05.120827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Relightful harmonization: Lighting-aware portrait background replacement","venue":null,"work_id":"3942d669-79ae-4627-853e-b347324086b7","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:31cdba33a7bc7eae58807a3c2c21fdf84d0ef65a967b6a7a2b39485046d38a44","observation_id":"f0927200-fef9-4efc-b95c-1952482bc0a9","resolution":{"observed_at":"2026-05-16T16:08:05.091267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"535ceba1-cabb-4509-9f9e-3f07fc98ed07","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:54adb83b9d99b6fa44351f9c5a1f916d330f58d3d7d33c663bab4cf5eb38dd26","observation_id":"fe5301cc-bafb-4447-98a3-24cb601ca5a2","resolution":{"observed_at":"2026-05-16T16:08:05.060266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"71989962-1e81-4f2e-8cc2-0122f97d44aa","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:8fc8811230c894bca81ca187e02ece22f212d69a46418dfb49620ddb8c38cb9d","observation_id":"6f0a1b7d-16ca-4bf1-8610-207b20d3ed12","resolution":{"observed_at":"2026-05-16T16:08:05.116521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In- stancegen: Image generation with instance-level instruc- tions","venue":null,"work_id":"bb5764c3-141c-442d-84ae-97ba24eb7f2e","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d1ead31297202e00e592cbfe5d0d7b495dcb4aebe5cfcbb6a8264870e82f174b","observation_id":"8c064bf0-07ce-42cd-972e-75aef95b295f","resolution":{"observed_at":"2026-05-16T16:08:05.123135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-12T14:19:29.389332Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":"1409.1556","doi":"10.48550/arxiv.1409.1556","metadata_source":"pith","pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","venue":"cs.CV","work_id":"1c4b4409-c14b-488b-a086-c57a5aab8a29","year":2014},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:79dbeebcb2cf7f1059d2ed2236bd147fccb01bdcfd4b1900edeb9faf85478e48","observation_id":"fcee1615-64ad-4aa5-8ea5-116107cc52e5","resolution":{"observed_at":"2026-05-16T16:08:04.457135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:51:07.915518+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:51:07.915518+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":"c14364af-ff28-4964-9b68-5c4ba95097ec","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:291ce74aea87f4b0c1c3202bcde6a48928c3b9548f178880f726f9b4e5c57b48","observation_id":"49bae8d9-df38-40e7-9a84-d7fdec63775b","resolution":{"observed_at":"2026-05-16T16:08:05.132847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object- stitch: Object compositing with diffusion model","venue":null,"work_id":"58f941cf-0ba7-4e92-9069-46c19e1ef5c3","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2c7dcea0077b902eb567f914f9ed19e3b6d60419fb304e0a78ac0916b5c771c1","observation_id":"8c7dd5ae-d598-43bf-9438-72e90a60f740","resolution":{"observed_at":"2026-05-16T16:08:05.127573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imprint: Generative object compositing by learning identity-preserving representation","venue":null,"work_id":"dc80090a-c1aa-45b5-abf6-d9df38148bf3","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:427fade2fb56cd6d4be1f077fe082c008efc2539160e2b4b4146c9feaa487de5","observation_id":"cfc53f00-91f0-469e-8855-62eee4a3969f","resolution":{"observed_at":"2026-05-16T16:08:05.104909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063","venue":null,"work_id":"d1af47bd-dd90-4dff-826b-302fd98831d3","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d4f716d2a5048ec98a9fb03ef30a4fd225256d36e0263b08fb62301745019494","observation_id":"f7a9fe67-c51b-4e53-af31-007591233af2","resolution":{"observed_at":"2026-05-16T16:08:05.130393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ominicontrol: Minimal and univer- sal control for diffusion transformer","venue":null,"work_id":"11cbbf98-0f6e-42d5-80cf-06290602b7ff","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:b572e9745e23e29a5c7b60321b1104e222d4a0a3bcb57eb4f42d2d340bc416b3","observation_id":"c39b7452-77bf-466f-ab50-9cddfc2939ed","resolution":{"observed_at":"2026-05-16T16:08:05.093829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep image harmonization","venue":null,"work_id":"2b9356d3-c138-4c84-9de6-0b023470eb1e","year":2017},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:9a83593b6ecab4819b97c270b1134dc9b60a3780cfc65db6d94470f7525d94ad","observation_id":"b2f55741-6f0d-493e-80e9-11a3dbd82b55","resolution":{"observed_at":"2026-05-16T16:08:05.096027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":"7bb18fd1-185f-4784-8688-0e87907f498c","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d7b08bdceda2658b29dc8d9a9cfded74bf3917f3a2dc6f39324004f70e5160e4","observation_id":"264421a8-6556-46c5-988d-e426eb22b766","resolution":{"observed_at":"2026-05-16T16:08:05.052255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-08-12T23:45:36.650177Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":"2406.07209","doi":"10.48550/arxiv.2406.07209","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi Wang, Yinan He, Yizhuo Li, Kunchang Li, Jiashuo Yu, Xin Ma, Xinhao Li, Guo Chen, Xinyuan Chen, Yaohui Wang, et al","venue":"arXiv (Cornell University)","work_id":"273757ff-d85e-4208-bb7c-e5881a8119e4","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:04d8a655b3fb3e3ca7178a89e55cf90c570dabcf4a273dfbc89faf642c8682f1","observation_id":"7cc84ab5-5e7a-46de-a1ce-a5763b1880bd","resolution":{"observed_at":"2026-05-16T16:08:04.470931Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13848","last_updated":"2023-08-18T17:12:13Z","snapshot_observed_at":"2026-08-13T18:29:32.530761Z","submitted_at":"2023-02-27T14:49:53Z","title":"ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2302.13848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.13848","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":"0f52104e-2d64-4f37-a7f8-e9a44c02d75f","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.13848","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d7a070bba986e54f7ca8cb892f17033b20938cbe099917ed39a46b7343713089","observation_id":"a602dc1d-904b-4d58-b7d0-4b2ba2872fe5","resolution":{"observed_at":"2026-05-16T16:08:04.432693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:3f984fe3c5938d8ec032000919392703356431bec5049c69065460ccb8685f7e","observation_id":"9bd574b2-b180-49ef-8236-3e9559fdd0ed","resolution":{"observed_at":"2026-05-16T16:08:04.467864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detectron2.https://github","venue":null,"work_id":"2923c166-4e57-404d-88c7-a7806a2af21f","year":2019},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:fa30d19b8a00b7387bb9d103fed3f3b92f223d5c4da0969b36ca2c567b7dbf6f","observation_id":"63bf19fc-9454-493f-94a3-329be00667b9","resolution":{"observed_at":"2026-05-16T16:08:05.106947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":"de4e20ee-512c-461e-aeed-4dd5d4fb39ba","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:c80b72250fe47498c3b6c371332a61f71c812a0b39c43586f4f1729b4f6c1e67","observation_id":"d374aad1-e26a-4ca0-bf4e-a67bd4f9d171","resolution":{"observed_at":"2026-05-16T16:08:05.047897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:56:07.268021Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"6e5dc294-7e63-4630-8393-e84dd1cf2140","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:0c97cd6d78d1d7255836a36e60adf41c2f2739fff7dd703f9584ade3ad7c4b58","observation_id":"ed062727-e7fd-48a7-b3b6-3c7ddce39928","resolution":{"observed_at":"2026-05-16T16:08:05.083699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"56984d04-fd7a-468b-81a8-796a82de7663","year":2018},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:fef0a346f4fd01f025dd0de828c9ac77ee06448e0deeca020291863970ad02f7","observation_id":"ebefa5d0-973d-4031-8d85-65cb0dd00054","resolution":{"observed_at":"2026-05-16T16:08:05.080884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preliminaries","venue":null,"work_id":"3182fdd4-12c7-4d22-a353-42d53bd232d0","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:02dde7d8b2dbc0938504d17aa0540d5b922eabbbdb206bbbdf73f0e57a77d052","observation_id":"68cc24eb-48e2-49da-a923-8ab5b011c5dd","resolution":{"observed_at":"2026-05-16T16:08:05.075865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmark","venue":null,"work_id":"50d48561-7bba-4788-92fc-1cd745909f77","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:bbc22f94f92a07281d5ba389ef2b9fd1593cf6983150202fd19e6eea2cf5c19f","observation_id":"af3b6150-b6da-48cb-b858-8eec4d448600","resolution":{"observed_at":"2026-05-16T16:08:05.073733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Additional Qualitative Results","venue":null,"work_id":"f61871b5-d0d5-494f-8dd6-db59092f2e43","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:c7fcf20238e3d2223e8faa23edac5a5666b5cc495f82f0d6c1e0ca33d2fa4dae","observation_id":"f538bd9e-0075-4d52-9ad8-8407e51c7f10","resolution":{"observed_at":"2026-05-16T16:08:05.069411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LooseRoPE","venue":null,"work_id":"cd1db751-af8b-43df-81cd-f18f71819576","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:57f3757cd1e5404a5808c7dc199057cbf3f7a79add0678fa28d6f20b65bc05f0","observation_id":"ce3079ac-aa43-49ea-b6ed-949d0864f4d4","resolution":{"observed_at":"2026-05-16T16:08:05.049933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8460.1200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"blend the cropped ob- jects into the image in a convincing manner without chang- ing the style of the image","venue":null,"work_id":"d1976170-0fa9-4668-a613-40943e0bc9fc","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:f41a3049151ad348e02bfd4a3b700fa39cb1f89cd7dc2027419c97b2821efe3c","observation_id":"cc5edd94-d35e-45d7-ba2e-e3b457c73a00","resolution":{"observed_at":"2026-05-16T16:08:04.443271Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"blend the cropped objects into the image in a convincing manner without changing the style of the image","venue":null,"work_id":"83238e0f-553b-492d-a0fc-cd7781fa9325","year":2048},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:6039a06b95d3e8e5a50209decbf8c7d83adf5e38b55bbd443c48c46ec662107d","observation_id":"d97b3af3-df70-4933-a4f4-2eeba194f352","resolution":{"observed_at":"2026-05-16T16:08:05.078493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":11,"verified_fuzzy":39},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2601.05127."}