{"as_of":"2026-08-10T11:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ddc55140a7475c28e0c81bcd08d22c4e705715fe38e86edce1bdd5f958942db","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:01:15.212230Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:17:04.427228Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T10:17:04.757643Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"cited_work":{"arxiv_id":"2506.03799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03799","snapshot_observed_at":"2026-08-06T10:17:04.757643Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","venue":"cs.CV","work_id":"5ee023d9-c9e3-43de-a87b-79ece14b85ae","year":2025},"citing_paper":{"arxiv_id":"2508.00395","last_updated":"2025-08-01T07:46:00Z","snapshot_observed_at":"2026-08-09T10:06:54.862111Z","submitted_at":"2025-08-01T07:46:00Z","title":"Decouple before Align: Visual Disentanglement Enhances Prompt Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:17:04.427228Z"},"links":{"cited_paper":"/paper/2506.03799","citing_paper":"/paper/2508.00395"},"observation_digest":"sha256:494f0f96ac54eafe4d6e9da6e4b8f7c3fa532f6a6d0a8e684d0bcca17899cb3d","observation_id":"67d5aa8e-f874-4373-bc2a-3b5bcc26b4d2","resolution":{"observed_at":"2026-08-06T10:17:04.762107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03799/citation-record","integrity":"/paper/2506.03799/integrity","json":"/paper/2506.03799/citation-record.json","paper":"/paper/2506.03799"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.15661","last_updated":"2023-05-17T21:08:32Z","snapshot_observed_at":"2026-08-07T19:33:04.292595Z","submitted_at":"2022-11-28T18:59:51Z","title":"What learning algorithm is in-context learning? Investigations with linear models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15661","snapshot_observed_at":"2026-08-07T11:01:07.438206Z","title":"What learning algorithm is in-context learning? investigations with linear models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.438206Z"},"links":{"cited_paper":"/paper/2211.15661","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e137443274b5857e2a2327431d875421f7351a44997d29ef5c057b3cf23856f9","observation_id":"fbfc7dd0-2c91-48fe-a745-75f02d3103a0","resolution":{"observed_at":"2026-08-07T11:01:07.438206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.511443Z","title":"L., Darrell, T., Malik, J., and Efros, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.511443Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e03c066cefb1fcb5b2eaf2773ebfc1be61a0fa04129cc31707119330df9527fc","observation_id":"eefa5975-0c1d-45d7-b7aa-1ac9c1122abd","resolution":{"observed_at":"2026-08-07T11:01:07.511443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.586827Z","title":"Visual prompting via image inpainting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.586827Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3d683e620ece552b3716b8198d10e4016e9d574988b2a80de1cd01106f3e7ac6","observation_id":"052ed2e7-3983-46a5-9f76-362e18b6a7ef","resolution":{"observed_at":"2026-08-07T11:01:07.586827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.637027Z","title":"Scene text removal via cascaded text stroke detection and erasing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.637027Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6ac7340e7cf7f83b0eddeeff7df4ee3fce2c52d72d89f880fdf6b036939249d9","observation_id":"424b35ec-2f1a-488e-ae94-15d0f14cb661","resolution":{"observed_at":"2026-08-07T11:01:07.637027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.724685Z","title":"Coco\\_ts dataset: pixel--level annotations based on weak supervision for scene text segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.724685Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:211f3be12f3407d7c2cda53fe819ac21b35635fd7158ea3e5123964dfc5da3bf","observation_id":"a17ef9f7-5dca-4a3b-a292-ca95186173f7","resolution":{"observed_at":"2026-08-07T11:01:07.724685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.810203Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.810203Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5282102162e4c6eef6f2752c3f6ebc2893473674a8ab1a78f5a6917210262e1f","observation_id":"de8370df-e35f-49a9-a638-e035285bd185","resolution":{"observed_at":"2026-08-07T11:01:07.810203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.892136Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.892136Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:51ed5424a8904553ac6869172bf5bbdd9acfd60631924bd9f4b033cfcd835684","observation_id":"8003483c-f748-4978-a8bb-f8a3edb53b96","resolution":{"observed_at":"2026-08-07T11:01:07.892136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.938275Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:07.938275Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:76adea86024c732355dfb7fc38e250e9925b6152133b5b7b677199f498fea73d","observation_id":"7cc66195-3df5-4d4d-8429-e9373ea7a7f7","resolution":{"observed_at":"2026-08-07T11:01:07.938275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.043288Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.043288Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6de8862f5fa330a5bd04a4d1d690281feb71113c7004640e3563e6a89987bf3c","observation_id":"40c8c6d2-a591-4183-921a-2b950d8e924c","resolution":{"observed_at":"2026-08-07T11:01:08.043288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.117319Z","title":"and Chen, P.-I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.117319Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:55c685a37532a9ddd37a6ee492723f80401adfd0d263c1ea22652b9c70ea9c8e","observation_id":"296a61ec-7b63-4b5a-9ac7-d2e50ddb49c2","resolution":{"observed_at":"2026-08-07T11:01:08.117319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-09T08:03:27.441735Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-07T11:01:08.177043Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.177043Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a640ccd492a0add47e254525d4d0bca9037a8667842f67e39954d910ec4112e7","observation_id":"bc3b31fb-3efc-45a2-9ef0-166de5dcd8aa","resolution":{"observed_at":"2026-08-07T11:01:08.177043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-07T11:01:08.241028Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.241028Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5f5d863aaf894b0110c5f6133d628a8f72eee225ca52bea9a68fae339a358c8b","observation_id":"fdcfb62e-104a-4945-bde3-a71c4a30fb11","resolution":{"observed_at":"2026-08-07T11:01:08.241028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:01:08.301690Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.301690Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:19ed3a9c3bf63769b223c52e599fdc8435e69f76ee3fdb3163d6f1b8fba4a74b","observation_id":"77a1d93e-c52c-4cf7-93a3-fb7685058b85","resolution":{"observed_at":"2026-08-07T11:01:08.301690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.374802Z","title":"Modeling stroke mask for end-to-end text erasing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.374802Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:10df01c7d058d8805f7c1da6393178bb68feaaa2ed45377978ba42b1cadeaa29","observation_id":"191929ef-e3ee-4f29-819a-cdc37ff00c3d","resolution":{"observed_at":"2026-08-07T11:01:08.374802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.438526Z","title":"Progressive scene text erasing with self-supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.438526Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:79ac2e69a6bd86a18ca1c190ab377ade2b42beb1ffce62e6baf08df26f462816","observation_id":"34fe5e37-130e-4d70-9ce9-754c02d65df8","resolution":{"observed_at":"2026-08-07T11:01:08.438526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.502534Z","title":"Progressive scene text erasing with self-supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.502534Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:448a05873e5ca19d9310e2dd06c68fd74407880f4f6c8b6c754f39ffbac0db9c","observation_id":"f57efffc-cc56-4f0a-a6ef-e02a7a999e98","resolution":{"observed_at":"2026-08-07T11:01:08.502534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.571502Z","title":"M., Loy, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.571502Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:19a5c4d658c910eb1e3ecafcf2e24476707bd95fa6675573d060adcf66be5a93","observation_id":"3b5d5732-05d1-4d05-afc4-54e35e4f76ca","resolution":{"observed_at":"2026-08-07T11:01:08.571502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.629731Z","title":"S., and Valiant, G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.629731Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1804be79488e614bcfadac19af1c3b53656bd3b0879dd55c6f5edd1126f81771","observation_id":"07bf1aee-7a7c-4dd1-a35a-ba6399344be5","resolution":{"observed_at":"2026-08-07T11:01:08.629731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.697679Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.697679Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f4a14f7c57f3d9a4513148ee52480134c29066752fd02fd188023bb9997f24d7","observation_id":"a12fb2ec-e77d-4149-a054-3ab773d2fe10","resolution":{"observed_at":"2026-08-07T11:01:08.697679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.760612Z","title":"J., and Wang, Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.760612Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:839e7c56fc2659ba3fe571569b9a0d460f7d5399fb3726cedbb17451b7d7ae0b","observation_id":"9cd4d61a-20de-4e3e-9175-e1100c254dac","resolution":{"observed_at":"2026-08-07T11:01:08.760612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.845077Z","title":"Self-supervised text erasing with controllable image synthesis","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.845077Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:bb2104dc26755fc3e7a1333956934043aae439b5315d2a34752382c1b4630d7f","observation_id":"73a8556a-1506-429d-ae0a-1a7f50cf9f74","resolution":{"observed_at":"2026-08-07T11:01:08.845077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.498361Z","title":"C., and Gevers, T","venue":null,"work_id":"012adf39-0580-4d1d-8903-1951c5855d35","year":2012},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.897571Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f34154917711c4e679103b5def9b9263c7b3b247b6ae4345a062b5b7c3422cb9","observation_id":"ee96fb5c-51a6-4d56-bd55-32d824867d2f","resolution":{"observed_at":"2026-08-07T11:01:16.502705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.484533Z","title":"G., Mestre, S","venue":null,"work_id":"47953686-939d-4731-b11b-83cb6e358932","year":2013},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:08.967265Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:40cdabf6bcd4d12695ec404328ab35b8fcca4dc5999f4e233af93674d366172c","observation_id":"3483ff39-1f82-48e0-8bcc-3c8511a9663f","resolution":{"observed_at":"2026-08-07T11:01:16.488622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.018900Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.018900Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:4a96c383dc9e804ed2f2db35ca91daf11f3caa0c81a222839b223240e4a95882","observation_id":"56747e1e-645a-4343-8212-9655b6f646d6","resolution":{"observed_at":"2026-08-07T11:01:09.018900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T11:01:09.090304Z","title":"C., Lo, W.-Y., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.090304Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:49d6862a2175fd91096763edcff596e6bbce92e1a4a1c88e1d15bfd20e934a5c","observation_id":"893be5e1-032c-4e13-865c-953e35a68c45","resolution":{"observed_at":"2026-08-07T11:01:09.090304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.150392Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.150392Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:de5191006f4dd55c70599a97a6c61d9d62e99ec599e664ba03909e66e7d83011","observation_id":"34f3e907-1c2c-4ebc-b09b-74e9697d2c07","resolution":{"observed_at":"2026-08-07T11:01:09.150392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.450727Z","title":"and Choi, C","venue":null,"work_id":"03f07d53-6f58-4710-bf4f-00e3f0eac192","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.210813Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6e003d34fef50e40f949e3e33c5371fb327a8af5783eeec437dc612a793e1b72","observation_id":"20b55225-958b-4bbb-aa3e-0f5b72066ce4","resolution":{"observed_at":"2026-08-07T11:01:16.454990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.435607Z","title":"Monte carlo linear clustering with single-point supervision is enough for infrared small target detection","venue":null,"work_id":"a59f69a0-00a3-4a4c-94cd-dd065abba613","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.271167Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:330d11e318680a59e0b8a08956f214561bac774a6be8aa9b7827645f0b7948da","observation_id":"a455c9a9-f80b-49cf-8996-279edac122b5","resolution":{"observed_at":"2026-08-07T11:01:16.440318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.420965Z","title":"Ddaug: Differentiable data augmentation for weakly supervised semantic segmentation","venue":null,"work_id":"cd06bf2d-b657-425b-862d-ef655ce7fdf4","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.354080Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:42284a2fd6e426d723dc2389a54bde987b14965c549d4d9edc513e01d35a9d90","observation_id":"d11afdba-80b7-450e-87f2-7f6366d0e1dc","resolution":{"observed_at":"2026-08-07T11:01:16.425551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13276","last_updated":"2023-04-26T04:33:41Z","snapshot_observed_at":"2026-08-07T10:06:04.747785Z","submitted_at":"2023-04-26T04:33:41Z","title":"The Closeness of In-Context Learning and Weight Shifting for Softmax Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13276","snapshot_observed_at":"2026-08-07T11:01:09.423620Z","title":"The closeness of in-context learning and weight shifting for softmax regression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.423620Z"},"links":{"cited_paper":"/paper/2304.13276","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0adcc88c6ea933592a73b610383749a767c08677acb74203a2d457a5927d190b","observation_id":"0c1eef5f-07d5-48cb-95aa-adf43fed8f2b","resolution":{"observed_at":"2026-08-07T11:01:09.423620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.407012Z","title":"and Qiu, X","venue":null,"work_id":"2349f671-2d7c-48b2-85a0-34afbcf8abfd","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.492583Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:939d3bf6a0fd9d3a877040826f3d32c6e1f3eb967dcfa130b4ace78da006df28","observation_id":"5d9b6aa9-8e6b-4bbf-9a27-3848dafa8f6b","resolution":{"observed_at":"2026-08-07T11:01:16.411345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.391561Z","title":"Erasenet: End-to-end text removal in the wild","venue":null,"work_id":"dedcecd9-4bb0-4ef6-9efb-14927ace34a9","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.561270Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9c3dc38f278a7269758f3599ad27a26e1fccc36491f249ecb763623aeb82ed05","observation_id":"00aed386-7f3a-4578-8ca5-bcd4af8eaeab","resolution":{"observed_at":"2026-08-07T11:01:16.396348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.376232Z","title":"Don’t forget me: accurate background recovery for text removal via modeling local-global context","venue":null,"work_id":"114c6f52-b052-4da5-ab06-95a13539f473","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.638255Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:247be2a774620569dfdbe155168b7fc089c052fafb0b52a4e895bcfba56c5461","observation_id":"becf9f31-f948-4a4b-a7db-a51bfe537e19","resolution":{"observed_at":"2026-08-07T11:01:16.381114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.361519Z","title":"Don’t forget me: accurate background recovery for text removal via modeling local-global context","venue":null,"work_id":"d57d0b45-a8a4-44f5-8031-6e8bd546906a","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.726890Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0e55b64a602005c8309f55944e208a90ae15d4a46774080c9f0e9573606768b1","observation_id":"e9540eb1-c80a-4d77-9659-1f7a2f94155a","resolution":{"observed_at":"2026-08-07T11:01:16.366256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.347811Z","title":"Audio-visual segmentation via unlabeled frame exploitation","venue":null,"work_id":"3d848dc0-3c76-4e32-a49c-a1ff5371acbe","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.807256Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:d4fd7854a525d40a2acafefe576501892658a6b07c95466bbd27c91bdd511534","observation_id":"370574e2-ebe3-41f9-b7a9-b23c7f1a53e6","resolution":{"observed_at":"2026-08-07T11:01:16.352035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T11:01:09.872864Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.872864Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:7f3bc1685706a0419495e12fe574714b3aefb8d4ac09822127ecff89bd5b50e7","observation_id":"c8c7bd07-5992-4538-bec5-e34a6126e830","resolution":{"observed_at":"2026-08-07T11:01:09.872864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.334398Z","title":"Wdnet: Watermark-decomposition network for visible watermark removal","venue":null,"work_id":"900ece7e-40bf-4e30-90e0-b20d48e2162a","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:09.954199Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:cefb2c2b0d6633fe899f7857776a923578515f913603a3096b9bc6eb54a2c211","observation_id":"0d5491be-b30c-4e9b-abc1-5fabc0aa216b","resolution":{"observed_at":"2026-08-07T11:01:16.338507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.319445Z","title":"Towards end-to-end unified scene text detection and layout analysis","venue":null,"work_id":"c80b73b7-ad48-49e5-a4f2-95ea52d5c4df","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.041487Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:33a0335891c6a8ed5baa2c5e1b1d4fd5562aa2dc7004b4a5a29a3147895a9f88","observation_id":"2362b71d-5e5e-4265-b6a1-806153e50149","resolution":{"observed_at":"2026-08-07T11:01:16.323559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.304571Z","title":"and Zhu, A","venue":null,"work_id":"37aec42a-719c-4842-bbd7-2d68e795446f","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.132480Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:58d828205e8ddfa9fff970acf85d97bf2365d6973e24f7df2048d23aa34200ca","observation_id":"05171fee-5010-45db-8980-e1b403e762be","resolution":{"observed_at":"2026-08-07T11:01:16.308819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.290033Z","title":null,"venue":null,"work_id":"804a3a7d-e72b-43b5-b92a-8cdbe75df417","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.222219Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:7677682b219814c7775c1641e2993da8d5ba37ce639696de98a0a1b75f21aac8","observation_id":"7e1baaa5-c0cb-4815-8572-b6fda6997e4e","resolution":{"observed_at":"2026-08-07T11:01:16.294716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09813","last_updated":"2023-03-17T07:47:55Z","snapshot_observed_at":"2026-07-06T15:04:49.291968Z","submitted_at":"2023-03-17T07:47:55Z","title":"DiffusionSeg: Adapting Diffusion Towards Unsupervised Object Discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09813","snapshot_observed_at":"2026-08-07T11:01:10.316282Z","title":"Diffusionseg: Adapting diffusion towards unsupervised object discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.316282Z"},"links":{"cited_paper":"/paper/2303.09813","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0c68328efd36074084717a50fc5a6c31fb4bda5545e5c451510cfd91232e59ff","observation_id":"f0c25978-acc9-480c-a66a-5a0f132e5c69","resolution":{"observed_at":"2026-08-07T11:01:10.316282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20046","last_updated":"2023-10-30T22:03:55Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-30T22:03:55Z","title":"Which Examples to Annotate for In-Context Learning? Towards Effective and Efficient Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20046","snapshot_observed_at":"2026-08-07T11:01:10.410137Z","title":"Which examples to annotate for in-context learning? towards effective and efficient selection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.410137Z"},"links":{"cited_paper":"/paper/2310.20046","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ed3ec177fdd3beec8f96f2daa309a85c3e6a7706440b209c26259d9e8e4c2f30","observation_id":"613b6460-f770-489b-8606-f5d9a1378942","resolution":{"observed_at":"2026-08-07T11:01:10.410137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-07T11:01:10.548624Z","title":"Rethinking the role of demonstrations: What makes in-context learning work? arXiv preprint arXiv:2202.12837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.548624Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:18e979cd44b260f746cfb56fa4d5681456b0cbb1dd576c21b8e9dd5b5335d901","observation_id":"85090e53-1aee-410c-b3fc-1d2c4257f306","resolution":{"observed_at":"2026-08-07T11:01:10.548624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-07T11:01:10.631471Z","title":"Conditional generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.631471Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b3fbd1395153c8b7377251e68f4784e68f59891a8a5c6c581bbb2574a981313c","observation_id":"7ab24d9c-34db-4c14-a5db-ead6a59cfc6c","resolution":{"observed_at":"2026-08-07T11:01:10.631471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.275826Z","title":"Scene text eraser","venue":null,"work_id":"a28e94a3-4fa7-4f53-9a45-0c0ccaf6db01","year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.731217Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a3e15a0ba6fea04fffb8ac50faffbc6220c8127161392a0bbaa550791f0fbcf4","observation_id":"fd81f4ef-31af-4555-8b3d-9a6efe447b8f","resolution":{"observed_at":"2026-08-07T11:01:16.280211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.261468Z","title":"Fine-grained visible watermark removal","venue":null,"work_id":"424a3a2a-5769-4a26-976c-71883a9cdb22","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.815303Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2acba64f2a5a674e50f4945f808f1d8835ac9e6e16f987ad2b67b3222393c1b4","observation_id":"ff04886a-8bbd-498f-ade0-8d27f59dc56e","resolution":{"observed_at":"2026-08-07T11:01:16.265827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.240354Z","title":null,"venue":null,"work_id":"44d85ab2-0f14-4a35-8f98-5e2937908bf3","year":1975},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.891770Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:eeca68b2577c423c6fed4c4b4494de3b135bfb46513bf8285e70d8d8ced9e425","observation_id":"c149eaec-477e-4c87-b999-9b5a6e5b1018","resolution":{"observed_at":"2026-08-07T11:01:16.245895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.225042Z","title":"What in-context learning “learns” in-context: Disentangling task recognition and task learning","venue":null,"work_id":"5184ffea-fdf8-4bb6-8a26-d0f8830032d9","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:10.975165Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:e7dc90c7041cb0e53f3356b4dc5e422cbaece63bb183d7dd32cdf5d3c4353bfc","observation_id":"decb7db4-470f-420c-97f5-29e108ef6049","resolution":{"observed_at":"2026-08-07T11:01:16.229611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.210383Z","title":"Viteraser: Harnessing the power of vision transformers for scene text removal with segmim pretraining","venue":null,"work_id":"8168f04d-70e1-47be-aaa6-6dabf787f42a","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.054051Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:580a83c04cde65a989d387624c0f491f5e27f4011f406cfe978bae6a58f97ef5","observation_id":"9bf0247d-7892-4a4b-91b8-512030d5a3f5","resolution":{"observed_at":"2026-08-07T11:01:16.214609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.195882Z","title":"Upocr: Towards unified pixel-level ocr interface","venue":null,"work_id":"6f1e3071-441a-484a-ac81-65a418b3b7ab","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.151984Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b969c271b60219522aebf524307bf05770d344876734e95fecdcb8216c5ec4aa","observation_id":"81457810-b5e9-404d-98a6-9b25fe1a3bff","resolution":{"observed_at":"2026-08-07T11:01:16.200335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.181569Z","title":"Image-to-image translation with conditional adversarial networks","venue":null,"work_id":"1c43c69b-a914-472f-a32c-b0598c8a9f7e","year":2017},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.226058Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2ec18d666e810874ed05ac8f5b0e49355bcc14d9d7492a0f2c352f5fa8a3eb57","observation_id":"29276b0a-dbd8-4268-a5fd-36f54e66a673","resolution":{"observed_at":"2026-08-07T11:01:16.186079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.167190Z","title":"Looking from a higher-level perspective: Attention and recognition enhanced multi-scale scene text segmentation","venue":null,"work_id":"f6e74cd7-ec44-4f44-baaf-8c09167a66d1","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.307853Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3eb282f878bdb80b87ba55fbee4ae632e92f7ce463ef2d64fd2aa98fa8c1fe45","observation_id":"a7c15c8e-209e-4b53-b615-2ddc29203972","resolution":{"observed_at":"2026-08-07T11:01:16.171592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.388857Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.388857Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1f5d28783ff1ba8c8c1b89c6090c0a399f2532b2dc228ae17d84d25e362993a5","observation_id":"ca54d6eb-0efe-4d72-a119-fca34db1f86e","resolution":{"observed_at":"2026-08-07T11:01:11.388857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08633","last_updated":"2022-05-08T05:17:15Z","snapshot_observed_at":"2026-08-07T07:00:59.716646Z","submitted_at":"2021-12-16T05:17:56Z","title":"Learning To Retrieve Prompts for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08633","snapshot_observed_at":"2026-08-07T11:01:11.480737Z","title":"Learning to retrieve prompts for in-context learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.480737Z"},"links":{"cited_paper":"/paper/2112.08633","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:21085c9eaaa4b064c8bddce38785bb6374c5173f5703b0cb1375995af0cee241","observation_id":"d76af8e4-aafd-4869-9b31-541310841d09","resolution":{"observed_at":"2026-08-07T11:01:11.480737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.142635Z","title":"and Coustaty, M","venue":null,"work_id":"e5ec34e0-e308-49df-b875-ff6ef7e175e7","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.565647Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0663308012e218f5187974225f90ffd083ac7d0d0afca295f0b52e5ac56ff64a","observation_id":"41f5c624-14e0-4ce8-ab92-14d5503480e4","resolution":{"observed_at":"2026-08-07T11:01:16.146919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06712","last_updated":"2023-08-18T05:49:47Z","snapshot_observed_at":"2026-07-06T15:15:26.125395Z","submitted_at":"2023-04-13T17:58:08Z","title":"What does CLIP know about a red circle? Visual prompt engineering for VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06712","snapshot_observed_at":"2026-08-07T11:01:11.648041Z","title":"What does clip know about a red circle? visual prompt engineering for vlms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.648041Z"},"links":{"cited_paper":"/paper/2304.06712","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:8fb8a009ecf07326442f38c6fad89cfd951d618430a2faca9ef0f795acc9daa7","observation_id":"28371d84-9f29-4461-852d-8375f006c0d9","resolution":{"observed_at":"2026-08-07T11:01:11.648041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.10064","last_updated":"2022-06-13T11:22:21Z","snapshot_observed_at":"2026-08-08T20:52:15.657136Z","submitted_at":"2021-07-21T13:18:21Z","title":"Few Shots Are All You Need: A Progressive Few Shot Learning Approach for Low Resource Handwritten Text Recognition","version":3},"cited_work":{"arxiv_id":"2107.10064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.10064","snapshot_observed_at":"2026-08-07T11:01:15.543730Z","title":"Few Shots Are All You Need: A Progressive Few Shot Learning Approach for Low Resource Handwritten Text Recognition","venue":"cs.CV","work_id":"90998a51-a1d4-4f83-9e5b-5a41960a0f4e","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.727496Z"},"links":{"cited_paper":"/paper/2107.10064","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f7fb296b4f41618260150812a7a9554f97b4e51b3b08d99dccc5363ff2968ecb","observation_id":"b4f268b6-1591-41d8-b67b-8a6919d4a76f","resolution":{"observed_at":"2026-08-07T11:01:15.548348Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01975","last_updated":"2022-09-05T14:01:15Z","snapshot_observed_at":"2026-08-10T01:45:41.161822Z","submitted_at":"2022-09-05T14:01:15Z","title":"Selective Annotation Makes Language Models Better Few-Shot Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.01975","snapshot_observed_at":"2026-08-07T11:01:11.803292Z","title":"H., Shi, W., Wang, T., Xin, J., Zhang, R., Ostendorf, M., Zettlemoyer, L., Smith, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.803292Z"},"links":{"cited_paper":"/paper/2209.01975","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6b27011081fb38e539816177320e1a2363982527e0d2de55ab5f36cc7c827474","observation_id":"2c2a308e-755a-48a6-b842-81e0f867e04e","resolution":{"observed_at":"2026-08-07T11:01:11.803292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.880006Z","title":"Exploring effective factors for improving visual in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.880006Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2d0b45d32257ea935cb8ae0726d3dc9aff6715b1fc7c5f3fd3f21815572c7d2d","observation_id":"8c28182a-6523-4648-81d8-81dd1a7ab6c0","resolution":{"observed_at":"2026-08-07T11:01:11.880006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.127237Z","title":"Stroke-based scene text erasing using synthetic data for training","venue":null,"work_id":"6c4b936c-71b7-474c-ae6b-a4f0b40bbda8","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:11.978013Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:fcd880c781fa35a99cd1bd1884342a894dcd1ce60dccf4d2c293bd933e098ffa","observation_id":"e73ac5fc-b29b-474e-bb8b-76910379fc4d","resolution":{"observed_at":"2026-08-07T11:01:16.132097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:01:12.057003Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.057003Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5e612e77deceb0abdca638adcc4d498932519350158fa7bf942c756e9ac29ce4","observation_id":"9e330387-f44d-4a03-8199-8497f1084f88","resolution":{"observed_at":"2026-08-07T11:01:12.057003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.112530Z","title":"Mtrnet++: One-stage mask-based scene text eraser","venue":null,"work_id":"f36e1e9b-9749-4839-905f-10cf46236c3c","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.156517Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:03df0fa3b71b100c1913d0868c038b544fa28ed8aa8201d5ab8306d9a59fc098","observation_id":"4b7c4cc1-a110-4736-b776-24b0427403d6","resolution":{"observed_at":"2026-08-07T11:01:16.116920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.098423Z","title":"N., Kim, S","venue":null,"work_id":"ec44127d-e3fb-4dab-868b-56912d78648f","year":2018},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.231422Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:72a75141f3cfc2d1978312df88cc624cd70d7431df38af19e74b1fcfdf1220e1","observation_id":"8d29505e-c3b9-4d3b-a09d-f438a7fc3428","resolution":{"observed_at":"2026-08-07T11:01:16.102695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:12.307578Z","title":"Transformers learn in-context by gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.307578Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:30b1981d5ac558a6d85c17631e3a4eca509fc459459c5ac7b2de129fe52954ba","observation_id":"3f36432b-c7b4-4344-ae3a-a3d14784ed45","resolution":{"observed_at":"2026-08-07T11:01:12.307578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.072444Z","title":"Deep high-resolution representation learning for visual recognition","venue":null,"work_id":"6d77a5bf-7ef4-45d4-bcdc-0d1be16eed97","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.408624Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:2f13bb744de59eab58bfcf0aaefcb2b3f9f97f6de57af2e659a5588f99559c28","observation_id":"3990a1fb-f6fe-4c81-a60f-da53eadcb03f","resolution":{"observed_at":"2026-08-07T11:01:16.077494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-07T11:01:12.487239Z","title":"Label words are anchors: An information flow perspective for understanding in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.487239Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:ebcbc7bb42be443faf4628976dc4c53415393c134ed9246210ae6fc75c654d15","observation_id":"7c086cfc-74b3-45d2-9d1b-60353a67b8ae","resolution":{"observed_at":"2026-08-07T11:01:12.487239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-07-06T17:30:47.845775Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-07T11:01:12.585825Z","title":"and Zhou, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.585825Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9b88c1817699031cac0f6b12815530961b14c7d42dda60b63d047a42df4d601b","observation_id":"2364f9f8-3fe6-4956-8ab4-8931e7f692b1","resolution":{"observed_at":"2026-08-07T11:01:12.585825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.057168Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":"f8f0aef7-0906-4760-9e2d-c53270bbaf8a","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.693695Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6f348e7134f52d27736d7d2db6e65858b57005a43d862bad1b4a43961569641a","observation_id":"f7862466-fa67-4f3c-9a34-c4c2afb0ad7e","resolution":{"observed_at":"2026-08-07T11:01:16.061394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.042159Z","title":"Textformer: component-aware text segmentation with transformer","venue":null,"work_id":"05654140-a08f-4e39-ba3a-c393a1d2c9ef","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.770125Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:257799034f8a865553f69ede3b6d32084524863c074446cffb84b0b60b79005a","observation_id":"87e79fcf-7812-4f42-ac2f-69c277c68de9","resolution":{"observed_at":"2026-08-07T11:01:16.046564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03284","last_updated":"2023-04-06T17:59:57Z","snapshot_observed_at":"2026-08-09T03:50:44.384164Z","submitted_at":"2023-04-06T17:59:57Z","title":"SegGPT: Segmenting Everything In Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03284","snapshot_observed_at":"2026-08-07T11:01:12.851868Z","title":"Seggpt: Segmenting everything in context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.851868Z"},"links":{"cited_paper":"/paper/2304.03284","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:114e760036801ca4cd4092a41710d5c858643a439f0ecd0bb1f03f7b37bb597a","observation_id":"1038fe8b-c7cd-44f3-8436-a5b918634933","resolution":{"observed_at":"2026-08-07T11:01:12.851868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.026723Z","title":"Skeleton-in-context: Unified skeleton sequence modeling with in-context learning","venue":null,"work_id":"c85ba9e4-f253-4eae-b659-7ec7f090a34e","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:12.949212Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:5042167e8f2c5fc522fd91e265e637c99db96f618bb7f8d2653c1b05f1f5b3ad","observation_id":"46d37b7e-2c34-4dfb-96ab-ff29129c7173","resolution":{"observed_at":"2026-08-07T11:01:16.031264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:16.012164Z","title":"What is the real need for scene text removal? exploring the background integrity and erasure exhaustivity properties","venue":null,"work_id":"538bbbb6-3596-4630-9c27-f39c174d716e","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.036641Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b44d24f20a743c77465cbe093470ff4fbc595bebd5608144855762d2bff80bda","observation_id":"04db03b1-f2d5-46aa-a672-37782a66dee2","resolution":{"observed_at":"2026-08-07T11:01:16.016877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.997572Z","title":"In-context learning unlocked for diffusion models","venue":null,"work_id":"38410cba-8728-48dd-b05c-b1bc1552d6ec","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.148545Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a8eb6aeeabceb465bd483875e23720546a24c311c756312393d0336a8aeb755a","observation_id":"c30a8386-9b14-40a6-b31f-432896db86a7","resolution":{"observed_at":"2026-08-07T11:01:16.002086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:13.234361Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.234361Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:3d428953a6db50ffd3bc99200ab32a31986561b970105335372d4cec6112d773","observation_id":"c71371b7-5122-4a45-b8ba-4d87b3af7f1c","resolution":{"observed_at":"2026-08-07T11:01:13.234361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:13.300492Z","title":"The learnability of in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.300492Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1689396d17ad0386a5818910c6dd4ebabf2f5fb0a7f4d36d882948c167074f8a","observation_id":"23be2a94-05bc-4577-93a9-c4c09e7b445d","resolution":{"observed_at":"2026-08-07T11:01:13.300492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.963600Z","title":"M., and Luo, P","venue":null,"work_id":"39729660-0fa6-4f76-818b-771f104a26c3","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.343275Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:671b775c072c771d86df3f03b1b7655d7944eb6fe738686323ace9f5d4e4e5cc","observation_id":"782be91a-a712-444e-962a-a39e46b10467","resolution":{"observed_at":"2026-08-07T11:01:15.967977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02080","last_updated":"2022-07-21T07:44:13Z","snapshot_observed_at":"2026-07-30T03:45:35.558793Z","submitted_at":"2021-11-03T09:12:33Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02080","snapshot_observed_at":"2026-08-07T11:01:13.408248Z","title":"M., Raghunathan, A., Liang, P., and Ma, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.408248Z"},"links":{"cited_paper":"/paper/2111.02080","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:f4156256b9326f0eba4ae464ac9b780e123da2cfaab090c5edee799a63542a26","observation_id":"a97127ab-8317-47c4-8eec-ba132b312267","resolution":{"observed_at":"2026-08-07T11:01:13.408248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.949073Z","title":"Rethinking text segmentation: A novel dataset and a text-specific refinement approach","venue":null,"work_id":"552547de-5087-4179-b47a-1cc55d0ac2c0","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.485688Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:da7b663b366848ad2e56b4bf84225e59c38075a47f16745e7b20e8bf0c6b588b","observation_id":"61b1ea9a-f27a-4742-961a-13d216a17e28","resolution":{"observed_at":"2026-08-07T11:01:15.953919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.935225Z","title":"Bts: a bi-lingual benchmark for text segmentation in the wild","venue":null,"work_id":"cc622319-ca56-4c75-afe2-4a1daa8ec3b9","year":2022},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.585296Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:6b610ef390b8dfef22fcdbad96a1c7f91abb3f3f98c041c19a29e32a3a0e0a4c","observation_id":"d237d668-76fd-4d6c-ad9b-d7c1f271e80a","resolution":{"observed_at":"2026-08-07T11:01:15.939438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T11:01:13.646565Z","title":"Set-of-mark prompting unleashes extraordinary visual grounding in gpt-4v","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.646565Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0e4a9f1f84df060c4146e1e03295568579dd838dd58ea6557dc8fb2d57f279e1","observation_id":"7bdbc804-e51e-4b96-b563-656f0ac3c8b1","resolution":{"observed_at":"2026-08-07T11:01:13.646565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.920451Z","title":"Multi-modal prototypes for open-world semantic segmentation","venue":null,"work_id":"39702433-4882-4af8-8986-374bd1819489","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.757322Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:b465f6323b00db2686607c93285b8b26263fc94c45d3c124f95c0c874296506d","observation_id":"f0a3c0cd-0590-4bf7-8965-4c41978770b8","resolution":{"observed_at":"2026-08-07T11:01:15.925027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17904","last_updated":"2024-11-08T10:45:12Z","snapshot_observed_at":"2026-07-06T17:23:10.017122Z","submitted_at":"2024-01-31T15:10:29Z","title":"Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation","version":2},"cited_work":{"arxiv_id":"2401.17904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.17904","snapshot_observed_at":"2026-08-07T11:01:15.324347Z","title":"Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation","venue":"cs.CV","work_id":"2e9f273a-197f-45c3-bda3-0163c1ab11c5","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.802547Z"},"links":{"cited_paper":"/paper/2401.17904","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:08afce753f6539b9de077a7f487f28fefdbbb933f34a8a176346758692a6e4f5","observation_id":"e1ba47f6-40a8-4491-aa84-6737154ac828","resolution":{"observed_at":"2026-08-07T11:01:15.329321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.905372Z","title":"Scene text segmentation with text-focused transformers","venue":null,"work_id":"3581b485-f84a-4ed4-87ba-311519f914be","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:13.945254Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:89735b842a9b9c6ffb2c9f0d863b9dcfb8db8544c18c1c08245befc509fcfacb","observation_id":"8cb2c129-a8dd-4043-98bc-cb68cb97f5eb","resolution":{"observed_at":"2026-08-07T11:01:15.910258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.890990Z","title":"Scene text segmentation with text-focused transformers","venue":null,"work_id":"933920d3-9864-4fe7-b4a2-cf490474eb32","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.032155Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:176bcf79ef65ce8d991563232f7629fd3488a4e440ee25a8a4b0657a542d100e","observation_id":"bd3baa7c-4b68-407c-b2bc-9145c35fe2ac","resolution":{"observed_at":"2026-08-07T11:01:15.895534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.876535Z","title":"Eaformer: Scene text segmentation with edge-aware transformers","venue":null,"work_id":"32531c2b-3e78-4f07-99b1-d6e05952e510","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.140172Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:89201ae904c99f6d70dd1bfdb453a8567c6fa736ce06a2b64418b9a912f5f852","observation_id":"9a4f3461-6596-456c-9a4b-06ded375817e","resolution":{"observed_at":"2026-08-07T11:01:15.881014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02872","last_updated":"2024-09-24T20:27:53Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:39:32Z","title":"How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02872","snapshot_observed_at":"2026-08-07T11:01:14.267944Z","title":"and Ananiadou, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.267944Z"},"links":{"cited_paper":"/paper/2402.02872","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:717082a381ff8811157d7d1c46f73813e23ea6067de25c12d02e93099a35e10f","observation_id":"2c2f1d6f-4611-49f7-8053-f79997112fb2","resolution":{"observed_at":"2026-08-07T11:01:14.267944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.862819Z","title":"and Nakayama, H","venue":null,"work_id":"41b7b6f1-a3df-4fc1-b38e-c91f5545e003","year":2020},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.394659Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:67dbcf2e5d34655f3074ffb8cc2a9dd4b43f94892e4edf8250f356853fae60fe","observation_id":"09ccf479-cb01-4785-a599-4603fccf417c","resolution":{"observed_at":"2026-08-07T11:01:15.866863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.847407Z","title":"Choose what you need: Disentangled representation learning for scene text recognition removal and editing","venue":null,"work_id":"f0aa4cf3-6742-4f79-81a7-2baa1f9425ce","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.490424Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:dd1f4c3625bd56f571b776910159a09a002e65b4b581bd7a9f495315ac232251","observation_id":"953148b6-e5ca-455c-9fc0-e1f2e4b02b76","resolution":{"observed_at":"2026-08-07T11:01:15.852329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.832438Z","title":"Complementary patch for weakly supervised semantic segmentation","venue":null,"work_id":"22ea1add-0eb3-4640-8682-b028ec2abd4e","year":2021},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.578427Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9e24286c2030a636904526261ecab92bfed397496af331a767d4840c7d2b5df2","observation_id":"b86683cd-20cd-47e2-bdcc-367acf1601a4","resolution":{"observed_at":"2026-08-07T11:01:15.836737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.818067Z","title":"Uncovering prototypical knowledge for weakly open-vocabulary semantic segmentation","venue":null,"work_id":"b8ed4c89-4a92-41c7-8e1b-02a9e56ef187","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.735536Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:06b66b6c90908155837e3e5a27cf64abfd3301f2c637358d007000baf60b74bb","observation_id":"d19b2e62-f8d9-44ed-b851-c9d34bd69755","resolution":{"observed_at":"2026-08-07T11:01:15.822487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.803349Z","title":"Instruct me more! random prompting for visual in-context learning","venue":null,"work_id":"3dd8884d-e6cc-4702-a9cc-7ca519656647","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.805412Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:a9da3ab8e58018e8509f089dc168cb523b4f3ff703244c0fe113bf5bdfa87b4e","observation_id":"9521e2e5-3ca9-4a17-a126-fd798aa376f8","resolution":{"observed_at":"2026-08-07T11:01:15.808030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.787881Z","title":"Ensnet: Ensconce text in the wild","venue":null,"work_id":"40c0555b-997e-4126-bc7d-b4e9570b36f2","year":2019},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:14.924630Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:9a6cefc837fd34a2de8f6bdab3791b5f2f5abf68b722fd8448093de47d0f6687","observation_id":"e7999922-d830-4833-bb74-c1a9c96c0794","resolution":{"observed_at":"2026-08-07T11:01:15.792756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01539","last_updated":"2025-06-02T11:05:28Z","snapshot_observed_at":"2026-08-08T06:00:29.569012Z","submitted_at":"2025-06-02T11:05:28Z","title":"G4Seg: Generation for Inexact Segmentation Refinement with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01539","snapshot_observed_at":"2026-08-07T11:01:15.034294Z","title":"G4seg: Generation for inexact segmentation refinement with diffusion models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.034294Z"},"links":{"cited_paper":"/paper/2506.01539","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:39448e25000267459d174a2fa23d7d5beb08baf19fa950092e3c968d9da7131e","observation_id":"4a1323c7-e37a-4752-986f-cc94580c628e","resolution":{"observed_at":"2026-08-07T11:01:15.034294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.773328Z","title":"What makes good examples for visual in-context learning? Advances in Neural Information Processing Systems, 36: 0 17773--17794, 2023 b","venue":null,"work_id":"677d1793-0de2-4123-ac56-296d72e07505","year":2023},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.163038Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:d007503a93258c6b701794e2fef8101136665c0e6ad35a313d76c734bf2284d9","observation_id":"1ade145f-f96b-414a-bcac-94e3b24066f8","resolution":{"observed_at":"2026-08-07T11:01:15.777844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12957","last_updated":"2024-11-27T09:54:05Z","snapshot_observed_at":"2026-08-05T03:56:09.380039Z","submitted_at":"2024-08-23T10:07:59Z","title":"Image Segmentation in Foundation Model Era: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12957","snapshot_observed_at":"2026-08-07T11:01:15.203110Z","title":"Image segmentation in foundation model era: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.203110Z"},"links":{"cited_paper":"/paper/2408.12957","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0596927ee38766c7dd052c296b0669805dae3ddc52c49a7bf9eafc048d1df449","observation_id":"08daf8ea-02e6-4406-bd0b-ec8d4f7b4ba3","resolution":{"observed_at":"2026-08-07T11:01:15.203110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14138","last_updated":"2024-11-03T08:12:57Z","snapshot_observed_at":"2026-07-06T18:48:53.833921Z","submitted_at":"2024-07-19T09:08:20Z","title":"Visual Text Generation in the Wild","version":2},"cited_work":{"arxiv_id":"2407.14138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14138","snapshot_observed_at":"2026-08-07T11:01:15.254060Z","title":"Visual Text Generation in the Wild","venue":"cs.CV","work_id":"295b430a-b6e3-4078-a2be-69741bccd023","year":2024},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.207893Z"},"links":{"cited_paper":"/paper/2407.14138","citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:0ba5a1b7f84d1bc13f0c93c0a258b3c5d234b77d7eaddadac3d5d67185c1c1e0","observation_id":"4c31ef1c-ef25-419a-a80d-509da9640fd0","resolution":{"observed_at":"2026-08-07T11:01:15.260251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:15.212230Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T11:01:15.212230Z"},"links":{"citing_paper":"/paper/2506.03799"},"observation_digest":"sha256:1cb4894406c3e6c2c13cdec9eef6ca6f506dc67b059f2bf76146e432c6b15db7","observation_id":"a3c5911a-dcd5-4d27-8396-390902c27cde","resolution":{"observed_at":"2026-08-07T11:01:15.212230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03799","last_updated":"2025-06-04T10:06:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T13:03:29.824359Z","submitted_at":"2025-06-04T10:06:32Z","title":"ConText: Driving In-context Learning for Text Removal and Segmentation"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":2,"verified_fuzzy":44},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 1 inbound Pith citation observation for arXiv:2506.03799."}