{"as_of":"2026-08-15T05:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96788bffd3764a3a33794ba594d63fa1b6d67b2c48bd293266507368fca94f81","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:10:54.070242Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.09372/citation-record","integrity":"/paper/2501.09372/integrity","json":"/paper/2501.09372/citation-record.json","paper":"/paper/2501.09372"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/acct.2015.63","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.218334Z","title":"A Review on the Strategies and Techniques of Image Segmentation,","venue":null,"work_id":"ba97bf6e-9907-470f-a70b-fde181c26cac","year":2015},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.910953Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:70c66de85d12b45c4b8e337c38dc5bf4befe2f53d3e8ffca2c9bb936a490311a","observation_id":"badbce81-722f-4f4b-aa5f-bd739bc9058a","resolution":{"observed_at":"2026-08-10T20:10:54.223023Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/electronics12051199","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.204271Z","title":"Techniques and Challenges of Image Segmentation: A Review,","venue":null,"work_id":"1f795608-447f-4706-87f9-2121361af860","year":2023},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.915391Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:f0c83d0bfcf00b6723add088b733fa90de78ff431f1111449d7d63f278e35922","observation_id":"a06a9c92-6ef3-4c81-b596-846eb10eb1bc","resolution":{"observed_at":"2026-08-10T20:10:54.208810Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.920089Z","title":"Fu lly convolutional networks for semantic segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.920089Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:0dfe0c30e78afd8cb98eac7a2fa52090ee385570e31d4c34080ba90166af4a7f","observation_id":"d4c53a0c-25c9-4011-acfb-104c7dd9a198","resolution":{"observed_at":"2026-08-10T20:10:53.920089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-14T05:43:53.421538Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-10T20:10:53.924659Z","title":"U -Net: Convolutional Networks for Biomedical Image Segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.924659Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:152d605f103f4203aaae19e4558b2beb775e5d0f689708894cceac4ed6720068","observation_id":"a236a509-183e-4bcc-ab98-fbdf716a7fb3","resolution":{"observed_at":"2026-08-10T20:10:53.924659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.7062","last_updated":"2016-06-07T04:00:08Z","snapshot_observed_at":"2026-08-14T23:06:27.726818Z","submitted_at":"2014-12-22T17:18:33Z","title":"Semantic Image Segmentation with Deep Convolutional Nets and Fully Connected CRFs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.7062","snapshot_observed_at":"2026-08-10T20:10:53.929456Z","title":"Semantic Image Segmentation with Deep Convolutional Nets and Fully Connected CRFs","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.929456Z"},"links":{"cited_paper":"/paper/1412.7062","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:2d946f9d822af0ac141b19e7d72bb842e4815f0741541ed19ce294340ca0efda","observation_id":"5680d631-193b-4f5e-8612-388093a8b93c","resolution":{"observed_at":"2026-08-10T20:10:53.929456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01105","last_updated":"2017-04-27T12:15:17Z","snapshot_observed_at":"2026-08-14T21:27:13.583882Z","submitted_at":"2016-12-04T11:46:22Z","title":"Pyramid Scene Parsing Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.01105","snapshot_observed_at":"2026-08-10T20:10:53.933874Z","title":"Pyramid Scene Parsing Network","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.933874Z"},"links":{"cited_paper":"/paper/1612.01105","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:786ccde1e24100c3fbd5fc32a673005f3028e7f4522f31153dec14147453384f","observation_id":"474d458f-bc5b-4ca1-9e12-7af1df7b3c35","resolution":{"observed_at":"2026-08-10T20:10:53.933874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.938756Z","title":"ImageNet: A large -scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.938756Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:acfd6d719c62d05f9a3cfca4f898a0c26c63b4c069f75023302012dfc642e64c","observation_id":"9cc183ce-3c33-4d8b-afc6-0e6dc43c00b8","resolution":{"observed_at":"2026-08-10T20:10:53.938756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.942948Z","title":"The Pascal Visual Object Classes (VOC) Challenge,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.942948Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:b72dc5bdb1a301a3d3ff5e7759c4c224d60e1a05f335a4b32965a708cb227683","observation_id":"44c81258-cf69-4ac4-92e6-468638d3575b","resolution":{"observed_at":"2026-08-10T20:10:53.942948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.946963Z","title":"Microsoft COCO: Common Objects in Context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.946963Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:101844bb3de9423caf7468dd954b4b07993497ab323a50d171de9844a5efd722","observation_id":"f245bd79-3efe-4ec6-bb65-345af1161fdf","resolution":{"observed_at":"2026-08-10T20:10:53.946963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.986231Z","title":"The Cityscapes Dataset for Semantic Urban Scene Understanding","venue":null,"work_id":"5ea43d84-71da-4a5f-8148-2f854d22a917","year":null},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.950823Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:daccee2b355a1225454ea5bcd24925574ec17c0f66d0ea05be5a08fb3a90bc9e","observation_id":"ecb4b7ba-f6ab-48b4-b326-0ce6ca61c33f","resolution":{"observed_at":"2026-08-10T20:10:54.989871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.959895Z","title":"The Liver Tu mor Segmentation Benchmark (LiTS),","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.959895Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:4749dba6fb409dba2ad7fc448564e027a4446b002bfaab29011f89bdae84acd8","observation_id":"8f4b089c-a933-4281-affe-9f3d0eae95b9","resolution":{"observed_at":"2026-08-10T20:10:53.959895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07122","last_updated":"2016-04-30T18:19:37Z","snapshot_observed_at":"2026-08-14T22:21:48.435559Z","submitted_at":"2015-11-23T07:32:14Z","title":"Multi-Scale Context Aggregation by Dilated Convolutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07122","snapshot_observed_at":"2026-08-10T20:10:53.963606Z","title":"Multi -Scale Context Aggregation by Dilat ed Convolutions","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.963606Z"},"links":{"cited_paper":"/paper/1511.07122","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:3809e7faed5ad4971ef51e80d3e552440380803d03abfa46fec2b0c83f7778f7","observation_id":"f905edba-ea02-456e-898d-73863b25914e","resolution":{"observed_at":"2026-08-10T20:10:53.963606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.974807Z","title":"Deep Residual Learning for Image Recognition","venue":null,"work_id":"16c86238-7663-499c-a176-cebd85b34d65","year":null},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.968183Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:19a6bbc4d9c060b9f5977dd87834660091c1969892270136dc0245a66cb4c2c3","observation_id":"f4e377b7-fb99-47ee-9274-18d8cca9528e","resolution":{"observed_at":"2026-08-10T20:10:54.978715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.962812Z","title":"Dropout: A Simple Way to Prevent Neural Networks from Overfitting,","venue":null,"work_id":"9d19cded-d5bf-4243-98b0-b99bc7adc7e1","year":1929},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.975851Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:e707861ae8df6bb51f6220477858b651fe039aaee1b96e77d6ead4adb29881b1","observation_id":"3f7f83ce-382f-4fcd-a9a7-74c99d2a055c","resolution":{"observed_at":"2026-08-10T20:10:54.966905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-10T20:10:53.979182Z","title":"Attention Is All You Need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.979182Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:02087b51bafb0914da4f825a5e234a7f0c0d0d27c927e02f1e67ad90216f12d0","observation_id":"b2a2a535-440a-4125-b8c0-bf8df186ba86","resolution":{"observed_at":"2026-08-10T20:10:53.979182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:53.982663Z","title":"Long Short -Term Memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.982663Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:df294ee89be2da2e561463b39416024ba9f54439080f38ba24ef53d4fae82718","observation_id":"7fb38790-b15b-44ab-be6f-98d0fb912d29","resolution":{"observed_at":"2026-08-10T20:10:53.982663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07971","last_updated":"2018-04-13T06:40:44Z","snapshot_observed_at":"2026-08-14T20:11:21.532523Z","submitted_at":"2017-11-21T18:51:16Z","title":"Non-local Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.07971","snapshot_observed_at":"2026-08-10T20:10:53.987337Z","title":"Non -local Neural Networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.987337Z"},"links":{"cited_paper":"/paper/1711.07971","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:21db44b697f1ad13075e1e265be15fba96e3a8788521e733b18dade859f740e0","observation_id":"e255ac17-1214-4398-90fd-0a54270aaa69","resolution":{"observed_at":"2026-08-10T20:10:53.987337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-01240-3_17","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:03:20.376878Z","title":"PSANet: Point-wise Spatial Attention Network for Scene Parsing,","venue":"Lecture notes in computer science","work_id":"e1343e1f-43f5-4d57-a791-2821693253e2","year":2018},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.991052Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:0aa802bbb6e494de2ad7d2e2e097b4900d7984dfba39f68d6bf7f29321de2435","observation_id":"711c3fd3-f46d-43b1-b464-737c56da2fb2","resolution":{"observed_at":"2026-08-10T20:10:54.140017Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.950726Z","title":"Local Relation Networks for Image Recognition","venue":null,"work_id":"ead917fa-dd77-42b8-9aa1-1e598d3a2513","year":null},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.995060Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:f4af0a7393b401e2a391bf2e4693f1435dca026b6354b09900010ebdfedf42c7","observation_id":"fdac9936-7f34-4593-9f17-694033421186","resolution":{"observed_at":"2026-08-10T20:10:54.955118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13621","last_updated":"2020-04-28T16:01:48Z","snapshot_observed_at":"2026-08-10T09:46:18.769095Z","submitted_at":"2020-04-28T16:01:48Z","title":"Exploring Self-attention for Image Recognition","version":1},"cited_work":{"arxiv_id":"2004.13621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.13621","snapshot_observed_at":"2026-08-10T20:10:54.524572Z","title":"Exploring Self-attention for Image Recognition","venue":"cs.CV","work_id":"d90233a2-a203-498e-9ab9-2e3ef411126a","year":2020},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.003983Z"},"links":{"cited_paper":"/paper/2004.13621","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:7df98744c268f2126dbbaff1b21b8884119cc9debb992c790dd2f1f938284aaf","observation_id":"d2847e4f-009f-4a44-ab50-5caa477521fc","resolution":{"observed_at":"2026-08-10T20:10:54.529049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T20:10:54.007985Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.007985Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:c436f4f935e3668819e5556945436e74703f7f5ee0e55cc0772dc5de0e1ec874","observation_id":"9e9b59f9-7c84-4886-816a-bcdc7a544835","resolution":{"observed_at":"2026-08-10T20:10:54.007985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12872","last_updated":"2020-05-28T17:37:23Z","snapshot_observed_at":"2026-08-14T22:50:00.733302Z","submitted_at":"2020-05-26T17:06:38Z","title":"End-to-End Object Detection with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12872","snapshot_observed_at":"2026-08-10T20:10:54.011596Z","title":"End -to-End Object Detection with Transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.011596Z"},"links":{"cited_paper":"/paper/2005.12872","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:ed993f7e32c027b7c6245f076a2c441a72538da6bda9e74009064218cd60e275","observation_id":"b4cef0b4-0429-4d6a-b6f0-61c906830ebe","resolution":{"observed_at":"2026-08-10T20:10:54.011596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.015526Z","title":"Scene Parsing through ADE20K Dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.015526Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:a5680209438a671a39b025340972bd7744039e9b5a96d3e1363f8c026b68d95b","observation_id":"ba674ad2-358e-4f2d-850e-c7c33f3839c9","resolution":{"observed_at":"2026-08-10T20:10:54.015526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.019948Z","title":"The Multimodal Brain Tumor Image Segmentation Benchmark (BRATS),","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.019948Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:c977098f2757011deeef3ff3d3d52d074a1d9b1030beab524b13a469bc4cef71","observation_id":"b8110192-d049-4427-9a5c-4b9eea6d8d77","resolution":{"observed_at":"2026-08-10T20:10:54.019948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.024166Z","title":"CNN or RNN: Review and Experimental Comparison on Image Classification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.024166Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:dc2bb851050454ce1e836fcf89cf402e7a60875f7586ad3fc33cef43372b99d7","observation_id":"cfaadbb7-a43b-4991-a618-03d12cf6834c","resolution":{"observed_at":"2026-08-10T20:10:54.024166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.00561","last_updated":"2016-10-10T21:11:59Z","snapshot_observed_at":"2026-08-14T22:25:13.259510Z","submitted_at":"2015-11-02T15:51:03Z","title":"SegNet: A Deep Convolutional Encoder-Decoder Architecture for Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.00561","snapshot_observed_at":"2026-08-10T20:10:54.028041Z","title":"SegNet : A Deep Convolutional Encoder -Decoder Architecture for Image Segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.028041Z"},"links":{"cited_paper":"/paper/1511.00561","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:b2d5196f9cbf2405c3faa5b8db44505602fb0346a2d01fe3a3a8cda9ee80a398","observation_id":"f9061a98-f58f-4886-aa0e-2293349add66","resolution":{"observed_at":"2026-08-10T20:10:54.028041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.06993","last_updated":"2018-01-28T17:12:02Z","snapshot_observed_at":"2026-08-14T21:42:53.838437Z","submitted_at":"2016-08-25T00:44:55Z","title":"Densely Connected Convolutional Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.06993","snapshot_observed_at":"2026-08-10T20:10:54.033403Z","title":"Densely Connected Convolutional Networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.033403Z"},"links":{"cited_paper":"/paper/1608.06993","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:9db73841b2eb0a2ef38f5f1765d2f8e3b8dfa7fa70c08717a906128c2161c781","observation_id":"ffe9c360-d5b7-473f-87b8-5a1dff89b035","resolution":{"observed_at":"2026-08-10T20:10:54.033403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:10:54.935717Z","title":"Deep High-Resolution Representation Learning for Visual Recognition","venue":null,"work_id":"31cd9c82-6ef1-44d3-b36e-c67520e333a5","year":null},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.037533Z"},"links":{"citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:c730bbd52bb08be4fdc3fffd8ef8638ba5180271fd42f62fc970a1296a5ea93c","observation_id":"382f9a6c-3020-4003-bee7-7bbaffdfac2f","resolution":{"observed_at":"2026-08-10T20:10:54.940882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05633","last_updated":"2021-09-02T10:36:48Z","snapshot_observed_at":"2026-08-13T19:24:12.054855Z","submitted_at":"2021-05-12T13:01:44Z","title":"Segmenter: Transformer for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05633","snapshot_observed_at":"2026-08-10T20:10:54.045389Z","title":"Segmenter: Transformer for Semantic Segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.045389Z"},"links":{"cited_paper":"/paper/2105.05633","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:076fbe2f4e4337993b2bce36faa0e91f700ca7f4f874c6dbaeed19a1c255201c","observation_id":"c9e71008-fa13-497a-9edc-db5922e30b75","resolution":{"observed_at":"2026-08-10T20:10:54.045389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04108","last_updated":"2021-12-28T05:50:43Z","snapshot_observed_at":"2026-08-14T21:17:11.691299Z","submitted_at":"2021-06-08T05:15:28Z","title":"Fully Transformer Networks for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04108","snapshot_observed_at":"2026-08-10T20:10:54.049533Z","title":"Fully Transformer Networks for Semantic Image Segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.049533Z"},"links":{"cited_paper":"/paper/2106.04108","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:069917f44df6b8b0aa82d515f8816a4efb3ecd7d32560b8fb872d0e61ed50f1a","observation_id":"a3e2cc5b-8e8c-4d04-979f-fe1da9ce14b4","resolution":{"observed_at":"2026-08-10T20:10:54.049533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12122","last_updated":"2021-08-11T12:38:21Z","snapshot_observed_at":"2026-08-14T22:53:44.387999Z","submitted_at":"2021-02-24T08:33:55Z","title":"Pyramid Vision Transformer: A Versatile Backbone for Dense Prediction without Convolutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12122","snapshot_observed_at":"2026-08-10T20:10:54.053883Z","title":"Pyramid Vision Transformer: A Versatile Backbone for Dense Prediction without Convolutions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.053883Z"},"links":{"cited_paper":"/paper/2102.12122","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:8006d7216a37a3e17999b80997bf2d049e319125fca833c0c86f72eb0e972ea1","observation_id":"a36f9808-a23f-4368-914f-f01d69eca483","resolution":{"observed_at":"2026-08-10T20:10:54.053883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01527","last_updated":"2022-06-15T20:58:09Z","snapshot_observed_at":"2026-08-13T17:22:53.749000Z","submitted_at":"2021-12-02T18:59:58Z","title":"Masked-attention Mask Transformer for Universal Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01527","snapshot_observed_at":"2026-08-10T20:10:54.057923Z","title":"Masked -attention Mask Transformer for Universal Image Segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.057923Z"},"links":{"cited_paper":"/paper/2112.01527","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:6182eff8156fcd9695a33dc37ee681fb315b966e79a4dbbdbca9ec2559dbaf57","observation_id":"d2fee5b9-fcfd-40a0-8718-f97f33e2cbd3","resolution":{"observed_at":"2026-08-10T20:10:54.057923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15840","last_updated":"2021-07-25T10:44:52Z","snapshot_observed_at":"2026-07-06T10:29:11.807491Z","submitted_at":"2020-12-31T18:55:57Z","title":"Rethinking Semantic Segmentation from a Sequence-to-Sequence Perspective with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15840","snapshot_observed_at":"2026-08-10T20:10:54.061761Z","title":"Rethinking Semantic Segmentation from a Sequence -to-Sequence Perspective with Transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.061761Z"},"links":{"cited_paper":"/paper/2012.15840","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:4143ebda44ecc856e7b49b07c6b3249ecc6fe7b29e806da2428e96772ae5784a","observation_id":"e8c60624-6622-467d-8837-d34acfd8af83","resolution":{"observed_at":"2026-08-10T20:10:54.061761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-13T19:24:14.214828Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-10T20:10:54.066079Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.066079Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:405c5876e1b9a76d74b7e735321cf88d87469a27a62363cc8ae8f5fb175fa632","observation_id":"f63a732c-cb40-4a5f-b692-d9645347c08d","resolution":{"observed_at":"2026-08-10T20:10:54.066079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.15203","last_updated":"2021-10-28T09:29:17Z","snapshot_observed_at":"2026-08-10T18:03:01.489982Z","submitted_at":"2021-05-31T17:59:51Z","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.15203","snapshot_observed_at":"2026-08-10T20:10:54.070242Z","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.070242Z"},"links":{"cited_paper":"/paper/2105.15203","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:be8ce16f611bf6eed5a2e72c6ad63a72d2452c6542a2e370ce89262e577455e3","observation_id":"90ccc98d-ed52-40e4-b5b1-000bae914df2","resolution":{"observed_at":"2026-08-10T20:10:54.070242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03385","last_updated":"2015-12-10T19:51:55Z","snapshot_observed_at":"2026-07-06T04:39:28.429064Z","submitted_at":"2015-12-10T19:51:55Z","title":"Deep Residual Learning for Image Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03385","snapshot_observed_at":"2026-08-10T20:10:53.972028Z","title":"18, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.972028Z"},"links":{"cited_paper":"/paper/1512.03385","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:3871ba9cee904e42acfb1ac4af84c78062e8d55750bbca28fc21c26b3df34fc1","observation_id":"f15da264-dfbe-46ce-ac63-2f90edfb6422","resolution":{"observed_at":"2026-08-10T20:10:53.972028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.01685","last_updated":"2016-04-07T15:39:22Z","snapshot_observed_at":"2026-08-14T22:02:49.221229Z","submitted_at":"2016-04-06T16:34:33Z","title":"The Cityscapes Dataset for Semantic Urban Scene Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.01685","snapshot_observed_at":"2026-08-10T20:10:53.955439Z","title":"21, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.955439Z"},"links":{"cited_paper":"/paper/1604.01685","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:e2543a21789ef5b4d6d3dca7b2be704f79b98fc3ee4c7049567c2daf9cfff376","observation_id":"987a3519-239e-4886-82ed-3fd775f82d9b","resolution":{"observed_at":"2026-08-10T20:10:53.955439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.11491","last_updated":"2019-04-25T17:59:35Z","snapshot_observed_at":"2026-08-14T16:41:21.291843Z","submitted_at":"2019-04-25T17:59:35Z","title":"Local Relation Networks for Image Recognition","version":1},"cited_work":{"arxiv_id":"1904.11491","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.11491","snapshot_observed_at":"2026-08-10T20:10:54.541369Z","title":"Local Relation Networks for Image Recognition","venue":"cs.CV","work_id":"bf4f86de-5397-4e89-9a08-4c2eec5e24ce","year":2019},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:53.998923Z"},"links":{"cited_paper":"/paper/1904.11491","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:f1ce04bceec7c3714c8b7c2382f0151d85246e7a1f856276844f9008531a8793","observation_id":"200d981b-8a8d-4986-9c3f-cb80d6d911bd","resolution":{"observed_at":"2026-08-10T20:10:54.545818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07919","last_updated":"2020-03-13T13:38:30Z","snapshot_observed_at":"2026-08-15T02:23:10.071678Z","submitted_at":"2019-08-20T10:47:46Z","title":"Deep High-Resolution Representation Learning for Visual Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07919","snapshot_observed_at":"2026-08-10T20:10:54.041403Z","title":"21, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:10:54.041403Z"},"links":{"cited_paper":"/paper/1908.07919","citing_paper":"/paper/2501.09372"},"observation_digest":"sha256:3b484cc430182a115a9a0eb3e835892b54655fd86f7fa0e40b1d5ca360436f82","observation_id":"10a7ab64-9a23-40fd-85f8-9dc095a05a8f","resolution":{"observed_at":"2026-08-10T20:10:54.041403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.09372","last_updated":"2025-01-16T08:34:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T20:31:34.798799Z","submitted_at":"2025-01-16T08:34:39Z","title":"Image Segmentation with transformers: An Overview, Challenges and Future"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":5,"verified_fuzzy":5},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2501.09372."}