{"as_of":"2026-08-11T11:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2010189e213775407e2cb72bf5bfa3209f98d923df8086b1e2f6805c7210fb5f","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:06:59.593165Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.14535/citation-record","integrity":"/paper/2501.14535/integrity","json":"/paper/2501.14535/citation-record.json","paper":"/paper/2501.14535"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:07:00.010866Z","title":"Vision trans- formers for dense prediction,","venue":null,"work_id":"5c4b0f79-a6c5-4c1d-b901-f052b0e16e7d","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.463606Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:73df417c3d1822f1999ff8ee5144df2a717cd67ccf15c75125d8561d07f50f29","observation_id":"ab59d56d-c1e1-4879-8da0-ab204d237580","resolution":{"observed_at":"2026-08-10T15:07:00.018182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-10T15:06:59.468124Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.468124Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:9d4a7a50274a53207084686740a6b618025c95ce8cf0a34cedbc47e9f1d44ae8","observation_id":"0042a627-bb2c-434b-992c-d92c6ee4683c","resolution":{"observed_at":"2026-08-10T15:06:59.468124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.994675Z","title":"RefineNet: Multi-path refinement networks for high-resolution semantic segmenta- tion,","venue":null,"work_id":"84ac1833-7189-457c-b180-ad27b051fbd0","year":2017},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.472325Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:e11781b42aacfb6bf6aec504261885d1f43d47ccdf3e165d2b11e74b2e20f13e","observation_id":"f93e330a-4bd0-4eab-8d99-207733666ea2","resolution":{"observed_at":"2026-08-10T15:06:59.998882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.984107Z","title":"Eva: Exploring the limits of masked visual representation learning at scale,","venue":null,"work_id":"79a2ba30-dffd-458a-871c-b33922ba8ff2","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.477122Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:2ba9eac19fdc4d2f39241c4e9d72fe7040ca6a877803ec3902709cdf2b5b82ee","observation_id":"060f2921-613e-41ea-b129-aac012b674ab","resolution":{"observed_at":"2026-08-10T15:06:59.987597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.973432Z","title":"Depth anything: Unleashing the power of large- scale unlabeled data,","venue":null,"work_id":"042356f7-dec8-491a-aac6-65a40485de5f","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.481829Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:87a62f2832ba4f497806fcf7b28f80349ef8c6df619fd8e5d856ed37aff828a5","observation_id":"bbfad913-ac07-4424-9235-10b6153a80e4","resolution":{"observed_at":"2026-08-10T15:06:59.976797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.963726Z","title":"Repurposing diffusion-based image generators for monocular depth estimation,","venue":null,"work_id":"67e19366-b409-46de-98e2-8bbfef6d7b09","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.486243Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:4132243d4fd1c132f0229329733d81958dd93098d4740876cc21f34cbd46b646","observation_id":"64afed73-17f2-4291-a194-3bd92e96a43c","resolution":{"observed_at":"2026-08-10T15:06:59.966993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T15:06:59.491556Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.491556Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:f66d2834e9df1d18cc83fbb0665da2182b15ddce35d88af375375b666b705dd9","observation_id":"876ec342-8c97-4bbf-95ed-6b3fa1c90ba8","resolution":{"observed_at":"2026-08-10T15:06:59.491556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14460","last_updated":"2023-07-26T19:01:49Z","snapshot_observed_at":"2026-08-05T14:21:33.902926Z","submitted_at":"2023-07-26T19:01:49Z","title":"MiDaS v3.1 -- A Model Zoo for Robust Monocular Relative Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14460","snapshot_observed_at":"2026-08-10T15:06:59.496317Z","title":"Midasv3. 1–a model zoo for robust monocular relative depth estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.496317Z"},"links":{"cited_paper":"/paper/2307.14460","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:79d3657dc3972e7b4ea6c7be15eaca4dff958e8e02b93d54f7246a9e02b7ba85","observation_id":"3d4aab51-528c-4e60-91ac-5185b1e4ef12","resolution":{"observed_at":"2026-08-10T15:06:59.496317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-10T15:06:59.500958Z","title":"Zoedepth: Zero-shot transfer by combining relative and metric depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.500958Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:b075f1ab947bf7b71351afc0f1aba04944c65323849697876be2ff66fb18abba","observation_id":"0e896ab9-8f0d-4412-b394-816cbfe07e82","resolution":{"observed_at":"2026-08-10T15:06:59.500958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-10T12:27:58.880216Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-10T15:06:59.504757Z","title":"Depthfm: Fast monocular depth estimation with flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.504757Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:ffd29f0bb30c31f38b9331464bc3e6369c9c243a9d8313e6aeff6c89adfe5981","observation_id":"01cbb2bb-fb1a-4a58-9fff-0290ed21ff4c","resolution":{"observed_at":"2026-08-10T15:06:59.504757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.954131Z","title":"Bins- former: Revisiting adaptive bins for monocular depth estimation,","venue":null,"work_id":"abceb8e1-0f48-4c42-99d1-c90fb56dbe1d","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.508892Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:decf520214dfd0697792bd54d53085830ac380878e8c30846c13f1c8278b2872","observation_id":"c401638b-fbc7-4514-9d88-854889d52861","resolution":{"observed_at":"2026-08-10T15:06:59.957239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.943163Z","title":"Ad- abins: Depth estimation using adaptive bins,","venue":null,"work_id":"4d7a9c07-518d-4487-8e93-cbdcd86ca856","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.515730Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:d9c727be908017956b671eecb25efc8bc5d210efe804a9e2d500b58e841c274a","observation_id":"313e1eb8-e4cb-4400-985d-7215f594657b","resolution":{"observed_at":"2026-08-10T15:06:59.947053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.930930Z","title":"Shvit: Single-head vision transformer with memory efficient macro design,","venue":null,"work_id":"dfbeb3ef-05e6-4edf-a584-07606f32f682","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.518878Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:862788d52cbabdfff2d93ab9f03e3b5b3bf22bf9adbf41d87169eb4a2e0586f7","observation_id":"792b4371-b577-453f-b0ca-a62aee7388aa","resolution":{"observed_at":"2026-08-10T15:06:59.935246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.919608Z","title":"Fast vision transformers with hilo attention,","venue":null,"work_id":"5af25662-14ab-42a3-956d-0eaa8cfe57f2","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.522915Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:3d133804e59ac368cadb8081301b0b77381b5bdbc9c32acabb0c34bfec679049","observation_id":"7ed27f85-5c3a-4919-9096-5e8949479743","resolution":{"observed_at":"2026-08-10T15:06:59.923495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.907729Z","title":"Swin transformer: Hier- archical vision transformer using shifted windows,","venue":null,"work_id":"b0e23e4d-b1c8-42d1-9307-291b9293c6af","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.526043Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:852b276c43b76164b631daaa9146738519854460cd823619aeb8564b37d7fc3d","observation_id":"d460affb-467a-4c40-8cb4-2ee8c556360e","resolution":{"observed_at":"2026-08-10T15:06:59.911904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.895571Z","title":"Swin-unet: Unet-like pure transformer for medical image segmentation,","venue":null,"work_id":"737a36db-24aa-442a-b342-645e31d9776b","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.530238Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:9e8c335f9ef7b733e5fe0c3511ef211b263197085d971d68825df9fb9ad90027","observation_id":"bb2f93d3-02d7-4c9f-a569-65a5434e0051","resolution":{"observed_at":"2026-08-10T15:06:59.899885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.883008Z","title":"Efficientformer: Vision trans- formers at mobilenet speed,","venue":null,"work_id":"fdc4ecf2-0491-49fc-87d0-53875e5dd114","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.534916Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:66efbf4be79bfab67fdd60430f5d9dca5100fa2c817f6578fd5ca88742756207","observation_id":"5e54d188-d6be-4535-a486-8631216ae583","resolution":{"observed_at":"2026-08-10T15:06:59.886239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.873338Z","title":"Swiftformer: Efficient additive attention for transformer-based real-time mobile vision applications,","venue":null,"work_id":"8ed7e4b0-ca0c-42b6-820b-25eaa757e9d2","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.539526Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:7d287819d77427f89a20a7d8d38651c40726c1a4b07c463719eac6728e7e110e","observation_id":"d45a0931-ebc7-485a-8c96-4a0c31fa138a","resolution":{"observed_at":"2026-08-10T15:06:59.876699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.861836Z","title":"Fastvit: A fast hybrid vision transformer using struc- tural reparameterization,","venue":null,"work_id":"3f727952-2dce-498d-8aa3-28999086ea96","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.543625Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:de44410100e45db6fbfedbe02612c4b7946b3594fd131c3869ad6eac3cd52ef4","observation_id":"b167f16a-a848-4c81-819e-8733562d28f7","resolution":{"observed_at":"2026-08-10T15:06:59.865084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.849822Z","title":"Repvit: Revisiting mobile cnn from vit perspective,","venue":null,"work_id":"fdbb5c0a-231b-49af-8437-c2c02acedc28","year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.547471Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:e0672dc59ec0672142d537184a06e899136d939e14be4a064a5cc48df1f11bf9","observation_id":"269cce47-0bd5-417b-b29f-c81370b1a5a1","resolution":{"observed_at":"2026-08-10T15:06:59.853908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.838503Z","title":"Segformer: Simple and efficient design for se- mantic segmentation with transformers,","venue":null,"work_id":"b4174f24-edc5-42c2-8fce-e1478741c211","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.551479Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:cf923d7d445517951c41814d4afc8a02fbfd791f6b453a3269f518158ef43bbf","observation_id":"6a1f778a-f50b-4054-b837-341c6ca73cf6","resolution":{"observed_at":"2026-08-10T15:06:59.842777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.825643Z","title":"Segmenter: Transformer for semantic segmentation,","venue":null,"work_id":"95c649e9-3b7b-4732-b7d3-39b77379f2b7","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.555872Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:235536a05fa96697d79f7376229263ad73de915f1fe518da23b936503834c64c","observation_id":"fba264c2-d66b-4ac4-9ca6-3b0eecb59c35","resolution":{"observed_at":"2026-08-10T15:06:59.830495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.810842Z","title":"More than encoder: Introducing transformer decoder to upsample,","venue":null,"work_id":"8656593c-8262-4b35-b7ce-4872c2a8ded3","year":2022},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.560947Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:88d40c022f62358926f5463554ca6514a123a3a3101518f09ca9a8b1235efa5f","observation_id":"a46b2914-2327-485a-a791-6cce23382a2f","resolution":{"observed_at":"2026-08-10T15:06:59.816265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02957","last_updated":"2024-07-22T09:07:27Z","snapshot_observed_at":"2026-08-10T19:06:52.473039Z","submitted_at":"2024-01-05T18:59:52Z","title":"Denoising Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02957","snapshot_observed_at":"2026-08-10T15:06:59.564819Z","title":"Denoising vision transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.564819Z"},"links":{"cited_paper":"/paper/2401.02957","citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:2b42bba976ed129c42b759aa3ea99818e20c8608dea9f095713c439a802bc170","observation_id":"14cdf7e4-2780-454a-a415-fefcdba6bcf5","resolution":{"observed_at":"2026-08-10T15:06:59.564819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.799423Z","title":"Learning to upsample by learning to sample,","venue":null,"work_id":"9652caf4-1dc7-4079-85dc-db67cfeb23c6","year":2023},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.568972Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:709f800043275d0aa250a870ff45b35710878c2c27b2e08e8bcf204d4e6b0342","observation_id":"434e7862-d873-42d9-9f9f-8d3582019d0c","resolution":{"observed_at":"2026-08-10T15:06:59.803185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.788008Z","title":"Imagenet-21k pretraining for the masses,","venue":null,"work_id":"7670b4c7-cb9c-4866-aa93-f41e51dbdfa3","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.572097Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:64f8736ee601fe81e36d5cbf3844e6d7c41f8736da020178976507c666d62187","observation_id":"d5b6f143-37b5-4c7b-8a89-43bb81a5d63c","resolution":{"observed_at":"2026-08-10T15:06:59.791769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.777072Z","title":"Indoor segmentation and support inference from rgbd images,","venue":null,"work_id":"e1204b08-f3e5-4be8-a412-1a614f6c708e","year":2012},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.575338Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:b36faf1f9de0895b35a59ef21f16b9b0e30da146a508a336f7d1b9a77c14c560","observation_id":"a6163c73-4605-44a6-8945-63adcf640615","resolution":{"observed_at":"2026-08-10T15:06:59.781025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.764235Z","title":"Learning the depths of moving people by watching frozen people,","venue":null,"work_id":"1db03e53-6f3e-453a-9a17-285e495af1be","year":2019},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.578339Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:c36628519b16dcfb1f32769ca1b706dfac0ae4bd003efb258c48637cb6906cda","observation_id":"ee294dc1-6015-427e-9e52-bfb42f18b10f","resolution":{"observed_at":"2026-08-10T15:06:59.768155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.751013Z","title":"Irs: A large naturalistic indoor robotics stereo dataset to train deep models for disparity and surface normal estimation,","venue":null,"work_id":"174bed82-ba7c-450c-a8f6-3b46b4f41e3d","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.581949Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:3ef75acfb677745c7c61af50a1e1c72334f02941d51ddb19305676a57fe2e7f5","observation_id":"b969f40a-ddf2-4f81-a8bd-9eb4f46e60e7","resolution":{"observed_at":"2026-08-10T15:06:59.755471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.736126Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding,","venue":null,"work_id":"d46e319b-7b36-4899-a5e5-186b48040964","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.585759Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:f7ea0c22c148f7e4ab8e2c20267b0097b414e081b4cbc7910732fa4a3560dc88","observation_id":"21cc9aba-e41b-4218-80f4-d3a6f9df9fa7","resolution":{"observed_at":"2026-08-10T15:06:59.742261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.720705Z","title":null,"venue":null,"work_id":"6044b8d2-bb61-4f00-a124-3de678e8e8ea","year":2021},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.589399Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:790ef04ee533b3cae0442632ba060b28196c086be228cc7e38b709e5e193217f","observation_id":"5b102dc6-554f-414d-97d7-97c3a8ac3b55","resolution":{"observed_at":"2026-08-10T15:06:59.725072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:06:59.702488Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"f9464884-b5e9-4440-9c30-d3ecceb382e8","year":1956},"citing_paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T15:06:59.593165Z"},"links":{"citing_paper":"/paper/2501.14535"},"observation_digest":"sha256:093625a19021bf1638702bc590fe6ce07fc889b268e001bbf66ad33dd3041299","observation_id":"3093b120-ccb8-41f2-8c36-5282fe4a2fd8","resolution":{"observed_at":"2026-08-10T15:06:59.710981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14535","last_updated":"2025-01-24T14:41:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T15:01:06.600931Z","submitted_at":"2025-01-24T14:41:30Z","title":"Rethinking Encoder-Decoder Flow Through Shared Structures"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2501.14535."}