{"as_of":"2026-08-16T04:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:369f42386550675c0c5c9990944d4330b2dc6510aa8f10e42870f8618cf3269e","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T11:06:43.215941Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.09798/citation-record","integrity":"/paper/1908.09798/integrity","json":"/paper/1908.09798/citation-record.json","paper":"/paper/1908.09798"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.602402Z","title":"Gated feedback reﬁnement network for dense image labeling","venue":null,"work_id":"559a8ea0-6070-4d5f-b19b-f84b0460d0d9","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.819456Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:b2c14314efe96acbba5e31d9b8e002e4df5c79988626d9e519a10c5eee1f72f2","observation_id":"0552d092-1b95-4a5b-a9eb-18a981eeab67","resolution":{"observed_at":"2026-08-14T11:06:44.608153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.583291Z","title":"2d human pose estimation: New benchmark and state of the art analysis","venue":null,"work_id":"d7ebd2b9-1db9-4a32-b73f-2a09401e45b1","year":2014},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.825505Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:857264213184d87a2aa6ad4137718e5f897e224d2321f38acc19a0381809a72f","observation_id":"c154173c-01f2-4336-ae75-2175f42d618f","resolution":{"observed_at":"2026-08-14T11:06:44.589506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.566365Z","title":"Segnet: A deep convolutional encoder-decoder architecture for image segmentation","venue":null,"work_id":"5ceaf0f6-804f-47c9-b196-f7a8e4e11ca1","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.831362Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d5adb6424570595e26a182c293ea44217712266bc42b4df0417da3b72447d6e7","observation_id":"259b388b-2c9e-411e-866b-62b4f648c7b5","resolution":{"observed_at":"2026-08-14T11:06:44.571113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.550482Z","title":"Loss maxpooling for semantic image segmentation","venue":null,"work_id":"5906524c-21c9-4256-88fd-4cefebd84c04","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.836455Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:7c361adfb0291d5861dd1b7c12919bb60cd5d919454a611bf4bdd856ac430d4e","observation_id":"937cfdb5-2402-44f2-ad94-53dce0286c72","resolution":{"observed_at":"2026-08-14T11:06:44.555595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.532737Z","title":"Realtime multi-person 2d pose estimation using part afﬁnity ﬁelds","venue":null,"work_id":"7bd973ab-9483-443b-a648-4c875f759913","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.841831Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:21b9deda722c59b6911aa685ca10e173edd41eb77c9d3b34c0504360af298ada","observation_id":"65ea9d41-564d-4dab-a1c8-0fa23fe2c153","resolution":{"observed_at":"2026-08-14T11:06:44.538351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.515129Z","title":"Collins, Yukun Zhu, George Papandreou, Barret Zoph, Florian Schroff, Hartwig Adam, and Jonathon Shlens","venue":null,"work_id":"0af7ae88-f6b9-4841-b76a-083031a599cc","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.847069Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8639f179c855661514512b806252cc692291f32e88e62c95d325fe0c0c64adfb","observation_id":"6155d86a-9321-4e8d-9bad-97a2a1e486d0","resolution":{"observed_at":"2026-08-14T11:06:44.520859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.497559Z","title":"Semantic image segmen- tation with deep convolutional nets and fully connected crfs","venue":null,"work_id":"fcf15572-6ddf-42fb-b373-f1d02f028bfd","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.852797Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:613114876eb9f6a31cbc150a63ed47964f4cfdcf42aa2277516b20bc2a16351a","observation_id":"6c4042f5-e182-4609-a868-e098f2655379","resolution":{"observed_at":"2026-08-14T11:06:44.503557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.476670Z","title":"Deeplab: Semantic image segmentation with deep convolutional nets, atrous convolu- tion, and fully connected crfs","venue":null,"work_id":"cb6b9c70-8166-4e47-be64-92df59f147e7","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.857850Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:c42f58bd8e47d9d43ea374e230110484b43ce362ea5d075cb457136489ec02f5","observation_id":"3c96e6f7-1548-410d-a357-e6b2a151cc10","resolution":{"observed_at":"2026-08-14T11:06:44.483175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-07T13:44:53.690521Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-14T11:06:42.862742Z","title":"Rethinking atrous convolution for seman- tic image segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.862742Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:e5d5dc817476dfea5723ea1723ed071a648999917cc14847047053a7a7e39d99","observation_id":"27b1428e-db93-41fa-9ddc-edc1dfac6895","resolution":{"observed_at":"2026-08-14T11:06:42.862742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.460438Z","title":"Attention to scale: Scale-aware semantic im- age segmentation","venue":null,"work_id":"dc4ce2b5-f123-4cd9-b3b8-b96c5225af7e","year":2016},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.868268Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:fb2191110646a385c0e75523572a08b481afb88c4b255119f44d9fc333b6de0e","observation_id":"53006e6d-7f49-493e-961a-b4b499c18e02","resolution":{"observed_at":"2026-08-14T11:06:44.465281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.444744Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation","venue":null,"work_id":"7884929c-cb20-49a1-8268-6ffba617e5e0","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.873373Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8687390b5ffd9a0637cbcf1ff75fc9ac83a06a91eeefc7960e4246d8447272b0","observation_id":"b860fdcb-4e71-4666-aea8-20db2b169738","resolution":{"observed_at":"2026-08-14T11:06:44.449638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.428895Z","title":"Detect what you can: De- tecting and representing objects using holistic models and body parts","venue":null,"work_id":"cbc9a5c1-0347-492d-b212-f9bdb9b3dd5c","year":1971},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.878156Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8a7e2a64228f9bcfa1ccfcc6e7010f0cf870ffb35b41ef21373c95aed9958df0","observation_id":"52e16129-7ebf-408e-b67c-1e341c022297","resolution":{"observed_at":"2026-08-14T11:06:44.434248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.410248Z","title":"Aˆ 2-nets: Double attention networks","venue":null,"work_id":"19e3e8b6-e88c-40e2-a726-8c5762b54cbf","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.883245Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:5d6ae8e26b25a2b8057ae6446ac4f37d5b124348d7f460953108e83eecfc7422","observation_id":"429fbab3-ab3e-4daa-8030-7590a3c4c664","resolution":{"observed_at":"2026-08-14T11:06:44.415344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:42.887765Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.887765Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:77903c72459948ba2db5d8a3819640e5bc955c9151613c9d6d08613f1a3eca7f","observation_id":"868acc13-0cd1-41da-add7-c6b652505952","resolution":{"observed_at":"2026-08-14T11:06:42.887765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:42.892772Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.892772Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:011fd9efcb1bcbb1ae0b94eae20e290359641972a52f03a78ce51e29a57a14ba","observation_id":"be18019b-226c-4f4e-a2cc-a958c59a151c","resolution":{"observed_at":"2026-08-14T11:06:42.892772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.371000Z","title":"Everingham, L","venue":null,"work_id":"5f2f7387-fa84-45b8-ae16-881971c20f56","year":2010},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.897757Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:58e54a4d20a7456ab31a18056ecbb398e73ca4cb0fc541fc117a96d4d36bc054","observation_id":"f4f014b4-2741-462f-9147-3937bef3ae9e","resolution":{"observed_at":"2026-08-14T11:06:44.376927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04310","last_updated":"2018-05-11T10:30:56Z","snapshot_observed_at":"2026-08-14T19:16:29.423654Z","submitted_at":"2018-05-11T10:30:56Z","title":"Weakly and Semi Supervised Human Body Part Parsing via Pose-Guided Knowledge Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04310","snapshot_observed_at":"2026-08-14T11:06:42.902589Z","title":"Weakly and semi supervised human body part parsing via pose-guided knowledge trans- fer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.902589Z"},"links":{"cited_paper":"/paper/1805.04310","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:6a6aedaae9c81f2cdc55aa776f6a4b8cf4f67994c586803353d37416c2bd98f5","observation_id":"d1212df9-fdd6-4e59-b569-9d9c28272572","resolution":{"observed_at":"2026-08-14T11:06:42.902589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.354588Z","title":"Dual attention network for scene segmentation","venue":null,"work_id":"2bc7022d-49e9-46eb-8a3c-c0031c29bd4d","year":2019},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.907244Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:376e218133a0b1286b62410fbc05fed29c5aa4fa714a5652e79efdbff9401299","observation_id":"4adfd29d-94cb-435c-a6fd-733263b099a4","resolution":{"observed_at":"2026-08-14T11:06:44.360017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.336891Z","title":"Stacked deconvolutional network for se- mantic segmentation","venue":null,"work_id":"ca80269c-03a6-480c-82aa-ca0194a568c0","year":2019},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.911580Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:a58c6d93bdb2e1109ad3e1e053fc7d0b3c66cabbecc95d5af842bb942765bde7","observation_id":"52069193-4cf4-4184-a0b2-af9b9fc33ece","resolution":{"observed_at":"2026-08-14T11:06:44.342603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:42.915963Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.915963Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:5888cc7d06e0d9def202412d10e2762dd7e1ea660dd522c15617c82e7d3248f2","observation_id":"c9bd4f07-a525-4547-8fbc-0444f4e61c13","resolution":{"observed_at":"2026-08-14T11:06:42.915963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.307113Z","title":"Zemel, and Miguel ´A","venue":null,"work_id":"424f15b3-9fd0-4c86-8a50-c65b4d39a8cf","year":2004},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.920819Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:9415a91a5e721def099a5286497cd750652fd93c28dd2b247623e3636cd88f43","observation_id":"7c221331-781c-454a-b802-e3d9f2b31dab","resolution":{"observed_at":"2026-08-14T11:06:44.311709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.290989Z","title":"A real-time algorithm for signal analysis with the help of the wavelet transform","venue":null,"work_id":"d63bf4a0-25cb-4678-aca6-cfdc9d620a68","year":1989},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.925225Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:5a83442c06079a0b4e1fc58a45698ce343e18520a74bf1a8a7bb8a9806b56946","observation_id":"5b88eae8-afd2-4247-998a-71b556d43120","resolution":{"observed_at":"2026-08-14T11:06:44.296093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.274135Z","title":"Relation networks for object detection","venue":null,"work_id":"c76d588b-a1bf-46ca-86cc-8802ab53a9e7","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.929373Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:5dfe756fbe450cf228e19cc0f086caf2c67d52b58df588b72186547b1922f468","observation_id":"8613eaa2-1016-40c2-b6b6-61492c492253","resolution":{"observed_at":"2026-08-14T11:06:44.279483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.256927Z","title":"Gather-excite: Exploiting feature context in convo- lutional neural networks","venue":null,"work_id":"1455860d-c338-406c-a357-43469a0f42ec","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.933895Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:1ec72906ce06891d88c42e87012b90a10e330fc4dd57ff53c91adcfb3011e55b","observation_id":"e88f1e13-7171-4c91-91f2-2965c4707d98","resolution":{"observed_at":"2026-08-14T11:06:44.262292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.240843Z","title":"Squeeze-and-excitation net- works","venue":null,"work_id":"13ec17e5-a560-4d7b-8743-811a558a7120","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.938270Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:b2411222ec7ccef9233c994820e736f9d614f16142eb390d755e2f2bb836ac5b","observation_id":"a78842bd-c06f-410e-8185-f2824c798e86","resolution":{"observed_at":"2026-08-14T11:06:44.246257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.223782Z","title":"Ccnet: Criss-cross attention for semantic segmentation","venue":null,"work_id":"bbb45e67-8364-4305-a4c1-346309c99715","year":2019},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.942931Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8348850db0e87a78e5d3b3ef3c7b1fdbd3a9ab1f1de2c3946cc66c439e26138b","observation_id":"f0d34ac6-ab35-4065-ba70-8a75fceca4e0","resolution":{"observed_at":"2026-08-14T11:06:44.229587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.206157Z","title":"Geometry-aware dis- tillation for indoor semantic segmentation","venue":null,"work_id":"8495fad5-940c-4f1d-b820-5575e28954af","year":2019},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.947422Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:c23ea8ee5e5b6a4369995749eb13dd35fabb3135ea14b02b19b016bdfa4fe7e2","observation_id":"8d3f6db2-55ac-40ee-8797-1467c7e826d3","resolution":{"observed_at":"2026-08-14T11:06:44.211339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.190396Z","title":"Multi-scale structure-aware network for human pose estimation","venue":null,"work_id":"f436ef75-28a6-4ff4-984f-a61252676c53","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.952064Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:e99cafa3358e94b8e78d25dcd5a5c2e24ee449a16b1c0d1f0e8ce9a12c932c04","observation_id":"e3a06f08-8b2c-46a2-96c6-6aa4da9f91f4","resolution":{"observed_at":"2026-08-14T11:06:44.195148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.173858Z","title":"Recurrent scene parsing with perspective understanding in the loop","venue":null,"work_id":"eb5ab7c7-9c0f-4857-bd7b-d0be5dbc8c1a","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.958183Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:90dc7f0c08f85e67c636c9cc1a477ff5669f33bc44dcda9b00a716750d9e0f10","observation_id":"d308cdbd-5a4b-4236-bda6-0676bb5b23b0","resolution":{"observed_at":"2026-08-14T11:06:44.179290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.157384Z","title":"Imagenet classiﬁcation with deep convolutional neural net- works","venue":null,"work_id":"3258cf27-21a1-4257-a594-55b4fcf22280","year":2012},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.963500Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:48d107b3e4dbc3213cb8636590b0d409f5efc86671f9f3642d971d838cbc8f06","observation_id":"5fce9563-71e2-40f7-93f8-00e405dcb34b","resolution":{"observed_at":"2026-08-14T11:06:44.162506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.139607Z","title":"What, where and how many? com- bining object detectors and crfs","venue":null,"work_id":"c260b4fb-15e1-4299-9e18-dc23e461762f","year":2010},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.968282Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:0ed187b9dedccc886ee17c6913e58797dcd38b3d45a62fe3b87bde61692008f7","observation_id":"2060ead0-6420-4415-807e-c724715251b6","resolution":{"observed_at":"2026-08-14T11:06:44.144992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:42.973133Z","title":"Backpropagation applied to handwrit- ten zip code recognition.Neural computation, 1(4):541–551,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.973133Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d21c2b8f8f3519e9951abf9b15add431e8010fd04583722d4a826a09212b42ac","observation_id":"db9999fb-5b68-4b20-a9ef-38c19062e18f","resolution":{"observed_at":"2026-08-14T11:06:42.973133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.00148","last_updated":"2019-05-30T01:30:32Z","snapshot_observed_at":"2026-08-14T17:36:14.933514Z","submitted_at":"2019-01-01T12:52:37Z","title":"Rethinking on Multi-Stage Networks for Human Pose Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.00148","snapshot_observed_at":"2026-08-14T11:06:42.978236Z","title":"Rethinking on multi-stage networks for human pose estimation","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.978236Z"},"links":{"cited_paper":"/paper/1901.00148","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:f35d26113b04becc6241fd2a07461aea6c5612d81926976342c481923b5b4286","observation_id":"16cad555-ceea-4dd7-86ee-28839a0d96a2","resolution":{"observed_at":"2026-08-14T11:06:42.978236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.109586Z","title":"Not all pixels are equal: Difﬁculty-aware se- mantic segmentation via deep layer cascade","venue":null,"work_id":"946d72c9-c58b-4d1f-9bd5-d98f50d8f5bf","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.983653Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d1ae661d5164631b3403f7f828f715db4d67480d7f14d304c9af3ed664200135","observation_id":"f12d365a-0a86-4849-a32c-05d52cce6b99","resolution":{"observed_at":"2026-08-14T11:06:44.115952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.092383Z","title":"Interpretable structure- evolving lstm","venue":null,"work_id":"9d4fb506-85c8-41d9-badc-14bcec282c82","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.988235Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:aec4ef7010ef1fe4d32686e9f0975fab10418497cd110030a9a97f5e7d844541","observation_id":"e092ff80-31f0-4d3c-90ad-c0571a6058db","resolution":{"observed_at":"2026-08-14T11:06:44.098413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.076172Z","title":"Reﬁnenet: Multi-path reﬁnement networks for high- resolution semantic segmentation","venue":null,"work_id":"3705db90-39d1-4cff-a4e6-42e871b20acf","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.993236Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:2c13a947eaa73352fab932edb270c8b38c42bfe8aee0f57b2b9a0a2f448e6a93","observation_id":"18e9074a-46ed-4b6e-91b6-1292ee8109bb","resolution":{"observed_at":"2026-08-14T11:06:44.081141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.057588Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"47a4031c-5a5a-4143-8c7f-d262ee00f22f","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:42.998727Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d31d7e1138bb45cff159554835858b46a76de6dc7ba26c72c316c32c5b1a7325","observation_id":"bced3c96-ea24-4578-b319-ef684bc81560","resolution":{"observed_at":"2026-08-14T11:06:44.063402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02985","last_updated":"2019-04-06T19:40:44Z","snapshot_observed_at":"2026-08-14T17:32:56.867577Z","submitted_at":"2019-01-10T01:05:15Z","title":"Auto-DeepLab: Hierarchical Neural Architecture Search for Semantic Image Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02985","snapshot_observed_at":"2026-08-14T11:06:43.003288Z","title":"Auto-deeplab: Hierarchical neural architecture search for semantic image segmentation","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.003288Z"},"links":{"cited_paper":"/paper/1901.02985","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d61bf8737ca06254a06f22d2a9fba02a41b6587aae83673f2b479fdcf5cebf42","observation_id":"3399a244-b835-4677-8312-c292bd5caeea","resolution":{"observed_at":"2026-08-14T11:06:43.003288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.04579","last_updated":"2015-11-19T22:19:28Z","snapshot_observed_at":"2026-08-14T22:44:24.911468Z","submitted_at":"2015-06-15T13:00:59Z","title":"ParseNet: Looking Wider to See Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.04579","snapshot_observed_at":"2026-08-14T11:06:43.010297Z","title":"Parsenet: Looking wider to see better","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.010297Z"},"links":{"cited_paper":"/paper/1506.04579","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:fe23b49e57a7a3767b83819cc443202fae0a228f2d1db71840cf7fec26cba3a3","observation_id":"5e0691de-1a59-4878-9bae-21a1ba903c75","resolution":{"observed_at":"2026-08-14T11:06:43.010297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.038740Z","title":"Fully convolutional networks for semantic segmentation","venue":null,"work_id":"a85d970b-32f0-4261-a275-7ad2dc85e216","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.016098Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:2ba3ec47b54c548b9f6bd8a327eb074a72c099580cd108a7aea27615db132b39","observation_id":"a1d3c8c8-b6c1-451e-8436-b3ceb04a474b","resolution":{"observed_at":"2026-08-14T11:06:44.044989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.021706Z","title":"Associa- tive embedding: End-to-end learning for joint detection and grouping","venue":null,"work_id":"5b915423-eb90-4b3a-8ce9-d5a72476498f","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.021707Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:b7aa8df31d8ed3dab1099d1cd14303b0f5f306c76addfdc333cf2c277e2e4550","observation_id":"24c33177-d7b5-46c7-af90-a346a720dc15","resolution":{"observed_at":"2026-08-14T11:06:44.027160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:44.003905Z","title":"Stacked hour- glass networks for human pose estimation","venue":null,"work_id":"5b072bdb-b93d-449f-a7f5-6b72b0abf550","year":2016},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.027033Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8de171c6c24e8cfab93f32991ee33582b451a9d2945ae3591e8b586e103560b3","observation_id":"aa38825f-ef81-4f69-9f93-5d36b31d481e","resolution":{"observed_at":"2026-08-14T11:06:44.009823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.983480Z","title":"Learning deconvolution network for semantic segmentation","venue":null,"work_id":"342486b3-3b27-4d7f-9387-36b9b5e0c202","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.032053Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:56e9e875fdb4a8619c76e0400f35afe7de6effcf3ebfdc36e01e971e4d2f3b82","observation_id":"3602b613-eeec-4891-9057-9976be5908de","resolution":{"observed_at":"2026-08-14T11:06:43.991131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.965424Z","title":"Modeling local and global deformations in deep learning: Epitomic convolution, multiple instance learning, and sliding window detection","venue":null,"work_id":"a149d85d-b6ed-4e74-ae5a-ab34037826ef","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.037037Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:fe2d3e5bc759fd5bf8dc0393cf41183f99c6f0dcbdf04c30107226f6f7605fa1","observation_id":"272ec843-12e1-40bc-9039-3ce1fd586d5b","resolution":{"observed_at":"2026-08-14T11:06:43.970966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.948357Z","title":"Large kernel matters–improve semantic segmenta- tion by global convolutional network","venue":null,"work_id":"dbbd1e1d-d267-47b9-a109-c721abc09182","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.042276Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:454075d02033c26ccbcbdd6dd257423d361291c0fb59a73acd05c3e49d6f3292","observation_id":"897a9e46-3328-4105-b251-6cbe1912f1b8","resolution":{"observed_at":"2026-08-14T11:06:43.953599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.932259Z","title":"Full-resolution residual networks for seman- tic segmentation in street scenes","venue":null,"work_id":"b0d83de6-d51f-41f5-b43d-ff9274f8dc58","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.047313Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:e071d689b8e988f7c61dba1c5e7e488040974330533b37c8e3558bde3f85b6cf","observation_id":"083b33d9-1893-46c1-8941-d30fcf2599c3","resolution":{"observed_at":"2026-08-14T11:06:43.937607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.913749Z","title":"Seamless scene segmentation","venue":null,"work_id":"26bea842-cd47-446f-ba3f-8caf81c221e0","year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.051767Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:ab0a5a0640a3e572a28508483ce5f73b97a84c7a4d932ff75b0b4f554ff66912","observation_id":"d6bb596d-4732-4f38-b582-97709b9e21f1","resolution":{"observed_at":"2026-08-14T11:06:43.920206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.894342Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"9dce7cd6-ed06-4033-a63c-39cf914793fa","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.057871Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:0ca23b9342cc60e865e4ec9fb2a62374469d028ccba8f0c837140e6ceeeed980","observation_id":"0005ccaa-9689-46e9-9589-3caf82bd608d","resolution":{"observed_at":"2026-08-14T11:06:43.901343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.873958Z","title":"In-place activated batchnorm for memory-optimized training of dnns","venue":null,"work_id":"ae96b7b2-d2fc-4bf1-bacf-e15998f52e8a","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.062639Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:74c2e1faf12e08358b7a0744168e9216d2b480ef50b2ea6c2c817422ac856d28","observation_id":"8deb1132-f003-43d2-8c32-56553f9222a0","resolution":{"observed_at":"2026-08-14T11:06:43.880892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6229","last_updated":"2014-02-24T03:38:17Z","snapshot_observed_at":"2026-08-14T23:50:42.135173Z","submitted_at":"2013-12-21T09:52:33Z","title":"OverFeat: Integrated Recognition, Localization and Detection using Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6229","snapshot_observed_at":"2026-08-14T11:06:43.066915Z","title":"Overfeat: Integrated recognition, localization and detection using convolutional networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.066915Z"},"links":{"cited_paper":"/paper/1312.6229","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:c28efa8c2c2f407f32c0943fc1a908cae892fa329b4b584299b6136765d589ef","observation_id":"bbce0534-913a-4e92-8b02-ec9a3a8f04c1","resolution":{"observed_at":"2026-08-14T11:06:43.066915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10343","last_updated":"2018-04-27T05:03:32Z","snapshot_observed_at":"2026-08-14T19:21:22.842592Z","submitted_at":"2018-04-27T05:03:32Z","title":"Stacked U-Nets: A No-Frills Approach to Natural Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10343","snapshot_observed_at":"2026-08-14T11:06:43.073761Z","title":"Stacked u-nets: a no-frills approach to natural image segmentation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.073761Z"},"links":{"cited_paper":"/paper/1804.10343","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:4c8e51c12e7c3ff4d6f520fb8759c7b1b485f66c92bb9ecc9aa6d0b7aa6b3fbf","observation_id":"f2aa629e-388a-4fc7-bf0f-7d98b4763b18","resolution":{"observed_at":"2026-08-14T11:06:43.073761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.079623Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.079623Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:0c85a1d6c5ead9b12a1e292e9f07c8a45d8c34a77c24da93718a24ea09b79e6e","observation_id":"6fc13bc3-889c-4965-9e45-57a72087756d","resolution":{"observed_at":"2026-08-14T11:06:43.079623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.03356","last_updated":"2018-08-06T19:53:18Z","snapshot_observed_at":"2026-08-14T19:17:20.679587Z","submitted_at":"2018-05-09T03:02:06Z","title":"SPG-Net: Segmentation Prediction and Guidance Network for Image Inpainting","version":4},"cited_work":{"arxiv_id":"1805.03356","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.03356","snapshot_observed_at":"2026-08-14T11:06:43.293590Z","title":"SPG-Net: Segmentation Prediction and Guidance Network for Image Inpainting","venue":"cs.CV","work_id":"2f8d540c-dd58-4ba3-88f5-2a77c3b7658a","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.084626Z"},"links":{"cited_paper":"/paper/1805.03356","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:9e282f2add43c4a023638cf881469b68369c43132514835f036f02ab35d9a5c9","observation_id":"64d6d9cd-afe4-442a-b5fc-65ed8b823d7a","resolution":{"observed_at":"2026-08-14T11:06:43.301509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.844390Z","title":"Going deeper with convolutions","venue":null,"work_id":"0c0453a8-6191-4ff8-b788-c1277d98986a","year":2015},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.090998Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:12599ebb83914d8202297f62f43d3f6c10f4797642cc06c9c28dc70c6ef519b9","observation_id":"50cce468-ba94-49d1-972e-a9048b1fa883","resolution":{"observed_at":"2026-08-14T11:06:43.850377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.826856Z","title":"Finding things: Image parsing with regions and per-exemplar detectors","venue":null,"work_id":"76ad10d9-f39e-41bd-8c62-3b0e32f32039","year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.096851Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:9a4c6f43a56e6f4bb565a3f0981911422a57a9881c121582180f3296ea9e7b42","observation_id":"eaf65b0a-8483-49e0-8aa0-54381179002b","resolution":{"observed_at":"2026-08-14T11:06:43.832958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.808747Z","title":"Image parsing: Unifying segmentation, detec- tion, and recognition","venue":null,"work_id":"e983281e-300c-45a1-a725-86f2ce6e0033","year":2005},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.102635Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:0c9e3b6f009d2601624a38da5e34e5f60d0619a5ae4ff72a98a08a48b9c17ef0","observation_id":"f30e0c0b-51a3-42c0-8603-d31edf14d1cb","resolution":{"observed_at":"2026-08-14T11:06:43.815056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.788379Z","title":"Attention is all you need","venue":null,"work_id":"42cf9076-fb72-4993-9ec1-7066766e018f","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.108003Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:7a93ceb960935a14553ab8a3bebdf22349edbff2c0143c5559bc62c4aef53665","observation_id":"5955b628-8257-4dac-965e-6319456036b5","resolution":{"observed_at":"2026-08-14T11:06:43.794301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.767320Z","title":"Understanding convolution for semantic segmentation","venue":null,"work_id":"eb68694e-b2b3-40c3-a480-2572b33ea62f","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.112994Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:f2f69cb667b394f52044b75fe5a19d98c49640bf180efaeedf6a96bff5060416","observation_id":"caed67ea-232b-4ee9-b821-21d6760f54a9","resolution":{"observed_at":"2026-08-14T11:06:43.773983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.744406Z","title":"A stagewise reﬁnement model for detecting salient objects in images","venue":null,"work_id":"0a0dc58f-5921-403c-9457-97bbb77333bb","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.117885Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:aec83ae3cd1ba75cfba8e06184eec5c3297747a94b93b2c67363b02163b80332","observation_id":"149b0464-76ad-441d-8624-4c7d9a3bf190","resolution":{"observed_at":"2026-08-14T11:06:43.751222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.721516Z","title":"Non-local neural networks","venue":null,"work_id":"779648b1-9d88-43c1-8f89-cf132bae6e66","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.122900Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:21a42f547f4c79d13cbbbf3c1b2394b3da9d8f70510059cc16fc3c3d1689ea93","observation_id":"432496b8-2d6c-4d6e-bad7-08e81cf8a272","resolution":{"observed_at":"2026-08-14T11:06:43.728952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.699926Z","title":"Convolutional pose machines","venue":null,"work_id":"3285ea18-e802-447c-a445-2eaacd3b43f3","year":2016},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.128218Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:b1f499dbcb0d373572db7538244d1ff21310cd060ad2156e2c1885e3547fa7f1","observation_id":"45aef46b-8604-47ea-abea-290052bd91d2","resolution":{"observed_at":"2026-08-14T11:06:43.705009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.679674Z","title":"The devil is in the decoder: Classiﬁcation, regression and gans","venue":null,"work_id":"4271feef-cec1-4bb1-a019-84576874e51f","year":2019},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.134742Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:261c1f0db0a18b072a121a6a8cc8ef95eeb0d8cfc62db9c5289e10711fb81e72","observation_id":"2c7b3654-e845-4f7f-a786-bcfe57b9f51c","resolution":{"observed_at":"2026-08-14T11:06:43.685799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06885","last_updated":"2016-05-23T03:43:00Z","snapshot_observed_at":"2026-08-15T05:15:49.479330Z","submitted_at":"2016-05-23T03:43:00Z","title":"Bridging Category-level and Instance-level Semantic Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.06885","snapshot_observed_at":"2026-08-14T11:06:43.140196Z","title":"Bridging category-level and instance-level semantic image segmentation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.140196Z"},"links":{"cited_paper":"/paper/1605.06885","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:dbc6a984179c6e94c8c88f97efd50b74704f1ff8928eeadcd4e40ebe9db5fe45","observation_id":"68cb2644-0bdf-4c78-81cc-d537eb3628a2","resolution":{"observed_at":"2026-08-14T11:06:43.140196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.660754Z","title":"Joint multi-person pose estimation and semantic part seg- mentation","venue":null,"work_id":"91675bbd-eade-4701-825b-66dd4de67b88","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.145867Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:2649fc2dd4954e1662030ee4d35f6b6b030d7a8a540f20969014fbb3fee27d9d","observation_id":"71e18f68-1562-46b6-9849-7c8eadd36182","resolution":{"observed_at":"2026-08-14T11:06:43.666640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.644139Z","title":"Uniﬁed perceptual parsing for scene understand- ing","venue":null,"work_id":"bfe96a65-e6bc-4a57-aea1-0852d125db90","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.151525Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:e13a51df9827740dde413ccb25e32e20659f8c5005a0abc683c1b8766a4e1b54","observation_id":"9536db5f-f134-4da7-a2ec-8cdc7b4e9321","resolution":{"observed_at":"2026-08-14T11:06:43.649407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.628066Z","title":"Denseaspp for semantic segmentation in street scenes","venue":null,"work_id":"97ba64e7-f2e9-47ae-b06e-af15475b9b60","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.156680Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:d1c0b7143f9fa07d478ebe978614cac7066651f07eae800418ee5562ebce699b","observation_id":"9a37b72f-05db-4703-a998-200e27a43e6c","resolution":{"observed_at":"2026-08-14T11:06:43.633635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.05093","last_updated":"2019-03-12T23:22:42Z","snapshot_observed_at":"2026-08-14T17:16:42.015294Z","submitted_at":"2019-02-13T19:34:07Z","title":"DeeperLab: Single-Shot Image Parser","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.05093","snapshot_observed_at":"2026-08-14T11:06:43.161783Z","title":"Deeperlab: Single-shot image parser","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.161783Z"},"links":{"cited_paper":"/paper/1902.05093","citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:7a6b81a96b72c9e8114aea33177b476a30f65f6516f3b821b5d04fe895f46f8b","observation_id":"3144ddb5-5bfd-41f5-ab2d-85853014ecd8","resolution":{"observed_at":"2026-08-14T11:06:43.161783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.610348Z","title":"Learning feature pyramids for human pose estimation","venue":null,"work_id":"1854c1af-e938-4505-8fce-4a6593cda207","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.167000Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:3124f3a82fbd1735c01377b6a737cc330f910d192fa1a92514c2cf255fc006a3","observation_id":"ed25f7fd-fcf2-4be1-97ab-76ae666fe229","resolution":{"observed_at":"2026-08-14T11:06:43.615730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.592275Z","title":"Describing the scene as a whole: Joint object detection, scene classiﬁcation and semantic segmentation","venue":null,"work_id":"321aece7-6995-483a-ae0c-d0c924b5d8d7","year":2012},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.172840Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:dbedb5289f33473a9ddae6213f60aa93eb177cd0d57f442a3135cb0a70f01843","observation_id":"3fb2a490-8024-4a05-b152-4825eaec99a2","resolution":{"observed_at":"2026-08-14T11:06:43.598064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.574103Z","title":"Bisenet: Bilateral segmenta- tion network for real-time semantic segmentation","venue":null,"work_id":"295f664e-a950-452d-8e68-ec2681579f06","year":null},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.178038Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:dbfc89544404d33ff6cfed5a3e0fda63d637fcc4b5a9ccd532b9f66141e57df7","observation_id":"99ee4cfb-8e20-4d5c-8bda-572ca21d4927","resolution":{"observed_at":"2026-08-14T11:06:43.580390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.556043Z","title":"Learning a discriminative feature network for semantic segmentation","venue":null,"work_id":"f3e91644-9cdb-4f07-8418-464b40f7625e","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.183595Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:817fb8ceee48a46963d8fa72e46e6544fe3742caeea1a93ede49da314fd73dae","observation_id":"12653c1b-4c90-48d0-8ded-c864361b1182","resolution":{"observed_at":"2026-08-14T11:06:43.561439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.540350Z","title":"Con- text encoding for semantic segmentation","venue":null,"work_id":"be5e3c07-b1e3-4ccc-a77c-332a84fc02f8","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.188304Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:f06e45ada8f57581818141484d13eea97403968ac0c7567f82cdcb8b1dfe4b6d","observation_id":"0a0eb702-10f0-4cf9-a633-b3b2bbbc7369","resolution":{"observed_at":"2026-08-14T11:06:43.545426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.522478Z","title":"Scale-adaptive convolutions for scene pars- ing","venue":null,"work_id":"1b21626a-31b6-4991-a0cf-b5885ae9570b","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.192685Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:495cd024ed4a692e364a68796dc34f583d5db61aaa917f6a2adb5db7fc727884","observation_id":"6ec02bae-c236-4ff7-bcef-0546ddce5e27","resolution":{"observed_at":"2026-08-14T11:06:43.528215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.503205Z","title":"Exfuse: Enhancing feature fusion for semantic segmentation","venue":null,"work_id":"0de68f3d-834c-4c52-95d2-467c6ec1f5c6","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.197436Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:c4cdcb03e3afe1e3015846aee6610d7b2f165975afe1807bcf37b9b450bced1f","observation_id":"d5435bf1-a559-4da5-9764-b606c84bd5cf","resolution":{"observed_at":"2026-08-14T11:06:43.508666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.486794Z","title":"Pyramid scene parsing network","venue":null,"work_id":"f24d4bc8-5eb6-4ddd-a813-aae5c7bfb5a9","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.202374Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:86fbbbd70b352b3db46db95ae5b63404bfa14bc813c13a1d90af7dc8eaa515a8","observation_id":"acd83ef1-5e92-413d-ac9d-691c2248cdd0","resolution":{"observed_at":"2026-08-14T11:06:43.491820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.470194Z","title":"Psanet: Point-wise spatial attention network for scene parsing","venue":null,"work_id":"0f46bf20-3304-4fb2-9648-e37d4f79e661","year":2018},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.206813Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:05ca5c7188c5f435ddae07733679e6d4163e3326b60894f6c86a139152cdaab9","observation_id":"ad70780d-9d9c-4c92-986f-4202af5c00e0","resolution":{"observed_at":"2026-08-14T11:06:43.475284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.453633Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":"94cc3352-8ff1-41f4-8dc3-6fc097e841be","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.211441Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:3e30e725104f320a03454548b1a56f88894e6844331bbb97e9f2b212e846370a","observation_id":"6441677d-8d9e-4b6b-abdd-949f1e76dc20","resolution":{"observed_at":"2026-08-14T11:06:43.458787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:06:43.437478Z","title":null,"venue":null,"work_id":"8ca17986-3f0d-4d1f-9599-955955e79618","year":2017},"citing_paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T11:06:43.215941Z"},"links":{"citing_paper":"/paper/1908.09798"},"observation_digest":"sha256:8bcb8fa749f4e5d3be5053c8c95bda14b13642eb2c0ddeaf986ca4d97d300404","observation_id":"9ac824cf-e630-4512-97e7-eddea446b249","resolution":{"observed_at":"2026-08-14T11:06:43.442700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.09798","last_updated":"2019-08-26T16:58:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T21:34:23.060516Z","submitted_at":"2019-08-26T16:58:12Z","title":"SPGNet: Semantic Prediction Guidance for Scene Parsing"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":62},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 0 inbound Pith citation observations for arXiv:1908.09798."}