{"as_of":"2026-08-16T14:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f93b5eb31f2ab422191b57a60fac6d3398f95b746cb0fa1ccfbb8c0f977f19c","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:42:20.427601Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:38:41.735094Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T08:06:06.195097Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"cited_work":{"arxiv_id":"1908.04577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.04577","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the Thirteenth Language Resources and Evalua- tion Conference, pages 2682–2692, Marseille, France","venue":null,"work_id":"367b79a1-2480-4fb7-9fc3-33f0d6a31e3f","year":2023},"citing_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T04:50:53.587891Z"},"links":{"cited_paper":"/paper/1908.04577","citing_paper":"/paper/2006.03654"},"observation_digest":"sha256:b6485df20032d9d19ecea88e7b0d2f60d8a7775c16098385268cf4b0ec617b94","observation_id":"6dcf605b-d1ea-4ff6-94d8-338b6c96991c","resolution":{"observed_at":"2026-05-13T04:50:53.675100Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04577","snapshot_observed_at":"2026-08-12T11:38:41.735094Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2411.18021","last_updated":"2024-11-27T03:31:14Z","snapshot_observed_at":"2026-08-14T07:03:54.615910Z","submitted_at":"2024-11-27T03:31:14Z","title":"Can bidirectional encoder become the ultimate winner for downstream applications of foundation models?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:38:41.735094Z"},"links":{"cited_paper":"/paper/1908.04577","citing_paper":"/paper/2411.18021"},"observation_digest":"sha256:ed0b1ee564dcb8404f11f8ed8c085f784ee99d64d2e1a7a05e5d7b2910698d23","observation_id":"333908a3-a03c-40c8-b0e9-5d4422190e91","resolution":{"observed_at":"2026-08-12T11:38:41.735094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"cited_work":{"arxiv_id":"1908.04577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.04577","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the Thirteenth Language Resources and Evalua- tion Conference, pages 2682–2692, Marseille, France","venue":null,"work_id":"367b79a1-2480-4fb7-9fc3-33f0d6a31e3f","year":2023},"citing_paper":{"arxiv_id":"2510.11233","last_updated":"2026-05-11T14:44:29Z","snapshot_observed_at":"2026-08-03T18:20:24.973119Z","submitted_at":"2025-10-13T10:14:18Z","title":"CNSocialDepress: A Chinese Social Media Dataset for Depression Risk Detection and Structured Analysis","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T08:03:18.399139Z"},"links":{"cited_paper":"/paper/1908.04577","citing_paper":"/paper/2510.11233"},"observation_digest":"sha256:1c44bee4a45f494c03286afcb3be209abe675a1ce59c5acd97eb046d0e0cfcc6","observation_id":"13a74964-6292-4fdd-aebe-8c075ba61a1e","resolution":{"observed_at":"2026-05-18T08:06:06.200840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.04577/citation-record","integrity":"/paper/1908.04577/integrity","json":"/paper/1908.04577/citation-record.json","paper":"/paper/1908.04577"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.825849Z","title":"The ﬁfth pascal recognizing textual entailment challenge","venue":null,"work_id":"188302da-3433-4c3c-b407-7eeb017b30ac","year":2009},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.298109Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:cbbb430d5e5292ec3d6748e0f284d2ae42afe42b5a689e6def7341ddb9a22ef6","observation_id":"bea6b3ad-1e7f-4b6a-b413-540ece6daba9","resolution":{"observed_at":"2026-08-14T13:42:20.830797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.815016Z","title":"A bottom-up approach to sentence ordering for multi-document summarization","venue":null,"work_id":"f90797a7-05a8-4718-9c8e-2f04c8cb1b18","year":2010},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.302627Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:12d34af970f6fa081f4d408135b70699ffa0c6b0ee630e71d47eaa1d182efefa","observation_id":"f8ecdf63-2514-461c-8d7a-a622d15f7f8b","resolution":{"observed_at":"2026-08-14T13:42:20.818820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.05326","last_updated":"2015-08-21T16:17:01Z","snapshot_observed_at":"2026-08-15T14:12:50.248453Z","submitted_at":"2015-08-21T16:17:01Z","title":"A large annotated corpus for learning natural language inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.05326","snapshot_observed_at":"2026-08-14T13:42:20.306521Z","title":"A large annotated corpus for learning natural language inference","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.306521Z"},"links":{"cited_paper":"/paper/1508.05326","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:c7603c4a244a116f1cee6cddb731225ac63420290a6ec8e2a780a6123005a655","observation_id":"64755cd8-e80f-4072-90b8-7f6343c3eecc","resolution":{"observed_at":"2026-08-14T13:42:20.306521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00055","last_updated":"2017-07-31T20:12:06Z","snapshot_observed_at":"2026-08-14T20:44:07.152809Z","submitted_at":"2017-07-31T20:12:06Z","title":"SemEval-2017 Task 1: Semantic Textual Similarity - Multilingual and Cross-lingual Focused Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00055","snapshot_observed_at":"2026-08-14T13:42:20.310917Z","title":"Semeval-2017 task 1: Semantic textual similarity-multilingual and cross-lingual focused evaluation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.310917Z"},"links":{"cited_paper":"/paper/1708.00055","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:c2a3a91f24252943a6c531643aca3d4b0b71a54c6e8175e7476dad367181f419","observation_id":"482713ee-696d-44b6-a5b9-de79540f6eac","resolution":{"observed_at":"2026-08-14T13:42:20.310917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06952","last_updated":"2016-07-23T16:22:23Z","snapshot_observed_at":"2026-08-14T21:47:07.384474Z","submitted_at":"2016-07-23T16:22:23Z","title":"Neural Sentence Ordering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06952","snapshot_observed_at":"2026-08-14T13:42:20.315484Z","title":"Neural sentence ordering","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.315484Z"},"links":{"cited_paper":"/paper/1607.06952","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:e0a8e8da97ca355222667bc812ed957a356842403682ecffd76d61569a82c51a","observation_id":"93ff61b1-dac3-4a29-a73f-07863c4c33ec","resolution":{"observed_at":"2026-08-14T13:42:20.315484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-14T13:42:20.319452Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.319452Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:8273c249d9ae5f57789a54a005341a35c7a1b2cb5977e58b9dce9b6ff9d4c91c","observation_id":"a6aacfbf-e12c-42f0-b0c0-c68a17c78809","resolution":{"observed_at":"2026-08-14T13:42:20.319452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.323755Z","title":"Automatically constructing a corpus of sentential paraphrases","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.323755Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:fbf52cc31826bdc8413837ba0dbcb01ece79a3225757b5fc4db834ecc6f9be26","observation_id":"823d969e-0577-43b5-85c6-f98b19a7e702","resolution":{"observed_at":"2026-08-14T13:42:20.323755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.327410Z","title":"Finding structure in time","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.327410Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:ea978ad8c313b0087c1bc32575069f113e0dbfef94015d7092392a960654824c","observation_id":"49f2c672-9c1b-47c6-b7fc-d1f65b077a6b","resolution":{"observed_at":"2026-08-14T13:42:20.327410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.01809","last_updated":"2017-08-05T19:06:00Z","snapshot_observed_at":"2026-08-14T20:42:59.645587Z","submitted_at":"2017-08-05T19:06:00Z","title":"A Comparison of Neural Models for Word Ordering","version":1},"cited_work":{"arxiv_id":"1708.01809","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.01809","snapshot_observed_at":"2026-08-14T13:42:20.608166Z","title":"A Comparison of Neural Models for Word Ordering","venue":"cs.CL","work_id":"c78471e8-0863-4ab1-b513-ae7e2e594be9","year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.331104Z"},"links":{"cited_paper":"/paper/1708.01809","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:6806558833342f3363576df930b3cb97c5893578ba11fc054bf83b3b6ac4e384","observation_id":"3dd7c18f-f818-47ef-96cf-be85844a9356","resolution":{"observed_at":"2026-08-14T13:42:20.613789Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-14T13:42:20.335823Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.335823Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:4939bdd763b09d9a5b9ef69baef2c845c17553077265c682a87e849e8df51e95","observation_id":"1f7b813e-e2c0-4c10-a16d-7906e6e418ad","resolution":{"observed_at":"2026-08-14T13:42:20.335823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.339741Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.339741Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:5db9bced31026fbaca2e0823e18a77056b96a81fecd9292980abcc6aad40226b","observation_id":"69156bbe-85f9-46f0-9de6-a8c666727396","resolution":{"observed_at":"2026-08-14T13:42:20.339741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10529","last_updated":"2020-01-18T03:53:04Z","snapshot_observed_at":"2026-08-14T16:02:49.181771Z","submitted_at":"2019-07-24T15:43:40Z","title":"SpanBERT: Improving Pre-training by Representing and Predicting Spans","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10529","snapshot_observed_at":"2026-08-14T13:42:20.343418Z","title":"Spanbert: Improving pre-training by representing and predicting spans","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.343418Z"},"links":{"cited_paper":"/paper/1907.10529","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:e21dc747600d1b77ac30aea6729a1225ef17d7b21467f3eb3c023fc0b7b5e87b","observation_id":"9a0c267a-909b-4654-99e0-ada48203b61e","resolution":{"observed_at":"2026-08-14T13:42:20.343418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.784766Z","title":"The winograd schema challenge","venue":null,"work_id":"e8818fcc-d405-42ae-a7b9-d4b74b08149c","year":2012},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.347415Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:e1af1499bba6594cc4e9e0ccbd2d365c079749c9ecfd03846780b704cc1db6e1","observation_id":"17bbd402-c6b3-4449-9f28-93deffce6a65","resolution":{"observed_at":"2026-08-14T13:42:20.788333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-08-16T03:41:30.752370Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-14T13:42:20.351096Z","title":"Multi-task deep neural networks for natural language understanding","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.351096Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:bae4879b67568ee9c2c1471efcba6d3827ce8951fb69621003c8a283541859a2","observation_id":"59dc5ab3-1424-489f-8cc7-1ffbf8c86d7f","resolution":{"observed_at":"2026-08-14T13:42:20.351096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-14T13:42:20.354787Z","title":"RoBERTa: A robustly optimized BERT pretraining approach.arXiv preprint arXiv:1907.11692, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.354787Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:1e524feeb458fe8066849343393b8fa77fb74b16bb471274895fcf8ef0e3d19c","observation_id":"48b3c4aa-e5c5-4376-9009-350b33d16acc","resolution":{"observed_at":"2026-08-14T13:42:20.354787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.772576Z","title":"Learned in translation: Contextualized word vectors","venue":null,"work_id":"0bea8143-9302-40b1-b26e-201e1f78c59d","year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.358766Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:238f5e6e1dceb900fe9d0bdc8624c0efd3672596d3f7b5853e0f626b6b51a19d","observation_id":"6fe34c44-28eb-45e4-8448-b79f666655a0","resolution":{"observed_at":"2026-08-14T13:42:20.777652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.760832Z","title":"Recurrent neural network based language model","venue":null,"work_id":"3a6561a4-d282-45e4-a098-90ec611aa2fc","year":2010},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.362090Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:2a95bd78a03f8341d566017617c2be4efd08cec70959fa6daa62426b6be0dc60","observation_id":"c4dbae72-9114-43e0-9540-216ebe99fc03","resolution":{"observed_at":"2026-08-14T13:42:20.764757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05365","last_updated":"2018-03-22T21:59:40Z","snapshot_observed_at":"2026-08-14T19:45:43.957260Z","submitted_at":"2018-02-15T00:05:11Z","title":"Deep contextualized word representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05365","snapshot_observed_at":"2026-08-14T13:42:20.365475Z","title":"Deep contextualized word representations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.365475Z"},"links":{"cited_paper":"/paper/1802.05365","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:9e0e609928a522fbad00202792329d56cb73c3fc0686a426cb3e0d4e1234cce1","observation_id":"a6a1dfbd-a233-4bbe-9256-a6760d3f2779","resolution":{"observed_at":"2026-08-14T13:42:20.365475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.01088","last_updated":"2019-02-27T19:07:16Z","snapshot_observed_at":"2026-08-14T18:04:56.544241Z","submitted_at":"2018-11-02T21:04:24Z","title":"Sentence Encoders on STILTs: Supplementary Training on Intermediate Labeled-data Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.01088","snapshot_observed_at":"2026-08-14T13:42:20.369209Z","title":"Sentence encoders on stilts: Supplementary training on intermediate labeled-data tasks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.369209Z"},"links":{"cited_paper":"/paper/1811.01088","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:5e45b1b3dce94346d3afe38aacf0407545d77e1f08530d8bdddce04fee56ff38","observation_id":"fa910d7c-e0af-40c3-adf9-26ace9f9afd4","resolution":{"observed_at":"2026-08-14T13:42:20.369209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.749036Z","title":"Improving language under- standing by generative pre-training","venue":null,"work_id":"ad274584-3eff-4dce-afd9-bf25b5f65a6d","year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.373661Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:b4332bbd0f8ac7ac2e229df567de653768a12a68e7557852b0c99d2d42b777b9","observation_id":"937ad893-81a3-4d16-a1c4-ede075f5e8a7","resolution":{"observed_at":"2026-08-14T13:42:20.753104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-08-15T14:23:50.348670Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-14T13:42:20.377372Z","title":"Squad: 100,000+ questions for machine comprehension of text","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.377372Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:3b7ae9fec51086b9bb9122129af3774091376c4afee558bf81c90937da920075","observation_id":"76502a54-4a9d-46eb-bad0-6c4d2109d415","resolution":{"observed_at":"2026-08-14T13:42:20.377372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.736943Z","title":"Snorkel: Rapid training data creation with weak supervision","venue":null,"work_id":"2ba6fcc8-0c6e-4f66-9cb8-f98d334e2f33","year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.380897Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:f3b18d9a71d514452deb9bf0770cee10ca94d9ea4122d586745b34737c494ae7","observation_id":"eb2a8944-3250-457d-9dbd-eb97cc8cd601","resolution":{"observed_at":"2026-08-14T13:42:20.741156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.724571Z","title":"Building applied natural language generation systems","venue":null,"work_id":"63c0daf1-05d4-44c1-9fd0-e76a593a6468","year":1997},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.384303Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:aab1b9d887331d20bff4ca151cf87790d62d98339e4c5c64e9d72fe2dfb1f388","observation_id":"82361db7-c0ca-4851-bca8-96fd3781eecc","resolution":{"observed_at":"2026-08-14T13:42:20.728990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.08633","last_updated":"2016-09-24T03:41:45Z","snapshot_observed_at":"2026-08-14T21:59:37.219215Z","submitted_at":"2016-04-28T22:09:49Z","title":"Word Ordering Without Syntax","version":2},"cited_work":{"arxiv_id":"1604.08633","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.08633","snapshot_observed_at":"2026-08-14T13:42:20.518875Z","title":"Word Ordering Without Syntax","venue":"cs.CL","work_id":"b6b138eb-2088-4a36-8665-c689ea3643bd","year":2016},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.387891Z"},"links":{"cited_paper":"/paper/1604.08633","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:f1700a393cd8c9b60274ce395edd22be2266fd5eac147dcf3634ccdd969edc9c","observation_id":"f9416b5c-fb82-48e5-8750-30cd46ded4b8","resolution":{"observed_at":"2026-08-14T13:42:20.523860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.711592Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":"e91fedd8-3f5d-44ec-b04d-c4f99c084a55","year":2013},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.391597Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:85d578e92f60d99ac0a7c14e53094031862b7878d7c442aa53c007ca54b93f21","observation_id":"07def491-e731-44e4-8177-50e97d41a4dd","resolution":{"observed_at":"2026-08-14T13:42:20.716400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.395279Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.395279Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:86d4681b916839e57bc6103b1f1caecc4cacf4f532204f74af8e6a433dca641e","observation_id":"b32913f5-e388-4d0e-9cdf-ef83b7be7903","resolution":{"observed_at":"2026-08-14T13:42:20.395279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-08-16T09:50:11.319379Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-14T13:42:20.398817Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.398817Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:40d85bb964955eb45b90f18a19e02c89b2fe73b219a4ee79e54525151dfe531f","observation_id":"49268ad8-79ff-4979-9df5-9de1cc7957be","resolution":{"observed_at":"2026-08-14T13:42:20.398817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12471","last_updated":"2019-10-01T18:41:05Z","snapshot_observed_at":"2026-08-14T19:09:01.924152Z","submitted_at":"2018-05-31T13:52:06Z","title":"Neural Network Acceptability Judgments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12471","snapshot_observed_at":"2026-08-14T13:42:20.402688Z","title":"Neural network acceptability judgments.arXiv preprint arXiv:1805.12471, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.402688Z"},"links":{"cited_paper":"/paper/1805.12471","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:b8d262ede37f3c2507a2b0a2596a4b5e6549e82d8fe4a4756aec23ebcb072729","observation_id":"6d67b1f7-5ba4-4885-8734-c47f26d2f32b","resolution":{"observed_at":"2026-08-14T13:42:20.402688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.05426","last_updated":"2018-02-19T19:19:51Z","snapshot_observed_at":"2026-08-14T21:06:11.966218Z","submitted_at":"2017-04-18T17:10:13Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.05426","snapshot_observed_at":"2026-08-14T13:42:20.406742Z","title":"A broad-coverage challenge corpus for sentence understanding through inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.406742Z"},"links":{"cited_paper":"/paper/1704.05426","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:ddd99efab82d1bfb34fb68ab4ee781cc58a555f3c2df7b62d1269e213306943d","observation_id":"712f05a1-31dd-4ce2-a492-20f71f669158","resolution":{"observed_at":"2026-08-14T13:42:20.406742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-14T13:42:20.410370Z","title":"Google’s neural machine translation system: Bridging the gap between human and machine translation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.410370Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:958d7e77eeb494a9a7fda7d02fe12ab79096abf18fe767efb45ba48924064477","observation_id":"5eae3dd0-1539-4c84-bd71-b8810b565770","resolution":{"observed_at":"2026-08-14T13:42:20.410370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.691868Z","title":"Enhancing pre-trained language representations with rich knowledge for machine reading comprehension","venue":null,"work_id":"23195ceb-9614-4ec5-a856-2e28eb243a8b","year":2019},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.413954Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:5c4f114b2a77b3f0611f24d73134ac9a4f5bf9908991a43574fbacd1bfef59ed","observation_id":"a46087f4-d103-41d3-9d5e-252cc99f6f3e","resolution":{"observed_at":"2026-08-14T13:42:20.696005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08237","snapshot_observed_at":"2026-08-14T13:42:20.417154Z","title":"Xlnet: Generalized autoregressive pretraining for language understanding","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.417154Z"},"links":{"cited_paper":"/paper/1906.08237","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:71f26abe9901c27aef8fc0510f033a54a6aecba0fd0bf587101f35ef6822f1aa","observation_id":"b71e9937-6258-4aa1-882a-747646ee95bb","resolution":{"observed_at":"2026-08-14T13:42:20.417154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09541","last_updated":"2018-04-23T11:33:43Z","snapshot_observed_at":"2026-08-14T19:23:07.768012Z","submitted_at":"2018-04-23T11:33:43Z","title":"QANet: Combining Local Convolution with Global Self-Attention for Reading Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09541","snapshot_observed_at":"2026-08-14T13:42:20.420809Z","title":"Qanet: Combining local convolution with global self-attention for reading comprehension","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.420809Z"},"links":{"cited_paper":"/paper/1804.09541","citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:dbdbb9b8e16ecb57367d706554955f2f41190266d17ed1c3672b8bbf0af6a1fc","observation_id":"6a69984a-788b-4316-93e8-dca8370cb259","resolution":{"observed_at":"2026-08-14T13:42:20.420809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.680008Z","title":"Discriminative syntax-based word ordering for text generation","venue":null,"work_id":"2870038e-3a34-43b5-94cf-91da4dfe7377","year":2015},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.424332Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:d218cf243b8d98cf40ce2b64d1e1c996d527baa22dba881b28a75fb0e0f1255b","observation_id":"4a103c29-03d7-4498-ac20-bae922130934","resolution":{"observed_at":"2026-08-14T13:42:20.684088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:20.667199Z","title":"Aligning books and movies: Towards story-like visual explanations by watching movies and reading books","venue":null,"work_id":"8db384c2-b7a8-42a6-ab33-0db656a7a788","year":2015},"citing_paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:20.427601Z"},"links":{"citing_paper":"/paper/1908.04577"},"observation_digest":"sha256:72f6fa350fafc0bce8713cd8d8f970434e87712c42cf58f69d08a09dfd67fc77","observation_id":"c28b762a-f7f3-4868-bb0f-2ce47f0604a4","resolution":{"observed_at":"2026-08-14T13:42:20.672220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.04577","last_updated":"2019-09-27T05:44:38Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:21:49.539462Z","submitted_at":"2019-08-13T11:12:58Z","title":"StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":12},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 3 inbound Pith citation observations for arXiv:1908.04577."}