{"as_of":"2026-08-09T15:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b054de3e4d766cf4e5caff7af95b4eb57566144ee9cb7724736ec48b38a8ef06","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":53,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:34:56.926817Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":137,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T05:37:55.083206Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/1910.10683"},"observation_digest":"sha256:2f266e781457b59a6ad3e7183ce9a4d74c1a575b415d4d4a969eb7f6d4a60528","observation_id":"a234e4eb-ab96-46dd-a4c9-9c43c87b8efc","resolution":{"observed_at":"2026-05-12T05:37:55.651851Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2003.10555","last_updated":"2020-03-23T21:17:42Z","snapshot_observed_at":"2026-08-06T14:37:14.514749Z","submitted_at":"2020-03-23T21:17:42Z","title":"ELECTRA: Pre-training Text Encoders as Discriminators Rather Than Generators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T10:26:47.593122Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2003.10555"},"observation_digest":"sha256:9fba2f6f4463b9a3a39d43bbb03f3465fba57d676334d47b70e823ac5fae48da","observation_id":"2b8ff791-0b26-40cf-bf79-ab2754a1c3ff","resolution":{"observed_at":"2026-05-16T10:26:47.617548Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T12:05:38.045330Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2005.14165"},"observation_digest":"sha256:c7556b460597862bea7409f0008f7730320864111247dfee993baf365512485c","observation_id":"36c3ec85-5ea5-4e26-9610-5c824a9590d3","resolution":{"observed_at":"2026-05-10T12:05:38.246816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2101.02388","last_updated":"2021-01-07T06:12:28Z","snapshot_observed_at":"2026-07-06T10:30:38.112588Z","submitted_at":"2021-01-07T06:12:28Z","title":"Knowledge Distillation in Iterative Generative Models for Improved Sampling Speed","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T03:56:19.837017Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2101.02388"},"observation_digest":"sha256:3294a21e13d326838e7f4c4d170505cae821c61e220046d3783373f1b068c9b5","observation_id":"ea31a5b7-dd9b-4d75-b989-215bc7b9c7a7","resolution":{"observed_at":"2026-05-17T03:56:19.886797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T12:49:19.418548Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2111.09543"},"observation_digest":"sha256:2050b3784e340d21d8a1ef45c88a8b34c41531df338cd82eb58a81d37e9ce0bc","observation_id":"e602c5e8-4a61-423f-b148-b339287e4db1","resolution":{"observed_at":"2026-05-15T12:49:19.448400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-09T11:34:56.926817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.926817Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:fe9e615d2cc111eded6dfaef2d4698942222b49fe5d15fa6884d03a9363b0e9c","observation_id":"b2f779b1-5788-41e3-a593-46cebc98585b","resolution":{"observed_at":"2026-08-09T11:34:56.926817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-08T18:10:38.356476Z","title":"Tinybert: Distilling BERT for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.05738","last_updated":"2025-02-09T01:47:59Z","snapshot_observed_at":"2026-08-09T03:59:41.475264Z","submitted_at":"2025-02-09T01:47:59Z","title":"Performance Analysis of Traditional VQA Models Under Limited Computational Resources","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T18:10:38.356476Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.05738"},"observation_digest":"sha256:69fcf8a622bd2cdb00eff2d4a01881fcabab2d1267a6f754eb04dc254160ee24","observation_id":"d5d66f28-4c3d-4039-9f6d-cc525750cd45","resolution":{"observed_at":"2026-08-08T18:10:38.356476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-08T16:36:00.644229Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.06155","last_updated":"2025-02-17T07:08:23Z","snapshot_observed_at":"2026-08-08T23:56:20.438819Z","submitted_at":"2025-02-10T05:00:56Z","title":"Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T16:36:00.644229Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.06155"},"observation_digest":"sha256:a0cc4a8eea240eba9c670d7176c0703eec91d099e12acfb346932b00be5316e2","observation_id":"373c26d2-28b7-4781-a4cf-40710192aefa","resolution":{"observed_at":"2026-08-08T16:36:00.644229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-08T12:50:14.699745Z","title":"Tinybert: Distill- ing BERT for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.07436","last_updated":"2025-02-11T10:24:57Z","snapshot_observed_at":"2026-08-09T12:51:16.416704Z","submitted_at":"2025-02-11T10:24:57Z","title":"Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T12:50:14.699745Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.07436"},"observation_digest":"sha256:eefefc3bcc822cbc7950d4c76564f0d05e93e40c840b5db3e28cec2a8e9f1678","observation_id":"ce1c0edc-2323-4c8f-8410-c35cf4074639","resolution":{"observed_at":"2026-08-08T12:50:14.699745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-08T06:02:46.475725Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.08213","last_updated":"2025-02-12T08:48:55Z","snapshot_observed_at":"2026-08-09T06:36:06.237121Z","submitted_at":"2025-02-12T08:48:55Z","title":"LLM Modules: Knowledge Transfer from a Large to a Small Model using Enhanced Cross-Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T06:02:46.475725Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.08213"},"observation_digest":"sha256:cf454bd22f71e66f53ed46796cb2af6f4c9ea462e6553b4f5d46a9de64fb27b1","observation_id":"e7aa24e4-5d35-4d94-90f2-cb1c8ed7de4c","resolution":{"observed_at":"2026-08-08T06:02:46.475725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:b13561816a0b17851a7f99970bcd6c36fb0e9ad91e9ab0e6a237e7ea6876dcad","observation_id":"bc7090e6-5def-4587-8ef1-73c17f19c09e","resolution":{"observed_at":"2026-05-23T01:05:16.228134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-07T14:33:13.230569Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":195,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:13.230569Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:76f7e0ad5284f3a041b7d001aea309ee7a58c624ba8dad6ed317f9a3cc118ab1","observation_id":"d57dda93-a1ef-4eff-b830-5b3a76ccc711","resolution":{"observed_at":"2026-08-07T14:33:13.230569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-07T14:17:11.727608Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19529","last_updated":"2025-05-29T16:57:36Z","snapshot_observed_at":"2026-08-09T08:15:23.954663Z","submitted_at":"2025-05-26T05:29:47Z","title":"Small Language Models: Architectures, Techniques, Evaluation, Problems and Future Adaptation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.727608Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2505.19529"},"observation_digest":"sha256:16b628698b2c9bfe71eed52416c4ec9e7d7db29a5d0c8310e2656107065bfc77","observation_id":"b72f986e-e1fa-4137-948d-6f3944b454e4","resolution":{"observed_at":"2026-08-07T14:17:11.727608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-07T13:59:35.328167Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.20485","last_updated":"2025-06-30T19:20:31Z","snapshot_observed_at":"2026-08-07T22:25:20.793479Z","submitted_at":"2025-05-26T19:43:11Z","title":"Avoid Forgetting by Preserving Global Knowledge Gradients in Federated Learning with Non-IID Data","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:35.328167Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2505.20485"},"observation_digest":"sha256:aec1a433bc8c73398c58082a54b5d71425a28ad507ef9a388092c5d90e6b520c","observation_id":"413efbf6-1e51-488b-8506-895164dbe1c2","resolution":{"observed_at":"2026-08-07T13:59:35.328167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-07T13:58:00.809775Z","title":"TinyBERT:DistillingBERTfornaturallanguageunderstanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.23801","last_updated":"2025-05-26T20:58:13Z","snapshot_observed_at":"2026-08-09T15:14:17.388241Z","submitted_at":"2025-05-26T20:58:13Z","title":"SEMFED: Semantic-Aware Resource-Efficient Federated Learning for Heterogeneous NLP Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:00.809775Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2505.23801"},"observation_digest":"sha256:bc50d6d45337aa50fb8f63038069926c0b440fa2c6d4c427186401aaea7e1003","observation_id":"06505bbb-163b-41d9-ad26-d46938c17af7","resolution":{"observed_at":"2026-08-07T13:58:00.809775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-07T00:13:34.496625Z","title":"Tinybert: Distilling bert for natural language understanding.arXiv preprint arXiv:1909.10351, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.14728","last_updated":"2025-06-17T17:08:32Z","snapshot_observed_at":"2026-08-07T14:16:24.457276Z","submitted_at":"2025-06-17T17:08:32Z","title":"AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:34.496625Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2506.14728"},"observation_digest":"sha256:bda9d2e12ab4c2e6a9a74eeee492642b85c7645fb2a7c6477a64e1ac63f91d44","observation_id":"feab6543-dc02-436a-9418-2ff401b5f011","resolution":{"observed_at":"2026-08-07T00:13:34.496625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T23:28:09.248145Z","title":"Tinybert: Distill- ing bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.248145Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:71b0d4e43c50c0e5cba536fe13019c85063699aae8763c3524fc5b3c5b28ce03","observation_id":"4080a1aa-4628-45d0-86f8-72a82dbc1432","resolution":{"observed_at":"2026-08-06T23:28:09.248145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T21:16:14.869832Z","title":"Tinybert: Distilling bert for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.00672","last_updated":"2025-07-01T11:13:56Z","snapshot_observed_at":"2026-08-07T09:02:35.437888Z","submitted_at":"2025-07-01T11:13:56Z","title":"Toward Edge General Intelligence with Multiple-Large Language Model (Multi-LLM): Architecture, Trust, and Orchestration","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-06T21:16:14.869832Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.00672"},"observation_digest":"sha256:10f732b8ea4297864f9cc1693df80fa7c2ebee04ca038d0c8a67ca7dae8b2e3a","observation_id":"b0863a24-7ce6-402e-ad61-f9d56865dff2","resolution":{"observed_at":"2026-08-06T21:16:14.869832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T21:11:18.365225Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.01079","last_updated":"2025-07-01T15:12:14Z","snapshot_observed_at":"2026-08-07T22:22:25.146557Z","submitted_at":"2025-07-01T15:12:14Z","title":"MobileRAG: A Fast, Memory-Efficient, and Energy-Efficient Method for On-Device RAG","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.365225Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.01079"},"observation_digest":"sha256:560fbd7f5e6d9dd61972d899eaea32e9819bede417c067de9837c8abce46ee86","observation_id":"51299067-fb77-4527-87fd-a9989287bef0","resolution":{"observed_at":"2026-08-06T21:11:18.365225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T15:42:59.790511Z","title":"TinyBERT: distilling BERT for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.15198","last_updated":"2025-07-21T02:55:33Z","snapshot_observed_at":"2026-08-09T15:30:26.524355Z","submitted_at":"2025-07-21T02:55:33Z","title":"Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:59.790511Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.15198"},"observation_digest":"sha256:a25ebc06fbd63c5c7a0d2e805962e901e70b24e8af24714b5b0ed886547f0116","observation_id":"f213d2be-3a68-4035-8326-733f47f762ef","resolution":{"observed_at":"2026-08-06T15:42:59.790511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T13:22:45.689017Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20749","last_updated":"2025-07-28T11:57:52Z","snapshot_observed_at":"2026-08-08T16:13:24.324121Z","submitted_at":"2025-07-28T11:57:52Z","title":"Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:22:45.689017Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.20749"},"observation_digest":"sha256:d6c42cafe01727cbe28b94116ce1f9930065a025065ac57b0f98bcfe0cda8a7a","observation_id":"1830bc6a-bdb2-4108-8f5a-0332b13c47ad","resolution":{"observed_at":"2026-08-06T13:22:45.689017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T10:52:31.903894Z","title":"Tinybert: Distill- ing bert for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.23404","last_updated":"2025-07-31T10:18:28Z","snapshot_observed_at":"2026-08-09T10:37:44.262522Z","submitted_at":"2025-07-31T10:18:28Z","title":"Enhanced Arabic Text Retrieval with Attentive Relevance Scoring","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:52:31.903894Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2507.23404"},"observation_digest":"sha256:84f908d2e4352c4ad73585b53be95fb1db2739d793ea976d30a06a43a73ce57b","observation_id":"210e109c-ec36-4528-9e09-d2ffdadc1c6c","resolution":{"observed_at":"2026-08-06T10:52:31.903894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T11:27:32.267226Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.02840","last_updated":"2025-08-08T02:51:44Z","snapshot_observed_at":"2026-08-08T14:33:53.469238Z","submitted_at":"2025-07-30T13:55:28Z","title":"Resource-Efficient Automatic Software Vulnerability Assessment via Knowledge Distillation and Particle Swarm Optimization","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T11:27:32.267226Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2508.02840"},"observation_digest":"sha256:b58125075124a56417ec9d627738bb171d2cb99db543157b4a5c2e640a7ad36f","observation_id":"858073bb-8429-478c-91b5-ebf573f0bb11","resolution":{"observed_at":"2026-08-06T11:27:32.267226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2508.03949","last_updated":"2026-04-14T17:16:30Z","snapshot_observed_at":"2026-08-04T01:34:07.529496Z","submitted_at":"2025-08-05T22:32:32Z","title":"Model Compression vs. Adversarial Robustness: An Empirical Study on Language Models for Code","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-19T00:01:42.228190Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2508.03949"},"observation_digest":"sha256:763688089e455ebd4ca19b132b2e50c299eb84d57c5ac27152a527edb0e663df","observation_id":"50948628-fe2d-49e4-9389-c22a0c660fab","resolution":{"observed_at":"2026-05-19T00:01:55.886217Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T23:54:24.707388Z","title":"Tinybert: Distilling bert for natural language understand- ing,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:24.707388Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:4ede2fb94b9295d908e3d71239a9cd0a3ee8aa70b0d0ef3862a08048fcff995d","observation_id":"0da92d69-bef4-4ab0-bc68-d82858b0e5ab","resolution":{"observed_at":"2026-08-05T23:54:24.707388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T17:36:35.500315Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2508.16050","last_updated":"2025-08-22T02:57:13Z","snapshot_observed_at":"2026-08-07T22:22:24.583361Z","submitted_at":"2025-08-22T02:57:13Z","title":"Expandable Residual Approximation for Knowledge Distillation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T17:36:35.500315Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2508.16050"},"observation_digest":"sha256:d353a099dcb06c4fd2d994987a42f3f5447ed72c0e74a98374ea2fc3f50059ef","observation_id":"d8128c1a-2a38-4318-bbd4-2abaaddc6114","resolution":{"observed_at":"2026-08-05T17:36:35.500315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T17:14:33.745393Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00039","last_updated":"2025-08-23T04:52:20Z","snapshot_observed_at":"2026-08-05T17:14:31.271503Z","submitted_at":"2025-08-23T04:52:20Z","title":"AMMKD: Adaptive Multimodal Multi-teacher Distillation for Lightweight Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:14:33.745393Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2509.00039"},"observation_digest":"sha256:f963a7c595511f45875d014a7ddfd5da256b2ca29369c172724c88573bf22f34","observation_id":"d237722c-20c3-403a-ac7a-1da6da367d4c","resolution":{"observed_at":"2026-08-05T17:14:33.745393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T10:52:45.911394Z","title":"Tinybert: Distilling bert for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.03610","last_updated":"2025-09-03T18:05:42Z","snapshot_observed_at":"2026-08-09T12:31:09.855352Z","submitted_at":"2025-09-03T18:05:42Z","title":"NoteBar: An AI-Assisted Note-Taking System for Personal Knowledge Management","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:52:45.911394Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2509.03610"},"observation_digest":"sha256:da23163d09f029191131fef9a2f234007983004e0e0a4c9fc5accd7cd9b03171","observation_id":"b7aeb654-9cd3-46e7-83dc-de4c244da4c5","resolution":{"observed_at":"2026-08-05T10:52:45.911394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2509.11443","last_updated":"2025-09-14T21:36:24Z","snapshot_observed_at":"2026-08-02T23:21:16.687714Z","submitted_at":"2025-09-14T21:36:24Z","title":"A Transformer-Based Cross-Platform Analysis of Public Discourse on the 15-Minute City Paradigm","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T16:15:01.855868Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2509.11443"},"observation_digest":"sha256:142c29b1d59b3493e7d27cdfdc9da11b18111f50f08402f6b4d11eee996f593a","observation_id":"e6bbc0f2-1356-4fd9-a4f1-857604417b4e","resolution":{"observed_at":"2026-05-18T16:16:36.217715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-04T08:22:13.706114Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.21364","last_updated":"2026-06-01T11:38:51Z","snapshot_observed_at":"2026-08-07T10:09:07.484130Z","submitted_at":"2025-10-24T11:48:49Z","title":"SindBERT, the Sailor: Charting the Seas of Turkish NLP","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T08:22:13.706114Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2510.21364"},"observation_digest":"sha256:a77f27a6321afc1b897f22fe718932de4fd0fa7a6e45fd7bf452dbe8264a8a86","observation_id":"87a1f58e-ccfe-468b-b62d-2d466a45d9e4","resolution":{"observed_at":"2026-08-04T08:22:13.706114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2511.05476","last_updated":"2026-05-11T16:45:40Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-07T18:38:54Z","title":"A Metamorphic Testing Perspective on Knowledge Distillation for Language Models of Code: Does the Student Deeply Mimic the Teacher?","version":5},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-17T23:45:54.490984Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2511.05476"},"observation_digest":"sha256:a20214b8338ff7ac672968ca7078b34dd8677dd20815122ec86a1d61bc543bda","observation_id":"08ab6e3d-1215-4d0b-9214-ffffe228da45","resolution":{"observed_at":"2026-05-17T23:50:31.910688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-03T03:13:22.046513Z","title":"Tinybert: Distilling bert for natural language understanding.arXiv preprint arXiv:1909.10351, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2602.08923","last_updated":"2026-07-07T20:21:24Z","snapshot_observed_at":"2026-08-08T01:05:15.308832Z","submitted_at":"2026-02-09T17:25:37Z","title":"DynamiQ: Accelerating Gradient Synchronization using Compressed Multi-hop All-reduce","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T03:13:22.046513Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2602.08923"},"observation_digest":"sha256:3efb1e73f4c3f31486f22071f9e2a7f8b0f72a2490b90e151e70b5e7d6405781","observation_id":"e81fdd76-2874-486f-8294-cf930d67f605","resolution":{"observed_at":"2026-08-03T03:13:22.046513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-03T03:04:21.095337Z","title":"Tinybert: Distilling bert for natural language understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2602.22229","last_updated":"2026-07-28T17:21:05Z","snapshot_observed_at":"2026-08-09T06:25:45.642133Z","submitted_at":"2026-02-10T02:55:10Z","title":"FHECore: Rethinking GPU Microarchitecture for Fully Homomorphic Encryption","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:21.095337Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2602.22229"},"observation_digest":"sha256:bebbd5c98fad6e6e85e49ddcd2b3a9327c1fa5d9eefc98f3781404eeddf931ac","observation_id":"b19253c8-5427-456c-bcc5-96d4f0c1992e","resolution":{"observed_at":"2026-08-03T03:04:21.095337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2604.08028","last_updated":"2026-04-09T09:30:04Z","snapshot_observed_at":"2026-07-06T22:57:13.745326Z","submitted_at":"2026-04-09T09:30:04Z","title":"A Comparative Study of Semantic Log Representations for Software Log-based Anomaly Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:08:20.298349Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2604.08028"},"observation_digest":"sha256:9443b919be3f3512a77d6ed35262634c2608fee0be3add77e92e59ee56f1ddf7","observation_id":"b05ea3eb-6ec7-4d2f-95e4-85934b8466e8","resolution":{"observed_at":"2026-05-11T05:25:59.667742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2604.18146","last_updated":"2026-04-21T07:16:41Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T12:08:58Z","title":"Modular Representation Compression: Adapting LLMs for Efficient and Effective Recommendations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T04:09:10.125285Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2604.18146"},"observation_digest":"sha256:5bd2d59f0b60a078cf6e33e03358c0bbfacf73f0913f8f681af2add841d08c32","observation_id":"96155bb0-3b50-42ec-8494-a2a28fc3ce7e","resolution":{"observed_at":"2026-05-11T12:06:04.762349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2604.18452","last_updated":"2026-04-20T16:10:28Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T16:10:28Z","title":"ESsEN: Training Compact Discriminative Vision-Language Transformers in a Low-Resource Setting","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-10T04:28:38.775948Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2604.18452"},"observation_digest":"sha256:07a3c479b44cdf9d9e2cd215ff6cc8908964be29aaea73d0ac49f8cb0e05b183","observation_id":"25f667af-963c-44d0-94c7-a96028d9ad73","resolution":{"observed_at":"2026-05-11T11:56:18.735494Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2604.18939","last_updated":"2026-04-21T00:25:49Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:25:49Z","title":"TabEmb: Joint Semantic-Structure Embedding for Table Annotation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-10T03:18:46.913340Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2604.18939"},"observation_digest":"sha256:26561824f4d60949ff4625e627310c071f476b162ca742f97e20b8e1d334a127","observation_id":"66b9c556-8e2a-470e-9d30-7d28d44f40b7","resolution":{"observed_at":"2026-05-11T12:41:02.293181Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.01205","last_updated":"2026-06-02T04:37:07Z","snapshot_observed_at":"2026-08-01T09:43:25.643391Z","submitted_at":"2026-05-02T02:44:12Z","title":"SRA: Span Representation Alignment for Large Language Model Distillation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-09T15:22:14.289423Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.01205"},"observation_digest":"sha256:2888f5ca483fa3993df588ae6213728abe178126c863f21aaf083d9fdce39b46","observation_id":"982c30a7-9243-462e-94c6-e5a1760b57e7","resolution":{"observed_at":"2026-05-11T16:41:15.928397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.01374","last_updated":"2026-06-02T09:16:00Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T10:52:49Z","title":"MTA: Multi-Granular Trajectory Alignment for Large Language Model Distillation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-09T14:55:26.285575Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.01374"},"observation_digest":"sha256:75fba5cdf3039e002f550874bea387ac50b8aaf768c7dd695ee2fbfa9b21e05f","observation_id":"65cc1a51-536f-4b18-8c49-1fafad3490d1","resolution":{"observed_at":"2026-05-11T16:51:05.530831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.01374","last_updated":"2026-06-02T09:16:00Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T10:52:49Z","title":"MTA: Multi-Granular Trajectory Alignment for Large Language Model Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T00:30:26.371099Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.01374"},"observation_digest":"sha256:cedb00c5c6c998fe4f45eb2eea833265d15fb77ac1f0d9c4e1b9b418e1d93147","observation_id":"37118c6b-3d65-4292-bb06-05684e865599","resolution":{"observed_at":"2026-07-01T00:35:10.324216Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.13421","last_updated":"2026-05-13T12:16:04Z","snapshot_observed_at":"2026-08-02T23:49:37.821677Z","submitted_at":"2026-05-13T12:16:04Z","title":"Combining pre-trained models via localized model averaging","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-05-14T17:56:34.111280Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.13421"},"observation_digest":"sha256:6a9fbbab44f3f8781a6b2be3d88dbdef0840537612930d14307b97b76ca7631e","observation_id":"bd571544-d7bf-4504-8218-fcae17f48a5a","resolution":{"observed_at":"2026-05-14T17:57:33.001244Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.13859","last_updated":"2026-04-14T09:57:15Z","snapshot_observed_at":"2026-07-06T23:25:21.032938Z","submitted_at":"2026-04-14T09:57:15Z","title":"BiSpikCLM: A Spiking Language Model integrating Softmax-Free Spiking Attention and Spike-Aware Alignment Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T07:11:46.177353Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.13859"},"observation_digest":"sha256:18c7aa21aea4091b0de1074c9923b9d52312f7dab03ed792b62bcd867cf64b62","observation_id":"5383e0ad-9bee-4442-a9b1-b14883139966","resolution":{"observed_at":"2026-05-15T07:15:11.707359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.19842","last_updated":"2026-05-19T13:37:53Z","snapshot_observed_at":"2026-07-06T23:30:30.141040Z","submitted_at":"2026-05-19T13:37:53Z","title":"Fast Tensorization of Neural Networks via Slice-wise Feature Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T06:53:09.576838Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.19842"},"observation_digest":"sha256:f0c20d7319868dc2833398dd10cd6c2a43d6f9e12b9004206a5b0c0dd2c1ea66","observation_id":"0972ee65-ebb9-416a-9456-b21e26496ef5","resolution":{"observed_at":"2026-05-20T06:53:22.956232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.24667","last_updated":"2026-05-23T17:10:20Z","snapshot_observed_at":"2026-08-01T07:37:33.980490Z","submitted_at":"2026-05-23T17:10:20Z","title":"When Mean CE Fails: Median CE Can Better Track Language Model Quality","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T13:23:55.114628Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.24667"},"observation_digest":"sha256:12907a37990398bafd08fac20584b611f685dd2d2bdaeb5e9fe52fdacf684cfa","observation_id":"4582d3fa-d37a-48e4-8a69-d02152f30f1f","resolution":{"observed_at":"2026-06-30T13:24:39.948088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2605.30448","last_updated":"2026-05-28T18:19:32Z","snapshot_observed_at":"2026-08-04T19:41:17.357990Z","submitted_at":"2026-05-28T18:19:32Z","title":"Bounded Behavioral Indistinguishability for Black-Box LLM Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T08:50:41.083288Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2605.30448"},"observation_digest":"sha256:e85617c5262adeafa59ff42c418330843abb088b85cd8a93f33b9d6ebaa21600","observation_id":"9a691f3c-2803-4f4c-9062-949e31d62082","resolution":{"observed_at":"2026-06-29T08:53:15.420960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.04032","last_updated":"2026-06-04T17:08:43Z","snapshot_observed_at":"2026-07-06T23:44:14.261541Z","submitted_at":"2026-06-01T20:59:05Z","title":"Do Transformers Need Three Projections? Systematic Study of QKV Variants","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-28T15:14:49.475561Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.04032"},"observation_digest":"sha256:cf1796d28307e029702f01ad3fc4a7a9ef129dc83785bf5f98ff05fb13f97681","observation_id":"101f88cd-8ca6-46fd-8d10-41e327910293","resolution":{"observed_at":"2026-07-01T22:36:17.296567Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.05429","last_updated":"2026-06-03T20:51:52Z","snapshot_observed_at":"2026-08-06T01:16:12.101022Z","submitted_at":"2026-06-03T20:51:52Z","title":"Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T06:09:42.838355Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.05429"},"observation_digest":"sha256:ad9ec0d1c44302a2210d0db5111e0cbdf70a8568a6aa6696b8f8c5f22ea4e571","observation_id":"8b7baf1f-7b74-4503-b001-f22cd9be71ac","resolution":{"observed_at":"2026-07-02T08:16:48.231919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.09401","last_updated":"2026-06-08T12:21:02Z","snapshot_observed_at":"2026-07-06T23:48:44.159537Z","submitted_at":"2026-06-08T12:21:02Z","title":"Benchmarking Empirical Privacy Protection for Adaptations of Large Language Models","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-06-27T17:13:46.335347Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.09401"},"observation_digest":"sha256:eb0986b3c22f5a42144809f4cab8078588baf7832dfdd715534038db4fd971df","observation_id":"92c8bb65-0867-4c60-a7f2-1002beef1905","resolution":{"observed_at":"2026-07-03T00:27:29.554567Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.09881","last_updated":"2026-06-03T05:44:29Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-03T05:44:29Z","title":"Toward Calibrated, Fair, and accurate Deepfake Detection","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-28T07:05:18.026601Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.09881"},"observation_digest":"sha256:d712074fc4fdee0ff1bfec750f89a3b7168496a63317f216aa9aff7b98765606","observation_id":"b8452aba-1e81-4f52-a05e-fcd27ad94a34","resolution":{"observed_at":"2026-06-28T07:11:45.313693Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.21851","last_updated":"2026-06-20T03:17:29Z","snapshot_observed_at":"2026-08-08T12:39:19.298375Z","submitted_at":"2026-06-20T03:17:29Z","title":"TALAS: Teacher-Anchored Layer Alignment with Adaptive Sharpness-Aware Minimization for Embedding Distillation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T12:18:01.779039Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.21851"},"observation_digest":"sha256:d331675397e184c1e2c8a67d106af57a66696b2243841b8d8fb63c6a2b9397e3","observation_id":"b9da8958-fc6c-43ac-9bc2-c410d7e443c2","resolution":{"observed_at":"2026-07-04T07:59:40.474904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.23919","last_updated":"2026-06-22T20:32:47Z","snapshot_observed_at":"2026-08-08T18:36:41.952502Z","submitted_at":"2026-06-22T20:32:47Z","title":"Unified Multi-Task Relevance Modeling for E-Commerce: Comparing Task Routing Architectures Across LLMs and Cross-Encoders","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T06:08:27.696658Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.23919"},"observation_digest":"sha256:1b2df56734cc674654f0bde1e1b7378243b5c77043e5411ae2a3fca24d7b07d5","observation_id":"c2e91149-e5b7-4028-a0bc-ac0aa346ec15","resolution":{"observed_at":"2026-07-04T12:49:51.880172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2606.28386","last_updated":"2026-06-22T17:06:05Z","snapshot_observed_at":"2026-08-02T11:08:25.094268Z","submitted_at":"2026-06-22T17:06:05Z","title":"Data Provenance for Image Auto-Regressive Generation","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-06-30T10:28:59.577056Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2606.28386"},"observation_digest":"sha256:f55bb8aadba1f060f375f422b9f26e81ad28ff18cc296f27600e9643b82bdffb","observation_id":"93f2dabb-d093-45ba-a4b3-d0f97a909f9c","resolution":{"observed_at":"2026-06-30T10:34:36.631239Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":"1909.10351","doi":"10.48550/arxiv.1909.10351","metadata_source":"arxiv_reference","pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":"arXiv (Cornell University)","work_id":"40d9fbb8-3c66-44bf-955c-5b5560f1e2f8","year":1909},"citing_paper":{"arxiv_id":"2607.00382","last_updated":"2026-07-01T03:26:41Z","snapshot_observed_at":"2026-08-09T02:16:51.705909Z","submitted_at":"2026-07-01T03:26:41Z","title":"Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-02T15:03:00.874505Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2607.00382"},"observation_digest":"sha256:ab587f4142326abcac75331878c00855b423f3a5e66d3bf9198c2cdde9cc6d38","observation_id":"404ba290-802b-4ef5-9456-d52bc53c03e5","resolution":{"observed_at":"2026-07-02T15:07:03.975713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.10351/citation-record","integrity":"/paper/1909.10351/integrity","json":"/paper/1909.10351/citation-record.json","paper":"/paper/1909.10351"},"outbound":[],"paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 53 inbound Pith citation observations for arXiv:1909.10351."}